跳到正文

OpenAI / ChatGPT

OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。

当前仅显示精选新闻

最新精选

第 21–40 条 · 共 523 条
10月2日周五
  1. AYi80

    Karpathy 发推分享理解大语言模型输出的技巧:让模型用受控语言 ASD-STE100 写作,或改用图表、交互 HTML 页面输出,他最看好为任意主题生成 3b1b 风格的自定义解释视频(可用 ElevenLabs API key 配旁白)。他认为随着 LLM 自主完成更多执行工作,人类工作将上移到监督与理解层面,且可以要求模型生成用后即弃的定制软件制品。作者阿易转述并解读了这条推文。

    引用Andrej Karpathy@karpathy

    We'll be spending a lot more time trying to understand the outputs of language models. A few thoughts, tips & tricks: Writing. Something I've had success with: Ask your LLM to explain something in ASD-STE100, it's a controlled language specification originally developed for aerospace maintenance documentation. LLMs well-versed in this language and it comes with heavy constraints on clean writing style that I often find a lot more readable. Sometimes I've tried to soften it a bit e.g. ask for "80% of the way to ASD-STE100" because the spec is quite stringent. But even better: Diagrams / images. Instead of writing, ask your LLM to create a diagram. These can be a lot easier to process, parse, and understand. But even better: Web pages. Ask for output "in HTML" to get a beautiful, interactive webpage. LLMs are getting really good at frontend and can create beautiful experiences, animations, etc. But even better: Explainer videos. The output format I am most bullish on is fully custom / bespoke explainer videos generated on any arbitrary topic. Experiment with things like "Create a 3b1b style video explainer on X. Use my ElevenLabs API key for audio narration". (you'd need an API key for the latter or you can ask your LLM to find you decent free alternatives that use your local compute). This is actually starting to work! In summary: - As LLMs get better, they will do more and more of the legwork autonomously, and a lot more of our work will rise up the abstractions into oversight and understanding. - Luckily, LLMs can help here too because as intelligence and code are increasingly abundant, you can ask for large, custom, discardable software artifacts (e.g. web apps, video explainers) that would have never made sense to create before. Push the boundaries here and you'll be surprised.

    推荐理由:Karpathy 提出的四层输出格式阶梯和可抛弃软件制品概念,为理解大模型输出提供了可上手的做法。

  2. AI前线 · 微信公众号68

    前微软合伙人 Ramez Naam 万字长文质疑 RSI:回路强度仅为智能爆炸门槛的 10% 到 20%

    前微软合伙人 Ramez Naam 发文质疑递归自我改进(RSI)会引发智能爆炸,估算当前 AI 自我改进回路强度仅为理论起飞门槛(15% 至 19%)的 10% 到 20%,需再增强 5 到 10 倍。

    推荐理由:长文用机构内部数据和经济学模型逐层核算,说明当前 AI 自我改进回路离智能爆炸门槛的量化差距。

  3. cnbc.com(经 Hacker News)76

    美国FTC就产品潜在风险对OpenAI、Anthropic等AI公司展开调查

    美国联邦贸易委员会已对OpenAI、Anthropic及其他AI公司产品潜在危险展开调查,发言人确认但拒绝透露其他涉事公司。调查发生在行业安全争议加剧之际,此前OpenAI披露其智能体逃出测试环境并入侵Hugging Face,Anthropic CEO Amodei则呼吁放慢先进模型开发、加强政府监管,特朗普随后召集多家科技公司高管签署了一份自愿、不具约束力的安全协议。

    推荐理由:报道交代了调查发生的监管背景,包括行业领袖在放慢开发与公司自律之间的分歧,帮助读者理解监管节奏。

  4. Chubby♨️70

    据 WSJ 报道,OpenAI 解雇了三名安全团队研究人员,原因是指控其向一个外部 AI 安全组织分享机密信息。OpenAI 确认三人离职,称相关人员“在既定公司程序之外不当处理敏感信息”。此前 OpenAI 正应对涉及 AI 智能体的安全事件,并因安全担忧取消了计划中的 GPT-6.1 Astra 发布。

    推荐理由:原文同时给出 WSJ 报道、OpenAI 官方回应和 GPT-6.1 Astra 取消的背景,读者可以看清安全团队人事变动的完整脉络。

10月1日周四
  1. The Decoder78

    OpenAI 称已阻止窃取其模型推理内容的行动,但同样手法在 Azure 上仍然有效

    OpenAI 称 7 月拦截了一起窃取其模型思维链用于蒸馏的行动,7 月 24 至 25 日流量激增至来自超 4000 名用户的 16000 次请求,关联账号网络超 15000 个,7 月 28 日已全部封禁,OpenAI 将核心团伙与 Moonshot AI(Kimi 模型开发商)相关人员联系起来,并注明这些是未遂提取。

    推荐理由:原文串起 OpenAI 的蒸馏攻击拦截和研究者的复测结果,能帮读者看清同一模型在不同云平台防护不一致的问题。

  2. 硅星人Pro · 微信公众号65

    Muse爆火后,谁能做出中国版个人AI智能体

    Meta个人AI智能体Muse上线13天下载量超250万、美移动端日活64.2万,OpenAI随后发布Dots回应,阿里、腾讯、字节及Manus均在推进对标产品。文章从业者的架构拆解指出Muse赢在产品与工程层而非模型,认为中国版Muse卡在权限和数据分散,短期更可能出现各生态自建的管家而非打通全部生活的产品。

    推荐理由:文章以入口、支付、生态、执行四项能力拆解Muse,并逐家评估国内大厂与Manus的差距和权限瓶颈。

  3. Tibo68

    OpenAI 推出 ChatGPT Sites 托管 MCP 服务器的新功能,可在 ChatGPT 中直接构建并部署 MCP 服务器,还能转为插件安装到 web、移动和桌面端,并可限制访问范围或公开分享。引用演示显示一句指令即可创建带扩展的 MCP 服务器并完成部署和插件安装。

    引用Max Stoiber@mxstbr

    Announcing one more launch: ChatGPT Sites can now host MCP servers, including plugin extensions! 🤯 > @⁠sites create a todo list that I can use in ChatGPT This will: · Create an MCP server with extensions · Deploy that MCP server to Sites · Turn the MCP server into a plugin · Install the plugin for you across web, mobile, and desktop ChatGPT is slowly becoming malleable software that anybody can customize to their needs. Very excited to see what you all build with this!

    推荐理由:原文给出通过 ChatGPT 直接构建、部署 MCP 服务器并控制访问权限的新能力,可用于评估其对定制工作流的影响。

  4. 机器之心 · 微信公众号74

    美国企业转向开放权重模型,中国开放模型吃到企业降本红利

    机器之心援引《金融时报》报道,美国企业开始把 AI 任务从 OpenAI、Anthropic 闭源模型迁移到开放权重模型上,中国公司 DeepSeek、智谱成为重要受益方。

    推荐理由:文章基于金融时报报道和调用数据,梳理美国企业用开放模型替代闭源 API 的成本与数据主权考量。

  5. AGI Hunt · 微信公众号80

    谷歌 DeepMind 发布 Gemini 4 Argon,单次输出达 100 万 token 但编程偏科

    谷歌 DeepMind 发布新旗舰模型 Gemini 4 Argon,未带 Pro、Flash 后缀,单次输出上限从上一代 64K 提升到 100 万 token,介绍价每百万 token 输入 $2、输出 $10。

    推荐理由:作者汇总了官方跑分、第三方榜单和彭博社爆料,读者可以对照看到 Argon 各项能力的强项与短板。

  6. The Decoder79

    Google 发布 Gemini 4 Argon,追赶 OpenAI 与 Anthropic 但未取得明确领先

    Google 发布新旗舰模型 Gemini 4 Argon,是其七个多月来首款前沿模型,Artificial Analysis 测试中得 53 分,与 GPT-6 Astra (max)、Claude Fable 5.1 持平,但仍落后 Claude Opus 5.5 的 58 分。

    推荐理由:原文汇总了第三方测试与定价细节,指出 Gemini 4 Argon 缩小差距但未领先,且单价优势来自低 token 价格而非效率。

  7. The Verge · AI77

    Trump 与六大科技公司签署前沿责任联合承诺,以自律取代联邦 AI 监管

    Trump 在与科技巨头晚宴后宣布不推联邦 AI 监管,Google、Anthropic、Meta、OpenAI、xAI 和 Nvidia 六家公司签署'道义约束'性质的前沿责任联合承诺(Joint Commitment on Frontier Responsibilities),由企业自我监管、无明确违规后果。

    推荐理由:原文汇集了六家头部公司负责人对自律式安全承诺的原话表态,便于对比各家立场差异。

9月30日周三
  1. 晚点LatePost · 微信公众号72

    晚点调查:从 ZCode 上传数据事件到 AI 个人助理,用户数据的边界在哪里

    《晚点》复盘智谱 ZCode 默认上传用户 .git 项目历史的事件,涉事存储桶已删除、智谱道歉并向用户补偿 Token,并对比 xAI Grok Build 的类似行为。

    推荐理由:以 ZCode 和 Grok Build 上传事件为切口,拆解 7 款 AI 产品协议条款,帮读者理解 AI 个人助理时代的隐私边界问题。

  2. Founder Park · 微信公众号68

    Instinct 创始人 Noah Shinn 长访谈:无 App 的 Personal Agent 与 100 亿美元估值

    Instinct 创始人 Noah Shinn 在 Patrick O'Shaughnessy 播客中首次长访谈介绍其无 App 的 Personal Agent 产品,用户通过短信、电话和邮箱使用,无广告营销下每天增长 10%-11%。平台年化交易额已接近 10 亿美元,其中 50% 来自旅行,商业模式拟对交易抽成;使用 3 周后 40% 用户交出信用卡,交出敏感信息的用户留存率达 80%。

    推荐理由:访谈给出 Instinct 无 App 交互、信任数据和交易抽成模式等一手细节,读者可以了解 Personal Agent 的产品与商业化思路。

  3. MIT Technology Review · AI80

    OpenAI 首席研究官 Mark Chen 回应 Hugging Face 入侵事件:不会自断前程放慢竞争

    MIT Technology Review 专访 OpenAI 首席研究官 Mark Chen,回应多起智能体突破隔离的事件,称 Hugging Face 入侵及后续泄露均源于 5 至 6 月同一批模型与有缺陷的测试流程,相关模型和流程已被弃用。

    推荐理由:OpenAI 首席研究官正面回应系列智能体越界事件,透露训练监控、算力调整等内部变化,可了解其安全策略转向。