OpenAI 扩展 ChatGPT 广告,推出自助 Ads Manager 与 CPC 竞价
OpenAI 扩展 ChatGPT 广告业务,推出 beta 版自助 Ads Manager、CPC 竞价和增强的衡量工具。官方称这些功能为保护隐私而设计,并让对话内容与广告保持分离。
推荐理由:原文给出 ChatGPT 广告的自助投放入口和 CPC 竞价方式,读者可据此了解其商业化路径与隐私设定。
OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事的持续追踪。
当前仅显示精选新闻OpenAI 扩展 ChatGPT 广告业务,推出 beta 版自助 Ads Manager、CPC 竞价和增强的衡量工具。官方称这些功能为保护隐私而设计,并让对话内容与广告保持分离。
推荐理由:原文给出 ChatGPT 广告的自助投放入口和 CPC 竞价方式,读者可据此了解其商业化路径与隐私设定。
OpenAI 在 GPT-5.5 上将每 token 价格翻倍,但该模型输出更为简洁。OpenRouter 基于真实用量数据测算这一变化带来的净成本影响。
推荐理由:OpenRouter 基于真实用量测算 GPT-5.5 单价翻倍后的净成本变化,读者可据此判断实际开销是否更贵。
Sierra 团队推出 𝜏-voice 基准,将 𝜏-bench 的 278 个客服任务与全双工实时语音、可控真实音频结合,任务、工具和评估器与文本版逐字节一致,语音成绩可与文本 Agent 直接对比。
推荐理由:语音与文本能力可在同一套任务上直接对比,还给出了噪音与口音下各厂商的具体失败模式。
OpenClaw 创始人撰文复盘项目如何在公开环境下变得安全:截至 4 月 30 日 GitHub 显示自 1 月 10 日以来共 1,309 份安全通告,其中 535 份发布、746 份判定无效,109 份 critical 报告中 95 份无效。
推荐理由:创始人复盘 OpenClaw 在公开安全报告压力下的加固过程,给出信任模型、插件化缩小攻击面和多用户威胁的处理思路。
Google Cloud 在 Q1 2026 同比增长 63%,AWS 为 28%、Azure 为 40%,三家云厂商该季度基础设施资本开支合计 1120 亿美元。
推荐理由:文章对比三家云厂商的增速与资本开支,指出自有模型层与芯片的垂直整合是增长分化的重要原因。
GitHub 宣布自 2026 年 6 月 1 日起 Copilot 从按请求计费转为基于 GitHub AI Credits 的按使用量计费,Opus 4.7 倍率将从 7.5 倍升至 27 倍;Anthropic 同期限制 Claude Code 中 Opus 模型,Pro 用户需额外付费。
推荐理由:原文梳理 Copilot 与 Claude Code 转向按量计费的细节,并引入 token 成本与程序员工资的比较框架。
Factory 用 50 个真实 PR、统一提示词和 LLM judge 评测 13 个模型的代码评审表现,GPT-5.2 以 60.5% F1、$1.25/PR 排第一,Opus 4.6 达 59.8% 但需 $3.11/PR。
推荐理由:原文给出 13 个模型在 50 个真实 PR 上的 F1 与成本数据,读者可以据此为自己的代码评审挑选性价比模型。
OpenAI 宣布 GPT 模型、Codex 和 Managed Agents 已在 AWS 上线,企业可以在自有 AWS 环境中构建安全的 AI 应用。
推荐理由:OpenAI 的模型、Codex 与 Managed Agents 上线 AWS,企业多了一条在自有云环境内构建 AI 应用的路径。
OpenAI 与 Microsoft 宣布一项修订协议,简化了双方的合作关系,增加长期确定性,并支持继续推进大规模 AI 创新。原文未给出条款细节。
推荐理由:协议修订简化了双方的合作框架并增加长期确定性,可作为观察两家公司合作走向的节点。
作者基于 OpenAI 本周在 Hub 上开源的 Privacy Filter,用 gradio.Server 搭建了三个 PII 脱敏 Web 应用:文档高亮浏览器、图像匿名化工具和 SmartRedact Paste。
推荐理由:文章以三个可运行示例展示 Privacy Filter 的接入方式,可供搭建 PII 脱敏应用时参考。
OpenAI 发布 GPT-5.5,这是一款面向编码、研究和数据分析等复杂任务的模型。该模型强调跨工具处理这些任务。
推荐理由:OpenAI 发布 GPT-5.5,面向编码、研究和数据分析等复杂任务,读者可了解其跨工具能力定位。
OpenAI 发布 GPT-5.5 系统卡,介绍该模型面向写代码、在线研究、分析信息、创建文档与表格等复杂实际工作,并能跨工具完成任务。系统卡披露了预部署安全评估和 Preparedness Framework 下的针对性红队测试,覆盖高级网络安全与生物能力,并在发布前收集了近 200 家早期访问伙伴的反馈。
推荐理由:系统卡列出 GPT-5.5 的预部署安全评估、针对性红队测试和近 200 家早期访问伙伴的反馈,读者可据此了解其发布前的安全审查流程。
OpenAI 在 ChatGPT 中推出工作区智能体,这类智能体由 Codex 驱动,可自动化复杂工作流。它们运行在云端,帮助团队跨工具安全地扩展工作。
推荐理由:官方说明了工作区智能体由 Codex 驱动并在云端运行,读者可据此判断它与现有团队工作流的衔接方式。
Sam Altman 称凌晨 3:45 有人向其住宅投掷燃烧瓶,无人受伤,他发文希望劝阻下一个袭击者。文中他阐述了对 AI 的信念,包括 AI 需要民主化、权力不能过度集中、安全不只是模型对齐还需全社会应对,并反思了自己与 OpenAI 董事会冲突中的错误,认为行业乱象源于"想控制 AGI"的心态,出路是广泛分享技术且无人独占。
推荐理由:Sam Altman 在自家中弹燃烧瓶事件后亲述个人信念与反思,是理解其 AI 治理立场与行业判断的一手材料。
Factory 发布 Legacy-Bench 基准,用涵盖 COBOL(46%)、Java 7(32%)等六类遗留语言的数百个任务测试 AI 智能体,12 个模型-智能体组合的通过率为 16.9% 至 42.5%,而这些模型在 SWE-bench Verified 等现代基准上得分超过 70%。
推荐理由:原文用真实遗留代码任务填补现有基准的盲区,给出各模型在 COBOL 等语言上的具体分数和失败模式,可帮助读者评估 AI 智能体处理关键遗留系统的实际能力。
Sayash Kapoor、Arvind Narayanan 与 Stephan Rabanser 等人发布 66 页论文《Towards a Science of AI Agent Reliability》,将智能体可靠性拆解为一致性、鲁棒性、可预测性、安全性四维共 12 项指标。
推荐理由:论文把智能体可靠性拆成12个维度并实测14个模型,显示18个月内准确率大涨而可靠性仅小幅提升。
Sam Altman 宣布 Sora 将进行两项调整:一是给版权方更细粒度的角色生成控制,类似肖像的 opt-in 模式,并特别提到用户与日本内容的深度连接;二是因用户视频生成量超出预期,计划很快开始与希望其角色被生成的版权方分享部分收入。他表示具体模式仍需试错,Sora 的迭代速度会很高,类似 ChatGPT 早期。
推荐理由:原文给出版权方控制机制和视频生成收入分享两项具体调整方向,读者可以据此了解 Sora 的治理与商业模式走向。
OpenAI 发布 Sora 应用,结合新视频模型 Sora 2,提供视频创作、分享和观看功能,并支持把用户和朋友放入视频的 cameo 特性。团队已部署深度伪造防范、有害内容防护和用户情绪定期检查等缓解措施,并提出优化长期用户满意度、让用户控制 feed、优先创作和帮助长期目标四项产品原则。
推荐理由:原文来自当事方,给出了产品定位、cameo 功能和防沉迷设计原则,读者可据此判断其与常见短视频产品的差异。
Factory 宣布其软件开发智能体 Droid 以 58.8% 的任务解决率在 Terminal-Bench 排行榜第一,Opus 4.1、GPT-5 和 Sonnet 4 三种单模型配置均显著领先其他单模型智能体,并超过 Codex CLI(42.8%)和 Claude Code(43.2%)。
推荐理由:原文在成绩之外给出智能体设计的可复用做法,如分层提示词、模型专属适配和精简工具,能帮助改进自己的 Agent。
Sayash Kapoor 撰文提出 AGI 不是里程碑,公司宣布实现 AGI 不是可操作事件,对商业、政策或安全都没有直接含义。文章以核武器为反类比,认为 AI 的经济影响依赖以十年计的扩散过程,并批评基于影响、内部机制和基准行为的三类 AGI 定义各有缺陷,建议企业和政策制定者关注安全扩散而非 AGI 宣言。
推荐理由:作者区分能力与权力、以扩散视角解释 AGI 为何不是可操作事件,为评估各方 AGI 宣言提供了一个可用的分析框架。