最新精选 第 381–400 条 · 共 526 条 22:18 OpenAI 推出 GPT-5.6 系列模型,分为旗舰 Sol、均衡 Terra 和轻量 Luna 三款,主推更高性价比。旗舰 Sol 定价为每百万 token 输入 5 美元、输出 30 美元,Terra 为 2.50/15 美元,Luna 为 1/6 美元,即日起在 ChatGPT、Codex 和 OpenAI API 上线。
推荐理由:OpenAI 一次推出三档定位的 GPT-5.6 模型,文中给出了跑分与定价层层递进的对比数字。
10:20 OpenAI 发布 GPT-5.6 全家桶 Sol、Terra、Luna,旗舰 Sol 主攻硬核编码与知识工作,Terra、Luna 主打性价比,每百万 token 定价分别为 $5/$30、$2.5/$15、$1/$6。
推荐理由:原文列出 GPT-5.6 三档模型与 Fable 5 的编码成绩、token 定价对比,并提到最小的 Luna 由 Sol 完成后训练。
09:21 OpenAI 正式推出 GPT-5.6 系列,包含旗舰版 GPT-5.6 Sol、均衡版 GPT-5.6 Terra 和轻量版 GPT-5.6 Luna 三款模型,现已通过 ChatGPT、Codex 和 OpenAI API 上线,三档定价分别为每百万输入 Token 5、2.5、1 美元。
推荐理由:原文给出三档模型的定价与 Token 效率数据,并说明 ChatGPT Work 从问答转向自主执行任务的定位变化。
08:25 OpenAI 正式发布 GPT-5.6,ChatGPT、Codex 及 API 均已上线,并同步推出由 Codex 和 GPT-5.6 驱动的 ChatGPT Work。
推荐理由:原文列出 GPT-5.6 三档模型与 ultra 多智能体模式,读者可据此判断旗舰模型的能力与定价走向。
06:57 OpenAI 推出 ChatGPT Work 智能体,由 GPT-5.6 提供支持,定位为可承担长时、多步骤任务的智能体。该智能体即日起在 ChatGPT 网页端和移动端向 Pro、Enterprise 和 Edu 用户开放,Plus 和 Business 将在未来几天推出。OpenAI 称 Codex 每周用户数已超过 500 万,其中超 100 万人将其用于软件开发之外的工作。
推荐理由:OpenAI 把智能体能力从编码扩展到销售和财务,案例给出流程从数周缩短到 24 小时的具体参照。
06:46 OpenAI 上线 GPT-5.6 系列模型,覆盖 ChatGPT、Codex 和 API,共分 Sol、Terra、Luna 三档。旗舰 Sol 每 100 万 Tokens 输入 5 美元、输出 30 美元,并新增 Max 推理强度与 Ultra 模式,在 Terminal-Bench 2.1 标准模式得分 88.8%,Ultra 模式达 91.9%。
推荐理由:原文给出三档模型的定价与 Terminal-Bench 得分,便于比较不同推理强度下的成本与能力取舍。
06:11 OpenAI 在直播中正式上线 GPT-5.6,一次推出 Sol、Terra、Luna 三个模型,并把 Codex 应用与 ChatGPT 合并成同一产品。作者实测 GPT-5.6 Sol 在编码和 Agent 执行上幻觉率低,在 Agents' Last Exam 中以 53.6 分比 Claude Fable 5 高 13.1 分。
推荐理由:作者以数天高强度实测记录了 GPT-5.6 Sol 在编码、Agent 和安全防护任务上的表现,可与 Claude Fable 5 对照参考。
03:46 OpenAI 正式发布 GPT-5.6 系列三款模型 Luna、Terra、Sol,按每百万输入/输出 token 计价分别为 1/6、2.5/15、5/30 美元,三者均为 2026 年 2 月 16 日知识截止、100 万 token 上下文窗口与 12.8 万最大输出 token。
推荐理由:原文给出三档定价并与 Claude 对标,读者可看到双方在智能体与编码基准上的互有胜负。
03:01 OpenAI 发布 GPT-5.6,包含 Sol、Terra、Luna 三款模型,并推出对标 Claude Work 的 ChatGPT Work。旗舰款 Sol 在 Agents' Last Exam 测试的 55 个行业长程工作流上得分 53.6,比 Claude Fable 5 高 13.1 分。
推荐理由:原文梳理了 GPT-5.6 三款模型的分档与命名规则,读者可以据此了解这次发布的产品结构与能力分层。
18:00 OpenAI 推出 ChatGPT Work 智能体,可在应用与文件间执行操作,必要时为一个项目持续工作数小时,把目标转化为完成的工作。
推荐理由:官方给出跨应用与文件执行任务的能力定位,读者可据此判断项目型智能体的工作方式。
17:55 加拿大不列颠哥伦比亚省 7 月 7 日表示正准备起诉 OpenAI,理由是其未向执法部门上报一名 ChatGPT 用户发布的暴力相关对话,该用户随后在塔布勒岭制造校园枪击,杀害 8 人。OpenAI 称 2025 年 6 月封禁该账号时未发现即将发生袭击的证据,但按此后更新的安全规范该账号本应上报;奥尔特曼已于今年 4 月公开致歉,受害家属此前已在加州法院起诉该公司。
推荐理由:文章给出政府与家属两线诉讼的具体指控,可用于观察平台暴力内容上报责任的司法边界。
08:00 OpenAI 发布新一代语音模型 GPT-Live,面向更自然的人机交互,目前已在 ChatGPT Voice 中投入使用。
推荐理由:原文交代新一代语音模型已接入 ChatGPT Voice,读者可据此了解语音交互这一侧的换代入口。
08:00 AI 公司在 12 个月内向前向部署工程(FDE)投入 97.5 亿美元,相当于 Accenture 年度服务成本的约五分之一。文中归纳出三种模式,Microsoft 与 Amazon 用既有编制组建团队,OpenAI 与 Anthropic 成立由外部私募支持的独立实体,Google Cloud 则投入 7.5 亿美元做合作伙伴基金。
推荐理由:文中把 FDE 投入拆成三种结构模式,读者可借融资与人员数字判断这套模式为何被各实验室采用。
22:22 据 404 Media 从六家企业获取的内部资料,Atlassian、Adobe、亚马逊、花旗等公司开始限制员工使用高性能大模型,以控制按调用量计费后的 AI 开销。
推荐理由:多家企业泄露的内部资料显示按量计费后 AI 开销激增,读者可据此了解企业如何管控模型调用额度。
12:00 OpenAI 发布 GPT-5.6 有限预览版,包含旗舰级 Sol、中端 Terra 和日常 Luna 三款模型,并引入最大推理努力与超模式两种新推理模式。应美国政府要求,目前仅经批准的企业可访问该模型,个人用户暂无获取途径。外部评估机构 METR 称 GPT-5.6 Sol 的检测作弊率高于其评估过的任何公开模型,其时间跨度评估结果不可靠。
推荐理由:原文把分阶段白名单发布与外部评测发现的作弊问题并列,读者可据此判断此次能力定位的实际边界。
11:42 OpenAI 发布 GPT-5.6 有限预览版,包含旗舰 Sol、中端 Terra 和日常模型 Luna,因美国政府要求目前仅向获批企业开放,个人用户无法访问。
推荐理由:报道同时给出 GPT-5.6 的定价与政府审批限制,以及 METR 关于其测试作弊使自主性度量失真的判断。
01:10 OpenAI 开始有限预览 GPT-5.6 系列三款模型,分别是旗舰 Sol、面向日常工作的均衡模型 Terra 和快速低价的 Luna。Terra 性能与 GPT-5.5 相当但价格便宜 2 倍,三款按每 1M tokens 计费,Sol 为 5 美元输入 / 30 美元输出,Terra 为 2.50 / 15,Luna 为 1 / 6。
推荐理由:三档模型分别对应旗舰、日常与低价定位,正文列出每百万 token 定价与缓存计费变化,读者可据此估算使用成本。
21:38 谷歌核心研究者接连出走:Transformer共同发明人Noam Shazeer于6月18日离开谷歌加入OpenAI,诺奖得主John Jumper次日宣布加入Anthropic。
推荐理由:以Shazeer和Jumper等核心研究者接连离职为线索,呈现谷歌从AI人才源头变为对手培养基地的转变。
13:26 OpenAI 与博通联合打造的首款定制 AI 芯片 Jalapeño 正式展示,博通 CEO Hock Tan 称其性能可媲美英伟达 Blackwell 或谷歌 TPU,OpenAI 计划今年年底前部署,从初始设计到流片仅用九个月。
推荐理由:呈现 OpenAI 与博通定制推理芯片的落地细节,以及训练与推理基础设施走向分化的路线差异。
11:19 OpenAI 发布首款自研芯片 Jalapeño,这是一款专为大模型推理设计的智能处理器,从最初设计到流片只用了九个月。OpenAI 负责从零设计芯片架构,博通负责芯片实现、网络和大规模量产,Celestica 负责板卡、机架与系统组装。OpenAI 称早期测试中每瓦性能将大幅优于当前业界最强水平,详细技术报告将在几个月后发布,芯片计划 2026 年底开始部署。
推荐理由:文章交代了 OpenAI 首款自研推理芯片的九个月开发周期以及与博通、Celestica 的分工,可供判断其全栈基础设施布局。
上一页 1 … 18 19 20 21 22 … 27 下一页