NVIDIA Nemotron 3 Nano Omni 现已在 Together AI 平台上线
NVIDIA Nemotron 3 Nano Omni 模型现已在 Together AI 平台提供,这是一个可跨视频、图像、音频和语言进行推理的开放模型。
媒体报道、公司博客与研究文章
NVIDIA Nemotron 3 Nano Omni 模型现已在 Together AI 平台提供,这是一个可跨视频、图像、音频和语言进行推理的开放模型。
Anthropic 发布一批面向创意工作的连接器,让 Claude 可直接对接 Ableton、Adobe Creative Cloud、Affinity by Canva、Autodesk Fusion、Blender、Resolume、SketchUp、Splice 等创意软件。
OpenAI 宣布 ChatGPT Enterprise 和 OpenAI API 已获得 FedRAMP Moderate 授权,使美国联邦机构能够安全采用其 AI 能力。授权覆盖这两项面向机构的产品,OpenAI 未披露更多细节。
Dwarkesh Patel 发布博客悬赏征集 AI 开放问题的解答,目标是招募一位共同研究员。他提出的问题包括:5 家超大规模厂商掌握全球 70%+ 的 AI 算力且大部分预留给 OpenAI/Ant/GDM。
Mistral AI 发布 Workflows 公开预览版,定位为企业 AI 的编排层,提供持久执行、可观测性和人工审批能力。开发者用 Python 编写工作流,可发布到 Le Chat 由业务人员触发,每步在 Studio 中可追踪审计。
Google DeepMind 宣布与韩国科学技术信息通信部(MSIT)建立合作关系,正值 AlphaGo 首尔对局十周年。
OpenAI 与 Microsoft 宣布一项修订协议,简化了双方的合作关系,增加长期确定性,并支持继续推进大规模 AI 创新。原文未给出条款细节。
推荐理由:协议修订简化了双方的合作框架并增加长期确定性,可作为观察两家公司合作走向的节点。
Choco 利用 OpenAI API 构建 AI 智能体,实现食品分销流程自动化,以提升生产力并推动业务增长。该案例展示了 AI 在食品分销行业的实际落地效果。
作者基于 OpenAI 本周在 Hub 上开源的 Privacy Filter,用 gradio.Server 搭建了三个 PII 脱敏 Web 应用:文档高亮浏览器、图像匿名化工具和 SmartRedact Paste。
推荐理由:文章以三个可运行示例展示 Privacy Filter 的接入方式,可供搭建 PII 脱敏应用时参考。
Anthropic 任命 Theo Hourmouzis 为澳大利亚与新西兰总经理,并正式启用悉尼办公室。Hourmouzis 此前在 Snowflake 担任澳新及东盟高级副总裁,将领导本地团队,推动 Claude 进入澳新客户的核心业务。悉尼办公室紧随东京、班加罗尔之后开设,首尔办公室也即将启用。
Runway 将 Kueue 作为 Kubernetes 准入控制器管理多团队共享的 GPU 集群,在保证团队预留容量的同时把 GPU 利用率提升超过 20 个百分点。
OpenAI 发布开源规范 Symphony,用于 Codex 编排,可把 issue tracker 变成常驻运行的智能体系统。该规范旨在提升工程产出并减少上下文切换。
Anthropic 在 Opus 4.7 中更换了 tokenizer,OpenRouter 通过对比从 4.6 迁移到 4.7 的实际用量,测算了这一改动对成本的具体影响。
OpenAI 公布指导其 AGI 工作的五项原则:民主化、赋能、普遍繁荣、韧性与适应性,目标是让通用 AI 尽可能广泛地交到人们手中,而非由少数公司掌控超级智能。OpenAI 称将借助基金会资源与各方合作应对 AI 新风险,并延续迭代部署策略,同时承认随着规模变大,其运营原则的调整会保持透明。
LlamaIndex 发布教程,用 LlamaParse Extract 对贷款申请、W-2、工资单、银行流水四类文档做结构化抽取,再用 Claude(claude-sonnet-4-6)交叉验证收入一致性、雇主名称和存款模式,生成含置信分数和决策建议的 HTML 报告。
OpenAI 发布 AI Jobs Transition Framework,不再把技术暴露等同于岗位消失,而是围绕 AI 能否承担任务、人是否仍居核心、需求是否随成本下降而增长三个问题评估就业转型。
Dwarkesh Patel 发起 2 万美元博客征文奖,围绕 AI 进展为何未放缓、基础模型公司如何盈利、OpenAI Foundation 如何花钱、非 AI 生产链国家如何应对等四类问题征集答案,每篇不超过 1000 词,5 月 10 日 23:59 PST 截止,前三名分获 1 万、6000、4000 美元。
SGLang 与 Miles 团队宣布在发布当天为 DeepSeek-V4 (1.6T Pro, 284B Flash) 提供推理与 RL 训练的开源支持,针对其混合稀疏注意力、mHC 和 FP4 专家权重架构做了专项适配。
推荐理由:原文给出 ShadowRadix、HiSparse 等具体优化机制和基准数字,读者可以了解混合稀疏注意力架构对推理与 RL 训练系统的实际工程要求。
OpenRouter 发布教程,介绍用 create-agent-tui 和 create-headless-agent 两个 skill 在几分钟内搭建个性化的编码智能体。两种 skill 分别对应终端界面和无头模式,后者可用于脚本与流水线。
推荐理由:原文给出两个 skill 的用法,读者据此可在几分钟内搭出带终端界面或无头运行的编码智能体。
OpenRouter 发布 Agent SDK,提供 callModel 函数,可把一次 chat completion 变成带工具调用、停止条件和成本追踪的多步智能体。该 SDK 支持 400+ 模型。
Together AI 提出分布感知投机解码(DAS),在 RL 后训练的 rollout 阶段实现最高 50% 加速且不改变模型输出。DAS 由自适应后缀树 drafter 和长度感知调度两部分组成:前者基于近期轨迹构建、无需训练即可跟随策略更新,后者通过跨 GPU 负载均衡与 GPU 内投机预算分配削减长尾请求。
DeepSeek 发布 V4,Hub 上提供两个 MoE 检查点:DeepSeek-V4-Pro 总参数 1.6T、激活 49B,DeepSeek-V4-Flash 总参数 284B、激活 13B,两者均支持 1M token 上下文窗口。
推荐理由:原文拆解了 V4 面向长上下文智能体的注意力与后训练设计,可据此判断开源模型跑长任务时的成本变化。
Anthropic 公布 Claude 在美国中期选举及今年全球多场重要选举前的保障措施,Opus 4.7 和 Sonnet 4.6 在政治偏见评测中分别得分 95% 和 96%。
NEC 将向全球约 3 万名 NEC 集团员工部署 Claude,并成为 Anthropic 首个日本全球合作伙伴,双方将面向日本金融、制造和地方政府等市场共同开发安全行业 AI 产品。
Anthropic 为 Claude 平台推出 Rate Limits API,管理员可通过编程方式查询其组织与工作区已配置的速率限制。
作者评测了五款面向小型企业的 AI Agent,对比功能、定价和真实用户口碑。Manus 适合端到端自主研究,付费起价 $20/月;Clay 擅长销售潜客开发但学习曲线陡峭。
DeepSeek API 已支持 V4-Pro 与 V4-Flash,兼容 OpenAI ChatCompletions 接口与 Anthropic 接口,base_url 不变,model 参数改为 deepseek-v4-pro 或 deepseek-v4-flash。
推荐理由:官方说明了新模型接入方式与旧模型名停用时间,开发者可以据此安排迁移。
OpenAI 发布 GPT-5.5,这是一款面向编码、研究和数据分析等复杂任务的模型。该模型强调跨工具处理这些任务。
推荐理由:OpenAI 发布 GPT-5.5,面向编码、研究和数据分析等复杂任务,读者可了解其跨工具能力定位。
OpenAI 发布 GPT-5.5 系统卡,介绍该模型面向写代码、在线研究、分析信息、创建文档与表格等复杂实际工作,并能跨工具完成任务。系统卡披露了预部署安全评估和 Preparedness Framework 下的针对性红队测试,覆盖高级网络安全与生物能力,并在发布前收集了近 200 家早期访问伙伴的反馈。
推荐理由:系统卡列出 GPT-5.5 的预部署安全评估、针对性红队测试和近 200 家早期访问伙伴的反馈,读者可据此了解其发布前的安全审查流程。
OpenAI 列出 Codex 在工作中的 10 个实用场景,覆盖跨工具、文件与工作流的任务自动化、交付物生成,以及把真实输入转化为输出。
ChatGPT Codex 支持通过插件与技能连接工具、访问数据,并遵循可重复的工作流来自动化任务、提升结果。
OpenAI 介绍 Codex 的 10 个日常实用场景,覆盖自动化任务、生成交付物,以及把真实输入转化为输出,横跨多种工具、文件与工作流。
ChatGPT Codex 让用户超越对话式交互,通过自动化任务、连接工具并产出文档和仪表盘等真实成果。该产品定位为在聊天之外完成实际工作的能力。
OpenAI 发布 ChatGPT Codex 入门指南,介绍如何设置项目、创建线程并完成首个任务,提供分步操作指引。
OpenAI 发布 Codex 设置指南,介绍如何配置个性化、细节层级和权限,让任务运行更顺畅并自定义工作流。
OpenAI 发布 ChatGPT Codex 使用指南,介绍如何设置工作区、创建线程与项目、管理文件,并按步骤完成任务。内容覆盖从初始配置到实际执行任务的完整流程。
OpenAI 的 ChatGPT Codex 自动化教程介绍如何用日程和触发器自动生成报告、摘要和周期任务,无需手动操作。教程面向重复工作流的自动执行,通过日程和触发器减少人工介入。
OpenAI 分享 ChatGPT Work 的实用工作流,覆盖重复性任务、进度更新、调研、规划与团队运营等场景。内容面向日常办公,帮助用户把这些环节交给 ChatGPT Work 处理。
Sierra 宣布收购总部位于巴黎的 Fragment,后者利用 AI 帮助企业扩展运营、让员工专注于更高价值工作。Fragment 联合创始人 Olivier Moindrot 和 Guillaume Genthial 将加入 Sierra,增强其在法国的智能体开发能力。
Hugging Face 发布指南,讲解如何在 Chrome 扩展(Manifest V3)中用 Transformers.js 运行本地模型,并复现其 Gemma 4 浏览器助手的核心架构。
推荐理由:用一个已上线的浏览器扩展拆解 MV3 下的分层架构,可供搭建本地模型扩展时参考分工与数据边界。