Runway 推出 DIFFUSE:面向 AI 原生创意人才的招聘平台
Runway 发布 DIFFUSE,一个连接 AI 原生创意人才与品牌、代理商和工作室的开放招聘平台,支持人才建立档案、展示作品集,企业可直接搜索并联系候选人。Runway 团队调研近 400 家公司的 1000 多个创意岗位招聘信息,其中 17% 提及 AI 技能或生成式工具,Runway 是这些岗位中需求最高的视频专用工具。平台现已上线 diffuse.runway.com。
媒体报道、公司博客与研究文章
Runway 发布 DIFFUSE,一个连接 AI 原生创意人才与品牌、代理商和工作室的开放招聘平台,支持人才建立档案、展示作品集,企业可直接搜索并联系候选人。Runway 团队调研近 400 家公司的 1000 多个创意岗位招聘信息,其中 17% 提及 AI 技能或生成式工具,Runway 是这些岗位中需求最高的视频专用工具。平台现已上线 diffuse.runway.com。
Simon Willison 发布 llm-anthropic 0.29,这是 LLM 工具接入 Anthropic 模型的插件更新。原文未披露该版本的具体功能、参数或可用性细节。
Claude API 的缓存诊断功能结束 beta,不再需要 cache-diagnosis-2026-04-07 beta header。在 Messages 请求中加入 diagnostics 对象即可启用,仍发送该 header 的请求行为不变;POST /v1/messages 的响应现在始终包含 diagnostics 字段,未启用时为 null。
Anthropic 前线部署工程师在 Notes from the Field 系列中分享管理大规模代码现代化项目的经验:原本需数年的项目现在可在数月或数周内完成,但瓶颈从编写变更转移到组织动员。
推荐理由:来自 Anthropic 一线工程师的实战经验,给出 AI 代码现代化项目启动前的组织性准备工作清单和可复用六步流程。
CodeRabbit、Power Digital 和 ThoughtSpot 通过 Claude Marketplace 用已有的 Anthropic 承诺额度扩容 Vercel 和 Snowflake。
Anthropic 宣布 Claude Marketplace 上线,把插件与连接器、智能体与产品以及服务合作伙伴聚合到一处。
推荐理由:Anthropic 官方宣布 Marketplace 上线,说明客户可用已承诺消费额度购买合作方工具,读者可据此了解生态采购方式的变化。
Anthropic 成立生命科学研究组和实验室,宣布 Claude 智能体在约 950 个智能体、21 小时、2.1 亿 token 的搜索后,自主发现一种与 DNA 重复序列相关的新型酶系统,命名为 array-associated reverse transcriptases(ART)。
推荐理由:原文给出 Claude 智能体自主发现新酶系统的过程细节和预印本,读者可以据此了解 AI 驱动生物学研究的实际工作方式。
Simon Willison 发布 llm-typesafe 0.1a0 插件,让 LLM 工具支持 TypeSafe AI 新推出的 Jev 模型。
OpenAI 于 2026 年 7 月发布全双工语音模型 GPT-Live-1,可同时听和说,无需轮次检测器。
TechCrunch Disrupt 2026 的 AI Stage 与 Real World AI Stage 共设五场 AI 安全主题会议,嘉宾来自 Anthropic、Nvidia、AWS、Waabi 等公司。9 月 25 日前注册可最多省 200 美元。
Interconnects 播客中,Nathan Lambert 与 Epoch AI Insights 负责人 Jean-Stanislas Denain 讨论多项议题。
a16z 宣布孵化 The Horowitz Andreessen Academy(HAA),一所位于旧金山、面向高中毕业生的全日制线下私立学校。
Gagan Biyani 宣布在旧金山创办 The Horowitz Andreessen Academy,面向高中毕业生及大学低年级学生的选择性学校,共获 4200 万美元融资,由 a16z 领投。
NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,新增智能体工作流与平台支持,支持 ROS Lyrical 和 Ubuntu 24.04。
Parallel 借助 GPT-6 Astra 让智能体研究并综合劳动力市场数据,耗时和成本均降至此前模型的一半。
针对今夏一系列 AI 炒作事件,DAIR 执行总监 Timnit Gebru 指出,Anthropic 与 OpenAI 宣称的漏洞发现、数学突破等成果在专家核查后均大幅缩水,OpenAI 的数学成果还被数学家指控剽窃他人工作。她认为"超级智能"叙事源于超人类主义等意识形态,把智能体说成"失控模型"实为帮企业逃避责任,呼吁政策制定者听取独立专家意见、不要依赖新闻稿。
现任 Accenture Federal Services 首席 AI 官的 Garrett Berntsen 认为,政府采用 AI 最难的不是造模型,而是围绕它重构机构、工作流与决策体系,仅提供 API 访问远远不够。
超聚变在 2026 国际探索者大会上提出"智企"概念,并发布 FusionOne AI 企业级 Token Factory 解决方案、FusionServer"无极"架构及首发产品 FusionServer V9 系列。
Latent Space 期 AINews 汇总,Xiaomi 发布 MiMo-V2.6-Pro 与 MiMo-V2.6-Flash 原生全模态开源模型(MIT 许可)。
推荐理由:原文汇总了 MiMo-V2.6-Pro 登顶开源权重榜的评测数据和 RL 训练成本细节,读者可以借此评估后训练路线的实际性价比。
阶跃毫无预兆发布 Step 5 Preview,总参数量 600B、激活 27B,带视觉输入,称 Artificial Analysis 上涨 44 分、全球开源前三,单任务成本仅为 Claude Opus 5 的 1/8。
推荐理由:作者与朋友实测了 Step 5 Preview 在可视化、金融、游戏等任务上的真实表现,补上了榜单分数之外的第一手体感参考。
非侵入AI脑机接口公司华超神控(BCI-Sonics)完成2亿元人民币Pre-A轮融资,由云启资本与红杉中国联合领投,比邻星投资、元禾控股、徐汇科创投、德石投资跟投,老股东经纬创投、德联资本持续加注。公司以低强度经颅聚焦超声写脑、fUS/EEG/fMRI/PET多模态读脑与AI神经解码构建闭环系统,闭环超声脑机系统计划2027年Q1进入临床,成立至今累计融资近3亿元。
xAI 官方复盘其客服团队(Cursor 于 8 月 14 日并入后)用 Grok Bot 处理客服工单的做法:合并后工单增长 175% 但未新增人手,称否则可能需多雇 200 人,单次解决成本低至 $0.20 到 $0.30,而传统 AI 客服工具按次收 $1 到 $4。
英国 AI 安全研究所(AISI)宣布使用 EvalEval 的 Evaluation Cards 开放共享评测结果,以支持更可复现、可验证的评测科学。
OpenRouter 发文解析 NVIDIA 的 Nemotron 3.5 Lightning,这是一个 30B 总参数、每 token 激活约 3B 的 MoE 开源权重模型,定位于智能体工作流中的高频执行步骤。
推荐理由:原文梳理了模型规格、与 Ultra 的分工、各端点差异和路由方法,可帮助读者判断何时用它替代大模型执行高频调用。
OpenRouter 用 Banking77 测试集的 3,080 条客服语句对比 Jev 1.13 和 Claude Opus 5 的意图分类能力。
推荐理由:原文给出了同一测试集下的准确率、延迟和成本对比,以及置信度级联方案,可用于判断小判断模型能否替代前沿模型。
oMLX 创作者兼维护者 Jun Kim 加入 Hugging Face,全职投入 MLX 社区建设。oMLX 将从副业转为有资金支持的正式项目,继续以 Apache 2.0 开源并由 Jun 领导,目标是加快开发并更好引导贡献者。Hugging Face 计划让 oMLX 成为新想法的试验场,并推动 transformers 模型定义快速转为可被不同引擎使用的 MLX 参考实现。
OpenAI 阐述了针对前沿模型与防护措施的第三方 AI 安全评估的优先事项与原则,强调评估应严谨、安全且独立。
Google AI 订阅用户现可直接获得 Colab 高级权益,包括优先使用更快的加速器和更强算力的机器。Google AI Ultra 订阅者还可解锁不间断后台执行和 Premium GPU 访问,长时间训练无需保持浏览器标签页开启。该权益将在未来几周内向 Colab 支持国家的 Google AI 订阅用户逐步推送,已有 Colab 订阅不受影响。
Together AI 推出 Rollouts 功能,在同一 endpoint 的两个部署间迁移流量,支持 Canary、蓝绿和滚动三种策略,配合指标门控与暂停/取消/反向发布控制。
OpenClaw 宣布引入决策模型支持,让智能体中工具筛选、消息压缩、是否应答等小型判断不必再走聊天模型调用,目标是更低延迟和成本。该能力为可选配置,插件可通过 Plugin SDK 的 api.runtime.decisions.evaluate 调用,支持托管 Jev 和本地 System One 服务器,社区已提出近 15 个相关 PR,官方强调这是实验基础而非已完工的功能清单。
OpenRouter 推出 Batch API,提交批量请求后供应商可在 24 小时窗口内完成,per-token 价格通常为常规价的 50% 或更低,已支持 70 多个模型。
推荐理由:官方给出了实测的批次完成时长分布和提交时段差异,便于读者判断批量推理能否接入现有工作流。
Hugging Face 宣布 transformers 支持通过 from_pretrained 加载 GGUF 量化模型,复用 ggml 的 Metal 内核,初始聚焦 Apple Silicon 上的 Qwen3.5 架构。
推荐理由:原文给出加载方式、性能对比数据和方法论,读者可据此判断在 Mac 上用 transformers 跑 GGUF 的可行路径。
TypeSafe AI 上周发布 Jev,称其为 System One 或决策模型:接受文本输入,输出对应类别、是非判断和评分的浮点数及置信分数。其首个模型按输入 token 计费,每百万 token $0.042,输出免费,比 GPT-5 Nano($0.05/百万)更便宜;问题并行评估,但对数字、日期和对抗性内容表现不佳。
安全研究员 Patrick Wardle 披露 Meta 的 AI 助手 Muse 存在 0-day 漏洞,本地任意应用或终端命令可通过更改云端转写端点窃取账户 token,完全控制 Muse 账户,Meta 在报道发布约 12 小时后发布热修复补丁。
推荐理由:报道给出漏洞利用路径和设计成因分析,读者可以借此评估高权限 AI 助手的安全架构风险。
Latent Space 播客专访 TypeSafe AI CEO Diogo Almeida,介绍其新发布的 System One 模型 Jev,目标是面向软件而非聊天、优化每美元智能。
Gary Marcus 在 UNGA 数字合作活动中发表演讲,与 Yoshua Bengio 和诺贝尔奖得主 Maria Ressa 同场。他反对零监管和末日论两个极端,主张近期风险是深度伪造虚假信息、不可靠 AI 系统窃取凭证和发起网络攻击,提出建立国际咨询委员会做事前评估与事后审计、禁止部署明显有害架构、限制无限制联网的 AI 智能体。
Amazon 与斯坦福大学联合成立 Stanford and Amazon Research Initiative,聚焦 AI、能源与医疗健康前沿研究。目前 Amazon 内部已有超过 10 个团队资助斯坦福的活跃研究与博士奖学金,覆盖人形机器人、后量子密码学、因果测量科学和 AI 驱动放射学等方向。该计划将支持联合研究项目、博士奖学金以及跨学科学术研讨会。
SemiAnalysis 长文拆解了 MoE 模型推理的计算与数据搬运过程,指出 MoE 不只增加参数量,还改变了每个 token 激活哪些张量、哪些数据必须就近放置、哪些传输需要高本地带宽。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批类别为电池储能系统(BESS)和冷却分配单元(CDU)。
Amazon Bio Discovery 团队发表三篇论文,推进 AI 计算化抗体设计。其中 MochiBind 仅凭序列预测抗体-抗原相对结合强度,在四个未见抗原上成对准确率均超结构基线,平均领先近 10%,CPU 上约 13 秒打分 20 万对抗体,推理速度提升逾 100 倍。另提出 CA-MAP 在推理阶段处理批次效应,并实现智能体选择结合位点、经实验验证的癌症靶点抗体命中。