OpenAI 推出面向法律行业的 Astra for Law
OpenAI 发布 OpenAI for Law,为法律行业提供前沿智能、律所自定义工作流、互联的法律数据源,以及面向保密客户工作的法律级管控。该产品名为 Astra for Law。
OpenAI 发布 OpenAI for Law,为法律行业提供前沿智能、律所自定义工作流、互联的法律数据源,以及面向保密客户工作的法律级管控。该产品名为 Astra for Law。
OpenRouter 发布教程,演示如何用其 TypeScript SDK 从零构建工具调用 Agent 循环,示例使用本地天气数据可独立运行。教程覆盖停止条件设计、按 toolCallId 返回结果、指纹计数拦截重复调用、models 参数实现有序模型回退,以及 Auto Exacto 默认按工具调用成功率重排提供商;并说明 MCP 只改变工具执行位置,循环控制仍是必要的。
推荐理由:教程给出了完整的停止条件、重复检测和模型回退实现,可用作自建 tool-calling 循环的参考骨架。
OpenAI 发布用于追踪、调查和披露模型对齐问题的框架,同时公布六份关于模型出现意外或令人担忧行为的报告。
OpenAI 与 AARP 合作,在美国 10 座城市为 1000 名老年人提供免费的 ChatGPT 实操工作坊,帮助他们安全掌握实用 AI 技能。
Anthropic 推出 Life Sciences Verification Program(LSVP)beta,让通过验证的生命科学从业者使用 Mythos 5.1、Opus 5 和 Sonnet 5,并用更宽松的分类器开展药物发现、研究生物学、临床开发和制造等通常被通用模型拦截的任务。
Anthropic 发布研究结果,Claude 在近四周内优化 30 多个开源生物分子模型(覆盖结构预测、蛋白质设计、基因组学等),平均加速约 4 倍,在输出完全一致时约 2 倍,并开源全部优化代码。
推荐理由:原文给出加速倍数、成本对比和开源代码入口,读者可以据此评估 Claude 优化对生物建模工作流的实际影响。
Balyasny Asset Management 在数千个真实金融任务上评测 Claude Fable 5,Fable 取得 89.4% 对前代生产模型 86.1% 的成绩,在复杂规划、分析和智能体执行上表现最突出。该机构自建 BAMAgent 平台,已支持数千个自主智能体 7×24 小时运行,Fable 成为其规划与分析阶段的首选模型。
Anthropic 宣布 Claude Code 的 Projects 改版,从文件夹形态变为对话式协调:Claude 会拆解目标、并行分配线程、审查输出并汇总结果,每个线程是一个独立的 Claude Code 云会话。
推荐理由:官方说明改版后 Projects 的线程协调、共享记忆和灰度范围,读者可据此评估它对多会话编码流程的改变。
Runway 为即将发布的实时视频生成模型设计了同步审核系统,采用 Zentropi 的 CoPE-B 模型,安全审查平均耗时不到 0.5 秒,可将违规内容暴露窗口压缩至半秒以内。CoPE-B 是基于 Gemma-4-26B-A4B-it 的 LoRA 适配器,该 MoE 模型总参数 25.2B、每次前向仅激活 3.8B,兼顾速度与准确率。实时模型输出将附带 C2PA 溯源信号。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次预览提交中,Qwen3-VL 吞吐量最高达 GB300 NVL72 的 3.7 倍,DeepSeek-R1 上最高 2.5 倍。GB300 NVL72 以 288 GPU 四机架提交实现 99% 扩展效率,软件优化较 v6.0 带来最高 1.6 倍性能提升。
Sakana AI 产品团队负责将研究团队的技术转化为产品并交付市场,团队由产品经理、工程师、设计师和销售等角色组成,成员国籍多元。团队主要现场办公,标准工作时间为 10:00–19:00,无固定核心时段,日常使用 Claude Code、Codex、Devin、Figma 等工具。产品团队 ARE 侧重通用性,与应用团队按客户需求定制的方式形成分工。
Sakana AI 更新 Sakana Chat,将编排模型 Fugu Max 向所有用户开放,并新增可跨对话继承角色、项目与写作偏好的记忆功能。Fugu Max 聚合多种开源模型并按提示词路由,官方称性能可媲美前沿模型,用户在模型选择器中选中即可使用,无需额外设置。记忆功能同时支持 Namazu 与 Fugu Max,可在设置中查看或关闭,且仅对本次更新后的对话生效。
OpenAI 推出新的 AI 广告体验,包括 Sponsored Agents、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。材料为 feed 摘要,未提供完整正文细节。
推荐理由:原文给出 Sponsored Agents、营销工具及 HubSpot、Shopify 集成等要点,读者可以了解 OpenAI 广告业务的初步形态。
Mistral 宣布与 Mozilla 合作,Firefox 的 AI 浏览助手 Smart Window (beta) 现由 Mistral 模型驱动,先覆盖法国和北美,英国和德国预计今年晚些时候跟进。双方强调开源与本地化,模型针对地区语言、方言和文化语境微调;Smart Window 默认不在 Mozilla 服务器保存对话,Mistral 承诺零数据保留。
OpenAI 介绍如何用 ChatGPT Work 和 Codex 的分析功能,帮助团队了解 AI 使用量与支出、识别培训需求,并把 AI 采用情况与业务成果关联起来。
Hex 的数据智能体借助 GPT-6 Astra,把分析答案转化为可交互的可视化报告,让员工愿意主动分享。
OpenAI 新经济研究显示,员工使用 AI 的方式已超出传统岗位职责,部分新活动正成为其工作中的常规组成部分。
OpenRouter 逐一梳理 DeepSeek V4 家族的输入模态:仅 deepseek/deepseek-v4.1-flash 和 deepseek/deepseek-v4-flash-vision-exp 接受图像,其余 V4 Pro 0813、V4 Flash 0731、两个 0423 checkpoint 和 Flash latest alias 均为纯文本。
Gemini Enterprise Agent Platform 推出 Agent Anomaly Detection 私密预览,这是一个基于推理的智能体监督与审计层,通过分析 reasoning traces、工具调用和执行流程识别行为异常、可疑意图与策略违规。
Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现奖励对齐的查询扇出并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现单次非自回归的查询扇出,无需推理时的 CoT 思考 token。该方法基于 Gemma3-4B 和 Qwen3-4B 微调,旨在解决零样本 LLM 在数据库感知查询分解中的复述坍缩与自回归延迟瓶颈。
Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两个实时语音对话模型,主打近实时推理与语音智能体。
推荐理由:官方给出两个新语音模型的定位分工和多项基准数字,读者可据此判断其适合规模化还是高复杂度语音任务。
IBM Research 在 ALTK-Evolve 中新增 Consistency Analyzer 和一致性指南,用于衡量并改善智能体重复执行同一任务时的稳定性。
推荐理由:原文给出 Pass^k 与 Mean@k 的区别和一种只靠单条轨迹、无需标注的稳定性诊断方法,可将智能体一致性缺口缩小约一半。
Google 宣布其技术现已支持超 300 种语言,覆盖 70 亿人、占全球人口 86%,并同步发布 AI & Economy ATLAS 交互洞察。同期科学进展包括开放 AlphaGenome Atlas 全基因组 90 亿个单字母变异预测,推出全球天气模型 WeatherNext 3,其提前一天以上降水预报准确率提升 50%。
Google 宣布其语言技术已覆盖 300 多种语言、服务超 70 亿人,占全球人口 86%。Gemini 3.5 Live Translate 支持 70 种语言。
推荐理由:官方梳理了从实时翻译到无障碍设计的语言 AI 布局,并给出各产品的覆盖语言数和合作项目,可作了解现状的参考。
NVIDIA 与 SGLang 合作实现 NVFP4 KV cache,在 Blackwell 上以 4 比特存储 K/V,配合 FP8 分块缩放与 FP32 张量级缩放两级量化,打包数据加块缩放仅占 FP8 约 56% 存储。
Anthropic 宣布 Claude Cowork 与聊天合并为一个统一 Claude,同时推出 Claude Docs 和 Claude Slides,Claude Design 也可在对话中使用。
推荐理由:官方说明了合并动机和推送节奏,读者可据此判断聊天里直接交付文档、幻灯片会怎样改变日常使用。
Google 正与全球社区和研究者合作,把 AI 用于疾病检测、治疗与预防、自然灾害预测、教育普及和经济机会拓展等社会影响领域。该内容集合展示了专家与地方领导者如何借助 AI 突破,让更多人共享 AI 带来的机会。
Sakana AI 为其研究智能体 Sakana Marlin 新增两项功能:Interactive Reading 支持以聊天方式就报告提问、跳转相关段落,并点击引用由 AI 打开源文件定位对应依据;PowerPoint 导出可生成可编辑幻灯片,修改文字、图形及表格图表的数据和格式,每页附来源 URL,并支持任意模板。
Google 发布 AI & Economy ATLAS 新数据可视化开放入口,并联合 Google DeepMind 和 MIT FutureTech 发表基于 ATLAS 数据的新研究,分析 2600 个专用 AI 模型并调研 600 多位美英科学家。
inclusionAI 在 Hugging Face 开源 LLaDA-UI,一个基于 MoE 的块扩散视觉语言 GUI Agent,总参数约 16.7B,语言骨干为 LLaDA2.0-mini-base。
Descript 发布案例研究,介绍其视频编辑智能体 Underlord 采用 OpenRouter 后,生产模型从 1 个增至 13 个(来自 4 家模型开发方),新模型评测时间从一周以上缩短到 1-2 小时,一次 Anthropic 发布从宣布到上线只用了几小时。
Google Developers Blog 发布零信任 Agent 系列第二篇,将安全检查从构建时移到 Gemini Enterprise Agent Platform 的运行时。
NASA 宇航员 Christina Koch 与 Google 研究高级副总裁 James Manyika 在 Dialogues on Technology and Society 最新一期节目中对话。Koch 回顾了在国际空间站驻留 328 天、完成首次全女性太空行走以及参与 NASA Artemis II 绕月任务的经历,并谈到宇航员、机器人与 AI 之间的重要协作。
Anthropic 与 Salesforce 合作发布 Salesforce in Claude 测试版插件,将销售人员的客户、商机和管道数据在现有 Salesforce 权限下接入 Claude,并提供 37 个技能覆盖客户调研、通话准备、管道复盘和 CRM 更新等日常工作。
Anthropic 为 Claude for Small Business 推出 43 个工作流和 27 个新集成,覆盖 Shopify、Salesforce、Stripe、Zoom、Xero、Zapier 等工具,产品自 5 月上线以来安装量超过 900,000 次。
推荐理由:官方公布了新增工作流与集成数量,并给出多个客户的可验证使用结果,读者可据此评估这类 Agent 产品对小型业务的落地形态。
Google DevFest 2026 于 10 月 1 日至 12 月 31 日回归,由全球 Google Developer Groups 在 115 个国家举办 800 多场活动,预计近百万开发者参与。
Microsoft AI 发布 MAI 模型的 AI Code of Conduct 首版草案,公开征询意见,反馈期六周,并计划今年晚些时候发布修订版。
Fyxer 基于 OpenAI 模型、微调、记忆机制与真实用户反馈,打造出能整理收件箱并按每位用户语气起草邮件的 AI 行政助理。
inclusionAI 推出 SingProbe,一个基于 meta-llama/Llama-3.2-1B-Instruct 的流式安全探针,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,仅增加不到 0.5% 解码开销。
inclusionAI 发布 SingProbe,一个基于 google/gemma-4-26B-A4B-it 的流式安全探针,复用基座模型隐藏状态逐 token 打分,仅增加不到 0.5% 解码开销。