全部AI 动态
全部动态
今日 2 条
Sundar Pichai@sundarpichaiAI 评分3333
Logan Kilpatrick@OfficialLoganKAI 评分6464



Google AI@GoogleAI精选AI 评分7474Google AI 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking 两款语音模型。

推荐理由:原文分述两款语音模型的能力差异与使用场景,读者可据此判断选型方向。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音模型
Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两个实时语音对话模型,主打近实时推理与语音智能体。
推荐理由:官方给出两个新语音模型的定位分工和多项基准数字,读者可据此判断其适合规模化还是高复杂度语音任务。
Odyssey@odysseymlAI 评分3434
Hugging Face Blog精选AI 评分6363 IBM Research 为 ALTK-Evolve 推出 Consistency Analyzer,将智能体一致性缺口从 24.4pp 降到 12.0pp
IBM Research 在 ALTK-Evolve 中新增 Consistency Analyzer 和一致性指南,用于衡量并改善智能体重复执行同一任务时的稳定性。
推荐理由:原文给出 Pass^k 与 Mean@k 的区别和一种只靠单条轨迹、无需标注的稳定性诊断方法,可将智能体一致性缺口缩小约一半。
Google Blog: AIAI 评分4040 Google 发布 AI & Economy ATLAS,AI 技术已支持超 300 种语言
Google 宣布其技术现已支持超 300 种语言,覆盖 70 亿人、占全球人口 86%,并同步发布 AI & Economy ATLAS 交互洞察。同期科学进展包括开放 AlphaGenome Atlas 全基因组 90 亿个单字母变异预测,推出全球天气模型 WeatherNext 3,其提前一天以上降水预报准确率提升 50%。
Google Blog: AI精选AI 评分6464 Google 公布多语言 AI 进展:Gemini 3.5 Live Translate 支持 70 种语言实时口译,TranslateGemma 可离线运行
Google 宣布其语言技术已覆盖 300 多种语言、服务超 70 亿人,占全球人口 86%。Gemini 3.5 Live Translate 支持 70 种语言。
推荐理由:官方梳理了从实时翻译到无障碍设计的语言 AI 布局,并给出各产品的覆盖语言数和合作项目,可作了解现状的参考。
LMSYS BlogAI 评分4646 SGLang 用 NVFP4 KV Cache 加速长上下文与智能体推理
NVIDIA 与 SGLang 合作实现 NVFP4 KV cache,在 Blackwell 上以 4 比特存储 K/V,配合 FP8 分块缩放与 FP32 张量级缩放两级量化,打包数据加块缩放仅占 FP8 约 56% 存储。
Claude Blog精选AI 评分7171 Anthropic 将 Claude Cowork 与聊天合并为统一 Claude,并推出 Claude Docs 和 Claude Slides
Anthropic 宣布 Claude Cowork 与聊天合并为一个统一 Claude,同时推出 Claude Docs 和 Claude Slides,Claude Design 也可在对话中使用。
推荐理由:官方说明了合并动机和推送节奏,读者可据此判断聊天里直接交付文档、幻灯片会怎样改变日常使用。
Google Blog: AIAI 评分2323 Google 如何用 AI 应对疾病、灾害、教育与经济机会
Google 正与全球社区和研究者合作,把 AI 用于疾病检测、治疗与预防、自然灾害预测、教育普及和经济机会拓展等社会影响领域。该内容集合展示了专家与地方领导者如何借助 AI 突破,让更多人共享 AI 带来的机会。
ByteByteGoAI 评分5959 ByteByteGo 图解 LLM 的记忆机制:模型本身不会记住对话
ByteByteGo 发文解释 LLM 为何在新会话中忘记此前对话:模型本身没有持久记忆,记忆错觉由围绕模型的应用通过重建上下文实现。文章区分训练记忆、上下文窗口工作记忆和外部持久记忆,分析上下文填满后的处理方式与长对话成本,并介绍滑窗、对话摘要、结构化实体抽取、向量库检索和长期用户画像等扩展记忆的技术。
Sakana AI BlogAI 评分5757 Sakana Marlin 新增 Interactive Reading 与 PowerPoint 幻灯片导出功能
Sakana AI 为其研究智能体 Sakana Marlin 新增两项功能:Interactive Reading 支持以聊天方式就报告提问、跳转相关段落,并点击引用由 AI 打开源文件定位对应依据;PowerPoint 导出可生成可编辑幻灯片,修改文字、图形及表格图表的数据和格式,每页附来源 URL,并支持任意模板。
Mustafa Suleyman@mustafasuleymanAI 评分3636关于我们昨天发布并公开征求意见的《人文主义AI行为准则》,我有几点想法。 https://mustafa-suleyman.ai/the-humanist-ai-code-of-conduct
Gary MarcusAI 评分5656 美国政府秘密 AI 评估框架在 FOIA 诉讼回应中部分公开但几乎全被删改
Gary Marcus 披露,Protect Democracy 针对 US 秘密 AI 安全评估框架提起的 FOIA 诉讼获政府回应,交付 132 页记录,Protect Democracy 已与其分享。
Google Blog: AIAI 评分5151 Google 发布 AI & Economy ATLAS 新洞察,数据显示近半受访科学家每天使用 AI
Google 发布 AI & Economy ATLAS 新数据可视化开放入口,并联合 Google DeepMind 和 MIT FutureTech 发表基于 ATLAS 数据的新研究,分析 2600 个专用 AI 模型并调研 600 多位美英科学家。
Eric@ericmitchellaiAI 评分1414inclusionAI Hugging Face modelsAI 评分5353 inclusionAI 发布 MoE 块扩散视觉语言 GUI Agent 模型 LLaDA-UI
inclusionAI 在 Hugging Face 开源 LLaDA-UI,一个基于 MoE 的块扩散视觉语言 GUI Agent,总参数约 16.7B,语言骨干为 LLaDA2.0-mini-base。
Claude Code GitHub ReleasesAI 评分1212 Claude Code v2.1.272 发布
Claude Code 发布 v2.1.272,本次更新以修复 bug 和提升可靠性为主,未引入新功能。
OpenRouter AnnouncementsAI 评分5151 Descript 案例复盘:如何用 OpenRouter 把新模型评测从一周缩到一两个小时
Descript 发布案例研究,介绍其视频编辑智能体 Underlord 采用 OpenRouter 后,生产模型从 1 个增至 13 个(来自 4 家模型开发方),新模型评测时间从一周以上缩短到 1-2 小时,一次 Anthropic 发布从宣布到上线只用了几小时。
Google Developers BlogAI 评分5959 Google 发布零信任 AI Agent 系列第二篇:用 Model Armor、Semantic Governance 与异常检测做运行时治理
Google Developers Blog 发布零信任 Agent 系列第二篇,将安全检查从构建时移到 Gemini Enterprise Agent Platform 的运行时。
Claude Code GitHub ReleasesAI 评分3636 Claude Code v2.1.271 发布:Remote 会话新增 fast mode
Claude Code v2.1.271 为 Remote 会话(云端与自托管 runner)新增 fast mode,按组织策略应用宿主机设置或会话内 `/fast`。
ViggleAI@ViggleAIAI 评分6262Viggle 宣布开源 viggle-animate 模型,可将任何人替换进任意视频中,同时提供在线快速试用版本。试用入口为 https://viggle.ai/meme/app/animate。
引用cocktail peanut@cocktailpeanutWe Must Pace the Frontier
Google DeepMind@GoogleDeepMindAI 评分3939天气预报在向可再生能源转型中发挥着关键作用。 WeatherNext 3 为电网运营商以及风能和太阳能发电企业提供风机高度风速和太阳辐射的预测,助力更智能、更清洁的能源规划。🧵

Google Blog: AIAI 评分2727 NASA 宇航员 Christina Koch 与 Google 的 James Manyika 对谈太空、技术与探索
NASA 宇航员 Christina Koch 与 Google 研究高级副总裁 James Manyika 在 Dialogues on Technology and Society 最新一期节目中对话。Koch 回顾了在国际空间站驻留 328 天、完成首次全女性太空行走以及参与 NASA Artemis II 绕月任务的经历,并谈到宇航员、机器人与 AI 之间的重要协作。
Odyssey@odysseymlAI 评分1717
Aidan Gomez@aidangomezAI 评分2828
Google Gemini@GeminiAppAI 评分2222
SiliconFlow@SiliconFlowAIAI 评分5252
Microsoft Research@MSFTResearchAI 评分2424
Claude BlogAI 评分5959 Anthropic 推出 Salesforce in Claude 测试版插件
Anthropic 与 Salesforce 合作发布 Salesforce in Claude 测试版插件,将销售人员的客户、商机和管道数据在现有 Salesforce 权限下接入 Claude,并提供 37 个技能覆盖客户调研、通话准备、管道复盘和 CRM 更新等日常工作。
Claude Blog精选AI 评分6969 Claude for Small Business 新增 43 个工作流与 27 个集成,并重启 SMB 巡回培训
Anthropic 为 Claude for Small Business 推出 43 个工作流和 27 个新集成,覆盖 Shopify、Salesforce、Stripe、Zoom、Xero、Zapier 等工具,产品自 5 月上线以来安装量超过 900,000 次。
推荐理由:官方公布了新增工作流与集成数量,并给出多个客户的可验证使用结果,读者可据此评估这类 Agent 产品对小型业务的落地形态。
Google Blog: AIAI 评分2828 Google DevFest 2026 回归:10 月 1 日起在全球 115 个国家举办 800 多场活动
Google DevFest 2026 于 10 月 1 日至 12 月 31 日回归,由全球 Google Developer Groups 在 115 个国家举办 800 多场活动,预计近百万开发者参与。
Ant Ling@AntLingAGIAI 评分2626Ling-3.0-flash-Fin 现已推出三个量化版本:FP8、FP4 和 INT4。 如果你正在构建真实的金融工作流,可以选择最契合你基础设施、内存和效率需求的版本。🧵

Gary MarcusAI 评分4040 Gary Marcus:特朗普与 AI 的命运之约?
Gary Marcus 在《经济学人》撰文提出,特朗普最重大的总统决策可能是是否与中国就 AI 达成协议,他主张策略重点不在芯片交易,而在 AI 向善的合作。特朗普与习近平 9 月 24 日通话,AI 已列入议程。文中还提到 AI 股票下跌、公众反 AI 情绪升温,以及 Steve Bannon 转而与 Sanders 联手反对。
a16z News精选AI 评分6767 Josh Elman 谈产品管理的核心仍是讲故事:AI 时代从写 spec 转向先建原型
前 LinkedIn、Twitter 产品负责人 Josh Elman 撰文指出,AI 把开发成本降到极低后,产品开发循环从先写 spec 再构建反转为先快速原型再设计,spec 不再是交付物,但判断成本没有下降,决定做什么才是产品经理的整个工作。
推荐理由:作者结合 LinkedIn 和 Twitter 的一线产品经历,说明 AI 如何把产品开发从写规格文档改为先做原型再做判断,方法论可直接迁移。
Google AI@GoogleAIAI 评分5757
Mustafa Suleyman@mustafasuleymanAI 评分6161Microsoft AI NewsAI 评分5555 Microsoft AI 发布 MAI 模型 Code of Conduct 草案并开启六周公众咨询
Microsoft AI 发布 MAI 模型的 AI Code of Conduct 首版草案,公开征询意见,反馈期六周,并计划今年晚些时候发布修订版。
OpenAI NewsAI 评分3333 Fyxer 如何用 OpenAI 模型打造值得信任的 AI 行政助理
Fyxer 基于 OpenAI 模型、微调、记忆机制与真实用户反馈,打造出能整理收件箱并按每位用户语气起草邮件的 AI 行政助理。