Jev 发布两天内出现 6 个开源克隆,判别式决策模型成为热点
Latent Space AINews 汇总 9/17-9/18 AI 动态:Jev 决策模型发布视频两天获 36M views,因未开源引发多个克隆,包括 Bespoke Nimble(Qwen3.5-9B 的 LoRA 微调。
Latent Space AINews 汇总 9/17-9/18 AI 动态:Jev 决策模型发布视频两天获 36M views,因未开源引发多个克隆,包括 Bespoke Nimble(Qwen3.5-9B 的 LoRA 微调。
十字路口编译 Chris Lu 对 YC 2026 夏季批次 236 家公司、470 位创始人的分析。91% 的公司与 AI 相关,但模型以下的公司占比从春季批次的 8% 升至 20%,应用层从 55% 降至 39%;自主 Agent 公司占比从 45% 降至 33%。
推荐理由:原文用同一套技术栈框架对比 YC 春夏两批公司数据,给出了 Agent 退潮、创业重心下沉到底层和实体世界的量化变化。
Google 扩充 AI & Economy 研究项目,聘请 2025 年诺贝尔经济学奖得主 Philippe Aghion 担任学术顾问,Ajay Agrawal 任访问研究员,并任命 Anu Madgavkar 与 Daniel Rock 为研究项目总监。
OpenAI 发布澳大利亚青少年安全蓝图,这是一份包含六大支柱的路线图,旨在打造更安全的 AI 体验,以保护和赋能青少年。



Anthropic 在 Claude Code 中推出 Projects,单次对话可派生并行云端会话、在线程间传递上下文,用户离开后仍继续运行,本地工作流后续支持。
我们注意到有一项声称我们的系统遭到未授权访问的说法。经过彻底调查,我们未发现任何证据支持这一说法,并可以确认我们的系统未被入侵。
Anthropic 宣布与 Accenture 合作,由其旗下 AI 业务 Faculty 在公司内部开展前沿 AI 的独立评估,包括模型评估与红队测试、对齐评估和安全防护测试,双方各自计划在未来五年至少投入 10 亿美元。
推荐理由:原文来自当事方,说明了嵌入式评估的运作方式、资金安排与局限,读者可据此理解这一安全机制的边界。
Sakana AI 正式公布公司内部的 Frontier Intelligence Group(FIG),主张智能尚未被解决,即使当前范式可通过规模实现 AGI,也仍需探索数据与能耗效率更高的另类路径。
Apollo Go 正在香港街头行驶。🚘 全无人驾驶测试在这座城市的道路上持续推进——一起来看看 Apollo Go 的实际表现。↓
Steve Yegge 关停了 Gas Town,并承认每月花数千美元订阅编码智能体,却只做出了 Gas Town 这一个项目。Databricks 向约 3500 名工程师铺开 GPT-6 Astra,其在高复杂度系统设计与长周期任务上"明确"优于 Opus 5 / Sol 5.6,但整体编码支出增加约 60%,公司为此设立专门的 Astra 子预算。
ChatGPT Ads for @Shopify is live. We are @OpenAI's first commerce partner. OpenAI pulls straight from Shopify Catalog, so merchants' products are already there. Merchants set their own campaigns, their own budget. Free to install, tracked right from the Shopify admin. Consumers are asking ChatGPT what to buy. Shopify merchants are able to decide exactly how they show up. https://apps.shopify.com/chatgptads
Today we rolled out Astra to every engineer at Databricks (N=~3500). Some notes that may be helpful to others: 1. Astra unambiguously out performs our previous highest-end models (Opus 5, Sol 5.6) on highly complex tasks, especially those related to high level system design or long range horizontal tasks. 2. Engineers given Astra increased overall coding spend by around 60% compared to baseline. 3. It is not clear Astra meaningfully improves on medium/low complexity coding tasks compared to earlier models. We suspect those tasks are mostly saturated (i.e. perfectly executed) by existing models. 4. We learned above by piloting Astra with around 200 users to gain signal on both quality and cost. We use Unity Gateway to do cohort-based experiments for all new models. 5. We give engineers a sub-budget specific to Astra to encourage them to use Astra selectively on complex tasks while preferring lower cost models for everyday tasks. Our engineers are able to mix-and-match tools and models within their overall budget envelope (we also allow for increased budgets through various mechanisms). These budgets are defined in Unity Gateway and regularly revisited. Note: We do not have robust comparisons of Astra-vs-Fable because we have net yet rolled out Fable widely due to data retention policies.
OpenAI 发布用于追踪、调查和披露模型对齐问题的框架,同时公布六份关于模型出现意外或令人担忧行为的报告。
OpenAI 与 AARP 合作,在美国 10 座城市为 1000 名老年人提供免费的 ChatGPT 实操工作坊,帮助他们安全掌握实用 AI 技能。
Balyasny Asset Management 在数千个真实金融任务上评测 Claude Fable 5,Fable 取得 89.4% 对前代生产模型 86.1% 的成绩,在复杂规划、分析和智能体执行上表现最突出。该机构自建 BAMAgent 平台,已支持数千个自主智能体 7×24 小时运行,Fable 成为其规划与分析阶段的首选模型。
Runway 为即将发布的实时视频生成模型设计了同步审核系统,采用 Zentropi 的 CoPE-B 模型,安全审查平均耗时不到 0.5 秒,可将违规内容暴露窗口压缩至半秒以内。CoPE-B 是基于 Gemma-4-26B-A4B-it 的 LoRA 适配器,该 MoE 模型总参数 25.2B、每次前向仅激活 3.8B,兼顾速度与准确率。实时模型输出将附带 C2PA 溯源信号。
Sakana AI 产品团队负责将研究团队的技术转化为产品并交付市场,团队由产品经理、工程师、设计师和销售等角色组成,成员国籍多元。团队主要现场办公,标准工作时间为 10:00–19:00,无固定核心时段,日常使用 Claude Code、Codex、Devin、Figma 等工具。产品团队 ARE 侧重通用性,与应用团队按客户需求定制的方式形成分工。
Cohere and Aleph Alpha announce the signing of a definitive agreement, becoming the first foundational AI model developer anchored on both sides of the Atlantic 🇨🇦🇩🇪 Operating globally as Cohere, the unified company will grow to more than 1,000 employees across both continents.
OpenAI 新经济研究显示,员工使用 AI 的方式已超出传统岗位职责,部分新活动正成为其工作中的常规组成部分。
Google 宣布其技术现已支持超 300 种语言,覆盖 70 亿人、占全球人口 86%,并同步发布 AI & Economy ATLAS 交互洞察。同期科学进展包括开放 AlphaGenome Atlas 全基因组 90 亿个单字母变异预测,推出全球天气模型 WeatherNext 3,其提前一天以上降水预报准确率提升 50%。
Google 宣布其语言技术已覆盖 300 多种语言、服务超 70 亿人,占全球人口 86%。Gemini 3.5 Live Translate 支持 70 种语言。
推荐理由:官方梳理了从实时翻译到无障碍设计的语言 AI 布局,并给出各产品的覆盖语言数和合作项目,可作了解现状的参考。
Google 正与全球社区和研究者合作,把 AI 用于疾病检测、治疗与预防、自然灾害预测、教育普及和经济机会拓展等社会影响领域。该内容集合展示了专家与地方领导者如何借助 AI 突破,让更多人共享 AI 带来的机会。
Gary Marcus 披露,Protect Democracy 针对 US 秘密 AI 安全评估框架提起的 FOIA 诉讼获政府回应,交付 132 页记录,Protect Democracy 已与其分享。
Google 发布 AI & Economy ATLAS 新数据可视化开放入口,并联合 Google DeepMind 和 MIT FutureTech 发表基于 ATLAS 数据的新研究,分析 2600 个专用 AI 模型并调研 600 多位美英科学家。
Descript 发布案例研究,介绍其视频编辑智能体 Underlord 采用 OpenRouter 后,生产模型从 1 个增至 13 个(来自 4 家模型开发方),新模型评测时间从一周以上缩短到 1-2 小时,一次 Anthropic 发布从宣布到上线只用了几小时。
Google DevFest 2026 于 10 月 1 日至 12 月 31 日回归,由全球 Google Developer Groups 在 115 个国家举办 800 多场活动,预计近百万开发者参与。
Microsoft AI 发布 MAI 模型的 AI Code of Conduct 首版草案,公开征询意见,反馈期六周,并计划今年晚些时候发布修订版。
Perplexity 正使用 GPT-6 Astra 撰写沟通内容、修改软件并监控生产系统,且相比早期模型,人工检查频率大幅降低。
LangChain 博客总结医疗与生命科学行业智能体规模化经验:76% 受访机构将 tracing、评估和支出可见性列为扩大智能体自主权的前提,49% 正在建设公司级智能体平台或“agent factory”,33% 聚焦已有纸质记录的受监管文档与后台流程,26% 在运行或构建面向患者和会员的对话式智能体(含语音),另有 26% 尝试让非工程师在中央护栏内构建智能体。
a16z 领投 Highstock 3000 万美元 A 轮融资,后者是 AI 驱动的 B2B 平台,帮品牌把过剩库存对接给经过审核的全球批发买家。平台已上线超 10 亿美元库存、合作 100 多个品牌,约 60% 交易额来自年营收超 5 亿美元的品牌与集团,并已让超 1000 万磅商品免于填埋。
Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练自有模型,基于开放权重拥有数据和由此产生的智能。Cloudera 平台承载 30 exabytes 客户自管数据。