奇怪的是,明明有个“赚大钱”的按钮,却没人去按。 (把你的 SaaS 产品做成 headless 架构,让智能体能够调用它,按交互次数收费——尤其是面向企业客户。)
#现象/趋势
#现象/趋势
今日 53 条@trq212@trq212AI 评分3636 @EMostaque@EMostaqueAI 评分66
@frxiaobei@frxiaobeiAI 评分2222 不到一年时间,大模型御三家从 ChatGPT、Claude、Gemini 变成了 ChatGPT、Claude、Grok。 不过还好还是 CCG。
@fofrAI@fofrAIAI 评分2222 过去两个月,情况真的变了。现在任何人都能做硬件。你可以给它刷入新固件,可以编写自己的操作系统。你的硬件如今真正属于你了,这在以前从未有过。去破解、去构建、去连接一切吧。
Karina@karinanguyenAI 评分3333elsewhere articlesAI 评分4242 从「同事.skill」到「人生系统」:两个年轻 Builder 的公开实验
周天奕用 Claude 花四小时做出「同事.skill」,可将聊天记录、会议纪要等「蒸馏」成可调用的 AI 技能包,上线 5 天在 GitHub 收获 7.3k 星标,如今累计 23k,并衍生出 200 多个二创 skills。
Nathan Lambert: InterconnectsAI 评分5151 Nathan Lambert 分析开源 AI 的经济学与 Nvidia 的芯片需求策略
Nathan Lambert 撰文分析开源 AI 的经济结构,区分附带完整训练配方的开源语言模型与仅含权重和使用代码的开放权重模型,指出 Nvidia 投入 260 亿美元打造近开源 Nemotron 模型意在让更多人自建模型、扩大其芯片需求。
@frxiaobei@frxiaobeiAI 评分4848 @fofrAI@fofrAIAI 评分1616 @emollick@emollickAI 评分4747
张小珺 Xiaojun Zhang@zhang_benitaAI 评分1414



Nathan Lambert: InterconnectsAI 评分6161 Nathan Lambert 写完 AI 教科书后谈 LLM 长篇非虚构写作的停滞
Nathan Lambert 完成后训练教科书《Reinforcement Learning from Human Feedback》后撰文指出,LLM 在长篇非虚构写作上进展停滞,能校对 200-300 页书稿的细微错误、辅助编辑和同步 Markdown 与 LaTeX 版本,但组织整章内容时仍混乱并累积概念错误。
Mistral AI@MistralAIAI 评分5050
Import AIAI 评分5757 Import AI 468:23 条应对 RSI 的政策建议、PostTrainBench 新纪录与 OpenAI 智能体攻击事件
Jack Clark 的 Import AI 第 468 期汇总多条 AI 安全与治理动态。IFP 发布 23 项应对自动化 AI 研发的低风险政策建议,涵盖透明度。
Every latest articlesAI 评分5858 一次 vibe coding 如何把安全漏洞写进线上应用
作者讲述自己 vibe coding 应用 Tastemaker 并用 Claude 添加 MCP 连接器后,被 GPT-5.6 Sol 审查发现线上连接器存在不应公开的注册路由,随后下线功能并撤销会话,未发现用户数据被访问。文章将其归因于'解释深度错觉'和只测试预期路径的倾向,并总结出学习领域基本原理、请人类专家把关、不把 AI 自我保证当唯一证据等规则,文末给出需要付费订阅解锁的五步提示词。
Barret李靖@Barret_ChinaAI 评分4343
Barret李靖@Barret_ChinaAI 评分4545
Barret李靖@Barret_ChinaAI 评分4444Dwarkesh PatelAI 评分5858 Dwarkesh Patel 提出持续学习时代的 8 项 AI 预测
Dwarkesh Patel 提出持续学习到来后的 8 项预测,认为模型仅在会话间写 Markdown 无法积累执行整份工作所需的经验,经验必须沉淀进权重。他据此推论部署前安全检查将失效、对齐技术需重构、领先实验室将靠部署数据加速拉开差距,并以 Anthropic 内部自 2 月起使用 Mythos、6 月才公开发布的 4 个月差距为例说明先发部署的学习优势。
Suno BlogAI 评分5151 Suno 阐述负责任构建音乐 AI 的原则并推出下载新政与透明度工具
Suno 发布官方声明,阐述支持艺术家、鼓励原创而非模仿、维护音乐生态等核心原则,并宣布相关行动。具体包括训练元数据不使用艺术家名、禁止特定艺术家或受版权保护歌曲的提示词、即将推出限制大规模分发歌曲到流媒体平台的下载政策、开始部署透明度工具及音频水印与指纹技术,并更新社区准则以更明确禁止伪造歌曲、未经授权上传和冒用他人声音等行为。
Runway NewsAI 评分4545 Edelman、Le Truc 与 WHY Brands 谈 AI 为何奖励有观点的创意
Edelman、Le Truc 与 WHY Brands 的创意负责人在 Monks 首席创新官 Henry Cowling 主持的对谈中认为,AI 技术已就绪,真正的难点是围绕它重塑习惯、团队与预算。
Import AIAI 评分5454 Import AI 467:自复制AI蠕虫原型、算力涨价判断与AI创造力争议
多伦多大学、Vector Institute、剑桥大学和 ServiceNow 的研究者构建出用开源权重 LLM 驱动、靠被攻陷机器 GPU 自我维持并复制的蠕虫原型,完整攻击成功率约 37%。
elsewhere articlesAI 评分3030 对谈汪天凡:AI 智能在通胀,智慧才稀缺,2026 该投什么?
BAI Capital 高级合伙人汪天凡在「十字路口」公路播客中判断,基础模型趋同后 AI 智能正在通胀,真正稀缺的是智慧,AI 应用的新机会藏在 Context 和交互里。他认为 AI 硬件真正难被「华强北 80 块平替」抄走的是产品定义与「注入人性的光辉」,并称 2026 年泡沫期更该投有愿景的创始人和让人更快乐的产品。
Nathan Lambert: InterconnectsAI 评分5151 开源模型盘点第23期:Laguna S2.1、Inkling 与 Kimi K3 展现开源模型在 Pareto 前沿的价值
本期开源模型盘点收录 Thinking Machines 首个模型 Inkling(975B-A41B 多模态 MoE)、Tencent Hy3(295B-A21B。
Microsoft AI News精选AI 评分6161 Microsoft 阐述按 token 效率优化前沿性能曲线的策略并盘点 MAI Flash 模型成果
Microsoft 提出行业下一个焦点是 token 效率,主张通过联合优化模型、harness 和 RL 环境为具体产品调校模型,而非所有任务都用前沿通用模型。
推荐理由:Microsoft 官方阐述 token 效率策略,用多款 MAI Flash 模型的实际成本数据说明如何按任务匹配模型规模。
Import AIAI 评分6363 Import AI 466:机器人学的苦涩教训、AI完成周级编程任务与OpenAI模型意外黑客事件
本期Import AI覆盖多件事:Epoch与METR发布MirrorCode基准,Claude Opus 4.7用14小时、251美元推理成本重实现人类需2至17周完成的程序。
Nathan Lambert: InterconnectsAI 评分6363 Interconnects 播客复盘开源模型:Kimi K3 体验、Qwen 大模型计划与蒸馏争论
Nathan Lambert 与 Florian Brand 做季度开源模型复盘,讨论 Kimi K3 发布后的使用体验、GLM 5.2 的作用以及中国模型为何能追近闭源前沿。二人反驳 Ben Thompson 关于蒸馏在 RL 阶段更有影响的说法,认为 SFT 蒸馏收益有限,并讨论了限制中国开放权重模型可能带来的网络安全防御风险。
Every latest articlesAI 评分6161 为什么有些 AI 工作流能坚持下来而另一些不能
Every 作者 Katie 复盘自己放弃和留下的多个 AI 工作流,结论是关键在于工作流回报的速度与是否匹配真实工作习惯。她为 CEO 的 Tend 需求搭建的 Attention Desk 因问题不存在而弃用,管理日程的 Margot 因维护成本过高被搁置,而即时给到回报的 compound writing 插件成为日常核心。
elsewhere articlesAI 评分6161 十字路口对话生数科技张金涛:从 SageAttention 到 Vidu S1 的推理加速与实时交互视频
播客邀请生数科技张金涛聊实时交互视频模型 Vidu S1:上传一张照片可变成能实时视频通话的 AI 角色,生成速度超过播放速度并支持无限时长。
Hugging Face BlogAI 评分5858 IBM Research:模型路由看似简单,实则是系统优化问题
IBM Research 团队撰文指出,把 Agent 系统中的模型路由当作分类问题会失效,实际是成本、质量、延迟与合规并存的系统优化问题。
AI as Normal Technology精选AI 评分7272 Arvind Narayanan 在 ICML 演讲谈 AI 时代还剩什么工作
Princeton 的 Arvind Narayanan 在 ICML Seoul 发表题为“还有什么工作留给我们做”的主题演讲,主张用 AI as Normal Technology 框架看待AI影响,并称实验室里程碑不会突然让人失业。他提出方法、产品、早期采用、适应四阶段,指出可靠性指标两年内仅提升五到十个百分点、适应阶段需要数十年;未来工作将从构建转向评估,人类应与AI形成“共同超级智能”。
推荐理由:作者结合能力与可靠性的测量数据,把AI经济影响拆为四个阶段,给出职业适应与评估优先的判断框架。
AI as Normal Technology精选AI 评分6969 Narayanan 撰文分析 AI 实验室如何上移价值栈以摆脱商品化陷阱
Arvind Narayanan 与 Akash Kapur 撰文认为模型推理在均衡状态下将陷入 Bertrand 悖论式竞争,价格趋向生成 token 的边际成本,模型层难以维持利润。
推荐理由:文章用历史案例和经济理论论证模型推理难逃商品化陷阱,实验室将靠上移价值栈构建护城河,但代价是企业锁定。
Sierra Blog精选AI 评分6666 Sierra 全员推行 Agent Pinecone 的五条经验
Sierra 于今年 1 月成立六人 AI 加速团队,将多个角色专属 Agent 合并为统一 Agent Pinecone,内置在 Claude Code 和 Codex 之上。
推荐理由:原文给出 Sierra 内部推行统一 Agent 的具体做法与教训,单 Agent 架构、持久化上下文和以产出物衡量价值等经验可迁移到其他公司。
Berkeley AI ResearchAI 评分5454 UC Berkeley 提出 Agent 时代数据系统的 For、Of、By 三大研究议程
UC Berkeley 的 Aditya G. Parameswaran 等人发表观点文章,认为近零推理成本时代将重塑数据系统研究。
Import AIAI 评分5959 Import AI 464:Fable 写出 GPU kernel,AI 自动化与模拟计算
Jack Clark 在 Import AI 464 期中汇总多项进展:Fable 在 KernelBench-Mega 上提交了首个也是最快的 megakernel。
Dwarkesh PatelAI 评分5555 Dwarkesh 公布 AI 大问题征文赛三篇获奖 essays
Dwarkesh Patel 的 AI 大问题征文赛收到超过 600 篇 essays,并公布三名获奖者及全文。
Sierra BlogAI 评分3333 Sierra Ghostwriter 黑客松:30 人用 AI 智能体三小时完成原本六个月的工作
Sierra 举办 Ghostwriter 黑客松,来自 17 家公司的 30 名参与者(过半来自年营收超 $10B 的企业)无论技术背景如何,都做出了可运行的 AI 智能体。有人三小时完成原本需六个月的工作,还有人把 Ghostwriter 指向知识库后 15 分钟一次性生成智能体。现场产出涵盖理赔受理、贷款资格审核、药房福利语音智能体等,其中一个账户解锁智能体在活动结束前已部署到生产环境。
elsewhere articlesAI 评分5050 十字路口对谈:Agent 元年第 500 天,GUI 退场、CLI 复兴与 Agentic Economy 萌芽
十字路口与真格基金「此话当真」串台播客复盘 Agent 元年 500 天,嘉宾为真格投资总监钟天杰和 AI 开发者归藏。
elsewhere articlesAI 评分4040 Agent 元年第 500 天:GUI 退场、Headless 上位与 CLI 复兴
真格基金「此话当真」与「十字路口」串台播客在 Agent 元年第 500 天复盘:Claude 3.5 Sonnet 在第 100 天前后为 Agent 提供能力基础并带火 Manus,第 300 天 Claude Code 刷屏。节目以 GUI 退场、Headless 上位、CLI 复兴、Skills 封装、Agentic Economy 萌芽为主线,讨论为何不该再投资 GUI 思维的软件。
Dwarkesh PatelAI 评分4545 Grant Sanderson 谈 AI 与数学的未来
3Blue1Brown 的 Grant Sanderson 在播客中讨论 AI 在数学领域的进展。他指出 AI 自 2024 年起能在 19 秒内解出 IMO 几何题,但在组合数学题上仍表现吃力,数学内部的进展呈现"分形"式的不均衡。他还探讨了 AI 能否找到领域间隐藏联系、概念性突破的验证周期可能长达一个世纪,以及 AI 是否净增人类对数学的理解。