跳到正文

全部动态

今日 337 条
9月10日周四
  1. Cursor Blog76

    Cursor 推出 Projects,用协调智能体管理大规模长期开发工作

    Cursor 推出 Projects,可承接一项功能、一次迁移或完整应用等大规模工作,在长达数月的工作中维持上下文,并向数千个子智能体委派任务。它由不写代码的协调智能体统一指挥,核心包括默认云端运行、跨机器同步的共享上下文,以及监听 Slack、按计划运行和跟进 PR 的订阅能力。

    推荐理由:官方说明给出协调机制、共享上下文和订阅三类核心功能,以及内部使用数据,读者可据此评估是否纳入自己的开发流程。

  2. Mistral AI45

    Cloudera 与 Mistral 达成合作,将主权 AI 引入企业数据平台

    Mistral 与 Cloudera 建立合作,将 Mistral 模型集成进 Cloudera 混合数据平台,企业可在私有云、公有云、本地及完全气隙环境中部署推理并保持完全控制。企业还能在受控环境中用专有数据训练自有模型,基于开放权重拥有数据和由此产生的智能。Cloudera 平台承载 30 exabytes 客户自管数据。

  3. jietang24

    你确定吗?找到最优模型规模很棘手:数据量、激活参数量、环境数量,以及目标推理成本。模型性能还取决于许多其他因素,每个因素都会带来自身的变数。

    引用Charlie O'Neill@oneill_c

    Fable is probably ~2-2.5T parameters, not 10T. Kimi K3 is 2.8T params, trained on maybe 20–30k Blackwell-equivalents. It lands within spitting distance of Fable 5 in terms of capabilities (5, not 5.1). Anthropic has far more compute than Moonshot, better rl environments, better architecture and better optimizers and all of that adds to capability per parameter. So if Fable is only slightly ahead of K3 with this in mind, it's almost certainly a smaller model. GPT-5.5 and 5.6 are smaller still (I'll say more on that later)

  4. OpenAI News70

    OpenAI 在 API 中推出语音模型 GPT‑Live‑1

    OpenAI 在 API 中推出语音模型 GPT‑Live‑1,支持自然的全双工语音对话。模型具备更强的指令遵循能力,支持自定义音色和电话场景。

    推荐理由:官方摘要指出模型新增全双工语音、自定义音色和电话支持,可据此了解 API 语音能力的扩展方向。

  5. OpenAI News64

    OpenAI 发布 Agents API,用于构建云端智能体

    OpenAI 发布 Agents API,一项用于构建和上线云端智能体的托管服务,底层由 Codex harness 驱动,支持编排、长时间运行会话和工具调用。

    推荐理由:OpenAI 官方宣布 Agents API,读者可从中了解其托管架构与工具调用能力如何服务云端智能体开发。

  6. Ant Ling54

    Novita 与蚂蚁百灵合作,在 Hugging Face 上线 Ling-3.0-flash-VL,前 14 天免费。模型总参数 124B、每 token 激活 5.5B,原生支持图像与视频理解,面向多模态推理和智能体工作流。

    引用Novita AI@novita_labs

    🤗 Novita now supports Ling-3.0-flash-VL on @huggingface. 🎁 Free for 14 days. • 124B total parameters · 5.5B active parameters per token • Native image and video understanding • Built for multimodal reasoning and agentic workflows

  7. OpenAI News61

    Paul Christiano 加入 OpenAI 基金会董事会

    OpenAI 宣布 Paul Christiano 加入 OpenAI 基金会董事会,并进入其安全与安全委员会。公告称他将带来在 AI 对齐、安全和标准方面的经验。

    推荐理由:官方宣布 Paul Christiano 加入 OpenAI 基金会董事会及其安全与安全委员会,人事动向本身即读者可关注的事实。

  8. a16z News42

    a16z 领投 Lightfield 4700 万美元 A 轮,打造智能体时代的 AI 原生 CRM

    a16z 领投 Lightfield 4700 万美元 A 轮融资,这是一款面向智能体时代的 AI 原生 CRM。它采用无需配置的灵活数据模型,可从邮件和通话中自动构建,底层是捕捉每笔交易背后原因的时间上下文图谱,智能体与人类通过同一 API 在同一平台协作。Lightfield 自去年年底推出以来已有数千家公司采用,部分团队正弃用 Salesforce、HubSpot 和 Attio 转投。

  9. Anthropic Newsroom84

    Anthropic 发布 2026 年 9 月威胁情报报告,披露多起 Claude 恶意使用案例

    Anthropic 威胁情报团队发布报告,披露 2025 年 12 月至 2026 年 8 月期间在七个危害领域识别并处置的 Claude 恶意使用活动,涉及疑似国家支持组织、犯罪团伙、商业间谍软件供应商等。

    推荐理由:报告用具体案例和数据说明AI如何改变网络攻击的成本与速度,并揭示AI供应链本身正成为攻击目标。

  10. DeepSeek API updates78

    DeepSeek 发布 DeepSeek-V4.1-Flash,API 价格同步下调

    DeepSeek 正式发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸模型,具备原生多模态视觉理解能力,设计目标是能力上限更高、推理更快、吞吐更大。

    推荐理由:官方公布了新结构系列最小模型的多项基准成绩和 API 迁移方式,开发者可据此评估切换成本与价格变化。

  11. Google Blog: AI36

    Google Search 上线橄榄球新功能:实时比赛动态、数据统计与梦幻阵容联动

    Google Search 推出橄榄球赛季新功能,包括实时比赛动态 Live Game Feed、更详细的球员与联盟数据统计,以及关联梦幻橄榄球账号获取个性化建议。Live Game Feed 已在美国移动端上线英文版,本月底将支持大学球队并扩展至更多地区;梦幻账号关联功能目前也仅限美国英文用户。

  12. Anthropic Research74

    Anthropic 红队发布 AI 模型战术情报定位与常规武器能力评测报告

    Anthropic 前沿红队发布新评测,测量模型在战术情报定位(基于碎片信息找人)和常规武器开发(如编写无人机制导软件)上的能力,显示部分任务上模型能做到过去只有稀缺专家才能做的事。

    推荐理由:原文用自建评测给出模型在情报定位和武器开发任务上的具体表现与模型间差距,读者可据此理解这类双用途能力的分布。

9月9日周三
  1. ByteByteGo58

    智能模型路由如何把 LLM 成本降低约 10 倍

    ByteByteGo 讲解智能模型路由,按请求难度把简单任务分给小模型、复杂任务分给强模型,算例显示 85% 请求走小模型、10% 走中等、5% 走强模型时平均成本约为全用强模型的 11%,接近 10 倍节省。文章覆盖小模型当路由器、级联先用便宜模型再校验升级、语义路由、基于真实数据的 learned routing,以及欠路由、过度路由、用户操纵路由规则等常见失败方式。

  2. Nathan Lambert: Interconnects41

    普通人何时才能感受到 AI 的影响?

    Nathan Lambert 认为 AI 对普通人日常生活的直接触达仍然边缘化,家庭、饮食、交通和娱乐等核心领域几乎感受不到影响,AI 目前主要是服务精英的知识工作工具。他警告若 AI 只带动半个社会,可能重演英国 1790 至 1840 年工资停滞而人均 GDP 快速扩张的"恩格斯停顿",进而拖累 AI 发展。

  3. OpenRouter Announcements62

    OpenRouter 推出美国区域路由,与去年上线的 EU 路由配套保障数据驻留

    OpenRouter 发布美国区域路由 us.openrouter.ai,与去年 10 月上线的 eu.openrouter.ai 配套,请求在区域内解密并只路由到区域内提供商,全程不出区。

    推荐理由:原文区分了推理级与端到端区域路由的差异,并说明区域域名、404 行为和 Guardrails 配置,读者可直接评估合规用法。