跳到正文

网站与博客

媒体报道、公司博客与研究文章

当前显示全部 AI 相关新闻
按账号或来源筛选(93)
全部网站与博客新闻IT Home8971 条Simon Willison360 条OpenAI News317 条TechCrunch · AI301 条The Decoder275 条The Verge · AI161 条Hugging Face Blog151 条Claude Blog140 条elsewhere articles116 条Google Research108 条OpenRouter Announcements103 条Mistral AI89 条Databricks Blog86 条Tomer Tunguz84 条Sierra Blog67 条Anthropic Newsroom65 条Gary Marcus64 条Claude Platform release notes62 条Runway News62 条Gemini API 更新日志60 条LMSYS Blog60 条Manus Blog60 条Together AI Blog60 条Google DeepMind58 条NVIDIA Blog53 条a16z News49 条Apple Machine Learning Research48 条LangChain Blog48 条Suno Blog48 条ByteByteGo46 条ElevenLabs Blog45 条Google Blog: AI41 条Qwen Blog40 条Google Developers Blog35 条Cursor Blog34 条Google Cloud: Databases32 条Microsoft AI News32 条Linear Now30 条AWS Machine Learning Blog29 条Ars Technica · AI27 条Dwarkesh Patel27 条Nathan Lambert: Interconnects26 条Latent Space24 条DeepSeek API updates23 条Sakana AI Blog23 条Anthropic Research21 条Import AI21 条AI as Normal Technology20 条ByteDance Seed Papers17 条MIT Technology Review · AI16 条GitHub Blog · AI & ML12 条MiniMax Blog12 条Meta Engineering11 条Sam Altman Blog11 条Berkeley AI Research10 条Black Forest Labs Blog10 条MarkTechPost10 条Microsoft Research10 条xAI:News9 条Cohere 产品与研究博客8 条Epoch AI:Gradient Updates8 条Factory 研究 / 产品8 条Google AI:DEV 作者专属8 条OpenClaw Blog8 条Recode China AI8 条Redwood Research Blog8 条Replit Blog8 条SemiAnalysis 长文8 条Understanding AI8 条404 Media7 条Amazon Science7 条Artificial Intelligence News7 条Every latest articles7 条Exponential View7 条Liquid AI 模型与工程博客7 条LlamaIndex:产品、工程与评测7 条PromptArmor:Threat Intelligence7 条PyTorch Blog7 条Thinking Machines Lab Blog7 条Preferred Networks:AI 研究与产品6 条ByteDance Seed Research5 条ChinaTalk5 条Chips and Cheese4 条Canary Media:Data Centers2 条Claude YouTube2 条CMU Machine Learning Blog1 条MarkTechPost · 历史来源118 条xAI News · 历史来源73 条Artificial Intelligence News · 历史来源54 条Claude YouTube · 历史来源46 条Ars Technica: AI · 历史来源19 条GitHub Blog · 历史来源17 条Lilian Weng's Log · 历史来源2 条
13,334 条AI 相关新闻 · 最新在前
9月24日周四
  1. Meta Engineering54

    Meta 将 Private Processing 机密计算扩展到 Meta AI 眼镜

    Meta 宣布把 Private Processing 机密计算基础设施扩展到 Meta AI 眼镜,让 AI 在云端 CVM 内处理个人上下文,连 Meta 自己也无法访问数据。系统基于 TEE 硬件隔离,采用匿名凭证加第三方 OHTTP 中继实现不可定向路由,通过 RA-TLS 远程证明核对公开透明账本,持久记忆以用户密钥加密存储在 TEE 内,并扩展 Bug Bounty 供外部研究者审计。

  2. Apple Machine Learning Research26

    Apple 提出半监督联邦 ASR 实用方案:在线伪标签配合服务端更新稳定化

    Apple 研究团队提出半监督联邦 ASR 训练方案,通过在线伪标签教师与服务端标注数据锚定更新两条耦合设计轴,解决伪标签误差跨序列、跨轮次累积导致的训练发散问题。该方案在 11 组对比中 9 组优于此前最强方法,域内平均提升 20.8%、跨域提升 10.0%,缩小了与全监督联邦学习的差距。

  3. GitHub Blog · AI & ML56

    GitHub Copilot app 如何渲染超大 Pull Request

    GitHub Copilot app 重建了 Pull Request 视图,可流畅打开含 2,200 个文件、超过一百万行变更和 400 多条内联评论的超大 PR。核心做法是把高度拆成确定性的代码几何与动态评论块两套独立体系,配合基于身份锚定的滚动校正、先流式返回结构的 pipeline,以及用生产探针和自动巡航跑 change → measure → improve 循环来定位 bug。

  4. Black Forest Labs Blog64

    Black Forest Labs 发布开源 World Action Model FLUX 3 Action

    Black Forest Labs 发布 7B 单步 World Action Model FLUX 3 Action(F3A)并公开权重与技术报告。在 RoboLab 上 F3A 成功率 38.3%±0.38,超过 Cosmos 3 Nano 的 36.8%,guidance 蒸馏版将纪录提高到 42.2%±0.36,比 Pi0.5 BF16 快 1.34x 到 2.28x。

    推荐理由:官方报告同时放出权重和完整微调配方,还给出与 Pi0.5、Cosmos 3 的速度与成本对比,读者可评估机器人部署选型。

  5. elsewhere articles34

    真格基金让 AI 当主播,与管理合伙人刘元录了一期播客

    真格基金在其播客《此话当真》中让 AI 坐上主播席,与真格管理合伙人刘元对谈约一小时。AI 顺着自己的好奇心提问,聊到能否训练一个「刘元 AI」、AI 能否胜任早期投资,以及人为什么带着缺陷仍一次次相信「这一次会不一样」。节目还讨论了资本不再稀缺后,价值观和品位会成为基金的差异。

  6. Anthropic Research64

    Anthropic Project Swap 实验:Claude 智能体在交易市场代用户换书的表现

    Anthropic 让 201 名员工的 Claude 智能体在六个办公室的去中心化交易楼层代用户交换书籍。5 分钟 intake 对话后,Claude 对书对的排序与本人一致率达 61%,市场效率 0.55(最优 0.89),其中 85% 的差距来自偏好表征不准而非谈判;重跑显示模型选择比指令更影响谈判结果,Opus 楼层效率 0.88 高于 Haiku 的 0.75。

    推荐理由:原文把市场失分的 85% 归因于偏好表征而非谈判能力,并给出模型选择比指令更影响结果的可复现数据。

  7. LangChain Blog57

    LangChain 发布 Managed Deep Agents 0.8,新增用户级记忆、认证与 HTTP 通道

    LangChain 发布 Managed Deep Agents 0.8,新增用户自有凭据、用户级记忆、HTTP 通道、Slack 文件传输,以及由 Parallel 驱动的内置网页搜索工具。用户记忆按调用者身份隔离,Slack 群聊等多人场景默认禁用用户记忆以防泄漏;连接服务开箱支持 23 个服务,Parallel 网页搜索在 MDA beta 期间免费。

  8. LangChain Blog60

    LangChain 发布 LangSmith Fine-Tuning 与 smithtune CLI,可将 Agent 轨迹转为微调模型

    LangChain 推出 LangSmith Fine-Tuning(Public Beta)和 smithtune CLI,把 LangSmith 轨迹数据集准备、Fireworks 或 Baseten 训练、LangSmith 评估与部署整合到一条命令行流程中,目前支持 SFT。

    推荐理由:官方给出内部两个 Agent 的 SFT 实测数据和完整工作流,读者可据此评估轨迹数据微调自家模型的收益与成本。

  9. Claude Blog54

    Claude Tag 支持在 Slack 频道中使用个人连接器

    Anthropic 宣布 Claude Tag(beta)新增个人连接器支持,频道内用户请求时可调用自己账户连接的工具,如个人 Google Drive、日历或 CRM。用户可选择 review 模式在发布前审核回复,或使用 auto 模式自动发布;Enterprise 管理员可强制审核。该功能现正面向 Team 计划推出,Enterprise 随后支持,无人值守任务仍使用频道共享连接器。

9月23日周三
  1. ByteByteGo40

    如何定制模型让它学会新技能:从提示词、RAG 到 LoRA 与 QLoRA 微调

    当提示词和 RAG 无法消除模型在特定任务上的反复偏差时,就需要通过微调把期望行为固化进模型参数。文章梳理了定制模型的路径:先用 few-shot prompting 和检索增强生成(RAG)补充信息,再用监督微调(SFT)训练模型,而 LoRA 和 QLoRA 通过减少需要调整的参数和显存占用,让微调现有模型更易落地。

  2. Google DeepMind68

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词设计角色声音、30 秒音频样本复刻声音,并逐行指挥表演。

    推荐理由:原文给出两个 TTS 模型的定位差异、基准成绩和开放渠道,读者可据此评估语音生成工作流的选型。

  3. NVIDIA Blog18

    NVIDIA 验证工程师 Sakeena Fiza 如何让硬件大规模成功

    NVIDIA 验证工程师 Sakeena Fiza 的工作是在产品量产前充当"第一个客户",把硬件逼到极限以提前发现问题。她最难忘的时刻之一是 NVIDIA Rubin GPU 首次在系统层面被识别,屏幕上只显示"NVIDIA Corporation Device",全场欢呼。她所在的机架可能包含近 50 万个组件,验证需覆盖固件、硬件、软件、散热与制造等环节。

  4. Gary Marcus28

    Gary Marcus 致信特朗普:美中可在 AI 安全与癌症、网络安全上合作而非放缓

    Gary Marcus 公开致信特朗普,建议其在与中国领导人的 AI 会谈中放弃"放缓"路线,转而推动美中合作,领域包括癌症与网络安全,类似冷战时期美苏在太空和天花上的合作。他援引《人民日报》文章称美中应"让 AI 成为中美合作新前沿"并利用政府间 AI 对话机制,认为中国实际上渴望合作。