跳到正文

Hugging Face Blog

huggingface.co · 网站与博客

当前显示全部 AI 相关新闻
切换来源
全部网站与博客新闻IT Home8667 条Simon Willison353 条OpenAI News317 条TechCrunch · AI267 条The Decoder251 条Hugging Face Blog151 条The Verge · AI144 条Claude Blog139 条elsewhere articles113 条Google Research108 条OpenRouter Announcements103 条Mistral AI88 条Tomer Tunguz81 条Databricks Blog76 条Sierra Blog67 条Anthropic Newsroom65 条Gary Marcus64 条Claude Platform release notes62 条Runway News62 条LMSYS Blog60 条Google DeepMind58 条a16z News49 条LangChain Blog48 条Suno Blog48 条NVIDIA Blog47 条ByteByteGo46 条Apple Machine Learning Research43 条Google Blog: AI41 条Google Developers Blog35 条Cursor Blog33 条Microsoft AI News32 条Linear Now30 条AWS Machine Learning Blog29 条Google Cloud: Databases28 条Dwarkesh Patel27 条Ars Technica · AI26 条Nathan Lambert: Interconnects25 条Latent Space24 条DeepSeek API updates23 条Sakana AI Blog23 条Anthropic Research21 条Import AI21 条AI as Normal Technology20 条MIT Technology Review · AI16 条GitHub Blog · AI & ML12 条Meta Engineering11 条Berkeley AI Research10 条Microsoft Research10 条Black Forest Labs Blog8 条ByteDance Seed Papers8 条ElevenLabs Blog8 条Gemini API 更新日志8 条Manus Blog8 条MarkTechPost8 条MiniMax Blog8 条Qwen Blog8 条Together AI Blog8 条Every latest articles7 条ByteDance Seed Research5 条xAI:News5 条Thinking Machines Lab Blog4 条CMU Machine Learning Blog1 条Sam Altman Blog1 条MarkTechPost · 历史来源106 条xAI News · 历史来源73 条Artificial Intelligence News · 历史来源48 条Claude YouTube · 历史来源41 条Ars Technica: AI · 历史来源18 条GitHub Blog · 历史来源17 条Lilian Weng's Log · 历史来源2 条
151 条AI 相关新闻 · 最新在前
8月14日周五
8月13日周四
  1. Hugging Face Blog71

    Hugging Face 复盘复现 2,226 篇 ICML 2026 论文的 hackathon

    Hugging Face 于 7 月 15 日至 8 月 2 日举办 ICML 2026 Open Reproductions 挑战赛,1,221 名参与者用 Claude Code、Codex、Cursor 等智能体在 19 天内发布 6,816 份 Trackio 日志,复现 2,226 篇论文,约占会议的 34%。

    推荐理由:官方复盘给出了逐条声明级别的复现数据和失败案例,可迁移到用智能体做大规模论文审计的工作流。

8月12日周三
8月11日周二
8月10日周一
  1. Hugging Face Blog44

    Hugging Face 提出离线 Top-K Logits 与融合分块 KL 损失,让知识蒸馏低成本跑在大规模场景

    Hugging Face 最新论文提出两项系统改动降低 LLM 知识蒸馏成本:一是离线缓存教师模型每位置的 top-100 logits,训练时无需再加载教师;二是融合分块 KL 损失,避免生成完整的词表×序列长度矩阵。以 gpt-oss-120b 为例,稠密 KL 峰值约 250GB 显存,融合分块方案峰值约 128GB,使长上下文修复可在单 GPU 上完成。

  2. Hugging Face Blog81

    Meta 发布开源多模态模型 Muse Glimmer-30B,主打本地智能体场景

    Meta 发布从 Muse 蒸馏而来的 30B 多模态模型 Muse Glimmer,采用 Apache 2.0 许可,面向本地隐私场景的智能体用途。模型由 2B ViT 视觉编码器和 28B 文本解码器组成,支持图像、视频、多模态工具调用和目标检测,并附带基于 DFlash 的可选投机解码。

    推荐理由:原文给出架构组成、基准对比和各推理框架的 day-0 用法,读者可以据此评估本地部署的可行路径。

8月8日周六
  1. Hugging Face Blog44

    Hugging Face 推出 TutorMoments:评测 AI 导师何时该帮、何时该放手

    Hugging Face 发布 TutorMoments 预览版,用真实一对一数学辅导记录回放式评测 LLM 导师的介入时机判断。数据集含 462 份脱敏文字记录、1500 多个教师标注关键时刻,来自 27 位美国教师标注者。测试 7 个 LLM 发现,仅被告知"好好辅导"时模型倾向过度帮助,在提示词中写明"帮与不帮"的权衡可提升表现,但仍未追平人类导师。

8月6日周四
8月4日周二
7月30日周四
7月29日周三
  1. Hugging Face Blog40

    Hugging Face 博客介绍 OlmoEarth Platform:行星尺度的地理空间推理

    Ai2 推出 OlmoEarth Platform,用于把地理空间基础模型从微调、评估一路支撑到大规模推理。该平台可在约一天内完成洲级区域推理,处理数十 TB 影像,成本为每平方公里不到一美分。北美野火风险图任务峰值动用约 19,600 个 CPU 和 994 个 GPU,网络吞吐超 168 GB/s,把预计 4,737 小时的串行计算压缩到约 30.5 小时,实现 155× 加速。

7月28日周二
7月27日周一
7月23日周四
7月22日周三
  1. Hugging Face Blog42

    物理 AI 仿真现状概览:从 MuJoCo 到 NVIDIA Isaac Sim

    Hugging Face 发布物理 AI 仿真综述,指出机器人训练缺乏互联网级数据,仿真可低成本生成数千小时机器人经验。文章梳理了 MuJoCo、MuJoCo Warp(MJWarp)、NVIDIA Isaac Sim 与 Isaac Lab 等主流引擎,并提出训练、仿真、机载三计算机范式,其中机载端以 NVIDIA Jetson AGX Thor 级设备运行策略。

7月21日周二
7月20日周一
7月17日周五
  1. Hugging Face Blog69

    NVIDIA NeMo Automodel 与 Diffusers 集成,可大规模微调视频和图像模型

    NVIDIA 和 Hugging Face 推出 NeMo Automodel 与 Diffusers 的集成,为 Hub 上任意 Diffusers 格式模型提供生产级分布式扩散训练,无需转换 checkpoint 或重写模型。

    推荐理由:NVIDIA 与 Hugging Face 把分布式扩散训练接入 Diffusers,无需转换 checkpoint 或重写模型,可直接微调现有开源扩散模型。

7月16日周四
  1. Hugging Face Blog87

    Hugging Face 披露 2026 年 7 月由自主 AI 智能体发起的基础设施入侵事件

    Hugging Face 披露其生产基础设施遭入侵,攻击由一个自主 AI 智能体系统端到端驱动,攻击者利用数据集处理的两个代码执行路径获得初始访问,窃取部分内部数据集和服务凭证。

    推荐理由:官方披露由自主 AI 智能体发起的基础设施入侵与处置细节,读者可以看到防御方如何用自有模型完成取证并应对护栏限制。

7月15日周三
  1. Hugging Face Blog81

    Hugging Face 发布 Thinking Machines 多模态开源模型 Inkling 使用指南并推出 Inkling-Small

    Thinking Machines 的开源多模态模型 Inkling 上线 Hugging Face,总参数 975B(激活 41B),原生接收图像、文本和音频输入,支持 1M 上下文和 1M token 训练语料中的 45 万亿 token 多模态训练,同日推出 276B 总参数、12B 激活参数的 Inkling-Small。

    推荐理由:官方详细拆解了 Inkling 的 MoE、相对注意力等架构设计,并给出从 2TB BF16 到 1-bit GGUF 的多档部署路径,方便按硬件选型。

7月10日周五
7月9日周四
7月8日周三
  1. Hugging Face Blog64

    Hugging Face:vLLM 的 transformers 后端达到原生实现速度

    Hugging Face 宣布 vLLM 的 transformers modeling backend 现在在多种 LLM 架构上达到甚至超过 vLLM 手写原生实现的速度,模型作者无需移植即可获得原生推理性能。

    推荐理由:官方给出三种 Qwen3 规模下的对比数据和方法,读者可以据此评估是否直接用 transformers 后端替代手写 vLLM 实现。

7月7日周二
  1. Hugging Face Blog61

    Microsoft Foundry Managed Compute 上线 Hugging Face 精选模型集

    Microsoft 在 Build 2026 宣布 Foundry Managed Compute 及 Hugging Face 模型集,精选开源权重模型每周更新,可一键部署到 Azure 预置的 GPU 托管平台。

    推荐理由:官方详解 Hugging Face 模型进入 Foundry Managed Compute 的策展流程、支持运行时和部署方式,读者可以据此评估企业侧部署开源模型的实际路径。

  2. Hugging Face Blog61

    LeRobot v0.6.0 发布:世界模型策略、奖励模型 API 与六大仿真基准

    Hugging Face LeRobot 团队发布 v0.6.0,引入 VLA-JEPA、LingBot-VA、FastWAM 三个世界模型策略,新增 GR00T N1.7、MolmoAct2、EO-1 等 VLA,以及 Robometer、TOPReward 奖励模型和统一奖励 API。

    推荐理由:官方完整发布说明覆盖世界模型策略、奖励模型、基准与部署 CLI,读者可据此评估是否升级自己的机器人训练工作流。

  3. Hugging Face Blog63

    Hugging Face 与 SkyPilot 推出 store: hf,跨云读取 Hub 数据免出流费

    Hugging Face 与 SkyPilot 联合推出 store: hf 后端,用一个 hf:// URL 和现有 HF_TOKEN 即可将 Hugging Face Bucket 或任意 Hub 仓库挂载进 SkyPilot 任务,任务可调度到 20+ 云、Kubernetes 和本地集群。

    推荐理由:原文给出具体价格对比和三云基准数字,读者可以据此评估零出流存储对跨云训练成本的实际影响。

7月6日周一
7月1日周三
6月30日周二