跳到正文

全部动态

今日 26 条
9月14日周一
9月11日周五
9月10日周四
  1. Ant Ling54

    Novita 与蚂蚁百灵合作,在 Hugging Face 上线 Ling-3.0-flash-VL,前 14 天免费。模型总参数 124B、每 token 激活 5.5B,原生支持图像与视频理解,面向多模态推理和智能体工作流。

    引用Novita AI@novita_labs

    🤗 Novita now supports Ling-3.0-flash-VL on @huggingface. 🎁 Free for 14 days. • 124B total parameters · 5.5B active parameters per token • Native image and video understanding • Built for multimodal reasoning and agentic workflows

  2. DeepSeek API updates78

    DeepSeek 发布 DeepSeek-V4.1-Flash,API 价格同步下调

    DeepSeek 正式发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸模型,具备原生多模态视觉理解能力,设计目标是能力上限更高、推理更快、吞吐更大。

    推荐理由:官方公布了新结构系列最小模型的多项基准成绩和 API 迁移方式,开发者可据此评估切换成本与价格变化。

9月9日周三
9月8日周二
9月6日周日
9月5日周六
9月4日周五
9月3日周四
  1. Google DeepMind72

    Google DeepMind 发布 WeatherNext 3 全球 AI 天气模型

    Google DeepMind 与 Google Research 发布 WeatherNext 3,称其为最先进准确的全球 AI 天气模型。模型直接学习实时卫星数据和气象站观测,逐小时产出最高 5 公里分辨率预报,精度约为 WeatherNext 2 的五倍;中期降水预报 CRPS 相对 IMERG 提升最高 60%。

    推荐理由:官方介绍了新模型的分辨率、逐小时更新和降水精度提升,并说明其在 Google 各产品中的落地方式,读者可评估对天气相关业务的应用价值。

  2. Demis Hassabis60

    Demis Hassabis 宣布 Google 发布 Gemini 3.8 Flash,这是不到一个月内的又一次升级,同时推出面向网络防御方向的 3.8 Flash Cyber。引用内容称 3.8 Flash 是 6 周内第三个更新的 Flash 模型,提升了智能体与编码能力,详情见博客 https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/

    引用Logan Kilpatrick@OfficialLoganK

    Introducing Gemini 3.8 Flash, another jump in Gemini's agentic + coding capabilities, and our 3rd updated Flash model in only 6 weeks... This model has been a ton of fun to work with, excited to see what you all think!

9月2日周三
  1. Fei-Fei Li57

    Fei-Fei Li 宣布 World Labs 团队发布从零训练的多模态世界模型 Atlas。该模型支持像素级精准的相机控制生成帧、从单张输入图像重建大场景、通过重排视频帧模拟时空、从一或多张图像原生输出 3D 空间,以及将多张带位姿图像组合成一致的 3D 世界,潜在应用覆盖 VFX 到机器人。

    引用World Labs@theworldlabs

    Introducing Atlas: The world's first multimodal world model that generates image and video frames with pixel-perfect camera control and reconstructs them in 3D. Model the world, move the camera, and simulate space & time.

9月1日周二
  1. Runway News68

    Runway 发布 Interface World Model 首个模型 Solaris,实时生成可交互界面

    Runway 发布 Solaris,定位为 Interface World Model 系列的首个模型,基于 Gen-4.5 改造,逐帧实时生成应用和网站界面,无需代码等中间表示。用户研究显示 250 名参与者约 7500 次成对评判中,61% 偏好其遵循指令(对比编码界面的 24%),71% 认为交互更自然;文本渲染、长会话一致性和无障碍集成仍是待解难题,现已开放早期访问申请。

    推荐理由:官方详细说明了实时生成的原理、与 Claude Opus 5 的对比数据和遗留短板,读者可以据此判断这类界面生成模型的实际边界。

  2. Google Research56

    Google 发布 TimesFM-3 时间序列基础模型,支持零样本多变量预测

    Google 发布 TimesFM-3,一个 330M 参数、在超过 1 万亿时间点上预训练的时间序列基础模型,原生支持零样本多变量预测。模型可在单次前向传播中生成整个预测区间,支持多目标、过去协变量和过去-未来协变量,并在 Gift-Eval、FEV-Bench 和 Time 三个基准上于点预测和概率预测指标中均排名第一。

  3. Claude Platform release notes71

    Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1,默认 1M token 上下文并下调缓存读取价格

    Anthropic 发布 Claude Fable 5.1(claude-fable-5-1),面向长时运行的智能体编码、知识工作和研究,并向 Project Glasswing 参与者提供 Claude Mythos 5.1。

    推荐理由:官方发布说明列出了定价、上下文窗口和多项 API 变更,方便现有使用方评估迁移和缓存成本影响。