Grok 4.7 is here. It's a notable improvement over Grok 4.6 at the same price and speed.
#模型发布
#模型发布
今日 22 条
Michael Truell@mntruellAI 评分5454引用SpaceXAI@SpaceXAI
Andrew Milich@milichabAI 评分5555引用SpaceXAI@SpaceXAIGrok 4.7 is here. It's a notable improvement over Grok 4.6 at the same price and speed.
Anthropic Newsroom精选AI 评分9090 Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
Anthropic 发布 Claude Opus 5.5,为 Claude 5.5 家族首款模型,官方称其表现与 Claude Fable 5.1 相当,运行成本较 Opus 5 降低 40%,输入和输出 token 价格为 $4 和 $20 每百万,缓存读取 $0.20 每百万(降低 60%),输出速度快 30% 以上。
推荐理由:官方给出完整基准、价格与安全评估细节,读者可据此比较 Opus 5.5 在成本与智能体编码上的实际变化。
Claude Platform release notes精选AI 评分8282 Anthropic 发布 Claude Opus 5.5,默认 1M 上下文并降低价格
Anthropic 发布 Claude Opus 5.5(claude-opus-5-5),面向长时运行的智能体编码与知识工作,默认 1M token 上下文窗口。
推荐理由:官方发布说明列出了价格、上下文窗口和 API 行为变化,可为长期智能体编码工作流的迁移提供具体参考。
OpenRouter Announcements精选AI 评分6868 TypeSafe 决策模型 Jev 1.13 上线 OpenRouter,面向开发者解析用法
TypeSafe 于 2026 年 9 月 15 日发布早期访问版决策模型 Jev(当前版本 1.13),现已可通过 OpenRouter 调用。Jev 是非生成式决策模型,只接受文本输入,返回 Choice、Score、Noul 三种类型化答案并附带校准概率,无自由文本输出。
推荐理由:原文给出 Jev 三个返回原语、真实 API 响应和定价细节,开发者可据此判断是否用它替换现有 LLM 加正则的分类流程。
SpaceXAI@SpaceXAIAI 评分3535推出 Grok Voice Transcribe 2.0。它是全球最准确的语音转写模型。

Mustafa Suleyman@mustafasuleymanAI 评分4545引用Artificial Analysis@ArtificialAnlysGenerating high-quality images is cheaper and faster than ever. Muse Image, MAI-Image-2.6 and GPT Images 2.5 have substantially shifted the Text to Image Pareto frontiers for both price and speed in recent weeks.
Jeff Dean@JeffDeanAI 评分5555引用Liam Fedus@LiamFedusWe built high-throughput materials labs in Menlo Park to create a loop between experiments and models. The labs generate fresh data, the models learn from it, and then help us decide what to try next. Using only 1,300 H200s, plus months of our experimental data, we mid-trained and RL’d an open-source model to surpass GPT-6 Astra on our analysis benchmark. We call it Neon. This is real footage from our lab. We’re focusing first on hard problems in materials science, including superconductors, magnets, and semiconductor materials. Read our blog posts below.
ViggleAI@ViggleAIAI 评分5454
Logan Kilpatrick@OfficialLoganKAI 评分6464



Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音模型
Google DeepMind 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两个实时语音对话模型,主打近实时推理与语音智能体。
推荐理由:官方给出两个新语音模型的定位分工和多项基准数字,读者可据此判断其适合规模化还是高复杂度语音任务。
Odyssey@odysseymlAI 评分3434
inclusionAI Hugging Face modelsAI 评分5353 inclusionAI 发布 MoE 块扩散视觉语言 GUI Agent 模型 LLaDA-UI
inclusionAI 在 Hugging Face 开源 LLaDA-UI,一个基于 MoE 的块扩散视觉语言 GUI Agent,总参数约 16.7B,语言骨干为 LLaDA2.0-mini-base。
SiliconFlow@SiliconFlowAIAI 评分5252
Ant Ling@AntLingAGIAI 评分2626Ling-3.0-flash-Fin 现已推出三个量化版本:FP8、FP4 和 INT4。 如果你正在构建真实的金融工作流,可以选择最契合你基础设施、内存和效率需求的版本。🧵

inclusionAI Hugging Face modelsAI 评分4545 inclusionAI 发布 gemma-4-26B-A4B-it-singprobe:基于 Gemma 的流式安全探针
inclusionAI 发布 SingProbe,一个基于 google/gemma-4-26B-A4B-it 的流式安全探针,复用基座模型隐藏状态逐 token 打分,仅增加不到 0.5% 解码开销。
inclusionAI Hugging Face modelsAI 评分5656 inclusionAI 发布 SingProbe 流式安全探测,基于 Qwen3.6-35B-A3B
inclusionAI 在 Hugging Face 发布 SingProbe,一个复用 Qwen3.6-35B-A3B 隐层状态的轻量流式安全探测,逐 token 输出 8 类查询意图、不安全与幻觉风险分数,探测参数仅 4.2M。
inclusionAI Hugging Face modelsAI 评分5151 inclusionAI 发布基于 Qwen3-0.6B 的 SingProbe 流式安全探针
inclusionAI 发布 SingProbe,一个构建在 Qwen/Qwen3-0.6B 之上的流式安全探针,复用基座模型隐藏状态在每个 token 上评估查询意图、回复不安全性和幻觉风险。
inclusionAI Hugging Face modelsAI 评分5656 inclusionAI 发布 SingProbe:基于 Qwen3.5-122B-A10B 的流式安全护栏探针
inclusionAI 在 Hugging Face 发布 SingProbe,一个构建在 Qwen/Qwen3.5-122B-A10B 上的内在流式安全护栏探针,复用基座模型隐藏状态,在每个 token 上输出 8 类查询意图、回复不安全度和幻觉风险分数,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4545 inclusionAI 发布 Qwen3.5-0.8B-singprobe:基于隐藏状态的流式安全探针
inclusionAI 发布 Qwen3.5-0.8B-singprobe,一个基于 Qwen/Qwen3.5-0.8B 隐藏状态的流式安全探针,可在生成过程中逐 token 输出查询意图、回复不安全和幻觉风险评分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4646 inclusionAI 发布 Qwen3.5-397B-A17B-singprobe 流式安全探针
inclusionAI 发布基于 Qwen/Qwen3.5-397B-A17B 的流式安全探针 SingProbe,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4646 inclusionAI 发布 Qwen3.8-27B-singprobe:基于隐藏状态的流式安全探针
inclusionAI 发布 Qwen3.8-27B-singprobe,这是一个构建在 Qwen/Qwen3.8-27B 上的内在流式护栏探针,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4141 inclusionAI 发布 SingProbe:基于 gemma-4-E4B-it 的流式安全探针
inclusionAI 推出 SingProbe,一个基于 google/gemma-4-E4B-it 的流式安全探针,复用基座模型隐藏状态,在生成每个 token 时对查询意图、回复安全性和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4444 inclusionAI 发布 SingProbe:基于 Qwen3-4B-Instruct-2507 的流式安全探针
inclusionAI 发布 SingProbe,一个构建在 Qwen/Qwen3-4B-Instruct-2507 上的内置流式护栏,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4444 inclusionAI 发布 GLM-5.3-singprobe 流式安全探针
inclusionAI 发布基于 GLM-5.3 的流式安全探针 GLM-5.3-singprobe,复用基座模型隐藏状态逐 token 打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4545 inclusionAI 发布 Qwen3.5-4B-singprobe:基于 Qwen3.5-4B 的流式安全探针
inclusionAI 发布 Qwen3.5-4B-singprobe,这是一个构建在 Qwen/Qwen3.5-4B 上的流式安全探针,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4242 inclusionAI 发布 Qwen3.5-9B-singprobe:基于隐藏状态的流式安全探针
inclusionAI 发布 Qwen3.5-9B-singprobe,这是一个构建在 Qwen/Qwen3.5-9B 上的内置流式护栏,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4242 inclusionAI 发布 gemma-4-31B-it-singprobe:基于 Gemma 4 的流式安全探针
inclusionAI 发布 SingProbe,一个基于 google/gemma-4-31B-it 的流式护栏探针,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4242 inclusionAI 发布 gpt-oss-120b-singprobe:基于 gpt-oss-120b 的流式安全探针
inclusionAI 发布 gpt-oss-120b-singprobe,这是构建在 openai/gpt-oss-120b 上的流式护栏探针,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4646 inclusionAI 发布 Step-3.7-Flash-singprobe:基于 Step-3.7-Flash 的流式安全探针
inclusionAI 发布 SingProbe,一个构建在 stepfun-ai/Step-3.7-Flash 上的内在流式护栏,复用基座模型隐藏状态,在生成每个 token 时对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4444 inclusionAI 发布 Hy3-singprobe:基于腾讯 Hy3 的流式安全探针
inclusionAI 发布 Hy3-singprobe,一个构建在 tencent/Hy3 上的流式安全探针,复用基座模型隐藏状态逐 token 打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分4848 inclusionAI 发布 Qwen3-8B-singprobe:基于 Qwen3-8B 的流式安全探针
inclusionAI 发布 Qwen3-8B-singprobe,这是构建在 Qwen/Qwen3-8B 上的内在流式护栏,复用基座模型隐藏状态,在每个 token 上对查询意图、回复不安全和幻觉风险打分,解码开销低于 0.5%。
inclusionAI Hugging Face modelsAI 评分5050 inclusionAI 发布基于 MiniMax-M2.7 的流式护栏探针 SingProbe
inclusionAI 发布 SingProbe,一个构建在 MiniMaxAI/MiniMax-M2.7 之上的流式护栏探针,在生成过程中复用基座模型隐藏状态,对每个 token 输出查询意图、回复不安全度和幻觉风险评分。
Ant Ling@AntLingAGIAI 评分4949Ling-3.0-flash-VL 两项更新: - 现已在 OpenRouter 上线,提供两周免费访问 - FP4 和 INT4 量化版本现已开源 可通过 API 试用或自行部署——由你选择。


SiliconFlow@SiliconFlowAI精选AI 评分6767
推荐理由:原文给出 DeepSeek-V4.1-Flash 的参数结构、上下文长度和开源协议,读者可据此评估其部署与成本价值。
jietang@jietangAI 评分2424你确定吗?找到最优模型规模很棘手:数据量、激活参数量、环境数量,以及目标推理成本。模型性能还取决于许多其他因素,每个因素都会带来自身的变数。
引用Charlie O'Neill@oneill_cFable is probably ~2-2.5T parameters, not 10T. Kimi K3 is 2.8T params, trained on maybe 20–30k Blackwell-equivalents. It lands within spitting distance of Fable 5 in terms of capabilities (5, not 5.1). Anthropic has far more compute than Moonshot, better rl environments, better architecture and better optimizers and all of that adds to capability per parameter. So if Fable is only slightly ahead of K3 with this in mind, it's almost certainly a smaller model. GPT-5.5 and 5.6 are smaller still (I'll say more on that later)
OpenAI News精选AI 评分7070 OpenAI 在 API 中推出语音模型 GPT‑Live‑1
OpenAI 在 API 中推出语音模型 GPT‑Live‑1,支持自然的全双工语音对话。模型具备更强的指令遵循能力,支持自定义音色和电话场景。
推荐理由:官方摘要指出模型新增全双工语音、自定义音色和电话支持,可据此了解 API 语音能力的扩展方向。
Ant Ling@AntLingAGIAI 评分4343在 DeepInfra 上体验最新的 Ling-3.0-flash-VL,我们的 day0 合作伙伴 @DeepInfra
引用DeepInfra@DeepInfraLing-3.0-flash-VL is live on DeepInfra — day 0 with @AntLingAGI. https://deepinfra.com/inclusionAI/Ling-3.0-flash-VL
DeepSeek API updates精选AI 评分7878 DeepSeek 发布 DeepSeek-V4.1-Flash,API 价格同步下调
DeepSeek 正式发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸模型,具备原生多模态视觉理解能力,设计目标是能力上限更高、推理更快、吞吐更大。
推荐理由:官方公布了新结构系列最小模型的多项基准成绩和 API 迁移方式,开发者可据此评估切换成本与价格变化。
OpenAI News精选AI 评分6969 OpenAI 发布 GPT-6 Astra:面向商务场景的新一代模型
OpenAI 发布 GPT-6 Astra,称其为面向商务的最强模型,具备高级推理、电脑使用能力,以及更强的写作和设计判断。
推荐理由:官方宣布新模型并点出推理、电脑操作与写作设计判断等方向,可据此了解其在商务场景的定位。