最新精选 第 221–240 条 · 共 427 条 00:00 SGLang 与 Meta Superintelligence Labs 合作,为 Muse Glimmer 提供 Day-0 支持。Muse Glimmer 是 30B 参数多模态稠密模型,拥有 128k+ token 上下文窗口,架构含 27.9B 文本解码器、1.9B ViT 和多模态 projector。
推荐理由:原文给出多平台实测吞吐与量化方案,读者可据此评估在本地硬件跑智能体工作流的可行性。
08:00 Anthropic 宣布从 8 月 14 日起 Claude Code 在 Pro、Max 和 Team 计划的新会话默认启用 auto mode,并停止向这些计划用户收取分类器开销。
推荐理由:文中对照了 auto mode 与人工审批在拦截危险命令上的差异,读者可据此判断默认权限模式的取舍。
18:00 ChatGPT 上线改进版 GPT-5.6 Sol,准确性与一致性提升,同时向免费用户扩大 GPT-5.6 Luna 的访问权限,并提供无限量的日常对话。
推荐理由:原文给出模型改动和免费用户的额度调整,读者可据此判断 ChatGPT 日常使用方式的变化。
23:00 Black Forest Labs 的 FLUX 3 Video 初版正式通过 BFL API 和部分合作方开放。模型可生成最长 20 秒、带原生音频的视频,支持 HD(720p)与 Full HD(1080p),并提供文本生视频、图生视频与关键帧、视频续写(最多 4 秒素材)、单次生成多镜头、多语言对话与精确口型同步、Draft Mode 快速预览等能力。
推荐理由:官方公布了模型能力和自评基准数据,并说明后续开源权重与图像版本的路线,可帮助读者评估其在视频生成工作流中的位置。
00:00 Microsoft Research 发布开源智能体框架 Orchard,核心是可复用的 Kubernetes 环境服务 Orchard Env,支持在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 内直接训练智能体。
推荐理由:原文给出框架设计、训练配方和多项基准数字,读者可以据此评估开放环境层对降低 Agent 研究成本的作用。
08:00 OpenRouter 发布 Ori Eval,在其 500 多个可选模型中为具体应用找出最合适的模型。工具会扫描代码库中所有模型调用点,通过问答确定你关心的成本、速度或准确率,生成 *.eval.ts 评测文件,用 bun test 断言智能体调用的工具并用 LLM judge 评开放性回答;运行期间固定 harness 与模型使结果可归因于模型变化。
推荐理由:原文说明评测如何固定环境、覆盖代码中模型调用点并接入 CI,读者可据此判断选型流程能否落地到自己的项目。
08:40 OpenAI 下调 GPT-5.6 系列 API 价格,入门款 Luna 最高降价 80%,每百万 Token 输入价格从 1 美元降到 0.2 美元、输出从 6 美元降到 1.2 美元。
推荐理由:降价最狠的 Luna 定位在高频 Agent 任务,读者可据此判断智能体长期运行的成本门槛变化。
16:17 月之暗面于 2026 年 7 月 27 日正式开源 Kimi K3,总参数量达 2.8 万亿。华为宣布昇腾实现 0day 极速适配,训练侧基于 MindSpeed MM 在 Atlas 800 A3、Atlas 900 A3 SuperPoD 上完成减层训练基础功能适配。
推荐理由:原文给出昇腾对 Kimi K3 的训练与推理适配细节,读者可了解国产算力与开源大模型的协同路径。
00:00 SGLang 和 Miles 发布对 Kimi K3 的 Day-0 支持,分别覆盖推理与 RL 训练。K3 为 2.8T 参数的 3 万亿参数级首个开源模型,采用 69 层 KDA 线性注意力与 24 层 MLA 的混合架构和 1M token 上下文窗口。
推荐理由:原文由 SGLang 团队自述 Day-0 支持的实现细节,给出内存管理、投机解码与并行策略的具体方案和实测数字,可迁移到异构注意力架构的部署。
00:00 Runway 推出面向专业开发者和企业团队的 AI 媒体平台 Runway Dev,现已可用,入口为 dev.runwayml.com。
推荐理由:原文列出了四大能力和企业级安全条款,开发者可以据此评估是否用单一平台替代多个媒体 API 的拼装方案。
08:00 OpenAI 在 ChatGPT 中上线健康功能,符合条件的美国用户可安全连接医疗记录和 Apple Health,以获得更个性化的洞察并更好地理解自身健康状况。
推荐理由:原文给出了该功能的开放对象与接入的医疗数据来源,读者可据此了解它面向哪些用户以及能提供什么。
08:00 Claude 语音模式现已运行在 Claude Opus、Sonnet 和 Haiku 上,可调用 Gmail、Slack 等已连接工具,并新增法语、德语、印地语、日语、韩语等多种语言。
推荐理由:语音模式此前只跑 Haiku,如今接入 Opus 和 Sonnet 并打通已连接工具,让口头推演能直接落到执行。
08:00 Hugging Face 宣布 Diffusers 原生支持 Nunchaku Lite,通过 from_pretrained() 直接加载 Nunchaku(SVDQuant)W4A4 量化检查点,无需单独推理引擎或本地 CUDA 编译。
推荐理由:官方介绍 Diffusers 原生加载 Nunchaku Lite 4-bit 检查点,附基准数据与自行量化发布流程,可迁移到消费级 GPU 部署。
08:00 OpenRouter 上线 POST /api/v1/audio/transcriptions 音频转写端点,复用 Chat Completions 的同一 API key 和鉴权。
推荐理由:官方教程给出了完整的请求参数、限制和计费细节,读者可以直接照抄接入而不必自建 Whisper 服务。
08:00 Cursor 发布智能模型路由器 Cursor Router,可自动将每个请求路由到最适合当前任务的模型,在节省 60% 成本的同时提供前沿质量的性能。Cursor 基于 60 多万个真实请求训练该路由分类器,并在数百万个真实请求上做在线 A/B 测试,以用户满意度(AFC)作为 reward 进行优化;抢先体验中数十家企业客户成本降低约 30% 至 50% 且质量没有下降。
推荐理由:官方给出路由器在成本与满意度上的实测对比数据,可了解自动选模在真实流量中的效果。
08:00 xAI 推出 Grok for Excel,一个免费的 Microsoft 365 加载项,可从 Microsoft Marketplace 安装。用户可用自然语言提问数据变化并生成带单元格引用的回答和图表,按描述生成公式、运行情景测试,还能通过连接器拉取最近邮件或 SharePoint、Google Drive 中的文件上下文;同类加载项也已支持 Word 和 PowerPoint。
推荐理由:官方公告说明了加载项的具体能力与安装方式,使用 Excel 的读者可以评估它对表格工作流的实际改变。
23:57 NVIDIA 和 Hugging Face 推出 NeMo Automodel 与 Diffusers 的集成,为 Hub 上任意 Diffusers 格式模型提供生产级分布式扩散训练,无需转换 checkpoint 或重写模型。
推荐理由:NVIDIA 与 Hugging Face 把分布式扩散训练接入 Diffusers,无需转换 checkpoint 或重写模型,可直接微调现有开源扩散模型。
02:00 Sierra 发布内部云 Agent 平台 Pinecone,让员工在浏览器、Slack、Linear 或手机上创建、共享和自动化云端智能体会话。每个会话约一秒内获得带代码仓库、构建缓存和开发服务的隔离环境,并提供多人协作、自动盯 PR、定时自动化、可复用 Skills 和多会话 Projects 等能力。
推荐理由:Sierra 官方复盘自研内部云 Agent 的架构与经验,读者可以从中了解企业如何沉淀员工工作智慧并组织智能体协作。
11:23 上海市科委宣布,植入式脑机接口手部运动功能代偿系统(NEO)获批上市后的首张处方在上海开出,全球首例植入手术在复旦大学附属华山医院完成。术中测试显示系统采集的硬膜外脑电信号稳定、质量良好,患者术后生命体征平稳。
推荐理由:从获批上市到开出第一张处方用了约四个月,读者可了解植入式脑机接口进入真实诊疗的路径。
00:00 SGLang 与 Miles 团队同 Thinking Machines Lab 合作,为 975B 参数、上下文最长 1M tokens 的多模态模型 Inkling 提供 Day-0 支持。
推荐理由:原文给出 Inkling 架构细节、SGLang 各项优化后的具体吞吐数字,以及 Miles 侧完整 RL 训练方案,工程参考价值具体。
上一页 1 … 10 11 12 13 14 … 22 下一页