跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

当前仅显示精选新闻
357条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 161–180 条 · 共 357 条
8月25日周二
  1. Hugging Face Blog69

    Gradio 推出 gr.Workflow:把 AI 管线变成可拖拽、可部署的节点图

    Hugging Face 在 Gradio 中内置 gr.Workflow,将 AI 应用管线描述为带类型的节点图,在同一画布上提供可运行节点、可视化中间结果、REST API 和一键部署到 Hugging Face Spaces。

    推荐理由:官方介绍了 gr.Workflow 的节点图机制和多条可复制的示例工作流,读者可以据此评估它能否替代手工拼装 Python 管线。

8月24日周一
  1. 机器之心 · 微信公众号78

    斯坦福教授 Percy Liang 团队启动 Marin 535B-A23B 模型训练并全程公开

    斯坦福大学教授 Percy Liang 与 Marin 开放实验室启动 Marin 535B-A23B 模型训练,并全程公开训练过程。该模型有 5350 亿总参数、230 亿激活参数,准备 18.75 万亿 token 训练数据,部署 11 套 GB200 NVL72 约 792 颗 GB200 GPU,预计连续训练约 3 个月,总训练计算量约 2.7e24 FLOPs。

    推荐理由:训练数据配比、实时 loss 曲线与实验日志全程公开,为观察前沿大模型训练过程提供了少见的一手材料。

8月23日周日
  1. @kimmonismus71

    据 WSJ 报道,英伟达将投入 60 亿美元打造一个开放权重 AI 模型,通过授权 Poolside 的技术并把其 100 多名员工并入 Nemotron 项目。英伟达还将以 120 亿美元投前估值向 Poolside 追加投资 10 亿美元。其目标是挑战 DeepSeek、Kimi 等中国开放权重模型团队,同时直接对标 OpenAI、Anthropic 等美国前沿实验室。

    推荐理由:报道给出的资金与团队规模,让读者能看清英伟达自研开放权重模型的投入量级及其双线竞争位置。

8月22日周六
  1. @OpenRouter65

    OpenRouter 说明 Thinking Machines Lab 模型的提示词和输出会被记录并用于改进其模型,会话数据会先与账号解绑,完整条款见各模型页面。开放权重采用 Apache 2.0,通过 API 访问这些免费端点适用单独条款。

    推荐理由:原文说明这些免费端点的提示词与输出会被记录用于改进模型,开放权重为 Apache 2.0,读者可据此判断数据与授权条款。

8月21日周五
  1. IT Home80

    OpenAI 开源 Codex Harness,放出 CLI、SDK 与 app-server 三类组件

    OpenAI 以 Apache-2.0 许可开源驱动 Codex 的底层执行框架 Harness,并放出三类组件:运行自动化流水线的 codex exec CLI、支持 TypeScript 和 Python 的 Codex SDK,以及通过 JSON-RPC 连接本地 Codex 进程的 app-server。

    推荐理由:开源的三类组件与 Harness 调优带来的基准变化,可供开发者评估把智能体嵌入自有产品的落地方式。

8月20日周四
  1. @gdb65

    Codex 的开源 harness 可用于构建编码之外的智能体产品,一个税务申报试点处理了 7,000 份申报,把准备时间缩短约三分之一。团队用它把智能体接入内部应用和运营仪表盘,由应用掌控界面、上下文、工具与审批,harness 负责智能体循环。

    引用@OpenAIDevs@OpenAIDevs

    Teams are using the open-source Codex harness to bring agents into the tools they already use, from internal apps to operations dashboards. Their applications control the interface, context, tools, and approvals while the harness handles the agent loop. https://t.co/shi2vwqxh4

    推荐理由:税务试点把 Codex 用在编码之外,配合开源 harness 展示了智能体接入自有产品的一条路径。

  2. @omarsar066

    Elvis Saravia 介绍了 TrueFoundry 发布的开源 agent harness TrueForge,他获得早期访问并在本地运行了数天。TrueForge 负责工具调用循环、上下文管理、子智能体协调和沙箱代码执行,支持 OpenAI、Anthropic、Google 模型以及 Kimi、GLM、DeepSeek 等开源权重模型,模型路由是可配置项。

    原始视频预览图;未保存可播放视频URL

    推荐理由:作者给出同一基准下的成本对比和多模型路由配置,便于判断自托管 agent harness 的实际取舍。

8月19日周三
  1. @thexpin68

    智谱 AI 发布新基础模型 GLM-5.3 的 API,聚焦复杂编码、网络安全防御和长程任务,在 Artificial Analysis Intelligence Index 得分 60,进入全球前沿模型梯队。该模型已接入 ZCode 和 GLM Coding Plan,与 Kimi K3 并列为领先开源模型,权重定于下周开源。

    推荐理由:原文交代了 GLM-5.3 的能力侧重、基准分数和开放节奏,读者可以据此判断其在开源与闭源模型中的位置。

  2. 硅星人Pro · 微信公众号77

    DeepSeek V4 Pro 与 V4 Flash 涨价生效,下游订阅与 Agent 平台成本承压

    DeepSeek V4 Pro 和 V4 Flash 的新价格于8月17日正式生效,V4 Pro 峰时缓存命中价格从每百万 Token 0.003625 美元提高到 0.044 美元,为原来的 12.14 倍,输出价格从 0.87 美元提高到 3.96 美元;V4 Flash 峰时输出从 0.28 美元提高到 1.32 美元,为原来的 4.71 倍。

    推荐理由:文章用峰谷价差和订阅额度变化,量化这次涨价对下游开发者与Agent平台的实际成本冲击。

8月18日周二
8月17日周一
  1. xAI News70

    Grok Build 开源,编码智能体与 TUI 源码发布到 GitHub

    Grok Build 现已开源,源码发布在 GitHub 上,包含智能体循环、工具、终端 UI 和扩展系统四部分。公开的代码覆盖上下文组装、模型响应解析、工具调用分发,以及 skills、plugins、hooks、MCP servers、subagents 的加载与调用方式。Grok Build 还支持完全本地运行,可自行编译并指向本地推理,全部通过 config.toml 驱动。

    推荐理由:源码公开了智能体循环、工具调用与扩展系统的具体实现,可对照理解自建编码智能体的工程细节。

  2. xAI News71

    xAI 开源 314B 参数 Grok-1 基座模型权重

    xAI 以 Apache 2.0 许可开放 Grok-1 的基座模型权重和网络架构。Grok-1 是 314B 参数的 Mixture-of-Experts 模型,每个 token 激活 25% 的权重,由 xAI 使用基于 JAX 和 Rust 的自研训练栈从零训练,预训练阶段于 2023 年 10 月结束。

    推荐理由:xAI 以 Apache 2.0 开放 314B MoE 基座权重与架构,读者可据此了解其预训练配置和复用条件。