xAI 让 Grok Bot 自主处理采购:Haggle Bot 已省下超 10 万美元
xAI 用 Grok Bot 搭建采购智能体 Haggle Bot,接入 Slack、Notion、Drive、Gmail、Hex、Ramp 后梳理约 125 家活跃供应商,已识别超 10 万美元直接节省。它在一款 SaaS 中发现 43 个 90 天无活动的付费席位,省下 14,220 美元,并在另一产品中找出每年 85,662 美元未使用 SKU。
网站与博客 · 历史来源 · 当前未持续收录
xAI 用 Grok Bot 搭建采购智能体 Haggle Bot,接入 Slack、Notion、Drive、Gmail、Hex、Ramp 后梳理约 125 家活跃供应商,已识别超 10 万美元直接节省。它在一款 SaaS 中发现 43 个 90 天无活动的付费席位,省下 14,220 美元,并在另一产品中找出每年 85,662 美元未使用 SKU。
xAI 发布面向企业的 Grok Bot,新增访问、网络和审计控制,用于在规模化条件下治理智能体。每个 Bot 在云端独立运行,跟随一次即可学到工作流并自主执行,Bot 之间还能互相传递上下文。xAI 称上线以来已有数千家机构采用,包括 Legora、Supermicro 和 ServiceTitan,Grok 与 Cursor 企业客户可在接下来两周免费使用并邀请整个组织。
xAI 介绍 Grok Bot 的设计思路,界面以 Bot 而非会话为核心,每个 Bot 拥有名字、头像、记忆和自己的电脑与工具。Grok Bot 把产品概念收敛为 Bot、Chat、Prompt、Tool、Artifact 五个,工具与技能放在账号级,记忆与 Routine 归 Bot 级,并设定每个账号约 50 个 Bot、每个群聊 6 个的上限。
推荐理由:xAI 复盘 Grok Bot 的界面取舍,展示持久化智能体如何从以会话为中心转向以 Bot 为中心。
LatchBio 对 Grok 4.6 的独立评测显示,其在 BioSecBench-Refusal 上以 62.1% 的平均分位列第一,是唯一在拒绝红队任务(59.2%)和完成常规生物任务(64.8%)两项指标上均超过 50% 的模型。
xAI 宣布 Grok Bot 现已支持连接 X 账号,没有开发者账号的用户会由平台代为创建,付费 Grok Bot 用户还可获得免费的 X API 额度。用户在 Grok Bot 中通过 X connector 登录后,可以让 Bot 搜索帖子、读取自己的时间线、查看提及或汇总 X 上的动态;此外还提供 X 插件,用于搜索帖子、读取时间线、拉取趋势和管理书签。xAI 表示这是该集成的第一个版本。
xAI 的旗舰模型 Grok 4.6 现已在 Microsoft Foundry 上线,支持 500k 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,面向长时间运行的智能体及交互与视觉任务。
xAI 宣布 Grok 4.6 已在 Gemini Enterprise Agent Platform 的 Model Garden 上线,开发者可直接调用。该旗舰模型面向长时间运行的智能体与交互、视觉任务,提供 500k 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度。
xAI 宣布 Grok Bot 现已包含在全部 SuperGrok 档位以及 Cursor Pro、Cursor Pro+、Cursor Ultra 和 Cursor Teams(Standard 与 Premium)计划中。
xAI 将 Grok Build 从 7 月起仅限 SuperGrok Heavy 的 Early Beta 开放给所有用户,网页、iOS 和 Android 均可使用,只需在对话中描述应用、游戏、网站或仪表盘即可生成可运行版本。
推荐理由:Grok Build 从仅限 SuperGrok Heavy 的早期测试转向全量开放,并补齐发布分享、自有域名与 GitHub 导出等交付环节。
xAI 宣布 Grok 4.6 已在 Amazon Bedrock 上正式可用,支持区域内的所有开发者均可调用。该模型提供 500k 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,面向长时间运行的智能体和交互、视觉类任务。定价为输入 $2、缓存输入 $0.50、输出 $6 每 100 万 tokens。
xAI 完成 60 亿美元 C 轮融资,投资方包括 A16Z、Blackrock、Fidelity Management & Research Company、Sequoia Capital、QIA 等,NVIDIA 和 AMD 作为战略投资方参与。
推荐理由:原文列出本轮投资方名单与资金用途,并给出 Colossus 与 Grok 的进展节奏,可对照其扩张计划。
xAI 发布 Grok Business 与 Grok Enterprise 两款面向团队的企业版并即刻开放使用,Grok Business 定价 30 美元每用户每月,包含团队管理、统一账单和用量分析。
xAI 发布 Grok 4.5,称其为自家最强模型,面向编码、智能体任务和知识工作,并与 Cursor 一同训练。官方给出的成绩包括 SWE Marathon 通过率 29.0%、DeepSWE 1.0 得分 62.0%,并称其平均每个 SWE Bench Pro 任务输出 15,954 个 token,约为 Opus 4.8 (max) 的 4.2 分之一。
推荐理由:原文给出多项基准对比、定价与 token 效率数据,读者可据此比较它与同代编码模型的位置。
xAI 宣布 Grok 系列基础模型的 API 进入公开测试,开发者可在 console.x.ai 注册后调用,首发的预览模型 grok-beta 支持 128,000 token 上下文、函数调用和系统提示词。
推荐理由:xAI 开放 Grok API 公测并给出兼容 OpenAI 的迁移路径,开发者可据此评估接入成本。
xAI 宣布与萨尔瓦多政府合作推出其称为全球首个的全国性 AI 教育项目,计划未来两年把 Grok 部署到 5000 多所公立学校,覆盖超过 100 万名学生的个性化学习。项目将提供随学生进度、偏好和掌握程度调整的课程对齐辅导,并把教师作为协作伙伴。xAI 表示会与萨尔瓦多共同开发新的方法论、数据集与框架,用于指导课堂中的负责任 AI 使用。
xAI 发布 Grok 4 Fast,称其用平均少 40% 的思考 token 在基准上达到与 Grok 4 相当的表现,同一前沿基准性能的价格降低 98%。该模型采用统一架构,由系统提示词切换长链推理与快速响应,具备 2M token 上下文窗口和端到端训练的工具调用与网络、X 搜索能力,在 LMArena Search Arena 以 1163 Elo 排名第一。
推荐理由:原文给出与 Grok 4 的基准对比、token 消耗和 API 定价,读者可据此判断推理模型的成本效率走向。
xAI 发布 Grok for Outlook,这是一个 Microsoft 365 加载项,把智能体放进邮箱,可总结长邮件线程、按用户语气起草回复并整理收件箱。该加载项可读取附件并搜索网络和 X,邮件需用户点击发送才会发出。目前已向所有付费 X 和 SuperGrok 用户开放,可在 Microsoft Marketplace 添加,Word、Excel 和 PowerPoint 版本也已提供。
xAI 宣布 SuperGrok 或 X Premium 订阅用户即日起可在开源本地优先智能体 OpenClaw 中登录并使用 Grok 模型,所有订阅档位均可接入。OpenClaw 可运行在 Mac Mini、笔记本、服务器、VPS 甚至树莓派上,支持跨会话持久记忆,并接入 WhatsApp、Telegram、Slack、Discord、Signal、iMessage 等消息平台。
xAI 为 Grok Build 推出 Agent Dashboard,把每个 Grok Build 会话集中到一个界面,可查看各会话状态、并行运行并在需要输入时介入。
Grok Build 现已开源,源码发布在 GitHub 上,包含智能体循环、工具、终端 UI 和扩展系统四部分。公开的代码覆盖上下文组装、模型响应解析、工具调用分发,以及 skills、plugins、hooks、MCP servers、subagents 的加载与调用方式。Grok Build 还支持完全本地运行,可自行编译并指向本地推理,全部通过 config.toml 驱动。
推荐理由:源码公开了智能体循环、工具调用与扩展系统的具体实现,可对照理解自建编码智能体的工程细节。
xAI 的 Grok 4.6 已在 GitHub Copilot 上线,向 VS Code 和 GitHub 上的开发者开放。开发者可在模型选择器中选中 Grok 4.6,云端智能体、Copilot CLI 和 VS Code 均可使用,部分企业需先在 Copilot 设置中启用该模型。该模型同时提供 API 调用,定价为每百万输入 token 2 美元、每百万输出 token 6 美元。
推荐理由:Grok 4.6 接入 GitHub Copilot 的模型选择器,开发者可据此比较其编码能力与每百万 token 定价。
xAI 通过 API 以公测形式开放编码模型 grok-build-0.1,该模型专门针对包括网页开发、调试和 MCP 支持在内的智能体编码任务训练,也是驱动 Grok Build 的同一模型。
推荐理由:模型给出 100+ tokens/秒的服务速度与每百万 token 1 美元输入、2 美元输出的定价,便于评估智能体编码场景的成本与速度取舍。
xAI 发布 Voice Agent Builder 测试版,这是在 Grok Voice 上配置生产级语音智能体的无代码平台,内置电话、知识库检索、工具、护栏、MCP 和可观测性。
推荐理由:xAI 把电话、知识库、工具与护栏收进同一个语音接口,并给出单价和基准对比,便于判断落地成本。
xAI 宣布完成 E 轮融资,募资 200 亿美元,超过原定 150 亿美元的目标规模,Valor Equity Partners、Stepstone Group、Fidelity、Qatar Investment Authority、MGX 和 Baron Capital Group 等参投,NVIDIA 与 Cisco Investments 为战略投资方。
推荐理由:融资超出原定目标,文中列出投资方构成与算力、Grok 5 的当前进展,可观察 xAI 的资金与基建节奏。
xAI 发布 Grok 4.1,已在 grok.com、X 及 iOS 和 Android 应用向所有用户开放,Auto 模式即时上线并可在模型选择器中显式选择。
推荐理由:官方给出与上一代在真实流量中的盲测偏好和 LMArena 榜单对比,可据此判断对话风格与幻觉控制的改进幅度。
xAI 发布 AI 助手 Grok,其底层是自研前沿 LLM Grok-1,Grok 通过 𝕏 平台具备对世界的实时知识。Grok-1 在 HumanEval 上取得 63.2%、MMLU 73%、GSM8k 62.9%、MATH 23.9%,xAI 称其在该算力级别中超过 ChatGPT-3.5 和 Inflection-1,仅落后于训练数据和算力大得多的 GPT-4。
推荐理由:原文给出 Grok-1 在 HumanEval、MMLU 等基准上的分数与同算力级别的横向对比,可据此判断其能力定位。
xAI 宣布完成 $6 billion B 轮融资,投资方包括 Valor Equity Partners、Vy Capital、Andreessen Horowitz、Sequoia Capital、Fidelity Management & Research Company、Prince Alwaleed Bin Talal 和 Kingdom Holding 等。
xAI 宣布 Grok Imagine Video 1.5 已在 Imagine API 全面开放,同时在 grok.com/imagine 及 iOS、Android 应用上线 Video 1.5 Fast。
推荐理由:官方逐项对比了音频、运动物理与生成速度的变化,可据此判断图生视频在实际创作中的可用程度。
xAI 宣布扩展 xAI For Government,通过美国总务署(GSA)的 OneGov 计划,未来 18 个月内以 0.42 美元的价格向所有美国联邦政府部门、机构和局开放 Grok 4 与 Grok 4 fast 等推理模型。
推荐理由:xAI 以 0.42 美元向全部美国联邦机构开放 Grok 4,可借此观察前沿模型进入政府市场的定价与合作方式。
xAI 发布 Grok 4.6,在 Grok 4.5 基础上强化长时间运行的智能体以及更复杂的交互与视觉任务,官方称其在多项智能体编码和知识工作基准上达到前沿水平。
推荐理由:官方列出 Grok 4.6 在多项智能体编码与知识工作基准上的对比数据,可据此判断其在长任务上的位置。
xAI 宣布可在 OpenCode 中接入 Grok,连接 Grok 账号后即可使用 Grok Build 编码,该模型同样驱动 xAI 的终端编码智能体。用户在 OpenCode 内运行 /connect 并选择 xAI,可通过 SuperGrok 订阅的 OAuth 登录,或使用面向 SSH、远程主机与 VPS 的无头登录方式。xAI 表示后续还将推出更多开源智能体与集成。
xAI 推出 PromptIDE,一个用于提示词工程与可解释性研究的集成开发环境,可透明访问驱动 Grok 的 Grok-1 模型。其核心是 Python 代码编辑器与配套 SDK,支持复杂提示词技术、并发执行,并实时展示 tokenization、采样概率、备选 token 和聚合注意力掩码等分析。该 IDE 支持提示词自动保存与版本管理、公开分享,目前面向早期访问计划成员开放。
xAI 将 Grok 接入 Microsoft Word,推出免费的 Microsoft 365 加载项,用户可在文档中把提示词转为段落、从网络引入研究资料,或改写文本以提升清晰度与简洁度。
推荐理由:xAI 把 Grok 接入 Word,读者可以了解它在文档写作、联网检索与连接器取数上的具体用法。
xAI 发布第一代多模态模型 Grok-1.5V,在文本能力之外可处理文档、示意图、图表、截图和照片等视觉信息,将先向早期测试者和现有 Grok 用户开放。xAI 新推出的 RealWorldQA 基准上,Grok-1.5V 得分为 68.7%,高于 GPT-4V 的 61.4%、Claude 3 Opus 的 49.8% 和 Gemini Pro 1.5 的 67.5%。
xAI 以 Apache 2.0 许可开放 Grok-1 的基座模型权重和网络架构。Grok-1 是 314B 参数的 Mixture-of-Experts 模型,每个 token 激活 25% 的权重,由 xAI 使用基于 JAX 和 Rust 的自研训练栈从零训练,预训练阶段于 2023 年 10 月结束。
推荐理由:xAI 以 Apache 2.0 开放 314B MoE 基座权重与架构,读者可据此了解其预训练配置和复用条件。
SpaceXAI 与 Anthropic 签署协议,向 Anthropic 提供 Colossus 1 超算的访问权限。该集群配备超过 220,000 块 NVIDIA GPU,包括 H100、H200 和下一代 GB200 加速器。Anthropic 计划用这部分额外算力直接提升 Claude Pro 和 Claude Max 订阅者的容量,并表达了合作开发多吉瓦级轨道 AI 算力的意向。
推荐理由:协议给出 Colossus 1 的 GPU 规模与 Anthropic 的用途,可据此观察前沿模型的算力供给安排。
xAI 发布 Grok-2 与 Grok-2 mini 的早期预览版,称它们在聊天、编码和推理上较 Grok-1.5 有显著提升。早期版本以 sus-column-r 名义在 LMSYS 榜单测试,xAI 称其整体 Elo 超过 Claude 3.5 Sonnet 和 GPT-4-Turbo。
推荐理由:原文给出 Grok-2 与 Grok-2 mini 的完整基准表和竞技场排名,可与 Claude、GPT-4o 等模型直接对照。
xAI 发布 Grok-1.5 模型,具备长上下文理解与高级推理能力,将在未来几天面向早期测试者和 𝕏 平台现有 Grok 用户开放。Grok-1.5 在 MATH 得 50.6%、GSM8K 得 90%、HumanEval 得 74.1%,相比 Grok-1 的 23.9%、62.9% 和 63.2% 均有提升。
推荐理由:原文给出 Grok-1.5 的数学、编码基准成绩与 128K 上下文窗口,读者可据此对比同期模型的推理能力。
xAI 发布代号 Aurora 的图像生成模型,随 Grok Imagine API 一同上线,覆盖图像生成、图像编辑以及视频生成与视频编辑。Aurora 是自回归 MoE 网络,通过预测交错文本与图像数据中的下一个 token 训练,使用数十亿互联网样本,原生支持多模态输入并可直接编辑用户提供的图片。新能力已在 𝕏 平台面向部分国家开放,并将在约一周内推送给全部用户。
推荐理由:官方给出 Aurora 的架构思路与多模态输入能力,可据此判断 Grok 图像生成在文本渲染与图像编辑上的定位。
xAI 宣布被美国国防部(DOW)选中,其面向美国军方与国家安全用户的前沿 AI 系统将接入 DOW 的 GenAI.Mil 套件,让 300 万军人和文职人员以 DOW Impact Level 5(DOW IL5)访问 xAI 技术。
推荐理由:这份 xAI 官方公告交代了合同覆盖的机构、平台与部署层级,可了解前沿 AI 进入美国军方系统的具体路径。