Gemini 与 Pixel 携手五大足球俱乐部升级球迷观赛体验
Google Gemini 和 Pixel 与五家全球足球俱乐部达成合作,用 AI 和智能手机技术提升球迷的比赛日体验。合作聚焦于通过 Gemini 与 Pixel 的能力改善观赛互动方式。
媒体报道、公司博客与研究文章
Google Gemini 和 Pixel 与五家全球足球俱乐部达成合作,用 AI 和智能手机技术提升球迷的比赛日体验。合作聚焦于通过 Gemini 与 Pixel 的能力改善观赛互动方式。
AI 出现在近 40% 的美国竞选中,作为竞选议题的排名超过以色列、种族和制造业。围绕数据中心的讨论是主要部分,焦点集中在其对电费成本和当地资源的影响。
华为小艺、vivo 蓝心小 V、荣耀 YOYO 正推进接入支付宝 AI 助手“阿宝”,现已开始测试,落地后手机系统 AI 可调用支付宝办事智能体能力。知情人士称支付宝还在与更多手机品牌洽谈,目标推动主流手机终端接入阿宝。目前 OPPO 与阶跃已落地调用,OPPO 用户可通过系统级 AI 助手“小布”调用阿宝整合的近 200 项生活服务。
韩国正筹划建设海底数据中心,将服务器装入集装箱式舱体沉放至 20m 深海床,最终最多可容纳 10 万台服务器。韩国海洋水产部今年 4 月选定蔚山开展示范项目,试点预计耗资 511 亿韩元,测试最快今年启动,由韩国海洋科学技术院牵头,SK 电讯、乐天建设和浦项制铁参与。舱体须承受标准大气压 3 倍压力并解决盐分腐蚀与冷凝问题,目标让设备水下连续工作 5 至 7 年。
OpenAI 的 Linux 版 ChatGPT 应用已进入全球公开预览阶段,支持 Ubuntu、Debian 和 Fedora,提供 x64/ARM64 架构的 deb 和 rpm 安装包。
国家统计局新闻发言人付凌晖在 8 月 17 日国新办发布会上表示,今年 1 至 7 月我国工业机器人产量同比增长 28.5%,3D 打印设备、锂离子电池产量同比分别增长 52.3%、40.2%。
蚂蚁集团 CEO 韩歆毅在支付宝 AI 生态合作伙伴大会上判断,智能体商业将在未来 6-12 个月爆发。他认为临界点到来基于三大条件同时成熟:智能体推理、执行、工具调用成熟且长程复杂任务能力持续加强,流量红利消失后需从有限流量中提升效率,以及形成推动商家转化率提升和成本管控的价值闭环。
鸿蒙智行享界 G9 首发华为智擎自适应差速锁电驱,内置牙嵌式机械差速锁,支持毫秒速自动上锁,并通过连续交叉轴脱困测试;该车还在 50cm 对角高差交叉轴工况下通过扭转刚度测试,四门两盖流畅关闭无形变。享界 G9 定档 8 月 20 日发布,预售价 43.98 万元起,全系标配 L3 级架构与华为乾崑智驾 ADS 5 高阶版。
北通鲲鹏 70 6D 升级款手柄将于明晚 20:00 开启预约,预售到手价 599 元,采用 XBOX 式布局并支持 6D 环绕式震感。该手柄配备 AI 触觉反馈肩键、AI 触觉反馈双切扳机、专利急停握把马达和阻尼可视触觉摇杆,肩键内部集成微型线性马达,支持预设与自定义震动模式。
据 Bloomberg 报道,Stripe 正以超过 70 亿美元收购 AI 初创公司 OpenRouter,其最新估值为 13 亿美元。OpenRouter 提供 400 多个 AI 模型的接入服务,拥有 800 万用户,其 CEO 曾把公司形容为 AI 领域的 Stripe。
推荐理由:报道中的 70 亿美元收购价远高于 OpenRouter 13 亿美元的最新估值,可用于观察模型聚合层的定价逻辑。
TrendForce 预估液冷在 AI 芯片的渗透率将从 2025 年约 33% 升至 2026 年 53%,因英伟达、AMD、谷歌等 AI 芯片单芯片 TDP 普遍超越 1kW,整柜式 AI 服务器功率攀升至数百 kW。
OpenAI、Anthropic 等 AI 公司快速发展造就大批百万富翁和亿万富翁,瑞银数据显示截至今年 4 月的 12 个月内全球亿万富翁人数同比增长 13% 至 3302 人。
宇树科技发布人形机器人新品“超人”,原地跳高 2m、极限速度 12.66m/s(0.85m 腿长),称超越全世界全人类原地跳高和奔跑速度纪录。宇树表示该整机仅用 3 个多月研发,未来几个月还有很大完善空间。此前今年 4 月宇树 H1 跑出 10m/s 刷新世界纪录;8 月 12 日公司宣布人形机器人累计生产下线约 18,000 台。
韶音 OpenFit 2 AI 耳机已在京东开启预售,首发价 1398 元,基于千问 AI 模型,主打 AI 语音能力。该耳机支持三端快捷发起录音、最长 8 小时记录,内置 12 大行业词库,支持 30 种语言与 19 种方言转写及四种翻译模式。单耳音乐续航 11 小时,搭配充电盒总续航 48 小时,支持充电 10 分钟聆听 2 小时。
xAI 完成 60 亿美元 C 轮融资,投资方包括 A16Z、Blackrock、Fidelity Management & Research Company、Sequoia Capital、QIA 等,NVIDIA 和 AMD 作为战略投资方参与。
推荐理由:原文列出本轮投资方名单与资金用途,并给出 Colossus 与 Grok 的进展节奏,可对照其扩张计划。
xAI 发布 Grok Business 与 Grok Enterprise 两款面向团队的企业版并即刻开放使用,Grok Business 定价 30 美元每用户每月,包含团队管理、统一账单和用量分析。
xAI 发布 Grok 4.5,称其为自家最强模型,面向编码、智能体任务和知识工作,并与 Cursor 一同训练。官方给出的成绩包括 SWE Marathon 通过率 29.0%、DeepSWE 1.0 得分 62.0%,并称其平均每个 SWE Bench Pro 任务输出 15,954 个 token,约为 Opus 4.8 (max) 的 4.2 分之一。
推荐理由:原文给出多项基准对比、定价与 token 效率数据,读者可据此比较它与同代编码模型的位置。
xAI 宣布 Grok 系列基础模型的 API 进入公开测试,开发者可在 console.x.ai 注册后调用,首发的预览模型 grok-beta 支持 128,000 token 上下文、函数调用和系统提示词。
推荐理由:xAI 开放 Grok API 公测并给出兼容 OpenAI 的迁移路径,开发者可据此评估接入成本。
xAI 宣布与萨尔瓦多政府合作推出其称为全球首个的全国性 AI 教育项目,计划未来两年把 Grok 部署到 5000 多所公立学校,覆盖超过 100 万名学生的个性化学习。项目将提供随学生进度、偏好和掌握程度调整的课程对齐辅导,并把教师作为协作伙伴。xAI 表示会与萨尔瓦多共同开发新的方法论、数据集与框架,用于指导课堂中的负责任 AI 使用。
xAI 发布 Grok 4 Fast,称其用平均少 40% 的思考 token 在基准上达到与 Grok 4 相当的表现,同一前沿基准性能的价格降低 98%。该模型采用统一架构,由系统提示词切换长链推理与快速响应,具备 2M token 上下文窗口和端到端训练的工具调用与网络、X 搜索能力,在 LMArena Search Arena 以 1163 Elo 排名第一。
推荐理由:原文给出与 Grok 4 的基准对比、token 消耗和 API 定价,读者可据此判断推理模型的成本效率走向。
xAI 发布 Grok for Outlook,这是一个 Microsoft 365 加载项,把智能体放进邮箱,可总结长邮件线程、按用户语气起草回复并整理收件箱。该加载项可读取附件并搜索网络和 X,邮件需用户点击发送才会发出。目前已向所有付费 X 和 SuperGrok 用户开放,可在 Microsoft Marketplace 添加,Word、Excel 和 PowerPoint 版本也已提供。
xAI 宣布 SuperGrok 或 X Premium 订阅用户即日起可在开源本地优先智能体 OpenClaw 中登录并使用 Grok 模型,所有订阅档位均可接入。OpenClaw 可运行在 Mac Mini、笔记本、服务器、VPS 甚至树莓派上,支持跨会话持久记忆,并接入 WhatsApp、Telegram、Slack、Discord、Signal、iMessage 等消息平台。
xAI 为 Grok Build 推出 Agent Dashboard,把每个 Grok Build 会话集中到一个界面,可查看各会话状态、并行运行并在需要输入时介入。
Grok Build 现已开源,源码发布在 GitHub 上,包含智能体循环、工具、终端 UI 和扩展系统四部分。公开的代码覆盖上下文组装、模型响应解析、工具调用分发,以及 skills、plugins、hooks、MCP servers、subagents 的加载与调用方式。Grok Build 还支持完全本地运行,可自行编译并指向本地推理,全部通过 config.toml 驱动。
推荐理由:源码公开了智能体循环、工具调用与扩展系统的具体实现,可对照理解自建编码智能体的工程细节。
xAI 的 Grok 4.6 已在 GitHub Copilot 上线,向 VS Code 和 GitHub 上的开发者开放。开发者可在模型选择器中选中 Grok 4.6,云端智能体、Copilot CLI 和 VS Code 均可使用,部分企业需先在 Copilot 设置中启用该模型。该模型同时提供 API 调用,定价为每百万输入 token 2 美元、每百万输出 token 6 美元。
推荐理由:Grok 4.6 接入 GitHub Copilot 的模型选择器,开发者可据此比较其编码能力与每百万 token 定价。
xAI 通过 API 以公测形式开放编码模型 grok-build-0.1,该模型专门针对包括网页开发、调试和 MCP 支持在内的智能体编码任务训练,也是驱动 Grok Build 的同一模型。
推荐理由:模型给出 100+ tokens/秒的服务速度与每百万 token 1 美元输入、2 美元输出的定价,便于评估智能体编码场景的成本与速度取舍。
xAI 发布 Voice Agent Builder 测试版,这是在 Grok Voice 上配置生产级语音智能体的无代码平台,内置电话、知识库检索、工具、护栏、MCP 和可观测性。
推荐理由:xAI 把电话、知识库、工具与护栏收进同一个语音接口,并给出单价和基准对比,便于判断落地成本。
xAI 宣布完成 E 轮融资,募资 200 亿美元,超过原定 150 亿美元的目标规模,Valor Equity Partners、Stepstone Group、Fidelity、Qatar Investment Authority、MGX 和 Baron Capital Group 等参投,NVIDIA 与 Cisco Investments 为战略投资方。
推荐理由:融资超出原定目标,文中列出投资方构成与算力、Grok 5 的当前进展,可观察 xAI 的资金与基建节奏。
xAI 发布 Grok 4.1,已在 grok.com、X 及 iOS 和 Android 应用向所有用户开放,Auto 模式即时上线并可在模型选择器中显式选择。
推荐理由:官方给出与上一代在真实流量中的盲测偏好和 LMArena 榜单对比,可据此判断对话风格与幻觉控制的改进幅度。
xAI 发布 AI 助手 Grok,其底层是自研前沿 LLM Grok-1,Grok 通过 𝕏 平台具备对世界的实时知识。Grok-1 在 HumanEval 上取得 63.2%、MMLU 73%、GSM8k 62.9%、MATH 23.9%,xAI 称其在该算力级别中超过 ChatGPT-3.5 和 Inflection-1,仅落后于训练数据和算力大得多的 GPT-4。
推荐理由:原文给出 Grok-1 在 HumanEval、MMLU 等基准上的分数与同算力级别的横向对比,可据此判断其能力定位。
xAI 宣布完成 $6 billion B 轮融资,投资方包括 Valor Equity Partners、Vy Capital、Andreessen Horowitz、Sequoia Capital、Fidelity Management & Research Company、Prince Alwaleed Bin Talal 和 Kingdom Holding 等。
xAI 宣布 Grok Imagine Video 1.5 已在 Imagine API 全面开放,同时在 grok.com/imagine 及 iOS、Android 应用上线 Video 1.5 Fast。
推荐理由:官方逐项对比了音频、运动物理与生成速度的变化,可据此判断图生视频在实际创作中的可用程度。
xAI 宣布扩展 xAI For Government,通过美国总务署(GSA)的 OneGov 计划,未来 18 个月内以 0.42 美元的价格向所有美国联邦政府部门、机构和局开放 Grok 4 与 Grok 4 fast 等推理模型。
推荐理由:xAI 以 0.42 美元向全部美国联邦机构开放 Grok 4,可借此观察前沿模型进入政府市场的定价与合作方式。
xAI 发布 Grok 4.6,在 Grok 4.5 基础上强化长时间运行的智能体以及更复杂的交互与视觉任务,官方称其在多项智能体编码和知识工作基准上达到前沿水平。
推荐理由:官方列出 Grok 4.6 在多项智能体编码与知识工作基准上的对比数据,可据此判断其在长任务上的位置。
xAI 宣布可在 OpenCode 中接入 Grok,连接 Grok 账号后即可使用 Grok Build 编码,该模型同样驱动 xAI 的终端编码智能体。用户在 OpenCode 内运行 /connect 并选择 xAI,可通过 SuperGrok 订阅的 OAuth 登录,或使用面向 SSH、远程主机与 VPS 的无头登录方式。xAI 表示后续还将推出更多开源智能体与集成。
xAI 推出 PromptIDE,一个用于提示词工程与可解释性研究的集成开发环境,可透明访问驱动 Grok 的 Grok-1 模型。其核心是 Python 代码编辑器与配套 SDK,支持复杂提示词技术、并发执行,并实时展示 tokenization、采样概率、备选 token 和聚合注意力掩码等分析。该 IDE 支持提示词自动保存与版本管理、公开分享,目前面向早期访问计划成员开放。
xAI 将 Grok 接入 Microsoft Word,推出免费的 Microsoft 365 加载项,用户可在文档中把提示词转为段落、从网络引入研究资料,或改写文本以提升清晰度与简洁度。
推荐理由:xAI 把 Grok 接入 Word,读者可以了解它在文档写作、联网检索与连接器取数上的具体用法。
xAI 发布第一代多模态模型 Grok-1.5V,在文本能力之外可处理文档、示意图、图表、截图和照片等视觉信息,将先向早期测试者和现有 Grok 用户开放。xAI 新推出的 RealWorldQA 基准上,Grok-1.5V 得分为 68.7%,高于 GPT-4V 的 61.4%、Claude 3 Opus 的 49.8% 和 Gemini Pro 1.5 的 67.5%。
xAI 以 Apache 2.0 许可开放 Grok-1 的基座模型权重和网络架构。Grok-1 是 314B 参数的 Mixture-of-Experts 模型,每个 token 激活 25% 的权重,由 xAI 使用基于 JAX 和 Rust 的自研训练栈从零训练,预训练阶段于 2023 年 10 月结束。
推荐理由:xAI 以 Apache 2.0 开放 314B MoE 基座权重与架构,读者可据此了解其预训练配置和复用条件。
SpaceXAI 与 Anthropic 签署协议,向 Anthropic 提供 Colossus 1 超算的访问权限。该集群配备超过 220,000 块 NVIDIA GPU,包括 H100、H200 和下一代 GB200 加速器。Anthropic 计划用这部分额外算力直接提升 Claude Pro 和 Claude Max 订阅者的容量,并表达了合作开发多吉瓦级轨道 AI 算力的意向。
推荐理由:协议给出 Colossus 1 的 GPU 规模与 Anthropic 的用途,可据此观察前沿模型的算力供给安排。