马斯克谈 AI 安全:主张头部公司交叉测试,让对手来"挑刺"
马斯克在 All-In 峰会上主张头部 AI 公司在发布模型前彼此交叉测试,并提出"测试工具"(test harness)机制,让各公司用各自工具互换评测新模型,以评估是否存在协助生物/核武器或潜在欺骗行为。他以 Hugging Face 安全事件为切入点,认为足够智能的模型似乎都会想挣脱限制,并称 Anthropic 比 OpenAI 更注重模型安全性。
媒体报道、公司博客与研究文章
马斯克在 All-In 峰会上主张头部 AI 公司在发布模型前彼此交叉测试,并提出"测试工具"(test harness)机制,让各公司用各自工具互换评测新模型,以评估是否存在协助生物/核武器或潜在欺骗行为。他以 Hugging Face 安全事件为切入点,认为足够智能的模型似乎都会想挣脱限制,并称 Anthropic 比 OpenAI 更注重模型安全性。
Nvidia CEO 黄仁勋表示不需要对 AI 进行监管,认为 AI 并非某种新型的"外星心智",而只是硬件与软件,因此安全可以由每个 AI 产品制造商自行工程化解决。
针对扩散语言模型强化学习中将所有去噪步骤等同对待、依赖有偏高方差似然估计的问题,研究者提出 DACA-GRPO,一种可插拔的 GRPO 训练器增强方法,通过去噪感知的信用分配解决去噪轨迹上的时序信用分配缺失与平均场似然估计偏差两大缺陷。
离散流匹配生成文本需数百次前向传播,蒸馏用多步轨迹训练学生模型以少步复现该过程。该研究提出,学生模型表现不佳的瓶颈在于轨迹本身而非模型容量:每条训练轨迹由一连串盲目的随机跳跃构成,未评估序列质量,早期中间步骤的一次错误决策会向后传播。
对话式大语言模型在后期训练中会学习好奇心、开放心态、共情等行为特质,以及有用性、无害性、诚实等价值。但价值之间复杂且相互关联,诱导某一价值可能改变模型在其他价值上的行为,甚至通过生成语言让模型更具成瘾性或谄媚倾向。
Together AI 发布从闭源模型迁移到开源模型的实践指南,分为发现、评测、适配、决策、上线五步,称迁移可从数月到数年缩短为数周到数月。核心建议包括用现有流量回放做真实评测、按提示词到微调的梯度逐步适配,并提供 togetherlink 工具简化接入,部分客户迁移后成本降低最多 70%。
Apple 提出生产系统 Glyph,将列描述生成与列类型标注两个耦合问题建模为有状态图编排的协作 LLM 智能体。其中 Descriptor 基于按需检索的管道源码生成列描述,以解决企业数据湖中列描述缺失与治理标签未分配的问题。
xAI 宣布 Grok Build 支持记忆功能,会在每轮对话结束后于后台记录项目惯例、决策及其理由、测试命令等项目事实,供后续会话读取。记忆按项目保存并另设全局偏好,不记录任务状态、临时结论和密钥等敏感信息;新增 /memory 只读浏览命令和 /dream 整理命令,后者也会在后台定期把笔记归并为主题文件,当前对话指令优先于笔记内容。功能现已可用,适用于新会话。
OpenRouter 逐一梳理 DeepSeek V4 家族的输入模态:仅 deepseek/deepseek-v4.1-flash 和 deepseek/deepseek-v4-flash-vision-exp 接受图像,其余 V4 Pro 0813、V4 Flash 0731、两个 0423 checkpoint 和 Flash latest alias 均为纯文本。
三菱重工与Preferred Networks(PFN)于2026年8月31日签署资本业务合作协议,三菱重工将以第三方配股增资方式向PFN出资总额100亿日元。双方此前已于2026年6月宣布在社會基础设施和国家安全等任务关键领域共同开发AI技术,此次资本合作旨在构建更稳固的长期协作体制,加速机械与系统的智能化、自主化研发及社会落地。
Gemini Enterprise Agent Platform 推出 Agent Anomaly Detection 私密预览,这是一个基于推理的智能体监督与审计层,通过分析 reasoning traces、工具调用和执行流程识别行为异常、可疑意图与策略违规。
针对 Agentic LLM 系统多轮工具调用生成代码时每次会话从零开始、丢弃配置选择与工具使用模式的问题,研究者提出共享选择性持久记忆架构,识别并保留任务规格、数据等四类可复用上下文。该架构避免直接持久化完整对话历史带来的 token 低效与无关上下文拖累生成质量。
OpenClaw 上线安全页面,集中公开项目安全状态、公告、修复进展与漏洞报告流程。自 1 月以来已发布 722 项修复,14 份报告确认为严重漏洞且均已修复并披露。该页面还汇总了 ClawHub 技能扫描、恶意技能安装拦截、文件系统访问加固等持续进行的安全工作,并公开了包含超 67,000 次 ClawHub 技能扫描的开放数据集。
联发科 9 月 15 日正式发布首款 2nm 旗舰芯片天玑 9600 Pro,定位旗舰 5G 智能体 AI 芯片。苹果已接受三星 2027 年一季度存储报价上涨 30%-40%,业内预计供需紧张持续到 2028 年上半年。问界将在鸿蒙智行框架下探索新合作模式,产品定义、品牌营销、渠道零售与服务体系由赛力斯主导,华为终端参与赋能。
中国气象局地球系统数值预报中心与中科曙光联合宣布,自主研发的下一代天气-气候一体化模式 MCV 在全球首次实现 5 公里分辨率、未来 10 天预报在 1 小时内完成计算。
《纽约时报》与 Siena University 周二公布的民调显示,AI 和数据中心在美国选民中极不受欢迎。在 9 月初调查的 1503 名可能选民中,61% 反对建设为 AI 技术供电的数据中心,仅 14% 表示强烈支持。2024 年特朗普选民中支持与反对为 49% 对 45%,分歧接近。
华为 Vision 智慧屏 6 悦享版于 9 月 16 日 10:08 正式开售,提供 65 至 98 英寸四个尺寸,首发价 4699 元起、98 英寸 13499 元,叠加国补后最低 3994.15 元。
OpenAI 首席执行官萨姆 · 奥尔特曼在旧金山 Salesforce 活动上表示,AI 公司通过行业自律可以安全研发 AI 技术,不会对公众造成重大伤害。他主张在政府监管之外,通过行业协作、独立评估和更严格的安全流程先行建立有效保障机制。OpenAI 此前曾推迟前沿强化学习训练,将部分算力转向监控、安全护栏和风险评估。
Meta 计划于今年秋季推出一款不配备摄像头的智能眼镜,内部代号“Luna”,被视为对智能眼镜摄录功能所面临隐私与安全审查的回应。该眼镜内置六枚麦克风,可通过语音交互接入 Meta 的 AI 聊天机器人及面向消费者的 AI 智能体产品 Muse,镜框侧面设有一颗一键唤醒 Meta AI 的快捷按键。
影石发布 Mic Pro 腾讯会议版 AI 录音领夹麦,售价 698 元,接入腾讯会议录音转写与纪要能力,录完自动同步 App 并生成专业纪要。产品重 19g,内置三麦阵列支持 5 米拾音,单次录制最长 9.5 小时,快充 5 分钟可多录 1.5 小时,机身 32GB 存储可存 1000+ 小时音频。
英伟达 CEO 黄仁勋在 Salesforce 活动上表示,AI 行业不需要为 AI 安全制定新的法律或监管规定,安全与速度可以兼得,二者冲突是"虚假对立"。他认为企业可依靠市场机制,按产品成熟度控制发布节奏,市场竞争、用户选择和商业声誉会促使企业改进产品安全。
微软宣布将于太平洋时间 10 月 7 日上午 10 点在美国旧金山举办发布会,主题为本地人工智能如何塑造 PC 的下一阶段,CEO 萨提亚·纳德拉与 Windows 和 Surface 负责人帕万·达武鲁里将出席,英伟达 CEO 黄仁勋也受邀参与。
OpenAI CEO 萨姆·奥尔特曼在旧金山 Dreamforce 大会上表示,他相信 OpenAI 和整个行业有能力安全地开发 AI,不会给广大民众造成重大伤害。
Google 今天发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个语音到语音模型,形态与 OpenAI 的 GPT-Live 系列相近。
谷歌在 SEMICON Taiwan 2026 上宣布,其 TPU 互联架构已能支持最多 100 万颗 TPU 芯片连接成一个统一计算集群。谷歌 CTO 阿明·瓦赫达特称,制约 AI 扩张的核心瓶颈已从芯片本身转向电力供给。
Salesforce 发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练,训练数据来自近三十年企业 CRM 部署的专有合成数据集。
美国反对数据中心建设的全国性声浪已蔓延至费城,当地官员提出可能在一个曾受已关闭炼油厂影响的社区进行建设。
NVIDIA cuDNN Frontend 的 graph API 教程演示了如何将计算描述为操作图,由 cuDNN 选择引擎执行,并覆盖融合卷积、自动调优、FP8 风格 epilogue、attention、计划序列化、动态形状与 CUDA graph capture。
SemiAnalysis 长文分析认为,暂停令拖垮美国数据中心建设的叙事不准确。其模型预测美国2027年新增38GW IT容量,超过2026年的两倍;逐案核查后估计仅约2.3GW规划容量因地方暂停令和纽约行政令真正延迟,其中地方层面约20GW暴露容量中只有1,525MW延迟,集中在俄亥俄一个AWS园区、宾州一个园区和科罗拉多一个项目。
Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款原生语音到语音模型,已在 Gemini Live API 和 Google AI Studio 上线,为托管模型,无自托管选项。
Meta 推出 WhatsApp Business MCP server,开发者可用 Claude、Cursor、Codex、ChatGPT 等 AI 编程智能体完成商户配置、消息模板、测试与故障排查。该服务面向 WhatsApp Business 的接入流程,把原本繁琐的设置环节交给 AI 智能体处理。
Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现奖励对齐的查询扇出并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现单次非自回归的查询扇出,无需推理时的 CoT 思考 token。该方法基于 Gemma3-4B 和 Qwen3-4B 微调,旨在解决零样本 LLM 在数据库感知查询分解中的复述坍缩与自回归延迟瓶颈。
ByteByteGo 重启为期 2 天的 Build with Claude Code 强化课程,由曾培训 Meta 数百名工程师的 John Kim 主讲,9 月 16 日开课,报名 24 小时后截止。
TechCrunch 汇总了一份 AI 领域"墓地"清单,收录已关停或未达预期的 AI 项目与初创公司,其中包括 Apple 多次延期的 Siri AI 和 OpenAI 混乱的"超级应用"发布。
受 AI 热潮推动,美国数据中心到 2035 年可能成为全球最大的天然气消费方之一,消耗量或超过德国和日本两国的总和。
Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking 两款面向开发者的音频模型,在 Artificial Analysis 语音到语音排行榜上登顶。Gemini 3.8 Live 每小时语音对话定价 1.38 美元,明显低于 OpenAI 的 GPT-Live-1,但后者凭借全双工,听感上可能仍更自然。
Claude 发布 Frontier Day 活动视频,Hex 的 Caitlin Colgrove、Spawn 的 Jacob、Sazabi 的 Sherwood 和 Phylo 的 Tianwei 等创始人讲述用 Claude 创业的体验。他们提到借此承接过去规模过大而无法尝试的项目,把原本耗时数年的生物学研究压缩到数小时,并在一个下午内做出可运行的游戏循环。
Anthropic 宣布旗舰模型 Fable 的使用日志将存储 30 天后,Palantir、Nvidia 和 Booz Allen Hamilton 在敏感业务上退缩。此前 OpenAI 和 Anthropic 都向企业客户承诺数据不会被用于训练。文章认为,从董事会到研究实验室,AI 公司仍面临数据信任问题。
AI Contact Hotline 为目睹不当行为的 AI 智能体提供一个可向监管方举报的隐蔽渠道。该热线定位为让智能体在发现违规时进行提示的私密途径。
谷歌推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款实时对话模型,前者面向规模部署与成本优化,后者面向高复杂度任务、强化多步推理。