MiniMax CEO 闫俊杰宣布不再领薪,将 4% 股份激励团队|AI 周报
MiniMax 创始人兼 CEO 闫俊杰发布内部全员信,宣布自即日起至公司实现 AGI 之日不再领取任何薪酬,并拿出个人名下相当于公司总股本 4% 的股份激励团队、1% 设立专项基金支持开源社区。此前 MiniMax 完成 160 亿港元融资,净额 80% 将投向 AI 基础设施及模型研发。
微信公众号
MiniMax 创始人兼 CEO 闫俊杰发布内部全员信,宣布自即日起至公司实现 AGI 之日不再领取任何薪酬,并拿出个人名下相当于公司总股本 4% 的股份激励团队、1% 设立专项基金支持开源社区。此前 MiniMax 完成 160 亿港元融资,净额 80% 将投向 AI 基础设施及模型研发。
Ralph Loop 创造者、Claude Code 核心技术设计者 Geoffrey Huntley 在播客中称"软件开发已死",任何人都能用 Cursor 生成代码,但能只用 300 行代码构建 Coding Agent 并讲清架构的软件工程师依然稀缺。
360 在 ISC.AI 2026 发布 AI 安全“倚天屠龙”两大能力:漏洞自动化挖掘智能体“图龙锋”和网络安全自动化防御系统“仪天阵”,并发起“磐石之盾”安全协作计划。周鸿祎称做中国版 Mythos 不能照搬美国路线,国产模型底层能力有差距,但可通过智能体打造更强 harness 平台补齐。“图龙锋”已累计挖掘漏洞 3432 个,其中 105 个高价值漏洞经监管机构确认。
Decagon CEO Jesse Zhang 发文称开源模型虽然崛起,但企业市场中开源模型的支出占比却在下降,并认为前沿模型与开源模型是同一条生命周期上的两个阶段。
Meta 发布面向智能体编程的多模态模型 Muse Spark 1.1,试图在智能体任务和编程领域与 OpenAI、Anthropic 竞争。该模型每百万输入 Token 收费 1.25 美元、每百万输出 Token 收费 4.25 美元,新 API 账户可获 20 美元免费额度。
2026 年 5 月,Bun 项目用 Claude Code 在 11 天内将约 53.5 万行 Zig 代码重写为 Rust,涉及超过 100 万行代码变更、6778 次提交,API 成本约 16.5 万美元。
推荐理由:百万行代码迁移用 11 天完成,文中披露了实现者与审查者分离的 50 个工作流和 16.5 万美元的成本账。
智能家居端侧芯片工程师展菲借助AI Agent和阿里云,同时切入AI眼镜、具身机器人解决方案和活动管理小程序"展菲汇"三个领域。他用两条指令完成项目从开发环境到云服务部署的全过程,Agent还接管了报名审核和内容审核流程。展菲汇从去年8月规划、9月启动,Web端和小程序端基于阿里云ECS运行,图片存入OSS并通过ESA边缘加速访问。
SpaceXAI 发布大模型 Grok 4.5,定位 Opus 级,面向 Coding、Agentic 任务和知识工作,支持 500k 上下文,基于 1.5 万亿参数 V9 底座。
7 月 7 日 Anthropic 宣布 Claude Cowork 开始扩展至网页端和移动端,首批面向 Claude Max 用户,执行环境从本地电脑迁移到远程基础设施,合上电脑任务仍可继续。
分析指出,自建 GPU 推理要便宜过 API,GPU 利用率必须超过 52% 这一临界点,而多数 AI 创业公司利用率仅 30%-50%,实际在亏钱。以 4×H100 跑 70B 模型为例,利用率从 80% 降到 30%,每千 Token 成本从 $0.011 涨到 $0.045。API 厂商靠 90%+ 利用率摊薄折旧,赚的是客户算不清利用率的信息差。
路透社7月7日援引三名知情人士称,DeepSeek正在自主研发面向推理场景的AI芯片,项目约一年前启动、目前处于早期阶段,已与芯片设计、晶圆代工和存储厂商接触。该芯片主要承担模型训练完成后的用户请求处理与内容生成任务,意在减少对英伟达、华为等外部供应商的依赖。DeepSeek未回应置评请求,芯片架构、制程工艺与代工方等信息均未公开。
Anthropic 发布 16 位作者完成的研究论文《可言说表征在语言模型中形成全局工作空间》,提出 Claude 训练中自发形成名为 J 空间的内部区域,用于存放可报告、可推理的概念,并开源代码并联合 Neuronpedia 推出交互式演示。
GitLab 2026 年 AI 问责报告显示,78% 的受访开发者表示编码速度加快,73% 认为代码质量提升,但 79% 表示整体软件交付并未以同样速度加速。85% 的受访者认同瓶颈已从编码转移到审查和验证环节;报告还提到 87% 的受访者相信团队能在 24 小时内确定 AI 生成代码是否导致生产事故,而过去一年发生过线上事故的企业中仅 34% 实际具备该溯源判定能力。
TGO 杭州十周年庆暨 GTLC 全球科技领导力大会·杭州站于 2026 年 6 月 27 日举办,现场参与人数超 500 人,鲁肃、叶军、汪源、许式伟等近二十位嘉宾围绕智能体架构、组织转型、数据底座与出海展开分享。汪源提出智能体瓶颈已从模型能力转向上下文工程,其自研 KRL 知识表达语言仅占原始格式 8% 的 Token,问答准确率超 90%。
Hugging Face 工程师 Joel Niklaus 的实验显示,冻结 DeepSeek-V4-Pro 权重、只优化模型外层执行机制 Harness,同一模型在不同 Harness 下的 pooled score 在 3.5% 到 80.1% 之间波动。
北京航空航天大学、复旦大学与浙江大学团队提出 QC-MHM 框架,通过问题校准与多跳建模提升时序知识图谱问答能力,在 CronQuestions 上 Hits@1 达 0.971,复杂多跳问题 Hits@1 绝对提升 5.1%。
陈勇超在x平台宣布创立Apex Intelligence(超衍智能),主攻自主进化基础模型(Self-Improving Model),目标让大模型从复刻人类已有知识转向自主发现未知规律。他3月刚从哈佛和MIT博士毕业,8月将入职清华大学任助理教授,此前婉拒了DeepMind工作邀约。公司正招募首批核心成员,方向涉及Agent Harness、Agent Infra及机器人、芯片、生命科学等。
Anthropic 在最新演讲中表示已删掉 Claude Code 80% 的系统提示词,技术团队成员 Tariq Shihipar 称示例反而会限制新模型 Fable 5 的发挥,反映出大模型引导方式的变化。
腾讯混元与新南威尔士大学联合提出 E-GRM 框架,将模型不确定性作为算力调度信号,仅对困难样本投入完整 CoT 推理。在 MATH 数据集上,58% 样本走短路径,延迟从 3.8 秒降至 2.2 秒(-62%),FLOPs 从 23.7T 降至 15.7T(-49%),准确率从 75.1% 提升至 78.4%。
蓝思科技创始人周群飞为彼得·戴曼迪斯与史蒂芬·科特勒新书《吾辈如神》撰写推荐序,提出 AI 时代真正的生存力源于认知持续迭代。她回顾消费电子行业早期放弃亚克力、押注玻璃盖板的逆势选择,并指出具身智能落地的核心瓶颈是精密化、标准化、规模化的量产制造能力,而非单一算法突破。
Anthropic 已与三星接洽,探讨围绕拟议自研 AI 芯片展开合作,但芯片的具体用途、部署方式和算力水平尚未确定。Anthropic 回应称,包含谷歌、Amazon 和英伟达芯片的多元化硬件架构仍是其计算战略关键支柱,此举被视为对 OpenAI 与博通发布 Jalapeño 推理芯片的回应。
腾讯混元与 UNSW 在 ACL 2026 论文中提出 SFT「不完全学习」(ILP)框架,用 MC 转换 + pass@5 检测、五大根因归因和 CPT 等干预方案覆盖约 97% 的未学习样本,剩余约 3% 样本不属任何已知根因。论文展望了未知根因发现、自由文本 pass@N 检测、多根因联合归因、CPT 数据选择精细化,以及将 ILP 推广到 RLHF/DPO、持续学习和多模态训练等方向。
阿里云将一人公司(OPC)创业周期拆解为想法验证、早期运营、持续运营三个阶段,推出 OPC Starter、OPC Lite、OPC Pro 三档装备库,并联合端木软件提供 Qoder、秒悟 Meoo、百炼 Token Plan 等一站式方案。
Meta 正在打造云业务,以出售其过剩的 AI 算力,消息公布后股价上涨超过 10%。该项目整合在名为 Meta Compute 的新部门下,由基础设施负责人 Santosh Janardhan 牵头,方案包括出售运行在自有基础设施上的模型访问权限,或直接出售原始算力,目前尚无定价或上线时间。此前 Meta 已承诺未来几年投入 1829 亿美元用于 AI 基础设施建设。
谷歌上线轻量文生图模型 Nano Banana 2 Lite(官方调用名 gemini-3.1-flash-lite-image),已登陆 Google AI Studio、Gemini API 和 Gemini 企业代理平台,1K 图单张成本 0.034 美元、平均约 4 秒生成。
高德行中智能部提出 GrowLoop,通过少量人类种子标注驱动大模型反思,把说不清的感性标准转化为可自动学习的评分细则,并让细则与测试题目互相驱动生长。在 132 条题目、355 对配对判断上,GrowLoop 在最严格的三选一匹配指标上拿到 0.78,第二名 ICAI 为 0.58。论文已发表在 arXiv,后续将逐步开源。
Cursor 推出 Cursor Mobile iOS 应用,开发者可在手机上启动编码会话、查看智能体输出、审批并合并 Pull Request,现已向所有付费订阅用户开放公测。
穹明智能开源 UMI ver.2 手持数据采集系统,整机成本不到 3000 元,精度达毫米级、误差控制在 0.5mm 以内,较上一代 UMI 提升十倍以上并支持双臂协同。
联想车计算推出量产级 L4 自动驾驶域控制器 AD1,搭载两颗基于 Arm 架构的 NVIDIA DRIVE AGX Thor X 芯片,可提供超 2,000 TOPS AI 算力。
据 SemiAnalysis 爆料,LeptonAI 创始人兼 CEO、英伟达系统软件副总裁贾扬清已从英伟达离职,距英伟达以 7 亿美元收购这支 20 人团队刚过去一年。
Arm 计算平台正赋能新一代物理 AI 系统,使机器人从工厂固定作业走向真实环境中的自主运行。智元机器人在 Arm 剑桥总部展示了人形机器人的灵巧操控与自主导航能力,云深处科技、普渡机器人 PUDU D5、波士顿动力 Spot 等则覆盖巡检、救援与工业场景。联想车计算与文远知行的自动驾驶出租车已验证基于 Arm 架构的平台可实现 L4 级自动驾驶。
卡内基梅隆大学副教授 Andy Pavlo 在 Percona Live 2026 大会上指出,数据库是自主智能体最难攻克的关键挑战,错误查询或配置变更可能导致整个系统瘫痪。他提到借助智能体增强技术,系统优化耗时可从 12 小时缩短至 15 分钟以内,但调优智能体各自独立运行易陷入局部最优,编码智能体生成的代码也缺乏通用性。
MiniMax 于港交所公告授予 116.88 万股 A 类普通股,认购价为零,按授股当日 515 港元收盘价计对应市值近 6 亿港元,员工归属期为 13 个月至 6 年且不设业绩考核。苹果因内存涨价上调 Mac、iPad 等 14 款产品价格,并游说美国政府批准采购长鑫存储(CXMT)内存芯片。阿里内部推行 OPT“一人团队”,鼓励前后端互做以减少协作成本。
OpenAI 发布 GPT-5.6 有限预览版,包含旗舰级 Sol、中端 Terra 和日常 Luna 三款模型,并引入最大推理努力与超模式两种新推理模式。应美国政府要求,目前仅经批准的企业可访问该模型,个人用户暂无获取途径。外部评估机构 METR 称 GPT-5.6 Sol 的检测作弊率高于其评估过的任何公开模型,其时间跨度评估结果不可靠。
推荐理由:原文把分阶段白名单发布与外部评测发现的作弊问题并列,读者可据此判断此次能力定位的实际边界。
Arm 认为物理 AI 正推动计算平台革新,其架构已用于 Rivian 第三代自主化计算平台 RAP1 和 Tensor 的 L4 级代理式 AI 自动驾驶平台。Tensor 每台车集成超 400 个 Arm 计算核心,涵盖 Neoverse AE、Cortex-X、Cortex-R 与 Cortex-M 系列。Arm 称特斯拉、Rivian、蔚来、吉利等主流车企均以其技术为核心计算平台。
6 月谷歌 DeepMind 出现多起高层研究员离职,Gemini 共同负责人 Noam Shazeer 加入 OpenAI,AlphaFold 共同创造者 John Jumper 以及 Jonas Adler。
火山引擎丁远普与王彦辉提出,AI 时代数据底座需从传统存算分离转向以多模态数据湖为核心的新架构,因为数据形态、计算模式和管理维度三方面都已改变。他们以 LAS 产品为例,引入 Lance 数据格式支持大 Blob 存储、零成本动态加列和高性能随机访问,并提供以 Token 为新型算力的算子能力,涵盖 PDF 解析、视频编辑等场景。
Anthropic 向美国参议员和白宫官员发信,指控与通义千问(Qwen)实验室有关的操作人员在 4 月 22 日到 6 月 5 日期间利用近 2.5 万个虚假账户,与 Claude 进行了近 2900 万次交互,重点针对软件工程和智能体推理能力。
Netflix 高级工程师 Tejas Chopra 开发的开源工具 Headroom 可在智能体指令送入大模型前压缩词元,据其估计其中高达 90% 属于冗余。
Claude 上线“群聊 Agent”功能,支持多智能体在群聊中协作交互。Karpathy 盛赞其为交互新范式,但也有观点担忧它成为打工人的“数字监工”。