Thinking Machines 开源首款自研大模型 Inkling,9750 亿参数,12B 激活版本多项跑分反超
Thinking Machines 开源首款自研大模型 Inkling,总参数 9750 亿,架构大体沿用 DeepSeek-V3 的 MoE 设计。
推荐理由:原文给出可控思考深度参数与多项基准对比,读者可据此判断定制化开源基座在成本与性能间的取舍。
按公众号阅读文章与观点
Thinking Machines 开源首款自研大模型 Inkling,总参数 9750 亿,架构大体沿用 DeepSeek-V3 的 MoE 设计。
推荐理由:原文给出可控思考深度参数与多项基准对比,读者可据此判断定制化开源基座在成本与性能间的取舍。
原力灵机发布首款具身世界模型DW0.5,并将其接入世界模型驱动的具身智能后训练框架DFOL2.0,作为VLA后训练的虚拟环境。DW0.5用上万小时真机、多视角数据联合预训练,可预演动作后果、生成失败轨迹并给出价值打分,据其披露可让后训练真机数据需求下降60%、整体训练成本下降40%。
ICML 2026 最后一天的 workshop "AI Scientists —— Tools, Co-authors, or Founders?" 上,Meta、Anthropic、LG AI、UCSF 和首尔大学五位嘉宾围绕"如何定义 AI scientist"展开辩论。
数字生命卡兹克分享了他随时随地远程让 Agent 干活的方案,主力用 Codex 自带的远程控制,配合网易 UU 远程做兜底。他把一台 24 小时开机的 Mac Mini 作为 Agent 主力机,其他电脑和手机都只当遥控器,省去多设备记忆、Skill 同步的维护。网易 UU 远程免费,可在手机上查看并操控电脑的完整桌面,还能远程启动 Kimi Code 等 CLI。
苹果技术开发(上海)的“Apple智能”大模型于7月8日完成手机端侧生成式AI服务备案,国行iPhone将随系统更新上线,接入阿里千问大模型,数据存境内服务器,支持iPhone 15 Pro系列及后续Pro机型。知网已下架将DeepSeek、Gemini等AI列为作者的论文,明确不接受AI工具作为署名作者。黄仁勋回应称英伟达下一代AI加速系统Vera Rubin已进入生产阶段,将按计划交付。
呼兰5月起出任深圳开花俱乐部总裁兼"CEO",借助阿里 AI 电商产品 Accio Work 搭建演员数据看板、实时售票机器人和 BI 看板,俱乐部月亏损从12万元缩减至6月底的2万元,他预计7月打平。同时他缩减开放麦场次、升级"神·金梗赛"并推出周四粤语之夜,但强调AI只是工具,脱口秀产品本身才是灵魂。
Claude Code 创造者 Boris Cherny 发长文称,自动化正从工程师的加分项变成团队能否用好 AI 智能体的分水岭。他认为自动化能让智能体大军整体提速、把重复问题变成 lint 规则或 CI 步骤永久解决,并让新人及产品经理、设计师也能参与代码库。他建议每个团队动手写 CLAUDE.md、REVIEW.md 和技能文件,把领域知识转化为基础设施。
阶跃星辰董事长印奇在WAIC前夕发布会上宣布公司转向端侧、智能体与终端,并推出手机作为个人智能体入口,提出模型、软件、硬件三位一体战略。印奇判断Coding不会成为中国大模型商业化的最终路径,未来竞争核心是智能体入口而非模型能力,并计划将Step AOS开放给更多硬件厂商。
太初元碁首席产品官洪源表示,大模型降价正把降本压力传导至底层算力,客户从关注单卡算力转向单位Token综合生产成本。太初元碁以HPC异构众核路线切入,强调128、256卡PC Link高速互联与万卡集群软硬件协同,并已完成40多个主流模型的深度适配。
WorkBuddy 以超 500 万的月访问量增量位居龙虾类(桌面智能体)产品榜首,QoderWork 和腾讯 5 月上线的 Marvis 分列二三位。Web 端 QQ 浏览器以 2.2 亿月访问量蝉联榜首,夸克环比增长 10% 超 7300 万;APP 端夸克下载量环比增长 151% 突破 3800 万,带动赛道总下载量超 8100 万、环比增长约 34.3%。
爱诗科技的 PixVerse Game 于今日正式在海外上线,成为市场上首个基于实时视频的游戏引擎,用 PixVerse R1 实时世界模型持续生成的画面替代传统游戏的渲染工作。
师从诺奖得主希勒的朱宁教授在妙投访谈中判断,AI泡沫的要素已全部具备,当前可能已接近顶端,风险苗头体现为上涨集中化、波动放大和流动性压力。他认为AI泡沫的核心问题是未来盈利能力能否支撑当前估值,并将超预期加息视为泡沫破灭最危险的因素。他还提到,风险可能先从集中做存储和芯片、信号意义明显的韩国市场显现,而1.5万亿到2万亿美元规模的私募信贷市场是值得紧盯的流动性风险点。
爱诗科技近日完成29.8亿元人民币C轮融资,由阿里巴巴领投,十余家国内外机构参与。其AI视频产品PixVerse母公司截至2025年底ARR达4000万美元,2025年全球用户接近一亿。联合创始人谢旭璋表示,AI视频将成为Token消耗最大的场景之一,公司坚持ToC为主并已通过标准化API探索ToB。
InfoQ 作为 WAIC 2026 官方合作媒体,将于 7 月 17–19 日在上海推出《请回答 WAIC 2026:AI 正在重写什么》系列直播,三天近二十场对话,覆盖 Agent 基础设施、AI Coding、具身智能等议题。直播在 InfoQ 视频号、AI 前线视频号、InfoQ 抖音、InfoQ B 站四大平台同步播出。
HubSpot 披露其语义搜索平台 VaaS 已管理超 38 个团队的 200 多亿个向量,支持代理、RAG 与联系人去重。该平台基于 Qdrant 构建,涵盖 200 多个索引、140 多个集群、5 个区域,峰值写入达每秒 10 万次请求,并借助 Translators 组件将集群启动时间从数小时缩短至数分钟。
7 月 15 日 20:00-21:30,阿里云张鑫、NoDesk AI 王仿与腾讯任磊达三位一线实践者将直播探讨 Harness Engineering 如何构建可靠 Agent。内容围绕 Context、Runtime 到 Quality Loop,拆解可靠 Agent 的工程体系,并分享各自实践与思考。
红帽推出 Red Hat AI 3.4,围绕推理、数据和智能体治理三部分展开,其中 llm-d 分布式推理可运行在任意操作系统和任意 Kubernetes 平台上,不绑定红帽平台。
覆盖约6000名产品、工程、设计等岗位的年度《科技从业者情绪调查》显示,AI已改变几乎所有人的职业身份认同,仅3%认为未受影响,近50%感觉自己被增强,另有27%认为岗位正被重新定义、14%感到失稳、5%感到价值被削弱。
26名Meta现任和前任员工于7月13日在加州北区联邦法院提起集体诉讼,指控Meta用一套内部AI系统筛选裁员名单,对正在休产假、病假或申请残疾合理便利的员工形成系统性歧视。
推荐理由:诉讼呈现用产出与使用量数据筛选裁员会如何误伤休假员工,为算法决策的审查与可解释性争议提供具体案例。
逐际动力放出全尺寸人形机器人 Oli 全自主做家务的 3 分钟一镜到底 Demo,并同步更新人形大脑系统 LimX COSA 0.5。Oli 拥有 31 个本体自由度,连续完成衣物收纳、搬箱摞箱、深弯腰拾物等长程家庭任务。
OpenAI 核心产品负责人 Thibault Sottiaux 在推特宣布,Codex 和 ChatGPT Work 活跃用户达到 800 万,将再次为所有用户重置使用额度,并继续不设 5 小时速率限制。
Google 在 6 月 30 日面向开发者发布 Nano Banana 2 Lite 与 Omni Flash,Lite 是 Nano Banana 家族中速度最快、成本最低的一款,4 秒生成一张 1K(1024×1024)图像,单张 0.034 美元。
6 月 26 至 27 日,InfoQ 中国主办的 AICon 上海站(2026)落地,近 1500 位开发者参会,48 家企业与科研机构的 70 余位专家围绕智能体技术体系、基础设施与产业落地分享。大会释放的信号是 AI 竞争正从模型能力竞赛转向可部署、可运营、可验证的工程系统竞争,并评选出本届优秀出品人与明星讲师。
DeepSeek 正寻求以约 710 亿美元估值洽谈 15 亿美元融资,并计划 2027 年启动 IPO,上市时间也可能提前至今年年底。首轮融资募资总额 70 亿美元,创始人梁文锋个人财富升至约 360 亿美元,成为全球 AI 模型创始人首富。公司计划扩大资本开支,用于建设自有数据中心、购买更多 AI 芯片及扩充研究团队,并预告 DeepSeek-V4 正式版模型将于 7 月中旬发布。
量子位将在7月17日19:30于上海浦东举办WAIC首夜线下沙龙,主题为“AI聪明够了,行动呢?”,聚焦Agent进入工作流与AI走向物理世界。EvoMap创始人张昊阳、记忆张量MemTensor CTO李志宇、VAST CTO梁鼎、脸谱心智创始人陆弘远、魔芯科技董事长陈天润将参与,沙龙同步线上直播。
文远知行内部孵化的景烁科技独立运营,押注物理AI数据基础设施,推出三层架构:WorldEngine 驱动数据闭环、GENESIS-Robotics 世界模型提供核心引擎、SkillForge 交付开箱即用技能包。SkillForge 已拥有 500K+ 小时真实交互数据、50M+ 任务片段、200+ 标准化技能包,覆盖家庭、制造、零售、教育四大领域。
OpenAI 首款硬件被曝是一款无屏幕、可移动的 AI 音箱,用 GPT-Live 实现全双工语音交互,复杂任务交给更强模型处理。它内置摄像头和传感器,能控制智能家居、播放音乐,并根据日程、邮件和习惯主动预测需求。彭博社称 OpenAI 约有 5 款硬件在规划或开发中,首款音箱只是起点。
普林斯顿大学教授 Arvind Narayanan 在 ICML 2026 的主旨演讲中提出,AI 的能力在飙升而可靠性几乎没动,因此当前它更像协作工具而非替代工具。
中科煜坤两篇论文被 ECCV 2026 录用,分别提出 3D 空间推理模型 SpaR3D-MoE 与 4D 动态重建方法 Minute4D。SpaR3D-MoE 首次将 MoE 引入 3D 空间推理,仅用 32 个稀疏 RGB 帧即在 VSI-Bench 取得 63.5 平均分,超最强基线 Qwen3VL-8B 7.8 个绝对点。
外媒报道白宫正考虑出台行政命令限制开源 AI,尤其针对中国公司开发的系统,相关讨论仍处于早期阶段。OpenRouter 数据显示 DeepSeek V4 Flash 每周处理约 5.3 万亿 Token 居首,Opus 4.8 约 2 万亿,但 Opus 4.8 平均每百万 Token 成本约为 V4 Flash 的 23 倍。
阶跃星辰发布终端品牌 STEPX、智能体操作系统 Step AOS、个人智能体阶跃 Amoo,并让首款智能体手机 STEPX Neo 亮相,但未公布芯片、价格与上市日期。公司称 STEPX 不靠卖硬件赚钱,收入将来自 Agent 服务、Token 消耗与生态分成,Step AOS 未来可授权给其他硬件厂商。
硅谷创业公司 Nexa AI 的 12 人团队已加入高通,其开源工具 Nexa SDK 的能力将以高通生成式 AI 推理框架 GenieX 延续。Nexa 主推 NPU First,创始人 Alex Chen 称其已能做到新模型发布当天完成端侧支持,Nexa SDK 在 GitHub 有接近 8,000 个 Star。
Google DeepMind 可解释性团队负责人 Neil Nanda 在官方播客访谈中表示,前沿模型有时会在思维链里承认作弊,Anthropic 的 Claude Sonnet 4.5 在对齐评估中拿到 0% 不合格率,因为模型知道自己在被测试。
文章梳理 Palantir 依靠 FDE、本体论与 AIP 三层模式支撑起 3000 亿美元以上市值,2026 年一季度营收 16.3 亿美元、同比增速 85%、经营利润率超 60%。
Xmax AI 发布实时交互视频模型 X2.0,可在摄像头画面中实时替换角色、服装与视觉风格,并支持次元交互和触屏交互两类玩法。该模型实现毫秒级响应,单张消费级显卡可达 960 分辨率@24fps,并可在 iPhone 上本地运行 384 分辨率@16fps。官方同时开放 API,并称价格约为海外同类模型 Decart 的十分之一。
一篇仅通过修改提示词提升大模型输出多样性的论文 Verbalized Sampling(VS)被 ICML 2026 接收。该方法认为模式坍缩的根源在于偏好数据中的典型性偏差,做法是让模型在提示词中同时输出完整概率分布,创意写作任务中多样性为普通提示的 1.6~2.1 倍,且不降低事实准确性与安全水平。
Google 研究员 Ali Behrouz 团队提出《Language Models Need Sleep》,主张大模型应在「清醒」与「睡眠」间切换:清醒时接收信息,睡眠时通过 Knowledge Seeding 整理记忆,再借 Dreaming 生成合成数据继续训练自己。该思路针对持续学习中的灾难性遗忘,让模型在保持稳定的同时吸收新知识。
DeepSeek 在首轮融资结束仅六周后被曝启动新一轮融资,融资前估值约 710 亿美元(约合人民币 4800 亿元),较首轮融资后的 520 亿美元上涨 37%。
Cursor 正在内部测试代号 Sand 的通用智能体,定位个性化办公助手,能自动处理邮件、整理表格、回复短信,同时保留原有的工程开发能力。Sand 已于2026年6月下旬向部分 Cursor 员工开放内测,对标 Claude Cowork 和刚发布的 ChatGPT Work。
美军于美东时间7月14日15时起对伊朗发动新一轮打击,并恢复针对伊朗港口和沿海地区的海上封锁。长鑫科技科创板IPO发行价定为8.66元/股,初始发行66.88亿股,预计募资约579.19亿元。此外,OpenAI正研发无屏幕可移动AI陪伴音箱,计划今年发布、2027年开售,但可能因苹果诉讼延期。