DeepSeek 上线 V4-Flash 正式版 API,9 项 Agent 与编程基准超过 GLM-5.2
DeepSeek 于 7月31日上线 V4-Flash 正式版 API,未调整模型结构和尺寸,只是在预览版基础上重新后训练,重点增强 Agent 与 Coding Agent 能力。
按公众号阅读文章与观点
DeepSeek 于 7月31日上线 V4-Flash 正式版 API,未调整模型结构和尺寸,只是在预览版基础上重新后训练,重点增强 Agent 与 Coding Agent 能力。
北卡罗来纳大学教堂山分校 IDEAL Lab 与加州大学伯克利分校团队提出 CoorDex,将 29 自由度 Unitree G1 与 20 自由度 WUJI 灵巧手的 49 个受控自由度拆成身体、手部两套运动先验,再在低维潜在空间学习协调。
MiniMax 正式发布全新一代视频模型 MiniMax H3,这也是其首个开源视频模型,可将剪辑逻辑、字体排版、转场设计、背景音乐与视觉特效端到端集成进模型,清晰度默认 2K。在 Artificial Analysis 榜单上,H3 获得视频编辑第一。2K 分辨率下每秒价格不到主流模型的 1/3,768P 分辨率下不到 1/2。
香港大学 Taku Komura 团队 2016 年发表的《A Deep Learning Framework for Character Motion Synthesis and Editing》获 SIGGRAPH 时间检验奖,该工作首次用卷积自编码器从大规模动作捕捉数据中学习可复用的运动表示。
DeepSeek V4 Flash 更新到正式版,Agent 能力大幅提升,官方称其超过 V4 Pro 的 Preview 版本。该版本已在官方 API 上线,同时支持 Codex 的 API 格式,并提供 Mac 与 Windows 一键配置脚本。DeepSeek-V4-Flash-0731 的模型结构、尺寸与 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。
DeepSeek-V4 系列正式版发布,DeepSeek-V4-Flash 正式版已可通过 API 访问,V4-Pro 正式版将尽快发布。
米哈游蔡浩宇的 AI 公司 Anuttacon 旗下项目陆续停运,其领英身份已更新为“独立大模型与智能体开发者”。团队资源随之调整,近九成算力集中到 LLM 方向,大模型团队转向以 Agent 为核心的系统能力建设。曾任首席研究科学家的吴箫剑于 5 月离职加入 OpenAI,创始研究科学家陶云哲加入 Microsoft AI,朱明浩转投通义实验室。
姚顺雨为腾讯混元AI4S方向招人,未给出职位描述,只用自研智能体Hyra的科研成绩单作为招募材料。基于本月开源的Hy3模型(总参数295B、激活参数21B),Hyra为加法组合学一个悬置约50年的开放问题找到关键构造并给出完整答案,证明结果能无限接近理论上限2,还附上Lean 4形式化证明。在Hyra-1.0的首批测试中,55道数十年未取得进展的数学开放问题里有29道刷新了已知最好结果。
MiniMax 发布全模态生成模型 H3,可统一理解文本、图像、视频和音频组成的多模态上下文,输出带原生双声道的音视频,最高支持 15 秒 2K 分辨率、24 FPS。H3 在 Artificial Analysis 视频模型榜单的视频编辑能力项排名全球第一,2K 分辨率输出定价 0.8 元/秒。MiniMax 表示将在未来几天内开放权重,具体开源协议和模型规格尚未公布,后续会发布技术报告。
字节 Seed 团队正式发布新一代视频创作模型 Seedance 2.5,单次可生成 30 秒高质量视频片段并支持多轮延长,将此前 15 秒的生成时长提升至 30 秒。
灵境智源创始人孙博在对话中称,具身智能需要专用算力底座而非通用方案,其自研端侧算力底座已对接超 300 家具身企业,行业覆盖率超 70%,超 200 家客户完成批量装机。公司基于自研「德沃夏克架构」推出 N 系列与 T 系列产品,并自研覆盖芯片层到安全层的操作系统,同时是开源鸿蒙社区具身操作系统的共同发起单位。
清华大学、鹏城实验室、香港科技大学(广州)、小米汽车和新加坡国立大学团队提出 FutureNav,一个面向连续视觉语言导航的统一 world-action 建模框架,训练由国产 AI 加速芯片支撑。
阿里云张鑫、NoDesk AI 王仿、腾讯任磊达在 InfoQ《极客有约》X AICon 直播中提出,Agent 进入真实业务后的失败大多发生在模型之外,需要 Harness 工程承接不确定性。张鑫认为 Harness 不是消灭幻觉,而是让 Agent 做正确的事并正确地做事,可观测性可形成飞轮效应;王仿强调企业需把给人看的上下文翻译成 Agent 能理解的语言,即本体论。
极客时间推出持续更新的 Codex 开发者知识库,围绕真实开发场景整理学习路径,内容涵盖 Codex 快速入门、登录与权限及 Context、MCP 等常见问题排查、真实项目实战案例,以及 Agent、MCP、Context Engineering 等底层能力解析,放在飞书文档中可搜索,免费领取。
谷歌在 Gemini 企业级代理平台上正式发布 AlphaEvolve,将 DeepMind 的进化式代码优化研究转化为面向谷歌云客户的产品。
Claude Code 创始人 Boris Cherny 建议每半年删除一次自己的 CLAUDE.md、Skills 和 Hooks,重新看看最新模型还需要多少指令,因为每代模型性格不同,旧指令可能已不再适用。
GPT-5.6 Luna 降至 2 折,输入每百万 token $0.1、输出 $0.6,GPT-5.6 Terra 打 8 折;MiniMax 发布 H3 多模态模型,可原生理解文字、图片、视频、音频输入,并生成文本、图片、视频。
MiniMax 发布 AI 视频模型 H3,并计划将其开源,已在 hailuoai.com 上线。作者提前拿到体验资格实测后认为,H3 的强项在视觉包装与后期特效,可生成动态 MV、动态海报和 Vlog,最多支持 12 个视频、图片、音频参考,当前开放 2K 输出、最长 15 秒,约 10 元一条 15 秒 2K 视频。
OpenAI 宣布 GPT-5.6 大降价,入门款 Luna 价格下调 80% 至每百万输入 token 0.20 美元、每百万输出 token 1.20 美元,Terra 下调 20% 至每百万输入 token 2 美元、输出 12 美元,Sol 定价不变但在 API 中新增快速模式。
MiniMax 正式发布通用全模态生成模型 H3,可统一理解由文本、图像、视频、声音组成的多模态上下文,输出具备原生双声道的音视频,最高支持 15s 2K 分辨率。
谷歌DeepMind发布Gemini Robotics 2系列三款机器人模型,其中Gemini Robotics 2是负责全身移动与多指灵巧操作的VLA模型,Gemini Robotics ER 2作为高级大脑负责理解指令、拆解多步骤任务并跟踪进度,Gemini Robotics On-Device 2则可在机器人本地运行。
OpenAI 下调 GPT-5.6 系列 API 价格,入门款 Luna 最高降价 80%,每百万 Token 输入价格从 1 美元降到 0.2 美元、输出从 6 美元降到 1.2 美元。
推荐理由:降价最狠的 Luna 定位在高频 Agent 任务,读者可据此判断智能体长期运行的成本门槛变化。
璨辰科技(CANCHEN TECH)已完成种子轮、天使轮、天使+/++轮系列融资,累计金额达数千万人民币,投资方包括东方富海、松禾资本、零以创投等。公司聚焦系统级虚拟器官时空动态演化模型,搭建从分子、细胞、组织到器官的全尺度动态仿真平台,用 AI 数字孪生替代部分传统动物实验,服务新药临床前评价和疾病早期筛查。
文章指出以 token 计价收费的 AI 应用正在变成二房东生意,OiiOii 以约 5000 万元年框购买火山引擎 Seedance 2.0 的纯血版 API,LibTV 则被指赔本转卖 API Key 以推高 ARR。
宇树科技7月30日晚公告,拟在科创板公开发行4044.6434万股,占发行后总股本10%,初步询价日为2026年8月5日,网下申购日为8月10日。字节跳动启动AI业务组织调整,飞书产品团队与豆包产品团队整合成立新的豆包产品团队,飞书GTM团队与火山引擎整合成立ToB GTM组织“创造力服务平台”。携程宣布,当订单可退金额低于机票款20%时将触发专属弹窗强提醒,该功能于2026年7月31日上线。
美股AI科技股经历久违大涨,但AI叙事逻辑已转变:微软财报后上涨、Meta下跌,差别在于能否证明"烧钱能生钱"。7月科技主跌浪最猛阶段已过,A股白酒板块近期多次大涨,风格切换的种子已埋下。四位不同处境的投资者复盘这轮调整,反思追高被埋、FOMO情绪与仓位管理问题。
OpenAI 宣布 GPT 5.6 系列降价,最快的 Luna 价格下调 80%,办公向的 Terra 下调 20%,新价格从 7 月 30 日起生效并陆续同步到 AWS。
在OpenAI任职八个月的Andrew Ho离职创办强化学习数据集公司,首批产品聚焦生物学与统计推理,其GeneBench-Pro测试显示GPT-5.6 Sol通过率仅约30%,目标将数据可靠性从30%提升至90%以上。他同时看空前沿实验室估值,认为其长期亏损、IPO后锁定期解禁将带来抛售压力,并称即便冻结当前模型能力,LLM融入人类生活也需二十年。
造物时代 Makera Z1 桌面级三轴 CNC 在 Kickstarter 众筹突破 1024.51 万美元,刷新该品类海外众筹纪录,整机重 17kg、众筹价 899 美元。创始人张邱溪称,CNC 硬件需纯自研、缺少成熟开源生态且容错率极低,软件与生态才是真正护城河,距离下一个“拓竹”时刻可能还需两到三年。
Meta 在 7 月 29 日发布 Q2 财报,营收增长 28% 超出预期,并将全年资本开支预期上调至 1300 亿至 1450 亿美元,财报发布后股价一度下跌超 10%。
针对同一模型,不要单纯比较 API 价格,还应适当关注 cache 比例,并留意量化信息。这是行业内的潜规则,cache 比例与量化信息都会影响实际使用成本与效果。
斯坦福大学一项研究显示,从ChatGPT出现至今,受AI影响最大的职业失业率只上升0.77个百分点,反而低于受影响最小职业的0.85个百分点,软件开发岗位招聘数量仍保持增长。但今年美国应届毕业生失业率已升至5.6%,比三年前高出1.6个百分点,22—25岁年轻人在AI影响较大的行业就业明显变差。目前真正大规模用上AI的企业不到两成,超过80%的企业高管表示AI暂时还没有改变公司的人员规模。
长亭科技推出开源 AI 编程平台 MonkeyCode,浏览器打开即可使用,无需安装配置,免费用户每日 3000 万 Token。平台为每个任务分配独立云端开发环境,已接入 GLM、Kimi、MiniMax、Qwen、DeepSeek 等模型,并提供 iOS、Android 与桌面客户端 MonkeyCode Work。
AGI Playground 2026 将于 8 月 3 日至 4 日在新加坡滨海湾花园 Flower Dome 举行,现场通过黄(Investor)、蓝(Founder)、绿(Attendee)、紫(Academia)四色胸卡区分身份,方便参会者按需对接。
月之暗面在 Kimi K3 技术报告末尾首次公开 401 位实际贡献者名单,文章据此梳理了核心成员的履历与分工。7 月 27 日发布的 K3 为 2.8T 参数开源模型,公司估值随之升至 315 亿美元,团队约 300 多人、平均年龄不到 30 岁。文中还提到 Mooncake 推理架构获 FAST 2025 最佳论文,以及 MoBA、Muon 优化器等底层技术工作。
忆生科技发布 EngramTeleOp 真机遥操系统与 EngramEgo 真人数据采集产品,前者为纯视觉方案,无需手套等穿戴设备,仅凭 MR 头显与裸手即可驱动灵巧手。
马斯克在《经济学人》90 分钟访谈中提出 AI 能力 = 芯片 X 电力,称中国之外瓶颈在电力与冷却,中国国内约束在芯片,并断言中国在光刻技术上比多数人预期更接近突破,一旦芯片问题解决大概率成为领先者,美国出口管制管不了世界其他地方。
微软与 Meta 同日发布财报,微软 2026 财年 Azure 收入突破 1000 亿美元,Azure 及其他云服务当季增长 43%,盘后股价一度上涨超过 8%。
AI Agent 时代做好自媒体需满足"三加一"要求:输入(Input)、处理(Processing)、输出(Output)构成的 I.P.O. 闭环,加上表达欲。作者主张 I.P.O. 在 AI Agent 时代应一体化,通过"干中学"在真实项目中反复实践,并借助 Agent 用文字、表格、网页、绘画、视频等多模态方式拆解行业专有名词。
文章以 OiiOii 用接近 40% 现金流签下 5000 万元 Seedance 2.0 年框为例,剖析 AI 应用公司为采购顶级模型 token 陷入的毛亏率困境。