Edelman、Le Truc 与 WHY Brands 谈 AI 为何奖励有观点的创意
Edelman、Le Truc 与 WHY Brands 的创意负责人在 Monks 首席创新官 Henry Cowling 主持的对谈中认为,AI 技术已就绪,真正的难点是围绕它重塑习惯、团队与预算。
媒体报道、公司博客与研究文章
Edelman、Le Truc 与 WHY Brands 的创意负责人在 Monks 首席创新官 Henry Cowling 主持的对谈中认为,AI 技术已就绪,真正的难点是围绕它重塑习惯、团队与预算。
NVIDIA 参与美国国家科学基金会(NSF)启动的州与区域 AI 基础设施中心计划,与产业界、慈善机构及州和地方政府合作,扩大 AI 研究教育所需的算力、数据、软件与技术支持。
Anthropic 为 Claude Enterprise 组织推出 Inference hooks 测试版,可将 Claude 指向企业自有 AI 安全服务器,claude.ai、Cowork 和 Claude Code 中每个受管控提示词都需等待服务器放行或拒绝后才继续推理,请求经过签名、失败处理可配置,每次拒绝都会记录在合规 Activity Feed 中。
SGL-Diffusion 团队通过三个递进 PR 优化 AR+DiT 混合生成管线:用 SRT 替换 HF 后端将 AR 阶段解耦为独立服务,单卡 AR 耗时从 122.8s 降至 46.6s(−62.1%),4-NPU 异构配置(AR 用 TP=4、DiT 用 SP=4)下端到端延迟从 154.6s 降至 35.2s(−77.2%)。
LlamaIndex 发文解析智能 OCR(又称 AI OCR)如何从传统字符识别演进为生产级文档理解系统:它结合机器学习、版面感知、语义抽取与校验逻辑,输出带字段级置信度的结构化数据而非扁平文本。
ByteDance Seed 发布原生音视频全双工大模型 SeedRealtime,用统一架构融合音频、视频与文本,支持音视频联合理解、主动交互与流畅对话节奏。端到端人工评测显示,相比级联模型,音视频对话节奏问题减少一半。模型已在豆包 App 全量上线,用户更新后在对话框选择“打电话”进入视频通话即可体验。
推荐理由:原文给出统一架构、端到端评测数字和豆包 App 开放入口,可据此了解音视频全双工交互的能力与体验变化。
LlamaIndex 发文反驳文档解析将被 frontier 模型商品化的流行观点,指出 GPT-4o 到 GPT-5.5 三代模型在 ParseBench 上解析准确率仅提升约 24 分、每页成本翻约 4 倍,最新模型仍比专用引擎低 20 分。
推荐理由:作者用 ParseBench 数据论证文档 OCR 的帕累托前沿仍高于通用模型,并给出路由、蒸馏、利用文件内文本等具体方法。
Claude Code 的 auto mode 通过一个单独的分类器逐条筛查每个操作,代替用户逐次确认,从而减少打断、完成长时间任务。视频解释该分类器的工作方式,以及为什么 Claude 不会批准自己的操作,还介绍了如何按自身环境和团队配置 auto mode,并附有官方博客链接。
推荐理由:视频拆解 Claude Code 自动模式如何用独立分类器逐条筛查操作,并给出按环境与团队配置的入口。
LLM 长上下文推理的成本主要来自 KV cache:它随 token 数和批量大小线性增长,解码阶段每生成一个 token 都要读取整个缓存,缓存越大带宽开销越高。
NVIDIA 开放 Alpamayo 2 Super 商用,这是一款面向 Robotaxi 和自动驾驶的开放推理模型,基于 NVIDIA Cosmos 3 Super Reasoner 并通过强化学习后训练,以 OpenMDW-1.1 许可在 Hugging Face 发布。
NVIDIA 在 FMS 大会上宣布开源 cuFile API 及其底层存储软件栈,让 GPU 可直接读写存储,并推出 Storage-Next 计划与 SCADA 框架。基准测试显示,NVIDIA Vera CPU 在两阶段压缩加密流水线中吞吐量最高达 x86 CPU 的 3.21 倍。Storage-Next 已汇集 DDN、KIOXIA、Micron 等 40 多家存储与闪存厂商。
Black Forest Labs 的 FLUX 3 Video 初版正式通过 BFL API 和部分合作方开放。模型可生成最长 20 秒、带原生音频的视频,支持 HD(720p)与 Full HD(1080p),并提供文本生视频、图生视频与关键帧、视频续写(最多 4 秒素材)、单次生成多镜头、多语言对话与精确口型同步、Draft Mode 快速预览等能力。
推荐理由:官方公布了模型能力和自评基准数据,并说明后续开源权重与图像版本的路线,可帮助读者评估其在视频生成工作流中的位置。
Sakana AI 与 大和证券 于 2026 年 8 月 1 日启动财富管理领域的本番开发阶段,此前双方以市场信息收集与分析为主题的技术验证确认了其 AI 智能体技术的实用性。
小红书 8 月 4 日发布两项治理公告,在未成年人网络保护专项行动中累计处置违规笔记 8.4 万余篇、违规评论 10.5 万余条、违规账号 3571 个,并永久封禁利用 AI 炮制恐怖版动画、诱骗未成年人从事软色情陪聊、教唆自残的三类典型账号。
Liquid AI 发布 LFM2.5-2.6B,一款可完全在设备端运行的智能体模型,支持工具调用与多步工作流,预训练约 34T tokens,中期训练将上下文窗口扩展至 128K。
推荐理由:官方给出与约 4 倍参数量模型的逐项基准对比和 CPU 解码速度,可供判断端侧智能体的可用边界。
今日宜休科技创始人王腾回应公司工位显示器“清一色”采用小米 REDMI 品牌,理由是“性价比高”。他目前使用的手机也是 REDMI K90 Pro Max。今日宜休由前小米中国区市场部总经理、REDMI 品牌总经理王腾于 2026 年 1 月创立,英文品牌名 ISHO,今年 5 月获 CMC 资本、云九资本、高瓴创投等联合投资,金额未披露。
Microchip 与美光合作展示高性能端到端 PCIe Gen 6 存储架构,方案由 Microchip PCIe Gen 6 交换芯片与美光 9650 NVMe 固态硬盘组成。该交换芯片基于 3nm 制程,支持高级错误隔离、全面诊断与组播功能,PCIe 6.0 每通道速率达 64GT/s,带宽较 PCIe 5.0 翻倍。美光 9650 面向 AI 大模型训练、大型数据库等数据密集型场景。
鸿蒙智行发言人就"竹知了"相关网络信息发布说明,称截至8月4日晚共监测到相关信息5.6万余条,实际对171条具体侵权内容发起投诉,平台反馈下架144条。官方表示投诉针对的是恶意剪辑、AI丑化肖像等具体侵权内容,并非针对"竹知了"玩具,也未向任何电商平台投诉或要求下架该商品。
华为 Vision 智慧屏 6 SE RGB 于 8 月 4 日开售,提供 55/65/75 英寸三个版本,售价分别为 3499 元、4699 元、5799 元。该机是华为首款搭载 RGB-MiniLED 真彩画质的智慧屏,拥有 105% BT.2020 色域,色彩丰富度较普通 MiniLED 提升约 66%,并支持 300Hz 高刷。
法拉第未来宣布历史遗留债务化解取得实质进展,总负债由 2025 年的约 3.5 亿美元降至 2026 年的约 2.3 亿美元,并计划用三到四个季度将总负债降至 1 亿美元以下。3 月至 6 月,FF EAI 机器人累计出货 242 台,超过 220 台的原定目标,全年出货目标从 1,500 台上调至 2,000 台;7 月销售及出货 152 台,创单月新高。
抖音 7 月共处置色情低俗内容 40.3 万条,14.7 万个账号被采取清除违规涨粉、取消营利权限、禁言、封禁等梯度处置。2026 年以来,已有 1290 个 10 万粉丝以上账号因低俗违规被处置,76 人因涉嫌违法犯罪被抓捕。平台还通报了以暗语站外引流、健身场景批量发布暴露内容、借"AI 教程"传授制作低俗内容等典型案例。
Linux 内核维护者、Linux 基金会研究员 Greg Kroah-Hartman 于当地时间周一宣布,Linux 内核暂存区(drivers/staging/)不再接受 AI 模型生成的补丁,真实有效的安全漏洞修复除外。
开放安全 AI 联盟成员在 Black Hat 大会开幕之际,通过 Linux Foundation 发布共享 AI 发现交换(SAFE)指南的征求意见稿,拟将智能体网络安全事件转化为全生态共享防护。
Google 汇总了 2026 年 7 月发布的 AI 更新。原文仅给出这一句概述,未列出具体模型、功能或数字。
中国 AI 黑板视频在海外社交媒体引发热议,老师手写公式可实时同步大屏并生成动态曲线,手绘草图能瞬间转化为可旋转、切割的 3D 模型。该技术基于光学字符识别与 3D 剖分技术,技术基座为全国产算力训练的深度推理大模型,目前已进驻全国 300 余个地市、1400 多个区县,在超 10 万个班级常态化应用,课堂问题解答率提升 85%、学生参与度提升 72%。
华为智选车产品总监(享界系列)彭磊晒出鸿蒙智行享界 G9 的 L3 自动驾驶功能按键,画面显示该按键可亮蓝光。享界 G9 已获批北京市 L3 级自动驾驶道路测试牌照,成为首款获批该牌照的车型,采用“激光雷达 + 视觉 + 毫米波雷达”多传感器融合方案,搭载车规级 896 线激光雷达。
Endeavor Optical Networks(EON)计划用太空激光在地面站与在轨卫星之间传输光纤级数据,提供无需经过海底的洲际带宽。目前95%的洲际数据流量依赖海底光缆,全球仅约500个在用海缆系统,单条海缆从规划到运营需近十年,且红海、波罗的海和台湾周边已多次发生光缆被切断事件。
一名网友在阿塞拜疆乘坐网约车时打到一辆比亚迪,用中文喊“你好,小迪”成功唤醒车机,系统先用英文回应“Hello”,随后识别“车里有点热”并切换中文回复已调高风量。比亚迪 7 月海外销量 179841 辆,同比增长 124.3%,海外销量占总销量比重已超四成。
a16z 宣布联合领投 Volta 的 A 轮融资,Volta 定位为面向 AI 原生公司的新云,通过项目融资方式为客户组装信用支持、项目股权与债务。文中提到 Volta 已签署 100 亿美元战略合作,在挪威部署 133 MW,并与资产管理者 Azora 有一项 50 亿美元的基础设施计划。
Mistral AI 发布开源多模态安全分类器 Shieldstral,权重 3B,采用 Apache 2.0 协议。模型将内容审核改写为推理时的问答任务,用户用自然语言给出政策,无需重训即可适配文本、图像和 prompt–response 对的审核。
推荐理由:原文解释了用问答式策略接口替代固定分类体系的设计思路,并给出训练数据构建方法,读者可以借鉴其小模型超越大模型的数据策略。
Cursor 开源了面向 NVL72 的生产级 MoE 训练 megakernel Mixture-of-Kittens(MoK),并发布设计论文。
DeepSeek 在 7 月 31 日通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。其跑分报告显示单任务成本比 GPT-5.6 Luna 低约 60%,并以 7.22 万亿 Token 的调用量在全球最大 AI 聚合平台 OpenRouter 的周度统计中位居第一。
工业和信息化部组织制定并归口的《智能网联汽车 自动驾驶系统安全要求》(GB 44721—2026)强制性国家标准由国家市场监督管理总局、国家标准化管理委员会批准发布,拟于 2027 年 7 月 1 日起正式实施。
华夏出版社在书籍上标注内容禁用于 AI 训练,负责人 8 月 4 日回应称,书籍内容若未经授权被用于人工智能训练很难维权,但仍要标注以表明态度、让公众意识到图书有版权。该社内部讨论后认为标明这句话较好,目前很多非引进书籍已加注。此举出现在 AI 公司大量收购图书、用破坏性扫描数字化并销毁纸质原件的风波之后。
据英国《金融时报》,亚马逊内部发现多起因 AI 部署失误导致的预算超支案例:其中一个项目用 Anthropic 的 Claude Sonnet 将作者信息与电商商品列表匹配,花费 180 万美元、超支 860%,且超支历时五个月才被发现。
外媒 Axios 报道称,Anthropic CEO 达里奥·阿莫迪曾在内部表达担忧:一些人更多是为了钱才加入 Anthropic,而非公司崇高的 AI 使命。报道指出,顶尖 AI 研究员跳槽时同样看重计算资源、技术方向决定权与研发自由,地位、野心和理念差异有时和钱一样重要。频繁人员流动还会冲击依赖同事信任与内部知识积累的 AI 研究,迫使公司不断花钱招人。
影石 Insta360 正为旗下产品新增 AI 语音助手功能,中国大陆地区接入阿里千问大模型,中国港澳台及海外地区调用谷歌 Gemini,率先落地 Go Ultra 系列口袋相机。该助手内部代号“Kira”,采用自研加大厂模型融合模式,端侧完成声纹识别与意图判断,云端承担问答、模式切换、翻译等任务,翻译结果可由机身扬声器播报。影石官方宣布 Go Ultra 将于 8 月 5 日迎来大更新。
小鹏汽车发布 G9L「珠峰白」「峡湾灰」车色官图,新车定位大五座科技旗舰 SUV,号称“30 万级科技标杆”。该车将搭载小鹏第二代 VLA 的首次重大升级版本,支持 800 伏超快充,9 分钟可充 450 公里,并首发全体型 AI 主动贴合座椅技术。四驱版已于 7 月完成申报,车长 5120 mm、轴距 3100 mm,双电机系统总功率 430 kW。
微软漏洞赏金计划在截至 2026 年 6 月 30 日的 2026 财年向来自 64 个国家的 562 名安全研究人员支付超 2,000 万美元奖金,创项目历史最高金额和最大参与人数纪录。上一年度为 59 个国家的 344 名研究人员发放 1,700 万美元。Zero Day Quest 活动提交近 700 份漏洞报告,发放 230 万美元奖励。
教育部8月4日发布《义务教育阶段科学教育“做中学”领航行动指南》,要求4—9年级每名学生每学期至少完成1项科学探究任务,每个任务不少于4课时,1—3年级完成科学课程规定的探究实践活动即可,不另作要求。