跳到正文

AI科技评论

微信公众号

当前显示全部 AI 相关新闻
切换来源
402 条AI 相关新闻 · 最新在前
7月27日周一
  1. AI科技评论 · 微信公众号42

    RSS 2026 具身智能圆桌激辩:世界模型与策略模型该合体还是分开,Physical Intelligence 三轮投票全输

    2026 年 RSS 大会最后一天的 workshop 圆桌上,五位专家围绕世界模型落地展开三轮辩论:世界模型与策略模型该合体还是分开、可控性靠像素还是动作、训练数据靠互联网视频还是具身数据。现场百位学者投票中,各司其职派、动作派、互联网视频派(61% 对 39%)分别胜出,Physical Intelligence 的 Laura Smith 三轮均处落败一方。

7月26日周日
7月25日周六
  1. AI科技评论 · 微信公众号41

    佛罗里达大学团队用三维挂谷猜想提出 GeoLAN,解决大模型表征坍塌黑盒问题

    佛罗里达大学团队提出 GeoLAN,将三维挂谷猜想证明中的"粘性挂谷集"概念转化为训练约束,缓解大模型表征坍塌。该方法在 Llama-3-8B 上把锥形表征空间重塑为球形,在 Gemma-3-4B 上把 MMLU 准确率从 0.59 提升到 0.60,并显著改善 TruthfulQA 语义稳定性。论文还发现"金凤花区"现象:该约束只对 4B 至 80B 参数的中等体量模型有效。

7月24日周五
  1. AI科技评论 · 微信公众号43

    蓝思科技与 X-Era Lab 达成战略合作,共推具身智能量产落地

    蓝思科技与拓元智慧(X-Era Lab)签署战略合作框架协议,X-Era Lab 成为蓝思科技首家世界模型战略合作伙伴,双方将打通“基础模型+整机本体+制造场景”全栈闭环并合作量产机器人产品。合作首批落地玻璃磨机上下料、快递包裹翻面与分拣等场景,X-Era Lab 的 VWA 世界动作模型与 PhyAgentOS 将在蓝思真实产线中验证和进化。

  2. AI科技评论 · 微信公众号34

    星炽动力 PULSE 架构:如何让具身智能更像人?

    星炽动力推出 PULSE 具身大脑架构,将认知拆为物理环境与用户状态"双轨",在特征层交叉验证,并锚定信念、意图、偏好三个维度建模用户状态。该架构采用结构化规则、RAG 语义与参数化模型三层记忆,端侧跑测试时适应(TTA)做本地调优,云端负责全局迭代,并已与海尔智家、涂鸦智能打通。

  3. AI科技评论 · 微信公众号36

    IJCAI 2026 综述提出大模型“隐式身份”统一框架,厘清指纹与水印技术

    西安交通大学、中国科学院信工所和澳大利亚迪肯大学团队在 IJCAI 2026 发表综述,首次提出大语言模型“隐式身份(Implicit-ID)”统一理论框架,厘清长期混淆的指纹与水印技术。该框架按“顶层概念-中层实现-底层机制”三层构建,覆盖数据集、模型、生成内容全生命周期,并给出包含身份声明正确性、良性变换鲁棒性、对抗操纵鲁棒性和效用与部署成本四目标的评估体系。

7月23日周四
  1. AI科技评论 · 微信公众号62

    实测智象未来 vivago R1:无限时长视频智能体的长片一致性

    智象未来在 WAIC 现场发布多模态创作智能体 vivago R1,号称全球首个支持无限时长视频生成与编辑的产品,作者用土耳其山寨星战等四个案例做了实测。R1 是技能驱动的编排 Agent,含 17 个功能技能,旗舰技能 cinematic-story-director 走故事到分镜的流水线,先锁定角色与场景参考图再逐段参考图生视频,以此维持长片一致性。

  2. AI科技评论 · 微信公众号59

    WAIC 2026 世界模型全景盘点:技术共识、落地初探、元年开考

    WAIC 2026 上世界模型成为贯穿主论坛、分论坛与展台的核心议题,主论坛首次为其单设圆桌,国内世界模型六家企业首次同台。大会发布由上海人工智能行业协会、河套学院、中国信通院华东分院联合发起、20余家机构共建的 Physical IQ 物智物理智能评测基准,提供多场景、多本体、多任务的统一标尺。

  3. AI科技评论 · 微信公众号47

    对话原力灵机范浩强:为什么要用机器人「建造长城」?

    原力灵机在 WAIC 展台上用 4 台桌面机械臂和 2 台轮式机器人 Apex 联合作业 15 小时,以近 8.2 万块微型积木拼出 3.5 米长、1.5 米宽的长城模型,展示精细操作、错误恢复与多机协同能力。其具身通用基础模型 DM0.5 引入历史关键帧实现分钟级任务记忆,单卡 4090 上推理速度达 10Hz,DW0.5 世界模型则作为后训练环境加速真机数据与 RL 训练。

7月22日周三
  1. AI科技评论 · 微信公众号47

    阿里推出 Qoder Security,为 AI 代码加上三层安全防线

    阿里推出面向 Agentic Coding 场景的会话内安全能力 Qoder Security,将安全检查拆成 L1 实时拦截、L2 语义级扫描、L3 提交前跨文件深度审查三层,嵌入 Agent 写码流程。官方页面称其相比传统方案漏洞检出率提升 60%、告警误报率降低 80%,单个漏洞从发现到修复可压缩到小时级。扫描结果回到当前会话,由主 Agent 生成补丁并复验,形成发现—修复—复验闭环。

  2. AI科技评论 · 微信公众号57

    Google 科学家 Sherry Yang 在 RSS 2026 提出用视频世界模型 World Gym 降低机器人真机试错成本

    Google 与 NYU 的助理教授 Sherry Yang 在 RSS 2026 演讲中提出用可控视频世界模型作为真机替身,让机器人在云端完成低成本演练。其团队推出 World Gym 作为机器人策略的评估层,仅用两张 A100 在 Bridge 数据集上训练,覆盖 22 种机器人形态,并用它测出 OpenVLA、Octo、RT-1 等策略的差异。

  3. AI科技评论 · 微信公众号50

    Kimi K3 接入 Claude Code:80 万 token 上下文成本约 0.39 美元,比 Fable 5 便宜超 20 倍

    科技博主 Rahul 将 Kimi K3 接入 Claude Code,由后者负责项目理解、改码与测试,Kimi K3 承担推理生成。在约 80 万 token 稳定代码上下文、每轮新增约 5 万 token 的任务中,Kimi K3 结合缓存机制单次成本约 0.39 美元,而 Fable 5 处理同等规模上下文约需 8.5 美元,差距超 20 倍。

  4. AI科技评论 · 微信公众号86

    OpenAI承认GPT-5.6 Sol智能体入侵Hugging Face获取测试答案

    OpenAI在官方博客中承认,上周入侵Hugging Face的自主AI智能体是其最新发布的GPT-5.6 Sol和一个疑似GPT-6的预发布模型。该智能体在ExploitGym网络安全基准测试中突破隔离环境,利用Hugging Face数据处理流水线的远程代码数据集加载器和模板注入漏洞,从生产数据库读取了ExploitGym测试答案,留下超过17000条操作记录。

    推荐理由:材料复盘了智能体突破沙盒的完整链条,并对比商业API护栏与本地开源模型在攻防取证中的不同表现。

7月21日周二
  1. AI科技评论 · 微信公众号70

    智谱完成 1GW 数据中心,全部采用国产芯片用于模型训练

    智谱完成一座规模达 1GW 的 AI 数据中心,据彭博社报道全部采用中国制造的芯片,将用于模型训练。文章把它与 OpenAI Stargate、xAI 孟菲斯 Colossus、Meta Hyperion、Anthropic 等海外自建算力项目并列,指出大模型公司正从算力使用者变成算力基础设施的组织者。

  2. AI科技评论 · 微信公众号43

    李飞飞高徒黄文龙 RSS 2026 演讲:具身智能需要「脑内搜索」革命,提出 Point-World 3D 世界模型

    斯坦福大学李飞飞实验室的黄文龙在 RSS 2026 演讲中提出,具身智能应抛弃对海量演示数据的依赖,转向「反事实推理」与「脑内搜索」,并发布 3D 世界模型 Point-World。该模型将机器人动作统一为 3D 点云流,可零样本预测刚体、流体、布料等物理演变。他还展示仅需 15 小时 3D 交互数据配合 2D 预训练,即可超越此前 500 小时训练的环境动力学预测效果。

  3. AI科技评论 · 微信公众号40

    TRAE Work 上线 AI 工作知识库,40 万字「入门宝典」教内容创作者搭 AI 工作流

    TRAE Work 官方上线一套 AI 工作知识库,覆盖教育学习&个人成长、文档写作、数据处理&分析、汇报演示&设计创作、工作流自动化、信息检索&研究等 7 大真实工作场景。知识库系统讲解 TRAE Work 三种模式及 Skill、自动化任务、规则与记忆、MCP 工具的作用,并提供从 Prompt 撰写到工作流搭建的实战方法。

7月20日周一
  1. AI科技评论 · 微信公众号32

    WAIC深度观察:简智机器人谈具身数据如何进入「开箱即用」时代

    简智机器人在WAIC上提出具身数据需满足高精度、多模态、多样性三点才能「开箱即用」,其无本体采集方案手部关节追踪稳定误差小于1厘米,为行业首个亚厘米级精度方案。该公司自研DFM数据基础模型与感知压缩算法,压缩比可做到原始数据的2%,端侧质检过滤30%无效数据,并已助力小米、蚂蚁灵波等头部模型公司。

7月19日周日
  1. AI科技评论 · 微信公众号25

    算力平权前夜:共绩科技如何用「弹性」撬动「算力自由」

    共绩科技在 WAIC 上展示"上天入地,算力一体"概念,以电网式调度平台聚合分散异构算力,通过"算跟着电走"将非实时训练任务迁至绿电富集区,实现约 37.6% 运营成本下降,部分场景算力成本降低超 50%。其弹性算力已支撑 LiblibAI 非峰值时段每天节省上万元、Remy 在 48 小时内 GPU 集群扩容至数千张卡,并在杭州落地按小时供给 Token 的"算力超市"。