B站AI创造公开赛:把BIP开放式造物搬进社区,观众投币决定谁获奖
B站推出“AI创造公开赛”,把BIP(Build in Public)模式搬进社区,参赛者用视频连载AI造物过程,弹幕和评论区充当需求池,观众投币数前10即可入围并获奖。赛事不卡学历、职业、经验、年龄,4月底官宣后已收到超千份意向报名,非专业开发者比例达60%,未成年及银发族占17%。
按公众号阅读文章与观点
B站推出“AI创造公开赛”,把BIP(Build in Public)模式搬进社区,参赛者用视频连载AI造物过程,弹幕和评论区充当需求池,观众投币数前10即可入围并获奖。赛事不卡学历、职业、经验、年龄,4月底官宣后已收到超千份意向报名,非专业开发者比例达60%,未成年及银发族占17%。
在6月5日的腾讯云AI产业应用大会上,腾讯首席AI科学家姚顺雨与腾讯集团高级执行副总裁汤道生对谈,回应外界认为腾讯AI慢了的声音,姚顺雨称AI是长期游戏且会更趋多元。
语音听写正在硅谷办公室流行,开发者与工程师用 Wispr Flow 等工具把口述语音转成 prompt,交给 Claude Code、Codex 等编程 AI,键盘逐渐退居备用输入方式。
Anthropic 公开内部研究数据,称 AI 正接管越来越多开发工作:2026 年第二季度其工程师每天合并的代码量是 2024 年的 8 倍,其中超过 80% 由 Claude 完成。
OpenDesign 团队开源了 HTML-Video 项目,基于 hyperframes 框架构建,采用 Apache 2.0 协议,称其为 HTML 版剪映。
ICRA 2026 在维也纳颁出多项核心奖项,胡瑞珍获最佳自动化论文奖,石冠亚获大会最佳论文奖及最佳操作与运动论文奖,王晓龙获 IEEE RAS 青年学术先锋大奖。胡瑞珍团队的 IMR-LLM 用大语言模型实现工业多机器人任务规划与程序生成,石冠亚团队的 OmniRetarget 为人形机器人全身移动操作提供保留物理交互的数据生成范式。
波恩大学教授 Maren Bennewitz 在 ICRA 2026 演讲中提出,机器人需将感知、预测、先验知识与动作规划放入同一闭环,通过主动移动视角、推动或抓取遮挡物,以最少动作获取最多信息。她展示了不确定性语义地图、3D 场景图结合 LLM 语义先验与重定位模型、以及农业监测中基于上一时刻地图先验的非刚性配准三类场景,并指出下一步将学习可见性与遮挡关系图表示。
UC Berkeley 教授 Ken Goldberg 在 ICRA 2026 演讲中提出,机器人领域积累的数据总量远小于大语言模型,存在约十万年的数据鸿沟,因此对数据万能论应保持警惕。
Lovart 年中大促开启,最低 43 折,为 2026 年全年最低价窗口,活动结束后恢复原价。作者以年费用户身份分享了 Brand Kit、Font Generator、Create Skill 和 Export PSD 四个常用功能,其中 Brand Kit 可存储设计风格并通过 @ 调用,Font Generator 约三分钟生成字体并自动存入 My Fonts。
Anthropic 研究院发布长文《当 AI 开始构建自己》,用公开基准和此前未披露的内部数据说明 AI 已在加速 AI 系统自身的开发。文中称 Anthropic 工程师平均每季度交付的代码量是 2021 至 2025 年间的 8 倍,Claude 在最开放任务上的成功率在 2026 年 5 月达到 76%,六个月内提高 50 个百分点。
推荐理由:Anthropic 用内部数据展示 Claude 在写代码和做研究上的进展,读者可据此理解递归自我改进这一趋势的早期证据。
Modal 正把 Sandbox 作为第二增长曲线,从 serverless GPU 平台扩展为 Agent Runtime 平台,Sandbox 已贡献超过三分之一收入。
慕尼黑工业大学自动驾驶实验室负责人 Johannes Betz 在 ICRA 2026 演讲中复盘团队过去八九年的自动驾驶赛车研究,其人类启发的主动驾驶智能系统 APEX 在与梅赛德斯-AMG 的测试中比测试车手快 2.6 秒、比前 DTM 车手本·施奈德快 1 秒,但每圈比 F1 车手乔治·拉塞尔慢约 1.5 秒。
AI科技评论的文章认为,Coding 能力正取代参数与月活,成为大模型公司估值的最核心驱动因子。文章以 Anthropic 5 月 28 日完成 650 亿美元 H 轮融资、估值达 9650 亿美元超越 OpenAI 的 8520 亿美元为例,并称仅 Claude Code 一条产品线就单独贡献 25 亿美元 ARR。
上海人工智能实验室提出 AgentDoG 1.5,一套轻量级可扩展的 Agent 安全对齐框架,把轨迹级安全诊断模型部署为在线 guardrail,在最终回复交付前的 Pre-Reply 节点审计完整执行轨迹并拦截风险。
Anthropic 分享了用 Claude 承接约 95% 内部业务数据分析请求、整体准确率约 95% 的方法。核心是分层数据技术栈和 Skill,用于应对概念与字段映射模糊、数据过期和检索失败三类失败模式;不加 Skill 时评测准确率不超过 21%,加入后稳定在 95% 以上。
李飞飞与 World Labs 团队发表长文《世界模型的功能性分类》,将当前被叫作世界模型的系统按功能分为渲染器、模拟器与规划器三类。渲染器输出观测、以视觉保真度为目标,模拟器输出在几何与物理上忠实的状态,规划器输出行动以决定智能体下一步该做什么。
英伟达在 GTC Taipei 发布的 Isaac GR00T 参考人形机器人中,灵巧手来自 Sharpa,本体为宇树 H2 Plus,算力模组为 Jetson Thor。
在 ICRA 2026 的主题演讲中,UT Austin 副教授、NVIDIA GEAR 团队负责人朱玉可提出以三层数据金字塔和世界模型为核心的路径,来缓解人形机器人真实数据稀缺的瓶颈。
银河通用创始人兼 CTO 王鹤在 ICRA 2026 演讲中提出,具身智能正迈向专属的「AlphaGo 时刻」与「ChatGPT 时刻」。他称银河通用已实现完全自主的人形机器人网球对抗和基于「灵巧世界模型」的灵巧手工具操作,并发布结合 VLA 与世界模型的 LDA 模型,已在全家便利店、宁德时代及物流仓储等场景全自主落地。
Kimi 发布 Kimi Work Beta 版,这是一款运行在本地的通用 Agent 产品,面向知识工作者,Mac 版已上线,Windows 版正在开发中。
英伟达在 2026 中国台北 GTC 大会上发布面向物理 AI 的开放世界基础模型 Cosmos 3,原生支持文本、图像、视频、环境音、动作五大模态的理解与生成,采用混合 Transformer(Mixture-of-Transformers)架构,并分为 Cosmos 3 Super、Cosmos 3 Nano 和即将上线的 Cosmos 3 Edge 三个版本。
GitLab 宣布裁减约 14% 的员工、约 350 人,作为其重组计划的一部分,同时表示会将节省下来的大部分成本重新投入研发和 AI 产品。财报显示,其 2027 财年第一季度营收为 2.642 亿美元,同比增长 23%,毛利率 88%,非 GAAP 运营利润率从 12% 提升至 14%,GAAP 净亏损从 3590 万美元收窄至 500 万美元。
昆仑万维于 5 月 26 日发布 SkyClaw-v1.0,定价 0.5 元每百万输入 token、4 元每百万输出 token,官方定位为面向工具使用和真实任务执行的 Agent 模型。
香港中文大学(深圳)王方鑫团队联合首都师范大学、南加州大学提出 3DReflecNet,一个面向反射、透明、低纹理物体的 3D 重建数据集,含 12 万+ 合成实例、1000+ 真实物体,总规模超 22 TB。
KIMI Desktop 上线 KIMI Work,可理解为带 GUI 版本的 KIMI Code,并兼容 KIMI Chat 模式,Windows 版仍需等待。作者作为 KIMI 长期订阅用户已第一时间用上,并认为大模型公司自研 Agent 且 Codex 化是大势所趋,DeepSeek 自研 Agent Harness 可能很快出现。
歸藏发布了 iOS 阅读器即览,可在 iPhone 和 iPad 上打开 .md、.markdown、.html、.htm、.txt 以及网页打包的 .zip 文件,全部本地渲染,无需上传或注册账号。即览把动态脚本默认关闭,并支持目录跳转、夜间模式、桌面模式切换,此前已在 TestFlight 开放 8000 个名额。作者认为在 AI 工作流里 Markdown 更像数据层,HTML 更像展示层。
谷歌DeepMind发布并开源Gemma 4 12B,这是一个统一、无编码器的多模态模型,只需16GB显存或统一内存即可在消费级笔记本上运行。它在标准评测基准上的成绩接近26B MoE模型,总内存占用不到后者一半,采用Apache 2.0协议,预训练与指令微调权重可从Hugging Face和Kaggle下载。
推荐理由:原文介绍了无编码器多模态架构如何降低延迟和内存占用,并列出16GB笔记本可用的本地运行入口。
Kimi 发布桌面端 Agent 产品 Kimi Work,定位面向知识工作者,支持最多 300 个 Agent 并行工作。核心能力包括 WebBridge 浏览器操控、同花顺/天眼查/iFind 等数据源接入、超长文本处理、PPT 生成和 Skill 系统,目前提供 Mac 版下载,Windows 版尚未上线。
Kimi 电脑客户端新增本地通用 Agent 模式 Kimi Work,作者实测用其 Agent 集群解析金融数据,半小时产出一篇七八万字的研报,再基于研报并发生成几十页 PPT。
Alphabet 当地时间 6 月 1 日公布总额 800 亿美元的股权融资计划,资金用于 AI 底层基础设施与全球算力集群扩建。融资由 300 亿美元公开发行、400 亿美元 ATM 持续增发计划和向伯克希尔·哈撒韦定向配售 100 亿美元三部分组成,后者的 A 类普通股较 Alphabet 收盘价 376 美元约有 6% 折扣。
推荐理由:账面现金超千亿仍启动800亿美元增发,可作为观察AI基建投入如何改变科技巨头财务结构的样本。
中国科学院深圳先进技术研究院徐天添在 ICRA 2026 Keynote 演讲中展示了磁控微机器人进展:用柔性霍尔传感器贴片实现便携式三维磁定位,以超声波反馈闭环控制微机器人,并用患者自身血液构建水凝胶微机器人。其磁流体左心耳封堵动物实验中,11 头猪实现完美封堵无渗漏,首头实验猪存活已约两年。
ICRA 2026 于6月1日在奥地利维也纳开幕,有效投稿4947篇、录用1882篇,录用率38.04%,11所中国高校占Top 20的55%。千寻智能在展台展示自研具身基座模型 Spirit v1.6,据现场介绍其在此前盲测中力压英伟达 Cosmos3 与 Physical Intelligence 的 Pi0.5。
新加坡国立大学余浩泳在 ICRA 2026 医疗机器人 keynote 上回顾团队 10 年可穿戴机器人研究,指出外骨骼未被广泛使用的瓶颈是太重、不舒适、穿戴复杂、控制困难且成本高。他提出用单电机加差速机构降低背部、肩部与髋部辅助设备的重量和同步控制难度,并以 FMG 传感器阵列隔衣识别负载等级与任务模式,实现自适应辅助。
AGI Playground 2026 的 Founder Show 板块正式启动招募,今年落地新加坡,面向全球 VC 合作伙伴,邀请北美、东南亚、欧洲、日本、拉美等市场的投资机构与生态方参与。招募重点关注 AI Infra、AI 应用和智能硬件三类团队,不以融资轮次为唯一筛选标准,入选团队可获得加速资源包、专属展位和闭门小局等资源,8 月在新加坡线下展示。
Colway(同路 AI)创始人穆建鑫提出 A2H(AI to Human)服务模式,将平台定义为"真人经验增强的个性化服务 Agent",让 AI 连接真实经验而非替代人。Colway 采用积分激励与付费服务结合的轻量化模式,天使轮基本完成,计划今年 9 至 10 月上线,先聚焦国内市场再考虑出海。
2026 年中国图像图形大会(CCIG 2026)5 月 29 日至 31 日在广州举办,由中国图像图形学会主办、中山大学承办,4200 余位专家学者和企业代表参会。
桥介数物创始人尚阳星认为机器人全身运动能力被低估,公司已建成"跨本体全身运动数据工厂",累计产出近千小时高质量 CWM 数据,并在十多款不同足式机器人上完成模型验证。数据工厂采用动捕加第一/第三人称视频采集,配合自研重定向引擎实现跨本体迁移,一小时数据采集成本约几百元,合格率超 90%。桥介计划今年内收集上万小时数据,并于 6 月推出将机器人运动控制做成标准化方案的产品。
上海交通大学教授王贺升在 ICRA 2026 演讲中提出,传统 SLAM 正从静态假设走向动态、可变形环境的具身智能导航。其团队结合激光雷达与视觉多模态融合、动态 Gaussian SLAM 与可变形三维高斯地图,并引入 NeRF 记忆机制和视觉语言模型推理辅助决策,跨模态定位每帧推理仅 14 毫秒。相关技术已在矿卡、仓储机器人、自动泊车和割草机器人等场景落地。
Anthropic 推出命令行工具 ant,可在终端直接调用 Claude API、管理 Agent、上传文件并跑自动化任务。
涂鸦智能云端架构师吕永猛将在 6 月 26 日-27 日举办的 AICon 上海站分享《AI 的"最后一公里":本地执行与全场景硬件接入的下一代 Agent 中枢》,聚焦 OpenClaw 架构的本地化演进,实现从嵌入式 MCU 到高性能边缘网关的全算力适配。