OpenAI 联合创始人卡帕西官宣加盟 Anthropic,重返大模型研发前线
安德烈·卡帕西(Andrej Karpathy)宣布加入 Anthropic,将于本周正式入职其预训练团队。他将重点主导建立一支全新团队,探索利用 Claude 自身的能力来加速预训练研究。卡帕西是 OpenAI 创始成员、前特斯拉 AI 总监,2022 年离开特斯拉后曾短暂回归 OpenAI,随后创办 AI 教育企业 Eureka Labs。
ithome.com · 网站与博客
安德烈·卡帕西(Andrej Karpathy)宣布加入 Anthropic,将于本周正式入职其预训练团队。他将重点主导建立一支全新团队,探索利用 Claude 自身的能力来加速预训练研究。卡帕西是 OpenAI 创始成员、前特斯拉 AI 总监,2022 年离开特斯拉后曾短暂回归 OpenAI,随后创办 AI 教育企业 Eureka Labs。
OpenAI 宣布推出名为“保证容量”(Guaranteed Capacity)的新服务,允许客户选择一至三年的合约期限长期锁定其 AI 计算基础设施访问权限,并根据年消费水平提供递增折扣。该额度可在 OpenAI 的全线产品组合、所支持的云服务提供商和模型家族范围内使用,并包含用于生产系统、面向客户的应用以及在其上运行的 AI 智能体的专用容量。
苹果预告将在 iOS 27、iPadOS 27、macOS 27 中把 Apple Intelligence 深度接入无障碍功能,Voice Control 支持自然语言输入,用户可直接说"点开最佳餐厅指南"或"点紫色文件夹"来操作 iPhone 和 iPad。
苹果预告 iOS 27 将推出系统级"生成字幕"功能,可自动为社交媒体、相册及信息中无字幕的个人视频实时生成字幕,并支持自定义字幕外观。该功能基于设备端语音识别,音频数据完全在本地处理不上传云端,同时覆盖 iPhone、iPad、Mac、Apple TV 和 Vision Pro。首发版本仅支持英语,且仅面向美国和加拿大用户。
在 2026 谷歌 I/O 开发者大会上,谷歌为 Google AI Studio 加入原生安卓应用生成功能,用户可直接在浏览器里用文本提示创建可安装、可分享的完整安卓应用。
谷歌在 2026 I/O 开发者大会上面向 Workspace 用户推出 AI 图像生成与设计工具 Google Pics,先以网页应用形式上线,可制作邀请函、海报等视觉内容。
谷歌在 2026 I/O 开发者大会上为 Play 应用商店推出 Ask Play,支持理解完整上下文的连续问答,用户可在首个需求后追加条件,系统合并语义后推荐应用。同步推出 Ask Play highlights,在搜索结果页上方提供复杂搜索的高层级摘要。Gemini 将在未来几周于 Android 和网页端聊天界面中呈现应用及相关内容,并可能根据问题意图主动推荐应用。
谷歌在 2026 年 I/O 开发者大会上宣布,为 Google TV 引入基于 Gemini 的新应用发现工具,帮助用户更容易找到新应用和可观看内容,该能力建立在 3 月已上线的 Google TV Gemini 功能之上。
谷歌在 2026 年 I/O 开发者大会上发布智能手表平台 Wear OS 7,从 Wear OS 6 升级后电池续航最高提升 10%。部分 2026 年发布的手表将获得 Gemini Intelligence 支持,用于执行智能体任务,具体设备名单与功能细节尚未披露。谷歌同步推出 AppFunctions API,让开发者把 Gemini 等助手或智能体整合进应用。
谷歌在 2026 I/O 开发者大会上发布 Antigravity 2.0 桌面应用,定位从面向开发者的智能体式 IDE 转向通用智能体优先工作平台,可同时部署多个子智能体并通过“/schedule”命令设置一次性或周期性定时任务。
谷歌在 2026 I/O 开发者大会上推出科研版 Gemini 模型 Gemini for Science,可追踪最新论文、将研究目标转化为可用代码并生成新假设。谷歌还提到模拟人工智能,未来有望模拟更复杂的系统甚至虚拟细胞,并透露已有多个项目处于临床前阶段,覆盖免疫疾病和癌症,目标是重新构想药物发现过程。
谷歌在 2026 年 I/O 开发者大会上宣布升级 AI 创意平台 Google Flow,整合 Gemini Omni Flash 的推理与生成式媒体能力,提升精细视频编辑和角色一致性,该功能已向全球 Google AI 订阅用户开放。
谷歌在 2026 I/O 大会上宣布将 Project Genie 的世界生成能力接入谷歌街景,可基于真实街景图像构建可探索、可互动的 3D 世界,用于 AI 智能体或机器人训练。用户点击 Google Maps 地图图钉选择美国地点并指定风格、描述角色后即可生成想象世界。该能力目前仍是实验性原型,仅支持美国地点,扩展时间表未定。
谷歌在 2026 I/O 开发者大会上携手三星展示 2 款智能眼镜,由 Gentle Monster 与 Warby Parker 参与设计,整合 Gemini AI,支持语音导航、基于路线的个性化推荐、自提订单、通知摘要和实时翻译(含菜单、路牌文字)。产品定位为手机伴侣设备,免手操作,首批定于今秋上市,价格暂未公布,传闻无显示版本或在 379 至 499 美元区间。
谷歌在 2026 谷歌 I/O 开发者大会上公布 AI 电商进展,推出 Universal Cart 通用购物车,将于今年夏天在谷歌搜索、Gemini、YouTube、Gmail 中推出。
谷歌在 2026 谷歌 I/O 开发者大会上宣布升级 Google Workspace,把 Gmail、Docs、Keep 变成可语音对话的协作助手。
谷歌在 2026 谷歌 I/O 开发者大会上发布 Ask YouTube,把 YouTube 的关键词搜索升级为对话式搜索,用户可用完整句子描述需求,并在拿到首轮答案后继续追问、逐步缩小范围。
谷歌在 2026 谷歌 I/O 开发者大会上宣布谷歌搜索迎来 25 年来最大改版,用 AI 全面重塑搜索入口与交互方式,由 Gemini 3.5 Flash 模型提供快速响应。
推荐理由:改版把 AI Mode、多模态输入与后台智能体一并纳入搜索入口,呈现搜索交互从关键词到完整需求的转向。
谷歌在 2026 谷歌 I/O 开发者大会上发布个人 AI 智能体 Gemini Spark,由 Gemini 3.5 系列模型及 Google Antigravity 框架驱动。
谷歌在 2026 I/O 开发者大会上预告 Android Halo,可在屏幕顶部实时显示 AI 智能体是否正在运行、完成任务或发送消息,状态跨应用常驻。该功能将首先支持即将加入 Gemini 应用的主动式 AI 智能体能力 Gemini Spark,今年晚些时候上线后再扩展至其他 AI 智能体,未来还将加入由 Gemini Intelligence 驱动的更多 Halo 能力。
谷歌在 2026 I/O 开发者大会上推出月费 100 美元的 AI Ultra 新订阅计划,支持 Gemini Spark AI 智能体。该计划定位在月费 20 美元的 AI Pro 与月费 250 美元的 AI Ultra 之间,瞄准使用 AI 编程或处理复杂工作流的高级用户,与 Anthropic 和 OpenAI 的同类产品竞争。
谷歌在 2026 谷歌 I/O 开发者大会上发布 Gemini 3.5 Flash 模型,称其在许多基准测试中的表现优于 3.1 Pro。该模型的输出速度达到每秒 289 tokens,是 Claude Opus 4.7 和 GPT-5.5 xhigh 的 4 倍。
谷歌在 2026 I/O 开发者大会上宣布 Gemini 3.5 Pro 将于下个月登场,目前已在内部使用,官方称其进步非常强。其他具体信息暂未公布。
谷歌在 2026 年谷歌 I/O 开发者大会上宣布 Gemini 集成 C2PA 内容凭证,用于抵御深度伪造。谷歌搜索和 Chrome 浏览器已集成 SynthID 与 C2PA,用户圈选图片搜索,或在 Chrome 中右键点击图片,即可询问图片是否经过 AI 编辑。桑达尔表示 SynthID 目前已经为 10 亿张图片和视频以及 6 万年的音频添加了水印。
谷歌在 2026 I/O 开发者大会上发布 Gemini Omni 全能模型,宣称可从任意输入生成任意输出,并支持一句话对话式修改视频中的角色、背景等元素。Google DeepMind 负责人哈萨比斯称其为 Gemini 模型家族迄今能力最全面的版本。
谷歌在 2026 谷歌 I/O 开发者大会上披露,2026 年 5 月每月处理超 3200 万亿 Token,同比增长 7 倍。Gemini App 月度活跃用户已超 9 亿,同比增长超 1 倍,每日请求量增长超 7 倍。Nano Banana 模型已累计生成超 500 亿张图片。
迪士尼因在主题乐园入口使用面部识别却未充分告知游客,面临一起集体诉讼,原告方要求向受影响人群索赔至少 500 万美元。诉讼指出,包括儿童在内的绝大多数入园游客不知情自己的生物特征数据正在被采集;迪士尼辩称该技术用于简化入园和二次入园流程并防范票务欺诈,采集数据会在 30 天内全部删除。园区虽设有四处可避开面部识别核验的通道,但仅用带斜线的人形简易图标标识,诉讼方认为这算不上有效告知。
AMD AI 开发者大会(AMD AI DevDay 2026)5 月 19 日在上海首次举办,AMD 董事会主席及 CEO 苏姿丰与零一万物创始人李开复围绕"AI 智能体新范式"展开对话。
苹果已收购虚拟形象制作软件公司 Animato,该公司专注视频通话与线上课程场景的虚拟形象技术,此举或用于优化 Vision Pro 的 Persona 功能。Animato 由曾在苹果任职七年的 Francesco Rossi 于 2022 年 10 月创立,总部位于旧金山。该收购由欧盟依据《数字市场法案》披露,报备日期为 2026 年 1 月 19 日。
苹果宣布一批依托 Apple Intelligence 的无障碍功能,为旁白、放大器、语音控制和无障碍阅读器扩充能力,并新增设备端智能字幕生成。旁白可对照片、账单、证件生成详细描述并支持相机画面连续追问,语音控制支持口语化描述界面元素操作。
影石发布首款旗舰级无线麦克风 Mic Pro,首创三麦克风阵列与芯片内置 NPU 模块,支持四种指向拾音模式和 AI 降噪。产品搭载六色墨水屏,可直连 Luna、X5、X4 Air、Ace Pro 2、GO Ultra 等影石相机,空旷环境传输距离达 400 米,音频最高 48kHz。单发标准价 698 元,即日起至 6 月 21 日限时福利价 528 元起。
亿咖通科技宣布与美国企业 May Mobility 达成战略框架协议,将向后者的自动驾驶出租车车队提供智能驾驶全栈解决方案,项目周期总价值预计约 7.5 亿美元(约合 51.09 亿元人民币)。亿咖通将交付数万套定制 L4 级中央计算平台和传感器硬件组合,双方目标于 2028 年将自动驾驶车辆整车综合成本降低至少一半。亿咖通 CEO 沈子瑜称此次合作是公司拓展全球自动驾驶业务版图的重要里程碑。
联想在“天禧 AI 一体多端全场景新品超能之夜”推出 2026 款小新 Air 14,Ultra 5 226V + 16GB RAM + 512GB SSD 售 5499 元,Ultra 5 228V + 32GB RAM + 1TB SSD 售 6999 元。
联想为 YOGA AI Mini 迷你主机新增 Ultra X7 358H 处理器版本,配 64GB RAM 和 1TB 存储,定价 17999 元,部分地区国补后 16499 元。该机为圆柱形机身、浅海贝配色,重 600g、容积约 0.65L,配备雷电 4、2.5G 网口、HDMI 等接口。
联想在“天禧 AI 一体多端全场景新品超能之夜”推出 YOGA 32 Ultra Aura 一体机,定价 22999 元。该机搭载 Ultra X7 358H 处理器,配 32GB RAM 和 1TB SSD,正面为 31.5 英寸 3840x2160 分辨率 165Hz 面板,支持 10-Bit 色彩与 1000 尼特峰值亮度,并内置 16MP LR 摄像头和四扬声器系统。
焕新极氪 009 正式上市,官方指导价 43.98 万至 46.98 万元,权益后限时售价 41.38 万至 44.38 万元,5 月 20 日起开启交付。新车首次搭载算力 700TOPS 的 Thor-U 智能驾驶芯片并标配激光雷达,搭载千里浩瀚 H7 G-ASD 辅助驾驶系统。
联想在“天禧 AI 一体多端全场景新品超能之夜”发布 AI 主机家族,作为天禧 AI 4.0 的硬件载体,支持“一键养虾”“一键组队”。首款 P7 搭载此芯 P1 芯片,提供 190TOPS 本地算力,最高 80GB RAM、128K 上下文窗口,7 月 1 日开启众筹。同步推出联想 AI 主机 mini,本地算力 45 TOPS,定价 2999 元,6 月 12 日预售。
微软前 Windows 人工智能创新合作总监马特 · 韦洛索在 X 上批评微软错失人工智能浪潮,称 Copilot 虽预装普及但付费用户实际使用率不足 3%。他列举了必应 AI 转型未换来份额增长、GitHub 服务可用性跌破 90% 等理由,微软企业沟通负责人弗兰克 · 肖随后作出回应。
联想发布天禧 AI 4.0 版本,官方称其从"被动调用"转为"自主执行"。新推出的天禧 Claw 支持"仿生记忆",基于 1.7B 多模态记忆模型实现情景、语义、程序记忆,模型完全部署在设备本地以保障离线安全。该版本还提供个人知识库功能,并推出模型广场、智能体广场和 Skills 技能广场,支持用户上传技能供他人使用。
特斯拉在北京、上海、天津、重庆、广州、深圳、成都、苏州、武汉 9 座城市招聘智驾测试(实车测试)技师,岗位属研发-自动驾驶 Autopilot 部门,需在公共道路、测试跑道和验证场地对车辆实地测试。