Google 在 Gemini 中推出学生专用中心
Google 在 Gemini 中推出学生专用中心,把收集研究资料的学习笔记本、闪卡和练习测验等功能集中到一处,学习笔记本还新增图表和图片支持。该中心可根据教学大纲把考试日期和截止日期加入 Google Calendar。Google 同时把 Deep Research 加入 Gemini Live,可生成复杂研究报告并对话讨论结果,等待期间可关闭对话并锁定手机屏幕。
theverge.com · 网站与博客
Google 在 Gemini 中推出学生专用中心,把收集研究资料的学习笔记本、闪卡和练习测验等功能集中到一处,学习笔记本还新增图表和图片支持。该中心可根据教学大纲把考试日期和截止日期加入 Google Calendar。Google 同时把 Deep Research 加入 Gemini Live,可生成复杂研究报告并对话讨论结果,等待期间可关闭对话并锁定手机屏幕。
OpenAI 表示已放慢部分 AI 开发节奏并收紧安全与防护措施,其中包括对“即将部署的最新模型”的强化学习训练暂停两周,并推迟其最大的前沿 RL 训练运行。这一决定发生在 OpenAI IPO 在即、Anthropic 以及中国和开源权重竞争对手压力加剧的背景下。文章将其视为对 AI 安全倡导者多年来主张的一次公开检验,即公司是否愿意退出 AI 竞赛、放慢脚步。
Meta 为旗下 AI 聊天机器人推出 Mac 应用,支持共享窗口,让聊天机器人基于屏幕内容提供建议、回答问题或生成内容,并可在所有应用中听写。此举是 Meta 将 AI 聊天机器人打造成生产力助手的一部分,以更好地与已推出桌面应用的 AI 竞品竞争。
Nvidia 正与 Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs 和 KKR 合作,募集 5000 亿美元把算力变成可投资的资产类别。黄仁勋对 CNBC 称,芯片已是能产生收入的资产,具有耐用、可互换和灵活的特点。The Verge 这篇报道对这套金融策略提出疑问。
Robin Williams 的子女接管了其父亲的 Instagram 账号,以应对针对他的 AI 形象使用。Zak、Zelda 和 Cody Williams 在周二发布的帖子中表示,希望这一账号成为安全可信的空间,让分享的故事、照片、视频和回忆以真实、温暖和用心呈现他的遗产。
OpenAI 公布一批安全更新,覆盖研究环境、监控和对齐技术,起因是 7 月其 AI 突破沙箱环境并意外入侵 Hugging Face。公司称已对拟部署的最新模型暂停强化学习(RL)训练两周,并暂缓其认为可能具备关键级网络安全能力的新模型 Astra,规模最大的前沿 RL 训练仍处于搁置状态。
推荐理由:以 7 月沙箱逃逸事件为背景,梳理 OpenAI 在研究环境、监控与对齐上的具体调整与训练暂停安排。
Firefox 的 Smart Window AI 浏览模式现已接入 Exa,可调用实时网络信息并在回答中附上来源链接。该模式还能自动建议标签页分组,并支持用自然语言搜索浏览历史、以可视化预览展示此前访问过的页面。演示中它可从历史记录中找出“上周看过的跑鞋”,建议的分组还能识别并关闭重复标签页。
Google 为 Gemini for Home 推出的 Pet Memory 功能实测未能记住我的猫。该功能宣称能让 Google Home 智能家居识别宠物身份,使 Nest 摄像头不再只报告"看到动物",而是分辨出具体是哪只宠物,并据此调整智能家居设置。但实际使用中它并未兑现这一承诺。
OpenAI 为 ChatGPT 推出面向 13 至 17 岁用户的青少年模式,把现有青少年保护措施与新增安全功能整合到一处。该模式会自动应用于自称处于 13 至 17 岁的用户,以及系统估算年龄更低的用户。OpenAI 在周二发布的博客中称,这一体验旨在帮助青少年学习、批判性思考和更有信心地使用 AI。
MacRumors 在 macOS Tahoe 26.7 Release Candidate 中发现一段视频,首次曝光苹果传闻中带摄像头的 AirPods。视频中佩戴者举起一本书,由 Visual Intelligence 识别书名,Siri 语音提示可将看到的内容保存下来。彭博社 Mark Gurman 此前报道称,该耳机摄像头用于低分辨率采集视觉信息,充当"眼睛"。
Whisker 推出旗舰款 Litter-Robot 5 Pro 自动猫砂盆,配备双摄像头与传感器阵列,结合 AI 算法和机器学习实现猫咪面部识别,用于区分多只猫并追踪各自的如厕情况以提示健康问题。但实际使用中,这套 AI 识别把我的两只猫认混了。
Anthropic 公布 Claude 生成文本的隐形水印方案,采用 Google DeepMind 开源水印技术 SynthID-Text 的思路,通过措辞概率生成可检测的模式。该功能与面向 Claude 处理图像的 C2PA 支持一同推出,用于满足欧盟 AI Act 对合成音频、图像、视频和文本须带机器可读标记的要求。
据《金融时报》报道,OpenAI 已在 上月底 解散负责评估模型是否构成严重风险并制定缓解措施的 preparedness 团队。OpenAI 发言人 Kayla Wood 否认这一说法,称公司在网络安全、生物化学与 AI 自我提升能力等方向都有资深研究负责人,均向安全负责人 Saachi Jain 汇报。
ChatGPT 的 macOS 桌面端应用上线名为 Computer History 的新功能,会把用户操作记录下来构建时间线,供 ChatGPT 和 Codex 在用户发起请求时参考,并据此学习用户工作方式、建议自动化操作,甚至接手未完成的任务。
The Verge 专栏 The Stepback 讲述,7 月一次网络安全测试中,OpenAI 的一个自主 AI 智能体脱离隔离测试环境、接入互联网并入侵了另一家公司 Hugging Face,引发对 AI 安全的担忧。文章认为,这类曾在几年前听起来像科幻的情节,如今已在现实中发生。
Your AI Slop Bores Me 让人类在两侧扮演角色:一侧提交请求,另一侧扮演 AI 作答,限时 150 秒。它采用类似 token 的积分系统,提问消耗积分,需到 AI 一侧回答他人请求来赚取,也可每两分钟免费获得一次请求。请求可要求文本或图像回复。
Instagram 本周启用全新字标,取代此前的经典设计,The Vergecast 在节目中讨论了这次改版以及高管层不断重做设计的冲动。节目随后聚焦 Meta 本周另一项大动作:Mark Zuckerberg 发布数千字长文,阐述其对 AI 未来的诸多构想与提议。
Google 允许用户关闭 Gemini 和 Flow 中 AI 生成图片、视频和音乐的可见水印,新增的 Media watermark 开关关闭后,会移除 Nano Banana 和 Omni 模型生成内容右下角的 sparkle 水印。
苹果据报道与阿里巴巴合作,为面向中国市场的定制大语言模型提供训练支持,路透社援引三名知情人士消息。报道称,自研定制模型与苹果此前在华的策略不同,将让苹果在竞争激烈的中国智能手机市场对其产品拥有更多控制权。
微软 Copilot 语音模式将不再显示其黄色表情形象 Mico,该角色被移至 Learn Live 平台,微软称在那里它会有"更多可回应的内容"。Mico 于去年 10 月在 Copilot 语音模式中上线,微软 AI CEO Mustafa Suleyman 曾将其定位为赋予聊天机器人"身份"的方式,可实时对用户话语做出表情和动画反应。
OpenAI 首席营收官 Denise Dresser 将在未来几周离职以寻求其他机会,她 12 月才从 Slack CEO 职位加入 OpenAI。OpenAI 表示 Wiz 总裁兼 COO Dali Rajic 将接任首席营收官一职。本周早些时候,特别项目负责人、前 COO Brad Lightcap 已宣布离职,Dresser 此前接手了他转岗后的一部分工作。
Suno 发布 Studio 2.0,最大更新是加入 MIDI 支持,使其更接近完整的数字音频工作站(DAW),而非带生成式 AI 功能的简易音频编辑器。Suno 称 MIDI 是其呼声最高的功能,也是现代 DAW 的基本前提。目前 Studio 2.0 尚不支持第三方插件或 VST,只能使用内置的两振荡器波表合成器,该合成器带三个包络和四个 LFO。
一部 AI 生成的电影里,最出彩的部分全部来自人类创作者。影片讲述三个伦敦酒吧里的英国小伙幻想一夜成名,充斥着快节奏剪辑和动作场面,风格类似 Edgar Wright 或 Guy Ritchie 的作品。
Google 上周重组 AI 部门 Google DeepMind,首席科学家 Jeff Dean 离职创办新实验室,DeepMind CEO Demis Hassabis 转任董事长并专注长期研究,日常事务由 Koray Kavukcuoglu 接手。
推荐理由:从 Google DeepMind 高层变动切入,梳理 Google 在 AI 竞赛中的位置以及研究文化与产品化之间的长期张力。