Google / Gemini
全部主题Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。
当前仅显示精选新闻最新精选
第 141–160 条 · 共 258 条@googleaidevs@googleaidevs精选AI 评分7272
the-decoder.com(经 Hacker News)精选AI 评分7878 德国法院裁定 Google 需为 AI Overviews 的错误答案负责
德国一项裁决认定 Google 的 AI Overviews 输出属于 Google 自身言论,Google 因此需为其中的错误答案承担责任。该报道在 Hacker News 上获得 427 点、238 条评论。
推荐理由:德国法院把 AI Overviews 的输出归为 Google 自身言论,讨论集中在搜索平台对错误答案的责任边界。
@berryxia@berryxia精选AI 评分6767 引用Google for Developers (@googledevs)@googledevsGemini 3.5 Live Translate is now in Public Preview via the Gemini API, delivering low-latency speech-to-speech translation across 70+ languages and 2,000 language pairs! 🌍 Challenge time: What is the most niche, unique, or complex language pair your application needs to translate? Tell us in the comments, and we’ll let you know if the model supports it! Full blog link: goo.gle/3QzaHwN Video
推荐理由:Google 将 Gemini 3.5 实时语音翻译推向公开预览,可了解其对小众语言对的覆盖范围与 API 接入方式。
@berryxia@berryxia精选AI 评分6767 Google 开发者账号宣布,Gemini 模型现已通过 Apple 的 Foundation Models 框架和 Xcode 中的原生支持,向数百万 Apple 开发者开放。
引用Google for Developers (@googledevs)@googledevsGemini models are now accessible to millions of Apple developers through Apple’s Foundation Models framework and natively within Xcode. You can now easily swap between local and cloud inference using a shared API surface to build next-generation agentic app experiences, increase development velocity, and offload heavy workloads to the cloud. Additionally, you can use agentic coding assistance from Gemini in Xcode to accelerate multi-step development tasks. Check out the full announcement to get started: goo.gle/3Q1YDnD Video
推荐理由:该消息交代了 Gemini 接入 Xcode 与 Foundation Models 框架的具体入口,便于判断 Apple 开发者的模型选择格局。
IT Home精选AI 评分7676 谷歌发布实时语音互译模型 Gemini 3.5 Live Translate,可识别 70 余种语言
谷歌发布实时语音互译音频模型 Gemini 3.5 Live Translate,可自动识别 70 多种语言并生成保留说话者语调、语速和音高的翻译语音,翻译通常只比说话者慢几秒。
推荐理由:新模型用连续生成语音在上下文与即时性之间取得平衡,落地入口覆盖谷歌翻译、Meet 和 API。
@googleaidevs@googleaidevs精选AI 评分7070 推荐理由:原文列出 Google AI Studio 实时试玩入口与 Gemini Live API 的第三方集成伙伴,开发者可据此直接接入。
Google DeepMind精选AI 评分7979 Google DeepMind 发布 Gemini 3.5 Live Translate 语音翻译模型
Google DeepMind 发布音频模型 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译,自动检测语言并保留说话者的语调、节奏和音高,全程仅落后说话者几秒。
推荐理由:原文给出模型能力、开放渠道和 Meet 语言扩展细节,读者可据此评估它在会议和翻译场景的可用性。
Google DeepMind精选AI 评分6767 Google DeepMind 发布 Gemma 4 12B:无编码器统一架构的多模态模型
Google DeepMind 发布 Gemma 4 12B,采用无编码器统一架构,视觉与音频输入直接进入 LLM backbone,是该系列首个支持原生音频输入的中等规模模型。
推荐理由:官方说明新模型以无编码器统一架构把性能接近 26B 的多模态能力压到 16GB 内存笔记本可跑,开发者可据此评估端侧部署选择。
@kimmonismus@kimmonismus精选AI 评分6868 Apple 发布新一代基础模型,共五款,均与 Google 合作打造,其中 AFM 3 Core Advanced 是 200 亿参数、完全在 iPhone 17 Pro 端侧运行的模型。


推荐理由:原文交代了 200 亿参数端侧模型用专家分片加载绕过 DRAM 瓶颈的思路,可据此了解其实现路径。
AI前线 · 微信公众号精选AI 评分8888 OpenAI 秘密提交 IPO 申请,估值超 8500 亿美元
OpenAI 已向美国证券交易委员会秘密提交 IPO 申请,公司当前估值超过 8500 亿美元,并一直在为最早今年第四季度上市做准备。公司称尚未确定上市时机与募资金额,此次提交让未来合适时能更快推进上市。就在一周前,Anthropic 也宣布秘密提交 IPO 申请,其估值达 9650 亿美元;SpaceX 已启动路演,三者的上市进程被视为检验市场对 AI 企业热情的风向标。
推荐理由:OpenAI、Anthropic 与 SpaceX 接连推进上市,读者可了解三家在融资与估值上的竞争节奏。
macrumors.com(经 Hacker News)精选AI 评分7878 Apple 公布围绕 Google Gemini 模型构建的新 AI 架构
MacRumors 报道称,Apple 公布了围绕 Google Gemini 模型构建的新 AI 架构,原文链接为 https://www.macrumors.com/2026/06/08/apple-reveals-new-ai-architecture/ 。该条目在 Hacker News 获得 199 分、166 条评论。
@kimmonismus@kimmonismus精选AI 评分7373 苹果在 WWDC 2026 发布全量重建的 Siri AI,可读取屏幕内容、从消息邮件与相册中提取上下文并串联跨应用操作,同时上线独立 Siri 应用,对话历史通过 iCloud 同步。


推荐理由:作者以现场视角梳理 Siri AI 的 Gemini 底层与发布会取舍,便于读者对照官方信息理解苹果补了什么、缺了什么。
Google DeepMind精选AI 评分6464 Google DeepMind 发布塞拉利昂 Gemini Guided Learning 教学试验结果
Google DeepMind 公布在塞拉利昂开展的预注册试验结果,使用 Guided Learning 的学生数学成绩较对照组提升 0.258 个标准差,约合 1.2 到 1.7 年的典型学习进度,八周内完成。
推荐理由:预注册试验给出了量化学习增益和保护批判性思维的交互数据,为评估 AI 辅助教学提供了可对照的证据。
量子位 · 微信公众号精选AI 评分7676 SpaceX IPO 路演 PPT 曝光:以 AI 算力为核心叙事,估值 1.77 万亿美元
SpaceX 在 IPO 路演 PPT 中计划于纳斯达克上市,发行 5.556 亿股、每股 135 美元,预计 6 月 11 日定价,估值 1.77 万亿美元。PPT 把 SpaceX 重新定位为横跨太空、通信与 AI 算力的未来基础设施公司,募资用于扩建 AI 算力基础设施、升级发射设施与运载火箭等。文件还给出轨道 AI 算力路线图,并提到谷歌将每月付费 9.2 亿美元租用 xAI 的算力。
推荐理由:SpaceX 在 IPO 路演中将 AI 算力写进核心叙事,读者可据此看到太空、通信与 AI 如何被打包成同一套估值逻辑。
IT Home精选AI 评分7777 谷歌每月向 SpaceX 支付 9.2 亿美元租用 AI 算力,含约 11 万张英伟达 GPU
谷歌与 SpaceX 达成云计算合作,计划自 2026 年 10 月起至 2029 年 6 月每月支付 9.2 亿美元租用数据中心算力。租赁内容涵盖至少 11 万张英伟达 GPU、CPU 等芯片对应的计算能力,主要面向训练和推理等 AI 高密度场景。华尔街日报认为,这既能缓解谷歌的算力供应紧张与扩容周期压力,也为 SpaceX 的 AI 业务新增一条收入来源,为其 IPO 提供叙事筹码。
推荐理由:协议披露了按月支付的算力租赁规模与起止时间,读者可据此观察谷歌的算力缺口与 SpaceX 的 AI 收入布局。
@googleaidevs@googleaidevs精选AI 评分7171 推荐理由:文章列出 Gemma 4 QAT 的 GGUF 与移动端两种量化方案,可用于判断本地部署的体积与质量取舍。
@GeminiApp@geminiapp精选AI 评分6666 推荐理由:官方给出了提问方式和操作路径,读者可以据此了解 Gemini Live 实时图像生成与编辑的使用门槛。
Google Research精选AI 评分6363 Google Research 发布 PHRM 系统,用手机前摄在日常生活中被动监测心率与静息心率
Google Research 在 Nature 发表 PHRM 研究系统,利用人脸解锁后的前摄视频,在日用手机过程中后台跟踪心率与每日静息心率(RHR)。
推荐理由:原文给出跨肤色验证数据和开放数据集申请入口,读者可以据此评估手机摄像头被动心率监测的可用性。
Hugging Face Blog精选AI 评分6161 NVIDIA 发布 Nemotron 3.5 Content Safety 多模态安全模型
NVIDIA 发布 Nemotron 3.5 Content Safety,基于 Google Gemma 3 4B IT 微调,把多模态输入、自定义企业策略与可审计推理链统一到单次推理调用中,并保持 12 种语言显式训练和约 140 种语言的零样本泛化。
推荐理由:相比 Nemotron 3,3.5 版把多模态审核、自定义策略与可审计推理链合并到一次调用中。
@googleaidevs@googleaidevs精选AI 评分6969 引用Google Magenta Project (@GoogleMagenta)@GoogleMagentaIntroducing Magenta RealTime 2 (MRT2): the live music model you can play as an instrument. MRT2 offers MIDI and prompt controls, and runs natively on a MacBook with <200ms latency. Open weights. Open source inference engine. Suite of apps and plugins. Hear what it can do and try it out for yourself below 🧵 Video
推荐理由:开放权重与开源推理引擎一并给出,读者可了解实时音乐模型在笔记本上的本地延迟表现。