实测 Today AI:一个创作者和 Personal AI 助理相处的一周
Today AI 今年 9 月在国内面向用户开放,定位「Personal AI 助理」,已支持 macOS、Windows、Linux、iOS 四个平台。它以 Memory 积累用户偏好,通过简报卡片和 Proactive 交互主动推进工作,可查询本地 Obsidian 文章库、整理 Gmail 邮件、生成 HTML 交付物并写入 Google Calendar。
Today AI 今年 9 月在国内面向用户开放,定位「Personal AI 助理」,已支持 macOS、Windows、Linux、iOS 四个平台。它以 Memory 积累用户偏好,通过简报卡片和 Proactive 交互主动推进工作,可查询本地 Obsidian 文章库、整理 Gmail 邮件、生成 HTML 交付物并写入 Google Calendar。
Latent Space 采访 Runway CTO Kamil Sindi 与研究科学家 Robin Kahlow,解读 GWM Worlds 2 新功能 WorldPrompt。
Krea 即将登陆 @Muse。 你想让 Muse 先做什么?
Google 下周要把 TPU 送上轨道了,所以我们也不得不跟上。 在 Viggle Animate 上把任何人换成 Hotel Lobby 趋势。
Runway Dev 的 Model Router 可按成本、质量或延迟偏好为每次请求自动选模型,其评测显示质量优化路由在 250 条图生视频提示上把单条成本从 Seedance 2.5 基线的 $1.80 降至 $1.28(-29%),可用率 77% 对 78%。
Google Research 发布 AI video co-director 研究,基于 Gemini 和 Veo 构建统一多智能体框架,包含 Co-Director(COLM 2026)、CANVAS(EMNLP 2026)、A²RD 和 VQQA 四个框架,将长视频生成转化为全局优化与世界状态跟踪问题,自动完成多模型提示、镜头衔接和闭环视觉精修。
Datasette 1.0a41 发布,Alec Garcia 为该版本加入了 OpenTelemetry 支持。该版本还把 Datasette 所有模态对话框重构为单一 Web Component,并已提供文档供其他插件使用。
Claude Code 发布 v2.1.282,新增 maxProseWidth 设置,可限制宽终端中 Claude 正文宽度,表格与代码块仍保持全宽。该版本还新增启动提示及 /status、claude doctor 条目,列出项目设置文件中被忽略或关闭遥测的变量,并修复了会话续接重发旧消息、扩展思考丢失及多处 API 报错等问题。




在 Krea Agent 中推出自定义应用。 构建按你想要的方式工作的创意工具。角色工作室、3D 查看器、动态效果。只需描述这个应用。 了解更多 + 示例见下方 👇
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,为对话模型加入近实时视频生成与视觉形象,今日起在 Gemini Enterprise 提供。该功能支持精确唇形同步、异步工具调用不中断对话、跨 97 种语言的语音到语音同步,并可用参考图定制头像(需企业允许名单),所有输出带 SynthID 水印。
在北美找工作?💼 让 WorkBuddy 在每一步帮你——从打磨简历、准备面试到比较工作机会。 你的下一个机会,可能始于一个正确的问题。
推出 Agora-2,我们的新一代多智能体世界模型。 Agora-2 支持最多 20 个人类与智能体在同一共享环境中互动,全部实时模拟。 我们的多人研究预览版现已开放体验!
Hy Image 3.5 preview is now live on GMI Cloud @TencentHunyuan $0.024 per image 8.8x cheaper than GPT Image 2 5.6x cheaper than Nano Banana Pro Create now 👇
用 MiniMax-H3 构建的更多方式。🐮 很高兴看到模型优化与 AMD 推理工程结合,为创作者带来更快的反馈循环。⚡️
5s of video, generated in 1.3s! Nunchux brings @MiniMax’s MiniMax-H3 to @AMD MI355X with up to 26.7× faster inference than SGLang on 8 GPUs @AMDServer And with streaming generation, you can change the prompt as the video plays, steering what happens next. One stack, optimized across hardware. Free access to MiniMax-H3 is coming soon! Join the waitlist now at http://nunchux.ai. Our blog: https://www.nunchux.ai/blog/video-generation-on-amd-mi355x #AI #VideoGeneration #MiniMaxH3
元宝节前更新上线旅游计划 Agent,可在 APP 对话中触发,也能把微信聊天记录多选转发给它整理需求。它会实时搜索门票预约规则等信息,输出可交互行程卡,并调用混元 Hy Image3.5 preview 生成攻略图,还能推荐徒步装备并跳转京东小程序加购。
Google Cloud API Gateway 进入 Public Preview,可充当远程 MCP 服务器,无需单独搭建 MCP 服务器即可把现有 REST 操作变成智能体可调用的 MCP 工具。
推荐理由:官方宣布 API Gateway 可直接充当远程 MCP 服务器,复用既有鉴权与配额,无需另建 MCP 服务器,适合评估 Agent 接入现有 API 的路径。
Meta 宣布把 Private Processing 机密计算基础设施扩展到 Meta AI 眼镜,让 AI 在云端 CVM 内处理个人上下文,连 Meta 自己也无法访问数据。系统基于 TEE 硬件隔离,采用匿名凭证加第三方 OHTTP 中继实现不可定向路由,通过 RA-TLS 远程证明核对公开透明账本,持久记忆以用户密钥加密存储在 TEE 内,并扩展 Bug Bounty 供外部研究者审计。
Runway 发布 DaVinci Resolve 插件,用户可在 Resolve Studio 内直接生成图像和视频、重绘播放头所在片段,结果自动导入 Media Pool 并上到时间线。
推荐理由:原文说明了插件在剪辑流程内生成和重绘的具体用法与付费条件,剪辑用户可据此判断是否改变现有工作流。
interactive media will be huge in the next year or two! this is incredible
Claude Opus 5.5 with PINOC MCP one shotted this: A playable Minecraft recreation Link, prompt and more examples below 🧵
推荐理由:官方宣布 Claude Marketplace 上线,读者可以据此了解连接器、Agent 产品和服务伙伴三类入口的实际内容。
Claude Code v2.1.281 为 Claude apps gateway 新增 Bedrock upstream 的 assume_role 与 guardrail 配置,并支持在 settings.json 中设置 "attribution": false 隐藏提交与 PR 署名。该版本还修复了会话恢复时重发历史、提示缓存丢失、代理中断流被误判为完成等多项问题。
We heard you loud and clear. ChatGPT Voice can now: - Use plugins like your email, calendar, and Slack. - Be powered by GPT-6 Astra, Sol, and Luna. - Be used in ChatGPT Work on web and mobile, so you can create docs, decks, sites, and spreadsheets or tackle complex tasks in the browser, just by talking. Rolling out globally today in the latest version of the app.
推荐理由:原文列出了语音可用的插件类型和可用入口,读者可以据此判断日常语音助手工作流会有哪些变化。
Google Beam 正式扩展至美国、加拿大、英国、法国、德国和日本六国,由 18 家渠道合作伙伴支持部署,旗舰硬件为 HP Dimension with Google Beam。
推出 ACTx486,一种全新交互式媒介的研究演示。 如果你能和任何视频对话,想问什么就问什么,会怎样? 我们的系统将一档现有播客变成了能倾听、能回应、能适应的东西。 研究来自 @jakubzeg:
Now Gemini can connect with 13 new apps like @adobe, @squarespace, @onepeloton, and more. Instead of switching between tabs, you can now grow your business, design assets, and plan your workouts all in Gemini. 🧵
Google Private AI Compute 团队宣布为 Private AI Compute 平台引入私密的服务端持久记忆,让 AI 助手能跨设备长期保留上下文。
LangChain 在 LangSmith 中推出 Custom Apps,可在 LangSmith 数据之上构建、发布并直接运行自定义 UI,免去托管、认证和权限维护。
Anthropic 恢复对输出前拒答的计费,仅限 stop_details.category 为 "bio"、"frontier_llm" 或 "reasoning_extraction" 三类,按实际运行模型的费率收费,其他类别输出前拒答仍不计费,该变更适用于所有平台。
作者宣布最新文本转语音与声音设计模型上线,现已在 AI Studio 中可用。新模型提供数千种可选声音,支持用提示词设计声音,可在 30 秒内复刻自己的声音,并提供表达性标签用于精细控制。
invideo 借助 GPT-6 Astra 更精准地规划剪辑,将色彩校正与调色效率提升 3 倍,并在一天内生成 50 个自定义特效。