#视频
#视频
今日 14 条
Kling AI@Kling_aiAI 评分5555
Kling AI@Kling_aiAI 评分2121等待结束。节奏回归。 THE BEAT,由可灵 4.0 创作,讲述一位鼓手重返舞台的旅程。“WATCH ME PLAY.”

Hugging Face Daily PapersAI 评分3333 视频-音频联合与跨模态生成及编辑:统一形式化与设计分类体系
一篇综述将联合生成、跨模态生成与联合编辑统一形式化为音视频对分布上的三类问题,并提出沿五个设计轴比较方法的分类体系。该工作称首次系统梳理联合音视频编辑,将其划分为九类编辑、涵盖 28 种编辑类型,并整理了各设定的方法、数据集与指标。
Kling AI@Kling_aiAI 评分1010
Deedy@deedydasAI 评分2828我最喜欢的 Paul Graham 文章《如何做出伟大的工作》,浓缩在不到 200 秒的视频里 (感谢 opus)

Hugging Face Daily PapersAI 评分4242 DataMagic:通过声明式多智能体编排创作数据视频
DataMagic 提出一种从原始表格数据自动生成数据视频的声明式多智能体编排方法。其 DVSpec 规范统一图表、旁白与动画并保证数据溯源,配合“先生成后编排”策略优化叙事连贯性。在 109 个真实样本上,DataMagic 将质量分数从 GPT-5 的 2.13/5 提升至 3.89(+83%),执行成功率超 95%,并将创作耗时降低 79.7%。
Jeff Dean@JeffDeanAI 评分3030引用Deedy@deedydasclaude just generated this 2 minute video about the history of Google and it goes so goddamn hard
Deedy@deedydasAI 评分2727claude 刚刚生成了这段 2 分钟的关于 Google 历史的视频,简直太炸了

Krea@krea_aiAI 评分5757Krea AI 宣布 Krea Agent 支持 motion references 功能,可从任意视频片段中提取动作,并赋予新的角色、场景或元素。功能现已开放使用。

ViggleAI@ViggleAIAI 评分3131Google 下周要把 TPU 送上轨道了,所以我们也不得不跟上。 在 Viggle Animate 上把任何人换成 Hotel Lobby 趋势。

Runway NewsAI 评分4848 Runway 用 Model Router 评估成本与质量:$1 上限可省 66% 成本
Runway Dev 的 Model Router 可按成本、质量或延迟偏好为每次请求自动选模型,其评测显示质量优化路由在 250 条图生视频提示上把单条成本从 Seedance 2.5 基线的 $1.80 降至 $1.28(-29%),可用率 77% 对 78%。
Google ResearchAI 评分5959 Google 发布 AI 视频联合导演研究,多智能体框架实现分钟级连贯长视频生成
Google Research 发布 AI video co-director 研究,基于 Gemini 和 Veo 构建统一多智能体框架,包含 Co-Director(COLM 2026)、CANVAS(EMNLP 2026)、A²RD 和 VQQA 四个框架,将长视频生成转化为全局优化与世界状态跟踪问题,自动完成多模型提示、镜头衔接和闭环视觉精修。
MiniMax (official)@MiniMax_AIAI 评分2929用 MiniMax-H3 构建的更多方式。🐮 很高兴看到模型优化与 AMD 推理工程结合,为创作者带来更快的反馈循环。⚡️
引用Nunchux AI@NunchuxAI5s of video, generated in 1.3s! Nunchux brings @MiniMax’s MiniMax-H3 to @AMD MI355X with up to 26.7× faster inference than SGLang on 8 GPUs @AMDServer And with streaming generation, you can change the prompt as the video plays, steering what happens next. One stack, optimized across hardware. Free access to MiniMax-H3 is coming soon! Join the waitlist now at http://nunchux.ai. Our blog: https://www.nunchux.ai/blog/video-generation-on-amd-mi355x #AI #VideoGeneration #MiniMaxH3
Runway News精选AI 评分6363 Runway 发布 DaVinci Resolve 插件,可在剪辑软件内直接生成和重绘素材
Runway 发布 DaVinci Resolve 插件,用户可在 Resolve Studio 内直接生成图像和视频、重绘播放头所在片段,结果自动导入 Media Pool 并上到时间线。
推荐理由:原文说明了插件在剪辑流程内生成和重绘的具体用法与付费条件,剪辑用户可据此判断是否改变现有工作流。
OpenAI NewsAI 评分2525 invideo 如何借助 GPT-6 Astra 将调色效率提升 3 倍
invideo 借助 GPT-6 Astra 更精准地规划剪辑,将色彩校正与调色效率提升 3 倍,并在一天内生成 50 个自定义特效。
Josh Woodward@joshwoodwardAI 评分4242引用Google Flow@FlowbyGoogleMore than 25 million people are using Google Flow every month to dream up new ideas, create stories, and build cool things. Thank you. We’re continuing the 50 additional daily credits for all users. Dive in and keep creating.
OpenAI NewsAI 评分2828 Higgsfield AI 借助 GPT-6 Astra 一天内上线新视频功能
Higgsfield AI 借助 GPT-6 Astra,一天内上线新视频功能,让小型企业更轻松地制作视频广告,并更快将新创意工具推向市场。
elsewhere articlesAI 评分4646 XGEN 车昊轩:不做「世界模型」,做生成式世界模拟
29 岁的车昊轩创办 XGEN,提出 interactive experience model(主观体验模型)与 generative world simulation(生成式世界模拟),用 World State 与 Render 分层架构分离训练,聚焦长程一致,让世界运行几十分钟后角色、状态与因果仍自洽。
Krea@krea_aiAI 评分2626这段视频 100% 由 Krea Agent 生成。 下方了解方法 👇

Kling AI@Kling_aiAI 评分2828在传统影视行业深耕30年后,Diane Shorthouse正在探索AI如何拓展电影创作者的边界。从更安全的制作流程到为AI角色赋予富有情感的表演,她分享了自己用可灵AI制作MINIBOTS的经历。

MiniMax (official)@MiniMax_AIAI 评分3434
引用Nunchux AI@NunchuxAIIntroducing VC-Attention: fast and accurate low-bit attention without retraining. On MiniMax-H3, VC-Attention speeds up attention by 1.6× on B200 and 1.5× on B300 over FlashAttention-4, with better fidelity than SageAttention2. It also works with existing sparse attention methods. Two key innovations: • V-Smooth reduces value quantization error. • ExpCast-FP8 speeds up softmax. Nunchux Attention, our proprietary extension, pushes the speedup to 1.9× on B200 and 1.8× on B300. Blog: http://www.nunchux.ai/blog/attention-is-the-video-bottleneck Technical Report: http://arxiv.org/pdf/2609.15810 Joint work by researchers at MIT, CMU, UC Berkeley, Stanford, and NVIDIA.
Runway NewsAI 评分4040 Runway 详解实时视频生成的同步审核系统
Runway 为即将发布的实时视频生成模型设计了同步审核系统,采用 Zentropi 的 CoPE-B 模型,安全审查平均耗时不到 0.5 秒,可将违规内容暴露窗口压缩至半秒以内。CoPE-B 是基于 Gemma-4-26B-A4B-it 的 LoRA 适配器,该 MoE 模型总参数 25.2B、每次前向仅激活 3.8B,兼顾速度与准确率。实时模型输出将附带 C2PA 溯源信号。
ViggleAI@ViggleAIAI 评分5454
ViggleAI@ViggleAIAI 评分6262Viggle 宣布开源 viggle-animate 模型,可将任何人替换进任意视频中,同时提供在线快速试用版本。试用入口为 https://viggle.ai/meme/app/animate。
引用cocktail peanut@cocktailpeanutWe Must Pace the Frontier
ViggleAI@ViggleAIAI 评分4242你肯定没见过这个: GPT-6 Astra 用于场景与道具建模 + PINOC mcp 用于可动画的高斯泼溅角色
引用PINOC@Viggle_PINOCGPT-6 Astra can now generate animatable Gaussian Splat characters. We connected it to the PINOC MCP and asked for a backrooms-style, Exit 8-ish game. We described the character we wanted and the motions. [MCP link in the comment 👇] Astra generated the character and every motion through PINOC through free preset animations and text to animation, and wrote the loop and the anomaly logic itself, and shipped the whole thing in a few sessions.
Runway NewsAI 评分4747 VOIDZ 如何用 Runway Seedance 2.0 把 15 秒 VFX 短片扩展成 95 秒纪录片
匿名混合现实艺术家 VOIDZ 借助 Runway 的 Seedance 2.0,将原本受限于 10 到 15 秒的 3D 制作流程,扩展成 95 秒纪录片《Ends Meat》。
Google DeepMind@GoogleDeepMindAI 评分3131
Runway NewsAI 评分5353 Runway 详解实时视频生成研究:从 Gen-4.5 后训练到流式输出
Runway 分享其实时视频生成研究的整体思路,目标是把视频模型从整段生成转向优化首帧时间和随提示流式输出。方法上基于 Gen-4.5 等基础模型做后训练,先将架构改为时间因果、逐帧自回归生成,再通过两阶段分布匹配蒸馏(先 off-policy 后 on-policy)把每帧压缩到几步推理,配合渐增序列长度课程减少误差累积,同时针对并发会话构建推理服务栈。
OpenRouter AnnouncementsAI 评分5757 OpenRouter 评测 Seedance 2.5:长单镜头与视频引用场景的优势与取舍
OpenRouter 发布 Seedance 2.5 评测。该模型自 2026 年 8 月 7 日上线其视频 API,支持 4 到 30 秒、480p 或 720p、首尾帧控制及图像、视频、音频引用,音频同趟生成不加价。
Runway News精选AI 评分6363 Runway 发布 Adobe 插件,可在 Premiere Pro 与 After Effects 内直接生成和编辑
Runway 发布 Runway Plugins,推出面向 Premiere Pro 和 After Effects 的 Adobe 插件,在时间线内直接生成图像和视频、重绘素材并放置结果,无需导出再导入。
推荐理由:官方说明插件如何消除剪辑中反复导出导入的流程,生成结果直接落入时间线并沿用现有套餐额度。
Runway NewsAI 评分5353 Kinetix 团队加入 Runway,推进机器人世界模型研究
Runway 宣布巴黎 AI 研究实验室 Kinetix 团队加入 Runway。该团队在 3D 人体运动与物理约束视频生成方面的积累将用于 Runway 面向机器人学的世界模型研究,团队将加入 Runway 巴黎枢纽,公司同时在巴黎招聘研究与工程岗位。
Runway NewsAI 评分4848 Runway 推出 Team 团队协作套餐
Runway 发布 Team 套餐,面向协作创作团队,提供最多 100 个共享项目、Brand Kits 和 1TB 存储,每个席位每月向统一共享余额贡献 6,900 credits,未用完的 credits 可结转一个月。该套餐今日上线网页端,每席位每月 69 美元,按年付费为 55 美元(8 折),支持 2 至 9 人团队;Standard、Pro 和 Max 转为个人套餐。
Google AI Developers@googleaidevsAI 评分5050
Runway NewsAI 评分3535 Miro 如何用 Runway 为四地市场制作 Canvas26 主题演讲视频
Miro 品牌团队完全用 Runway 生成 Canvas26 年度活动开场视频,并针对 4 个城市分别制作本地化版本,所有城市景观、人群和入场镜头均由 Runway 生成,再叠加动效与品牌元素。团队用场馆照片作为 Runway 参考图生成对应地点的电影感入场镜头,并借助 Runway 原生生成非标准宽高比画面,避免 4K 素材裁切损失分辨率。
Fei-Fei Li@drfeifeiAI 评分5757引用World Labs@theworldlabsIntroducing Atlas: The world's first multimodal world model that generates image and video frames with pixel-perfect camera control and reconstructs them in 3D. Model the world, move the camera, and simulate space & time.
Google DeepMind精选AI 评分6868 Google DeepMind 为 Gemini 推出 agentic video understanding 视频分析功能
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出 agentic video understanding,动态检索视频片段以替代固定帧率处理,token 消耗最多降 88%,成本最多降 66%,准确率最多提升 7%。
推荐理由:官方给出 token、成本与准确率的具体降幅和开启方式,长视频处理场景下可评估是否切换处理模式。
Google DeepMind精选AI 评分7272 Google DeepMind 发布 Gemini Omni 1.1 Flash,强化生成式视频创作控制
Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者提供一组创意控制和生成式视频能力,可通过 Google AI Studio 中的 Gemini API 使用。
推荐理由:官方披露了场景扩展、首末帧插值、4K 放大等具体能力与可用入口,便于开发者评估是否迁移现有视频生成工作流。
OpenRouter Announcements精选AI 评分6060 OpenRouter 发布 Video Generation API 代码指南,一个端点调用 Seedance、Veo、Wan
OpenRouter 发布视频生成 API 教程,通过 POST /api/v1/videos 提交任务、轮询状态、下载 MP4,同一集成可用 Seedance 2.0、Veo 3.1、Wan 2.7,切换模型只需改 model 标识符。
推荐理由:OpenRouter 官方教程给出完整的异步视频生成集成代码,包括轮询、失败状态处理和换模型时需注意的参数差异,可直接迁移到自己的项目。
Runway NewsAI 评分3939 Runway 谈企业视频生成下一阶段:模型授权与智能体执行
Runway 企业业务今年增长逾一倍,NRR 超过 300%,一家 Fortune 20 客户使用量增长 17 倍。其企业客户已覆盖 Amazon、Microsoft、Allstate、Adobe、Robinhood 等,欧洲占企业客户群 20% 以上,日本成为亚洲最大市场。