一只巨猫突袭街角小店。 GPT-6 Astra 自己编写了 Blender 场景,然后由 PixVerse 渲染成这个 https://t.co/EdYpbaKo3G
X
关注 AI 研究者、开发者与机构的动态
按账号或来源筛选(541)
@PixVerse_@PixVerse_AI 评分3030 
Josh Woodward@joshwoodwardAI 评分4242引用Google Gemini@GeminiAppNow Gemini can connect with 13 new apps like @adobe, @squarespace, @onepeloton, and more. Instead of switching between tabs, you can now grow your business, design assets, and plan your workouts all in Gemini. 🧵
@elonmusk@elonmuskAI 评分2323 @elonmusk@elonmuskAI 评分2222 @AYi_AInotes@AYi_AInotesAI 评分4545
引用@AYi_AInotes@AYi_AInotes做 X 内容、做增长、想拿创作者收益的兄弟们,我干了件可能帮大家赚钱且少走半年弯路的事: 我决定把自用的这套 X Growth OS 增长操作系统开源给大家,回馈大家一直以来的关注和支持! 说实话,x是目前最值得投入的平台,我半年多副业都在x挣了有40多万,甚至说个暴论,要把x当做一家自己的公司去经营,X Growth OS 是一套纯本机优先、不可变草稿、每一步都在本地留下证据账本的独立系统。 为了把这套系统的逻辑彻底讲透,我顺手用最近大热的视频创作Pexo,全程纯聊天,从零到一捏了一条 45 秒完整的商业白板解说视频: 0 剪辑轨道、全程自然语言对齐,画面哪里不对直接在屏幕上画个红圈局部重绘,出来就是一条带配音、字幕和包装的可用成片! 我觉得对于做产品、搞运营、做知识科普的兄弟们, AI 视频圈真正能干活的生产力工具今天真的落地了, 绝逼是今年把商业视频门槛干得最碎的一次,没有之一! 你敲一句大白话: → 它在后台拉模型规划分镜、画线稿,自己去挑该用 Kling 还是海螺,把多轨剪辑和音画包装全包了; → 出来的不是一段需要你再导进剪辑软件缝合的 5 秒素材碎片,而是一条带配音、单行字幕、直接能发的 45 秒完整解说片; → 画面哪里不对,哪怕一个图标画错,不用切回剪辑软件,暂停视频在画面上画个圈批注,改字像在飞书文档里批注一样,鼠标画个圈打个点,它局部重绘,提示词不用删,更不用从头重抽! → 交付出来就是一条自带单行字幕、旁白、配乐和手绘动作的完整 45 秒商业成片! 我刚才拿自己刚做完的「X Growth OS 本机增长系统」45 秒产品白板视频做了一场全流程实测,咱们看下方视频: 我给它的第一道指令很简单:“把发推像拆炸弹的痛点,用真实人手拿着黑色马克笔在白纸上画出来,琥珀色代表决策,青绿色代表回执,先跑前 7 秒试片。” 指令一敲,它在后台直接开始拆解分镜, 很多人做视频第一步就踩坑: 迷信一句话直接生成大片,结果模型自由发散,出来的东西根本没法看。 Pexo 第一版试片给我弹了个花里胡哨的暗色 3D 风格, 我直接在对话框里回了一句:“风格太重,只要极简手绘线稿。”两秒钟后,白底黑线、真实人手画出散乱碎片的质感稳稳咬合住!把不确定性掐死在第 0 秒,整条片子的基调就不会跑偏。 确认完试片,后面 5 段顺着讲:划掉虚荣曝光、画出增长链路、画出不可变草稿与回执。 在同一个对话框里持续往下聊,它打破了传统 AI 视频 5 秒单次成片的硬顶,自己负责把段落拼合完整,并自动匹配语速节奏与转场,出来就是一条结构完整的长片,完全不用导出素材再进剪辑软件自己对音画。 最绝的是画面上的 Mark to Fix 批注修改,这绝对是全篇最聪明的一步: 做过视频的都懂以前有多崩溃, 憋脚本在 Notion,生成图在 Midjourney, 跑动效在 Kling 或 Hailuo, 最后还要扔进剪映拉几十条音轨与字幕轴,耗掉大半天拼出来的片子还是浓浓的拼接塑料感。 更搞人心态的是,一旦发现第 15 秒有个图标错了,整段提示词就得推倒重抽! 而在 Pexo 这里,就像在飞书文档里画圈批注一样: 直接在成片画面上框选打点,敲一句话告诉它把这里的按键改成青绿色回执,它结合对话上下文直接把那两秒局部修好,完全不需要切回剪辑软件切轨道。 前面定好的白纸黑线风格与冷色调标记,在生成后续因果图和数据看板时被它全部记住,不需要每开一次新对话就重新教一遍模型做人。 但先把丑话说在前头,这东西是搞生产力的兵器,绝不是拍大片的玩具, 如果你想拿它生成赛博朋克电影、漫威特效、或者搞短剧带货擦边,赶紧绕道,它压根就不是干这个的。 而且它绝不是闭眼不管的无脑生成器,你的输入 Brief 事实边界越糊,它画出来的逻辑就越扯。 你自己的业务逻辑和审美,依然是最后的总指挥。 它省的其实已经不是那几秒生成时间,是把以前找外包花两三千、在多轨剪辑软件里搬砖两天的折磨,彻底压缩成几轮确定性的对话。 做知识科普、产品说明、业务流程或者商业汇报的朋友,真的可以把工作流彻底更新一下了。 说穿了:视频模型在大脑里算得多快不重要,但能让你在画面上画圈改稿的双手,才真正决定一条视频能不能发出来。 大家平时做视频最烦哪个环节呢?我自己的感受是,在剪辑软件里给几十个散碎片段对音频字幕轴,简直是对耐心的折磨hh。
@fofrAI@fofrAIAI 评分66 
@omarsar0@omarsar0AI 评分1919 @testingcatalog@testingcatalogAI 评分3939 

@kimmonismus@kimmonismusAI 评分55
SiliconFlow@SiliconFlowAIAI 评分3636
@kimmonismus@kimmonismusAI 评分3434 
@GeminiApp@GeminiAppAI 评分5858 
@GeminiApp@GeminiAppAI 评分4343 用 @Linear 创建、管理并跟踪 issue 和项目周期。 只需让 Gemini“显示 Linear 上分配给我的所有高优先级 issue。” https://t.co/TJNTaPQXgm

@GeminiApp@GeminiAppAI 评分3434 
@GeminiApp@GeminiAppAI 评分3333 用 @WisprFlow 总结会议、记录语音笔记并提取行动项。 只需对 Gemini 说“查一下我最近和 Wispr 的会议得出了哪些决定。” https://t.co/jx6V1F5ayF

@GeminiApp@GeminiAppAI 评分2929 
@GeminiApp@GeminiAppAI 评分4343 
@GeminiApp@GeminiAppAI 评分4848 
@GeminiApp@GeminiAppAI 评分2626 用 @Squarespace 头脑风暴并搜索域名。 只需让 Gemini“在 Squarespace 为我的新室内设计业务找域名。” https://t.co/OdMlawadH6

@GeminiApp@GeminiAppAI 评分3232 
@GeminiApp@GeminiAppAI 评分3737 
@GeminiApp@GeminiAppAI 评分4848 
@GeminiApp@GeminiAppAI 评分3636 
@GeminiApp@GeminiAppAI 评分5151 
@GeminiApp@GeminiAppAI 评分5353 
@ZHO_ZHO_ZHO@ZHO_ZHO_ZHOAI 评分2929 


@kimmonismus@kimmonismusAI 评分4343 正式确认:特朗普正指示“所有美国官方文件”将 AI 称为“超级智能”。 人工智能将在所有官方文件中被重新命名为超级智能。

Microsoft Research@MSFTResearchAI 评分3131
@cb_doge@cb_dogeAI 评分3939 
Google Gemini@GeminiAppAI 评分4141
@PixVerse_@PixVerse_AI 评分55 @PixVerse_@PixVerse_AI 评分3030 
@fofrAI@fofrAI精选AI 评分6666
引用@OfficialLoganK@OfficialLoganKIntroducing Gemini 3.8 Flash and Flash-Lite TTS, our new SOTA text to speech model with: - a new voice design experience - 2,000+ production ready voices - voice replication - support for 100 languages - voice remixing (soon) - #1 spot on Hume AI's voice benchmarks and more!!
推荐理由:作者的 Singing 风格实测展示可作为判断该 TTS 旋律生成表现的直观参考。
@emollick@emollickAI 评分99 我很感谢那些关于隐藏事件的提及,我相信确实有一些,但如果能知道有没有关于 AI 内部使用的公开案例,那会非常有用? 现在职场中已有数亿人可以使用 AI……
@OpenRouter@OpenRouterAI 评分3737 
@fofrAI@fofrAIAI 评分5858
引用@GoogleDeepMind@GoogleDeepMindCreate and deploy custom audio with our new text-to-speech models: 🔵 Gemini 3.8 Flash TTS: Design unique voices with distinct accents and characteristics. 🔵 Gemini 3.8 Flash-Lite TTS: Built for efficiency and scale, choose from your created styles or our expansive production-ready library.
@deedydas@deedydasAI 评分3939 Opus 5.5 在指令式视频生成上表现出色,作者用约 1 分钟、约 2 美元成本为一家推理创业公司制作了发布视频,而这类视频过去需要数周甚至数月、依赖代理商协作且成本高出 1000 倍。

Cursor@cursor_aiAI 评分3939我们通过更精简的提示词、选择性工具加载、更好的缓存以及压缩文件读取,将 Cursor 的 token 成本降低了 7%,且智能体质量没有下降。

@OfficialLoganK@OfficialLoganKAI 评分2424 @OfficialLoganK@OfficialLoganKAI 评分4343 所有这些,加上 @GoogleAIStudio 中的全新体验,成本比我们之前的 3.1 Flash TTS 模型更低! 阅读更多:https://t.co/GdYBOw66WW