Introducing Director Mode in CapCut Video Studio. The future of AI filmmaking. From first idea to final cut, Director Mode gives creators a faster and smarter way to build films, trailers, and music videos. One prompt. Endless possibilities. #capcutai @capcutapp capcut.com/?utm_medium=socia… Video
@berryxia
@berryxia · X · 历史来源 · 当前未持续收录
切换来源
@berryxia@berryxiaAI 评分4949 引用huangserva (@servasyy_ai)@servasyy_ai@berryxia@berryxia精选AI 评分6767
引用ChatGPT (@ChatGPTapp)@ChatGPTappHave you ever thought to yourself: I really don't want to make this PowerPoint. Good news: ChatGPT can now create and edit presentations directly in PowerPoint. Build, update, understand, and polish presentations directly in PowerPoint while keeping slides editable. Now in beta, we’d love your feedback 👀
推荐理由:原文给出了在 PowerPoint 内直接创建、编辑和润色演示文稿的能力变化,以及 beta 阶段的试用入口。
@berryxia@berryxia精选AI 评分6868 引用dadabots (@dadabots)@dadabots🥳 Announcing Stable Audio 3 🍕 🏆 fastest music models ever 💻 runs on MacBookPro M-series 🧪 break it plz 🧠 LoRA finetune in < 1h 📷 Sm = faster, Medium = qualityer ⚡ 59x realtime on M5 Pro One-liner fast install: curl -LsSf dadabots.com/_/sa3-mac | bash Video
推荐理由:Stable Audio 3 给出在 Mac 本地运行音乐生成的安装方式与性能数据,可据此判断本地音乐生成工作流的可行性。
@berryxia@berryxiaAI 评分66 @berryxia@berryxiaAI 评分3939
引用Bloome (@Bloome_im)@Bloome_imBloome is officially live. The first messaging app where humans and AI agents share the same group chat — as teammates, not tools. Multi-Agent. One room. Let's work. 1,000 invite codes only. Video
@berryxia@berryxiaAI 评分3636
引用Jonathan Cooper (@GameAnim)@GameAnimApple's Persona team continuing to do amazing work with face capture and animation. New paper released ahead of WWDC26 apple.github.io/ml-headsup/ Video
@berryxia@berryxiaAI 评分2626 YoLo这个传统模型在AI这一波来了之后,迭代速度和优化支持越来愈好。 支持交通信号灯的智能辅助系统,通过识别红绿灯和等待时间来辅助整个交通系统。
引用Ultralytics (@ultralytics)@ultralyticsDetect road signs and pedestrian symbols with Ultralytics YOLO26! 🚸 Identify traffic signs and walking signals in real time to support safer streets, driver assistance systems, and smart city traffic monitoring. Read more ➡️ bit.ly/4mpJsAr #Ultralytics #SmartCities #ComputerVision Video
@berryxia@berryxiaAI 评分3636
引用Nic Cruz Patane (@niccruzpatane)@niccruzpataneTesla Optimus V2.5 walking dynamics are now much more human-like. Huge improvement over previous versions. It’s walking with confidence. Video
@berryxia@berryxiaAI 评分5454 引用Google Gemini (@GeminiApp)@GeminiAppGet a head start on your day with Daily Brief. Gemini can now proactively flag what matters most in an easily digestible to-do list, so you’re ready for the day before you even finish breakfast.
@berryxia@berryxiaAI 评分6464 Codex 推出 Appshots,用户在 Mac 上双击 Command 键即可把当前应用窗口附加到 Codex 对话,Codex 会同时获取窗口截图和文字,包括屏幕上未显示的部分。
引用OpenAI Developers (@OpenAIDevs)@OpenAIDevsIt’s Codex Thursday, and yes, we have updates for you. First up: Appshots, a new way to bring the context of what you’re working on into Codex. On your Mac, press Command-Command to attach your app window to a Codex thread. Codex gets both a screenshot and text from the window, including content beyond what’s visible onscreen. Appshots are available across plans on Mac, with enterprise access coming soon. Video
@berryxia@berryxiaAI 评分4848 最近𝕏 开始支持和拥抱各种生态,从小龙虾、Hermes 再到直接工具类的 OpenCode。 如今你可以直接在 OpenCode 中使用 Grok 或者𝕏 Premium 的订阅
引用OpenCode (@opencode)@opencodeOpenCode can now officially be used with your Grok or X Premium subscriptions Try it with the new Grok Build model
@berryxia@berryxiaAI 评分3838
引用𝗖𝘆𝗱𝗶𝗮𝗿 (@Cydiar404)@Cydiar404团队小伙伴受到 Zara 的启发,闲暇时间搞了一个 Magic Slide 项目(终于发了,其实早就搞出来了),解决了日常 Slide 产出问题,欢迎大家一起体验,转场和效果非常丝滑!联网和部分模型使用我们自己的网关 PIPELLM 完成,顺便多说一句,哈哈哈!目前团队除了C端产品之外,大多数的时间和精力都在做 AI Infra 事情! magicslide.show
@berryxia@berryxiaAI 评分44 
@berryxia@berryxiaAI 评分6262
引用Logan Kilpatrick (@OfficialLoganK)@OfficialLoganKVery excited that @GoogleAIStudio is coming to mobile (both Android and iOS) with native apps! We rebuilt the vibe coding experience to bring it to even more people in a form factor that feels approachable + simple iOS: apps.apple.com/us/app/google… Android: play.google.com/store/apps/d…
@berryxia@berryxiaAI 评分5555 Telegram 更新收件箱功能,可指派机器人代为读取和回复消息,让收件箱自动运转。用户还能精细化管控机器人的权限与聊天访问范围。

@berryxia@berryxiaAI 评分4545
引用Berryxia.AI (@berryxia)@berryxia兄弟们! 今天已经可以在ZenMux上免费体验Gemini 3.5 Flash 了! 我第一时间用它跑了那个经典的「AI模型递归二叉树生长测试」. 同一个 Prompt ,不同模型画出的树形态完全不一样。(见视频-Prompt见评论区) Gemini 3.5 Flash 从输入提示词到生成完整 HTML 动画网页(树干慢慢长出、分支递归展开、最后随风摇摆),全程只用了 77.56 秒! 整体效果非常惊艳:树形态自然优雅、生长动画丝滑、视频和内容呈现都顶级! 熟悉的老朋友都知道,ZenMux 每次新模型都是 ZeroDelay 首发. Google I/O 2026 今天刚发布,现在立刻就能通过 API 调用! 还有免费额度可以白嫖~ 速度是真的没话说,还完美保留了旗舰级模型的能力。 专为 Agent 设计,在 MCP Atlas、Toolathlon、Finance Agent 等多项榜单直接拿下第一! 多模态理解也极强:MMMU-Pro 83.6%、CharXiv Reasoning 84.2%,全面超越上一代 Gemini 3.1 Pro。 完全兼容主流 API 格式,无需改动现有工具链。 支持按量计费 + Builder 套餐。 👇 直接体验 正式版 → zenmux.ai/google/gemini-3.5-… 免费试用 → zenmux.ai/google/gemini-3.5-… Video
@berryxia@berryxiaAI 评分2020 项目地址:github.com/MemTensor/MemOS
@berryxia@berryxiaAI 评分5757
引用耳朵 (@RookieRicardoR)@RookieRicardoRMemOS 又有新进展了。 现在搞 AI Memory 的方案不少,但很多还是把聊天记录存下来这个层面,看着像有记忆,实际上就是给 markdown 加了一个语义检索。 @MemOS_dev 做记忆系统已经有一段时间了,从 1.0 一路走到 2.0,现在回头看其实一个共识在慢慢变清晰:下一步真正决定 Agent 好不好用的,已经不是模型参数本身了,是它能不能在你自己的本地世界里,持续学习,沉淀经验,记住反馈,复用能力。 最近 MemOS Local Plugin 2.0 正式上线后,我研究了一下它的新特性。 这次更新我觉得最值得拿来说的功能,叫“执行即学习”。 它不是只存对话,而是当 Agent 在帮你完成任务的时候,把执行过程里那些关键步骤,拆成一个个可学习的单元,再转成可评分、可归因、可复用的认知资产。 换个好理解说法就是,它不只是记得你说过什么,它记得你和 Agent,是怎么一步一步做完一个任务的。 举个我自己最近的体感,用 OpenClaw 写一个小工具,第一轮把代码风格、命名习惯、错误处理写法一条一条说清楚,来回改了三四轮才顺手。 搁以前,换个对话或者过两天再来,这些东西基本就丢了,又得从头再讲一遍,这次 2.0 用上之后,第二天起新任务,它自己就把上一轮我们磨出来的那套写法直接用上了。 下面挨个说说这次更新的新特性:⬇️ github.com/MemTensor/MemOS/t…
@berryxia@berryxiaAI 评分1818 作者在书店观察到,约一半的人在用 AI 工具学习或工作,其中少数人使用 ChatGPT,且均为纯 chat 模式,未见有人使用 Claude 或 Codex。作者由此判断 AI 的发展还很早期。

@berryxia@berryxiaAI 评分5454 上周末多场美国大学毕业典礼上,演讲嘉宾一夸 AI 就遭台下嘘声。前 Google CEO Eric Schmidt 在亚利桑那大学把 AI 比作火箭船船票,称毕业生可以组建 AI agent 团队。
引用宝玉 (@dotey)@dotey上周末好几场美国大学毕业典礼上,只要演讲嘉宾一夸 AI,台下就开始嘘。 被嘘得最惨的是前 Google CEO Eric Schmidt。他在亚利桑那大学的演讲里把 AI 比作一张火箭船的船票,说毕业生可以“组建一支 AI agent 团队”去完成一个人做不到的事,结果嘘声越来越大,一度逼得他停下来。他改口安抚:"我知道你们在担心什么,这种恐惧是合理的。"但核心意思没变,AI 会塑造世界,你们要去引导它。台下不买账。 被轰的不止他一个。中佛罗里达大学,一位地产公司高管把 AI 称为“下一次工业革命”,当场被嘘;中田纳西州立大学,唱片公司 Big Machine Records 的 CEO Scott Borchetta 说 AI 正在改写整个行业,面对嘘声直接甩了句“接受现实吧,这就是个工具”。 学生的反感完全能理解,毕竟现在就业形势不算好,而站在台上劝他们拥抱 AI、说机会无限的,恰恰是推动这场变革、也在用 AI 砍岗位的那批人。Gallup 上月的调查显示,美国人对 AI 的兴奋和期待正在降温,愤怒在上升。 视频来源:nbcnews.com/video/multiple-c… Video
@berryxia@berryxiaAI 评分2222 AI&硬件的结合玩起来会很好,有点像当年的安卓刚出来的时期,大家都可以自定义ROM包刷机的感觉。
引用歸藏(guizang.ai) (@op7418)@op7418终于找到了这种墨水屏硬件最适合的场景: 开机的时候,让 AI 往里边推一个 To-do、日历,一些基础的需要记的信息 把它挂在屏幕边上(用磁吸) 关机的时候,利用墨水屏的特性让它显示名片,这样大家加好友什么的直接看就行 太实用了! 到时候打包成 Skills。有类似硬件的朋友到时候可以玩玩。
@berryxia@berryxiaAI 评分6060 引用Tesla (@Tesla)@TeslaFSD Supervised is now available in: - United States - Canada - Mexico - Puerto Rico - China - Australia - New Zealand - South Korea - The Netherlands - Lithuania
@berryxia@berryxiaAI 评分3636 
@berryxia@berryxiaAI 评分3838 微软举办了一场Claude使用工作坊,高级开发者布道师Marlene Mangami带开发者用Foundry + Claude动手搭建真实可用的AI Agent。

@berryxia@berryxiaAI 评分99 网站在这里:osirisai.live/ GitHub:github.com/simplifaisoul/osi…
@berryxia@berryxiaAI 评分1111 
@berryxia@berryxiaAI 评分5656 引用MasterPa (@HanyangWang)@HanyangWang小西天,看着像视频,但其实是我们在现场实地拍摄 3,811 张 206 GB 的照片后建模的。FUNES 把《黑神话:悟空》里「既见未来,为何不拜」满天神佛的原型,来自自山西临汾隰县的小西天,做成了一个可漫游的 3DGS 数字存档。 完全实地拍摄,每天清晨一开门就冲上山去,趁着没人的时候拍。然后通过 Gaussian Splatting 重建,没有手工建模,尽量保留真实悬塑和圆塑的极其密集的金色空间、细节和光感。不同的材质在这里交织成了无法分辨的一个天国世界。这种半空中的小塑像是「悬塑」,它们大多出现在十六世纪到十七世纪。 在现场如果要看清小西天的所有细节,我想大概需要三天时间。但是有了模型,我们可以在屏幕前慢慢看。在相当长的时间里,学术界并没有特别重视小西天这样的悬塑——因为在只有学术图录的年代,平面印刷无法展示出悬塑的震撼。而随着技术的进步,我们终于可以在远方一窥明代悬塑的璀璨。 重轻特意为这个模型做了配乐,大家可以打开慢慢欣赏。 推荐电脑访问:funes.world/apps/the-hanging… Video
@berryxia@berryxia精选AI 评分7373
引用Berryxia.AI (@berryxia)@berryxia兄弟们! 今天已经可以在ZenMux上免费体验Gemini 3.5 Flash 了! 我第一时间用它跑了那个经典的「AI模型递归二叉树生长测试」. 同一个 Prompt ,不同模型画出的树形态完全不一样。(见视频-Prompt见评论区) Gemini 3.5 Flash 从输入提示词到生成完整 HTML 动画网页(树干慢慢长出、分支递归展开、最后随风摇摆),全程只用了 77.56 秒! 整体效果非常惊艳:树形态自然优雅、生长动画丝滑、视频和内容呈现都顶级! 熟悉的老朋友都知道,ZenMux 每次新模型都是 ZeroDelay 首发. Google I/O 2026 今天刚发布,现在立刻就能通过 API 调用! 还有免费额度可以白嫖~ 速度是真的没话说,还完美保留了旗舰级模型的能力。 专为 Agent 设计,在 MCP Atlas、Toolathlon、Finance Agent 等多项榜单直接拿下第一! 多模态理解也极强:MMMU-Pro 83.6%、CharXiv Reasoning 84.2%,全面超越上一代 Gemini 3.1 Pro。 完全兼容主流 API 格式,无需改动现有工具链。 支持按量计费 + Builder 套餐。 👇 直接体验 正式版 → zenmux.ai/google/gemini-3.5-… 免费试用 → zenmux.ai/google/gemini-3.5-… Video
推荐理由:原文用基准与定价的对比说明 Flash 系列的定位变化,读者可据此重新评估轻量模型的成本预期。
@berryxia@berryxiaAI 评分5252
引用PaddlePaddle (@PaddlePaddle)@PaddlePaddle🚀 PaddleOCR 3.5: Transformers Backend Support Now Live! We're excited to share that PaddleOCR 3.5 now supports Hugging Face Transformers as an inference backend. Run PP-OCRv5 and PaddleOCR-VL 1.5 models directly within the Transformers ecosystem. ✨ What you get: 🔸 Run OCR models with engine="transformers" 🔸 Seamless integration for RAG & Document AI apps 🔸 Less friction, more natural HF stack connection 🔸 Same PaddleOCR pipeline, your favorite backend Big thanks to the @huggingface team for the collaboration! 🙌 🔗 Read the blog: huggingface.co/blog/PaddlePa… #PaddlePaddle #PaddleOCR #HuggingFace #Transformers #OCR
@berryxia@berryxiaAI 评分2525
引用Gaurav (@gauravsbuilding)@gauravsbuildingToday we're introducing Claude Code for Marketing. In one prompt, Fastlane deploys social media accounts, generates viral content, and posts everything for you automatically. This is beyond insanity. Video Community note: Anthropic has not released a product called "Claude Code for Marketing." Fastlane is an independent tool that automates content generation and posting, but it does not deploy social media accounts as claimed. anthropic.com/news usefastlane.ai
@berryxia@berryxiaAI 评分77 @berryxia@berryxiaAI 评分5252
引用Draw Things (@drawthingsapp)@drawthingsapp🔍 An interesting discovery! 🧩 Z-Image-Fun-Lora-Distill from alibaba-pai was originally trained for Z-Image Base, with 2-step, 4-step, and 8-step versions available. ⚡ But during some accidental testing in Draw Things, We found that Z Image Turbo paired with Z-Image-Fun-Lora-Distill delivers surprisingly excellent results, as shown in the comparison images below. 🚀 It can even reduce ZiT generation from 8–9 steps down to just 3–4 steps, which greatly shortens local generation time! 👇🏻 The comments include detailed generation settings and the LoRA link for reference.
@berryxia@berryxia精选AI 评分7272 
推荐理由:作者用递归树动画实测 Gemini 3.5 Flash 的生成速度,并列出其在 Agent 榜单与多模态基准上的成绩。
@berryxia@berryxiaAI 评分88 @berryxia@berryxiaAI 评分5656 引用向阳乔木 (@vista8)@vista8完成了第一项工作,开源自己常用的油猴脚本。 1. 小红书、抖音、微信贴图,截图粘贴自动上传。 2. Youtube字幕复制,倍速调节,复制字幕给NotebookLM、ChatGPT处理。 3. 小宇宙网页版倍速调整 开源地址:github.com/joeseesun/qiaomu-…
@berryxia@berryxiaAI 评分3434 @berryxia@berryxiaAI 评分4545 引用Berryxia.AI (@berryxia)@berryxia兄弟们! 今天已经可以在ZenMux上免费体验Gemini 3.5 Flash 了! 我第一时间用它跑了那个经典的「AI模型递归二叉树生长测试」. 同一个 Prompt ,不同模型画出的树形态完全不一样。(见视频-Prompt见评论区) Gemini 3.5 Flash 从输入提示词到生成完整 HTML 动画网页(树干慢慢长出、分支递归展开、最后随风摇摆),全程只用了 77.56 秒! 整体效果非常惊艳:树形态自然优雅、生长动画丝滑、视频和内容呈现都顶级! 熟悉的老朋友都知道,ZenMux 每次新模型都是 ZeroDelay 首发. Google I/O 2026 今天刚发布,现在立刻就能通过 API 调用! 还有免费额度可以白嫖~ 速度是真的没话说,还完美保留了旗舰级模型的能力。 专为 Agent 设计,在 MCP Atlas、Toolathlon、Finance Agent 等多项榜单直接拿下第一! 多模态理解也极强:MMMU-Pro 83.6%、CharXiv Reasoning 84.2%,全面超越上一代 Gemini 3.1 Pro。 完全兼容主流 API 格式,无需改动现有工具链。 支持按量计费 + Builder 套餐。 👇 直接体验 正式版 → zenmux.ai/google/gemini-3.5-… 免费试用 → zenmux.ai/google/gemini-3.5-… Video
@berryxia@berryxia精选AI 评分6565 
推荐理由:作者用同一递归树 Prompt 记录生成耗时与效果,并列出 Agent 与多模态榜单成绩,可快速判断该模型的能力定位。
@berryxia@berryxia精选AI 评分6666 Gemini 3.5 Flash 已在 ZenMux 上线并提供免费额度体验,也可通过 API 调用。作者用它跑递归二叉树生长测试,从输入提示词到生成完整 HTML 动画网页耗时 77.56 秒。

推荐理由:材料给出同一提示词下的生成耗时与多项榜单成绩,可作为了解 Gemini 3.5 Flash 速度与 Agent 能力的参考。
@berryxia@berryxiaAI 评分4444 继𝕏 Premium 支持 Hermes Agent后现在也支持OpenClaw的接入。 方法和教程其实类似,大家切换Model就行了~
引用Premium (@premium)@premiumNew for X Premium members: use your subscription directly in @openclaw. OpenClaw is an open-source, local-first agent and personal assistant. Chat with your agent, generate images & videos, search X posts – now with your Premium subscription.