跳到正文

X

关注 AI 研究者、开发者与机构的动态

当前显示全部 AI 相关新闻
按账号或来源筛选(541)
全部X新闻X:Rohan Paul2034 条X:Kim1538 条X:阿易 AI Notes1236 条X:Testing Catalog620 条X:阿里云 / Alibaba Cloud574 条X:cb_doge538 条X:Alexandr Wang(Scale AI 创始人/Meta 首席 AI 官)494 条X:Elvis Saravia494 条X:OpenRouter454 条X:Artificial Analysis439 条X:Elon Musk430 条X:Ethan Mollick401 条X:PixVerse372 条X:SemiAnalysis340 条X:OpenAI Developers294 条X:ZHO284 条X:Replit272 条X:小北218 条X:Dex Horthy(HumanLayer)194 条X:AI Safety Memes185 条X:Tibo178 条X:Gemini175 条X:swyx171 条X:Emad Mostaque167 条X:MiniMax159 条X:OpenAI151 条X:X.PIN144 条X:Epoch AI140 条X:Runway133 条X:Nathan Lambert128 条X:Claude Devs125 条X:赵纯想124 条X:Aravind Srinivas(Perplexity CEO)124 条X:Thomas Wolf(Hugging Face 联创/CSO)122 条X:洪明119 条X:蚂蚁百灵118 条X:Jason Liu117 条X:马东锡 NLP114 条X:Gabriel112 条X:Frank Wang 玉伯111 条X:Perplexity108 条X:Google AI for Developers104 条X:fofr103 条X:Yuchen Jin102 条X:面壁智能 OpenBMB101 条X:阑夕99 条X:Claude99 条X:Luma AI98 条X:Peter Steinberger98 条X:Sam Altman93 条X:Tencent WorkBuddy85 条X:Thariq83 条X:Cohere79 条X:Eric Zakariasson77 条X:Krea AI77 条X:Francois Chollet75 条X:opencode75 条X:Clément Delangue(Hugging Face CEO)71 条X:Suno69 条X:OpenClaw65 条X:Greg Brockman64 条X:Deedy Das61 条X:karminski61 条X:腾讯混元58 条X:通义千问 / Qwen57 条X:Microsoft Research56 条X:Anthropic54 条X:AK51 条X:Google DeepMind47 条X:商汤 SenseTime (@SenseTime_AI)43 条X:Charlie Holtz43 条X:Peter McCrory(Anthropic 首席经济学家)42 条X:Boris Cherny41 条X:Google AI41 条X:可灵 Kling AI37 条X:Viggle AI33 条X:百度 Baidu32 条X:AI at Meta32 条X:Aidan Gomez(Cohere CEO)28 条X:Josh Woodward28 条X:Logan Kilpatrick28 条X:Mustafa Suleyman(Microsoft AI CEO)26 条X:Noam Brown24 条X:SpaceXAI24 条X:Andrew Milich22 条X:Odyssey22 条X:李继刚20 条X:Tianyi Cui20 条X:华为云19 条X:硅基流动 SiliconFlow18 条X:Mark Zuckerberg18 条X:Arena (@arena)17 条X:DeepSeek16 条X:fal (@fal)16 条X:DAIR.AI (@dair_ai)14 条X:Karina Nguyen14 条X:Mistral AI14 条X:PixVerse (@PixVerse)14 条X:Sundar Pichai14 条X:ARC Prize (@arcprize)13 条X:Demis Hassabis13 条X:Noah Zweben13 条X:智谱 Z.ai12 条X:Lee Robinson12 条X:Philipp Schmid(Google DeepMind 开发者体验) (@_philschmid)12 条X:ElevenLabs (@elevenlabs)11 条X:Eric Mitchell11 条X:Georgi Gerganov(llama.cpp) (@ggerganov)11 条X:Jensen Huang11 条X:卡兹克 (@Khazix0918)10 条X:唐杰10 条X:Ammaar Reshi10 条X:Andrew Ng(DeepLearning.AI 创始人)10 条X:Arthur Mensch(Mistral CEO) (@arthurmensch)10 条X:Barret 李靖10 条X:Cursor (@cursor_ai)10 条X:Hao AI Lab10 条X:Kimi.ai10 条X:Cognition (@cognition)9 条X:Fei-Fei Li9 条X:Manus (@ManusAI)9 条Tripo(官方 X)8 条X:Figure AI (@Figure_robot)8 条X:Gemini Notebook (@Gemini_Notebook)8 条X:Higgsfield AI (@higgsfield)8 条X:Jeff Dean8 条X:Jim Fan8 条X:Lisa Su(AMD CEO) (@LisaSu)8 条X:Meshy (@MeshyAI)8 条X:MiniMax Design (H3) (@Hailuo_AI)8 条X:谢赛宁7 条X:Michael Truell7 条X:張小珺 Xiaojùn6 条X:NotebookLM0 条@berryxia · 历史来源430 条@vista8 · 历史来源262 条@op7418 · 历史来源231 条@google · 历史来源30 条@getsuperintel · 历史来源9 条@latentspacepod · 历史来源9 条@android · 历史来源8 条@dreamlabla · 历史来源8 条@mannybernabe · 历史来源8 条@karpathy · 历史来源7 条@alexatallah · 历史来源6 条@ryanleeminimax · 历史来源5 条@theo · 历史来源5 条@aidotengineer · 历史来源4 条@dkundel · 历史来源4 条@reach_vb · 历史来源4 条@dotey · 历史来源3 条@eliebakouch · 历史来源3 条@googlechrome · 历史来源3 条@kilocode · 历史来源3 条@maxforai · 历史来源3 条@newsfromgoogle · 历史来源3 条@richardssutton · 历史来源3 条@skylermiao7 · 历史来源3 条@victorsuortiz · 历史来源3 条@ajambrosino · 历史来源2 条@akashi203 · 历史来源2 条@anatolikopadze · 历史来源2 条@andrewcurran_ · 历史来源2 条@antirez · 历史来源2 条@barrnanas · 历史来源2 条@coreyching · 历史来源2 条@deanwball · 历史来源2 条@designarena · 历史来源2 条@fellmentke · 历史来源2 条@gergelyorosz · 历史来源2 条@gmi_cloud · 历史来源2 条@gravicle · 历史来源2 条@hxiao · 历史来源2 条@id_aa_carmack · 历史来源2 条@jackminong · 历史来源2 条@lennysan · 历史来源2 条@mada299 · 历史来源2 条@microsoft · 历史来源2 条@mikastars39 · 历史来源2 条@mitchellh · 历史来源2 条@nabeelqu · 历史来源2 条@rudrank · 历史来源2 条@sebastienbubeck · 历史来源2 条@zan2434 · 历史来源2 条@___harald___ · 历史来源1 条@_boraturan · 历史来源1 条@0xjaniak · 历史来源1 条@0xkato · 历史来源1 条@47fucb4r8c69323 · 历史来源1 条@559hkdt · 历史来源1 条@aaliya_va · 历史来源1 条@abhikatte42 · 历史来源1 条@abhishekpatiil · 历史来源1 条@aboutberlin · 历史来源1 条@addyosmani · 历史来源1 条@agi2asi · 历史来源1 条@aiaicreate · 历史来源1 条@aimlapi · 历史来源1 条@aisaonehq · 历史来源1 条@aisystemprompt · 历史来源1 条@alemtuzlak · 历史来源1 条@alexxubyte · 历史来源1 条@alupsasca · 历史来源1 条@amasad · 历史来源1 条@ampcode · 历史来源1 条@anas_build_ · 历史来源1 条@aniketmaurya · 历史来源1 条@anitakirkovska · 历史来源1 条@anneliesgamble · 历史来源1 条@antigravity · 历史来源1 条@arafatkatze · 历史来源1 条@argofowl · 历史来源1 条@ashiknewazaj · 历史来源1 条@atabarrok · 历史来源1 条@atomic_chat_hq · 历史来源1 条@awe_automation · 历史来源1 条@awesomekling · 历史来源1 条@awscloud · 历史来源1 条@ayushagarwal · 历史来源1 条@baaadas · 历史来源1 条@bai_agi · 历史来源1 条@bbuddha_xyz · 历史来源1 条@bclavie · 历史来源1 条@beccalytics · 历史来源1 条@benfleming__ · 历史来源1 条@benhylak · 历史来源1 条@benjamineyliu · 历史来源1 条@bfl_ml · 历史来源1 条@bleysg · 历史来源1 条@bolna_dev · 历史来源1 条@bosmeny · 历史来源1 条@boxmining · 历史来源1 条@bozhou_ai · 历史来源1 条@brexhq · 历史来源1 条@brian_armstrong · 历史来源1 条@brianchew · 历史来源1 条@bridgemindai · 历史来源1 条@budgetpixel · 历史来源1 条@cahidarda · 历史来源1 条@calmpromptshq · 历史来源1 条@ce_zhang · 历史来源1 条@cedric_chee · 历史来源1 条@chaitralikakde · 历史来源1 条@chatgpt · 历史来源1 条@chatgptapp · 历史来源1 条@christinetyip · 历史来源1 条@christofsalis · 历史来源1 条@clark__labs · 历史来源1 条@cloudflaredev · 历史来源1 条@cnorth_13 · 历史来源1 条@cnzoecomeback · 历史来源1 条@cocohearts · 历史来源1 条@code_star · 历史来源1 条@codebyaurelia · 历史来源1 条@cohavygal · 历史来源1 条@commandcodeai · 历史来源1 条@consensusnlp · 历史来源1 条@contralabs_ai · 历史来源1 条@cozyblaze265065 · 历史来源1 条@crimedecoder · 历史来源1 条@crtr0 · 历史来源1 条@damnventures · 历史来源1 条@daniellockyer · 历史来源1 条@darioamodei · 历史来源1 条@davidmaliglowka · 历史来源1 条@davidondrej1 · 历史来源1 条@davidsacks · 历史来源1 条@dbirker78883 · 历史来源1 条@deryatr_ · 历史来源1 条@devfun · 历史来源1 条@diegocabezas01 · 历史来源1 条@digitalocean · 历史来源1 条@dimillian · 历史来源1 条@dimitrispapail · 历史来源1 条@discussingfilm · 历史来源1 条@dkthomp · 历史来源1 条@dmitryrybin1 · 历史来源1 条@dmsobol · 历史来源1 条@douglance · 历史来源1 条@douglasyaody · 历史来源1 条@duckduckgo · 历史来源1 条@easyrouterio · 历史来源1 条@edgardobriban · 历史来源1 条@eisokant · 历史来源1 条@elliotarledge · 历史来源1 条@encrypted · 历史来源1 条@endpointarena · 历史来源1 条@envato · 历史来源1 条@escanorreloaded · 历史来源1 条@esrtweet · 历史来源1 条@ethanhe_42 · 历史来源1 条@eu_commission · 历史来源1 条@fba · 历史来源1 条@fdavidsont · 历史来源1 条@figmaweave · 历史来源1 条@finn_meeks · 历史来源1 条@first_tree_ai · 历史来源1 条@flavioad · 历史来源1 条@flowith · 历史来源1 条@fminzhou · 历史来源1 条@freddie_spirit · 历史来源1 条@frydwia · 历史来源1 条@futurestacked · 历史来源1 条@garrettlord · 历史来源1 条@garrytan · 历史来源1 条@gavinsbaker · 历史来源1 条@GayaniFigma · 历史来源1 条@genspark_ai · 历史来源1 条@gitlawb · 历史来源1 条@gneubig · 历史来源1 条@gokulr · 历史来源1 条@goodfireai · 历史来源1 条@goodnesmbakara · 历史来源1 条@googleaistudio · 历史来源1 条@gordic_aleksa · 历史来源1 条@gro_tsen · 历史来源1 条@hangsiin · 历史来源1 条@happycapyai · 历史来源1 条@haydenbleasel · 历史来源1 条@helloiamleonie · 历史来源1 条@hey_asiif · 历史来源1 条@hilbertspaess · 历史来源1 条@howtoprompt__ · 历史来源1 条@hq4ai · 历史来源1 条@hypersoren · 历史来源1 条@ianbremmer · 历史来源1 条@interaction · 历史来源1 条@intology · 历史来源1 条@iron_redux · 历史来源1 条@ithilgore · 历史来源1 条@itsreallyvivek · 历史来源1 条@jamesjyu · 历史来源1 条@jameszmsun · 历史来源1 条@jason_young1231 · 历史来源1 条@jawad_rahman_ · 历史来源1 条@jaydendavisnc · 历史来源1 条@jeffbarg · 历史来源1 条@jenzhuscott · 历史来源1 条@jiayuan_jy · 历史来源1 条@jilles · 历史来源1 条@jimcramer · 历史来源1 条@jimsyoung_ · 历史来源1 条@jinjingliang · 历史来源1 条@jjacky · 历史来源1 条@jjackyliang · 历史来源1 条@joefioti · 历史来源1 条@joi___ai · 历史来源1 条@joinhandshake · 历史来源1 条@joinpursuit · 历史来源1 条@joulee · 历史来源1 条@jsconfasia · 历史来源1 条@jsrailton · 历史来源1 条@juminoz · 历史来源1 条@kaizero_ainta · 历史来源1 条@karanganesan · 历史来源1 条@kdaigle · 历史来源1 条@kentherogers · 历史来源1 条@kevinsays · 历史来源1 条@khudonogov · 历史来源1 条@kinfisht · 历史来源1 条@koraykv · 历史来源1 条@kotekjedi_ml · 历史来源1 条@kuberwastaken · 历史来源1 条@kurz_gesagt · 历史来源1 条@kwindla · 历史来源1 条@lafalcemateo · 历史来源1 条@lakshyaaagrawal · 历史来源1 条@larrylv · 历史来源1 条@layoffai · 历史来源1 条@levinstanley · 历史来源1 条@lifeofjer · 历史来源1 条@livekit · 历史来源1 条@lon · 历史来源1 条@lostinlatencyx · 历史来源1 条@lotte_verheyden · 历史来源1 条@lqiao · 历史来源1 条@luciushq · 历史来源1 条@luckeyfaraday · 历史来源1 条@lukaspet · 历史来源1 条@madhavsinghal_ · 历史来源1 条@manassharmahere · 历史来源1 条@markiewagner · 历史来源1 条@marksaroufim · 历史来源1 条@marsxiang_ · 历史来源1 条@maseehg_ · 历史来源1 条@mattshumer_ · 历史来源1 条@mem0ai · 历史来源1 条@mengto · 历史来源1 条@merettm · 历史来源1 条@micahcarroll · 历史来源1 条@michael_chomsky · 历史来源1 条@michaelarnaldi · 历史来源1 条@microsoftai · 历史来源1 条@mike_acton · 历史来源1 条@mikeyyyzhao · 历史来源1 条@minchoi · 历史来源1 条@minimaxagent · 历史来源1 条@minu_who · 历史来源1 条@mkbhd · 历史来源1 条@modal · 历史来源1 条@moritzthuening · 历史来源1 条@moxie · 历史来源1 条@mstockton · 历史来源1 条@mtslive · 历史来源1 条@multimodalart · 历史来源1 条@neelnanda5 · 历史来源1 条@neilrahilly · 历史来源1 条@nickbaumann_ · 历史来源1 条@nirantk · 历史来源1 条@noemititarenco · 历史来源1 条@notjazii · 历史来源1 条@nousresearch · 历史来源1 条@oblomovius · 历史来源1 条@ollama · 历史来源1 条@onlyterp · 历史来源1 条@onlyzhynx · 历史来源1 条@organicgpt · 历史来源1 条@orgrem · 历史来源1 条@p0 · 历史来源1 条@palantirtech · 历史来源1 条@palmerluckey · 历史来源1 条@pandatalk8 · 历史来源1 条@parishilton · 历史来源1 条@patrickcarlyle · 历史来源1 条@patricktoulme · 历史来源1 条@paulg · 历史来源1 条@paulsolt · 历史来源1 条@pbdtokenrouter · 历史来源1 条@pererabinoy · 历史来源1 条@philhchen · 历史来源1 条@pirroh · 历史来源1 条@pjaccetturo · 历史来源1 条@postlive · 历史来源1 条@pranaveight · 历史来源1 条@prathamdby · 历史来源1 条@prince_canuma · 历史来源1 条@pumpkherm · 历史来源1 条@pvncher · 历史来源1 条@qiaoqiao2001 · 历史来源1 条@rajveerbach · 历史来源1 条@randyhaddad6 · 历史来源1 条@rauchg · 历史来源1 条@raveeshbhalla · 历史来源1 条@rayanpal_ · 历史来源1 条@rayfernando1337 · 历史来源1 条@redpoint · 历史来源1 条@ric_rtp · 历史来源1 条@richardsocher · 历史来源1 条@riderashgame · 历史来源1 条@rileybrown · 历史来源1 条@robertvaradan · 历史来源1 条@ronshepherd · 历史来源1 条@rosmine · 历史来源1 条@rthiago · 历史来源1 条@ruben_kostard · 历史来源1 条@runware · 历史来源1 条@rvivek · 历史来源1 条@ryanjunejo · 历史来源1 条@safaricheung · 历史来源1 条@samuelstroschei · 历史来源1 条@sanmking · 历史来源1 条@saranormous · 历史来源1 条@savinovnikolay · 历史来源1 条@scale_ai · 历史来源1 条@scaling01 · 历史来源1 条@sdaily_ai · 历史来源1 条@secscottbessent · 历史来源1 条@seltaa_ · 历史来源1 条@sergiopaniego · 历史来源1 条@servasyy_ai · 历史来源1 条@sethltx · 历史来源1 条@sharat_sc · 历史来源1 条@shashankgoyal95 · 历史来源1 条@sherryyanjiang · 历史来源1 条@sherylhsu02 · 历史来源1 条@shl · 历史来源1 条@sighjith · 历史来源1 条@simistern · 历史来源1 条@southpkcommons · 历史来源1 条@sriramkri · 历史来源1 条@sshoaibali · 历史来源1 条@stalkermustang · 历史来源1 条@status_effects · 历史来源1 条@stevencheng · 历史来源1 条@stockanalystpro · 历史来源1 条@suekhim · 历史来源1 条@sultanalfardan · 历史来源1 条@suraj_sharma14 · 历史来源1 条@swisscheese4299 · 历史来源1 条@swmansion · 历史来源1 条@systematicls · 历史来源1 条@teksedge · 历史来源1 条@tftc21 · 历史来源1 条@theahmadosman · 历史来源1 条@themidasproj · 历史来源1 条@theonejvo · 历史来源1 条@therealadamg · 历史来源1 条@timsoulo · 历史来源1 条@tmuxvim · 历史来源1 条@tobi · 历史来源1 条@togethercompute · 历史来源1 条@trackernetwork · 历史来源1 条@trustkerneltech · 历史来源1 条@ttunguz · 历史来源1 条@tuhinchakr · 历史来源1 条@twistartups · 历史来源1 条@ubermenscchh · 历史来源1 条@udayan_w · 历史来源1 条@usefastlane · 历史来源1 条@uzyn · 历史来源1 条@valeriocapraro · 历史来源1 条@vasuman · 历史来源1 条@vdbergrianne · 历史来源1 条@vibeguessing · 历史来源1 条@victoriakimse · 历史来源1 条@victoriawu77 · 历史来源1 条@victortaelin · 历史来源1 条@vikaskansalhq · 历史来源1 条@volchika · 历史来源1 条@walden_yan · 历史来源1 条@warpdotdev · 历史来源1 条@waynesutton · 历史来源1 条@wesroth · 历史来源1 条@whosamberella · 历史来源1 条@xdinodeer · 历史来源1 条@xicilion · 历史来源1 条@xucian_ · 历史来源1 条@yacinemtb · 历史来源1 条@yaojingang · 历史来源1 条@yevr19 · 历史来源1 条@yoheinakajima · 历史来源1 条@yongquanyq · 历史来源1 条@youtubejocoding · 历史来源1 条@yusufg · 历史来源1 条@zachbussey · 历史来源1 条@zeddotdev · 历史来源1 条@zeroxkyle · 历史来源1 条@zhenthebuilder · 历史来源1 条@zicohacks · 历史来源1 条@zixuanli_ · 历史来源1 条@zymazza · 历史来源1 条
18,965 条AI 相关新闻 · 最新在前
9月22日周二
  1. @testingcatalog27

    META 🔥:我们可能很快就能在 API 上用上 Muse Video 模型。 > Meta 可能在 Meta Connect 期间随新语音模型一起在 API 上发布 Muse Video。 > Meta 平台目前正在开发专门的 Video 和 Voice Playground。 除此之外,一个单独的 Connectors 板块也在筹备中。该板块很可能允许用户直接向平台提交自己的 Muse Connectors(目前需要通过人工审核表单)。

  2. @AYi_AInotes57

    千问在云栖大会公布 Qwen3.8 系列,其中 Qwen3.8-Flash 通过底层重构把训练成本降低近九成,缓存命中输入定价为每百万 Tokens 一毛钱。Qwen3.8-Max 在零人工干预下自主跑完 33 轮闭环演进,把总线模块面积缩减 42%,并针对阿里新款芯片自主完成算子调优与底层框架适配,单实例推理吞吐提升 96%。新架构 Qwen4 已在训练,后续版本规划扩展至 5 到 10 万亿参数,千问开源模型下载量已超 30 亿次。

    引用@AYi_AInotes@AYi_AInotes

    看完今天上午云栖大会千问交出的整套底牌, 我感觉最锋利的地方全落在了账本上: 研发端让模型零干预自主迭代 33 轮扛住研发重活, 成本端直接把缓存命中输入打穿到了每百万 Tokens 一毛钱。 咱们把这两串数字掰开看, 在模型研发端,Qwen3.8-Max 在没有任何人工干预的情况下自主跑完 33 轮闭环演进,调用上万次工业工具把总线模块面积缩减了 42%,Artificial Analysis 质量指数推到了 45。 面对从未见过的阿里新款芯片,它自己进场完成算子调优与底层框架适配,竟然把单实例推理吞吐拉升了 96%,这说明算法团队日夜洗数据调参的阶段正在过去,大模型正在自己接管研发流水线。 而在落地成本端,提前开源架构的 Qwen3.8-Flash 通过注意力机制等底层重构,把训练成本直接砍掉近九成,配上每百万 Tokens 一毛钱的缓存单价,让大规模并发调用有了真实的利润空间。 Pinterest CEO 在公开场合提到,换用千问后综合调用成本压缩至同类商业模型的 8%。 更耐人寻味的是技术迭代的节奏,新架构 Qwen4 已经在训,后续版本规划直奔 5 到 10 万亿参数,配合全球突破 30 亿次的开源下载量,感觉千问交出来的已经不是几个孤立的模型版本了,有点把 AI 从手工作坊时代推进到了自运转的工业工厂时代的意味。 并且阿里的这种工程化能力已经开始向多模态交付延伸了,视频模型 Wan3.0 在主流评测中排名前列,下代模型定档 11 月,刚开源的 Qwen-Image-2.1 凭借 7B 的轻量尺寸,把原生透明图层与局部编辑做进了同一个模型,支持圈选修改、图层替换与多图保真参考,以往需要跨几个专业软件来回倒腾的设计链路,现在能在同一个模型内被压成秒级响应。 从算法团队教模型理解世界,到模型反向进入研发体系、全行业的计算成本被大幅摊薄。 开源生态把图纸与开采机完整交出来之后,竞争的重心彻底转向了谁能用更低成本把真实业务跑通。 这套成本架构落地之后,大家最想先重构手头的哪块业务?我自己是打算把后台知识库检索和长文本记忆全量切过去,粗算一年能省出好几台服务器的实打实开销。

  3. @AYi_AInotes63

    阿里在云栖大会交出千问整套模型底牌,Qwen3.8-Max 在没有任何人工干预下自主跑完 33 轮闭环演进,Qwen3.8-Flash 把缓存命中输入价压到每百万 Tokens 一毛钱。前者调用上万次工业工具把总线模块面积缩减 42%、单实例推理吞吐拉升 96%,后者的训练成本砍掉近九成,Pinterest CEO 称换用千问后综合调用成本压缩至同类商业模型的 8%。新架构 Qwen4 已在训练并规划扩展至 5 到 10 万亿参数,开源下载量突破 30 亿次,视频模型 Wan3.0 下代定档 11 月,刚开源的 Qwen-Image-2.1 以 7B 尺寸把原生透明图层与局部编辑做进同一个模型。

    引用@AYi_AInotes@AYi_AInotes

    看完今天上午云栖大会千问交出的整套底牌, 我感觉最锋利的地方全落在了账本上: 研发端让模型零干预自主迭代 33 轮扛住研发重活, 成本端直接把缓存命中输入打穿到了每百万 Tokens 一毛钱。 咱们把这两串数字掰开看, 在模型研发端,Qwen3.8-Max 在没有任何人工干预的情况下自主跑完 33 轮闭环演进,调用上万次工业工具把总线模块面积缩减了 42%,Artificial Analysis 质量指数推到了 45。 面对从未见过的阿里新款芯片,它自己进场完成算子调优与底层框架适配,竟然把单实例推理吞吐拉升了 96%,这说明算法团队日夜洗数据调参的阶段正在过去,大模型正在自己接管研发流水线。 而在落地成本端,提前开源架构的 Qwen3.8-Flash 通过注意力机制等底层重构,把训练成本直接砍掉近九成,配上每百万 Tokens 一毛钱的缓存单价,让大规模并发调用有了真实的利润空间。 Pinterest CEO 在公开场合提到,换用千问后综合调用成本压缩至同类商业模型的 8%。 更耐人寻味的是技术迭代的节奏,新架构 Qwen4 已经在训,后续版本规划直奔 5 到 10 万亿参数,配合全球突破 30 亿次的开源下载量,感觉千问交出来的已经不是几个孤立的模型版本了,有点把 AI 从手工作坊时代推进到了自运转的工业工厂时代的意味。 并且阿里的这种工程化能力已经开始向多模态交付延伸了,视频模型 Wan3.0 在主流评测中排名前列,下代模型定档 11 月,刚开源的 Qwen-Image-2.1 凭借 7B 的轻量尺寸,把原生透明图层与局部编辑做进了同一个模型,支持圈选修改、图层替换与多图保真参考,以往需要跨几个专业软件来回倒腾的设计链路,现在能在同一个模型内被压成秒级响应。 从算法团队教模型理解世界,到模型反向进入研发体系、全行业的计算成本被大幅摊薄。 开源生态把图纸与开采机完整交出来之后,竞争的重心彻底转向了谁能用更低成本把真实业务跑通。 这套成本架构落地之后,大家最想先重构手头的哪块业务?我自己是打算把后台知识库检索和长文本记忆全量切过去,粗算一年能省出好几台服务器的实打实开销。

  4. @AYi_AInotes59

    千问在云栖大会公布整套模型与成本方案,Qwen3.8-Max 在没有任何人工干预的情况下自主跑完 33 轮闭环演进,调用上万次工业工具把总线模块面积缩减 42%,并对从未见过的阿里新款芯片自主完成算子调优与底层框架适配,把单实例推理吞吐拉升 96%。成本端 Qwen3.8-Flash 通过注意力机制等底层重构把训练成本砍掉近九成,缓存命中输入降到每百万 Tokens 一毛钱,Pinterest CEO 称换用千问后综合调用成本压缩至同类商业模型的 8%。同期开源的 Qwen-Image-2.1 以 7B 尺寸把原生透明图层与局部编辑做进同一个模型,视频模型 Wan3.0 在主流评测中排名前列、下代定档 11 月,新架构 Qwen4 已在训,后续版本规划直奔 5 到 10 万亿参数,开源下载量突破 30 亿次。

    引用@AYi_AInotes@AYi_AInotes

    看完今天上午云栖大会千问交出的整套底牌, 我感觉最锋利的地方全落在了账本上: 研发端让模型零干预自主迭代 33 轮扛住研发重活, 成本端直接把缓存命中输入打穿到了每百万 Tokens 一毛钱。 咱们把这两串数字掰开看, 在模型研发端,Qwen3.8-Max 在没有任何人工干预的情况下自主跑完 33 轮闭环演进,调用上万次工业工具把总线模块面积缩减了 42%,Artificial Analysis 质量指数推到了 45。 面对从未见过的阿里新款芯片,它自己进场完成算子调优与底层框架适配,竟然把单实例推理吞吐拉升了 96%,这说明算法团队日夜洗数据调参的阶段正在过去,大模型正在自己接管研发流水线。 而在落地成本端,提前开源架构的 Qwen3.8-Flash 通过注意力机制等底层重构,把训练成本直接砍掉近九成,配上每百万 Tokens 一毛钱的缓存单价,让大规模并发调用有了真实的利润空间。 Pinterest CEO 在公开场合提到,换用千问后综合调用成本压缩至同类商业模型的 8%。 更耐人寻味的是技术迭代的节奏,新架构 Qwen4 已经在训,后续版本规划直奔 5 到 10 万亿参数,配合全球突破 30 亿次的开源下载量,感觉千问交出来的已经不是几个孤立的模型版本了,有点把 AI 从手工作坊时代推进到了自运转的工业工厂时代的意味。 并且阿里的这种工程化能力已经开始向多模态交付延伸了,视频模型 Wan3.0 在主流评测中排名前列,下代模型定档 11 月,刚开源的 Qwen-Image-2.1 凭借 7B 的轻量尺寸,把原生透明图层与局部编辑做进了同一个模型,支持圈选修改、图层替换与多图保真参考,以往需要跨几个专业软件来回倒腾的设计链路,现在能在同一个模型内被压成秒级响应。 从算法团队教模型理解世界,到模型反向进入研发体系、全行业的计算成本被大幅摊薄。 开源生态把图纸与开采机完整交出来之后,竞争的重心彻底转向了谁能用更低成本把真实业务跑通。 这套成本架构落地之后,大家最想先重构手头的哪块业务?我自己是打算把后台知识库检索和长文本记忆全量切过去,粗算一年能省出好几台服务器的实打实开销。

  5. @AYi_AInotes61

    吴恩达就 OpenAI 智能体蜂群攻破 Hugging Face 事件发文,认为事故核心是 OpenAI 测试沙箱的隔离与监控流程存在 Bug,并不代表 AI 风险出现跃升。

    原始视频预览图;未保存可播放视频URL
    引用@AndrewYNg@AndrewYNg

    The loudest voices stoking fears about AI dangers have made tremendous headway in the past two weeks. AI technology has not taken some unexpected, dangerous turn, but the hype around it — propelled by what appears to be a well orchestrated PR campaign — has drummed up considerable fear. I worry that it represents a setback for our field. I have written frequently that fears of AI are overhyped. AI’s capabilities can be uncannily human-like and unpredictable, and it’s rational to worry when people who are directly involved express concerns. But I see the problems as a sign of the engineering work that ahead, rather than insurmountable barriers or the sky falling. AI technology continues to advance — which is a good thing! — but technical advances, poorly understood by the public, give those who seek to generate hype repeated opportunities to do so. First, I don’t see any step up in the risk of human extinction from AI compared to a few months ago. The theories about this remain the same fantastical, science fiction scenarios as a few months ago. The biggest change in AI risk is its cybersecurity capabilities — a topic which we should take seriously — but this, too, will not lead to the end of the world. The most notable recent event leading to increased fear was when an OpenAI team deployed an agent swarm that hacked into Hugging Face. Much of the popular press contained significant hype. For example, some publications reported that a swarm of 1,200 agents carried out the attack. While this was technically accurate, as I write this, I have about 1,300 processes running on my laptop. Yes, the ability to get large swarms of agents to work in parallel on a task is a significant technical advance, And, in computing, many processes run at the same time. So this shouldn’t be seen as some magical capability. Additionally, OpenAI’s buggy sandboxing and monitoring processes were key to enabling this incident. Fixing these bugs and putting in place improved monitoring would be appropriate fixes, not pausing AI. There are many well known ways to attack software systems. The main advantage of AI agents is that they are relentless. They will tirelessly try many tactics — and have the patience to chain vulnerabilities together — that previously would have taken an infeasible amount of human effort. But in the long term, I believe the advantage will lie with defenders (because they have more information with which to identify bugs, which they can fix), but the cyber-threat landscape has changed significantly. There are still bottlenecks to identifying and exploiting a vulnerability. AI agents still have to try a lot of things to see what works, and taking these actions takes time and might be detected by defenders. This is why, even though it is now easy to obtain versions of leading open weight models that have had their guardrails removed or weakened, so they will not refuse to try to execute cyber attacks, the world has not ended. I am also concerned about the anthropomorphization of AI in a lot of reporting, where LLMs and agents are unnecessarily treated as if they were people. If I wield a hammer, miss a nail, and accidentally dent the wall, it’s not the fault of the hammer. The problem lies in how I used the hammer. Similarly, if I prompt an agent and it hacks into someone else’s system, the responsibility lies with me, not the agent. Of course, we want to build systems that are as safe and predictable as possible. (For example, an unsafe hammer would be one whose head randomly flies off under normal use.) Today’s agentic systems are not predictable, but I see no reason why, by applying sound engineering practices, we won’t be able to make them extremely safe to use. One new element in the forecasts of AI-enabled doom is AI companies disclaiming responsibility for their own products. “I didn’t do it; my out-of-control agent did!” There’s a balance to be struck between the responsibility of the tool maker and the tool user, but when something goes wrong, let’s hold the people building and/or using the hammer responsible, rather than the hammer. (By the way, if you’re worried about AI bioweapon risk, David Bellamy has a great post on why this, too, is overhyped. Briefly, the bottleneck in building a bioweapon is not intelligence, but lab work and manufacturing.) Pausing AI progress will create much more harm than benefit. First, our adversaries will certainly not slow down. Second, engineering requires discovering problems empirically so we can fix them. If we pause AI by a decade, we will also delay finding and implementing safety engineering fixes by about the same duration. Of course, the incentive to stoke fears — for regulatory capture, to garner attention, or to make one’s technology seem more powerful — remains the same as before. Disclaiming responsibility is a new one. Taking a hard technical look at the actual risks however, I see little factual basis for the degree of fear that’s been stoked up. We still have hard research and engineering work ahead to improve AI safety, but the beneficial applications continue to vastly outweigh the risks, and we should keep building. [Original text (with links): https://t.co/jni2tWazAH ]

  6. @TencentHunyuan54

    腾讯混元 Hy Image3.5 preview 上线,支持文生图与图像生图,最高 2K,官方称人评胜率较 Hy Image3.0 提升 30%。腾讯云 API 定价为每张 0.024 美元,参考图不计费,OnSolo 与 Miora 可免费试用两周。

    引用@TencentHunyuan@TencentHunyuan

    Hy Image3.5 preview is live. 🚀 Professional-grade image generation, +30% win rate in human eval vs Hy Image3.0 Both Text to image & Image to image available. Up to 2K. Better Consistency. API: https://t.co/5BvR2SdI6Q Priced for everyone. $0.024 per image on Tencent Cloud API. We only charge for what we generate — your reference images are free. Two weeks free (Only in OnSolo and Miora): Miora https://t.co/UxwBScI64O OnSolo https://t.co/iXnNNg6U9k Try it and tell us where it breaks.

  7. karminski-牙医39

    Qwen4 家族首次曝光,包含 Qwen4-Max、Qwen4-Flash & Qwen4-Plus 以及 Qwen4-27B,未来 Qwen 会训 5-10T 的模型。卧槽5-10T???

    引用Max For AI@MaxForAI

    🚨Qwen4家族首次曝光!! 刚刚,在2026年云栖大会的开幕式上,新任@Alibaba_Qwen LLM负责人刘大一恒官宣了即将到来的Qwen4家族! 包含Qwen4-Max Qwen4-Flash&Qwen4-Plus 还有Qwen4-27B!!! 未来Qwen会训5-10T的模型

  8. @TencentHunyuan42

    AI 说网站做好了。然后首页报错,按钮重叠,还加了一个你从没要求过的登录流程。🙃 介绍 WebCraftBench:智能体真正使用实时应用,覆盖率引导的探索发现从未被触及的部分,然后我们评估美观度、可用性,以及原始需求是否被满足。 在 197 个人工验证的配对样本上,它与人类偏好的一致率达到 85.3%。 论文:https://t.co/0QT2srOKTZ

  9. @AYi_AInotes37

    Pexo 把十几款底层视频模型收编为执行层,用户只需给出想法、参考素材或产品网页链接,它便自动拆分镜、调度生成、排动效、加字幕配乐,直接输出完整成片。改片时可在播放器画面上圈选打批注,智能体只对标记区域局部重修,无需整条视频重推。其定位是把碎片化的单段生成能力打包成端到端交付,让演示内容的产出速度对齐写代码搓原型的节奏。

    原始视频预览图;未保存可播放视频URL
  10. OpenBMB25

    非常感谢分享!很高兴看到 MiniCPM5-2B 被用在这样实际的多智能体工作流中——尤其是 worker 通过工具调用实际处理匹配、短付款、重复引用和争议。感谢你在测试和记录上付出的所有努力。这对社区来说是个很好的案例 🙌

    引用Joey@aijoey

    Next test on Spark 1: 32 synthetic invoices, with purchase orders and payment records. GPT-6 Astra coordinates the MiniCPM5-2B workers. They sort out matches, short payments, duplicate references and price disputes, then write the results into a case ledger. All 32 verified in 67.8 seconds. Eight in each category, with 232 executed tool calls. The video is real time. This demo doesn’t move money.