X
关注 AI 研究者、开发者与机构的动态
按账号或来源筛选(539)
@rohanpaul_ai@rohanpaul_aiAI 评分4242 
@kimmonismus@kimmonismusAI 评分2727 终于能用上邮件、日历和 Slack 这类插件,让 GPT-Voice 的实用性提升了 100 倍,终于成为可以(日常)使用的真正选项。需要测试一下。 https://t.co/5WahRn6zML

@alexandr_wang@alexandr_wangAI 评分22 等等,有人放大看过登月照片吗?https://t.co/kLfp3FiHEQ

@emollick@emollickAI 评分4747 这既有趣,也很好地衡量了多模态 AI 在短时间内进步了多少。
引用@EpochAIResearch@EpochAIResearchCan AI tell if you've built your IKEA furniture wrong? Our new benchmark, the Furniture Assembly Benchmark (FAB), gives models the manual and a photo of a half-completed piece of furniture and asks them to spot the mistake. The top score has gone from 28% to 80% in just 10 months.
@thsottiaux@thsottiaux精选AI 评分8080 引用@OpenAI@OpenAIWe heard you loud and clear. ChatGPT Voice can now: - Use plugins like your email, calendar, and Slack. - Be powered by GPT-6 Astra, Sol, and Luna. - Be used in ChatGPT Work on web and mobile, so you can create docs, decks, sites, and spreadsheets or tackle complex tasks in the browser, just by talking. Rolling out globally today in the latest version of the app.
推荐理由:ChatGPT Voice 接入插件并在 ChatGPT Work 中支持语音生成文档与表格,读者可据此了解语音入口当前的可用范围。
Gemini Notebook@Gemini_NotebookAI 评分5454
@gabriel1@gabriel1AI 评分2222 市场是否正在定价这样一个预期:今天约 0% 的企业数据经过语言模型,而 3 年后每一条内部和外部消息、每一次数据库变更、分析、会议转录以及其他一切,都将经过语言模型?
@OpenRouter@OpenRouterAI 评分2121 Space Bunny Alpha 已在 OpenRouter 重新上线。 问题现已解决,模型恢复服务。感谢大家在宕机期间的耐心等待。 https://t.co/g1XybNcJue
@ArtificialAnlys@ArtificialAnlysAI 评分4343 @ArtificialAnlys@ArtificialAnlysAI 评分2727 
@ArtificialAnlys@ArtificialAnlysAI 评分3030 
@ArtificialAnlys@ArtificialAnlysAI 评分3434 
@rohanpaul_ai@rohanpaul_aiAI 评分2727 在全球范围内,AI 引发的好奇心远多于恐惧,即便担忧依然相当普遍,正面情绪仍超过负面情绪。

@rohanpaul_ai@rohanpaul_aiAI 评分55 抱歉,您提供的主推文内容仅包含一个链接(https://t.co/pF3dpykVJj),没有可翻译的正文文字。请提供推文的实际文字内容,我将为您翻译。
@rohanpaul_ai@rohanpaul_aiAI 评分4646 
@karinanguyen@karinanguyenAI 评分4848 @rohanpaul_ai@rohanpaul_aiAI 评分55 @rohanpaul_ai@rohanpaul_ai精选AI 评分6565 
推荐理由:卡内基研究用 2022 与 2025 两年 NeurIPS 群体的去向数据,呈现 AI 人才流向的反转。
@EpochAIResearch@EpochAIResearchAI 评分77 @EpochAIResearch@EpochAIResearchAI 评分1414 我们认为 FAB 能很好地代表一系列具有经济价值的任务,这些任务需要类似的视觉推理能力,比如修车或修理家用电器。 我们希望这样的基准能帮助更好地追踪 AI 在这一领域的进展。
@EpochAIResearch@EpochAIResearchAI 评分2929 就实际实用性而言,速度与准确率同样重要。在这方面,GPT-6 Astra 是明显的异类。它不仅准确率最高,而且在我们测试的所有模型中也是最快的。https://t.co/4h1JI28zT2

@EpochAIResearch@EpochAIResearchAI 评分3434 
@EpochAIResearch@EpochAIResearchAI 评分1414 在 FAB 上,AI 必须根据如下所示的照片来评估组装成果。该基准测试包含来自 3 个不同家具组装过程的 60 张照片。https://t.co/X4W7OpgfiW

Epoch AI@EpochAIResearchAI 评分4242AI 能看出你把宜家家具装错了吗?我们的新基准——家具组装基准(FAB)——把说明书和一张组装到一半的家具照片交给模型,让它们找出错误。 最高分在短短 10 个月内从 28% 升到了 80%。

@EMostaque@EMostaqueAI 评分2828 

@AYi_AInotes@AYi_AInotesAI 评分1717 首届 2026 年 11 月 5 日早申截止,优先高中应届和大学读了一年的,入口 https://t.co/0c0oNBs6Pv
@AYi_AInotes@AYi_AInotes精选AI 评分6565 
推荐理由:梳理 a16z 自办学院的招生与运作细节,可作为观察 VC 把人才筛选前移到高中毕业的一个样本。
@rohanpaul_ai@rohanpaul_aiAI 评分2929 
@jxnlco@jxnlcoAI 评分2525 @OpenAI@OpenAI精选AI 评分8383 
推荐理由:语音入口接入邮箱、日历与 Slack 等插件并由新模型驱动,读者可据此判断对话式办公的可用边界。
@karinanguyen@karinanguyenAI 评分1818 
@EMostaque@EMostaqueAI 评分2626 
@AYi_AInotes@AYi_AInotesAI 评分3131 Claude Opus 5.5 被指纯代码完成了一段视频画面,连音乐也由其生成。推文称这波表现"封神",并调侃从 OpenAI 那里"找回场子"。

eric zakariasson@ericzakariassonAI 评分6060
引用Cursor@cursor_aiWe've reduced token costs in Cursor by 7% with no drop in agent quality. Savings came from tighter prompts, selective tool loading, better caching, and compressed file reads.
@karinanguyen@karinanguyenAI 评分1313 4/ 你可以导演场景 这里,Elon 被指示停止吸烟。https://t.co/dXLNDL1LPg

@rohanpaul_ai@rohanpaul_aiAI 评分4646 
@karinanguyen@karinanguyenAI 评分2121 
Karina@karinanguyenAI 评分3131推出 ACTx486,一种全新交互式媒介的研究演示。 如果你能和任何视频对话,想问什么就问什么,会怎样? 我们的系统将一档现有播客变成了能倾听、能回应、能适应的东西。 研究来自 @jakubzeg:

@OpenRouter@OpenRouterAI 评分4646 @PixVerse_@PixVerse_AI 评分2323