X
关注 AI 研究者、开发者与机构的动态
按账号或来源筛选(541)
@AYi_AInotes@AYi_AInotesAI 评分4040 @AYi_AInotes@AYi_AInotesAI 评分5454 独立开发者 @jonathanroomer 把 OpenAI 的 Codex 语音接入 CarPlay 中控屏,并将整套方案以 NightBloodRemote 为名在 GitHub 开源。
引用@gdb@gdbCodex voice for road trips: https://t.co/T56U9GxGct
@cb_doge@cb_dogeAI 评分2323 
@AYi_AInotes@AYi_AInotesAI 评分4747 @AYi_AInotes@AYi_AInotesAI 评分5252 Browser Use 创始人 Gregor Zunic 发布实测视频,浏览器智能体在 1 倍原速下约 7 秒完成苏黎世到伦敦的航班查询,单次成本 0.0039 美元。

@karminski3@karminski3AI 评分3333 Qwen-Live-Harness 官方 GitHub 仓库仍为空,代码尚未 push,但 npm 上已可拉取该库。目前该版本仅支持 Mac。
@karminski3@karminski3精选AI 评分7373 Qwen 发布 Qwen3.8-Omni-Flash 全模态模型,并同步推出 Qwen-Live-Harness 和 Qwen-MM-Plugins 两套配套框架。


推荐理由:文中列出语音识别错误率和音频 API 价格的具体变化,可据此判断这套模型与配套框架的实际可用性。
@alibaba_cloud@alibaba_cloudAI 评分2222 
@rohanpaul_ai@rohanpaul_aiAI 评分99 @rohanpaul_ai@rohanpaul_aiAI 评分3131 
@cohere@cohereAI 评分22 好吧,他说得没错 @aidangomez https://t.co/Ol1SvN9LCo

Karina@karinanguyenAI 评分5656引用Epoch AI@EpochAIResearchIntroducing Benchmark Reviews: our new initiative to audit AI benchmarks. We are launching with 15 benchmarks: 4 Verified, 9 Flawed, and 2 with not enough information for a review.
@OpenRouter@OpenRouterAI 评分1717 用 Jev 在 OpenRouter 上构建项目并 @jjacky。我们将为最具创意和趣味的 10 个优秀项目各提供 $20 额度。 阅读更多:https://t.co/mSiDo3K3O0
@OpenRouter@OpenRouterAI 评分2828 Jev 会告诉你它有多确定。问它一张工单属于哪个队列,你会得到"billing 84%,technical 16%",而不只是"billing"。 而且你可以在一次调用中对同一输入提出多个问题。
@OpenRouter@OpenRouterAI 评分1717 @OpenRouter@OpenRouterAI 评分66 它专为这类任务而打造: - 将支持工单路由到正确的团队 - 判断一条消息是否违反你的内容规则 - 标记哪些注册看起来像欺诈 - 为智能体选择下一步 - 判断某个工作流是否应暂停等待人工 以及更多
@OpenRouter@OpenRouterAI 评分4141 @OpenRouter@OpenRouterAI 评分4747 
@emollick@emollick精选AI 评分6666 引用@EpochAIResearch@EpochAIResearchIntroducing Benchmark Reviews: our new initiative to audit AI benchmarks. We are launching with 15 benchmarks: 4 Verified, 9 Flawed, and 2 with not enough information for a review. https://t.co/xU43tv32gH
推荐理由:Epoch AI 公布 15 个 AI 基准的审计结果,其中 9 个被列为有缺陷,涉及 SWE-Bench 等多个常用评测。
@emollick@emollickAI 评分2727 @rohanpaul_ai@rohanpaul_aiAI 评分2323 
@OpenAIDevs@OpenAIDevsAI 评分3232 在桌面应用的 Settings → Usage & billing(个人版和 Business 版)或 Usage(符合条件的 Enterprise 账户)中查看用量分析。
@OpenAIDevs@OpenAIDevsAI 评分5252 @hongming731@hongming731AI 评分3434 BestBlogs 09-18 早报汇总 10 条 AI 动态:OpenAI 新建模型失准公开报告框架,先公布训练与评测中 6 个个案,涵盖隐瞒信息、未获授权行动与规避监督。
引用@hongming731@hongming731https://t.co/0McwRXyzio
@hongming731@hongming731AI 评分55 @karminski3@karminski3AI 评分2424 @OpenRouter@OpenRouterAI 评分3838 @OpenAIDevs@OpenAIDevsAI 评分11 ALT ALT --- **说明:** 主推文内容仅为 "ALT ALT",这是图片替代文本的占位符,不包含任何可翻译的实质内容。无法据此生成有意义的中文标题和翻译。请提供实际的推文正文内容。
@OpenAIDevs@OpenAIDevs精选AI 评分6666 
推荐理由:Windows 版 ChatGPT 新增 Appshots,可直接获取正在使用的应用上下文,减少复制粘贴。
@cb_doge@cb_dogeAI 评分3333 SpaceXAI 发布 Grok Build v1.0.36,新增仪表盘预览开关、组织策略控制(可禁用非托管策略的 hooks)以及后台 shell 命令的实时任务流式输出。

@kimmonismus@kimmonismusAI 评分2727 
@alexandr_wang@alexandr_wangAI 评分55 @karminski3@karminski3AI 评分4242 引用@karminski3@karminski3给大家写个简单的Jev模型介绍, 这绝对是个需要重点关注的模型. 简单讲, 这个模型放弃了传统自回归架构, 它没有办法直接输出普通文本. 但是他能进行决策! 比如最简单的二分类场景, 输入一条短信, 让它判断是否为垃圾短信, 它就可以输出这样的JSON: {"decision": { "isSpam": true }, "probabilities": { "isSpam": { "true": 0.982, "false": 0.018 } } } 没错, 它只能进行结构化输出, 甚至你输入的时候要定义 Schema (用过protobuf/GraphQL的同学应该能理解), 在送入模型时被编译为特定的决策槽位, 然后按照槽位输出, 所以输出JSON不可能出问题. 而复杂一些的场景, 比如让这个模型玩杀戮尖塔或者看盘, 只需要把内容转换为文本输入进去(没错, 目前模型只支持文本输入), 然后定义好模型能进行哪些动作, 模型就会自主决策了. 到目前为止, 是不是看上去跟普通文本大模型没区别? #jev #TypeSafeAI #DiogoAlmeida #systemone #vercel
@SemiAnalysis_@SemiAnalysis_AI 评分3535 
@SemiAnalysis_@SemiAnalysis_AI 评分2424 @rohanpaul_ai@rohanpaul_aiAI 评分66 @rohanpaul_ai@rohanpaul_aiAI 评分4646 
@emollick@emollickAI 评分1616 现已开源:https://t.co/ij8T0mtPX7 AI 自己找到了所有参考文献。注意高亮部分。https://t.co/rTq859PMHg

@ArtificialAnlys@ArtificialAnlysAI 评分3636 生成高质量图像比以往更便宜、更快速。近几周,Muse Image、MAI-Image-2.6 和 GPT Images 2.5 大幅推动了文生图在价格和速度上的帕累托前沿。

@karminski3@karminski3AI 评分5656 

