X:Elvis Saravia
@omarsar0 · X
切换来源
@omarsar0@omarsar0AI 评分44 @omarsar0@omarsar0AI 评分3232 
@omarsar0@omarsar0AI 评分1111 @omarsar0@omarsar0AI 评分2121 @omarsar0@omarsar0AI 评分2525 我发现,在上面的 v2 提示词中使用 4K 能带来好得多的结果。 这里是 v1: https://t.co/DzbLgZNWDy
引用@omarsar0@omarsar0GPT-6 Astra is absolutely insane for generating 3D stuff. "Generate a Grok Bot version of Codex Micro." Now I want this so bad! In one prompt. Imagine what else it can do—sharing more insane examples shortly. https://t.co/YOcWgKZe8x
@omarsar0@omarsar0AI 评分2121 天呐!!! GPT-6 Astra 仅用一张图片参考就做出了这个。 我无言以对。https://t.co/29ar6Ylu77

@omarsar0@omarsar0AI 评分2121 我试过用 Fable 做这件事很多次,质量通常都不到位。这是我第一次一次性就得到了看起来质量相当不错的结果! 给 Astra 一张图片,让它重新创作出一些东西,这很有趣。
@omarsar0@omarsar0AI 评分1515 @omarsar0@omarsar0AI 评分2828 
@omarsar0@omarsar0AI 评分4242 
@omarsar0@omarsar0AI 评分2424 
@omarsar0@omarsar0AI 评分1818 
@omarsar0@omarsar0AI 评分1616 @omarsar0@omarsar0AI 评分4444 一项研究称 LLM 多智能体系统实际只需约六种通信拓扑:将码本容量从 8 扩到 64 后,通过奖励过滤存活下来的拓扑仍收敛到大致相同的六种。

@omarsar0@omarsar0AI 评分4646 
@omarsar0@omarsar0AI 评分1515
@omarsar0@omarsar0AI 评分2525 @omarsar0@omarsar0AI 评分1313 @omarsar0@omarsar0AI 评分3636 
@omarsar0@omarsar0AI 评分6262 
@omarsar0@omarsar0AI 评分1818 推荐阅读。 它总结了支撑 Grok Bot 的持久化智能体背后的设计选择。如果你想了解智能体领域的下一步发展,这是一篇出色的文章。https://t.co/dmOUaRVsog
@omarsar0@omarsar0AI 评分3737 
@omarsar0@omarsar0AI 评分1919 来自 Apodex 的一个验证案例。 根据 Apodex 报告的结果,AAV 衣壳设计中的一项特定模型能力超越了该领域此前发表的最佳方法。 这些是 Apodex 报告的结果,尚未经过独立验证。
@omarsar0@omarsar0AI 评分3232 
@omarsar0@omarsar0AI 评分2525 
@omarsar0@omarsar0AI 评分1313 
@omarsar0@omarsar0AI 评分3232 评估单位是完整的求解器。 这意味着模型加上它的工具、记忆、执行环境和控制循环。 只对基础模型打分,会遗漏智能体在实践中真正失败的地方。https://t.co/Dui8MMqZZF

@omarsar0@omarsar0AI 评分1717 
@omarsar0@omarsar0AI 评分4141 
@omarsar0@omarsar0AI 评分3232 
@omarsar0@omarsar0AI 评分1515 @omarsar0@omarsar0AI 评分1616 是我一个人觉得奇怪吗,Fable 5.1 在发布当天就能用上,但 GPT-6 Astra 却没有? 说实话,有点失望。 希望 AGI 发布时不会是这样。随便说说。
@omarsar0@omarsar0AI 评分4848 
@omarsar0@omarsar0精选AI 评分7777 引用@OpenAI@OpenAIGPT-6 Astra is state-of-the-art on FrontierMath Tier 4, ARC-AGI 3, and TerminalBench-4.0. GPT‑6 Astra is also a major advance for scientific discovery, with state-of-the-art performance on Terminal-Bench Science 0.1 and HealthBench Pro. https://t.co/7hEFadVAN9
推荐理由:作者指出 GPT-6 Astra 在多项高难度基准上超过几天前刚发布的竞品模型,并附有对比数据。
@omarsar0@omarsar0AI 评分2525 你们都在做一些很酷的东西。 我该不该再找 Grok @bot 团队要一些兑换码?
引用@omarsar0@omarsar0The @bot team gave me 50 codes to hand out to my followers, each worth $200. That's a month free of the $200/month plan, or $200 in credits. Just comment with your best/most fun use cases or things you’d like to try in Grok Bot. Grok Bot changed how I work with agents. I stopped overthinking. I hand a task to a bot, and it manages most of the work from there. My favorite bot so far: My orchestrator bot runs my higher-level agent team. It assigns work across specialized bots and keeps everything organized, so I run many tasks in parallel instead of babysitting one at a time.
@omarsar0@omarsar0AI 评分99 @omarsar0@omarsar0AI 评分11 @bot 我在发代码。继续来领。还剩几个。https://t.co/Q0jrI2XhwA

@omarsar0@omarsar0AI 评分3434 @omarsar0@omarsar0AI 评分22 @omarsar0@omarsar0AI 评分2121