Sierra Blog· Soham Ray, Keshav Dhandhania, Victor Barres·· 2026-05-02精选AI 评分64
Sierra 发布 𝜏-voice 基准,在真实语音条件下评测实时语音 Agent
𝜏-voice: benchmarking real-time voice agents on real-world tasks
AI 导读
Sierra 团队推出 𝜏-voice 基准,将 𝜏-bench 的 278 个客服任务与全双工实时语音、可控真实音频结合,任务、工具和评估器与文本版逐字节一致,语音成绩可与文本 Agent 直接对比。
推荐理由
语音与文本能力可在同一套任务上直接对比,还给出了噪音与口音下各厂商的具体失败模式。
来源:Sierra Blog · sierra.ai