跳到正文
原文
Sierra Blog· Soham Ray, Keshav Dhandhania, Victor Barres·· 2026-05-02精选AI 评分64

Sierra 发布 𝜏-voice 基准,在真实语音条件下评测实时语音 Agent

𝜏-voice: benchmarking real-time voice agents on real-world tasks

AI 导读

Sierra 团队推出 𝜏-voice 基准,将 𝜏-bench 的 278 个客服任务与全双工实时语音、可控真实音频结合,任务、工具和评估器与文本版逐字节一致,语音成绩可与文本 Agent 直接对比。

推荐理由

语音与文本能力可在同一套任务上直接对比,还给出了噪音与口音下各厂商的具体失败模式。

来源:Sierra Blog · sierra.ai