OpenAI GPT-Live-1 以 81.5 分登顶 Artificial Analysis 语音到语音指数,Astra 为委派后端模型
OpenAI 新的全双工语音到语音模型 GPT-Live-1 在 Artificial Analysis 语音到语音指数中首次亮相,使用 Astra 作为委派后端模型时得分 81.5,排名第 1;使用 Sol 低推理配置时得分 80.1,排名第 3。在 Speech Agent Arena 中,Gemini 3.1 Flash Live Minimal 以 1,096 Elo 领先偏好,Grok Voice Think Fast 2.0 High 以 94.6% 的任务成功率领先;GPT-Live-1 两种配置分别排名第 3 和第 4。Tau Voice 智能体性能基准中,GPT-Live-1 的两种配置位列前二。Big Bench Audio 音频推理中,GPT-Live-1 Astra 中等推理得 90.1%,Sol 低推理得 89.0%,落后于 Grok 和 Qwen 的相关模型。速度上,GPT-Live-1 的两配置首次音频时间分别为 1.34 秒和 1.24 秒,慢于 Grok Voice Think Fast 2.0 High 的 0.70 秒;成本上分别为每小时 5.83 美元和 4.47 美元。
推荐理由:该内容汇总了 GPT-Live-1 在不同后端配置下的语音智能体基准成绩,包含偏好、任务成功率、音频推理、速度和成本等对比,适合需要评估实时语音模型表现的开发者参考。