AssemblyAI Universal 3.5 Pro 在 15 个模型测试中词错误率为 1.93%
Tarush Agarwal 报告了一项语音转文字基准测试,15 个模型使用相同音频和流程。在 Pipecat FLEURS 的 1,000 段朗读片段上,AssemblyAI Universal 3.5 Pro 的词错误率为 1.93%,首次出字中位时间为 489 毫秒,两项均为该测试中的最佳结果。
Tarush Agarwal 报告了一项语音转文字基准测试,15 个模型使用相同音频和流程。在 Pipecat FLEURS 的 1,000 段朗读片段上,AssemblyAI Universal 3.5 Pro 的词错误率为 1.93%,首次出字中位时间为 489 毫秒,两项均为该测试中的最佳结果。
Artificial Analysis 报告,StepAudio 3 ASR 的转写速度为实时的 88 倍,落后于三个更快的系统,接近 ElevenLabs Scribe v2 与 Gemini 3.5 Transcribe,并领先于 Fun-Realtime-ASR-preview。
Artificial Analysis 称,StepFun 的 StepAudio 3 ASR 已可通过 StepFun API 进行非流式转写,在 AA-WER Index 上的词错误率为 1.7%,与阿里巴巴的 Fun-Realtime-ASR-preview 并列,低于 StepAudio 2.5 ASR 的 4.7%。其转写速度为实时的 88 倍,价格为每小时 0.40 美元。