AssemblyAI Universal 3.5 Pro 在 15 款模型測試中詞錯誤率為 1.93%
Tarush Agarwal 報告一項語音轉文字基準測試,以相同音訊與流程測試 15 款模型。在 Pipecat FLEURS 的 1,000 段朗讀片段中,AssemblyAI Universal 3.5 Pro 的詞錯誤率為 1.93%,首次輸出文字的中位數時間為 489 毫秒,兩項均為該測試最佳結果。
Tarush Agarwal 報告一項語音轉文字基準測試,以相同音訊與流程測試 15 款模型。在 Pipecat FLEURS 的 1,000 段朗讀片段中,AssemblyAI Universal 3.5 Pro 的詞錯誤率為 1.93%,首次輸出文字的中位數時間為 489 毫秒,兩項均為該測試最佳結果。
Artificial Analysis 報告,StepAudio 3 ASR 的轉錄速度為即時的 88 倍,落後三個更快的系統,接近 ElevenLabs Scribe v2 與 Gemini 3.5 Transcribe,並領先 Fun-Realtime-ASR-preview。
Artificial Analysis 表示,StepFun 的 StepAudio 3 ASR 已可透過 StepFun API 作非串流轉錄,在 AA-WER Index 的詞錯率為 1.7%,與阿里巴巴的 Fun-Realtime-ASR-preview 並列,並由 StepAudio 2.5 ASR 的 4.7% 下降。轉錄速度為即時的 88 倍,費用為每小時 0.40 美元。