Did Codex Reset
GitHub

QQ·微信群

DeepLearning.AI 於 The Batch 詳解 DeepSeek 快取縮減與 Flash 基準測試表現

DeepLearning.AI

DeepLearning.AI 於本週的 The Batch 發布了關於 DeepSeek 的技術分析,重點探討 AI Agent 的記憶體佔用優化。報告指出,DeepSeek 將每個 token 的快取降至 890 位元組,比 DeepSeek-V1 縮小了 437 倍。

分析亦指出,當輸入上下文由 4K 擴展至 1M token 時,每個輸出 token 的運算量增加了 25%。在基準測試評估中,Flash 於 AA Index 取得 39 分,高於 V4-Pro 的 36 分;每個任務的報告成本分別為 0.27 美元與 0.67 美元。