DeepLearning.AI, The Batch 통해 DeepSeek의 캐시 절감 및 Flash 벤치마크 결과 상세 분석
DeepLearning.AI는 The Batch에서 DeepSeek의 아키텍처를 분석하며, 토큰당 캐시가 890바이트로 DeepSeek-V1 대비 437배 축소되었다고 전했다. 또한 입력 토큰이 4K에서 1M으로 늘어날 때 출력 토큰당 연산량이 25% 증가하며, AA Index에서 Flash가 V4-Pro를 앞섰다고 짚었다.