この中国のAI開発企業が開発したV4.1 Flashモデルは、5520億のパラメータを持つフレームワークと専門家混合(MoE)設計に基づいた、全く新しい「因果エンコーダー・デコーダー」アーキテクチャを採用しています。DeepSeekは、このモデルが以前のフラッグシップ製品を性能で上回るだけでなく、推論コストを削減し、実行速度を向上させたと主張しています。