이 중국 인공지능 개발사의 V4.1 Flash 모델은 5,520억 개의 매개변수를 가진 프레임워크를 기반으로 하는 완전히 새로운 "인과 인코더-디코더" 아키텍처를 채택했으며, 전문가 혼합(MoE) 설계를 사용합니다. DeepSeek은 이 모델이 이전 플래그십 제품의 성능을 능가할 뿐만 아니라 추론 비용을 절감하고 실행 속도를 향상시켰다고 주장합니다.