Svmuu 소식: 알리바바 Qwen 팀은 7월 21일 Qwen Image 3.0을 출시했다. 이 모델은 최대 4,500 토큰의 명령어 입력을 지원하며, 이는 이전 세대의 처리 용량의 4.5배에 달한다. 또한 한 번에 신문, 스토리보드, 정보가 밀집된 인포그래픽 그리드 등 복잡한 레이아웃을 생성할 수 있다.
Qwen 팀은 Qwen Image 3.0이 10px의 작은 글씨도 정밀하게 렌더링할 수 있어 모공, 머리카락 등의 세부 사항을 표현할 수 있으며, LaTeX 수식과 12개 언어의 네이티브 렌더링을 지원해 웹페이지, 게임, 라이브 스트리밍 등 주요 인터페이스를 시뮬레이션할 수 있다고 밝혔다.
Qwen Image 3.0은 chat.qwen.ai에서 API 시범 서비스를 시작했으며, API 요금은 아직 공개되지 않았다. 이번 출시에서는 모델 가중치, 벤치마크 표 또는 기술 보고서는 공개되지 않았다.