동차 Beating 모니터링에 따르면, 천원(千问)이 3세대 이미지 생성 모델 Qwen-Image-3.0을 출시했습니다. 새 모델은 최대 4.5k Token 입력을 지원하며, 복잡한 레이아웃, 작은 글씨, 지식 기반 이미지 생성 능력을 중점적으로 개선했습니다.
이 모델은 긴 명령어 하나로 신문, 시험지, 단편 드라마 스토리보드, 9칸 정보 그래픽을 생성할 수 있습니다. 하나의 이미지에서 여러 주제를 처리할 수 있으며, 동시에 수식, 차트, 인물, 중·영문 텍스트를 생성합니다. 공식적으로 공개된 9칸 그래픽은 9가지 독립적인 콘텐츠를 포함하며, 설명 명령어는 약 3.7k Token 길이입니다.
텍스트 렌더링도 한층 강화되었습니다. 천원은 모델이 10px 크기의 작은 글씨까지 선명하게 생성할 수 있으며, LaTeX 수식, 위·아래 첨자, 손글씨 주석, 신문의 조밀한 레이아웃을 처리할 수 있다고 밝혔습니다. 모공, 머리카락, 종이 및 그림 질감 등의 디테일도 더욱 사실적으로 표현됩니다.
Qwen-Image-3.0은 기본적으로 12개 언어, 100개 이상의 아트 스타일 및 다양한 UI 인터페이스를 지원합니다. 공식적으로는 인터넷 연결을 통한 날씨 지도 생성, 전통 회화 복원, 전문 정보 그래픽 제작 등의 사용 사례도 공개되었습니다. 단순히 예쁜 이미지를 생성하는 것보다, 이번 세대는 PPT, 교육 자료, 디자인 및 콘텐츠 제작 등 실제 활용 시나리오에 더 중점을 두고 있습니다.