models
Qwen-Image-3.0-Pro: Alibabas neues Bildmodell will mehr als nur huebsch aussehen
Alibaba hat mit Qwen-Image-3.0-Pro ein neues Bildgenerierungsmodell auf QwenCloud veröffentlicht, das explizit den Sprung von “gut aussehend” zu “nützlich” antritt. Das Modell unterstützt sowohl Text-to-Image als auch Image-to-Image und kann bis zu 4.500 Tokens pro Prompt verarbeiten – genug für komplexe Layouts wie Zeitungsseiten, Storyboards, Menüs oder Klausurbögen in einem einzigen Durchgang.
Besonders interessant sind die Detail- und Textfähigkeiten: Qwen-Image-3.0-Pro rendert Text ab 10px Größe präzise und soll feinste Details wie Mimik, Poren und einzelne Haarsträhnen bis hin zu fotorealistischer Qualität abbilden. Native Unterstützung für 12 Sprachen und über 20 Schriftarten sowie die realistische Simulation von Web- und Game-UIs sollen das Modell zu einem echten Produktivwerkzeug machen, nicht nur zu einem Spielzeug.
Auf API-Ebene bietet das Modell die übliche Qwen-Feature-Palette: Function Calling, strukturierte Outputs, Context Cache für längere Kontexte, Batch-Verarbeitung, Web Search Integration und Fine-Tuning. Der Aufruf erfolgt über die DashScope-API mit einem simplen cURL-Kommando. Mit prompt_extend: true lassen sich kurze Prompts automatisch anreichern. Wer multilinguale Bildgenerierung mit präzisem Text-Rendering braucht, sollte sich Qwen-Image-3.0-Pro genauer ansehen.