Modellreihe · ALIBABA

Qwen

16 Releases · Aug 2023 bis Jul 2026 · im Schnitt alle 2,3 Monate · 5 Kategorien

digitalpfade digitalpfa.de/zeitstrahl/modell/qwen
Qwen-7B Aug 2023 Qwen2.5 Sep 2024 Qwen3 Apr 2025 Qwen3.5 Feb 2026 Qwen3.6 Apr 2026 Qwen3.8-Max-Preview Jul 2026 Qwen-Audio-3.0-TTS Jul 2026 Qwen-Image-3.0 Jul 2026 2024 2025 2026

Alle Releases

  1. Qwen-7B Sprache

    • Alibabas erstes offenes LLM mit frei herunterladbaren Gewichten.
    • 7B auf 2,2 Billionen Tokens, zweisprachig Chinesisch und Englisch.
    • Grundstein der später dominanten Qwen-Familie.

  2. Qwen1.5 Sprache

    • Sechs Größen von 0,5B bis 72B, direkt in Hugging Face integriert.
    • 32K-Kontext und deutlich bessere Ausrichtung der Chat-Modelle.
    • Machte Qwen breit nutzbar ohne trust_remote_code.

  3. Qwen2 Sprache

    • Großer Sprung gegenüber 1.5, Unterstützung für 27 Sprachen.
    • Größen von 0,5B bis 72B inklusive MoE-Variante 57B-A14B.
    • Führend in vielen offenen Benchmarks seiner Zeit.

  4. Qwen2.5 Sprache

    • Breite Familie von 0,5B bis 72B mit deutlich mehr Wissen.
    • Starke Sprünge bei Code und Mathe, plus Coder- und Math-Varianten.
    • Wurde zur weltweiten Standardbasis für offene Feintunings.

  5. Qwen2.5-Coder Code

    • 32B-Variante erreichte als offenes Coding-Modell GPT-4o-Niveau.
    • Top-Werte bei Code-Generierung und Code-Reparatur (Aider).
    • Lief lokal auf einem Mac und wurde zum Liebling der Entwickler.

  6. Qwen2.5-Max Sprache

    • Großes MoE-Flaggschiff, auf über 20 Billionen Tokens trainiert.
    • Schlug in Benchmarks DeepSeek V3 und forderte GPT-4o heraus.
    • Nur über API, Alibabas Antwort auf den Jahresauftakt 2025.

  7. Qwen3 Sprache

    • Hybrid-Modell mit umschaltbarem Denk- und Schnellmodus.
    • Dichte Modelle bis 32B plus MoE bis 235B-A22B, alle Apache-2.0.
    • Setzte 2025 die Messlatte für offene Modelle neu.

  8. Qwen3-Coder Code

    • 480B-Coding-MoE (35B aktiv) mit nativem 256K-Kontext.
    • Auf Claude-Sonnet-4-Niveau bei agentischem Programmieren.
    • Kam samt offenem CLI-Tool Qwen Code für Coding-Agenten.

  9. Qwen-Image Bild

    • Alibabas offenes 20B-MMDiT-Modell, besonders stark bei Bildtext.
    • Hervorragende chinesische und englische Schriftwiedergabe.
    • Mit Qwen-Image-Edit auch präzises, textbasiertes Bildediting.

  10. Qwen3-Max Sprache

    • Erstes Qwen-Modell mit über 1 Billion Parametern.
    • Auf rund 36 Billionen Tokens trainiert, verfügbar nur über API.
    • Alibabas bisher stärkstes Flaggschiff, auch als Thinking-Variante.

  11. Qwen3.5 Sprache

    • Neue MoE-Generation mit einem Flaggschiff von 397B Parametern, davon 17B aktiv, in mehreren Wellen bis hinunter zu 0,8B.
    • Offen unter Apache 2.0, nahe an der Frontier-Leistung bei stark reduzierten Rechenkosten, teils auf Consumer-Hardware lauffähig.

  12. Qwen3.6 Sprache

    • Nachfolgeserie von Qwen3.5, ausgerichtet auf Agenten für den realen Einsatz.
    • Offene MoE-Variante mit 35B Parametern (3B aktiv) neben dem proprietären Plus-Modell und einem agentischen Coding-Flaggschiff.

  13. Qwen3.8-Max-Preview Multimodal

    • Alibabas neues Spitzenmodell mit 2,4 Billionen Parametern als sparsames Mixture-of-Experts, vorgestellt auf der World AI Conference in Shanghai.
    • Verarbeitet Text, Bilder, Video und Dokumente bei einer Million Token Kontext.
    • Bruch mit der bisherigen Linie: nur über die API nutzbar, ohne herunterladbare Gewichte, ohne Benchmark-Tabellen und ohne Lizenzangabe.

  14. Qwen-Audio-3.0-TTS Audio

    • Sprachsynthese aus Alibabas Tongyi Lab in den Stufen Flash und Plus, für 16 Sprachen und 20 chinesische Dialektregionen.
    • Die Plus-Stufe übernahm als erstes rein gehostetes Modell aus China die Spitze der Speech Arena von Artificial Analysis.
    • Kostet nach Anbieterangaben etwa ein Drittel des Preises von ElevenLabs.

  15. Qwen-Image-3.0 Bild

    • Dritte Generation des Qwen-Bildmodells, die Prompts mit bis zu 4500 Token verarbeitet.
    • Setzt lesbare Schrift bis hinunter zu zehn Pixel ins Bild, was für Layouts und Beschriftungen entscheidend ist.
    • Wie die übrigen Juli-Releases von Alibaba nur über die API verfügbar.

  16. Qwen3.7 Flash Multimodal

    • Günstiges Vision-Sprachmodell aus der Qwen-Reihe mit 1 Million Token Kontext und Eingaben aus Text, Bild und Video.
    • Auf hohe Stückzahlen ausgelegt: 0,03 US-Dollar je Million Eingabe-Token machen es zu einem der billigsten bildfähigen Modelle überhaupt.
    • Gedacht für multimodale Agenten, visuelles Programmieren und die Steuerung von Oberflächen; ohne technischen Bericht veröffentlicht.

    Quelle openrouter.ai