Anbieter

Alibaba

28 Releases · Aug 2023 bis Sep 2026 · im Schnitt alle 1,4 Monate · 6 Kategorien

Zurück zur Übersicht

Qwen-7B Aug 2023 Qwen2.5 Sep 2024 Qwen3 Apr 2025 Wan 2.6 Dez 2025 Qwen3.5 Feb 2026 Qwen3.6 Apr 2026 Qwen3.8-Max-Preview Jul 2026 Qwen-Audio-3.0-TTS Jul 2026 Qwen-Image-3.0 Jul 2026 Qwen3.8-Max Aug 2026 Wan 3.0 Aug 2026 Qwen3.8-27B Aug 2026 2024 2025 2026

Für Präsentation und Weitergabe

Als Bild in die Folien legen oder als einzelne HTML-Datei herunterladen und einbauen.

Bild
HTML herunterladen

Alle Releases

Kategorie
  1. Qwen-7B Sprache

    • Alibabas erstes offenes LLM mit frei herunterladbaren Gewichten.
    • 7B auf 2,2 Billionen Tokens, zweisprachig Chinesisch und Englisch.
    • Grundstein der später dominanten Qwen-Familie.

    Reihe Qwen

  2. Qwen1.5 Sprache

    • Sechs Größen von 0,5B bis 72B, direkt in Hugging Face integriert.
    • 32K-Kontext und deutlich bessere Ausrichtung der Chat-Modelle.
    • Machte Qwen breit nutzbar ohne trust_remote_code.

    Reihe Qwen

  3. Qwen2 Sprache

    • Großer Sprung gegenüber 1.5, Unterstützung für 27 Sprachen.
    • Größen von 0,5B bis 72B inklusive MoE-Variante 57B-A14B.
    • Führend in vielen offenen Benchmarks seiner Zeit.

    Reihe Qwen

  4. Qwen2.5 Sprache

    • Breite Familie von 0,5B bis 72B mit deutlich mehr Wissen.
    • Starke Sprünge bei Code und Mathe, plus Coder- und Math-Varianten.
    • Wurde zur weltweiten Standardbasis für offene Feintunings.

    Reihe Qwen

  5. Qwen2.5-Coder Code

    • 32B-Variante erreichte als offenes Coding-Modell GPT-4o-Niveau.
    • Top-Werte bei Code-Generierung und Code-Reparatur (Aider).
    • Lief lokal auf einem Mac und wurde zum Liebling der Entwickler.

    Reihe Qwen

  6. QwQ-32B-Preview Sprache

    • Eines der ersten offenen Reasoning-Modelle, das o1-preview forderte.
    • Zeigte, dass 32B per RL bei Mathe und Code stark denken kann.
    • Apache-2.0 und damit frei für kommerzielle Nutzung.

    Reihe QwQ

  7. Qwen2.5-Max Sprache

    • Großes MoE-Flaggschiff, auf über 20 Billionen Tokens trainiert.
    • Schlug in Benchmarks DeepSeek V3 und forderte GPT-4o heraus.
    • Nur über API, Alibabas Antwort auf den Jahresauftakt 2025.

    Reihe Qwen

  8. Wan 2.1 Video

    • Alibabas offenes Video-Modell unter Apache 2.0, frei nutzbar.
    • Varianten von 1,3B bis 14B für Consumer- bis Profi-Hardware.
    • Spitzenwerte im VBench-Benchmark, starke offene Alternative.

    Reihe Wan

  9. QwQ-32B Sprache

    • Nur 32B, aber auf Augenhöhe mit dem 671B großen DeepSeek-R1.
    • Lief dank RL-Training auf einer einzelnen 24-GB-GPU.
    • Apache-2.0, machte starkes Reasoning lokal verfügbar.

    Reihe QwQ

  10. Qwen3 Sprache

    • Hybrid-Modell mit umschaltbarem Denk- und Schnellmodus.
    • Dichte Modelle bis 32B plus MoE bis 235B-A22B, alle Apache-2.0.
    • Setzte 2025 die Messlatte für offene Modelle neu.

    Reihe Qwen

  11. Qwen3-Coder Code

    • 480B-Coding-MoE (35B aktiv) mit nativem 256K-Kontext.
    • Auf Claude-Sonnet-4-Niveau bei agentischem Programmieren.
    • Kam samt offenem CLI-Tool Qwen Code für Coding-Agenten.

    Reihe Qwen

  12. Wan 2.2 Video

    • Erstes offenes Video-Modell mit Mixture-of-Experts-Architektur.
    • 27B Parameter gesamt, 14B aktiv, für kinoreife Clips.
    • Deutlich größerer Trainingsdatensatz als Wan 2.1.

    Reihe Wan

  13. Qwen-Image Bild

    • Alibabas offenes 20B-MMDiT-Modell, besonders stark bei Bildtext.
    • Hervorragende chinesische und englische Schriftwiedergabe.
    • Mit Qwen-Image-Edit auch präzises, textbasiertes Bildediting.

    Reihe Qwen

  14. Qwen3-Max Sprache

    • Erstes Qwen-Modell mit über 1 Billion Parametern.
    • Auf rund 36 Billionen Tokens trainiert, verfügbar nur über API.
    • Alibabas bisher stärkstes Flaggschiff, auch als Thinking-Variante.

    Reihe Qwen

  15. Wan 2.6 Video

    • Videomodell mit Multi-Shot-Erzählung, nativer Ton-Bild-Synchronisation und Referenz-zu-Video aus einem einzigen Bild.
    • Erzeugt Clips bis 15 Sekunden in 1080p aus Text oder Bild, mit hoher Figuren-Konsistenz.

    Reihe Wan

  16. Qwen3.5 Sprache

    • Neue MoE-Generation mit einem Flaggschiff von 397B Parametern, davon 17B aktiv, in mehreren Wellen bis hinunter zu 0,8B.
    • Offen unter Apache 2.0, nahe an der Frontier-Leistung bei stark reduzierten Rechenkosten, teils auf Consumer-Hardware lauffähig.

    Reihe Qwen

  17. Qwen3.6 Sprache

    • Nachfolgeserie von Qwen3.5, ausgerichtet auf Agenten für den realen Einsatz.
    • Offene MoE-Variante mit 35B Parametern (3B aktiv) neben dem proprietären Plus-Modell und einem agentischen Coding-Flaggschiff.

    Reihe Qwen

  18. Qwen3.8-Max-Preview Multimodal

    • Alibabas neues Spitzenmodell mit 2,4 Billionen Parametern als sparsames Mixture-of-Experts, vorgestellt auf der World AI Conference in Shanghai.
    • Verarbeitet Text, Bilder, Video und Dokumente bei einer Million Token Kontext.
    • Bruch mit der bisherigen Linie: nur über die API nutzbar, ohne herunterladbare Gewichte, ohne Benchmark-Tabellen und ohne Lizenzangabe.

    Reihe Qwen

  19. Qwen-Audio-3.0-TTS Audio

    • Sprachsynthese aus Alibabas Tongyi Lab in den Stufen Flash und Plus, für 16 Sprachen und 20 chinesische Dialektregionen.
    • Die Plus-Stufe übernahm als erstes rein gehostetes Modell aus China die Spitze der Speech Arena von Artificial Analysis.
    • Kostet nach Anbieterangaben etwa ein Drittel des Preises von ElevenLabs.

    Reihe Qwen

  20. Qwen-Image-3.0 Bild

    • Dritte Generation des Qwen-Bildmodells, die Prompts mit bis zu 4500 Token verarbeitet.
    • Setzt lesbare Schrift bis hinunter zu zehn Pixel ins Bild, was für Layouts und Beschriftungen entscheidend ist.
    • Wie die übrigen Juli-Releases von Alibaba nur über die API verfügbar.

    Reihe Qwen

  21. Qwen3.7 Flash Multimodal

    • Günstiges Vision-Sprachmodell aus der Qwen-Reihe mit 1 Million Token Kontext und Eingaben aus Text, Bild und Video.
    • Auf hohe Stückzahlen ausgelegt: 0,03 US-Dollar je Million Eingabe-Token machen es zu einem der billigsten bildfähigen Modelle überhaupt.
    • Gedacht für multimodale Agenten, visuelles Programmieren und die Steuerung von Oberflächen; ohne technischen Bericht veröffentlicht.

    Reihe Qwen Quelle openrouter.ai

  22. Qwen3.8-Max Multimodal

    • Alibabas neues Spitzenmodell mit 2,4 Billionen Parametern in einer Mixture-of-Experts-Architektur. Es nimmt Text, Bilder und Video entgegen und antwortet in Text.
    • Das Kontextfenster fasst eine Million Token, davon bis zu 991.000 Token Eingabe und 131.000 Token Ausgabe.
    • Alibaba nennt 86,6 Punkte in Terminal-Bench 2.1 und 92,6 in GPQA Diamond. Offene Gewichte und ein kleineres Qwen3.8-27B sind angekündigt.

    Reihe Qwen Quelle qwen.ai

  23. Wan 3.0 Video

    • Öffentliche Testfassung von Alibabas Videomodell: 30 Sekunden am Stück, doppelt so lang wie beim Vorgänger.
    • Neben Text, Bild, Ton und Video nimmt es erstmals auch Dokumente an, etwa PDF, Word, Excel und PowerPoint.
    • Eine Automatik schlägt zum Prompt die passende Länge vor.

    Reihe Wan Quelle alizila.com

  24. Wan-Animate-2 Video

    • Offenes Modell unter Apache-2.0-Lizenz, das eine Figur im Bild die Bewegungen aus einem Referenzvideo nachspielen lässt.
    • Es überträgt auch Handbewegungen und Mimik, ohne dass die Figur ihr Aussehen verliert.
    • Eine leichte Variante schafft 24 Bilder je Sekunde und läuft damit live.

    Reihe Wan Quelle github.com

  25. Qwen3.8-27B Multimodal

    • Offenes Modell unter Apache-2.0-Lizenz mit 27 Milliarden Parametern, das Text, Bild und Video versteht.
    • Es läuft lokal auf einer Grafikkarte mit 24 Gigabyte Speicher, quantisiert sogar auf einem Notebook.
    • Trotz der kompakten Größe erreicht es das Niveau eines zehnmal größeren Vorgängermodells.

    Reihe Qwen Quelle alibabacloud.com

  26. HappyShrimp 1.0 Audio

    • Alibabas erstes Musikmodell erzeugt aus einer Textbeschreibung ein fertiges Lied mit Melodie, Arrangement, Text und Gesang.
    • Alle Teile entstehen gemeinsam, statt einzeln erzeugt und danach zusammengesetzt zu werden.
    • Es deckt chinesische Musik, Pop, R&B, Hip-Hop, Rock, Funk, Elektro, Klassik und Jazz ab.

    Quelle musicbusinessworldwide.com

  27. Qwen3.8-Flash-Next Sprache

    • Vorschau auf die Architektur der nächsten Qwen-Reihe. Alibaba gibt die Gewichte frei.
    • Von 180 Milliarden Parametern rechnen nur 6 Milliarden pro Wort mit.
    • Das Training kostete ein Neuntel des Vorgängers Qwen3.7-Plus.

    Reihe Qwen Quelle huggingface.co

  28. Qwen3.8-Max-0902 Multimodal

    • Aktualisierte Fassung des größten Qwen-Modells mit 2,4 Billionen Parametern.
    • Es fasst eine Million Zeichen Kontext.
    • Alibaba bietet es nur über die Schnittstelle an, nicht zum Herunterladen.

    Reihe Qwen Quelle thursdai.news

Gefüllter Punkt: Hauptversion. Offener Punkt: Zwischenstand oder Punkt-Release. Stand der Daten: Sep 2026.