LLaMA 1
Feb 2023
MusicGen
Jun 2023
Llama 2
Jul 2023
Llama 3
Apr 2024
Llama 3.1 405B
Jul 2024
Llama 4
Apr 2025
Muse Spark
Apr 2026
Muse Image
Jul 2026
Muse Spark 1.2
Aug 2026
Muse Glimmer
Aug 2026
Muse Voice Transcribe
Sep 2026
Muse Spark 1.3
Sep 2026
2024
2025
2026
Für Präsentation und Weitergabe
Als Bild in die Folien legen oder als einzelne HTML-Datei herunterladen und einbauen.
Bild
Alle Releases
Kategorie
Zu dieser Auswahl gibt es keinen Eintrag.
-
LLaMA 1 Sprache
- Metas erste LLaMA-Reihe von 7B bis 65B, zunächst nur für Forschung.
- Geleakte Gewichte lösten die Welle offener LLMs überhaupt erst aus.
- Effizient trainiert, schlug teils viel größere Modelle wie GPT-3.
-
MusicGen Audio
- Steuerbares Musikmodell aus Text- und optionaler Melodie-Vorgabe.
- Erzeugte Musik in einem einzigen, schlanken Sprachmodell.
- Als Open Source weit verbreitet in der Forschung.
-
Voicebox Audio
- Vielseitiges Sprachmodell für Synthese, Editieren und Stilübertragung.
- Konnte Sprachlücken füllen und über Sprachen hinweg klonen.
- Wegen Missbrauchsrisiko bewusst nicht veröffentlicht.
-
Llama 2 Sprache
- Leistungsfähiges, offen nutzbares Modell
- Auch kommerziell einsetzbar
- Treibt die Open-Source-KI-Welle an
-
Code Llama Code
- Auf Llama 2 basierende Code-Spezialisten von 7B bis 70B.
- Fill-in-the-Middle, lange Kontexte und Python-Spezialvarianten.
- Frei nutzbar, Basis vieler offener Coding-Werkzeuge.
-
AudioCraft Audio
- Bündelte MusicGen, AudioGen und EnCodec in einem Framework.
- Erzeugte Musik und Soundeffekte aus Textbeschreibungen.
- Als Open Source ein Baukasten für die Audio-Forschung.
-
Llama 3 Sprache
- Metas dritte Generation (8B und 70B) mit deutlich besserer Qualität.
- Trainiert auf über 15 Billionen Tokens, ein starker Allrounder.
- Frei nutzbar, setzte 2024 den Maßstab für offene Modelle.
-
Llama 3.1 405B Sprache
- Größtes offenes Llama mit 405B Parametern auf Frontier-Niveau.
- 128k-Kontext, konkurrenzfähig mit GPT-4 und Claude.
- Auch als verbesserte 8B- und 70B-Varianten veröffentlicht.
-
Llama 3.2 Multimodal
- Erste multimodale Llamas mit Bildverständnis (11B und 90B Vision).
- Dazu winzige Text-Modelle (1B, 3B) für Smartphone und Edge.
- Brachte Bild-Reasoning in das offene Llama-Ökosystem.
-
Llama 3.3 Sprache
- 70B-Modell mit der Leistung des viel größeren 405B-Vorgängers.
- Stark in Reasoning, Mathematik, Code und beim Befolgen von Anweisungen.
- Günstig zu betreiben, beliebter Allrounder für offene Deployments.
-
Llama 4 Multimodal
- Metas erste nativ multimodale Modellfamilie mit Mixture-of-Experts-Architektur (Scout und Maverick).
- Scout bot ein extrem langes Kontextfenster von bis zu 10 Millionen Tokens auf einer einzigen GPU.
- Als offen gewichtetes Modell wichtig für die Open-Source-Szene, trotz gemischter Aufnahme bei den Benchmarks.
-
Muse Spark Multimodal
- Erstes Modell der Meta Superintelligence Labs und Bruch mit der offenen Llama-Linie: proprietär, dafür kostenlos in der Meta-AI-App.
- Nativ multimodales Reasoning mit Werkzeugnutzung, visueller Gedankenkette und Multi-Agenten-Orchestrierung in drei Modi (Instant, Thinking, Contemplating).
- Klein und schnell ausgelegt, stark bei Wissenschaft, Mathematik und agentischen Aufgaben.
-
Muse Spark 1.1 Multimodal
- Update von Muse Spark mit deutlich besserem Programmieren, Reasoning und Video-Beschreiben; treibt den Meta-AI-Assistenten an.
- In der Public Preview über die API verfügbar und aggressiv niedrig bepreist gegen OpenAI und Anthropic.
-
Muse Image Bild
- Erstes eigenes Bildmodell von Meta Superintelligence Labs, kostenlos in der Meta-AI-App, in Instagram Stories und in WhatsApp.
- Denkt vor der Generierung über den Prompt nach, mischt mehrere Vorlagenfotos und erlaubt Bearbeitung per Zeichnen direkt im Bild.
- Der Rückgriff auf Fotos der Nutzerinnen und Nutzer als Referenz sorgte direkt zum Start für Kritik.
-
Muse Video (Vorschau) Video
- Metas erstes Videomodell, zum Start nur als Vorschau angekündigt und noch nicht allgemein verfügbar.
- Erzeugt Ton nicht nachträglich, sondern komponiert Dialog, Ambiente und Effekte gemeinsam mit den Bildern.
- Debütierte in der Text-zu-Video-Arena auf Platz drei nach menschlicher Präferenz.
-
Muse Spark 1.2 Code
- Meta schärft sein stärkstes Modell für das Programmieren nach. Der Kontext bleibt bei 1 Million Token.
- Das Training läuft an ganzen Code-Sammlungen und langen Projekten statt an einzelnen Aufgaben.
- Zeitgleich erscheint Muse Code, ein Agent für die Kommandozeile, der mehrere Unteragenten parallel führt.
-
Muse Glimmer Multimodal
- Meta gibt die Gewichte eines Modells mit 30 Milliarden Parametern unter Apache 2.0 frei.
- Es läuft örtlich auf einem Rechner mit einer einzelnen Grafikkarte und verarbeitet Text und Bilder.
- Der Zweck sind dauerhaft laufende Agenten auf dem eigenen Gerät, ohne Weg über die Cloud.
-
Muse Voice Transcribe Audio
- Erstes Echtzeit-Transkriptionsmodell von Meta. Es schreibt beim Sprechen mit.
- Es unterscheidet mehr als 20 Stimmen in einer Aufnahme.
- Die Fehlerquote liegt bei 3,1 Prozent. Eine Stunde kostet 18 Cent.
-
Muse Spark 1.3 Code
- Metas Modell für selbstständig arbeitende Assistenten und für Code.
- Es braucht rund 20 Prozent weniger Werkzeugaufrufe als Muse Spark 1.2.
- Es fragt nach, wenn eine Aufgabe unklar ist, und bestätigt folgenreiche Schritte vorher.
Gefüllter Punkt: Hauptversion. Offener Punkt: Zwischenstand oder Punkt-Release. Stand der Daten: Sep 2026.