LLaMA 1
Feb 2023
MusicGen
Jun 2023
Llama 2
Jul 2023
Llama 3
Apr 2024
Llama 3.1 405B
Jul 2024
Llama 4
Apr 2025
Muse Spark
Apr 2026
Muse Image
Jul 2026
2024
2025
2026
Für Präsentation und Weitergabe
Als Bild in die Folien legen oder als einzelne HTML-Datei herunterladen und einbauen.
Bild
Alle Releases
Kategorie
Zu dieser Auswahl gibt es keinen Eintrag.
-
LLaMA 1 Sprache
- Metas erste LLaMA-Reihe von 7B bis 65B, zunächst nur für Forschung.
- Geleakte Gewichte lösten die Welle offener LLMs überhaupt erst aus.
- Effizient trainiert, schlug teils viel größere Modelle wie GPT-3.
-
MusicGen Audio
- Steuerbares Musikmodell aus Text- und optionaler Melodie-Vorgabe.
- Erzeugte Musik in einem einzigen, schlanken Sprachmodell.
- Als Open Source weit verbreitet in der Forschung.
-
Voicebox Audio
- Vielseitiges Sprachmodell für Synthese, Editieren und Stilübertragung.
- Konnte Sprachlücken füllen und über Sprachen hinweg klonen.
- Wegen Missbrauchsrisiko bewusst nicht veröffentlicht.
-
Llama 2 Sprache
- Leistungsfähiges, offen nutzbares Modell
- Auch kommerziell einsetzbar
- Treibt die Open-Source-KI-Welle an
-
Code Llama Code
- Auf Llama 2 basierende Code-Spezialisten von 7B bis 70B.
- Fill-in-the-Middle, lange Kontexte und Python-Spezialvarianten.
- Frei nutzbar, Basis vieler offener Coding-Werkzeuge.
-
AudioCraft Audio
- Bündelte MusicGen, AudioGen und EnCodec in einem Framework.
- Erzeugte Musik und Soundeffekte aus Textbeschreibungen.
- Als Open Source ein Baukasten für die Audio-Forschung.
-
Llama 3 Sprache
- Metas dritte Generation (8B und 70B) mit deutlich besserer Qualität.
- Trainiert auf über 15 Billionen Tokens, ein starker Allrounder.
- Frei nutzbar, setzte 2024 den Maßstab für offene Modelle.
-
Llama 3.1 405B Sprache
- Größtes offenes Llama mit 405B Parametern auf Frontier-Niveau.
- 128k-Kontext, konkurrenzfähig mit GPT-4 und Claude.
- Auch als verbesserte 8B- und 70B-Varianten veröffentlicht.
-
Llama 3.2 Multimodal
- Erste multimodale Llamas mit Bildverständnis (11B und 90B Vision).
- Dazu winzige Text-Modelle (1B, 3B) für Smartphone und Edge.
- Brachte Bild-Reasoning in das offene Llama-Ökosystem.
-
Llama 3.3 Sprache
- 70B-Modell mit der Leistung des viel größeren 405B-Vorgängers.
- Stark in Reasoning, Mathematik, Code und beim Befolgen von Anweisungen.
- Günstig zu betreiben, beliebter Allrounder für offene Deployments.
-
Llama 4 Multimodal
- Metas erste nativ multimodale Modellfamilie mit Mixture-of-Experts-Architektur (Scout und Maverick).
- Scout bot ein extrem langes Kontextfenster von bis zu 10 Millionen Tokens auf einer einzigen GPU.
- Als offen gewichtetes Modell wichtig für die Open-Source-Szene, trotz gemischter Aufnahme bei den Benchmarks.
-
Muse Spark Multimodal
- Erstes Modell der Meta Superintelligence Labs und Bruch mit der offenen Llama-Linie: proprietär, dafür kostenlos in der Meta-AI-App.
- Nativ multimodales Reasoning mit Werkzeugnutzung, visueller Gedankenkette und Multi-Agenten-Orchestrierung in drei Modi (Instant, Thinking, Contemplating).
- Klein und schnell ausgelegt, stark bei Wissenschaft, Mathematik und agentischen Aufgaben.
-
Muse Spark 1.1 Multimodal
- Update von Muse Spark mit deutlich besserem Programmieren, Reasoning und Video-Beschreiben; treibt den Meta-AI-Assistenten an.
- In der Public Preview über die API verfügbar und aggressiv niedrig bepreist gegen OpenAI und Anthropic.
-
Muse Image Bild
- Erstes eigenes Bildmodell von Meta Superintelligence Labs, kostenlos in der Meta-AI-App, in Instagram Stories und in WhatsApp.
- Denkt vor der Generierung über den Prompt nach, mischt mehrere Vorlagenfotos und erlaubt Bearbeitung per Zeichnen direkt im Bild.
- Der Rückgriff auf Fotos der Nutzerinnen und Nutzer als Referenz sorgte direkt zum Start für Kritik.
-
Muse Video (Vorschau) Video
- Metas erstes Videomodell, zum Start nur als Vorschau angekündigt und noch nicht allgemein verfügbar.
- Erzeugt Ton nicht nachträglich, sondern komponiert Dialog, Ambiente und Effekte gemeinsam mit den Bildern.
- Debütierte in der Text-zu-Video-Arena auf Platz drei nach menschlicher Präferenz.
Gefüllter Punkt: Hauptversion. Offener Punkt: Zwischenstand oder Punkt-Release. Stand der Daten: Jul 2026.