Modellreihe · META
Llama
7 Releases · Feb 2023 bis Apr 2025 · im Schnitt alle 4,3 Monate · 2 Kategorien
digitalpfade
digitalpfa.de/zeitstrahl/modell/llama
LLaMA 1
Feb 2023
Llama 2
Jul 2023
Llama 3
Apr 2024
Llama 3.1 405B
Jul 2024
Llama 3.2
Sep 2024
Llama 3.3
Dez 2024
Llama 4
Apr 2025
2024
2025
Alle Releases
Feb 2023
LLaMA 1
Sprache
Metas erste LLaMA-Reihe von 7B bis 65B, zunächst nur für Forschung.
Geleakte Gewichte lösten die Welle offener LLMs überhaupt erst aus.
Effizient trainiert, schlug teils viel größere Modelle wie GPT-3.
Jul 2023
Llama 2
Sprache
Leistungsfähiges, offen nutzbares Modell
Auch kommerziell einsetzbar
Treibt die Open-Source-KI-Welle an
Apr 2024
Llama 3
Sprache
Metas dritte Generation (8B und 70B) mit deutlich besserer Qualität.
Trainiert auf über 15 Billionen Tokens, ein starker Allrounder.
Frei nutzbar, setzte 2024 den Maßstab für offene Modelle.
Jul 2024
Llama 3.1 405B
Sprache
Größtes offenes Llama mit 405B Parametern auf Frontier-Niveau.
128k-Kontext, konkurrenzfähig mit GPT-4 und Claude.
Auch als verbesserte 8B- und 70B-Varianten veröffentlicht.
Sep 2024
Llama 3.2
Multimodal
Erste multimodale Llamas mit Bildverständnis (11B und 90B Vision).
Dazu winzige Text-Modelle (1B, 3B) für Smartphone und Edge.
Brachte Bild-Reasoning in das offene Llama-Ökosystem.
Dez 2024
Llama 3.3
Sprache
70B-Modell mit der Leistung des viel größeren 405B-Vorgängers.
Stark in Reasoning, Mathematik, Code und beim Befolgen von Anweisungen.
Günstig zu betreiben, beliebter Allrounder für offene Deployments.
Apr 2025
Llama 4
Multimodal
Metas erste nativ multimodale Modellfamilie mit Mixture-of-Experts-Architektur (Scout und Maverick).
Scout bot ein extrem langes Kontextfenster von bis zu 10 Millionen Tokens auf einer einzigen GPU.
Als offen gewichtetes Modell wichtig für die Open-Source-Szene, trotz gemischter Aufnahme bei den Benchmarks.