Modellreihe · META

Llama

7 Releases · Feb 2023 bis Apr 2025 · im Schnitt alle 4,3 Monate · 2 Kategorien

digitalpfade digitalpfa.de/zeitstrahl/modell/llama
LLaMA 1 Feb 2023 Llama 2 Jul 2023 Llama 3 Apr 2024 Llama 3.1 405B Jul 2024 Llama 3.2 Sep 2024 Llama 3.3 Dez 2024 Llama 4 Apr 2025 2024 2025

Alle Releases

  1. LLaMA 1 Sprache

    • Metas erste LLaMA-Reihe von 7B bis 65B, zunächst nur für Forschung.
    • Geleakte Gewichte lösten die Welle offener LLMs überhaupt erst aus.
    • Effizient trainiert, schlug teils viel größere Modelle wie GPT-3.

  2. Llama 2 Sprache

    • Leistungsfähiges, offen nutzbares Modell
    • Auch kommerziell einsetzbar
    • Treibt die Open-Source-KI-Welle an

  3. Llama 3 Sprache

    • Metas dritte Generation (8B und 70B) mit deutlich besserer Qualität.
    • Trainiert auf über 15 Billionen Tokens, ein starker Allrounder.
    • Frei nutzbar, setzte 2024 den Maßstab für offene Modelle.

  4. Llama 3.1 405B Sprache

    • Größtes offenes Llama mit 405B Parametern auf Frontier-Niveau.
    • 128k-Kontext, konkurrenzfähig mit GPT-4 und Claude.
    • Auch als verbesserte 8B- und 70B-Varianten veröffentlicht.

  5. Llama 3.2 Multimodal

    • Erste multimodale Llamas mit Bildverständnis (11B und 90B Vision).
    • Dazu winzige Text-Modelle (1B, 3B) für Smartphone und Edge.
    • Brachte Bild-Reasoning in das offene Llama-Ökosystem.

  6. Llama 3.3 Sprache

    • 70B-Modell mit der Leistung des viel größeren 405B-Vorgängers.
    • Stark in Reasoning, Mathematik, Code und beim Befolgen von Anweisungen.
    • Günstig zu betreiben, beliebter Allrounder für offene Deployments.

  7. Llama 4 Multimodal

    • Metas erste nativ multimodale Modellfamilie mit Mixture-of-Experts-Architektur (Scout und Maverick).
    • Scout bot ein extrem langes Kontextfenster von bis zu 10 Millionen Tokens auf einer einzigen GPU.
    • Als offen gewichtetes Modell wichtig für die Open-Source-Szene, trotz gemischter Aufnahme bei den Benchmarks.