Begriff
Llama 3.3
Llama 3.3 (Dezember 2024) ist Metas offenes 70B-Instruct-Modell — es erreicht 405B-Klasse-Qualitaet bei 70B-Kosten, mit 128K-Kontext und offenen Gewichten.
Llama 3.3 — ausführlicher erklärt
Meta veröffentlichte Llama 3.3 70B Instruct am 6. Dezember 2024 als letztes Modell seines Llama-Release-Zyklus 2024. Es ist ein rein textbasiertes, instruction-getuntes Transformer-Modell mit 70,6 Mrd. Parametern, das Grouped-Query-Attention (GQA) für skalierbarere Inferenz nutzt. Das Kontextfenster umfasst 128K Token, der Wissensstand reicht bis Dezember 2023, und das Training erfolgte auf über 15 Bio. Token öffentlich verfügbarer Daten. Unterstützt werden acht Sprachen, darunter Deutsch, Englisch, Französisch und Spanisch.
Beispiel / Praxisbezug
Der Kern-Vorteil von Llama 3.3: Es zielt auf Ergebnisse der 405B-Klasse bei den Bereitstellungskosten eines 70B-Modells. Laut Meta erzeugt Llama 3.3 70B Antworten nahezu fünfmal kosteneffizienter als das größere Llama 3.1 405B — mit Infrastrukturkosten von etwa 10 Cent pro 1 Mio. Input-Token und 40 Cent pro 1 Mio. Output-Token. Als Modell mit offenen Gewichten ist es frei herunterladbar (Hugging Face) und über Plattformen wie Amazon Bedrock verfügbar; damit eignet es sich für kostensensible Deployments und Self-Hosting.
Abgrenzung
Llama 3.3 ist ein reines Text-Modell und damit enger gefasst als multimodale Modelle. Innerhalb der Llama-Reihe ist es die effizienzoptimierte 70B-Variante, die die Qualität der deutlich größeren 3.1-405B-Generation annähert, ohne deren Rechenlast. Anders als proprietäre Modelle von OpenAI oder Anthropic steht Llama unter Metas offener Community-Lizenz.