Sofortantwort
Llama einfach erklärt
Metas Open-Weight-Sprachmodelle für Forschung und eigene Anwendungen.
- Kurz gesagt
- Open-Weight-Modell: Gewichte frei verfügbar für Forschung und kommerzielle Nutzung
- Typischer Einsatz
- Self-Hosted LLM, Custom Fine-Tuning, Forschung
- Wichtig zu wissen
- Großes Ökosystem mit vielen Community-Varianten und Werkzeugen für Anpassung und Inferenz
Llama im Überblick
Llama ist Metas Familie von Sprachmodellen mit öffentlich verfügbaren Gewichten. Seit der Veröffentlichung von Llama 1 im Februar 2023 hat Meta das Open-Weight-Ökosystem maßgeblich geprägt. Die aktuelle Generation Llama 4 setzt auf eine Mixture-of-Experts-Architektur und ist nativ multimodal.
Llama-Evolution:
2023-02: Llama 1 → 7B–65B, nur Forschung
2023-07: Llama 2 → 7B–70B, kommerziell nutzbar
2024-04: Llama 3 → 8B–70B, deutlicher Qualitätssprung
2024-07: Llama 3.1 → 8B–405B, erstmals >400B Open Weight
2024-09: Llama 3.2 → 1B–90B, multimodal + Edge-Modelle
2025-01: Llama 3.3 → 8B–70B, optimiert, Reasoning verbessert
2025-04: Llama 4 → Scout & Maverick (MoE, multimodal, Scout mit bis zu 10M Kontext)
Ökosystem
Llama hat ein großes Ökosystem für Anpassung und lokale Inferenz:
| Bereich | Beispiele |
|---|---|
| Fine-Tuned-Varianten | Zahlreiche Community-Modelle auf Hugging Face |
| Spezialisiert | Code Llama, Llama Guard, Med-Llama |
| Inference-Engines | llama.cpp, vLLM, TGI, Ollama |
| Fine-Tuning-Tools | LoRA, QLoRA, Axolotl, Unsloth |
| Quantisierung | GGUF, GPTQ, AWQ, EXL2 |
Lokal betreiben
# Mit Ollama (2 Befehle)
ollama pull llama4
ollama run llama4 "Erkläre Transformer in 3 Sätzen"
# Als API-Server
ollama serve # localhost:11434 – OpenAI-kompatible API
Llama vs. andere Open-Weight-Modelle
| Modell | Anbieter | Stärke | Schwäche |
|---|---|---|---|
| Llama 4 | Meta | Multimodalität, MoE und Anpassbarkeit | Lizenz und Infrastruktur prüfen |
| Mistral-Modelle | Mistral | Open Weight und kommerzielle Optionen | Modell und Lizenz einzeln prüfen |
| Qwen-Modelle | Alibaba | Breites, mehrsprachiges Angebot | Hosting und Lizenz einzeln prüfen |
| Gemma-Modelle | Kompakte Modellvarianten | Eignung und Grenzen je Variante prüfen | |
| DeepSeek-Modelle | DeepSeek | Unterschiedliche Sprach- und Reasoning-Modelle | Herkunft, Hosting und Lizenz prüfen |