Meta: Llama 3.3 70B Instruct
Anbieter: meta-llama. Offene Gewichte
- Eingabepreis
- $0,10
- pro 1 Mio. Tokens
- Ausgabepreis
- $0,32
- pro 1 Mio. Tokens
- Kontextfenster
- 131K
- Tokens
- Qualität
- 1.274
- #273 auf LMArena
- Größe
- 71B
- Parameter
- Downloads
- 354,9 Tsd.
- auf Hugging Face, letzte 30 Tage
Läuft es lokal?
Schätzung für die Q4_K_M-Version mit 8K Kontext. Eigene Karte und Einstellungen wählst du im Rechner.
- NVIDIA GeForce RTX 40608 GBLäuft, aber langsam1,0–1,4 Tokens/s
- NVIDIA GeForce RTX 306012 GBLäuft, aber langsam1,1–1,5 Tokens/s
- NVIDIA GeForce RTX 4060 Ti 16 GB16 GBLäuft, aber langsam1,2–1,6 Tokens/s
- NVIDIA GeForce RTX 409024 GBLäuft, aber langsam1,7–2,4 Tokens/s
- NVIDIA GeForce RTX 509032 GBLäuft, aber langsam2,8–3,9 Tokens/s
- Apple M1 Pro 32 GB32 GBLäuft nicht—
Preise: OpenRouter, aktualisiert am 8. Okt. 2026. Qualität: LMArena (CC BY 4.0), Rangliste vom 2. Okt. 2026. Modellseite auf Hugging Face