Meta: Llama 3.1 70B Instruct

Anbieter: meta-llama. Offene Gewichte

Eingabepreis
$0,40
pro 1 Mio. Tokens
Ausgabepreis
$0,40
pro 1 Mio. Tokens
Kontextfenster
131K
Tokens
Qualität
1.261
#287 auf LMArena
Größe
71B
Parameter
Downloads
86 Tsd.
auf Hugging Face, letzte 30 Tage

Läuft es lokal?

Schätzung für die Q4_K_M-Version mit 8K Kontext. Eigene Karte und Einstellungen wählst du im Rechner.

  • NVIDIA GeForce RTX 40608 GBLäuft, aber langsam1,0–1,4 Tokens/s
  • NVIDIA GeForce RTX 306012 GBLäuft, aber langsam1,1–1,5 Tokens/s
  • NVIDIA GeForce RTX 4060 Ti 16 GB16 GBLäuft, aber langsam1,2–1,6 Tokens/s
  • NVIDIA GeForce RTX 409024 GBLäuft, aber langsam1,7–2,4 Tokens/s
  • NVIDIA GeForce RTX 509032 GBLäuft, aber langsam2,8–3,9 Tokens/s
  • Apple M1 Pro 32 GB32 GBLäuft nicht—
Meinen Rechner prüfen

Preise: OpenRouter, aktualisiert am 8. Okt. 2026. Qualität: LMArena (CC BY 4.0), Rangliste vom 2. Okt. 2026. Modellseite auf Hugging Face