Qwen2.5 72B Instruct
Anbieter: qwen. Offene Gewichte
- Eingabepreis
- $0,36
- pro 1 Mio. Tokens
- Ausgabepreis
- $0,40
- pro 1 Mio. Tokens
- Kontextfenster
- 33K
- Tokens
- Qualität
- 1.269
- #279 auf LMArena
- Größe
- 73B
- Parameter
- Downloads
- 287,3 Tsd.
- auf Hugging Face, letzte 30 Tage
Läuft es lokal?
Schätzung für die Q4_K_M-Version mit 8K Kontext. Eigene Karte und Einstellungen wählst du im Rechner.
- NVIDIA GeForce RTX 40608 GBLäuft, aber langsam0,9–1,3 Tokens/s
- NVIDIA GeForce RTX 306012 GBLäuft, aber langsam1,0–1,4 Tokens/s
- NVIDIA GeForce RTX 4060 Ti 16 GB16 GBLäuft, aber langsam1,1–1,6 Tokens/s
- NVIDIA GeForce RTX 409024 GBLäuft, aber langsam1,6–2,3 Tokens/s
- NVIDIA GeForce RTX 509032 GBLäuft, aber langsam2,5–3,5 Tokens/s
- Apple M1 Pro 32 GB32 GBLäuft nicht—
Preise: OpenRouter, aktualisiert am 8. Okt. 2026. Qualität: LMArena (CC BY 4.0), Rangliste vom 2. Okt. 2026. Modellseite auf Hugging Face