Meta: Llama 3.1 70B Instruct
Creado por meta-llama. Pesos abiertos
- Precio de entrada
- $0,40
- por 1M de tokens
- Precio de salida
- $0,40
- por 1M de tokens
- Ventana de contexto
- 131K
- tokens
- Calidad
- 1.261
- #287 en LMArena
- Tamaño
- 71B
- parámetros
- Descargas
- 86 mil
- en Hugging Face, últimos 30 días
¿Funciona en local?
Estimación para la versión Q4_K_M con contexto de 8K. Elige tu tarjeta y ajustes en la calculadora.
- NVIDIA GeForce RTX 40608 GBFunciona, pero lento1,0 a 1,4 tokens/s
- NVIDIA GeForce RTX 306012 GBFunciona, pero lento1,1 a 1,5 tokens/s
- NVIDIA GeForce RTX 4060 Ti 16 GB16 GBFunciona, pero lento1,2 a 1,6 tokens/s
- NVIDIA GeForce RTX 409024 GBFunciona, pero lento1,7 a 2,4 tokens/s
- NVIDIA GeForce RTX 509032 GBFunciona, pero lento2,8 a 3,9 tokens/s
- Apple M1 Pro 32 GB32 GBNo funciona—
Precios: OpenRouter, actualizados el 8 oct 2026. Calidad: LMArena (CC BY 4.0), clasificación del 2 oct 2026. Página del modelo en Hugging Face