Resumen de rendimiento comunitario

Llama 3.3 70B

2 configuraciones de GPU medidas con este modelo. Compara el hardware, las cuantizaciones y cada resultado registrado.

2 pruebas firmadas · 0 verificadas · 2 testers
Mediana de procesamiento180.93tok/s · 70.36 a 291.49
Mediana de generación9.31tok/s · 8.6 a 10.01
Configuraciones2Q4_K_M · UD-IQ1_M
Última observación8 octGCN / Vega · RDNA 2

Qué muestran los resultados

Una vista clara.
Cada prueba registrada.

Las mediciones de hardware y modelos comparables se presentan juntas. Las medianas muestran el rendimiento habitual y cada prueba firmada sigue disponible para consultar y compartir.

Hardware probado2 grupos
AMD Radeon Pro Vega II Duo1 prueba→AMD Radeon PRO W6800X Duo ×21 prueba→
macOS

macOS 15.7.7 Sequoia · macOS 26.6.1 Tahoe

Pruebas registradas

Consulta cada prueba.

Abre cualquier resultado para revisar el hardware exacto, la configuración del modelo, las medidas y los detalles del envío.

1 a 8 de 2 configuraciones

Benchmark verificado Aporte comunitario
Modelo / cuant.HardwareArquitecturaPromptGeneraciónOrigen
Llama 3.3 70BQ4_K_M · Dense · Signed ToshLLM app · amd-gpu · Metal · comparación
GCN / Vega
70.36tok/s
10.01tok/s
warriordr78 oct 2026
Llama 3.3 70BUD-IQ1_M · Dense · Signed ToshLLM app · amd-gpu · Metal · comparación
RDNA 2
291.49tok/s
8.6tok/s
walruns22 ago 2026