Ejecutar en la app
ToshLLM registra la prueba.
Abre Benchmarks → Share with the community en ToshLLM, elige cualquier modelo local y detén el servidor antes de medir para que ambos procesos no compitan por la VRAM.
- Cualquier modelo GGUF local o repartido
- Carga estándar pp512 y tg128
- Tres repeticiones independientes
- Tu GPU y configuración reales