Aporte comunitario

Registro de rendimiento · Dense

Models Zai Org GLM 4.6V Flash

Q4_K_M en AMD Radeon GFX10, 16 GB con macOS 15.7.8 Sequoia

RENDIMIENTO / TOKENS POR SEGUNDORDNA
Procesamiento1131.82tok/s
#62 en el índice
Generación de tokens72.12tok/s
#62 en el índice

Datos de la prueba

Contexto para interpretar los resultados.

CuantizaciónQ4_K_MVariante enviada
Arquitectura de GPURDNAMotor Metal
Contexto de prueba512tokens de prompt
Familia del modeloDenseSigned ToshLLM app · amd-gpu · Metal
Versión de ToshLLMv0.83.13Versión de la app usada para registrar y firmar esta prueba
01

Carga estándar

Procesamiento and generation are reported separately so memory bandwidth and decode behavior stay visible.

02

Configuración incluida

La cuantización, familia de GPU, VRAM y contexto acompañan el resultado; no quedan ocultos tras una puntuación única.

03

Procedencia conservada

Este resultado sigue identificado como aporte comunitario.