ul-smf-cache-compressionliventruth
NUEVOUL-SMF es un marco de compresión de caché KV para inferencia de Transformers de contexto largo, que afirma comprimir hasta 384x mediante FSQ y mapeo latente de 16D. La lógica central de compresión requiere un binario propietario de código cerrado.