ul-smf-cache-compressionliventruth
NOVOUL-SMF é um framework de compressão de cache KV para inferência Transformer de contexto longo, alegando até 384x de compressão via FSQ e mapeamento latente de 16D. A lógica central requer um binário proprietário fechado.