Headroom compresse les sorties d'outils, logs, chunks RAG, fichiers et historiques de conversation avant qu'ils n'atteignent le LLM, réduisant l'utilisation de tokens tout en préservant les informations clés. Fonctionne localement comme bibliothèque Python/TypeScript, proxy, serveur MCP ou wrapper pour Claude Code, Codex, Copilot, Cursor et d'autres agents.
OPEN SOURCE, OPEN TO EVERYONE
Code ouvert. Horizons nouveaux.
Découvrez des projets open source de qualité, soumettez des projets anonymement, puis revendiquez et éditez votre propre projet.
✳Sélection humaine · Découvrez de bons projets open source4109découverts
Un peu de curiosité. Un monde de code ouvert.
THE FIRST COLLECTIONTopic: compression清除
headroomheadroomlabs-ai
NOUVEAUul-smf-cache-compressionliventruth
NOUVEAUUL-SMF est un framework de compression de cache KV pour l'inférence Transformer à long contexte, revendiquant jusqu'à 384x de compression via FSQ et un mapping latent 16D. La logique de compression repose sur un binaire propriétaire fermé.
DeepSpeeddeepspeedai
NOUVEAUDeepSpeed est une bibliothèque d'optimisation du deep learning conçue pour rendre l'entraînement et l'inférence de modèles à grande échelle faciles, efficaces et performants.