Colección de implementaciones simples en PyTorch de redes neuronales y artículos de aprendizaje profundo con explicaciones documentadas lado a lado, que abarcan transformadores, GANs, modelos de difusión, RL, optimizadores y más.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONProyecto de código abierto de modelos de lenguaje grandes chinos LLaMA y Alpaca, que amplía el vocabulario chino sobre la base del LLaMA original y realiza un segundo preentrenamiento, proporcionando modelos ajustados con instrucciones, pesos LoRA, scripts de entrenamiento y cuantificación, con soporte para ejecución local en CPU/GPU.
Troy es una herramienta CLI para el ajuste fino y de preferencias de LLM localmente en Macs con Apple Silicon. Usando MLX, permite entrenar modelos mediante una configuración YAML simple sin necesidad de nube ni CUDA.
LlamaFactory es un framework de Python para el ajuste fino eficiente de más de 100 modelos de lenguaje grandes y multimodales, con CLI sin código, interfaz web Gradio, LoRA/QLoRA y múltiples algoritmos de entrenamiento.
PEFT es una biblioteca que proporciona métodos de ajuste fino eficientes en parámetros para adaptar grandes modelos preentrenados con costos mínimos de almacenamiento y computación.