Repositorio oficial de código para 'Build a Large Language Model (From Scratch)': implementación paso a paso en PyTorch de modelos tipo GPT, cubriendo preentrenamiento y ajuste fino con notebooks y ejercicios.
Código abierto. Nuevas posibilidades.
Descubre proyectos de código abierto de calidad, envía proyectos de forma anónima y reclama y edita tu propio proyecto.
Un poco de curiosidad. Un mundo de código abierto.
THE FIRST COLLECTIONColección de implementaciones simples en PyTorch de redes neuronales y artículos de aprendizaje profundo con explicaciones documentadas lado a lado, que abarcan transformadores, GANs, modelos de difusión, RL, optimizadores y más.
Drowse es un banco de trabajo local para la interpretabilidad mecanicista de modelos de lenguaje grandes, que ofrece un panel, una API de Python y un servidor compatible con OpenAI/Ollama para la manipulación de activaciones, sondas de conceptos, variedades, SAE y lentes jacobianas.
DocsGPT es una plataforma de IA de código abierto para crear agentes y asistentes inteligentes, con funciones de análisis de documentos, soporte multi-modelo y capacidades de búsqueda empresarial.
Un plan de estudios de ingeniería de IA gratuito y de código abierto basado en principios fundamentales: 523 lecciones en 20 fases (~342 horas), con cobertura desde las matemáticas hasta la producción en Python, TypeScript, Rust y Julia. Cada lección genera un artefacto reutilizable; incluye un tutor de IA instalable y preparación para la certificación de Claude.
Una colección curada de 107 artículos fundamentales de investigación en IA generativa con resúmenes completos, rutas de aprendizaje, glosarios y guías de decisión, haciendo accesible la investigación de vanguardia para todos.
Un framework de IA todo en uno para búsqueda semántica, orquestación de LLM y flujos de trabajo.
Una guía práctica y completa para entrenar LLMs desde cero con PyTorch, cubriendo preparación de datos, construcción de un Transformer, preentrenamiento y post-entrenamiento con SFT, DPO, PPO y GRPO.
Xinference es una biblioteca unificada de inferencia para servir modelos de lenguaje, voz y multimodales. Proporciona API RESTful compatible con OpenAI, utilización heterogénea de GPU/CPU, despliegue distribuido e integraciones con LangChain, LlamaIndex, Dify y Chatbox.
LlamaFactory es un framework de Python para el ajuste fino eficiente de más de 100 modelos de lenguaje grandes y multimodales, con CLI sin código, interfaz web Gradio, LoRA/QLoRA y múltiples algoritmos de entrenamiento.
PEFT es una biblioteca que proporciona métodos de ajuste fino eficientes en parámetros para adaptar grandes modelos preentrenados con costos mínimos de almacenamiento y computación.
Un curso gratuito de Microsoft de 21 lecciones para principiantes sobre cómo crear aplicaciones de IA generativa, con ejemplos en Python/TypeScript.
SANA es la familia de modelos de difusión eficientes de código abierto de NVIDIA para generar imágenes y vídeo de alta resolución, con código de entrenamiento e inferencia, atención lineal, compresión DC-AE y despliegue en 4 bits.