Repositório oficial de código do livro 'Build a Large Language Model (From Scratch)': implementação passo a passo em PyTorch de modelos tipo GPT, cobrindo pré-treinamento e ajuste fino com notebooks e exercícios.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONColeção de implementações simples em PyTorch de redes neurais e artigos de deep learning com explicações lado a lado documentadas, abrangendo transformers, GANs, modelos de difusão, RL, otimizadores e muito mais.
Drowse é uma bancada de trabalho local para interpretabilidade mecanicista de grandes modelos de linguagem, oferecendo um painel, API Python e servidor compatível com OpenAI/Ollama para direcionamento de ativações, sondas de conceitos, variedades, SAEs e lentes jacobianas.
DocsGPT é uma plataforma de IA de código aberto para a criação de agentes e assistentes inteligentes, com análise de documentos, suporte a múltiplos modelos e capacidades de busca empresarial.
Currículo de engenharia de IA gratuito e de código aberto focado em primeiros princípios: 523 lições em 20 fases (~342 horas), com cobertura da matemática à produção em Python, TypeScript, Rust e Julia. Cada lição entrega um prompt, skill, agente ou servidor MCP reutilizável; inclui um tutor de IA instalável e preparação para certificação Claude.
Uma coleção selecionada de 107 artigos fundamentais de pesquisa em IA generativa, com resumos abrangentes, roteiros de aprendizado, glossários e guias de decisão—tornando a pesquisa de IA de ponta acessível a todos.
Um framework de IA tudo-em-um para busca semântica, orquestração de LLMs e fluxos de trabalho de modelos de linguagem.
Um guia prático e completo para treinar LLMs do zero usando PyTorch, cobrindo preparação de dados, construção de um Transformer, pré-treinamento e pós-treinamento com SFT, DPO, PPO e GRPO.
Xinference é uma biblioteca unificada de inferência para servir modelos de linguagem, fala e multimodais. Oferece API RESTful compatível com OpenAI, uso heterogêneo de GPU/CPU, implantação distribuída e integrações com LangChain, LlamaIndex, Dify e Chatbox.
O LlamaFactory é um framework Python para ajuste fino eficiente de mais de 100 modelos de linguagem e multimodais, oferecendo CLI sem código, interface Web Gradio, LoRA/QLoRA e vários algoritmos de treinamento.
PEFT é uma biblioteca que fornece métodos de Ajuste Fino Eficiente de Parâmetros de última geração para adaptar grandes modelos pré-treinados com custos mínimos de computação e armazenamento.
Curso gratuito da Microsoft com 21 lições para iniciantes criarem aplicações de IA generativa, cobrindo LLMs, engenharia de prompts, RAG, agentes, ajuste fino e mais, com exemplos em Python/TypeScript.
SANA é a família open-source da NVIDIA de modelos de difusão eficientes para geração de imagens e vídeos em alta resolução, com código de treino e inferência, atenção linear, compressão DC-AE e implantação em 4 bits.