Um pequeno modelo de linguagem GPT (~540M parâmetros) projetado para treinamento do zero em hardware de laptop de consumo, com pré-treinamento em Fineweb-edu e capacidade de ajuste fino para chat.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONO Cog empacota modelos de machine learning em contêineres Docker prontos para produção, lidando automaticamente com a compatibilidade CUDA e gerando uma API de inferência HTTP a partir de definições de tipos Python.
Uma coleção abrangente de programas de exemplo CUDA demonstrando recursos de programação GPU, cobrindo exemplos em C++ e Python em múltiplas categorias, incluindo introdução, utilitários, conceitos, bibliotecas, aplicações específicas de domínio e amostras específicas de plataforma.
vLLM é uma biblioteca de alta taxa de transferência e eficiência de memória projetada para inferência e serviço de Large Language Models (LLM).
Voicebox é um estúdio de voz com IA de código aberto e execução local, oferecendo clonagem de voz, TTS, ditado global, pós-processamento de áudio, editor de histórias, API REST e integração com agentes via MCP.
Um runtime residente em GPU para modelos de vídeo image-to-image do TensorRT, permitindo upscaling de vídeo de alta performance ao manter os frames brutos na GPU da decodificação à codificação.
CatBoost é a biblioteca de gradient boosting de código aberto da Yandex para classificação, regressão e ranking, com suporte nativo a características categóricas, treinamento em CPU/GPU, treinamento distribuído via Apache Spark e APIs para Python, R, Java e C++.
Uma ferramenta de edição automática de vídeo via IA usando Whisper e Gemini com suporte a tailandês e inglês, oferecendo cortes de segmentos e legendas com desempenho 3-4x superior via GPU e Docker.
NVIDIA cuDF é uma biblioteca de DataFrame acelerada por GPU para processamento de dados tabulares, parte do conjunto CUDA-X. Oferece APIs compatíveis com pandas, um mecanismo GPU para Polars e um backend Dask para manipulação de dados de alto desempenho.
OneFlow é um framework de aprendizado profundo amigável, escalável e eficiente, com API estilo PyTorch, Tensor Global para execução paralela n-dimensional e Compilador de Grafo para aceleração e implantação de modelos.
SGLang é um framework de serving de alta performance para modelos de linguagem extensos (LLMs) e modelos multimodais, projetado para inferência de baixa latência e alta vazão.