Hugging Face Transformers — это фреймворк определения моделей для машинного обучения, охватывающий текст, зрение, аудио и мультимодальные задачи. Он предоставляет унифицированный API для инференса и обучения с доступом к более чем 1 миллиону предобученных чекпоинтов.
Открытый код. Новые возможности.
Находите качественные проекты с открытым исходным кодом, отправляйте проекты анонимно, заявляйте права на свои проекты и редактируйте их.
Немного любопытства. Мир открытого кода.
THE FIRST COLLECTIONAutoKeras — это открытая библиотека AutoML на базе Keras, автоматизирующая поиск моделей глубокого обучения для задач с изображениями, текстом и структурированными данными.
Apache TVM — это открытый фреймворк компиляции машинного обучения, разработанный для универсального развертывания и настраиваемых конвейеров компилятора.
Комплексное открытое руководство по промпт-инжинирингу, RAG, AI-агентам и оптимизации LLM. Включает туториалы, научные статьи, инструменты и notebooks для эффективной работы с большими языковыми моделями.
ESPnet — это набор инструментов для обработки речи сквозного типа на базе PyTorch, охватывающий ASR, TTS, перевод речи, улучшение, диаризацию и другое, с воспроизводимыми рецептами и предобученными моделями.
Курируемый список курсов по компьютерным наукам с видеолекциями, охватывающий алгоритмы, ИИ, базы данных, операционные системы и многое другое.
MediaPipe — это кроссплатформенный фреймворк Google и набор локальных решений машинного обучения для живых и потоковых медиа, охватывающий задачи зрения, текста и аудио на Android, iOS, вебе, настольных и периферийных устройствах.
Made With ML — это открытый курс и кодовая база, обучающая проектированию, разработке, развёртыванию и итерации приложений машинного обучения промышленного уровня, охватывающая MLOps, тестирование, сервинг, CI/CD и непрерывное обучение.
Colossal-AI — это открытая система для более дешевого и эффективного обучения и запуска больших ИИ-моделей, предлагающая стратегии параллельного обучения, управление памятью и ускорение инференса для LLM, моделей диффузии и других.
PaddlePaddle — это промышленная платформа глубокого обучения, предоставляющая комплексный фреймворк для машинного обучения, включая библиотеки моделей и комплекты разработки.
Комплексный инструментарий для компьютерного зрения, предоставляющий независимые от моделей строительные блоки для загрузки данных, визуализации и управления наборами данных.
Gradio — это библиотека Python с открытым исходным кодом для быстрого создания и совместного использования веб-приложений для моделей машинного обучения, API или любых функций Python без опыта веб-разработки.
Magika — это инструмент Google для определения типа содержимого файлов на основе ИИ. Он использует небольшую модель глубокого обучения для распознавания более 200 типов файлов за миллисекунды на одном CPU с точностью около 99%. Доступен в виде CLI на Rust, а также привязок для Python, JavaScript и Go.
Pyro — это гибкая и масштабируемая библиотека глубокого вероятностного программирования на основе PyTorch, поддерживающая универсальные вероятностные модели и автоматический вывод.
Бесплатная учебная программа по AI-инжинирингу с открытым исходным кодом и лицензией MIT: 523 урока в 20 этапов (~342 часа), от первых принципов до продакшена на Python, TypeScript, Rust и Julia. Каждый урок завершается переиспользуемым артефактом — промптом, навыком, агентом или MCP-сервером; включает устанавливаемый ИИ-тьютор и подготовку к сертификации Claude.
Sonnet — это библиотека нейронных сетей от DeepMind на базе TensorFlow 2. Она предлагает простые композируемые абстракции через концепцию snt.Module для исследований в области машинного обучения, поддерживая пользовательские модули, сериализацию и распределённое обучение.
Tesseract.js — JavaScript-библиотека для оптического распознавания символов (OCR), извлекающая текст из изображений более чем на 100 языках. Работает в браузере через WebAssembly и в Node.js, обёртывая движок Tesseract без изменения модели распознавания.
dlib — комплексный C++ toolkit для решения практических задач машинного обучения и анализа данных с поддержкой Python и широким набором алгоритмов.
EasyOCR — готовая к использованию библиотека оптического распознавания символов, поддерживающая более 80 языков и основные системы письма. Простой Python API и CLI, модели на PyTorch, возможность обучения собственных моделей.
Сборник примеров кода и учебных материалов по машинному и глубокому обучению, сопровождающий онлайн-курсы. Охватывает темы от линейной регрессии до обучения с подкреплением, NLP, компьютерного зрения и генеративного ИИ.