Batchalign3 — это аудио- и ML-конвейер TalkBank для создания и обогащения транскриптов CHAT, включающий ASR, принудительное выравнивание, нейроморфотаггинг, перевод и сегментацию высказываний. Поставляется с CLI, Python-пакетом, мостом PyO3, панелью React и экспериментальной оболочкой Tauri.
Открытый код. Новые возможности.
Находите качественные проекты с открытым исходным кодом, отправляйте проекты анонимно, заявляйте права на свои проекты и редактируйте их.
Немного любопытства. Мир открытого кода.
THE FIRST COLLECTIONPlanckGPT — образовательный проект для обучения GPT-модели (~540M параметров) с нуля на потребительском железе. Предобучение на 2 млрд токенов Fineweb-edu (~28 часов на ноутбуке), опциональный чат-финтюнинг с Smol-smoltalk.
微舆 (BettaFish) — инновационная мультиагентная система анализа общественного мнения, созданная с нуля. Автоматически анализирует 30+ мировых соцмедиа, использует ИИ-краулеры, мультимодальный анализ, дебаты агентов, умные отчёты, поддерживает частные БД и развёртывание через Docker.
Бесплатная учебная программа по AI-инжинирингу с открытым исходным кодом и лицензией MIT: 523 урока в 20 этапов (~342 часа), от первых принципов до продакшена на Python, TypeScript, Rust и Julia. Каждый урок завершается переиспользуемым артефактом — промптом, навыком, агентом или MCP-сервером; включает устанавливаемый ИИ-тьютор и подготовку к сертификации Claude.
Курируемая коллекция из 107 основополагающих исследовательских работ по генеративному ИИ с подробными резюме, учебными маршрутами, глоссариями и руководствами по принятию решений, делающая передовые исследования доступными для всех.
Чистая Python-платформа для научных вычислений с 22 модулями, охватывающими квантовые вычисления, машинное обучение, статистику, решатели ОДУ и другое — без зависимостей времени выполнения, с опциональными адаптерами NumPy/SciPy для валидации и воспроизводимости.
Haqumei — это библиотека японского преобразования графем в фонемы (G2P), написанная на Rust с привязками к Python, обеспечивающая точное преобразование текста в фонемы с информацией о просодии, сопоставление слов и фонем, а также CLI-инструмент для фронтендов синтеза речи.
Проект с открытым исходным кодом для китайских больших языковых моделей LLaMA и Alpaca: расширение китайского словаря на основе оригинальной LLaMA, повторное предобучение, модели с инструктивной настройкой, веса LoRA, скрипты обучения и квантования, поддержка локального запуска на CPU/GPU.
NLTK — это комплексный набор модулей Python с открытым исходным кодом, наборов данных и учебных пособий, предназначенный для поддержки исследований и разработок в области обработки естественного языка.
SpellKit — это быстрый и безопасный Ruby-гем с реализацией SymSpell на Rust. Он обеспечивает задержку менее миллисекунды, защиту терминов через regex, горячую перезагрузку словарей и нулевую зависимость. Поддерживает несколько экземпляров, шаблоны пропуска и готов к production для извлечения поисковых терминов.
txtai — это универсальная ИИ-платформа для семантического поиска, оркестрации LLM и построения сложных конвейеров языковых моделей.
Swift Tokenizers — это высокопроизводительная Swift-обёртка над Rust-крейтом tokenizers от Hugging Face, ориентированная исключительно на токенизацию без зависимостей от Hub. Поддерживает macOS, iOS и Linux, предлагая кодирование, декодирование, потоковую детокенизацию, чат-шаблоны и вызовы инструментов.
HanLP — это многоязычный набор инструментов для обработки естественного языка, ориентированный на производственную среду. Основан на PyTorch и TensorFlow 2.x, поддерживает сегментацию слов, частеречную разметку, распознавание именованных сущностей, синтаксический и семантический анализ, предоставляет RESTful и локальный API.
Premove ITN — это открытая библиотека контекстной обратной нормализации текста для английских транскриптов голосовых агентов. Она преобразует речь ASR в канонические письменные формы, используя конвейер генерации, оценки и декодирования с контекстным скорингом DeBERTa.
Репозиторий содержит ресурсы для языка тсуутина (сарси): морфологические анализаторы, средства проверки орфографии и словари на основе конечных автоматов и грамматики ограничений в рамках проекта GiellaLT.
LlamaFactory — это Python-фреймворк для эффективного дообучения более 100 больших языковых и мультимодальных моделей с zero-code CLI, Gradio Web UI, LoRA/QLoRA и множеством алгоритмов обучения.
ModelScope — это открытая Python-библиотека, реализующая концепцию «модель как сервис»: унифицированные интерфейсы pipeline, Trainer и MsDataset для инференса, дообучения и оценки моделей CV, NLP, аудио, мультимодальных и научных задач, а также интеграция с хабами моделей и датасетов.
AskNews Python SDK — клиентская библиотека для API AskNews, добавляющая контекст реальных новостей в любую LLM одной строкой кода. Поддерживает поиск новостей, отслеживание событий, прогнозы, аналитику, глубокие исследования, графы знаний и веб-поиск.
Бесплатная 12-недельная программа Microsoft из 24 уроков по основам ИИ: нейронные сети, глубокое обучение, компьютерное зрение, NLP, трансформеры, этика, практические задания, тесты и лабораторные работы.
Hugging Face Transformers — это фреймворк определения моделей для машинного обучения, охватывающий текст, зрение, аудио и мультимодальные задачи. Он предоставляет унифицированный API для инференса и обучения с доступом к более чем 1 миллиону предобученных чекпоинтов.