Made With ML — это открытый курс и кодовая база, обучающая проектированию, разработке, развёртыванию и итерации приложений машинного обучения промышленного уровня, охватывающая MLOps, тестирование, сервинг, CI/CD и непрерывное обучение.
Открытый код. Новые возможности.
Находите качественные проекты с открытым исходным кодом, отправляйте проекты анонимно, заявляйте права на свои проекты и редактируйте их.
Немного любопытства. Мир открытого кода.
THE FIRST COLLECTIONОфициальный репозиторий кода книги «Build a Large Language Model (From Scratch)»: пошаговая реализация GPT-подобных моделей на PyTorch, включая предобучение и дообучение, с ноутбуками и упражнениями.
DocsGPT — это open-source AI платформа для создания интеллектуальных агентов и ассистентов, предлагающая возможности анализа документов, поддержку различных моделей и корпоративный поиск.
Коллекция экспериментов по обработке естественного языка (NLP), ориентированная на векторные представления слов, трансформеры и фундаментальные алгоритмы NLP.
Resume Matcher — это открытый ИИ-инструмент, который адаптирует резюме и сопроводительные письма под вакансии с помощью 100+ LLM, с локальным или облачным развертыванием, шаблонами и поддержкой нескольких языков.
NLTK — это комплексный набор модулей Python с открытым исходным кодом, наборов данных и учебных пособий, предназначенный для поддержки исследований и разработок в области обработки естественного языка.
Сборник примеров кода и учебных материалов по машинному и глубокому обучению, сопровождающий онлайн-курсы. Охватывает темы от линейной регрессии до обучения с подкреплением, NLP, компьютерного зрения и генеративного ИИ.
HanLP — это многоязычный набор инструментов для обработки естественного языка, ориентированный на производственную среду. Основан на PyTorch и TensorFlow 2.x, поддерживает сегментацию слов, частеречную разметку, распознавание именованных сущностей, синтаксический и семантический анализ, предоставляет RESTful и локальный API.
Hugging Face Transformers — это фреймворк определения моделей для машинного обучения, охватывающий текст, зрение, аудио и мультимодальные задачи. Он предоставляет унифицированный API для инференса и обучения с доступом к более чем 1 миллиону предобученных чекпоинтов.
Каталог ресурсов NLP для бенгальского языка (бангла), поддерживаемый сообществом, — 712 статей, 63 набора данных, 20 моделей и 9 инструментов по 13 задачам — создан как статический сайт на Astro со строгой проверкой данных и общими фильтрами.
TextBlob — это библиотека Python для обработки естественного языка с простым API, поддерживающая анализ тональности, частеречную разметку, извлечение именных групп, классификацию, токенизацию и другое, на основе NLTK и pattern.