NVIDIA cuDF — это библиотека DataFrame с GPU-ускорением для обработки табличных данных, часть набора CUDA-X. Она предоставляет API, совместимые с pandas, GPU-движок для Polars и бэкенд для Dask для высокопроизводительной обработки данных.
Открытый код. Новые возможности.
Находите качественные проекты с открытым исходным кодом, отправляйте проекты анонимно, заявляйте права на свои проекты и редактируйте их.
Немного любопытства. Мир открытого кода.
THE FIRST COLLECTIONOneFlow — это удобный, масштабируемый и эффективный фреймворк глубокого обучения с API в стиле PyTorch, Global Tensor для n-мерного параллельного выполнения и Graph Compiler для ускорения и развертывания моделей.
SGLang — это высокопроизводительный фреймворк для обслуживания больших языковых (LLM) и мультимодальных моделей, разработанный для обеспечения низкой задержки и высокой пропускной способности при выводе.
PlanckGPT — образовательный проект для обучения GPT-модели (~540M параметров) с нуля на потребительском железе. Предобучение на 2 млрд токенов Fineweb-edu (~28 часов на ноутбуке), опциональный чат-финтюнинг с Smol-smoltalk.
Cog упаковывает модели машинного обучения в готовые к продакшену Docker-контейнеры, автоматически обеспечивает совместимость CUDA и генерирует HTTP API для инференса на основе определений типов Python.
Официальная коллекция примеров CUDA, демонстрирующих возможности GPU-программирования на C++ и Python, охватывающая введение, утилиты, концепции, библиотеки, доменные приложения и платформенные примеры.
vLLM — это высокопроизводительная и эффективная с точки зрения использования памяти библиотека, разработанная для инференса и развертывания больших языковых моделей (LLM).
Voicebox — это студия голосового ИИ с открытым исходным кодом, работающая локально. Она поддерживает клонирование голоса, синтез речи (TTS), глобальную диктовку и интеграцию с ИИ-агентами через протокол MCP, предлагая бесплатную альтернативу облачным сервисам.
Среда выполнения на базе GPU для видеомоделей image-to-image TensorRT, обеспечивающая высокопроизводительный апскейлинг видео за счет хранения необработанных кадров в памяти GPU от декодирования до кодирования.
CatBoost — библиотека градиентного бустинга с открытым исходным кодом от Yandex для классификации, регрессии и ранжирования, с поддержкой категориальных признаков, обучением на CPU/GPU, распределённым обучением через Apache Spark и API для Python, R, Java и C++.
Инструмент для автоматического редактирования видео на базе ИИ с использованием Whisper и Gemini. Поддерживает тайский и английский языки, обрезку ключевых сегментов и создание субтитров, работая в 3-4 раза быстрее благодаря GPU и Docker.