운영 의사결정(가격, 재고, 에너지, 대기열, 공급망)을 위한 강화학습 라이브러리. 31개 알고리즘, 타입 인터페이스, 고전적 기준선, 재현 가능한 벤치마크 제공.
오픈 소스. 새로운 가능성.
우수한 오픈 소스 프로젝트를 발견하고, 익명으로 프로젝트를 제출하며, 내 프로젝트를 신청해 편집하세요.
호기심으로 오픈 소스의 세계를 발견하세요.
THE FIRST COLLECTIONSGLang은 저지연 및 고처리량 추론을 위해 설계된 대규모 언어 모델(LLM) 및 멀티모달 모델용 고성능 서빙 프레임워크입니다.
Reinfors는 게임 시뮬레이션, 트리 검색, 에피소드 오케스트레이션, 배치 조립을 병렬 Rust 백엔드에서 실행하는 강화학습 프레임워크로, 추론 콜백을 통해 네트워크, 학습, 최적화 등 전체 제어는 사용자에 맡긴다.
알고리즘, 인공지능, 데이터베이스, 운영체제 등 컴퓨터 과학 주제의 비디오 강의를 포함한 교육 자료 디렉터리입니다.
SANA는 NVIDIA의 오픈소스 고효율 확산 모델 제품군으로, 고해상도 이미지 및 비디오 생성을 위한 학습·추론 코드, 선형 어텐션, DC-AE 압축, 4비트 배포를 제공합니다.
안정적인 PyTorch 기반의 강화학습 알고리즘 구현체인 Stable Baselines3에 대해 설명합니다.
labml.ai는 60개 이상의 문서화된 PyTorch 딥러닝 구현을 제공하며, 웹사이트에서 설명 노트와 함께 나란히 렌더링됩니다. 트랜스포머, GAN, 디퓨전 모델, 강화학습, 옵티마이저 등 다양한 주제를 다룹니다.
Jericho is a lightweight Python interface connecting learning agents to man-made Interactive Fiction games, featuring Frotz emulation, stochastic environments, and comprehensive documentation for AI research.
무료 오픈소스 AI 엔지니어링 커리큘럼으로, 첫 원리부터 20단계 523개 수업(약 342시간)을 Python, TypeScript, Rust, Julia로 제공. 각 수업은 수학 기반 구현부터 재사용 가능한 프롬프트, 스킬, 에이전트, MCP 서버까지 포함하며, 설치형 AI 튜터와 Claude 인증 준비도 지원.
Unsloth는 Windows, macOS, Linux에서 대규모 언어 모델(LLM) 및 확산 모델을 로컬로 실행하고 학습시킬 수 있는 데스크톱 애플리케이션이자 프레임워크입니다.
온라인 강좌와 함께 제공되는 머신러닝 및 딥러닝 코드 예제와 튜토리얼 모음입니다. 선형 회귀부터 강화 학습, NLP, 컴퓨터 비전, 생성형 AI까지 다양한 주제를 다룹니다.
Unity ML-Agents 툴킷은 게임과 시뮬레이션을 지능형 에이전트 훈련 환경으로 활용할 수 있게 하는 오픈소스 프레임워크로, PyTorch 기반의 심층 강화 학습 및 모방 학습을 지원합니다.
Adrastea는 자율적인 오케스트레이션을 위해 결정론적 작업 실행 코어(Alpha)와 확률적 추론 엔진(Beta)을 결합한 Python 이중 엔진 시스템입니다. Alpha는 강화 학습 계획 및 로컬 Ollama 추론을 통해 로컬 프로그램을 예약하고 실행하는 반면, Beta는 원격 측정을 모니터링하고, 이상 현상을 해결하고, 점수 가중치를 조정하며, MCP를 통해 프론티어 LLM을 참조할 수 있습니다.
Ray는 단일 노트북에서 분산 클러스터까지 AI 및 Python 애플리케이션을 확장할 수 있는 통합 프레임워크입니다.