Microsoft의 초보자를 위한 10주, 20강 데이터 과학 커리큘럼으로, 프로젝트 기반 수업, 퀴즈, 50개 이상의 언어 번역이 포함되어 있습니다.
오픈 소스. 새로운 가능성.
우수한 오픈 소스 프로젝트를 발견하고, 익명으로 프로젝트를 제출하며, 내 프로젝트를 신청해 편집하세요.
호기심으로 오픈 소스의 세계를 발견하세요.
THE FIRST COLLECTIONFiftyOne은 고품질 데이터셋과 컴퓨터 비전 모델을 구축하기 위한 오픈소스 Python 도구로, 이미지, 비디오, 주석 시각화, 모델 평가, 데이터 정제 기능을 제공합니다.
OpenRefine은 웹 브라우저 인터페이스를 통해 지저분한 데이터를 정제, 변환 및 조정하도록 설계된 Java 기반의 오픈 소스 파워 툴입니다.
비즈니스 분석가 및 트레이더를 위한 수치 컴퓨팅 및 데이터 시각화 중심의 파이썬 입문 교육 과정 소개
Great Expectations (GX Core)는 데이터 일관성과 신뢰성을 보장하기 위해 데이터 단위 테스트 프레임워크를 제공하는 오픈 소스 Python 라이브러리입니다.
VectorBT는 오픈소스 파이썬 백테스팅 라이브러리로, 수천 개의 매개변수 조합을 NumPy 배열로 압축하고 Numba와 선택적 Rust 엔진으로 가속화하며, 포트폴리오 분석과 대화형 Plotly 시각화를 제공합니다.
Keras 3는 JAX, TensorFlow, PyTorch 또는 OpenVINO를 사용하여 모델을 구축하고 학습시킬 수 있는 멀티 백엔드 딥러닝 프레임워크입니다.
scikit-learn은 SciPy를 기반으로 구축되었으며 3-Clause BSD 라이선스 하에 배포되는 포괄적인 머신러닝용 Python 모듈입니다.
사용자가 맞춤형 데이터 세트를 가져와 시각화 및 분석을 수행할 수 있는 데이터 연구 및 분석 플랫폼입니다.
Gradio는 웹 개발 경험 없이도 머신러닝 모델, API 또는 모든 Python 함수를 위한 웹 애플리케이션을 빠르게 구축하고 공유할 수 있는 오픈 소스 Python 라이브러리입니다.
Evidence는 드래그 앤 드롭 방식의 BI 도구를 대체하는 오픈 소스 코드 기반 도구로, SQL과 markdown을 사용하여 빠르고 인터랙티브한 보고서를 구축하고 정적 사이트로 게시하거나 자체 호스팅할 수 있습니다.
단계별 30일 Python 프로그래밍 챌린지로, 기초부터 웹 스크래핑, pandas, MongoDB, API까지 다루며 실습 문제와 여러 언어 번역을 제공합니다.
Apache Superset은 데이터 탐색 및 시각화에 사용되는 현대적인 기업용 비즈니스 인텔리전스(BI) 웹 애플리케이션입니다.
IPython은 주로 Python을 비롯한 여러 프로그래밍 언어의 컴퓨팅을 위한 강력한 대화형 명령 셸로, 향상된 내성(introspection)과 셸 통합 기능을 제공합니다.
DVC는 데이터 및 ML 모델 버전 관리, 재현 가능한 파이프라인 구축, 로컬 실험 추적을 위한 명령줄 도구 및 VS Code 확장입니다.
온라인 강좌와 함께 제공되는 머신러닝 및 딥러닝 코드 예제와 튜토리얼 모음입니다. 선형 회귀부터 강화 학습, NLP, 컴퓨터 비전, 생성형 AI까지 다양한 주제를 다룹니다.
pandas는 관계형 또는 레이블 데이터 작업을 위해 설계된 빠르고 유연하며 표현력이 풍부한 데이터 구조를 제공하는 강력한 Python 라이브러리입니다.
Dagster는 데이터 자산의 전체 라이프사이클에 걸친 개발, 운영 및 관찰을 위해 설계된 클라우드 네이티브 데이터 파이프라인 오케스트레이터입니다.
Microsoft가 제공하는 무료 12주, 26개 레슨 커리큘럼으로 Scikit-learn을 활용한 클래식 머신러닝을 학습합니다. 퀴즈, 실습 프로젝트, 과제, Python 및 R 레슨, 다국어 번역을 포함합니다.
온라인 결제 거래를 정상 또는 사기로 분류하는 교육용 머신러닝 프로젝트입니다. Python, pandas, NumPy, scikit-learn을 사용하여 데이터 전처리, 특성 인코딩 및 스케일링을 수행하고 Logistic Regression, Decision Tree, Random Forest 모델을 학습 및 평가합니다.