Uma lista selecionada de cursos de ciência da computação com videoaulas, abrangendo algoritmos, IA, bancos de dados, sistemas operacionais e muito mais.
Código aberto. Novas possibilidades.
Descubra projetos open source de qualidade, envie projetos anonimamente e reivindique e edite seu próprio projeto.
Um pouco de curiosidade. Um mundo de código aberto.
THE FIRST COLLECTIONFaceAttend é um sistema de presença em sala de aula hospedado localmente que utiliza reconhecimento facial baseado em vídeo para identificar alunos matriculados.
jetson-inference é uma biblioteca de visão profunda em C++ e Python para NVIDIA Jetson. Usa TensorRT para inferência no dispositivo e PyTorch para treinamento, com exemplos, modelos pré-treinados e tutoriais para classificação, detecção, segmentação, pose, ação, profundidade e streaming de câmera.
O MediaPipe é um framework multiplataforma de código aberto do Google que oferece soluções de aprendizado de máquina no dispositivo para mídia ao vivo e streaming, abrangendo visão, texto e áudio em Android, iOS, web, desktop e dispositivos de borda. Sua documentação principal está em developers.google.com/mediapipe, e inclui componentes como Tasks, Model Maker e Studio.
Um projeto de AI/ML que utiliza visão computacional para detectar animais como elefantes, gado e macacos em áreas agrícolas, visando prevenir danos às colheitas. O README é breve e direciona os usuários ao código para detalhes de configuração.
Gestune é um controlador de volume do sistema sem toque que utiliza gestos manuais para ajustar os níveis de áudio sem a necessidade de teclado ou mouse.
O YOLOv5 é um framework de visão computacional rápido e preciso em PyTorch para detecção de objetos, segmentação de instâncias e classificação de imagens. Ele suporta treinamento em conjuntos de dados personalizados, inferência de várias fontes e exportação de modelos para formatos como ONNX, TensorRT e CoreML.
Demo de detecção facial baseada em navegador construída com face-api.js e TensorFlow.js, empacotada como imagem Docker via nginx, acompanhada de notas de pesquisa comparando detectores Viola-Jones, HOG+SVM e CNN.
O openFrameworks é uma toolkit C++ para creative coding, com suporte a desenvolvimento multiplataforma para Windows, Linux, macOS, iOS, tvOS e Emscripten.
Um plugin de câmera de alta performance para Flutter que utiliza o Nitro SDK para bindings nativos sem overhead, oferecendo vídeo acelerado por GPU em tempo real e FFI de baixa latência.
FiftyOne é uma ferramenta de código aberto para criar conjuntos de dados de alta qualidade e modelos de visão computacional. Ela permite aos usuários visualizar, rotular, avaliar e curar dados de IA visual.
Um toolkit abrangente para visão computacional que fornece blocos de construção agnósticos a modelos para carregamento de dados, visualização e gerenciamento de datasets.
Currículo de engenharia de IA gratuito e de código aberto focado em primeiros princípios: 523 lições em 20 fases (~342 horas), com cobertura da matemática à produção em Python, TypeScript, Rust e Julia. Cada lição entrega um prompt, skill, agente ou servidor MCP reutilizável; inclui um tutor de IA instalável e preparação para certificação Claude.
Repositório com 61 tutoriais de visão computacional em notebooks Jupyter, cobrindo modelos como YOLO11, SAM 3 e Qwen3-VL para detecção, segmentação e OCR.
AirSim é o simulador de código aberto da Microsoft para drones e carros, construído como um plugin do Unreal Engine com um lançamento experimental para Unity. Ele suporta simulação software-in-the-loop e hardware-in-the-loop com PX4 e ArduPilot, e expõe APIs de várias linguagens para coletar imagens e controlar veículos para pesquisa em IA.
dlib é um toolkit abrangente em C++ projetado para criar software complexo, oferecendo algoritmos de aprendizado de máquina e análise de dados com suporte a C++ e Python.
Gesture Ninja é um aplicativo baseado em visão computacional que permite aos usuários jogar Fruit Ninja usando rastreamento de dedos em tempo real via webcam.
O Label Studio é uma ferramenta de anotação de dados open-source e multi-tipo, que suporta áudio, texto, imagens, vídeo e séries temporais, com uma interface simples e exportação para vários formatos de modelo.
Meshify é um aplicativo de detecção de malha facial em tempo real que identifica e rastreia marcos faciais usando OpenCV, MediaPipe e CVZone.
X-AnyLabeling é uma aplicação desktop multiplataforma e leve para anotação de dados assistida por IA, cobrindo texto, imagem, vídeo e dados multimodais. Oferece ampla variedade de ferramentas de rotulagem, integração com muitos modelos de deep learning, inferência local e remota, além de importação/exportação em diversos formatos.