Nitro Camera 是一款高性能 Flutter 相机插件,旨在作为 vision-camera 的替代方案。它利用 Nitro SDK 通过 FFI 提供类型安全且零拷贝的原生绑定,消除了 iOS (AVFoundation) 和 Android (Camera2) 的 method-channel 开销。
好开源,值得被发现。
发现优质开源项目,匿名提交开源项目,认领编辑你的开源项目。
带着好奇心,发现开源世界。
THE FIRST COLLECTIONFiftyOne 是一款开源工具,用于构建高质量数据集和计算机视觉模型,支持可视化、标注、评估及数据策展。
Supervision 是一个全面的计算机视觉工具包,为数据加载、可视化和数据集管理提供与模型无关的构建模块。
免费开源的 AI 工程课程,从第一性原理出发,包含 20 个阶段、523 节课(约 342 小时),覆盖 Python、TypeScript、Rust 和 Julia。每课产出可复用的提示、技能、智能体或 MCP 服务器,并提供可安装的 AI 导师与 Claude 认证备考内容。
该仓库提供了一套全面的Jupyter笔记本集合,用于学习计算机视觉,涵盖从ResNet到RF-DETR、YOLO11、SAM 3和Qwen3-VL等前沿模型,涉及目标检测、分割、姿态估计、OCR等任务,并支持微调和零样本推理。
AirSim是微软开源的无人机和汽车模拟器,作为虚幻引擎插件构建,并提供实验性的Unity版本。支持PX4和ArduPilot的软件/硬件在环仿真,提供跨语言API以获取图像和控制车辆,用于AI研究。
dlib是一个全面的C++工具包,专注于机器学习、数据分析和解决现实问题的复杂软件开发。支持AVX指令、CMake构建管理、vcpkg依赖管理器,并提供Python API接口。采用Boost Software License开源协议,适用于开源和商业软件。
Gesture Ninja 是一款基于计算机视觉的应用,用户可以通过网络摄像头进行实时手指追踪,从而在无需键盘或鼠标的情况下玩 Fruit Ninja。
Label Studio是一个开源的多类型数据标注工具,支持音频、文本、图像、视频和时间序列,界面简洁,可导出多种模型格式。
Meshify 是一款实时面部网格检测应用程序,利用 OpenCV、MediaPipe 和 CVZone 来识别并追踪面部关键点。
X-AnyLabeling 是一款轻量级、统一的跨平台桌面应用,用于 AI 辅助数据标注,支持文本、图像、视频和多模态数据,内置多种深度学习模型与丰富标注工具,并支持多格式导入导出。
这是一个本地人脸识别考勤系统,采用 React Native Expo 移动端应用和 FastAPI Python 后端。该系统通过 Expo Camera 采集面部图像,利用 OpenCV LBPH 进行处理,并将带有时间戳的考勤记录存储在 SQLite 中。
Deep Lake 是一款面向 AI 的无服务器多模态数据库,结合向量搜索与嵌入、图像、视频、音频和文档存储,可将云端数据直接流式传输至 PyTorch/TensorFlow,支持数据版本控制,并集成 LangChain、LlamaIndex 和 Weights & Biases。
Ultralytics 提供了一套先进的 YOLO 模型,用于执行包括目标检测、分割和分类在内的计算机视觉任务。
OpenCV 是一个开源计算机视觉库,为图像处理和视觉分析提供广泛的工具。
微软推出为期 12 周、共 24 课的免费开源课程《人工智能入门》,涵盖神经网络、深度学习、计算机视觉、NLP、Transformer 及伦理等核心内容,并提供可执行笔记本、测验与实践实验室。
JavaCV通过JavaCPP Presets为OpenCV、FFmpeg等计算机视觉和多媒体库提供Java封装,支持Java和Android平台上的图像与视频处理、面部检测、相机标定及硬件加速显示等功能。
RF-DETR是Roboflow开发的实时Transformer模型架构,用于目标检测、实例分割和关键点检测,基于DINOv2骨干网络设计,支持微调。
Pokex 是一个基于 Elixir/OTP 的个人游戏自动化机器人,用于在 macOS 上操作 2D MMORPG。它通过屏幕捕获感知游戏状态,并使用合成输入执行动作。该系统由 26 个 GenServer 和 3 个监督器组成,强调进程隔离和消息传递,以应对输入延迟、竞争条件和系统争用等现实问题。
一个精选的计算机科学课程视频讲座列表,涵盖算法、人工智能、数据库、操作系统等主题。