这个项目能做什么
RunAnywhere 基于统一C++核心构建八款SDK(Swift、Kotlin、Flutter、React Native、Web、Electron、Python及命令行工具),实现跨硬件设备的离线本地AI推理,自动调度设备最优执行引擎。
**核心能力:**
- 支持令牌流式传输、多轮对话历史及LoRA适配器的大语言模型聊天(Llama、Qwen、Gemma、Phi、DeepSeek等)
- 视觉语言模型(VLM)实现图像理解与摄像头实时问答
- 语音转文本(Whisper、Moonshine)与文本转语音(Piper、Kokoro、MeloTTS)
- 语音代理流程(VAD + STT + LLM + TTS)
- 本地文档加载与流式处理的嵌入向量及RAG系统
- 基于Stable Diffusion(Core ML)的图像生成与Hexagon NPU图像修复
- 结构化JSON输出、工具调用及代理循环
- 计算机操作解析器(CUA)
**推理引擎:**
- QHexRT:专为高通Hexagon NPU(v75/v79/v81)设计的运行时,直接在NPU上执行大语言模型、视觉语言模型、语音及文本转语音任务,支持混合专家模型(MoE)和1-bit量化模型
- MLX:Apple原生推理引擎,支持大语言模型、视觉语言模型、语音转文本、文本转语音及嵌入向量
- llama.cpp:通过Metal(Apple)、CUDA(NVIDIA,需启用)、WebGPU/WASM(浏览器)及CPU(NEON/AVX)实现全平台运行
- sherpa + ONNX:跨平台语音、VAD及嵌入向量处理
- Core ML:iOS/macOS设备上的扩散模型图像生成
**扩展功能:**
- 通过Python SDK和CLI提供兼容OpenAI的服务器模式,开放聊天补全、嵌入向量、音频转录/语音合成等接口
- RunAnywhere Console:支持空中模型部署及设备集群遥测数据收集的控制平面
- Connect(局域网):允许macOS主机通过可信局域网向iOS/Android客户端共享已加载模型
- 能力发现API(capabilities())供应用查询当前设备及引擎的实际执行能力
SDK成熟度差异:Swift、Kotlin及rcli已稳定;Flutter、React Native与Web处于测试阶段;Electron为预览版;Python处于Alpha阶段。
评论
0 评分人数达到10人后显示
登录后参与讨论。