这个项目能做什么
ggml 是一个用纯 C/C++ 编写的机器学习张量库,其明确目标是简单、便携、高效且配置极少。它是 llama.cpp 等项目背后的张量基础。
README 中描述的主要特点:
- 纯 C/C++ 实现,无外部依赖。
- 跨平台支持:x86、ARM、RISC-V、LoongArch、PowerPC、s390x 和 WebAssembly。
- 针对 x86、ARM 和 RISC-V 的 SIMD 优化内核。
- 广泛的后端支持,涵盖 CPU、GPU、NPU 和浏览器环境。
- 从 2 位到 8 位的整数量化,以及 MXFP4 和 NVFP4 微缩放格式。
- 运行时零内存分配。
入门方式是通过 CMake 从源码构建:
```bash
git clone https://github.com/ggml-org/ggml
cd ggml
mkdir build && cd build
cmake ..
cmake --build . --config Release -j 8
```
一个涵盖矩阵乘法的最小且带完整注释的示例位于 examples/simple 下。
项目引用的文档包括 GGUF 文件格式规范、在 Hugging Face 上发布的 ggml 介绍,以及 GGML 技巧与窍门 wiki 页面。
对于核心 ggml 库(包括 CMake 构建系统)的贡献,README 要求贡献者改为在 llama.cpp 仓库中打开拉取请求,以便更改获得更多可见性、测试和审查。
该项目以 MIT 许可证发布。
评论
0 评分人数达到10人后显示
登录后参与讨论。