llama.cpp

纯C++实现的高性能本地LLM推理引擎,支持GGUF量化格式,CPU/GPU多后端兼容

Stars122k
Forks21.1k
主语言C
分类模型部署与推理
作者homebrew-lts
LicenseMIT

加载项目详情…