llama.cpp

llama.cpp是一款以C/C++编写、用于在个人电脑上运行大语言模型的开源推理引擎。

1篇文章
最近提及

llama.cpp是格奥尔基·格尔加诺夫于2023年发布的项目,可在CPU和多种GPU上运行模型。它能以GGUF格式加载量化模型,用较少内存运行,被广泛用作本地大模型运行工具的基础。

本条目依据AIPOST的文章与广为人知的事实整理。如有错误,请通过更正请求告诉我们。

涉及该条目的文章

该模型在Hugging Face上以GGUF格式提供两种版本,GGUF是推理引擎llama.cpp使用的文件格式:


© 2026 AIPOST. All rights reserved.

AIPOST是一家报道AI应用方法、AI安全、性能、创业、健康、伦理与行业资讯的AI专业媒体。无需注册即可使用,个人信息的处理方式请参阅隐私政策。