打开/关闭菜单
打开/关闭外观设置菜单
打开/关闭个人菜单
未登录
未登录用户的IP地址会在进行任意编辑后公开展示。

网站测试中,如需帮助或提出建议
联系维护员 @天明

天明留言 | 贡献
创建页面,内容为“GGUF(GPT-Generated Unified Format)是一种用于存储和加载大型语言模型的文件格式,由ggerganov开发,旨在替代早期的GGML格式。它支持多种量化级别,可显著减小模型体积并提高推理速度,主要被llama.cpp、LM Studio等本地推理工具采用。GGUF在2023年8月随llama.cpp的更新而推出,成为本地部署量化LLM的主流格式。”
 
天明留言 | 贡献
无编辑摘要
 
第1行: 第1行:
GGUF(GPT-Generated Unified Format)是一种用于存储和加载[[大型语言模型]]的文件格式,由ggerganov开发,旨在替代早期的GGML格式。它支持多种量化级别,可显著减小模型体积并提高推理速度,主要被llama.cpp、[[LM Studio]]等本地推理工具采用。GGUF在2023年8月随llama.cpp的更新而推出,成为本地部署量化LLM的主流格式。
GGUF(GPT-Generated Unified Format)是一种用于存储和加载[[大型语言模型]]的文件格式,由ggerganov开发,旨在替代早期的[[GGML]]格式。它支持多种量化级别,可显著减小模型体积并提高推理速度,主要被llama.cpp、[[LM Studio]]等本地推理工具采用。GGUF在2023年8月随llama.cpp的更新而推出,成为本地部署量化LLM的主流格式。

2026年5月23日 (六) 23:14的最新版本

GGUF(GPT-Generated Unified Format)是一种用于存储和加载大型语言模型的文件格式,由ggerganov开发,旨在替代早期的GGML格式。它支持多种量化级别,可显著减小模型体积并提高推理速度,主要被llama.cpp、LM Studio等本地推理工具采用。GGUF在2023年8月随llama.cpp的更新而推出,成为本地部署量化LLM的主流格式。