打开/关闭搜索
搜索
打开/关闭菜单
978
27
6
4034
Ac-Wiki
导航
首页
最近更改
随机页面
编辑指南
上传文件
联系我们
Discord
Telegram
QQ
打开/关闭外观设置菜单
无法加载偏好设置。请检查您的网络连接并重试。
重试
打开/关闭个人菜单
未登录
未登录用户的IP地址会在进行任意编辑后公开展示。
user-interface-preferences
个人工具
登录
网站测试中,如需帮助或提出建议
请
联系维护员
@天明
查看“︁Llama.cpp”︁的源代码
来自Ac-Wiki
查看
阅读
查看源代码
查看历史
associated-pages
页面
讨论
更多操作
←
Llama.cpp
因为以下原因,您没有权限编辑该页面:
您请求的操作仅限属于该用户组的用户执行:
用户
您可以查看和复制此页面的源代码。
https://llama.app/ https://github.com/ggml-org/llama.cpp llama.cpp 是一个[[开源]]的 [[C 语言|C]]/[[C++]] 项目,旨在在本地硬件上高效运行[[大语言模型]],最初针对 [[Meta]] 的 [[LLaMA|LLaMA 模型]]设计。主要用途是让用户无需依赖云服务即可在 [[CPU]] 或普通 [[GPU]] 上推理运行模型。核心特点包括使用 [[GGUF|GGUF 格式]]量化模型以降低内存占用,支持多平台([[Windows]]、[[Linux]]、[[macOS]]、[[Android]])及多种加速后端(如 BLAS、[[CUDA]]、[[Vulkan]])。项目于 2023 年 3 月由开发者 Georgi Gerganov 首次发布,后续社区贡献使其支持更多模型架构,成为本地运行开源大模型的重要工具之一。 {{DISPLAYTITLE: llama.cpp}}
返回
Llama.cpp
。
查看“︁Llama.cpp”︁的源代码
来自Ac-Wiki