打开/关闭搜索
搜索
打开/关闭菜单
978
27
6
4034
Ac-Wiki
导航
首页
最近更改
随机页面
编辑指南
上传文件
联系我们
Discord
Telegram
QQ
打开/关闭外观设置菜单
无法加载偏好设置。请检查您的网络连接并重试。
重试
打开/关闭个人菜单
未登录
未登录用户的IP地址会在进行任意编辑后公开展示。
user-interface-preferences
个人工具
登录
网站测试中,如需帮助或提出建议
请
联系维护员
@天明
查看“︁大型语言模型”︁的源代码
来自Ac-Wiki
查看
阅读
查看源代码
查看历史
associated-pages
页面
讨论
更多操作
←
大型语言模型
因为以下原因,您没有权限编辑该页面:
您请求的操作仅限属于该用户组的用户执行:
用户
您可以查看和复制此页面的源代码。
大型语言模型(Large Language Model, LLM)是一种基于[[深度学习]]技术、以[[Transformer]]架构为核心的神经网络模型,通过大规模文本语料训练,能够理解并生成自然语言文本。其主要用途涵盖对话系统、文本生成、知识问答、代码辅助、翻译与摘要等。核心特点包括参数量巨大(从数十亿到数千亿)、具备上下文学习与少样本推理能力。发展历史可追溯至2017年Transformer论文提出,2018年[[GPT]]与[[BERT]]等模型诞生,2020年GPT-3展示强大文本生成能力,2022年[[ChatGPT]]发布推动公众广泛使用,此后开源社区与商业公司推出[[Llama]]、[[Claude]]、[[DeepSeek]]等系列模型。
返回
大型语言模型
。
查看“︁大型语言模型”︁的源代码
来自Ac-Wiki