GLM:修订间差异
来自Ac-Wiki
更多操作
创建页面,内容为“GLM(General Language Model)是由清华大学与智谱AI等机构开发的大规模预训练语言模型。它采用自回归填空训练目标,结合了自编码与自回归的优势,在自然语言理解与生成任务上表现均衡。GLM-130B是其主要版本,拥有1300亿参数,支持中英文等多语言处理,在多项基准测试中接近GPT-3。模型权重公开,可用于文本生成、对话系统、知识问答等场景。” |
小无编辑摘要 |
||
| 第1行: | 第1行: | ||
GLM(General Language | GLM(General Language Model)是由[[清华大学]]与[[智谱|智谱AI]]等机构开发的[[大型语言模型|大规模预训练语言模型]]。它采用自回归填空训练目标,结合了自编码与自回归的优势,在自然语言理解与生成任务上表现均衡。GLM-130B是其主要版本,拥有1300亿参数,支持中英文等多语言处理,在多项基准测试中接近GPT-3。[[权重|模型权重]]公开,可用于文本生成、对话系统、知识问答等场景。 | ||
2026年5月29日 (五) 17:22的最新版本
GLM(General Language Model)是由清华大学与智谱AI等机构开发的大规模预训练语言模型。它采用自回归填空训练目标,结合了自编码与自回归的优势,在自然语言理解与生成任务上表现均衡。GLM-130B是其主要版本,拥有1300亿参数,支持中英文等多语言处理,在多项基准测试中接近GPT-3。模型权重公开,可用于文本生成、对话系统、知识问答等场景。