首页 / AI 百科 / 大语言模型(LLM)

大语言模型(LLM)Large Language Model (LLM)

基础概念

用海量文本训练出来的超大神经网络,靠不断预测下一个词学会了语言,能对话、写作、编程,也能犯下很像样的错。

大语言模型的训练目标简单到有点出人意料:给它一段文本,让它猜下一个词是什么。但在海量数据上把这件事做到极致之后,模型开始表现出翻译、总结、推理、写代码这些没有被专门教过的能力。

怎么工作

为什么重要

它把过去需要专门训练的模型,变成了一个用自然语言就能调用的通用工具。写文案、查资料、做表格、写代码、做客服,很多任务的实现方式从「写程序」变成了「写提示」。对独立开发者来说,这意味着一个人也能做出过去需要团队才能做的产品。

常见误区

相关词条
Transformer 思维链与推理模型 微调与指令微调 RAG 检索增强生成
本词条为原创科普整理,用于帮助理解,不替代论文与官方文档。如有技术性错漏,欢迎指正。
← 返回 AI 百科 · 返回首页