大语言模型(LLM)
用海量文本训练出来的超大规模神经网络,通过预测“下一个词”学会语言、知识与推理,ChatGPT、Claude、Gemini 背后都是 LLM。
模型处理文本的最小单位,约等于 0.5–0.75 个汉字或 0.75 个英文单词。API 按 token 计费,上下文窗口也按 token 计量。
用海量文本训练出来的超大规模神经网络,通过预测“下一个词”学会语言、知识与推理,ChatGPT、Claude、Gemini 背后都是 LLM。
回答前先从外部知识库检索相关资料,再交给模型生成答案。解决模型知识过时与“一本正经胡说”的问题,企业知识库问答的标准架构。