FDE Hub
术语词典/LLM(大语言模型)
Defined Term

LLM(大语言模型)

Large Language Model,在海量文本上预训练的基础模型

详细定义

LLM 指参数量通常在 10 亿以上、在 TB 级文本上预训练的基础模型。代表:GPT-4 / Claude 4 / Gemini 2.5 / Qwen3 / DeepSeek / Llama-3。具备「涌现能力」——规模到一定程度后出现小模型没有的能力(推理、规划、工具使用)。FDE 现场要选对 LLM:闭源(GPT-4o 效果最好但贵、数据外流)vs 开源(Qwen3 自托管可控)。

实例

  • 闭源旗舰:GPT-4o、Claude Sonnet 4.5、Gemini 2.5 Pro。
  • 开源主流:Llama-3、Qwen3、DeepSeek-V3、Mistral。
来自行业的实例
闭源旗舰:GPT-4o、Claude Sonnet 4.5、Gemini 2.5 Pro。
开源主流:Llama-3、Qwen3、DeepSeek-V3、Mistral。

关联术语

关于 LLM(大语言模型) 的常见问题

LLM(大语言模型) 的核心定义是什么?

Large Language Model,在海量文本上预训练的基础模型

LLM(大语言模型) 在 FDE 工作流中扮演什么角色?

LLM 指参数量通常在 10 亿以上、在 TB 级文本上预训练的基础模型。代表:GPT-4 / Claude 4 / Gemini 2.5 / Qwen3 / DeepSeek / Llama-3。具备「涌现能力」——规模到一定程度后出现小模型没有的能力(推理、规划、工具使用)。FDE 现场要选对 LLM:闭源(GPT-4o 效果最好但贵、数据外流)vs 开源(Qwen3 自托管可控)。