FDE Hub
术语词典/Context Window(上下文窗口)
Defined Term

Context Window(上下文窗口)

LLM 单次推理能处理的最大 token 数

详细定义

Context Window 是 LLM 单次推理能处理的最大 token 数(含输入 + 输出)。2025 年主流模型的窗口:GPT-4o = 128K、Claude Sonnet 4.5 = 200K、Gemini 2.5 = 1M-2M、Qwen3 = 128K。FDE 必须在架构层管理长上下文:分段、摘要、RAG、外部记忆。

实例

  • 把 500 页 PDF 塞进 128K 窗口 → 单次问答成本高、响应慢。
  • 用 RAG 把 500 页拆成 50 个相关片段 → 成本降 10 倍,精度提升。
来自行业的实例
把 500 页 PDF 塞进 128K 窗口 → 单次问答成本高、响应慢。
用 RAG 把 500 页拆成 50 个相关片段 → 成本降 10 倍,精度提升。

关联术语

关于 Context Window(上下文窗口) 的常见问题

Context Window(上下文窗口) 的核心定义是什么?

LLM 单次推理能处理的最大 token 数

Context Window(上下文窗口) 在 FDE 工作流中扮演什么角色?

Context Window 是 LLM 单次推理能处理的最大 token 数(含输入 + 输出)。2025 年主流模型的窗口:GPT-4o = 128K、Claude Sonnet 4.5 = 200K、Gemini 2.5 = 1M-2M、Qwen3 = 128K。FDE 必须在架构层管理长上下文:分段、摘要、RAG、外部记忆。