Defined Term
Context Window(上下文窗口)
LLM 单次推理能处理的最大 token 数
详细定义
Context Window 是 LLM 单次推理能处理的最大 token 数(含输入 + 输出)。2025 年主流模型的窗口:GPT-4o = 128K、Claude Sonnet 4.5 = 200K、Gemini 2.5 = 1M-2M、Qwen3 = 128K。FDE 必须在架构层管理长上下文:分段、摘要、RAG、外部记忆。
实例
- 把 500 页 PDF 塞进 128K 窗口 → 单次问答成本高、响应慢。
- 用 RAG 把 500 页拆成 50 个相关片段 → 成本降 10 倍,精度提升。
来自行业的实例
把 500 页 PDF 塞进 128K 窗口 → 单次问答成本高、响应慢。
用 RAG 把 500 页拆成 50 个相关片段 → 成本降 10 倍,精度提升。
关联术语
关于 Context Window(上下文窗口) 的常见问题
Context Window(上下文窗口) 的核心定义是什么?
LLM 单次推理能处理的最大 token 数
Context Window(上下文窗口) 在 FDE 工作流中扮演什么角色?
Context Window 是 LLM 单次推理能处理的最大 token 数(含输入 + 输出)。2025 年主流模型的窗口:GPT-4o = 128K、Claude Sonnet 4.5 = 200K、Gemini 2.5 = 1M-2M、Qwen3 = 128K。FDE 必须在架构层管理长上下文:分段、摘要、RAG、外部记忆。