全部文章标签

上下文窗口

解释大模型一次能读入多少 Token、窗口满了会怎样,以及长上下文、检索增强和分段处理各自适合的场景与取舍。

专题介绍

上下文窗口是大模型单次处理时能同时看到的 Token 上限,决定它能读多长的文档、记住多远的对话。这个专题围绕窗口大小的计算方式、注意力稀释与截断现象展开,并对比扩大窗口、检索增强生成和摘要压缩三条路线,帮助读者判断资料该整段交给模型,还是先检索、切分后再喂进去。

注意力机制是什么?大模型处理长文本时靠它分配关注

注意力机制是什么?大模型处理长文本时靠它分配关注

AI百科
AI导航 2 次阅读
AI回答一半就停了怎么办?别重开,这样让它续上

AI回答一半就停了怎么办?别重开,这样让它续上

AI问答
AI导航 1 次阅读
上下文窗口是什么意思?大模型一次能看多少内容的上限

上下文窗口是什么意思?大模型一次能看多少内容的上限

AI百科
AI导航 3 次阅读
RAG 是什么?给大模型外挂知识库的检索增强生成

RAG 是什么?给大模型外挂知识库的检索增强生成

AI百科
AI导航 5 次阅读
Transformer 是什么?主流大模型都在用的核心架构

Transformer 是什么?主流大模型都在用的核心架构

AI百科
AI导航 5 次阅读
Token 是什么意思?大模型处理文字的最小单位

Token 是什么意思?大模型处理文字的最小单位

AI百科
AI导航 8 次阅读
MCP协议能否替代超长上下文窗口?

MCP协议能否替代超长上下文窗口?

AI百科
AI导航 106 次阅读
大模型上下文工程实战:什么是大模型上下文工程

大模型上下文工程实战:什么是大模型上下文工程

AI百科
AI导航 84 次阅读