Skip to main content
Mellnx
Explore
Topics
Utilities
Explore
Topics
Utilities
Search
Agents
Frontend
Backend
Explore · Visual Dictionary
Agents 图解词典
看懂 AI Agent 在想什么:上下文、提示词、工具、记忆——每个概念一句话讲透,顺手带走一段能直接粘贴的 prompt。
Context Window
图解
上下文窗口 · 上下文长度
模型一次能"看在眼里"的内容上限,相当于它工作台桌面的大小。
点击查看详解 →
System Prompt
图解
系统提示词 · 人设指令
开演前塞给模型的"剧本",规定它是谁、守什么规矩、怎么干活。
点击查看详解 →
Token
图解
词元 · 字符碎片
模型数文本的最小单位——一个汉字或小半个英文单词;窗口大小和费用都按它算。
点击查看详解 →
Tool Call
图解
工具调用 · 函数调用
模型自己不动手——它发出"操作指令",由外部程序代为执行,再把结果带回来。
点击查看详解 →
MCP
图解
模型上下文协议
给 AI 接工具的"通用插线板"标准:工具方实现一次,各家 Agent 都能即插即用。
点击查看详解 →
Memory
图解
记忆 · 长期记忆
跨会话留存的笔记系统,弥补模型"聊完就忘"的短板。
点击查看详解 →
Diff & PR
图解
改动差异 · 拉取请求
AI 改代码的交付格式:Diff 标出"改了哪几行",PR 在外面再包一层说明与审查流程。
点击查看详解 →
Compaction
图解
上下文压缩 · 摘要滚动
窗口快满时,把旧对话浓缩成摘要腾出空间,好让会话继续干活。
点击查看详解 →
窗口上限
token 预算
系统提示
历史消息
工具结果
读过的文件
新消息…
!
空间告急
再塞就截断
上下文窗口:装满即截断
静态终态标注:消息块已经落满量杯,最新的一块贴着窗口上限线——超出的部分不会再被模型看到,只能截断或压缩。
SYSTEM PROMPT
用户消息
按剧本回复
继续追问
仍按剧本行事
看不见的信头
每轮都在
排最前 · 规矩最高 · 你看不见
静态终态标注:金色剧本信头盖在信纸最上方,用户消息与助手回复在其下依次叠放——信头常驻不可见,每轮对话都随身带着这封信头。
无论中文还是英文,先被切成 token:
模
t1
型
t2
读
t3
文
t4
本
t5
to
t6
ken
t7
这一句 ≈ 7 个 token
窗口大小、回复上限、账单,都按 token 数计
静态终态标注:句子已被切成 7 个 token 小块——汉字约一字一块,英文单词还会被拆开;模型读的从来不是整句,而是这串小块。
模型
宿主执行
调用指令
工具腰带(宿主准备好)
用户消息
助手回复
工具结果
静态终态标注:扳手已被抽出工具腰带,宿主齿轮转过一圈执行完毕,工具结果作为新消息回到对话流——模型只发指令,动手的是宿主。
Agent
Agent 端不变
标准线
MCP 插线板
工具
数据库
API
一次接入 · 工具换新即插即用
静态终态标注:数据库、工具、API 三支插头都接在 MCP 插线板上,信号沿标准线送入 Agent——刚换上的金色工具插头即插即用,换插头不换 Agent。
记忆板 · 跨会话
Session 1
会话结束
写下来
项目约定
偏好设置
踩坑记录
Session 2
上下文清零
读回来
便签钉在板上 · 跨会话仍可读
静态终态标注:Session 2 的对话区已经清零,但钉在记忆板上的便签还在——Agent 读板把项目约定检索回来。上下文会清零,记忆不会。
-
-
+
+
PR 审查
删除
新增
人工与 CI 双审通过才合并
静态终态标注:两行已划掉标删除、两行以金色标新增,"PR 审查"印章盖下——改动以行级 diff 交付,审查通过才算数。
压缩前的窗口
早期对话……
长工具输出……
读过的文件……
中间结论……
摘要:任务要点
腾出的空间
+ token 预算
新消息有了落脚点
会话继续干活
旧内容 → 一段摘要
细节可能丢失,要点留下
静态终态标注:长便签已压成顶部一张金色摘要卡,下方腾出 dashed 空间——旧对话换成摘要,主线保留、细节丢失。