文章
已发布的全部文章。
从头接通一个工具系统:Python 实战与 MCP 源码导读
通过本地循环、模拟审批、MCP 双模式 Client 和真实模型桥接,沿 SDK 2.1.1 源码解释整条调用链。
模型这次应该看到什么:理解上下文工程与上下文组装
从售后问题解释上下文的组成、信息来源、权限与版本,逐步构造一次有依据的模型请求。
上下文不是越长越好:Token 预算、信息选择与排列
用预算计算、依赖片段与工具交互说明上下文选择,区分窗口容量、有效信息和生成质量。
需要时再加载:渐进式披露、工具发现与外部工作区
解释目录发现、受限读取、工具加载与 Artifact 引用,理解按需获得上下文的收益和代价。
一次任务怎样继续:会话历史、工作状态与 Checkpoint
从用户修改取件时间解释消息、任务状态、检查点、并发更新和中断恢复的关系。
哪些信息值得长期记住:记忆的提取、读取、纠正与遗忘
用语言偏好和一次性取件地址解释长期记忆的写入、检索、版本纠正、失效与删除传播。
长会话怎样压缩:从聊天摘要到可继续执行的任务快照
通过授权条件丢失和取件时间变更说明压缩快照、增量摘要、原文引用以及安全恢复。
哪些上下文可以复用:缓存机制、命中条件与失效
分清前缀、组装、检索和答案缓存,用版本变更与权限撤销解释命中条件和失效传播。
谁可以看到什么:上下文隔离、可信边界与多 Agent 交接
把授权、用途和指令权限贯穿检索、记忆、摘要、工作区与多 Agent 交接,避免跨用户信息污染。
生产中的上下文工程:设计一个可追溯的上下文管理模块
设计信息提供器、策略、预算、请求组装和记录模块,解释一致性、降级、并发与策略发布。