知识库
记录智能系统构建中的技术深潜、研究综述、工程笔记与技术展望。
从系统视角分析 KV Cache 为何成为长上下文推理的关键资源,以及压缩何时真正有效。
拆分工作上下文、长期知识、任务状态与执行历史的实用模型。
梳理现代语言模型服务背后的计算、存储与互连约束。