<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Context Window on 魔都水滴</title>
    <link>https://blog.margrop.net/tag/context-window/</link>
    <description>Recent content in Context Window on 魔都水滴</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>zh-CN</language>
    <lastBuildDate>Sun, 19 Jul 2026 18:30:00 +0800</lastBuildDate>
    <atom:link href="https://blog.margrop.net/tag/context-window/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>AI 为什么总说‘我忘了’？Token、上下文窗口与那叠写满就必须丢掉的便利贴</title>
      <link>https://blog.margrop.net/post/ai-token-context-window-sticky-notes/</link>
      <pubDate>Sun, 19 Jul 2026 18:30:00 +0800</pubDate>
      <guid>https://blog.margrop.net/post/ai-token-context-window-sticky-notes/</guid>
      <description>&lt;blockquote&gt;&#xA;&lt;p&gt;&lt;strong&gt;先说结论&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;AI 的“记忆力差”，很多时候不是它完全没有记住，而是当前对话能带进模型的内容有限。可以把上下文窗口想成一叠有限容量的便利贴：新的问题和工具输出不断贴上去，便利贴写满以后，系统就必须压缩、截断，或者把最旧的一部分移走。被移走的内容，模型在当前请求里就很可能再也看不到。&lt;/p&gt;&#xA;&lt;/blockquote&gt;&#xA;&lt;p&gt;你有没有遇到过这种场景：刚刚和 AI 约定“所有代码都用 Python”，聊了十几轮以后，它突然给出一段 JavaScript；你明明把项目背景写得很完整，AI 却又问了一遍“你使用的是什么系统”；或者你上传了一篇长文档，AI 能准确复述开头，却对中间那条最重要的限制条件一无所知。&lt;/p&gt;&#xA;&lt;p&gt;这看起来像“AI 记性不好”，但更准确的说法是：&lt;strong&gt;AI 每次回答时，能看到的内容受到上下文窗口限制；而能看到，也不代表它会同等重视每一段内容。&lt;/strong&gt;&lt;/p&gt;&#xA;&lt;p&gt;本文不把 Token 讲成吓人的数学名词，而是把它讲成一套便利贴管理规则。你会看到 Token 是什么、上下文窗口如何装载、为什么长对话会遗忘、Agent 为什么更容易把窗口塞满，以及普通用户如何用简单的整理方法让 AI 少忘事。&lt;/p&gt;</description>
    </item>
  </channel>
</rss>
