<?xml version="1.0" encoding="utf-8"?>
<feed xmlns="http://www.w3.org/2005/Atom">
  <title>sid-code 博客</title>
  <subtitle>sid-code 的机制解析与工程实测：一个机制为什么这么设计、实现里踩了哪些坑、实测数据是多少、当前边界在哪。</subtitle>
  <link href="https://www.sid-code.cc/blog/" />
  <link rel="self" type="application/atom+xml" href="https://www.sid-code.cc/blog/feed.xml" />
  <id>https://www.sid-code.cc/</id>
  <updated>2026-08-04T00:00:00+08:00</updated>
  <entry>
    <title>Prompt Cache：两族协议的分叉，和 4.3 亿 token 的实测账</title>
    <link href="https://www.sid-code.cc/blog/prompt-cache" />
    <id>https://www.sid-code.cc/blog/prompt-cache</id>
    <updated>2026-08-04T00:00:00+08:00</updated>
    <summary>294 会话 · 4.3 亿输入 token 账本 · 整体命中率 65.5% —— 同一套缓存策略，在 Anthropic 协议和 OpenAI 协议上必须写成两种形状——差异会一直渗透到你怎么摆一条日期字符串。这篇拆开 sid-code 的实现分叉，交出 294 个会话 4.3 亿输入 token 的命中率账本，以及几个只有实测才能发现的坑。</summary>
    <category term="上下文工程" />
    <category term="prompt cache" />
    <category term="成本优化" />
    <category term="机制解析" />
    <category term="实测" />
  </entry>
  <entry>
    <title>JIT 上下文：让规则在正确的时刻进入上下文</title>
    <link href="https://www.sid-code.cc/blog/jit-context" />
    <id>https://www.sid-code.cc/blog/jit-context</id>
    <updated>2026-08-02T00:00:00+08:00</updated>
    <summary>19 会话实测基线 · 3 个静默缺陷 · 5 条未修边界 —— 规则写了却不被遵守，多半不是模型不听话，而是那条规则当时根本不在上下文里。这篇拆开 sid-code 的两条注入路径，附 19 个会话的实测基线、三个只能靠实测发现的静默缺陷，以及五条至今没修的边界。</summary>
    <category term="上下文工程" />
    <category term="机制解析" />
    <category term="实测" />
  </entry>
</feed>
