🪙 内容线 SSoT · 2026-09-02
省 token 系列作战图 · 首批 16 篇(持续增补)
把「不用推理的活,从模型手里拿回来」——你已发布的第 1 篇(8-28)是一份思想总纲,正文里埋了 4 个「后面单独拆」的钩子。这张图先把已盘出的弹药排成首批 16 篇(四幕递进,每篇都有素材,不靠现编)。16 不是上限——省 token 是长期母题,未来新的省 token 工具/实践文章随时增补(S17、S18…),此图随弹药更新。
16篇总规模
1篇已发(S01)
4幕递进
2篇已成稿
10+素材卡直接供料
0 · 为什么现阶段聚焦它(三层理由)
① 它是你唯一已成体系的 IP 线
其余素材是单点散弹;省 token 已有总纲 + 六层框架 + 工具实测 + 两篇成稿(B09/B02)+ 一张完整素材卡。系列天然成立,只差发射序列。
② 与护城河 & 变现同频
C1「AI 工程化」护城河 25 分主战场;且「省 token = 省账单」是每个 coding agent 用户都痛、都可量化的话题(0.4% vs 97.7% 就是钩子),最易从内容长成付费服务。
③ 已发正文自带连载钩子
第 1 篇承诺「一周 1–2 篇」「下一篇拆检索层」,并预告 4 个单独拆点(缓存读为什么 97.7%、注意力律、钩子律、跨工具移植)。兑现预告 = 天然的追更理由。
④ 弹药全部真实可复现
每篇都有实测数据背书(-80% 工具调用 / 压 93.6% / -73% 代码量 / 累计省 6710 万 token),符合「真实工程实践 + 方法论可复现」的系列宣言,不写没干过的。
1 · 弹药盘点(家底)
| 类别 | 资产 | 支撑哪几篇 |
| ✅ 已发(公众号) | S01《省 token 的第一性原理》(8-28 20:00)+ 同日 08:15 预热贴图「90% 的人都省反了」 | 系列总纲 / S02 预告源 |
| ✅ 已发(CSDN) | H3《五层 Token 首篇》(8-06,账号 still thinkgame) | ⚠️ 五层旧版,需按六层口径对齐,勿直接引用冲突 |
| ✅ 成稿 | B09《Claude Code 省 token 配置实操》(散文层·Concise) B02《Ponytail:代码量砍 73%》(生成层) | S07 / S09 |
| 📦 素材底座 | 《六层Token系列素材卡 2026-08-27》:六层工具映射+实测表 / 4 个工程哲学 / 12 工具生态全景 / 11 条踩坑 / 落地篇映射表 | S03–S06、S10–S12、S14 全系 |
| 📦 扩展知识 | 《省 token / 精简会话技能全景》:三层精简体系 + Caveman/Output Style/Prompt Caching 待挖选题 | S08 及散文层纵深 |
| 📦 横评底座 | 《主流编程 Agent 速览与省 token 配置》(9 个 Agent,第 35 周榜单) | S15 |
| 🎨 视觉系统 | outputs/a0_省token总纲/ 全套:封面 900×383 / 图1 token 去向 / 六层金字塔 / 预热贴图 / 发布描述包 / gen_*.py 脚本可复用 | 后续每篇封面与配图直接复用管线 |
2 · 系列路线图 · 首批 16 篇(四幕)
🎯 排期逻辑:S01 已发 → S03 是正文承诺的「下一篇」,9 月上旬必须发(兑现预告);六层实战按「省最大头优先」排序(检索层 > 协议层 > 输入压缩 > 散文 > 生成);哲学与实战穿插,避免连续干货疲劳。合集归属见 §4。
第一幕 · 思想(2 篇)— 立框架、给钩子
| # | 篇名(暂定) | 档 | 幕/层 | 素材来源 | 状态 | 排期窗口 |
| S01 | 省 token 的第一性原理:把「不用推理的活」从模型手里拿回来 | A | 思想总纲 | a0 总纲全套 | ✅ 已发 8-28 | — |
| S02 | token 账单深潜:97.7% 的缓存读,到底是怎么花掉的 | C | 思想·账单 | 团队 8 个月账单统计(S01 预告「单独拆一篇」) | ✏️ 加工 | 9 月中旬 |
第二幕 · 六层实战(7 篇)— 每层 1+ 篇落地,数据说话
| # | 篇名(暂定) | 档 | 幕/层 | 素材来源 | 状态 | 排期窗口 |
| S03 | 检索层①:20 次 grep 变成 3 次图查询(CodeGraph 实测) 正文已预告的「下一篇」 | B | 检索层(省大头) | 素材卡 §一/§三.1(-80% 工具调用实测) | ✏️ 加工 | 9/9–9/10 优先 |
| S04 | 检索层②:Monorepo 该用 CBM——图检索工具怎么挑 | C | 检索层 | 素材卡 §三.1(CBM / CodeGraph / Gortex / Graphify) | ✏️ 加工 | 9 月下旬 |
| S05 | 协议层:rtk 把命令输出压掉 93.6%,累计省 6710 万 token | C | 协议层 | 素材卡 §三.2 | ✏️ 加工 | 9 月中旬 |
| S06 | 输入压缩层:Headroom——从源头压输入,省 20–95% | C | 输入压缩层 | 素材卡 §一(Headroom 新增层) | ✏️ 加工 | 9 月中旬 |
| S07 | 散文层①:改 1 个配置,账单瘦了(Concise 系统级精简) | B | 散文层 | B09 成稿(已就位) | ✅ 成稿 | 9/8(日历已排) |
| S08 | 散文层②:Caveman——让 AI 说人话,客套 -81% | C | 散文层 | 扩展知识全景(Caveman 独立成文选题) | ✏️ 加工 | 10 月上旬 |
| S09 | 生成层:Ponytail——把代码量砍掉 73% 的最懒方案(YAGNI) | B | 生成层 | B02 成稿(已就位) | ✅ 成稿 | 9/5(日历已排) |
第三幕 · 两条律 + 哲学(4 篇)— 工具会过期,思想不会
| # | 篇名(暂定) | 档 | 幕/层 | 素材来源 | 状态 | 排期窗口 |
| S10 | 律①:规则是愿望,钩子是墙——20+ 条军规为何只执行了七成 | B | 底层律 | 军规库 + hooks 实测(S01 已引 70–90% 遵从率) | ✏️ 加工 | 9 月下旬 |
| S11 | 律②:注意力比 token 更贵——128K 塞 70% 噪音,不如 32K 干净 | B | 底层律 | 素材卡 §二.2(注意力稀释效应) | ✏️ 加工 | 10 月上旬 |
| S12 | 哲学:能写成 bash 的,就别让 Agent 跑(数据搬运谬误) | C | 工程哲学 | 素材卡 §二.1/3(Sub Agent 分工 + 搬运谬误) | ✏️ 加工 | 10 月中旬 |
| S13 | 跨工具:同一套 hook,从 Claude Code 拆到 Codex 照用(配置可移植) | B | 工程 | 素材卡《多工具 Harness 兼容体系 2026-09-02》 | ✏️ 加工 | 10 月中旬 |
第四幕 · 避坑 + 横评 + 收束(3 篇)— 广度与闭环
| # | 篇名(暂定) | 档 | 幕/层 | 素材来源 | 状态 | 排期窗口 |
| S14 | 避坑:六层 Token 的 11 个坑,我替你踩过了 | C | 避坑 | 素材卡 §四(11 条踩坑含根因+修复) | ✏️ 加工 | 10 月下旬 |
| S15 | 横评:9 个主流编程 Agent,谁最省 token | B | 横评 | 横评素材卡(第 35 周榜单) | ✏️ 加工 | 9/18(日历已排) |
| S16 | 收束:模型会变,思想不变——半年省 token 账单复盘 | A | 收束 | a0 总纲 + 全系实测数据汇总 | 🆕 新写 | 11–12 月(攒够新数据) |
3 · 与 9 月日更日历的冲突修正(已发现 2 个硬伤)
硬伤 ①:命名撞车。日历第 2/3 周有 6 篇「六层 Token ①~⑥」,小标题却按 token 消费结构(钱花在哪 / 系统提示词层 / 上下文层 / 工具定义层 / 历史消息层 / 输出层)拆——这与 S01 已发布的六层剥离动作(需求/检索/协议/输入压缩/散文/生成)同名不同义,读者与发布者都会混乱。
硬伤 ②:与已发重复。六层Token①「你花的钱到底花在哪」讲 0.4%/97.7%——S01 第一节已讲透,再发一遍是注水。
| 日期 | 原条目(撞车) | → 修正为 | 对应 |
| 9/5 | Ponytail 砍 73%(合集标 🔧) | 保留,标注系列 S09 | S09 |
| 9/8 | Claude Code 省 token 配置实操(合集标 🔧) | 保留,标注系列 S07 | S07 |
| 9/9 | 六层 Token ① 钱花在哪 | 检索层①:20 次 grep→3 次图查询(CodeGraph) | S03 |
| 9/10 | 六层 Token ② 系统提示词层 | 协议层:rtk 压掉 93.6% | S05 |
| 9/11 | 六层 Token ③ 上下文层 | 输入压缩层:Headroom 源头压输入 | S06 |
| 9/15 | 六层 Token ④ 工具定义层 | 检索层②:Monorepo 用 CBM | S04 |
| 9/16 | 六层 Token ⑤ 历史消息层 | 账单深潜:97.7% 缓存读怎么花掉的 | S02 |
| 9/17 | 六层 Token ⑥ 输出层与总账 | 律①:规则是愿望,钩子是墙 | S10 |
| 9/18 | 主流编程 Agent 横评 | 保留,标注系列 S15 | S15 |
| 9/19 | 省 token 精简会话技能全景 | 散文层②:Caveman 说人话 -81% | S08 |
✅ 修正后 9 月共发省 token 系列 9 篇(S02–S10 中 9 篇 + S15),其余日更(速评/复利/工程化)穿插不变,节奏仍每天 1 篇。
4 · 合集归属(需要你拍板)
省 token 是持续产出的母题(首批 16 篇已排、后续仍增补),足够且应该撑起一个独立合集。已发 S01 当时的发布参数就写了合集「行途 · 省 token 系列」(见 a0 README),只是这个合集还没建。
| 选项 | 做法 | 优点 | 代价 |
| A · 新建第 4 合集「省 token 系列」(建议) | S 系篇目(B02/B09/检索/协议/输入压缩/散文/生成…)全部归它;主页 4 合集 | 系列归属清晰,追更路径最顺;合集首页上限 10 个,4 个远未满 | 「AI 工程化实战」减员 ~9 篇,改靠 B12/超卖/Agent×Harness 等支撑(仍 ≥3 生效,9/9 不受影响) |
| B · 并入「AI 工程化实战」 | 不建新合集,S 系篇目继续入 🔧 | 合集少而厚,单篇入集零冲突 | 系列感弱,S01 已宣示的「省 token 系列」名不副实 |
⚠️ 微信硬规则再确认:单篇仅入 1 集(2024-04-28 起 5→1)· ≥3 篇才展示 · 改名间隔 24h。一旦 B02(9/5)/B09(9/8)发出时入错集,补救只能先移出再入,费一道手——所以合集决策必须在 9/5 首发前定。
5 · 系列一致性铁律(每篇必守)
| # | 铁律 | 说明 |
| 1 | 开头带系列宣言 | 「真实工程实践,方法论可复现——行途『省 token』系列第 N 篇」 |
| 2 | 结尾预告下一篇 | S01 已验证的追更钩子,每篇末尾必带「下一篇拆 XX」 |
| 3 | 每篇 ≥1 个实测数据 + 口径声明 | 数据必须来源可查(数量 vs 费用口径分开,沿用 S01 规范) |
| 4 | 合集归属一致 | 全系列入同一合集(决策见 §4),中途不换集 |
| 5 | 公众号全网首发 | 先公众号后分发,间隔 ≥24h + 差异化改写 |
| 6 | 私域钩子 | 文末「回复『六层』自取落地清单」等钩子保持可用(需后台同步配置关键词) |
| 7 | 标题埋词 | 前 13 字含「省 token」或工具名(CodeGraph/rtk/Caveman/Ponytail 均为 SEO 强词) |
| 8 | 视觉系统复用 | 封面/配图沿用 a0 管线(行途蓝 #056DE8),gen_*.py 脚本可直接改参复用 |
6 · 待拍板(3 项)
| # | 决策点 | 建议 |
| 1 | 合集:新建第 4 集「省 token 系列」 vs 并入「AI 工程化实战」 | A:新建独立合集(母题持续增补撑得起;S01 发布参数当时就写的这个名)——9/5 首发前必须定 |
| 2 | 9 月日历第 2/3 周 6 条撞车条目按 §3 修正? | 是——消除命名撞车 + 重复注水,对齐已发 S01 预告顺序 |
| 3 | 首批 16 篇清单与档位(B 档 7 / C 档 7 / A 档 2)确认?后续新弹药随到随编号(S17+) | 确认后按窗口逐个进入加工,9 月优先 S03(已预告的「下一篇」) |