-
Book-to-skill:把一本 400 页的技术书,编译成 Agent 按需加载的技能
你买了一本《Designing Data-Intensive Applications》,啃了三个月,划线、做笔记,以为终于懂了。半年后写代码遇到复制延迟的问题,你隐约记得书里第五章讲过,但具体说了什么、用了什么术语,全忘了。打开 PDF 搜 replication,返回 47 个结果分布在 23 页里。把整本书丢给 Claude?一本 400 页的书大概 20 万 token,每问一次就烧一次全…- 1.1k
- 0
-
Pxpipe:用视觉通道绕开 Token 计费,把文字变成图片来省钱
如果有人在 2026 年 5 月告诉你,他能帮你把 Claude Code 的账单砍掉 60%,方法是把你的提示词渲染成图片再发给模型,你大概率会觉得他在搞行为艺术。正常人的逻辑是:图片比文字大得多,怎么可能省钱。 但 pxpipe 证明了这个反直觉的逻辑是对的。Anthropic 对图片 Token 的计费是按像素尺寸算的,图片里塞了多少字符,账单不关心。一张 1928×1928 的 PNG 约…- 1.3k
- 0
-
Headroom:AI Agent 的上下文压缩层,砍掉 90% Token 但答案不变
写 AI Agent 的人都有一个共同的焦虑:Token 烧得太快了。Agent 调一次工具返回几千字的 JSON,读一个文件灌进去几百行代码,RAG 检索拉回来一堆半相关的文档片段。这些内容里 70% 到 95% 是 LLM 根本不需要的噪音。但 Agent 不管,照单全塞进 prompt。 更反直觉的是:把这些冗余信息砍掉 70% 到 95%,LLM 给出的答案几乎没变。不是"差不多…- 1.2k
- 0





