把 90% 的 token 烧在错的地方:headroom 帮我把 Agent 成本压了 7 倍
很多人跟我一样,最近被 LLM 的 API 账单吓到过一次。 不是训练侧的成本,是 Agent / RAG 这类"每次调用都要拼一大坨上下文"的场景。一个典型的 Claude Code 会话,过去一个月我把日志翻出来看,工具输出和日志回显占进去的 token 是真问题里最容易被忽略的那块。 ...
很多人跟我一样,最近被 LLM 的 API 账单吓到过一次。 不是训练侧的成本,是 Agent / RAG 这类"每次调用都要拼一大坨上下文"的场景。一个典型的 Claude Code 会话,过去一个月我把日志翻出来看,工具输出和日志回显占进去的 token 是真问题里最容易被忽略的那块。 ...
6 月 16 日,Vicki Boykis 那篇《Running local models is good now》冲上 Hacker News 第四,1044 分、437 条评论。她自己用的设备是一台 2022 年的 M2 Mac、64GB 内存、1TB 存储——不是什么 M3 Ultra 工作站,就是普通开发者的常规配置。 ...
这篇文章撕开了一个很多人不愿意承认的事实。 2026 年 6 月 6 日,一个叫 poisonfountain 的软件工程师在 Bear Blog 发了一篇长文,标题是「LLMs are eroding my software engineering career and I don’t know what to do」。他自己写得很克制,但评论区炸了。第二天帖子被顶到 Hacker News 第 11 位,787 分,768 条评论。评论/分数比接近 1:1,是典型的"被讨论而非被点赞"信号:不是大家都同意,是这件事戳到了每一个人。 ...