中文窄主题验证 · 仅 Claude Code / Cursor
Claude Code / Cursor 成本与额度浪费体检
不是精确算账,而是找出让你快速烧额度的使用模式。 全部在浏览器里读你贴的内容,不上传任何日志。
为什么 Claude Code / Cursor 用得这么快?
多数情况下不是因为模型贵,而是 workflow 在重复烧上下文: 每次都贴同一段背景、每次都把整段 stack trace 回灌、每次都在错误循环里把同一份失败反复重发。 真正烧额度的不是"一次贵的请求",而是一连串本可以不发生的请求。
体检范围(D1–D9)
9 条本地自检线索。每条都对应一种可识别的浪费模式,配 D 编号方便你和自己的 session 对照。
D1
全仓库盲扫
一次性把整个 monorepo 当上下文喂给模型,触发重复读、重复理解。
D2
重复上下文投喂
每个 session 都从零重新贴同一段 system prompt / 规则 / 背景。
D3
build/test 失败循环
同一组错误反复重试,每次把整段 stack trace 回灌到上下文。
D4
简单任务用高成本模型
改一行配置 / 跑一次命令也用最贵的 Opus / Sonnet / Max 档。
D5
session 没有 stop condition
没有明确的「做到 X 就停」,最后变成无限改稿。
D6
任务没拆导致上下文膨胀
把「重构整个模块」塞进一个 prompt,模型只能越改越糊。
D7
验证证据不足
让模型「看着改对了」但没让它跑测试 / diff / lint。
D8
输出不可执行
产出大段解释,但用户必须自己手动搬运才能用。
D9
额度 / 容量风险
周额度、月额度、并发上限被快速打穿,但没有 stop-the-line 策略。
这个工具不做什么
- ✕不上传你的 session 日志、prompt、token 计数
- ✕不收集 API key、不接 provider 接口
- ✕不做实时监控、不写后台
- ✕不自动修改 ~/.claude/、Cursor 配置、cron、provider 设置
- ✕不做精确账单、不给 USD/CNY 数字承诺
- ✕不替代 Claude Code / Cursor 官方 telemetry
- ✕不暗示「用完就能省钱」或「省 X%」
成本估算只能称为"近似暴露 / 配额烧穿风险 / 容量烧穿风险",不承诺"省 X%"或"省 Y 元"。
本地自检 prompt(直接复制到你的编辑器)
这是一段文字 prompt,不会上传任何东西。把它贴进 Claude Code / Cursor / 任何编辑器, 把 输入字段 替换成你已经脱敏的 session 摘要即可。
# 本地 Claude Code / Cursor 自检 prompt(复制到本地编辑器使用) # 工具:你可以贴给 Claude Code、Cursor,或自己跑。 # 原则:不连网、不上传、读完再决定改不改。 请基于下面这份【已脱敏】的 session 摘要,输出一份人工可读的浪费体检报告。 只读,不要修改任何配置或文件。 # 输入字段(用户填) - 工具: claude-code / cursor / 其他 - 最近 N 次 session: (N、起止日期、平均时长) - 平均 input tokens / session: (估算) - 平均 output tokens / session: (估算) - 触发最多失败的任务: (一句话) - 是否每天都有同一类 prompt 重复: yes / no - 是否每个 session 都从零重新贴上下文: yes / no - 是否 build/test 反复失败重试超过 3 次: yes / no - 是否会在不同 session 之间换模型: yes / no # 输出格式(Markdown) 1. **结论(Verdict)**:可能浪费 / 高度怀疑 / 几乎不浪费 2. **Top 3 浪费信号**:每条配 1 句证据 + 1 条 D1-D9 编号 3. **为什么重要**:1 句,不承诺省钱 4. **下次怎么改**:可手动执行的 1-3 条 5. **不知道的事(Limits / Unknowns)**:诚实列出 # 红线 - 不给美元/人民币精确数字 - 不写"省 80%"之类承诺 - 不让用户改 ~/.claude/、provider config、cron、自动 apply - 不建议任何 dashboard / SaaS / 上传服务
Agent Run Kit · 10 分钟
10 分钟 Agent Run Kit
不要上传日志。把脱敏摘要复制到你自己的 Claude / ChatGPT / Claude Code / Cursor, 让 agent 生成一份 D1-D9 浪费体检报告。
Step 1准备脱敏 session 摘要
不要贴:API key / token / private repo URL / 客户数据 / 个人信息。
不要贴:完整项目代码 / 完整聊天记录。
只需要:5-10 行摘要,按下面 10 个字段填。
# 脱敏 session 摘要(10 字段,5-10 行内填完) - 工具: Claude Code / Cursor / 其他 - 使用场景: 修 bug / 新功能 / 重构 / 写测试 / 部署 / 调研 - session 时长: < 20 分钟 / 20 分钟-1 小时 / 1-3 小时 / > 3 小时 - 大概轮数: (如 10 次对话 / 30 次 tool calls / 不确定) - 这次想完成什么: (一句话) - 卡住在哪里: build 失败 / test 失败 / 找不到文件 / 改错方向 / 反复解释 / 上下文太长 / 其他 - 是否重复出现同一错误 / 同一文件 / 同一段背景: yes / no / 部分 - 可脱敏错误信息: (删除 API key / token / private repo URL / 客户数据 / 个人信息) - 我主观觉得浪费的地方: (一句话) - 下次最想改的地方: (一句话)
Step 2复制 Agent Auditor Prompt
下面这段 prompt 让 agent 强制输出 D1-D9 完整 mapping + NEEDS INFO fallback。 直接复制,贴到你自己的 Claude / ChatGPT / Claude Code / Cursor。
# 角色 你是一位中立的浪费审计员。基于下方【脱敏】session 摘要,输出 D1-D9 体检报告。 只读、只分析、只给 text-only 建议。不要修改任何配置或文件。 # 原则 - 不上传、不保存、不写后台 - 不收集 API key / token / private repo URL / 客户数据 / 个人信息 - 文本分析,不假设真实 token 数 - 不承诺省钱数字、不给 USD/CNY 金额 - 不输出"自动 apply"或"一键修复"命令 - 所有建议 text-only,由用户手动执行 # 输入 用户会贴一份已脱敏的 session 摘要(格式见 # 输出前先看输入)。如果用户给的 摘要不足以判断 D1-D9 中的任何一条,必须输出 NEEDS INFO 并列出还需要哪些信息。 # 输出(严格按这个 Markdown 结构) ## Verdict - 必填 1 选 1:CLEAN / WATCH / ACTION NEEDED / HIGH WASTE RISK - 附 1 句中性说明(不承诺省钱) ## Top 3 Waste Signals 对每一条: - signal: 1 行信号名(对应下方 D1-D9 编号) - evidence: 1 句来自用户摘要的引用或改写 - why it matters: 1 句说明为什么重要(不承诺省钱数字) - confidence: high / medium / low 如果证据不足,给出 NEEDS INFO 而不是猜测。 ## D1-D9 Mapping 对 D1 到 D9 每一条,标 1 个: - ✓ 命中(附 1 句证据) - ✗ 不命中 - ? 证据不足(说明缺什么) - 9 条全标,不允许省略 D1 全仓库盲扫 D2 重复上下文投喂 D3 失败循环 D4 大模型滥用 D5 缺 stop condition D6 未拆任务 D7 验证不足 D8 输出不可执行 D9 额度风险 ## Manual Next-Session Rules - 3 条具体规则 - 每条都要"下次 session 启动时立刻可执行" - 全部 text-only,不写 shell 命令让用户盲跑 ## What We Cannot Know - 没有完整 telemetry - 没有官方 token usage - 不能精确算成本 - 不能确认实际节省金额 - 任何"省 X%""省 Y 元"都不在报告里出现 ## Feedback Questions(请用户回答) - 这个报告有没有指出你原来没意识到的问题? - 你会不会按建议改变下一次 session? - 你愿不愿意第二次跑这个 audit? - 如果做成 local / skill 月度报告,你是否愿意付费?(不愿 / ¥39 / ¥99 / ¥199 / 其他) # 红线(违反任意一条 = 输出无效) - 不要编造 token 数字 - 不要承诺省钱 - 不要给自动修改配置命令 - 所有建议必须 text-only - 证据不足时输出 NEEDS INFO,而不是猜测 # 输出前先看输入 (这里由用户粘贴脱敏 session 摘要。摘要格式见 # 输入 字段。 如果用户没填或字段缺失 3 个以上,直接输出 NEEDS INFO 列出缺失字段。)
Step 3在你自己的 agent 里跑
- 把 Step 1 填好的脱敏摘要 + Step 2 的 prompt 粘到你自己的 Claude / ChatGPT / Claude Code / Cursor
- 只在你自己的环境运行 — 本站不处理、不保存、不上传任何内容
- 所有建议都是 text-only,由你自己手动决定要不要改
- 如果 agent 输出 NEEDS INFO,按它的要求补字段再跑一次
Step 4只回传 verdict(可选)
如果愿意参与 PoC,只发:Verdict / D1-D9 mapping / Feedback Questions 的答案。
不要发:原始 session 日志、完整 prompt / 完整 agent 输出、任何客户数据。
渠道:发邮件到 support@inferclaw.ai,主题写「Agent Run Kit 回传」。邮件会由 InferClaw 人工查看, 本站不处理、不保存、不上传任何其他内容。
下一步
- 先打开 D1–D9 checklist, 把每条和最近一次 session 对照一遍。
- 用上面的 prompt 生成一份 mock 报告,对照 示例报告 看结构。
- 所有修复都是 text-only,由你手动执行。不存在"一键 apply"。
想参与中文 PoC(提供 1 份脱敏 session 摘要换 1 份人工报告)? 发邮件到 support@inferclaw.ai。我们不承诺 5/5 都回,只承诺会读每一封。