InferClaw Tools

中文窄主题验证 · 仅 Claude Code / Cursor

Claude Code / Cursor 成本与额度浪费体检

不是精确算账,而是找出让你快速烧额度的使用模式。 全部在浏览器里读你贴的内容,不上传任何日志。

为什么 Claude Code / Cursor 用得这么快?

多数情况下不是因为模型贵,而是 workflow 在重复烧上下文: 每次都贴同一段背景、每次都把整段 stack trace 回灌、每次都在错误循环里把同一份失败反复重发。 真正烧额度的不是"一次贵的请求",而是一连串本可以不发生的请求

体检范围(D1–D9)

9 条本地自检线索。每条都对应一种可识别的浪费模式,配 D 编号方便你和自己的 session 对照。

  • D1

    全仓库盲扫

    一次性把整个 monorepo 当上下文喂给模型,触发重复读、重复理解。

  • D2

    重复上下文投喂

    每个 session 都从零重新贴同一段 system prompt / 规则 / 背景。

  • D3

    build/test 失败循环

    同一组错误反复重试,每次把整段 stack trace 回灌到上下文。

  • D4

    简单任务用高成本模型

    改一行配置 / 跑一次命令也用最贵的 Opus / Sonnet / Max 档。

  • D5

    session 没有 stop condition

    没有明确的「做到 X 就停」,最后变成无限改稿。

  • D6

    任务没拆导致上下文膨胀

    把「重构整个模块」塞进一个 prompt,模型只能越改越糊。

  • D7

    验证证据不足

    让模型「看着改对了」但没让它跑测试 / diff / lint。

  • D8

    输出不可执行

    产出大段解释,但用户必须自己手动搬运才能用。

  • D9

    额度 / 容量风险

    周额度、月额度、并发上限被快速打穿,但没有 stop-the-line 策略。

这个工具不做什么

  • 不上传你的 session 日志、prompt、token 计数
  • 不收集 API key、不接 provider 接口
  • 不做实时监控、不写后台
  • 不自动修改 ~/.claude/、Cursor 配置、cron、provider 设置
  • 不做精确账单、不给 USD/CNY 数字承诺
  • 不替代 Claude Code / Cursor 官方 telemetry
  • 不暗示「用完就能省钱」或「省 X%」

成本估算只能称为"近似暴露 / 配额烧穿风险 / 容量烧穿风险",不承诺"省 X%"或"省 Y 元"。

Checklist查看 D1–D9 完整 checklistSample查看示例报告(mock)

本地自检 prompt(直接复制到你的编辑器)

这是一段文字 prompt,不会上传任何东西。把它贴进 Claude Code / Cursor / 任何编辑器, 把 输入字段 替换成你已经脱敏的 session 摘要即可。

# 本地 Claude Code / Cursor 自检 prompt(复制到本地编辑器使用)
# 工具:你可以贴给 Claude Code、Cursor,或自己跑。
# 原则:不连网、不上传、读完再决定改不改。

请基于下面这份【已脱敏】的 session 摘要,输出一份人工可读的浪费体检报告。
只读,不要修改任何配置或文件。

# 输入字段(用户填)
- 工具: claude-code / cursor / 其他
- 最近 N 次 session: (N、起止日期、平均时长)
- 平均 input tokens / session: (估算)
- 平均 output tokens / session: (估算)
- 触发最多失败的任务: (一句话)
- 是否每天都有同一类 prompt 重复: yes / no
- 是否每个 session 都从零重新贴上下文: yes / no
- 是否 build/test 反复失败重试超过 3 次: yes / no
- 是否会在不同 session 之间换模型: yes / no

# 输出格式(Markdown)
1. **结论(Verdict)**:可能浪费 / 高度怀疑 / 几乎不浪费
2. **Top 3 浪费信号**:每条配 1 句证据 + 1 条 D1-D9 编号
3. **为什么重要**:1 句,不承诺省钱
4. **下次怎么改**:可手动执行的 1-3 条
5. **不知道的事(Limits / Unknowns)**:诚实列出

# 红线
- 不给美元/人民币精确数字
- 不写"省 80%"之类承诺
- 不让用户改 ~/.claude/、provider config、cron、自动 apply
- 不建议任何 dashboard / SaaS / 上传服务

Agent Run Kit · 10 分钟

10 分钟 Agent Run Kit

不要上传日志。把脱敏摘要复制到你自己的 Claude / ChatGPT / Claude Code / Cursor, 让 agent 生成一份 D1-D9 浪费体检报告。

Step 1准备脱敏 session 摘要

不要贴:API key / token / private repo URL / 客户数据 / 个人信息。

不要贴:完整项目代码 / 完整聊天记录。

只需要:5-10 行摘要,按下面 10 个字段填。

# 脱敏 session 摘要(10 字段,5-10 行内填完)
- 工具: Claude Code / Cursor / 其他
- 使用场景: 修 bug / 新功能 / 重构 / 写测试 / 部署 / 调研
- session 时长: < 20 分钟 / 20 分钟-1 小时 / 1-3 小时 / > 3 小时
- 大概轮数: (如 10 次对话 / 30 次 tool calls / 不确定)
- 这次想完成什么: (一句话)
- 卡住在哪里: build 失败 / test 失败 / 找不到文件 / 改错方向 / 反复解释 / 上下文太长 / 其他
- 是否重复出现同一错误 / 同一文件 / 同一段背景: yes / no / 部分
- 可脱敏错误信息: (删除 API key / token / private repo URL / 客户数据 / 个人信息)
- 我主观觉得浪费的地方: (一句话)
- 下次最想改的地方: (一句话)

Step 2复制 Agent Auditor Prompt

下面这段 prompt 让 agent 强制输出 D1-D9 完整 mapping + NEEDS INFO fallback。 直接复制,贴到你自己的 Claude / ChatGPT / Claude Code / Cursor。

# 角色
你是一位中立的浪费审计员。基于下方【脱敏】session 摘要,输出 D1-D9 体检报告。
只读、只分析、只给 text-only 建议。不要修改任何配置或文件。

# 原则
- 不上传、不保存、不写后台
- 不收集 API key / token / private repo URL / 客户数据 / 个人信息
- 文本分析,不假设真实 token 数
- 不承诺省钱数字、不给 USD/CNY 金额
- 不输出"自动 apply"或"一键修复"命令
- 所有建议 text-only,由用户手动执行

# 输入
用户会贴一份已脱敏的 session 摘要(格式见 # 输出前先看输入)。如果用户给的
摘要不足以判断 D1-D9 中的任何一条,必须输出 NEEDS INFO 并列出还需要哪些信息。

# 输出(严格按这个 Markdown 结构)

## Verdict
- 必填 1 选 1:CLEAN / WATCH / ACTION NEEDED / HIGH WASTE RISK
- 附 1 句中性说明(不承诺省钱)

## Top 3 Waste Signals
对每一条:
- signal: 1 行信号名(对应下方 D1-D9 编号)
- evidence: 1 句来自用户摘要的引用或改写
- why it matters: 1 句说明为什么重要(不承诺省钱数字)
- confidence: high / medium / low

如果证据不足,给出 NEEDS INFO 而不是猜测。

## D1-D9 Mapping
对 D1 到 D9 每一条,标 1 个:
- ✓ 命中(附 1 句证据)
- ✗ 不命中
- ? 证据不足(说明缺什么)
- 9 条全标,不允许省略

D1 全仓库盲扫
D2 重复上下文投喂
D3 失败循环
D4 大模型滥用
D5 缺 stop condition
D6 未拆任务
D7 验证不足
D8 输出不可执行
D9 额度风险

## Manual Next-Session Rules
- 3 条具体规则
- 每条都要"下次 session 启动时立刻可执行"
- 全部 text-only,不写 shell 命令让用户盲跑

## What We Cannot Know
- 没有完整 telemetry
- 没有官方 token usage
- 不能精确算成本
- 不能确认实际节省金额
- 任何"省 X%""省 Y 元"都不在报告里出现

## Feedback Questions(请用户回答)
- 这个报告有没有指出你原来没意识到的问题?
- 你会不会按建议改变下一次 session?
- 你愿不愿意第二次跑这个 audit?
- 如果做成 local / skill 月度报告,你是否愿意付费?(不愿 / ¥39 / ¥99 / ¥199 / 其他)

# 红线(违反任意一条 = 输出无效)
- 不要编造 token 数字
- 不要承诺省钱
- 不要给自动修改配置命令
- 所有建议必须 text-only
- 证据不足时输出 NEEDS INFO,而不是猜测

# 输出前先看输入
(这里由用户粘贴脱敏 session 摘要。摘要格式见 # 输入 字段。
如果用户没填或字段缺失 3 个以上,直接输出 NEEDS INFO 列出缺失字段。)

Step 3在你自己的 agent 里跑

  • 把 Step 1 填好的脱敏摘要 + Step 2 的 prompt 粘到你自己的 Claude / ChatGPT / Claude Code / Cursor
  • 只在你自己的环境运行 — 本站不处理、不保存、不上传任何内容
  • 所有建议都是 text-only,由你自己手动决定要不要改
  • 如果 agent 输出 NEEDS INFO,按它的要求补字段再跑一次

Step 4只回传 verdict(可选)

如果愿意参与 PoC,只发:Verdict / D1-D9 mapping / Feedback Questions 的答案。

不要发:原始 session 日志、完整 prompt / 完整 agent 输出、任何客户数据。

渠道:发邮件到 support@inferclaw.ai,主题写「Agent Run Kit 回传」。邮件会由 InferClaw 人工查看, 本站不处理、不保存、不上传任何其他内容。

下一步

  1. 先打开 D1–D9 checklist, 把每条和最近一次 session 对照一遍。
  2. 用上面的 prompt 生成一份 mock 报告,对照 示例报告 看结构。
  3. 所有修复都是 text-only,由你手动执行。不存在"一键 apply"。

想参与中文 PoC(提供 1 份脱敏 session 摘要换 1 份人工报告)? 发邮件到 support@inferclaw.ai。我们不承诺 5/5 都回,只承诺会读每一封。