同一个工具,用得好省钱又高效,用不好费钱又泄密。
AI 不按"字"算钱,而是按 Token(词元)算 —— 它把你的话切成一小块一小块。
如果每次请求的开头部分一模一样,系统会"记住"它,后面再用就便宜很多。
模型每读进一个 Token,都要现场算出一份“理解笔记” —— 专业上叫 KV(Key / Value),它是注意力机制里用来回看上文的中间结果。 关键在于:某个 Token 的 KV 只取决于它和它前面的内容。所以只要请求的开头一字不差,这一段的 KV 就能原样复用、不必重算 —— 省下的正是这段重复的计算量(也就少占了算力,所以更便宜)。
最贵的模型不等于最该用的模型。按任务难度挑,才是省钱关键。
和 AI 长时间对话做事时,对话越长越费钱 —— 因为每一句都得带着前面所有历史。
这两个命令行 Agent 都把上下文当成预算来管。记住下面几条命令和约定,省下的就是真金白银。
/compact
/clear
CLAUDE.md / AGENTS.md
plan first
@path
git / GitHub
问得清楚,一次就对;问得含糊,反复返工 —— 返工才是最大的浪费。
API Key 不是普通密码 —— 谁拿到,谁就能花你的钱。
你发出去的话,沿途每一站都看得到明文 —— 不只是大模型厂商。
以下均为公开报道的真实事件——代价从机密外泄到账单被盗刷不等。
几条容易被忽略、但很关键的习惯。
一定记住这两栏。
测试是否掌握token成本与安全管控:全部答对 19题 解锁独立使用高价模型的资格。