AI编程如何节约使用token
一、表达层面:说人话,但说短话
1. 删除一切礼貌用语和寒暄 模型不需要"请""谢谢""能否麻烦你"。把"你好,我想请你帮我看一下这段代码,我觉得它可能有点问题,不知道你能不能帮我优化一下"压缩成"优化以下代码:"。每减少一个无意义token,都是真金白银。
2. 使用结构化标记,而非自然语言描述 用代码块、列表、符号代替长句描述:
-
差:
我需要你写一个函数,这个函数的作用是接收一个用户的ID,然后到数据库里面去查这个用户的订单,然后返回订单的列表,要求用Python写,使用SQLAlchemy。 -
优:
Python函数:输入user_id,查询orders表,返回List[Order]。框架:SQLAlchemy。
3. 一次只问一件事 多任务混杂会拉长输入输出,且容易让模型"走神"导致返工。把"写代码+写测试+写文档"拆成三轮,每轮输出更精准,总token消耗往往比一轮混杂生成更少。
二、上下文管理:只给"必要信息"
4. 提交代码片段,而非整个文件 不要贴进去500行的完整文件让AI找bug。用# ...省略无关部分,只保留关键函数和周边10-20行上下文。如果涉及多文件,用文件路径+关键接口代替完整内容:
plain
# utils.py
def calculate_discount(price, user_type): ...
# 当前问题:在cart.py第45行调用时返回None
5. 建立"项目摘要"(Project Summary) 与其每次对话都重复项目背景,不如在第一轮生成一段200字以内的项目摘要(技术栈、核心依赖、架构风格)。后续对话引用它:基于上述项目背景,实现...。避免重复token。
6. 及时新开对话,清理历史 长对话中,历史消息会持续累加token消耗。当话题切换(如从"写登录模块"转到"写支付模块"),果断新开对话。如果必须延续,让AI先总结当前进度(50字以内),然后基于总结开新窗。
三、代码策略:让AI做"设计",你做"实现"
7. 要伪代码/大纲,不要完整代码 让AI输出逻辑骨架和关键算法,你自己填充 boilerplate(样板代码)。伪代码的token量通常是完整代码的1/5到1/3,且你手动实现的部分往往更贴合项目风格。
8. 模块化提问,利用函数签名 不要问"如何实现整个推荐系统"。先问接口设计:def recommend(user_id: str, n: int) -> List[Item]: ... 的合理实现方案?确认后再深入具体函数。这避免了AI生成大量最终被废弃的代码。
9. 复用已有代码,明确引用 如果项目已有类似实现,贴出参考函数并说明:"参照validate_email()的风格,实现validate_phone()。"AI会模仿已有模式,减少解释成本,输出也更短。
四、工具与流程:把token花在刀刃上
10. 区分"思考模型"和"编码模型" 用轻量级模型(如GPT-4o-mini、Claude 3 Haiku)做代码补全、格式化、简单重构;只把复杂架构设计、疑难bug排查交给顶级模型(o3、Claude 3.5 Sonnet)。成本差距可达10倍以上。
11. 启用Prompt Caching(如果支持) 部分API(如Anthropic)支持提示缓存:将不变的系统提示、项目规范、常用代码库预加载到缓存中,后续调用只计费增量部分。适合有固定代码规范的大型项目。
12. 本地化处理"体力活" 格式化、 lint 修复、变量重命名、简单文档生成——用本地工具(Black、Ruff、Copilot本地版)解决,不要调用API。把API token留给真正的逻辑难题。
五、输出控制:约束AI的"话痨"属性
13. 在prompt中设定输出长度上限 明确追加指令:回答控制在300字以内。 / 只输出代码,不要解释。 / 如有多种方案,只给出最优的一种。 模型默认倾向于"详细解释",这会膨胀3-5倍token。
14. 要求"diff格式"而非完整重写 让AI以+/- diff格式返回修改,而不是重写整个文件。diff的token量通常只有完整代码的5%-10%,且你apply时更不容易出错。
15. 使用"继续"(continue)策略 如果AI因长度限制截断输出,不要让它重生成完整代码。直接说"从def process_data处继续",只补全剩余部分。
六、总结:Token节约的核心思维
节约token不是抠门,而是信息密度的管理。
表格
| 浪费token的行为 | 节约token的做法 |
|---|---|
| 贴整段无关代码 | 只贴关键行,用...省略 |
| 自然语言描述需求 | 结构化列表 + 代码示例 |
| 让AI一次做三件事 | 拆成三轮,每轮一个原子任务 |
| 长对话里反复纠偏 | 及时总结开新窗 |
| 要完整可运行代码 | 要伪代码/接口,自己填充细节 |
最终原则:你的时间比token贵,但token比无意义的废话贵。 把AI当作一个按字收费的资深工程师,你自然会学会精简表达——而这恰恰也是优秀工程师的核心能力。
更多推荐

所有评论(0)