结论:省积分的核心是减少无效 token 和多余的工具调用,而不是单纯少用。

① 提问前把需求写清楚,一次说全,避免来回追问,多轮对话的上下文会反复计费。

② 长文档先自己摘出关键段落再喂进去,别整篇丢给模型,输入 token 能砍掉一大半。

③ 简单任务用轻量模型,只有真正需要推理和复杂生成时才切到强模型。

④ 关掉用不上的联网、代码执行等开关,这些功能每次触发都会额外扣分。

⑤ 定期清理会话历史,别让无关的旧上下文一直挂在里面跟着计费。