教同事用 AI 助手,我第一条教的不是提示词

傍晚的时候,一位同事刚把 AI 助手装上,一边处理手上的异常一边挤出空来跟我聊。她先问的不是怎么写提示词,是装在哪台机器合适,然后顺口补了一句担心:token 会不会烧太多。

我给她的答案只有一个斜杠。

她先问的是机器

我说装在自己长期开机的那台上。道理很简单:助手要能被随时叫起来干活,定时任务、后台轮询、隔天的收尾才有落脚点。装在一台下班就合盖的笔记本上,再好用也只在你在场的时候好用。

然后她说了那句:「但是应该不会消耗太多 token 吧。」

我能理解,刚上手的人都先心疼钱。

我只教了一个斜杠

我回的是:任务结束就 /new,多用这个指令。

为什么要紧,我打个比方。会话历史每一轮都要重新喂给模型,你跟它聊得越久,桌上堆的纸就越多,之后每说一句话都得先把前面那摞重新摊开读一遍。后果有三层:

  • 慢。一次请求要吞下几万字历史,生成时间跟着涨。
  • 贵。按 token 计费的时候,旧账也照样收钱,你又不会回头去读它。
  • 更麻烦的是变笨。上下文太长,注意力被稀释,真正的新任务被挤到边上,偶尔还会把上个任务的残留当成背景,答着答着就串了台。

/new 是唯一真正「放下」的动作。桌面清空,从头开始,钱和注意力都花在眼前这件事上。

那压缩不是会自动清吗

会。会话长到一定程度会被压缩,把旧内容压成摘要接着聊,这是兜底机制,不是日常习惯。摘要终究是摘要,细节会掉,而且压缩本身也要跑一轮模型,不是免费的。兜底可以有,靠它过日子就本末倒置了。

一点感想

新手最容易走两个极端:要么什么任务都挤在一个会话里,觉得「它都记得」是好事;要么被 token 吓住,什么都不敢问。

其实真正烧钱的不是开着不用,是旧会话堆着几万字还接着往下聊。任务收尾就 /new,比什么提示词模板都实在。

希望她听得进去喵。