PRIME会员社区精选
路中南
路中南
07/30 11:59
七月再聊模型使用

网页链接 上次六月初聊了大模型的使用体验,那个时候兴起了token效率。经过实践来看: 1、把第三方模型接入 Claude Code 总会消耗更多 token;弃用 Claude 后 2、用了一个多月的 ZCode,现在转向 Pi,后者相当精简。删除了大部分前期积累的各种技能,input 消耗的token减少许多。Pi 还支持缓存未命中的警告;比如 3、对话搁置太久重启会丢失热缓存,导致消耗更多token,打铁要趁热。 期间我放弃了 Kimi 订阅,一方面是基础订阅的 token plan 太少,另一方面是模型在思考过程中反复纠结,两者叠加的后果就是5小时额度消耗完了还没有产出任何内容。这种白烧token让我对地球母亲有罪恶感。在 K3 出来后我意识到这种「模型思考时的纠结」并不是Kimi的问题: 1、Kimi 2.7 用的中文来思考,其他家用的是英文,所以纠结的过程很容易被用户看到; 2、其他家的英文思考过程也能看到「纠结」,比如七月主力用的 GLM 5.2。 3、Kimi 的问题是推理速度太慢了,用户等到没有耐心所以去看思考过程,一看居然都在纠结。只要推理速度足够快、限定思考用的token,纠结与否不重要的。纠结不是问题。 七月我用的是 OpenCode Go 的套餐,除了有周限额还有个月限额,最高用到60USD,GLM 5.2 很快烧完了,很多时候在用免费的 DeepSeek Flash 和 Big Pickle。看到同事们都在开心地耍 Claude 和(重置了一遍又一遍的)ChatGPT,我感觉就跟章鱼哥看着海绵宝宝与派大星出去玩一样,前几日终于订阅了 GPT Plus: 1、GPT 5.6 系列会讲人话很多,反而之前最会讲人话的 Claude 不太会讲人话了。 2、terra high 就足够覆盖我大部分日常需求了,几百K token 就能一次性解决/搞定我的小任务。 3、在 GitHub 上找了个 tokenBar 来追踪 token 使用,底层是tokscale,喜欢TUI的直接用后者就行。 最后讲个解决问题上的模型差异案例:每一次重启后,我的 Jump Desktop Connect 就会卡在初始化动不了,一开始我以为是软件的bug或者是 macOS 27 beta 的bug,但是重新安装后并没有解决,前几个星期我都让 DeepSeek V4 Flash/ Big Pickle去解决这个问题。 这些小模型的回复是,软件的 launch 进程失败了,所以帮我写了一个 plist,我一看真启动成功了,真棒!但是我第二次重启发现问题依然在,我猜也许是执行的问题?结果这几天第三次重启问题依旧,刚好订阅了嘛我就找了 GPT terra high,它先拟了三个请求去互联网上查询类似的问题,最后给了截图中的回答。 我很意外,想起来确实有这么回事,因为没认出 PhaseFive Systems 是哪个软件从而关掉了它的后台运行权限……去设置里开了就好了。

kokdemo
kokdemo
07/30 16:36
会员续费啦

之前的点数都还没花过,今年继续选择无点数版本。 继续呼吁下直接给作者打赏点数的功能哈哈哈哈哈