gadfly3173's recent timeline updates
gadfly3173

gadfly3173

V2EX member #550386, joined on 2021-07-08 16:24:58 +08:00
Today's activity rank 14082
gadfly3173's recent replies
> 不要再用 agent plan 的公式来推算可以使用的量了,这是完全不准确的。

虽然缓存命中不打折很坑,但是我更好奇你这个结论是怎么得出来的?文档里都没写缓存命中价格,每个模型的输入输出消耗倍率都写了,你怎么会算出来不准确的用量呢?
往/usr 下扔缓存挺变态的。。。deepin 的不可变是可以关的,参考文档 https://bbs.deepin.org.cn/zh/post/286633
@gadfly3173 #4 5000 万 token 是目前 glm-5.2 2.5 折的效果,七月开始要除以 4 ,所以非常非常少。
火山两种订阅的 200 档位,5 小时限额都是约 5000 万 token ,缓存无折扣。和阿里比肯定是便宜的,和官方或者 opencode 比肯定是贵的。
这模型给 FIM 了吗?感觉拿去给代码补全用还行,使用量也很高
我觉得 GPT5.5 的指令遵循确实不如 5.4 或者其他模型,比如我经常使用的 code-review-excellence skill 中对最终报告的输出有格式要求,GPT5.5 是最偏离格式要求的模型,Opus 4.8 或者 GLM-5.1 、Deepseek V4 Pro 等都可以很好地遵循输出的格式,5.4 会稍微改变一些,但也是基本遵守的。
听起来适合用 git filter repo ,因为你还需要重写 module 的路径。
May 30
Replied to a topic by lame_chen 程序员 大模型不听话咋整(skill)
skill 纯看大模型的指令遵循怎么样了。比如 GPT 就很喜欢不按照你要求的输出格式来输出。
你可以用 randomaccessfile 里的 seek 实现一个差不多的,只要你不实现行号的计算,只是从文件尾往前读的话应该也不会很慢。
在 ai 大火之前,论坛里是各种婚恋话题
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   3304 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 16ms · UTC 11:58 · PVG 19:58 · LAX 04:58 · JFK 07:58
♥ Do have faith in what you're doing.