• 请不要在回答技术问题时复制粘贴 AI 生成的内容
zhangli2946
V2EX  ›  程序员

面对越来越贵的 token 我们能做什么

  •  
  •   zhangli2946 ·
    go4s · 2h 33m ago · 726 views

    今早 kimi 申请退款了。

    换了 scnet.cn 的按量调用。

    我体验下来,模块级别代码补全、vibe coding 、人类强_监督的编程工作中,Deepseek-V4-Flash 已经很够用了。

    突然"涌现"了一个想法,缓存命中是复用,"标准构建块" 复用怎么就不是复用了?

    贵价模型,输出_消尓壳_代码,不是"殄暴尤物"了。

    9 replies    2026-09-07 16:25:36 +08:00
    jhytxy
        1
    jhytxy  
       2h 32m ago
    gemma4 qat 版本已经够用了

    两张 2080ti 22g 的事
    zhangli2946
        2
    zhangli2946  
    OP
       2h 30m ago
    @jhytxy 我 4060ti G(8) ~有用~
    coefu
        3
    coefu  
       2h 29m ago
    如果厂商为了性能更好,都搞隐式推理,显式的 token 生成就会大大降低量。不过订阅就要从纯 token 模式,换花样了,毕竟在他们模型里多跑几趟,那也是耗算力更多。

    只要还用厂商 api ,那么就是砧板上鱼肉。
    foryou2023
        4
    foryou2023  
       2h 24m ago
    看了一下这个这么贵
    foryou2023
        5
    foryou2023  
       2h 23m ago
    @foryou2023 这比官方也贵太多了吧。

    DeepSeek-V4-Flash-0731
    [暂不支持闲忙时定价] [RPM 预设为 200] 2026 年 7 月 31 日发布的高效轻量化 MoE 模型,总参 284B ,激活 13B ,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发、轻量化任务,适合日常对话、内容创作、基础 RAG 、批量文案处理等普惠刚需场景。

    模型价格
    计费项 单价
    输入 3 元 /百万 tokens
    缓存命中输入 0.3 元 /百万 tokens
    输出 9 元 /百万 tokens
    YanSeven
        6
    YanSeven  
       2h 20m ago
    跟随市场而动即可,无所谓,大不了不用。
    zhangli2946
        7
    zhangli2946  
    OP
       2h 15m ago
    @foryou2023 啊? 更贵了?
    zimue
        8
    zimue  
       2h 9m ago
    我开发一个,可以直接免费使用各平台 AI 的插件,而且解决的就是 TOKEN 太贵的问题,欢迎试试了。这是插件下载地址: https://github.com/07/dda/blob/main/duoda-ai-chrome.zip 。刚更新了官方:www.duodaai.com
    msg7086
        9
    msg7086  
       1h 48m ago
    按量用不起,我还是订阅吧。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   4208 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 36ms · UTC 10:14 · PVG 18:14 · LAX 03:14 · JFK 06:14
    ♥ Do have faith in what you're doing.