• 请不要在回答技术问题时复制粘贴 AI 生成的内容
gux928
V2EX  ›  程序员

阿里的 tokenplan 真是一言难尽

  •  
  •   gux928 · 2h 30m ago · 787 views

    今天看到 tokenplan 新上了 DeepSeek v4 flash 0731 ,(我也不知道之前为什么下掉 Flash ),想试试看是不是划算,找了半天没找到模型消耗的对比

    我也就是想找到大概用哪个模型模型便宜,是 v4 flash 还是优惠中的 qwen-3.8max preview

    发了工单问客服,客服又把文档发了一遍

    您好,Token Plan 采用统一 Credit 抵扣机制,覆盖不同模型、不同工具。系统会根据模型档位、上下文长度、输入/输出 token 数、是否使用 Harness 工具(如联网搜索、代码解释等)综合计算 Credit 消耗,因此不同类型的调用消耗差异较大。具体的用量以实际产生的 Credits 消耗量为准。

    各位大佬有大概清楚的吗? 也不用多精确,看个大概就行。

    10 replies    2026-08-03 17:34:57 +08:00
    cskeleton
        1
    cskeleton  
       2h 28m ago
    这种只能自己测一下吧,我正在试图测一下 qwen3.8-max 不带 preview 的用量如何。然后再来测 ds flash
    sentinelK
        2
    sentinelK  
       2h 25m ago
    阿里的 deepseek 限流非常严重,TPM 1.2M token
    gux928
        3
    gux928  
    OP
       1h 33m ago
    @cskeleton 就给个 opencode go 那种类似的对比也行,现在这样太黑盒了
    lue828
        4
    lue828  
       46 mins ago
    我用 qwen-3.8max ,几个简单任务就用量 30%周额度,太夸张了
    Foxkeh
        5
    Foxkeh  
       38 mins ago
    周末才抢到的 lite 版本的 token plan, 用 glm-5.2,做个小型单体项目的代码分析,周限直接干到只剩 3%
    helysan33
        6
    helysan33  
       25 mins ago
    preview 下线了 没有 1 折 。这个额度 根本没法用了。
    kekxv
        7
    kekxv  
       13 mins ago via iPhone
    之前 199 的团队,一天不到,全部用完了,一个月的额度
    winning11k
        8
    winning11k  
       5 mins ago
    @lue828 好像 GLM5.3 也快出了,再等等看
    superrichman
        9
    superrichman  
       3 mins ago
    copilot 也一样,现在都改成 credit 了,很抽象
    shawnvan
        10
    shawnvan  
       2 mins ago
    @kekxv 哈哈哈,同一天,还好是他们赠送的,简直傻眼
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   5359 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 631ms · UTC 09:37 · PVG 17:37 · LAX 02:37 · JFK 05:37
    ♥ Do have faith in what you're doing.