• 请不要在回答技术问题时复制粘贴 AI 生成的内容
gux928
V2EX  ›  程序员

阿里的 tokenplan 真是一言难尽

  •  
  •   gux928 · 8h 54m ago · 1758 views

    今天看到 tokenplan 新上了 DeepSeek v4 flash 0731 ,(我也不知道之前为什么下掉 Flash ),想试试看是不是划算,找了半天没找到模型消耗的对比

    我也就是想找到大概用哪个模型模型便宜,是 v4 flash 还是优惠中的 qwen-3.8max preview

    发了工单问客服,客服又把文档发了一遍

    您好,Token Plan 采用统一 Credit 抵扣机制,覆盖不同模型、不同工具。系统会根据模型档位、上下文长度、输入/输出 token 数、是否使用 Harness 工具(如联网搜索、代码解释等)综合计算 Credit 消耗,因此不同类型的调用消耗差异较大。具体的用量以实际产生的 Credits 消耗量为准。

    各位大佬有大概清楚的吗? 也不用多精确,看个大概就行。

    21 replies    2026-08-03 21:56:25 +08:00
    cskeleton
        1
    cskeleton  
       8h 52m ago
    这种只能自己测一下吧,我正在试图测一下 qwen3.8-max 不带 preview 的用量如何。然后再来测 ds flash
    sentinelK
        2
    sentinelK  
       8h 49m ago
    阿里的 deepseek 限流非常严重,TPM 1.2M token
    gux928
        3
    gux928  
    OP
       7h 57m ago
    @cskeleton 就给个 opencode go 那种类似的对比也行,现在这样太黑盒了
    lue828
        4
    lue828  
       7h 9m ago
    我用 qwen-3.8max ,几个简单任务就用量 30%周额度,太夸张了
    Foxkeh
        5
    Foxkeh  
       7h 2m ago
    周末才抢到的 lite 版本的 token plan, 用 glm-5.2,做个小型单体项目的代码分析,周限直接干到只剩 3%
    helysan33
        6
    helysan33  
       6h 49m ago
    preview 下线了 没有 1 折 。这个额度 根本没法用了。
    kekxv
        7
    kekxv  
       6h 37m ago via iPhone
    之前 199 的团队,一天不到,全部用完了,一个月的额度
    winning11k
        8
    winning11k  
       6h 28m ago
    @lue828 好像 GLM5.3 也快出了,再等等看
    superrichman
        9
    superrichman  
       6h 26m ago
    copilot 也一样,现在都改成 credit 了,很抽象
    shawnvan
        10
    shawnvan  
       6h 25m ago
    @kekxv 哈哈哈,同一天,还好是他们赠送的,简直傻眼
    hit9
        11
    hit9  
       6h 20m ago
    preview 版本还比较耐蹬.. 但是现在正式版 qwen3.8max 额度就用的很快了...
    helysan33
        12
    helysan33  
       6h 16m ago
    没有 preview ,没有 1 折。可以直接申请退款了
    hidemyself
        13
    hidemyself  
       6h 9m ago
    太快太快了,我两次请求把我 5 小时限额干没了
    gux928
        14
    gux928  
    OP
       6h 0m ago via iPhone
    @helysan33 #6 preview 已经下了吗? 那真是不敢用了
    gux928
        15
    gux928  
    OP
       5h 59m ago via iPhone
    @winning11k #8 就算有 5.3 也会是用起来飞快吧
    winning11k
        16
    winning11k  
       5h 32m ago
    @gux928 大概率,看友商的压力了,你看 DS 出个 coding plan 估计就要降价要不增量
    Yserver
        17
    Yserver  
       5h 14m ago
    @sentinelK #2 阿里正价的 ds 感觉限流还好 但是缓存命中率很低 而且缓存命中很贵

    阿里的限流不是很透明 有一个 Request rate increased too quickly 根本无法判断
    brsyrockss
        18
    brsyrockss  
       4h 0m ago
    @gux928 这就是他们的目的,主要是竞争不够激烈,大家现在都不够卖的.就跟手机套餐的 QCI 一样,国内外大的运营商套餐里都不写 QCI,反倒是网络运营商都会写的清清楚楚的 ,因为小公司没有什么吸引人的卖点,只能把这些潜规则拿出来告诉你,就跟把心都掏出来告诉你:"看我没有骗你,没有套路你,我是真良心啊",但是大的运营商就不在乎了,反正怎么搞都赚钱,无所吊味.
    lino68
        19
    lino68  
       3h 26m ago
    token plan 出了 qwen3.8-max preview 之后,我立即就从 3.7max 切到这个使用了,目前感觉明显 preview 耐用,因为官方说 10 倍用量,或者说是 1 折。不过使用的时候经常出现 qwen3.8-max preview unavailable 的情况
    leyfung
        20
    leyfung  
       2h 58m ago
    我试了 qwen3.8max ,消耗感觉是 dsv4f 的好几倍,五小时额度很快就没了,qwen-3.8max preview 有活动肯定是最便宜的
    yarawen
        21
    yarawen  
       2h 4m ago
    你们真是,有好东西不早说
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2585 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 77ms · UTC 16:00 · PVG 00:00 · LAX 09:00 · JFK 12:00
    ♥ Do have faith in what you're doing.