• 请不要在回答技术问题时复制粘贴 AI 生成的内容
Leon6868
V2EX  ›  程序员

Deepseek V4.1 Flash 真实体验

  •  
  •   Leon6868 · 2 days ago · 11031 views

    使劲蹬了一天也就 20rmb ,agent 能力与代码能力大幅提高,多模态调试闭环完全能用

    梁圣你回来了✋😩🤚

    82 replies    2026-09-16 17:35:26 +08:00
    tool2dx
        1
    tool2dx  
       2 days ago
    我用 DSH,给一张图片来绘制一个场景,结果雷霆大思考输出了一堆错误,是不是用法不对.
    Lemonyi
        2
    Lemonyi  
       2 days ago
    我用 V4.1-flash 和 glm5.3-flash 对比了下,满分 100 分的话,glm 是 90 分,V4.1 是 80 分吧,差距很小,就只是某个方面有些差距,但是 V4.1 是闲暇时段还有周六日才是 glm 消耗的一半,正常工作日周一到周五白天消耗跟 glm 是一样的,我现在公司是 996 的,周一到周五白天用 glm ,晚上和周六用 v4.1
    BreakTheBank
        3
    BreakTheBank  
       2 days ago
    3 小时用了 30 块。不敢用了,开了 opencode go
    JoJoWuBeHumble
        4
    JoJoWuBeHumble  
       2 days ago
    @Lemonyi 是在各种的平台上测的吗?我感觉 deepseek 在不在 dsh 上面差距还是很大的
    JoJoWuBeHumble
        5
    JoJoWuBeHumble  
       2 days ago
    @tool2dx 我倒是完全没有用它多模态的一块。不太相信 dp 的多模态
    vfs
        6
    vfs  
       2 days ago
    @BreakTheBank 能把人卡死。。。不会再续费了
    Ossi
        7
    Ossi  
       2 days ago
    身边反馈比 glm5.3-flash 强不少
    awesomePower
        8
    awesomePower  
       2 days ago
    还是比 GLM-5.3 差不少,用 v4.1 做一个需求要来回改好几次
    bbbblue
        9
    bbbblue  
       2 days ago
    我这边前几天有几个完整的管理后台页面 我把需求文档给了 图也给了 很快就做完了
    虽然有一些 bug 比如多选框不能取消全部 选择筛选项的过程中会清空之前的结果之类的 但感觉完成度挺不错了 关键是好快啊
    liudon
        10
    liudon  
       2 days ago
    @vfs 晚上会快很多 😂
    foryou2023
        11
    foryou2023  
       2 days ago
    能力还行满足需求,就是变得有点啰嗦了,很容易探索要求之外的事情。
    vampuke
        12
    vampuke  
       2 days ago via Android
    @Lemonyi
    随便找了个会话算了一下
    未缓存输入 180,148 tok 缓存读取 49,288,704 tok 输出 239,651 tok
    4.1flash 是 0.18 * 2 + 50 * 0.04 + 0.24 * 8 = 4.28(高峰期价格)
    glm flash 是 0.18 * 0.8 + 50 * 0.23 + 0.24 * 2.8 = 12.316
    l0s7r
        13
    l0s7r  
       2 days ago
    有道德吗
    vfs
        14
    vfs  
       2 days ago   ❤️ 1
    @liudon 你说的晚上是 0 点之后? 我最近经常晚上九十点用, 就卡的我, 忍不住自己动手写了, 用它的 AI 简直是浪费生命。 我的月度还有三天就结束了,但是 token 采用了 60%, 不是我不想用,是它实在太卡了
    xironwater
        15
    xironwater  
       2 days ago via Android
    自己用着前端进步明显,算是把 ds 的短板补上了不少,性价比还是可以的
    calcoe
        16
    calcoe  
       2 days ago   ❤️ 1
    在一众低参数模型中已经很不错了,而且有梁文谷能狠狠蹬
    Leon6868
        17
    Leon6868  
    OP
       2 days ago
    @vfs #6 270+tps 很卡吗
    twofox
        18
    twofox  
       2 days ago
    我也是一天可以用 20 多。然后算了一下,这么下来一个月大概需要 400 左右,然后准备跟同事拼一个 codex pro 了
    KOMA1NIUJUNSHENG
        19
    KOMA1NIUJUNSHENG  
       2 days ago
    为什么 ds 一开思考模式,感觉能跑一万年
    NakanoAzure
        20
    NakanoAzure  
       2 days ago
    这个头像好熟悉,好像推上看过🤔
    liudon
        21
    liudon  
       2 days ago
    @vfs 我白天晚上都在用,白天感觉慢一些,晚上 10 点后感觉会快一些,没遇到卡的情况呢
    MIUIOS
        22
    MIUIOS  
       2 days ago
    @l0s7r 这个是新的多模态底座,道德方面强化了不少
    MIUIOS
        23
    MIUIOS  
       2 days ago
    @tool2dx 他超级容易雷霆大思考,你做这种的相反不能开高思考,因为这种是确定性的,我前阵子让他绘制了太阳系,开最低思考绘制出来的贼无敌。
    sampeng
        24
    sampeng  
       2 days ago via iPhone
    一天 20 ,不算你加班就是 600 ,周末用就是 800-1000 。请问这么算还梁圣吗?再计算一天做了多少个需求,你就明白了。可能都不如 glm…
    zhao69270
        25
    zhao69270  
       2 days ago
    目前感觉还是 glm5.3flash 好用,已经抛弃 DeepSeek 了
    Kale
        26
    Kale  
       2 days ago
    @Leon6868 Opencode 确实卡的。
    vfs
        27
    vfs  
       2 days ago
    @liudon @Leon6868 啊, 难道就我自己卡..... 你们挂代理了?
    Leon6868
        28
    Leon6868  
    OP
       2 days ago
    @vfs #27 我用的是官方,稳定 270+tps
    hoor
        29
    hoor  
       2 days ago
    @BreakTheBank 我也是开了 opencode go ,单备用
    Nu1lXX
        30
    Nu1lXX  
       2 days ago
    使劲蹬了一天也就 20rmb ?? 20$吧
    Cloud9527
        31
    Cloud9527  
       2 days ago
    个人体感 4.1flash 更好用,主要是速度快。5.3flash 还是慢一些。功能这两个都能实现。
    PopRain
        32
    PopRain  
       2 days ago
    请问一般做 coding 用 GLM 5.3 FLASH 还是 DS 4.1 FALSH ?
    qianyeyixi
        33
    qianyeyixi  
       2 days ago
    用 4.1flash 做了项目,没法新群友口中的问题。我觉得编程能力要比 5.3 强,速度也快尤其是大型任务尤其明显。conding plan 的任务 任务链比较长的情况双方有 10 分钟的差距。https://github.com/wang-yi-bit64/dsh-desktop 改项目有 glm-5.3flash, ds-4-flash, ds-4.1flash, gemini-3.7flash 共同完成
    qianyeyixi
        34
    qianyeyixi  
       2 days ago
    @PopRain 推荐 4.1flash 速度快
    hellodudu86
        35
    hellodudu86  
       2 days ago   ❤️ 1
    每天高强度用,v4.1 出之前我的主力就是 glm5.3flash ,对比起来 v4.1 还是强一些的,现在价格和速度也更占优势,glm 停用了。
    hellodudu86
        36
    hellodudu86  
       2 days ago
    不过我之前的 glm 不是在 zcode 上用,也是在 dsh 上用。
    bao3
        37
    bao3  
       2 days ago
    烧钱很快,同样的推理,质量只比 gemini-3.8 好一点。所以我都几乎不用它,估计只能做简单的题目。
    amoSjiang
        38
    amoSjiang  
       2 days ago
    “使劲蹬了一天” 得说多少 token ,多少钱
    你登一天不如我登一个小时,这话白说
    qianyeyixi
        39
    qianyeyixi  
       2 days ago
    消费金额:¥41.73 CNY
    API 请求次数: 3,156
    Tokens: 716,734,730. 大概在 30 块钱的时候项目已经完成了,因为这几个模型做架构不太行,让 chatgpt 聊天的做了架构和中长期规划 ,剩下的全都是在调整方向
    wktline
        40
    wktline  
       2 days ago
    glm5.3-flash 这不是弱智吗?
    vfs
        41
    vfs  
       2 days ago
    @Leon6868 哦哦哦, 误会了,我也用过官方的 API ,我才说 OpenCode Go 辣鸡的不行,不建议充值,太慢了
    poxiaohy
        42
    poxiaohy  
       2 days ago
    体感比 GLM 5.3-flash 略强,但是 Zcode + GLM 配合挺完善了,各种统计和交互不比 codex 差,一天 20 元为何不用智谱的 plan 呢?
    jonsmith
        43
    jonsmith  
       2 days ago
    flash 模型是未来趋势? GLM-5.3-flash 和 deepseek-v4.1-flash 性价比都非常高,智力够用,速度快。目前我是用 deepseek 更多,因为它的速度最快。
    wanglz111
        44
    wanglz111  
       2 days ago
    三个号 workbuddy + ds v4.1 flash = free
    我这几天狠狠整理了我的测试文档,干脏活太好用了。
    gpt5.6sol 30-40t/s
    ds v4.1 flash 300t/s
    整理文档,整理测试用例,整理需求报告,ds 体感太好了,又快又准
    workbuddy 可以帮着生成 html 的汇报,流程图什么画的极好,帮助理解需求太方便了,真神了
    Rorysky
        45
    Rorysky  
       2 days ago
    一天 20 ,一个月不就 600 了么?
    pluszone
        46
    pluszone  
       2 days ago
    5.3flash 虽然有点智障,但看在每周送 3Etoken 的从操作上,我给他拉到 DS 同等高度。
    breezy23
        47
    breezy23  
       2 days ago
    我在 pi 里面用 v4.1flash high ,目前还没发现它解决不了的问题
    zzboat0422
        48
    zzboat0422  
       2 days ago
    我在 opencode 和 zcode 中同时都接入了 dsv4.1f 和 glm5.3f 。交叉干活,然后用 codex 中的 gpt-5.6-sol review 这两个模型的工作结果。

    交叉对比下来,无论是 opencode 中还是 zcode 中,dsv4.1f 均强于 glm5.3f ,被 gpt5.6sol review 出来的错误更少,而且速度更快。
    dong706
        49
    dong706  
       2 days ago
    @pluszone 每周送 3E 是什么活动?
    pluszone
        50
    pluszone  
       2 days ago
    @dong706 每周末送 3 亿 5.3 flash token, Zcode 客户端直接领取。 周五晚到周一早之间生效。
    Leon6868
        51
    Leon6868  
    OP
       2 days ago
    @Nu1lXX #30 你太小看粱圣的前缀缓存了
    KJH
        52
    KJH  
       2 days ago
    听你们一说,刚刚让他给我改 4 个 bug

    哐哐一顿输出,消费 5 元,我一验证,bug 解决数 0 。。。
    chemzqm
        53
    chemzqm  
       2 days ago
    还是整个套餐吧,直接 API 还是有点小贵
    yekern
        54
    yekern  
       2 days ago
    公司给啥用啥. 我们现在是直接对接的 API. 我用的 omp 解决问题还可以 有自动学习 踩过的坑很少会踩第二次 和上面差不多 几乎没有不能解决的 在我的开发场景下
    iorilu
        55
    iorilu  
       2 days ago
    我最近试了 dsf4.1 也感觉不错

    主要在 dsh 里面干活基本不会停

    也不会问来问去

    反正我最晚搞了个我认为可能有点折腾的活, 没想到一次性 2 小时干完了, 超出我预期

    所以我现在把 dsf4.1 提升为完全可用的级别, 那自然那个便宜用哪个

    如果舍不得包 gpt pro , 按量使用 dsf 是比较划算得
    yekern
        56
    yekern  
       2 days ago
    用量也不是很大
    macscsbf
        57
    macscsbf  
       2 days ago
    太贵了
    Leon6868
        58
    Leon6868  
    OP
       2 days ago
    @KJH #52 那是好事啊,说明你的工作比较复杂,没法被 AI 取代
    Desiree
        59
    Desiree  
       2 days ago   ❤️ 1
    @sampeng 一个月 600 还不如 gpt
    IUserName
        60
    IUserName  
       2 days ago
    我一直搞不懂,这么多模型 pro flash preview plus ultra 到底哪个更好。
    Lemonyi
        61
    Lemonyi  
       2 days ago
    @JoJoWuBeHumble 在 WorkBuddy 里面测的,然后现在在做一个比较复杂的 crm 系统
    Lemonyi
        62
    Lemonyi  
       2 days ago
    @vampuke 我是结合自己项目干活使用情况综合分析的
    eben
        63
    eben  
       2 days ago
    我写了 6 个小 PHP 功能,花了 16 元
    Leon6868
        64
    Leon6868  
    OP
       2 days ago
    @sampeng #24 还真是,一天 20 的话还真不如买 gpt pro ,openai 至少是真的顶级模型
    KJH
        65
    KJH  
       2 days ago
    @Leon6868 #58 高情商
    iorilu
        66
    iorilu  
       2 days ago
    @Leon6868 也没那么简单

    不可能每天都是高强度工作的

    按量付费还是有一定优势
    RexKang
        67
    RexKang  
       2 days ago
    高峰期在 zcode 里面用 opencode go 的 ds-v4.1-flash ,发现又节约能力又强(对比 glm-5.3-flash )。
    resist
        68
    resist  
       2 days ago
    我感觉现在 DeepSeek 有点流口水了,笨还乱搞
    lozzow
        69
    lozzow  
       1 day ago
    我用的是 ollama cloud 的订阅,我感觉 DS4.1 flash 很猛啊。相比降智版本的 astra 猛多了,我这个 100 多万行的 c++酷酷的改,完全没问题
    6581
        70
    6581  
       1 day ago
    不会在用 deepseek 了,是比较快,
    但是价格太高了
    1 天 20 ,一个月 400 ,用啥模型不行啊,非要用 deepseek

    这也不是最关键的
    最关键的是:价格改来改去,拿用户当猴耍啊
    cppc
        71
    cppc  
       1 day ago via iPhone
    我稍微使劲用了一天(白天),50rmb
    fanfou
        72
    fanfou  
       1 day ago
    总结是光快不出活
    resist
        73
    resist  
       1 day ago
    我再再 workbuddy 里面使用 DeepSeek ,妈耶,居然还要我指导它错误在哪,到底你是 AI 还是我是 AI ?为什么再 workbuddy 里面用,因为 free ,是真的会流口水,而且还会死循环,那 token 飞的特别快
    resist
        74
    resist  
       1 day ago
    前几天用 API ,晚上两小时用了 10 块钱,我算了一下,如果天天用,不得每月上千?重点是两小时,啥也没产出
    到现在我都记得,0731 版本那天,我再 opencode 里面体验了 DeepSeek ,感觉特别强,啥 buff 都没有,现在的 DeepSeek 真的是又贵又流口水
    Qds
        75
    Qds  
       1 day ago
    让他改个需求,又臭又长,还中途为了解决测试数据把数据库数据搞丢的问题浪费了一大堆 tokens,后面做完需求了,让他测,还遗留一大堆问题(没讲到重点),5 块钱没了,后面用 gpt6 中 扫了一下,问题至少 3 个,让他做个需求是真的不放心,问题太多了
    Qds
        76
    Qds  
       1 day ago
    后面我让 gemini 分析了一下,大致就说,是 deepseek v4.1 flash 就好比一个初级程序员,你让饭端到他碗里,夹菜给他,他用勺子就能好好吃饭了,gpt6 中已经是个成年人了,会自己烧饭盛饭,自己做菜,端菜,他自己会想要什么,要吃哪些才好吃有营养就会自己夹了
    Qds
        77
    Qds  
       1 day ago
    @KJH 我跟你情况差不多,感觉智能度太低了,做需求容易漂移和找不到重点
    Gnukid
        78
    Gnukid  
       1 day ago
    前两天用 V4.1flash 打了数学建模,花了 2h11 块,后面小修小改到 20 块左右,期待一下会不会获奖
    m0mo
        79
    m0mo  
       1 day ago
    和 GLM 5.2 比怎么样? 日常编码场景.
    KJH
        80
    KJH  
       1 day ago
    @Qds #77 还是得用 Opus5 , 这 4 个 bug 直接一次性修复
    minimaluminium
        81
    minimaluminium  
       1 day ago
    真的不如十几块一年的北美大豆包
    shellic
        82
    shellic  
       1 day ago
    用了一天感觉能力不错,但是花了 20 ,没有 coding plan 的话作为日常主力用不起
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   1139 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 153ms · UTC 17:52 · PVG 01:52 · LAX 10:52 · JFK 13:52
    ♥ Do have faith in what you're doing.