• 请不要在回答技术问题时复制粘贴 AI 生成的内容
cloudzhou
V2EX  ›  程序员

普通程序员,大模型之争如同 Jdk 版本

  •  
  •   cloudzhou · 22h 15m ago · 3044 views
    之前一直使用 opus ,然后 gpt
    困惑于各种封号和中转,决定直接 deepseek flash 试试
    非常惊讶,我甚至区分不出差异,尤其你任务拆分的够细的话,实现差距极小

    让我不由得想起以前远古时代,“你们用 jdk 几?”
    实际上,好的代码,核心并非在 jdk 几点几版本,同理现在差距不大的大模型,用于普通业务差距很小
    30 replies    2026-09-23 09:38:04 +08:00
    jackOff
        1
    jackOff  
       22h 8m ago
    deepseek v4 flash 在不同 agent 和不同程序员手里表现差异非常巨大
    cloudzhou
        2
    cloudzhou  
    OP
       22h 4m ago
    @jackOff 我想表达的就是要善用工具,而不是一味的以为用上最好 ai 就怎么样
    marsg
        3
    marsg  
       21h 41m ago
    然而程序员都快没了。
    newaccount
        4
    newaccount  
       21h 40m ago
    一个需求做不出来,是模型的问题还是人的问题
    你让他怎么选?
    Sezxy
        5
    Sezxy  
       21h 37m ago   ❤️ 1
    v4.1flash 日常开发速度很快,质量也能接受。小任务我都懒得用 gpt5.6-sol
    YanSeven
        6
    YanSeven  
       21h 30m ago   ❤️ 1
    当前大模型从研发团队到用户群体,看中和攀比的应该都是其“许愿能力”吧。
    longaiwp
        7
    longaiwp  
       21h 19m ago
    我一直都在用开发生产代码上,只要不是发散思维的问题,处理得很好。
    gibber
        8
    gibber  
       21h 11m ago
    @jackOff dsv4f 用哪个 agent 比较好呢?
    agentd
        9
    agentd  
       21h 10m ago
    @marsg 心酸
    cloudzhou
        10
    cloudzhou  
    OP
       20h 58m ago
    @marsg 这是另一篇忧伤的帖子了,大约就这两年了
    foryou2023
        11
    foryou2023  
       20h 55m ago
    一直使用 deepseek v4 使用的挺好的,自己 在 pi agent 里面写的 plan 插件。流程一直都是先把需求讨论清楚,然后让 ai 写成文档,然后再让 ai 干活,一直挺好的。
    cloudzhou
        12
    cloudzhou  
    OP
       20h 36m ago
    @Sezxy 对,对比一下 v4.1flash 快的飞起,gpt 一跑我就想摸鱼,好几分钟
    chjqpmain
        13
    chjqpmain  
       18h 39m ago   ❤️ 1
    确实是,我有段时间不问了(绝对不是因为我大部分时候都用最新的 gpt 和 claude),
    不过我也想到了之前看到的一个梗:
    23 年程序员惊叹于 ai 的智力,把代码复制下来修改
    26 年程序员愤怒于 ai 的降智,换更好的模型处理问题
    z1s23
        14
    z1s23  
       17h 8m ago via iPhone
    @cloudzhou 我选 GPT ,因为它可以让我有摸鱼时间,DeepSeek 太快了,我甚至看不清它吐字的速度,不利于摸鱼
    jackOff
        15
    jackOff  
       17h 7m ago
    @gibber 很诡异的来说,这玩意在 zcode 或者 claude code 表现似乎比较强,但是这俩客户端嘛。。。。。。目前我是用 deepseek harness,一个是安全,另一个是节省开支
    webcape233
        16
    webcape233  
       16h 59m ago via iPhone
    vsc 的 copilot 接入的,感觉还行啊,我也搞不懂重置党天天开发的啥?难道是我说得详细,反复推敲方案,几个 ai 都审核后,再用最快的 gemini 一把梭。我还会不时更新文档和.agents ,rhai 优化项目级 skills 和 rule ,经常 refactor 。是不是用高端模型的直接喊话就行了
    bbbblue
        17
    bbbblue  
       16h 42m ago
    只要你不是许愿式编程 特别那种给一个任务 然后去睡觉了
    而是你本身懂模型在做什么 会打断会指导 那其实用起来差没太多
    之前 gpt 又卡又降职 从 5.6sol 换到 grok 4.6 和 ds 4.1 flash 已经用了俩礼拜了 也是同感
    gibber
        18
    gibber  
       16h 36m ago
    @jackOff 我用的 claude code cli 不是很爽,现在连自动模式也用不了了
    Tianqi
        19
    Tianqi  
       16h 8m ago
    deepseek v4.1 flash 这么好用么,我感觉真的抽象,沟通不了一点
    1874w
        20
    1874w  
       16h 1m ago
    太真实了,现在天天都有人发各种模型降智水帖,说到底还是自己的流程不对,或者说一直都是许愿式开发,只要发现和之前预期不一样,或者稍微说点胡话,就开始发帖吐槽。但实际情况是,会用的人不会发帖夸他完成的好,能看到的帖子全是降智帖。
    降智可能确实会影响一些,就像 JDK 版本,新版 SDK 在某些场景可能会有更好的体验,但确实很少很少一部分。正常的开发流程熟悉和掌握之后,这些偏差很容易就修正了。对于完成工作来说,没有任何实质影响。
    1874w
        21
    1874w  
       15h 53m ago
    @newaccount 人总是自我趋向于自我解释和修正。需求完成不了 => 怀疑自己 => 看到社区说模型不行/降智 => 怀疑模型。反正不能是自己的问题。
    jim9606
        22
    jim9606  
       12h 28m ago
    需要留守 JDK8 的都是,我不知道它咋跑的,反正他就能跑,所以就不动,虽然升了好像没啥问题,但我不想背锅。
    这事如果换成 LLM 就是,你的工件需要 LLM 的响应可重现才能跑起来。
    可能是 LLM 还不够资历养出这种奇葩工件出来吧?
    maolon
        23
    maolon  
       9h 54m ago
    我觉得还是有区别的,特别是模型降智这种场景,最可怕的地方是当你发现他降智的时候他已经在代码库里拉了一坨了,而且可能是前一个请求好的后一个请求就坏了,这不是什么“流程改善”能避免的问题

    而且之所以争这个就是因为每个模型他实现的速度,质量,价格,稳定性都不同,比如 luna 他可能非常便宜质量尚可,但是非常慢,比如 deepseek 他质量尚可而且快,但是需要指导(人长期驻守)而且越来越贵,比如 gpt 系列就不擅长前端,这些都是模型特性上的明显差距也是跑分看不出来的东西,而且每代模型都不同。

    当然你说我就这个用途,在我的用途下区别不大那确实没问题,但是我认为对大部分人来说还是有区别的。
    iorilu
        24
    iorilu  
       7h 20m ago
    我反正全面切换到 dsf4.1 了

    速度质量都能接受, 关键是便宜, 不考虑 token 用量

    我实在最近火的 dsh desktop 里面用的, 还没仔细研究, 但这个工具确实能发挥 dsf 模型能力, 潜力非常大, 可以随便套插件
    kneo
        25
    kneo  
       7h 20m ago
    感觉不到区别说明你还是没有善用工具。
    TirionHo
        26
    TirionHo  
       6h 21m ago
    我都用 AI vibe coding 了,肯定是想体验许愿式开发啊,直接一个大任务开 plan 模式跑多爽
    自己将任务拆分得很细让智力差的 AI 辅助开发,就比 cursor 代码补全高级一点点
    fredweili
        27
    fredweili  
       6h 9m ago
    简单任务也许用不出来,我也没那么 pro
    ajaxfunction
        28
    ajaxfunction  
       6h 3m ago
    有没有可能是你的需求太简单了,简单到降智后的模型也能胜任你的任务
    cloudzhou
        29
    cloudzhou  
    OP
       5h 39m ago
    @kneo 不,区别不大才说明善用工具。这一点来说我有点像所谓的*第一性原理*,工具重要性并不大
    @TirionHo 我昨天试了一个之前跑过的 plan ,比 gpt 给的技术文档,更符合我的期待,可能是我描述更清晰了
    @ajaxfunction 以我对互联网需求业务复杂度的了解,80% 业务大模型差距就是不大

    再总结一下吧,就像选 mysql / postgresql 一样,在绝大多数互联网开发,都是没有差异的,都能满足需求
    而反而要求你把 sql 写好
    cloudzhou
        30
    cloudzhou  
    OP
       5h 35m ago
    @TirionHo 我认为大一点的开发,无论哪个模型,plan 模式都需要的,还有就是测试用例,这种循环反馈才是完成一个大需求的保证
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   5402 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 84ms · UTC 07:13 · PVG 15:13 · LAX 00:13 · JFK 03:13
    ♥ Do have faith in what you're doing.