• 请不要在回答技术问题时复制粘贴 AI 生成的内容
cloudzhou
V2EX  ›  程序员

普通程序员,大模型之争如同 Jdk 版本

  •  
  •   cloudzhou · 12h 45m ago · 1670 views
    之前一直使用 opus ,然后 gpt
    困惑于各种封号和中转,决定直接 deepseek flash 试试
    非常惊讶,我甚至区分不出差异,尤其你任务拆分的够细的话,实现差距极小

    让我不由得想起以前远古时代,“你们用 jdk 几?”
    实际上,好的代码,核心并非在 jdk 几点几版本,同理现在差距不大的大模型,用于普通业务差距很小
    23 replies    2026-09-23 05:19:22 +08:00
    jackOff
        1
    jackOff  
       12h 37m ago
    deepseek v4 flash 在不同 agent 和不同程序员手里表现差异非常巨大
    cloudzhou
        2
    cloudzhou  
    OP
       12h 33m ago
    @jackOff 我想表达的就是要善用工具,而不是一味的以为用上最好 ai 就怎么样
    marsg
        3
    marsg  
       12h 10m ago
    然而程序员都快没了。
    newaccount
        4
    newaccount  
       12h 10m ago
    一个需求做不出来,是模型的问题还是人的问题
    你让他怎么选?
    Sezxy
        5
    Sezxy  
       12h 7m ago   ❤️ 1
    v4.1flash 日常开发速度很快,质量也能接受。小任务我都懒得用 gpt5.6-sol
    YanSeven
        6
    YanSeven  
       11h 59m ago   ❤️ 1
    当前大模型从研发团队到用户群体,看中和攀比的应该都是其“许愿能力”吧。
    longaiwp
        7
    longaiwp  
       11h 48m ago
    我一直都在用开发生产代码上,只要不是发散思维的问题,处理得很好。
    gibber
        8
    gibber  
       11h 41m ago
    @jackOff dsv4f 用哪个 agent 比较好呢?
    agentd
        9
    agentd  
       11h 39m ago
    @marsg 心酸
    cloudzhou
        10
    cloudzhou  
    OP
       11h 28m ago
    @marsg 这是另一篇忧伤的帖子了,大约就这两年了
    foryou2023
        11
    foryou2023  
       11h 25m ago
    一直使用 deepseek v4 使用的挺好的,自己 在 pi agent 里面写的 plan 插件。流程一直都是先把需求讨论清楚,然后让 ai 写成文档,然后再让 ai 干活,一直挺好的。
    cloudzhou
        12
    cloudzhou  
    OP
       11h 5m ago
    @Sezxy 对,对比一下 v4.1flash 快的飞起,gpt 一跑我就想摸鱼,好几分钟
    chjqpmain
        13
    chjqpmain  
       9h 8m ago   ❤️ 1
    确实是,我有段时间不问了(绝对不是因为我大部分时候都用最新的 gpt 和 claude),
    不过我也想到了之前看到的一个梗:
    23 年程序员惊叹于 ai 的智力,把代码复制下来修改
    26 年程序员愤怒于 ai 的降智,换更好的模型处理问题
    z1s23
        14
    z1s23  
       7h 38m ago via iPhone
    @cloudzhou 我选 GPT ,因为它可以让我有摸鱼时间,DeepSeek 太快了,我甚至看不清它吐字的速度,不利于摸鱼
    jackOff
        15
    jackOff  
       7h 36m ago
    @gibber 很诡异的来说,这玩意在 zcode 或者 claude code 表现似乎比较强,但是这俩客户端嘛。。。。。。目前我是用 deepseek harness,一个是安全,另一个是节省开支
    webcape233
        16
    webcape233  
       7h 29m ago via iPhone
    vsc 的 copilot 接入的,感觉还行啊,我也搞不懂重置党天天开发的啥?难道是我说得详细,反复推敲方案,几个 ai 都审核后,再用最快的 gemini 一把梭。我还会不时更新文档和.agents ,rhai 优化项目级 skills 和 rule ,经常 refactor 。是不是用高端模型的直接喊话就行了
    bbbblue
        17
    bbbblue  
       7h 11m ago
    只要你不是许愿式编程 特别那种给一个任务 然后去睡觉了
    而是你本身懂模型在做什么 会打断会指导 那其实用起来差没太多
    之前 gpt 又卡又降职 从 5.6sol 换到 grok 4.6 和 ds 4.1 flash 已经用了俩礼拜了 也是同感
    gibber
        18
    gibber  
       7h 5m ago
    @jackOff 我用的 claude code cli 不是很爽,现在连自动模式也用不了了
    Tianqi
        19
    Tianqi  
       6h 37m ago
    deepseek v4.1 flash 这么好用么,我感觉真的抽象,沟通不了一点
    1874w
        20
    1874w  
       6h 30m ago
    太真实了,现在天天都有人发各种模型降智水帖,说到底还是自己的流程不对,或者说一直都是许愿式开发,只要发现和之前预期不一样,或者稍微说点胡话,就开始发帖吐槽。但实际情况是,会用的人不会发帖夸他完成的好,能看到的帖子全是降智帖。
    降智可能确实会影响一些,就像 JDK 版本,新版 SDK 在某些场景可能会有更好的体验,但确实很少很少一部分。正常的开发流程熟悉和掌握之后,这些偏差很容易就修正了。对于完成工作来说,没有任何实质影响。
    1874w
        21
    1874w  
       6h 23m ago
    @newaccount 人总是自我趋向于自我解释和修正。需求完成不了 => 怀疑自己 => 看到社区说模型不行/降智 => 怀疑模型。反正不能是自己的问题。
    jim9606
        22
    jim9606  
       2h 58m ago
    需要留守 JDK8 的都是,我不知道它咋跑的,反正他就能跑,所以就不动,虽然升了好像没啥问题,但我不想背锅。
    这事如果换成 LLM 就是,你的工件需要 LLM 的响应可重现才能跑起来。
    可能是 LLM 还不够资历养出这种奇葩工件出来吧?
    maolon
        23
    maolon  
       23 mins ago
    我觉得还是有区别的,特别是模型降智这种场景,最可怕的地方是当你发现他降智的时候他已经在代码库里拉了一坨了,而且可能是前一个请求好的后一个请求就坏了,这不是什么“流程改善”能避免的问题

    而且之所以争这个就是因为每个模型他实现的速度,质量,价格,稳定性都不同,比如 luna 他可能非常便宜质量尚可,但是非常慢,比如 deepseek 他质量尚可而且快,但是需要指导(人长期驻守)而且越来越贵,比如 gpt 系列就不擅长前端,这些都是模型特性上的明显差距也是跑分看不出来的东西,而且每代模型都不同。

    当然你说我就这个用途,在我的用途下区别不大那确实没问题,但是我认为对大部分人来说还是有区别的。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   938 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 48ms · UTC 21:43 · PVG 05:43 · LAX 14:43 · JFK 17:43
    ♥ Do have faith in what you're doing.