• 请不要在回答技术问题时复制粘贴 AI 生成的内容
QS0x01
V2EX  ›  程序员

关于新 GPT-6 如何替换 GPT-5.6,我的建议是不要用 6-luna

  •  
  •   QS0x01 · 1 day ago · 3499 views

    架构说明

    首先说明一下我的使用环境以及模型配置:Claude Code + Trellis

    Opus

    负责 Plan + Check ( Review )

    • 唯一选择:GPT-Sol(xhigh)

    Sonnet

    负责主会话 + Implement

    • 首选:GLM(max)
    • 备选:GPT-Terra(xhigh)

    Haiku

    负责 Research / Explore

    • 首选:GLM-Flash(high)
    • 备选:GPT-Luna(xhigh)

    为什么 Sonnet 和 Haiku 优先选 GLM

    GLM 又快又好,并且我有之前 180 一年的 Lite ,非高峰期还是比较耐用的。 GPT 应当只负责顶尖智能。

    图片|690x191 图片|690x196 图片|690x277

    具体模型映射

    GPT-Sol

    • Before: GPT-5.6-Sol(xhigh)
    • After: GPT-6-Sol(xhigh)

    没啥好说的,半价 + 智能水平不降,直接替换。 为什么不使用 Astra ?:plus 套餐根本用不起

    图片|690x398

    GPT-Terra

    • Before: GPT-5.6-Terra(xhigh)
    • After: GPT-6-Sol(high)

    按价格来看,现在的 6-Sol 其实就是之前的 5.6-Terra ,我估计模型容量上是一样,只不过经过后训练对齐,效果变好。

    GPT-Luna

    • Before: GPT-5.6-Luna(xhigh)
    • After: GPT-5.6-Luna(xhigh)

    6-Luna 智能水平在 xhigh 等级是明显的下降,max 我觉得 research 工作没必要。 而且 Luna 本来几乎等于不要钱,即使更便宜,我觉得也感知不强。

    图片|607x500

    Supplement 1  ·  12h 46m ago
    dfourc 在我这里确实响应速度要比 GPT 更快,CPA 统计到

    - GLM 5.3 基本上能全部在 20s 内返回结果,中位数在 13s 左右。
    - GPT Sol 时不时就会蹦到 40 秒到 50 秒,很明显的把均值拉高。

    ---

    另外,我觉得我个人感受到快,并不是因为响应速度,因为而是因为 GLM 比较遵守指令,不会做多余探索。

    简单来说,如果不开 subagent ,直接让 Agent 执行某一个修改:
    - GPT 会偏向于进行非常广的探索,对边界情况如何处理进行需求澄清。然后设计一堆我从未要求的安全机制,再噼里啪啦写一堆测试。
    - GLM 就会非常直接的把我说的地方改掉(对不对另说,因为我这后面还有 review agent 所以不太关注),不会做其他多余的事情和需求澄清。

    ---

    各有利弊吧,之前有个排序的逻辑,我给的提示词里就没有考虑到提供的多级排序键仍然可能会造成平局情况,当时直接让 GLM 改的,确实也让按我的需求做的,就没有处理仍然相等的边界。然后我直接 git reset 重新让 GPT 进行规划,GPT 就直接指出了这个边界,并询问我按什么字段进行兜底。
    17 replies  •  2026-09-24 19:10:35 +08:00
    billccn
        1
    billccn  
       23h 17m ago
    基本赞同,我之前是用这个 DeepSWE 的图表进行选择:



    用强的模型(比如 GPT 6 Sol/Opus 5.5 )做设计和“领导”,GPT-5.6/6 Luna 这种“免费”好用的 AI 干活,一次开十几个 subagent 都不心疼,而且干活基本准确不会乱搞。

    唯独你说"现在的 6-Sol 其实就是之前的 5.6-Terra"我觉得不准确,定位可能是一样的,但是参数量肯定不一样。
    msg7086
        2
    msg7086  
       22h 56m ago
    @billccn 我用下来感觉也是 6-sol 是 5.6-terra 的平替,应该是当 terra 训练然后比 terra 强一点就直接钉到 sol 了,不像是老 sol 再强化的结果。
    maocat
        3
    maocat  
       19h 53m ago
    昨天测评过 GPT-6-Luna 的识图能力连 GPT-4o-mini 都不如
    maemolee
        4
    maemolee  
       19h 44m ago
    不晓得为什么, 昨天用了一天 6-sol ,笨的我头疼,换回 5.6-terra 智商提升了 10 分至少。
    gibber
        5
    gibber  
       19h 40m ago
    @msg7086 意思 5.6-Sol 比 6-Sol 还要强不少吗?
    zichao410
        6
    zichao410  
       19h 26m ago
    请教一下大佬,你是如何在 Claude Code 中使用 GPT 和 GLM 的?
    我现在要么使用 GPT 要么使用其他家的模型,没法一起同时用,节别说作为子 Agent 进行调度了
    dfourc
        7
    dfourc  
       19h 12m ago
    glm 好不好不说,快是怎么得出结论的,一直都是 40t/s
    kairosbladejiuji
        8
    kairosbladejiuji  
       18h 38m ago
    @zichao410 你问一下 GPT 就知道了
    loopq
        9
    loopq  
       18h 30m ago
    6 sol 特别慢,换回 5.6 sol 快多了,合着价格差在这呢
    graymmon
        10
    graymmon  
       18h 4m ago
    6 sol 测下来真的是蠢。5.6 都不如。
    msg7086
        11
    msg7086  
       14h 55m ago
    @gibber 看看楼上楼下别人说的
    cheng6563
        12
    cheng6563  
       14h 16m ago
    问 6 sol 原神最新版本,还在 5.0 。合着还在玩怀旧服。
    降智问题下,哪个强哪个弱没啥意义。
    refear99
        13
    refear99  
       14h 9m ago
    6sol 超级慢,但是便宜
    Sezxy
        14
    Sezxy  
       13h 52m ago
    6sol ,6luna 能力没提升多少,就是降价了
    QS0x01
        15
    QS0x01  
    OP
       12h 58m ago
    @zichao410 CPA 作为网关负责路由模型(opus/sonnet/haiku)到实际承载模型(负载分发/故障回退),Claude Code Agent 配置支持预先指定 model
    MuyuQ
        16
    MuyuQ  
       9h 40m ago
    6sol ,luna 都是残废。。。。。又慢又蠢,让人实在受不了。 切到 zcode 连上 5.3Flash ,我又活了过来。
    MuyuQ
        17
    MuyuQ  
       9h 38m ago
    @MuyuQ 用这两个蠢蛋模型,简直是浪费生命。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   852 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 48ms · UTC 20:48 · PVG 04:48 · LAX 13:48 · JFK 16:48
    ♥ Do have faith in what you're doing.