这几天被 gpt5.6 搞的心态爆炸. 各种 bug,不按规范来. 一问就是“你说的对,我马上改”. token 消耗又极快,plus 周额度基本也就一天. 想想还不如直接买国内模型,多写点约束也不是不能用.
1
tool2dx 8h 12m ago
用 gpt5.5 也够了, 不一定要 5.6 的.
个人需求比较少, 体验下来 K3 非常不错, 别的也就一般般.(有些第三方很容易部署量化, 导致降智) |
2
raolight 8h 10m ago
刚才我也是用 gpt5.6sol 高来改个东西,改的东西差点让我气炸了,然后用 grok 4.6 high 弄好了,起码 60 刀的可以重度爽蹬,目前 grok 价格合适,能力也还 ok 的
|
3
webeasymail 8h 5m ago
couser 之前 TMD 买 20 美刀的,搞几个项目完全不够用,然后 60 美刀的用它自己的模型还可以,用 gpt 什么的感觉很快,用不了几次,但是我现在主要都是用他自带的,感觉完全用不完,全部用来跑 bataitools.com 的 agent 自动提交(说实话,感觉有点心疼)。
然后很多使用我还使用个 antiravity ,这个很快,而且我很喜欢他的 plan 模式,不用手动切换。 |
4
ktyang 7h 59m ago
我目前用的是 codex+kimi+opencode go ,基本上够用了。反正自己用着 k3+ds v4 flash 比 gpt 在体感上没有太大的退坡,但是你说强吧,除了前端审美以外也没有感觉到什么太强的,总体可用。
|
5
tiaod 7h 40m ago
我主力 DeepSeek v4 Flash ,东西写不出来反思一下是不是自己没想好
|
6
longaiwp 7h 33m ago
我主力 DeepSeek v4 Pro ,只要不是那种太过宽泛的问题,都是没啥问题的。
|
7
yh7gdiaYW 7h 32m ago
你愿意自己一起写,v4 flash 的正式版就还行。只想写需求和技术架构设计,需要 qwen3.7max/glm 5.2/qwen3.8max/k3 ,最后两个完全可以替换掉北美模型
|
8
cowcomic 7h 29m ago
我感觉国内的都挺不错的
最近用过小米,deepseek ,混元,glm 感觉都挺好 |
9
xmdiwei 7h 24m ago
感觉智谱就很不错了,就是前端差点(不支持多模态,发图沟通比较费劲),搭配 kimi 可能就比较完美了
|
10
zijie0 7h 20m ago
是不是还是要掌握一下 context debugging 的能力?按我理解 26 年了,主流模型一般不会无缘无故地犯错。
|
11
7opkk 6h 42m ago
我都是使用 gpt 5.5 medium 进行开发。 其他的额度使用太快了
|
12
sora2blue 6h 29m ago
kimi>deepseek>minimax ,glm 大涨价且不支持多模态不常用不评价
轻度使用可以蹬一段 opencode go $10 换$60 额度,deepseek-flash 基本够用,但是蹬 kimi/glm5.2/闭源模型,三天就能用完 |
13
LunarConcerto 6h 25m ago
现在基本上都是用 Deepseek v4 Pro ,长任务蹬一个小时基本上必定命中缓存,基本上按最低价算,连续一小时消耗顶多 3 块钱,比中转站 GPT 性价比真高了不是一点两点。
感觉现在主流模型基本上处理需求的能力都差不多了,GPT 能写的,D4v 也能写,针对某些领域可能还写得更好,现在对模型能力没啥偏见,基本看性价比。 |
14
zhaoziling 3h 13m ago
公司的项目,因为是持续开发,我自己只负责一小部分,一直用的 chatgpt 和 claude 的最新模型,因为用量不大,主要是修改,测试,查 bug (公司报销额度能覆盖)
自己的项目,用 grok+DSV4pro ,grok 是图便宜开的,不用浪费了,主力是 DS ,一周狠狠地蹬也用不到 100 ,不过下周涨价了,有点麻爪,这要是翻了 10 倍就难受了 |
15
bywenshu 2h 14m ago via iPhone
@zhaoziling 没那么多,新价格在官网已经有了。https://api-docs.deepseek.com/zh-cn/quick_start/pricing/
|
16
fovecifer 30 mins ago
我觉得 5.6 不错啊,能说下具体是 sol 还是 luna? effort 用的哪个档位?
|
17
ainyyy OP @fovecifer sol 非常迷糊,思考过程都显示用户希望加什么什么注释,写出来就没有,问为什么没加就是 你说的对。然后开始改。 最近每次该问题要改好多,不按约束来,有时候明确在当前指令中的约束都能无效
|
18
Ipsum 12 mins ago via Android
@zhaoziling 10 倍夸张了。但是 5 倍差不多了。
|
19
nrtEBH 9 mins ago
5.6 很强 你有这些问题 大概率 harness 没弄好或者需求不清晰
|