有深度体验过的兄弟吗
1
awah 2 days ago
体验是 Gemma 没一个打得过 Qwen
|
2
Meteora626 2 days ago
qwen
|
3
Tokin 2 days ago
gemma 都没热度。。。
|
4
ChoiYoonJung 2 days ago
|
5
JerningChan 1 day ago
@ChoiYoonJung 你要知道那个是 a4b ,每次推理只有 4b 的参数量,qwen3.8-27b ,是每次推理是 27b 的参数量。。。
|
6
siriusliangcn 1 day ago
巧了,现在两个我都部署使用过了。我是两张 5090 部署的 q8+256k 的 context ,只有我一个人用。
先说结论,qwen3.8-27b 已经领先 gemma4-31b 一个时代了。 如果你要做简单任务,例如帮我总结一下这个函数写个注释、帮我解释一下这个图片描述了什么内容、把下面一段文字翻译成美式英语,两个模型都能胜任。如果还是有大量专业名词或者新名词的,gemma4-31b 的理解能力反而更好。 如果要做长任务,比如,读一下这个小说开头两万字,这是我下面的剧情,你把它扩写成能撑起 6 万字的概要,按照我现在的节奏规划章节,每一章节一篇概要,都要包括人物关系变化、伏笔与回收,注意剧情一致逻辑自洽人物形象不能偏移。 |
7
siriusliangcn 1 day ago @siriusliangcn 这种长任务,就只能 qwen3.8-27b 做,gemma4-31b 是上个时代的东西,大概不到半小时后输出很少就结束了;而 qwen3.8-27b ,我在 dsh 下能跑 4 个多小时,一篇一篇反复写反复斟酌,前后不一致再回去改已经写好的,经历好几次上下文压缩,从不中断。
这还是非编码场景。如果是编码,就更是 qwen3.8-27b 的强项了。 |
8
siriusliangcn 1 day ago
我是在 dsh 中使用的,dsh 本来就墨迹,碰上更墨迹的 qwen3.8-27b ,一个小需求俩人要商量半天。
如果着急就用云端大模型。如果不着急,我感觉产物的逻辑性堪比 DeepSeek-v4-flash-0731 ,输在速度,胜在稳定发挥,云端 ds4flash 老掺水降智。 |
9
siriusliangcn 1 day ago
qwen3.6-27b 那会,我也用过一段时间,感觉不如 gemma4-31b ,写代码方面 qwen3.6-27b 略胜,其他 gemma4-31b 稳定胜出。gemma4-31b 不啰嗦,话少,总是能精准给出我要的结果。
但现在完全不同了,qwen3.8-27b 在长任务的毅力上表现惊人。不知道谷歌会不会更新 gemma 系列,听说有人离职了。 |