abctest
V2EX  ›  问与答

Nvidia 128G 的那个小盒子用哪个模型好?

  •  
  •   abctest · Aug 26 · 1170 views

    试了最新出的 Qwen3.8-27B ,吐字很慢,4token/s 。 试了 Qwen3.6-35B-A3B ,质量感觉不行,幻觉有些严重。

    2 replies    2026-08-27 04:49:50 +08:00
    volvo007
        1
    volvo007  
       Aug 26
    因为这货的带宽太低了,所以非常不适合稠密模型的推理。所以比较合适的还是两台上满血 d4f
    biaoyu
        2
    biaoyu  
       Aug 27
    适合用 MOE ,稠密不行
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   5207 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 33ms · UTC 08:19 · PVG 16:19 · LAX 01:19 · JFK 04:19
    ♥ Do have faith in what you're doing.