abctest
V2EX  ›  问与答

Nvidia 128G 的那个小盒子用哪个模型好?

  •  
  •   abctest · 7h 51m ago · 353 views

    试了最新出的 Qwen3.8-27B ,吐字很慢,4token/s 。 试了 Qwen3.6-35B-A3B ,质量感觉不行,幻觉有些严重。

    2 replies    2026-08-27 04:49:50 +08:00
    volvo007
        1
    volvo007  
       7h 43m ago
    因为这货的带宽太低了,所以非常不适合稠密模型的推理。所以比较合适的还是两台上满血 d4f
    biaoyu
        2
    biaoyu  
       1 min ago
    适合用 MOE ,稠密不行
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   915 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 73ms · UTC 20:51 · PVG 04:51 · LAX 13:51 · JFK 16:51
    ♥ Do have faith in what you're doing.