ついにQwen3.8が出ましたね。Maxも27Bも出ました。GGUFも出たので、早速インストールして現在の弊社のLLMと殴り合いしてみました。
【結果編】Qwen3.8-27b、降臨。既存と殴り合わせた
土曜0時、予告どおりオープン公開(ModelScope→HF→ollama)。検証機を ollama ネイティブ(0.32.13)に入れ替えて qwen3.8:27b(dense 27.3B / Q4_K_M / 17.7GB / 262kコンテキスト / tools+thinking+vision)をpull、現行主力と処理判定10番勝負。
| モデル | 精度(誤処理) | 速度 | スループット | tool_use |
| 現行 | 10/10 (0 / 0) | 4.9秒/件 | 90 tok/s | ○ |
| qwen3.8:27b | 10/10 (0 / 0) | 7.0秒/件 | 48 tok/s | ○ |
・精度: ついに満点タイ。過去のQwenの弱点「思考中にJSONが壊れる」も完全に消えた。
・速度: 現行の勝ち(約1.4倍速・スループット2倍)。現行はMoE(実働3.8B)、qwen3.8はdense 27Bで毎回全部通す構造差。
・結論: 主力は速さで 現行続投。ただし qwen3.8 は精度・安定性・道具使いで完全に並んだ”最強の二番手”。精度が命の場面では、こいつに出番が来る。
残念ながら、現行のモデルを変更するほどのパフォーマンスが出ませんでした。
ワクワクは良かったけど、だめでした。
残念だけど、まぁ、すごいものが出てきたものです。
何がすごいって、MoEじゃなくDenseでこのパフォーマンスを出すのはすごいです。
今後は、もっとすごいモデルが出てくるんでしょうね。
楽しみです(^^)