Qwen3-VL 8B の必要VRAM
現行世代の画像対応モデル(VLM)。文書読解・画面理解が強化。画像入力時はこの目安より必要メモリが増えます。
8.77B / 36層 / GQA 8ヘッド / 既定コンテキスト 8,192 トークン(HuggingFace)
| 量子化 | 必要VRAM | RTX 3060 Ti | RTX 3070 | RTX 4060 | RTX 3080 | RTX 3060 12GB | RTX 4070 | RTX 4060 Ti 16GB | RTX 4070 Ti SUPER | RTX 4080 | RX 7800 XT | RTX 3090 | RTX 4090 | RX 7900 XTX | RTX 5090 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Q4_K_M | 8.0 GB | △ ぎりぎり | △ ぎりぎり | △ ぎりぎり | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 |
| Q5_K_M | 8.9 GB | × 不可 | × 不可 | × 不可 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 |
| Q6_K | 9.9 GB | × 不可 | × 不可 | × 不可 | △ ぎりぎり | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 |
| Q8_0 | 12.0 GB | × 不可 | × 不可 | × 不可 | × 不可 | △ ぎりぎり | △ ぎりぎり | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 |
| FP16 | 20.2 GB | × 不可 | × 不可 | × 不可 | × 不可 | × 不可 | × 不可 | × 不可 | × 不可 | × 不可 | × 不可 | ◎ 快適 | ◎ 快適 | ◎ 快適 | ◎ 快適 |
必要VRAM = 重み + KVキャッシュ(既定コンテキスト時) + 1.5GB(OS/表示)。△は量子化を下げるかコンテキストを絞れば動作します。
お使いのGPUで判定する
| 量子化 | 必要VRAM |
|---|
判定はブラウザ内で完結します(選択内容は送信されません)。
▶ あなたのPCを自動判定する(スペック送信なし・ブラウザ内完結)
クラウドGPUでQwen3-VL 8Bを動かす(RunPod)
上記はアフィリエイトリンクです。経由して課金された場合、当サイトに紹介料が入ります。