ローカルLLM向けにArc Pro B70とGeForce RTX 3090を比べると、最初に目につくのはVRAM容量です。B70は32GB、RTX 3090は24GB。単一GPUで量子化せずに載せたいモデルが24GBを超えるなら、この8GB差は大きくなります。ただし推論速度、必要なソフト、カードの入手条件も違います。容量だけで一方を万能と決めることはできません。
IntelのB70仕様とNVIDIAのRTX 3090仕様を出発点に、両GPUを使ったColabHiveの実測研究の範囲を確認します。この研究は2026年6月の測定で、著者自身が「working draft v2」と記しています。すべてのLLMや推論ソフトに当てはまる決着ではありません。
容量と電力仕様
| 項目 | Arc Pro B70 | RTX 3090 |
|---|---|---|
| 搭載VRAM | 32GB GDDR6 | 24GB GDDR6X |
| 公称のボード電力 | 230W | 350W |
| 主なソフト基盤 | Intel GPU向けXPU・oneAPIなど | CUDA |
容量と電力は両社の製品仕様によります。公称電力は実際のLLM実行中の測定値ではありません。GPUの使用率、量子化方式、電力制限によって実消費電力は変わります。B70のメモリ帯域は608GB/sとされていますが、帯域だけからトークン速度を算出できないため、ここでは同条件の実測を優先します。
bf16の7B推論実測
ColabHiveはQwen2.5-7B-InstructをvLLMで動かし、bf16、eager、コンテキスト4096という条件で比較しました。並列リクエストが多い条件では、B70の出力スループットはRTX 3090の95~97%でした。これは「そのテストでほぼ同じ水準」という意味で、あらゆるモデルの速度差が3~5%に収まるという意味ではありません。研究は3回繰り返し、RTX 3090側の測定ばらつきにも触れています。
同条件でのGPU負荷時電力はB70が約219W、RTX 3090が約343Wと報告されました。速度に対する電力の見方ではB70が有利ですが、電源からのPC全体の消費電力と混同しないようにします。また、ユーザー1人のチャット体感は、総スループットだけでなく最初のトークンまでの待ち時間にも左右されます。
AWQ 4bit推論の実測
同じ研究のAWQ 4bit測定では、Qwen2.5-7Bの出力スループットがB70でRTX 3090を19~26%上回りました。例えば同時リクエスト8件で3090が302.9 tok/s、B70が381.8 tok/sです。bf16の近い結果から順位が変わるため、買う前に使う量子化方式を決めて比較する必要があります。
この数値は特定のvLLM-XPU環境とAWQモデルでの結果です。Intel側は特定の設定フラグを使っており、導入時の手間も含めて確認したいところです。CUDAで動く既存ツールをそのまま使う運用なら、RTX 3090のソフト資産が有利になる場面もあります。速度差だけで移行作業の量は測れません。
32GBが効くモデルの例
ColabHiveはQwen2.5-14B-Instructをbf16で読み込む試験も行いました。この条件ではRTX 3090の24GBはメモリ不足となり、B70は31.1GiBを使用して読み込めました。B70の32GBに近い容量を使っているため、長いコンテキストや追加の並列処理には余裕が少ないことも読み取れます。モデルがロードできることと、希望する設定で快適に使えることは分けて判断しましょう。
RTX 3090でも同規模のモデルを4bitなどに量子化すれば実行できる場合があります。したがって「3090では14Bが動かない」と一般化するのは誤りです。B70の利点は、その研究のbf16設定を1枚で維持できたことです。量子化による品質差や必要なコンテキストを考えて、自分のモデルでの必要容量を調べてください。
GPU選択の基準
B70は新品の国内販売例があり、32GBを1枚で使えることが魅力です。RTX 3090は24GBですが、CUDA前提のツールや既存の手順を使うなら導入しやすいことがあります。価格を比較する際は、3090の新品・中古の状態や保証の差もそろえる必要があります。ここで単一の中古相場を固定して優劣を決めることはできません。
まず、使うLLMと量子化方式、必要コンテキストを決めます。次にそのモデルが24GBと32GBのどちらに収まるか、使う推論ソフトが各GPUをサポートするかを確かめます。最後に同じ設定のベンチマークとPC全体の費用を比べましょう。B70側の実機例は32GBでのローカルLLM記事でも確認できます。
まとめ
Arc Pro B70とRTX 3090の大きな違いは32GB対24GBのVRAMとソフト基盤です。ColabHiveの7Bテストではbf16が近く、AWQ 4bitではB70が19~26%速い結果でした。これは限定された測定であり、購入判断には実際に使うモデル、精度、ソフトの対応を当てはめる必要があります。
