メインコンテンツへスキップ
技術ブログヘッダー

技術ブログ

最新の技術情報や導入事例、開発ノウハウを発信しています。

AI・機械学習
29分

70GBのQwen3.8-Flash-NextをVRAM 5GBで動かす。RTX 5090 + llama.cpp 実測メモ

Qwen3.8-Flash-Next を手元の Windows 機で動かしてみました。合計 176B、GGUF で 70GB のモデルです。GPU は RTX 5090(VRAM 32GB)、メインメモリは 64GB。結論から言うと、動きます。しかも VRAM は 5GB しか使いませんでした。ただ...

2026/08/27
むらかみ
70GBのQwen3.8-Flash-NextをVRAM 5GBで動かす。RTX 5090 + llama.cpp 実測メモ
llama.cppGGUFRTX 5090動作検証

むらかみ

AI・機械学習分野の専門家として、企業のDX推進をサポートしています。