テクノロジー

12GB VRAMで125Bモデルを動かす「Strata」の概要|npaka

1: star_123 2026/10/02 09:41

試したい/試した。Ryzen5600 4070TiSuper VRAM16GB RAMDDR4 96GBの環境でQ2_XSのモデルが64kコンテキストでぬるぬる(70tps)動いた。良く課題で見る3Dボクセルアート5重の塔も15分で満足行くものが出来た。これは驚き屋じゃなくても驚く

2: Nunocky 2026/10/02 09:45

なんにしたってメモリが足りない...

3: himakao 2026/10/02 10:09

RAM64GB必要なことを除けば完璧っすねえ

4: naozane2 2026/10/02 10:11

Qwen3.8-Flash-Next。Qwen3.8-27Bより賢い。80GBで立ち上げがすごい時間かかる。

5: urtz 2026/10/02 10:20

まるで魔法のような

6: kotaponx 2026/10/02 10:25

RAMはDDR4ならどうにかなるのだけど、GPUはAmpareとかPascalだからなぁ……

7: sucelie 2026/10/02 10:29

マシだけどメモリ64GBはまだきついなぁ

8: Retset 2026/10/02 10:30

GemmaやQwen3.6 A3Bなどは使えないのかな?

9: shinobue679fbea 2026/10/02 10:42

FreeTokenのQwen3.8Flash最適化、ですな。Qwen4Flashが本命だろうけど、これのために50万くらい突っ込む価値あるかもね、ローカルで検閲緩いLLM使いたい人は

10: ssfu 2026/10/02 10:44

昔、Strata Studioって、3Dツールあったなあと思いだすなど。

11: kyahi227 2026/10/02 11:18

一般的にコンテキストのQ8未満、モデルのQ4未満は回答一発目では調子がいいが、ツールコール文法が保てなくなるなど支離滅裂になって使い物にならないと言われてる。それでも良いならどうぞという類。

12: fusionstar 2026/10/02 11:58

LM Studio で 27B 動かすより速く 125B が動くのはほんとに驚いた。 PC のリソースほとんど食っちゃっててほかのこと何もできなそうだったけど。

13: yorkfield 2026/10/02 12:21

一日に数回のリリースがされてる。開発の勢いが凄い。 https://github.com/Niko1221/Strata/releases [追記]量子化手法のGSQ-RCOは、3.5bitでも性能があまり落ちないらしい? https://huggingface.co/ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF

14: rdlf 2026/10/02 12:27

AppleのAFM 3 Core Advancedみたいなものかな?これでメモリ依存しなくなるのはいいけどモデルがデカいのでストレージを圧迫する問題が…

15: tyhe 2026/10/02 12:32

ひと世代前のRyzenと4070TiとDDR5 64GBだからギリギリ試せそうかなー。試してみるかー。

16: Yagokoro 2026/10/02 12:42

巨大モデルがローカルで動く時代が来てるの凄いわ

17: hirokinko 2026/10/02 12:55

PC故障で色々交換したタイミングに!

18: totoronoki 2026/10/02 12:56

これで125B の2Bit量子化モデルを入れてるが、なかなか賢い。速度もそこそこ。

19: TriQ 2026/10/02 13:03

VRAM12GBでマジか!となってRAM64GBでマジか…ってなった人結構多いと思うw

20: kurage_lizard 2026/10/02 13:11

安い時に不要と思いながらもRAM64GBにしておいた過去の自分を褒めたい

21: shinoppie 2026/10/02 14:08

喋るっぽくしてるだけでツールは動かないからエージェントを動かしたりとかはむりだよ、とAIさんにいわれてがっかり

22: ys0000 2026/10/02 15:48

Qwen3.8 FlashはQ4でも性能いいからなぁ。Strataのようなツールにすがる気持たはよくわかる。

23: rgfx 2026/10/02 17:02

あ、32GB環境向けのも出てたんだ

24: strawberryhunter 2026/10/02 18:01

すごい。GPUを買うならNVIDIAだな。まだ数年はNVIDIAの優位性は続く。

25: taguch1 2026/10/02 18:31

楽しみ

26: harumomo2006 2026/10/02 18:49

しかしメモリが足りない

27: ardarim 2026/10/02 19:08

VRAMもシステムRAMも足りないワイ低みの見物

28: collectedseptember 2026/10/02 20:03

GPUからメインメモリにスワップしてるのか

29: Abba 2026/10/02 20:26

まさかのRAMがいるのか 時期が悪いが買うか…

30: misshiki 2026/10/02 22:17

StrataはGPU・CPU・RAM・SSDを使い、125B級MoEをVRAM 12GBのGPUでも実行する推論エンジン。RAM 64GBを推奨し、OpenAI・Anthropic互換APIに対応。仕組みや測定結果、導入手順を解説。

31: agricola 2026/10/02 22:40

R9 3900X/DDR4-2666 64GB/RX6600 8GBの俺の愛機が……不安定なんすよ(涙)。もっともR9 5900XT/DDR4-3200 128GB/Radeon AI PRO R9700が控えてるけどな。あとRTX 2000 Adaもホストがメモリ障害で死んでから稼働してない(をい

32: ryunosinfx 2026/10/02 22:47

いつもどおりAMDがハブられてて草(Github上ではちゃんとRX9070XTも乗ってる)

33: torish 2026/10/02 22:57

試してみよう。ちょと昔のパーツぶち込んだらつかえるかも??バック・トゥ・ザ・フューチャーのデロリアンにゴミでも何でも掘り込んでた感じになるのかな?

34: Imamura 2026/10/04 13:51

RAM32GBではCoderのみか…でもこんな低スペックでも125Bモデルを動かせるとはすごい時代になった