テクノロジー

12GB VRAMで125Bモデルを動かす「Strata」の概要|npaka

1: star_123 2026/10/02 09:41

ddr4だけどram96GBだから今度試してみよう

2: Nunocky 2026/10/02 09:45

なんにしたってメモリが足りない...

3: himakao 2026/10/02 10:09

RAM64GB必要なことを除けば完璧っすねえ

4: naozane2 2026/10/02 10:11

Qwen3.8-Flash-Next。Qwen3.8-27Bより賢い。

5: urtz 2026/10/02 10:20

まるで魔法のような

6: kotaponx 2026/10/02 10:25

RAMはDDR4ならどうにかなるのだけど、GPUはAmpareとかPascalだからなぁ……

7: sucelie 2026/10/02 10:29

マシだけどメモリ64GBはまだきついなぁ

8: shinobue679fbea 2026/10/02 10:42

FreeTokenのQwen3.8Flash最適化、ですな。Qwen4Flashが本命だろうけど、これのために50万くらい突っ込む価値あるかもね、ローカルで検閲緩いLLM使いたい人は

9: ssfu 2026/10/02 10:44

昔、Strata Studioって、3Dツールあったなあと思いだすなど。

10: kyahi227 2026/10/02 11:18

一般的にコンテキストのQ8未満、モデルのQ4未満は回答一発目では調子がいいが、ツールコール文法が保てなくなるなど支離滅裂になって使い物にならないと言われてる。それでも良いならどうぞという類。

11: fusionstar 2026/10/02 11:58

LM Studio で 27B 動かすより早く 125B が動くのはほんとに驚いた。 PC のリソースほとんど食っちゃっててほかのこと何もできなそうだったけど。

12: yorkfield 2026/10/02 12:21

一日に数回のリリースがされてる。開発の勢いが凄い。 https://github.com/Niko1221/Strata/releases

13: rdlf 2026/10/02 12:27

AppleのAFM 3 Core Advancedみたいなものかな?これでメモリ依存しなくなるのはいいけどモデルがデカいのでストレージを圧迫する問題が…

14: tyhe 2026/10/02 12:32

ひと世代前のRyzenと4070TiとDDR5 64GBだからギリギリ試せそうかなー。試してみるかー。

15: Yagokoro 2026/10/02 12:42

巨大モデルがローカルで動く時代が来てるの凄いわ