使えば分かる。最初はalibaba? 中共の罠? くらいに思っていたよ。Qwen使ったら、自分の用途だとオープンウェイトなのにフロンティア級のように答えるし、商用性ないから追従少ないし。Gemmaとかお呼びでないね
Deepseekの0731が極めて素晴らしいアップデートな上に値段も安かったんだけど、急にAPIが最大12倍くらいの値上げになっちゃったので、安くて同等の性能のローカルLLMとしてのqwen3.8:27bが注目されてる昨今、もしくはluna
Qwen系は思考が長すぎとかありますが手元でこれだけ動いたらコスパ以外に道が見えてきますね。Gemma4もアップデート後は結構よくなったように感じますが。ローカルLLMはコーディング用途で見られがちなところあるかも。
派生モデルの登録数が倍らしい(´-`)なお読んでない
grokも公開しろよ
Deepseekはそこそこ期待通り動いてくれて助かる、まあフロンティアモデルのAPI使ったほうが安いとは思うけど
私の用途/構成ではGemma4 26Bが良さげだったのでQwenから乗り換えようかと思ってる。
Qwen 3.8、デフォルトがxhighになっているのが少し問題あるらしいがどうなんだろ https://x.com/DogukanUrker/status/2089282517010374665
今もう国際学会の発表者は大半が中国人だしNVIDIAのGPUを輸出規制されるイジメを受けても研究力でカバーして新モデルアーキテクチャ生み出してアメリカのフロンティアモデルに1年遅れくらいで追いついてるしすげーよ
QwenはGemmaの倍近く――Hugging Face統計にみる、中国製AIの台頭
使えば分かる。最初はalibaba? 中共の罠? くらいに思っていたよ。Qwen使ったら、自分の用途だとオープンウェイトなのにフロンティア級のように答えるし、商用性ないから追従少ないし。Gemmaとかお呼びでないね
Deepseekの0731が極めて素晴らしいアップデートな上に値段も安かったんだけど、急にAPIが最大12倍くらいの値上げになっちゃったので、安くて同等の性能のローカルLLMとしてのqwen3.8:27bが注目されてる昨今、もしくはluna
Qwen系は思考が長すぎとかありますが手元でこれだけ動いたらコスパ以外に道が見えてきますね。Gemma4もアップデート後は結構よくなったように感じますが。ローカルLLMはコーディング用途で見られがちなところあるかも。
派生モデルの登録数が倍らしい(´-`)なお読んでない
grokも公開しろよ
Deepseekはそこそこ期待通り動いてくれて助かる、まあフロンティアモデルのAPI使ったほうが安いとは思うけど
私の用途/構成ではGemma4 26Bが良さげだったのでQwenから乗り換えようかと思ってる。
Qwen 3.8、デフォルトがxhighになっているのが少し問題あるらしいがどうなんだろ https://x.com/DogukanUrker/status/2089282517010374665
今もう国際学会の発表者は大半が中国人だしNVIDIAのGPUを輸出規制されるイジメを受けても研究力でカバーして新モデルアーキテクチャ生み出してアメリカのフロンティアモデルに1年遅れくらいで追いついてるしすげーよ