テクノロジー

ClaudeのAPI費用が激減。システムプロンプトを「画像」として読ませる新ツールの仕組み | XenoSpectrum

1: nguyen-oi 2026/07/05 21:35

情報密度無視のピクセル固定課金の隙を突く画像化ハック、賢いけど絶対対策される

2: miyabisun 2026/07/05 21:41

Claudeは画像読むの苦手だから情報の欠損多いだろうし、どうせその内対策されるから一発ネタ位にしかならなさそう

3: ustam 2026/07/05 21:56

ユーザー離れを起こすので値上げはしにくいだろうし、普通にAnthropicが経営破綻すると思うよ。

4: poponponpon 2026/07/05 22:00

こういうのは思いついた人がこっそりやるべきであって公開してドヤるのはちょっといかがかと思う

5: pendamadura 2026/07/05 22:01

笑う

6: nekonanox 2026/07/05 22:17

削減できるのは入力トークンのみだから結果としては誤差かなー

7: hogetax 2026/07/05 22:34

おもしれぇ事考える人がいるなぁw

8: twmw 2026/07/05 22:46

トヨタ自動車の企業文化(特に「紙1枚主義」)が最も有名です。

9: sionsou 2026/07/05 22:48

ワラタw なんか似たようなハックを何処かで見た気がするけど面白いこと考える人いるなぁ。たしかに日本語のほうが文字数多くて不利だから短文とか英文がいいみたいな話もあったが画像で圧縮するとはw

10: wordi 2026/07/05 22:59

文字の形に一意性がある英語ならでは

11: auto_chan 2026/07/05 23:32

画像を使って自然言語を介さずAIの脳に直接語りかけたい。さぞかし驚くだろうなあ

12: kihee 2026/07/06 00:04

アプローチとしては面白いけど、最終的な計算量も圧縮されないならすぐ対策されてしまいそうな気がする

13: doko 2026/07/06 00:44

どうせすぐに対策されるでしょ

14: nomakkah 2026/07/06 00:45

「テキストをそのまま処理せず、いったん画像として扱って、視覚経由で情報を圧縮・再解釈する」という発想はDeepSeek-OCRに似てるな

15: gabill 2026/07/06 00:49

入力トークンは削減できても負荷がめちゃくちゃ上がりそう

16: hatahata_chan 2026/07/06 00:58

こんなん、騒いだら防がれるに決まってんじゃん。お疲れ様です。

17: kyahi227 2026/07/06 01:10

画像はビットマップ展開してトークナイザに無理矢理突っ込んでネイティブに処理される。LLMに届くトークン量に嘘はない訳だから裏技ではなく単に言語が圧縮できるだけだが、節約した分だけ精度も落ちると思うんだが。

18: BOUSOUNINJIN 2026/07/06 02:41

ほかにもrtk-aiとgenshijinで入力・出力トークンをそれぞれ節約できる。今後AIの料金が上がるのは見えてるのでトークン節約は必須になる。

19: FreeCatWork 2026/07/06 03:22

文字を画像で読ませるなんて天才にゃ!ボクも魚の写真を送れば釣れるかにゃ?

20: kazyee 2026/07/06 07:16

OCRのためのトークン使用量とトレードオフかな。

21: hirrrose 2026/07/06 07:52

トークン節約

22: PerolineLuv 2026/07/06 08:10

これ確か作者ドキュメントに書いてあるけど、不可逆圧縮でしょ。システムプロンプトを圧縮したいなら他にいくらでも有益なツールある。

23: ton-boo 2026/07/06 08:36

こういうやり方で圧縮する際の言語による圧縮効率が気になる。漢字の方が文字が潰れやすいから日本語・中国語は不利かも。まあ使わないけど

24: UCs 2026/07/06 09:25

公開したところで、塞がれるかな?費用は負荷に応じて設定されてる訳で、塞がれない気もする

25: ihirokyx 2026/07/06 09:27

Claude Codeの入力コンテキストをPNG画像に変換し、トークン費用を約6割削減するローカルプロキシ「pxpipe」が登場した 不確実な画像読み取りを許容できるタスクの切り分けが必要

26: strawberryhunter 2026/07/06 09:56

たぶん、ふさぐ類いのものではなく、実際に圧縮できているのでは?DeepSeek-OCRとかあったじゃん。画像がどのようにトークンになるのか知らないので何とも言えないが。

27: tamayuz 2026/07/06 10:27

日本語でこれをやるのは大変そうだね。漢字とか潰れるでしょ

28: yorkfield 2026/07/06 10:33

画像を解釈するためにthinkingパートが伸びたり(thinkingは出力なので入力の5倍の価格)、入力の精度が下がった結果リトライが発生して、返って料金増える気がするんだけど、そのあたりも考慮して節約できてるのかな?

29: defiant 2026/07/06 11:40

この記事をおすすめしました

30: fashi 2026/07/06 11:44

「Fable 5では15回中13回の成功にとどまり、Opusモデルでは全滅」

31: ene0kcal 2026/07/06 12:45

アルファベット圏の言語と漢字圏ではその分岐点が違うと思うので、それについて触れてないと不誠実だなと思った。

32: yathu 2026/07/09 16:05

圧縮系は明確な弱点があって安定性を犠牲にする。ちょっとでも崩れたら全部崩れかねない。別にチートでも何でもないから的外れ。作成コストを取るか、圧縮言語辞書作って安定性を図るか。