テクノロジー

「Claude Code×GPT」自律ループが凄すぎ、仕事が“3つ”に減る5ステップ

1: jintrick 2026/08/22 06:31

ただし「事故る」と札束が消えます。事故らなくてもかなり浪費します。ループ設計間違えると何も改善しないまま数百Bのトークンが浪費されます。信頼できる専用ハーネスアプリが固まるまで手を出さない方針。

2: toaruR 2026/08/22 07:25

タスクの並列化が案外ムズイんよなぁ……

3: iinalabkojocho 2026/08/22 07:41

私は開発ではないがHermesで恐る恐る動かしてる。無論環境はVM。境界ガチガチ。トークンは最安のLLM監視しながら。便利な一方でトークンコストもセキュリティも怖いものですよ。

4: Suga-0106 2026/08/22 07:48

もちろん事故ったら筆者が全責任を負うんだよね?

5: qpci32siekqd 2026/08/22 08:03

常に正解が分かるものでないと難しい。仕様書をコンパイルしてエラー、仕様書と実装が違っていたらエラーとか機械的に判別つくようにならない限り難しい気がする。

6: nowww 2026/08/22 08:13

AI開発の友人が誰もいないので完全に自己流だけど、自動でいいものが作れるのかな?俺は細かい指定をしないと満足いくものができないんだけど

7: mayumayu_nimolove 2026/08/22 08:29

ブクマデフォルトアイコン率高いな

8: ebibibi 2026/08/22 08:46

よい記事。

9: Niemand 2026/08/22 09:28

本当に実用的ならAI企業が、テンプレート化して公開してるはずだけど何故か無いんだよね不思議だ。

10: katano33jp 2026/08/22 09:58

具体例が一つもない

11: tuka8s 2026/08/22 10:01

ベンチマーク「LoopsBench」は、112件の長時間開発タスクで、当時最強のClaude Opus 4.7とClaude Codeの組み合わせで完全に解決25%.GitHub上の複雑な連続タスクで成功率は3%台。そんなもんなのか、、、

12: bxmcr 2026/08/22 11:04

完成形があらかじめ分かっているなら可能かも?作りながら考える私には難しい。/最新のAIだと、勝手にテストスクリプト書いて通るまで繰り返し改善してくれるのである意味内蔵済みでは?

13: strawberryhunter 2026/08/22 17:03

要件だけ投げて、思った通りのものができるかと言うと、事前に決め切れないから、まあ無理。終わった後に人力で確認する必要はある。

14: okupro 2026/08/22 23:47

Blender MCPを使った3Dモデルのモデリングとかはループを設定するかどうかで出来上がりの差が大きく出る。ただトークンバカ食いする。

15: georgew 2026/08/23 00:33

当時最強のClaude Opus 4.7とClaude Codeの組み合わせでも、完全に解決できた割合は25%にとどまった。実際のGitHub上の複雑な連続タスクに限れば、成功率は3%台に沈んだ > この程度にトークン大量消費は正直キツい。

16: schoollife 2026/08/23 13:50

すごいウォーターフォール感あるけど設計がクソだったらデスマーチ(大量のトークン消費)に繋がる? そう考えるとアジャイルな開発プロセスがトークン消費を抑えられるかもしれない?