テクノロジー

AIが実装し、AIがテストし、AIが「問題ありません」と言う時代の品質保証 - Qiita

1: uehaj 2026/08/13 07:43

この問いは、要求仕様を書き下すべきだという結論になる。

2: twmw 2026/08/13 07:53

エージェントのアバター画像を現場猫に変更することで全ての整合性がとれました🤔

3: nguyen-oi 2026/08/13 08:03

テストを通すことだけに最適化された結果グリーンになる現象はAIあるあるだな

4: jintrick 2026/08/13 08:09

"Quality Constraintを先に定義する" そうそう、ここにひたすら時間をかける。うちのエージェントどもは「受け入れ条件」と呼んでるけど、とにかく全精力をここに注いでる。モデルの性能が上がるほど他の努力は無駄になる。

5: showii 2026/08/13 08:13

AI記事

6: harumomo2006 2026/08/13 08:36

テストを通すことだけに専念するテスターいるから領域が違うだけでそんなに変わらない印象

7: fuji_haruka 2026/08/13 08:40

AI時代にどんな能力が重要になるか、という問い自体がもう賞味期限切れしかけていて、遅かれ早かれ人間の知性がAIにより疎外されるのを認めざるをえなくなると思う。

8: otihateten3510 2026/08/13 08:51

私も2ヶ月くらいAgentの検収問題の理論化について取り組んでる。大体答えは見つけた。とりあえず、自動テストで何とかなるシステムとならないシステムで分けたい。この記事は前者。どうも前者に引きずられる。

9: tpircs 2026/08/13 09:05

この問題、人間が優秀な前提で語られてることが多い気がするんだけれど実際の人間は結構ポンコツなのが混ざってるからAIの謎テストのほうが品質が高いってのも普通にあったりするのが闇

10: Error401 2026/08/13 09:06

少なくともテストコードの目視くらいしたら?

11: irh_nishi 2026/08/13 09:13

機械と人間なら機械のほうが正確なのは誰もが理解できるのに、AIになると理解できなくなるのは面白いなぁ、と。扱ってる問題が不確実性に富むものだからある程度不正解にはなるとして、人間よりは正確だよ。

12: progrhyme 2026/08/13 09:14

引用文献のサーベイ記事みたいな感じかな(?)

13: GENS 2026/08/13 09:22

「スワップテスト」「コードの長さの正規化」「生成と評価は別のモデル使う」とか、AIが信用できないポイントは人間と違うのが面白いよなって思っています

14: gm91 2026/08/13 09:25

たとえばテストパターン生成をAIにやらせたとして、その妥当性の判定は自分でやるよね。もう一歩踏み込むならばそのパターンでなぜ妥当と言えるのか?を説明させる。

15: sevenspice 2026/08/13 09:38

現場では皆AIを通して仕事してるだけになってしまった。品質云々以前に人間がいるはずなのに人間と会話もチャットもしてるように思えない虚しさがある。スマホ持たずにいられますか?みたいな状況に近い…

16: doko 2026/08/13 09:45

プロダクトをどのレベルまで掌握したいか、すべきかという話があって、お仕事なら相当の深度までだろうが、個人のプロダクトなら「お客さん」と同じレベルで良いと思う。なんか違うと思ったらそれは「違う」で良い

17: shoh8 2026/08/13 09:48

“AIが作った評価基準を、そのまま最終的なQuality Gateにすること は別問題”

18: tonocchokun 2026/08/13 10:07

そしてAIが品質保証するようになったときの責任だけが人間に残される未来なのだろうか

19: utisam 2026/08/13 10:37

最近 FMEA とか DRBFM あたりにヒントあるんじゃないかな?と思ってるけど具体化できずにいる。

20: manaten 2026/08/13 10:42

人間の営みに関わるものを開発してる限り、仕様策定はもちろんだがテストの何処かの工程でも人の手は絶対必要なのでは、という仮説を持っている

21: s17er 2026/08/13 10:53

マネージャーやプロダクトオーナーが開発チームに対してどのように品質保証をやらせるか、その報告をどう判断するかという視点がそのまま降ってきたかのようだ

22: m50747 2026/08/13 10:58

AIがだんだん賢くなってるので日々感じることは、大体人間のソフトウェアエンジニアと扱いが似てきていること。人間のエンジニアを雇って仕事をさせた時にここまでのことをやるのか?同僚に対してここまでやるのか?

23: sds-page 2026/08/13 11:02

人間が手抜きするようにAIも手抜きする。抜けを見つけて要求仕様をmdファイルに積んでいくしかない

24: FreeCatWork 2026/08/13 11:16

AIがテストしてもボクの可愛さはバグなしにゃ!人間もボクを撫でて品質保証してにゃん。

25: Xray 2026/08/13 11:23

人間がやってて品質保証ができていたのか?みたいな議論が必要では。自動テスト不可能な領域の話であればそもそもAIが出てきてはいけない。

26: ardarim 2026/08/13 11:47

AIがテストできる範囲なんてたかが知れている。組み込み系ではまだ無理(ハードが絡むので)

27: fusionstar 2026/08/13 11:58

原則として AI は人間より正確で網羅的と思うし、最近は意図の読解もうまくなってると思う。 人間はコードを見るよりも、 AI が日本語で書いた設計や仕様、テスト項目などの文書の確認が主になっていくと思うな。

28: sabinezu 2026/08/13 11:58

なぜ全部自動化を正としようとする?最終的に使うユーザーは人間だろうよ。

29: ynxdaz 2026/08/13 12:04

そして誰も業務を定義しないのである。

30: Iridium 2026/08/13 12:05

AIが正しく動いてるときはいいんだけど、AIが動かない場合の原因分析が難しくなっているような。開発速度を上げるために複雑性が増加している

31: flirt774 2026/08/13 12:08

この側面からも、領域外、非エンジニアがプロダクトを作るのが難しい、の説明になりそう。背伸びしたプロダクトをエージェント生成しているけど、テスト内容を把握してても不安が消えない。手の内にない

32: otoan52 2026/08/13 12:14

コンテキストを引き継ぐのは効率的なんだけど、0ベースでテスト書かせたり評価させることで改善したりするのよね。

33: IndigoBlue_Bird 2026/08/13 12:39

ゲームのMOD開発もAI利用が進んでいるようで、バグ報告を無視したりAIに放り投げて放置する、そのゲームへの愛情などなくてただ技術を誇示するためにMODを利用している、といった批判も出てきた。

34: hiroyuki1983 2026/08/13 12:45

安心しろ。やらかしたときに怒られるのは人間の役目だぞ

35: bamch0h 2026/08/13 13:16

AIにEXCELにエビデンスを画像で残すように指示すればいいんじゃないですかね?

36: gimonfu_usr 2026/08/13 13:25

( どこぞの戦場で女子小学生を誤爆殺してもベストエフォート的論理で逃げるの? )

37: green_chili 2026/08/13 13:26

『「正しさを評価する仕組みを設計する能力」』

38: fai_fx 2026/08/13 13:27

敵対的テスターAIは必須。

39: ejointjp 2026/08/13 14:00

Opus 5より頭がいい人間がいるなら品質チェックしてほしい。そうでなければOpus先生に全面的にお願いしたい

40: aalpaca375 2026/08/13 14:28

AIによるテストは、テックリードの能力に支えられた上で初めて使い物になる。採用した技術基盤は、その業務に対して十分な表現力を有しているか。現代のAIは、その多くを即座には判別できない。

41: KIKERIKI17 2026/08/13 14:37

「要求仕様」があるはずなのにAIはそれを忘れて「テストケースを要求仕様として適応する」みたいな話が構成されてない?書かれてる事はテストやAIの問題ではなくない?「外注にアウトソース」でも一緒だよね

42: soulfulmiddleagedman 2026/08/13 15:11

mutation test あたりをやりたいとは思ってるけど。

43: fashi 2026/08/13 15:47

AIが「これはテストが間違ってるのでテストを修正します」と言うのはよく見る / この記事も同じこと繰り返しててワードサラダみがあるな

44: mayumayu_nimolove 2026/08/13 15:49

コードは問題ありません。でも売れるんですかこれ?

45: misshiki 2026/08/13 16:08

AIが実装・テスト・修正まで担う時代は、テストが通っただけでは正しさを保証できない。人間は「何を正しいとするか」「何を必ず検証するか」を定義し、AIとは独立した確認手段を用意することが重要。

46: ochikun 2026/08/13 16:26

つまりこれからは、AIの出力を信じることしかできない人材か、その出力の妥当性を確認できる人材かに分かれるってことだよな

47: iouri 2026/08/13 16:33

ユーザーサポートもユーザーも全部AIにすればいいんだよw

48: toaruR 2026/08/13 16:53

仕様でもタスクでも、効くルーブリックが必要で、AIより上手く作れる人は案外少ないとも(´-`)と、その辺を整えても、新モデル登場でひっくり返る辛みも

49: junk-do 2026/08/13 16:56

人間が実装し、人間がテストし、人間が「問題ありません」と言う時代は終わったと言うことか。正直ある一定ライン以下の人間よりもCodexかClaudeがコーディングしたコードの方が信用できる時代。

50: yellowdomestic 2026/08/13 17:04

むしろ全部AIに任せた方がマシな現場の方が多いと思う

51: morimarii 2026/08/13 17:35

そもそもAI関係なくテストを通過したからといって「ユーザが期待する仕様を満たす」わけないのでいろいろ前提からおかしいのでは?

52: duckt 2026/08/13 18:04

まあ考えたら自然科学理論の証明だって「十分に」距離を置いた「十分な」数のテスト結果と整合的か、ということに尽きるもんな。理論自体の正しさは永遠に証明できないわけで。

53: t-tanaka 2026/08/13 18:06

役割の違うエージェントに協働させるんじゃだめなの?

54: circled 2026/08/13 18:42

同じAIモデル使うと良くない(solで設計、lunaで実装、solでレビュー)とか言われてるけど、最近MOAで複数のAIモデルをオーケストレーションするの普通になったから、もうかなり勝手に品質上げてってくれるんだよね

55: nobububu 2026/08/13 19:11

ちょっと凝ったロジックのテストケースだとまだまだ全然Opusよりは人間のが優秀だけど。

56: nikutetu 2026/08/13 19:45

最初はまぁそうか…と納得する点はあるものの、途中から横文字が多すぎてうるせぇ!となった。人間のダメなのはそういうとこだぜ。

57: schoollife 2026/08/13 20:36

上位要求を満たすよう最下位のコンポーネントを作るときに、設計・検証が自動化できるのはその通りでなのではないか。それを組み込んだときに問題ないかどうかは一つ上のレベルで動作確認でやればいい。

58: hasiduki 2026/08/13 20:53

金を稼いだモンの勝ちだ!!!!!!!!

59: gabari 2026/08/13 21:19

昔は「受け入れテストの設計」をテストチームに任せてコーディングだけしていればよかったが、コーディングを代替されてしまっただけ。自分で書けばゴメンなさいで許されたがAIに書かせるとそうもいかない。

60: snare_micchan 2026/08/13 21:34

アジャイルにおける「完成の定義」にあたる話だな。これがないのにアジャイルやってますという謎現場に遭遇したことがあったのを思い出した

61: ikanosuke 2026/08/13 22:02

AI「ヨシ!」

62: joseph150 2026/08/13 22:02

ひょっとしてこの記事自体AIが書いてない?違ったら失礼しましただけど、見慣れた文体すぎて。。。

63: CardamomPowder 2026/08/13 22:40

なんか冗長で要領を得ない感じがするな。TDDのテストを正とする前提で動く中で、テストが正で保証できない部分をどう定義するのかの議論の方が知りたい

64: sakurai_youhei 2026/08/13 22:58

保証、、、誰が?AIが!?じゃないよね、自然人か法人、もしくは組織やチームが品質を保証するんだよね。検査したり試したりしてその結果を見て誰かがヨシ!するものだとばっかり。