テクノロジー

ChatGPTに「この文献にあります」と言われて目を通したが書いてなかったのでそう伝えたら「3版以前を読んでませんか? 4版で追加された記述です」と正論で殴られた話

1: Galaxy42 2026/09/28 02:27

巨人大鵬玉子焼

2: mouseion 2026/09/28 06:37

Z世代でチャッピー使って失敗しまくる原因ってもしかして無料版だから説。割とマジでありそう。

3: flirt774 2026/09/28 06:45

GoogleのとあるAPIが廃止されてたけど英語でのリリースがあって日本語でのリリースがなくて、Claudeはしっかり英語版を根拠として伝えてきたというのはあった。ソースURLをしっかり確認するの大事

4: augsUK 2026/09/28 07:03

ここ半年くらいは、架空の文献を示すハルシネーションは論文引用レベルでは全くなくなったな。doi番号もすべて正確

5: nguyen-oi 2026/09/28 07:09

ハルシネーション疑ってドヤ顔で突っ込んだら版違いで論破されるの人間側の敗北感すごい

6: gimonfu_usr 2026/09/28 07:34

"何もかも全部こっちからインプットしてあげないとダメ"/

7: awaytabi 2026/09/28 07:38

あまいな。読んでみたら4版に書いてないのがChatGPT。

8: chikoshoot 2026/09/28 07:42

チャッピーが賢くなったって話してるのに Gemini で凸してくるの無謀すぎるだろ。

9: njgj 2026/09/28 08:01

指摘すると「その通りです。この文献にあると思われがちですが、実は書いていないのです」とか言われるイメージだけど…。

10: duckt 2026/09/28 08:04

第何版かまでは教えてくれないのか。

11: kei_1010 2026/09/28 08:04

AIを論破しまくりたければGemini最高やで(白目

12: toria_ezu1 2026/09/28 08:20

論文参照とかプログラミングとかSNS上の発言とか、すぐにハルシネーションが分かるところがある場合はAIは便利だと思う

13: good2nd 2026/09/28 08:24

2年前は「1.11と1.9のどちらが大きいか」みたいなので間違えてたのにね。あっという間に性能上がってるのは確か。

14: atsuskp 2026/09/28 08:29

てかその文献をソースとして一緒に提出してこいよ(ただし、それにも記述がなかったりする)

15: iwashioyaji 2026/09/28 08:41

おおむね統一されたルールによって記述されたデータベースを検索させる、というのは、AIの一番よい使い道のひとつだよね

16: TakamoriTarou 2026/09/28 08:45

逆にGoogleの検索に出てくるGeminiが酷い事になっている印象。コストの増大を受けて無料版の方はコストを下げる方に進化させてて、AIの間違いや倫理問題に対応するためにガードレールを厳しくしている影響だと思うが

17: kazyee 2026/09/28 08:46

よくわからないが、生成AIに参考文献名と版数のリストを回答で出力するようにプロンプトを書けばいいのでは。/GeminiとGPTは回答の切り口の傾向が異なるのが良いところであり悪いところでもある。

18: corux 2026/09/28 08:47

(これは会話を続けて相手と分かり合えたという話だとして…人間とも会話を続けることが出来ないとか、わかってちゃんをやってしまったあげく怒るとか、AIに向いてないな? 指示出しスキルではなく対話スキルの…)

19: moandsa 2026/09/28 08:55

つまりその本を◯版と◯版を学習で読ませてるということで。古本大量発注の件からなんとなく不気味に感じてる。「学習させる」とは何かその前からわかっていたことなのに。

20: nakex1 2026/09/28 08:59

参考文献を示すなら発行年は必須だろ。

21: hashigohinan 2026/09/28 09:10

4版自体がないのがChatGPTでは…

22: togetter 2026/09/28 09:11

より正確な情報が欲しいなら有料版のほうがいいんだね。

23: pakila 2026/09/28 09:21

「読んでみたら4版に書いてないのがChatGPT」ってコメントが星を集めているが、Togetter本文には「確かに書いてあった」とある。人間もろくに内容を読まずハルシネーションを起こしているのである。

24: PikaCycling 2026/09/28 09:24

Geminiは有料版でも当然のようにハルシネーションしてくるからゴミ。チャッピーは話が長くて好きじゃないから課金してないけど、絵を描かせると上手いんだ。

25: Cru 2026/09/28 09:26

むしろ盲信してて危険。ハルシネーションは減ってきてても今のところ原理的な部分で絶対消せてない。最近さらにひどくなってきた気がする無料版でも各社モデルによって信頼度変わる実感

26: bugttehanny 2026/09/28 09:31

★がたくさん付いたブコメはハルシネーションを起こすイメージで語られてるが、最新のChatGPTにそんなイメージはないぞ。昔のChatGPTとか、Geminiの印象で語ってないか?

27: circled 2026/09/28 09:31

引用元リストを出してくれるのは良いのだけど、引用と引用元のマッチングが極めて下手なのがChatGPTのイメージ

28: differential 2026/09/28 09:41

AIの推論根拠の出典を掘って確認してるとそんなこと書いてなかった、は割とあるあるだが、AIに食わす本を大量に買い漁ってる話と合わせるとこの先「出典確認したいがその本が手に入らない」がありうるなと思ったり

29: bayaread 2026/09/28 09:43

こういう初歩的はハルシネーション、フロンティアモデルでは起こらなくなってると思うけどな。みんな無料版で弱いモデルを使ってるだけどな気もする

30: honeybe 2026/09/28 09:47

かつては存在しない文献を上げていたのに一応存在する文献を上げるようになったのか(マテ

31: sandboxA 2026/09/28 09:52

(書いてあった)って記載あるじゃねーか!注目コメントやそれに群がる★は一体なんなん?

32: tomokatz 2026/09/28 09:55

農家。農業でいろいろ聞くとかなり間違える。科学的でないものがたくさんあるので、何を重視するかで正しさが変わる。こういうジャンルはかなり弱いので使い手の能力が試される。

33: mirakux 2026/09/28 09:56

古いイメージで語ってるなあ。若しくはGeminiユーザーが見栄張ってる

34: takamocchi 2026/09/28 09:58

情シスの人が言ってたけど、未だに「あなたは◯◯の専門家です」とかプロンプト打ってる人居たりするって。

35: kumpote 2026/09/28 10:17

AIも日進月歩。確かにちょっと前より確実に賢くなってる。ウィルスミスもパスタ食える。けどまだまだハルシネってくる事も間違えなんです!って煽ってくる事もあるから常に疑いの気持ちは必要

36: pqw 2026/09/28 10:25

査読された論文とかはいいけどそれ以外のソースだとまだ微妙よね。「うそはうそであると見抜く」のは難しい。私英語できる方だと思うが、英語だとわからん。もっとレベル高いにせよAIも同じような感じかと。

37: sierraromeo 2026/09/28 10:29

ちゃんと確認するえらめのじんるいだ

38: T-norf 2026/09/28 10:43

2年ほど前に作ったスライドに「生成AI、三日会わざれば刮目して見よ」というタイトルのがあるけど、ずっとそうなのよね

39: hiruhikoando 2026/09/28 10:43

ちょい面白いのはチャッピー、GeminiさんやGoogleの悪口言うときものすごいノリノリなのな。グロックやクロードにはそうではないのに。

40: wiz7 2026/09/28 11:16

指摘すると「はい、その文献には書いてありませんよ」と、シレっと自分の発言にすり替えるので、カスタム指示で焼きを入れるまでがセット

41: marilyn-yasu 2026/09/28 11:24

最近はネットで公開されてる情報なら齟齬なく引用してくれるようになった。逆に書籍内容だと公開されてない訳で正しく引用してるならAI学習でなく引用データベースとしてオープンAIが内容を保持してるって話になる。

42: estragon 2026/09/28 11:27

Geminiは相変わらず酷い印象だけど、ChatGPTとClaudeは随分前からそこまであからさまな捏造はかなり減りましたね

43: shibuiku 2026/09/28 11:29

ここ数週間以内の性能について語っているであろう話題に、「4版が無いのがチャッピー」など数年前の経験を書いちゃう人類増田におかれましては

44: ttrr 2026/09/28 11:31

事実を指摘することを正論とは言わないし、より正確な事実を提示することを殴るとも言わない。

45: ardarim 2026/09/28 11:40

このケースは正論で殴り返されてるけど実は4版なんて存在しなかった(ハルシネーション)というオチも結構ありがちな気がするけど…

46: hecaton55 2026/09/28 11:44

そういうパターンもあるよね

47: Iridium 2026/09/28 11:47

文献がないものとか研究があまり進んでないものはぜんぜん適当な内容になる印象がある。「夜勤明けで夜眠れない」といった相談に対する回答はまったく意味のないものになる。

48: oreuji 2026/09/28 12:03

チャッピーも普段の応答次第で割とノンデリになる場合もあるからかなり使ってるユーザーだと他との対応に違いは出るかも

49: mobanama 2026/09/28 12:12

"ChatGPT「3 版以前を読んでません? 4 版で新しい研究成果として追加された記述なのでそっち読んでもらわないと。てか普通最新版チェックしませんか?」"w

50: metamix 2026/09/28 12:15

どこまでAIの性能が上がろうが100%信用しないことが重要、たとえAIのほうが正しかろうが関係ない。AIはどこまで行っても道具、人間様の判断のほうが上、という意識付けが大切

51: khtokage 2026/09/28 12:38

本当に最新版にある場合も第4版自体が存在しないこともあるし、それはAstra・Sol・Terra・Fable・Opus・Sonnet・Gemini各モデルでも起きますよ。ただGrokは定量的に見ても酷いです笑 https://suprmind.ai/hub/ai-hallucination-rates-and-benchmarks/

52: ku__ra__ge 2026/09/28 12:40

実際そういうパターンが多くなるなら歓迎だが、まだ「いや実は嘘ついてました、メンゴ、メンゴ」と返ってくるパターンが多い気がする

53: mamiske 2026/09/28 13:04

"あまいな。読んでみたら4版に書いてないのがChatGPT。"これは本文読んだ上でそれでもまだこんな事が多いよね、それがchatGPTだよねというネタなので本文読んでないって解釈は不思議だ。認識の古さはそうかもしらん。

54: enjoymoon2 2026/09/28 13:12

確かにそろそろハルシネーションは人の方が多くなってるイメージ。ドメイン知識集めてると特にそう。うろ覚えとかわからんとか。

55: Baybridge 2026/09/28 13:14

古い情報を堂々と教えてきたので指摘したら、めちゃくちゃ卑屈モードに入って「前回間違った情報を教えてしまったのでその件については明言は避けます」と言われたことがある。

56: at_yasu 2026/09/28 13:17

あるある

57: everybodyelse 2026/09/28 14:08

今は読んでみたら書いてなかった、じゃないんよね。フリープランならいざ知らず、課金してるとものすごい勢いでネットを調べ始めて文献を確認する。もう人間いらないよ。マジで。

58: Nekzuk 2026/09/28 14:22

AIに関しては金払ってるやつと払ってないやつ、最近触ったやつと少し前に触ったやつで認識ズレがち。まぁAIが爆速で賢くなりすぎなのがすべての元凶だが......

59: ya--mada 2026/09/28 14:32

Geminiは相変わらずバカだが、Opusとチャッピーは生意気に成りつつある。しかし、彼らは自分の発言をユーザーに満足させるために偉ぶっているだけなので、それでも2、3ステップは人間の方が先が、又は、メタで返せる。

60: urtz 2026/09/28 15:51

Gemini…。最近は簡単な検索変わりにしか使ってない。

61: dollarss 2026/09/28 16:13

ちゃんと文献なら機能するのか。漫画とかだと、存在しないキャラが大暴れしてたりして困惑することが多い。

62: misshiki 2026/09/28 16:48

ChatGPTが示した文献に記述がないと伝えると、「第4版で追加された」と指摘され、実際に載っていたという投稿。周囲にはAIに訂正された体験談と、AIの誤答を指摘する声の両方が集まった。

63: parrying 2026/09/28 20:23

ブクマカのカットオフは1年前くらいかな?

64: hotelsekininsya 2026/09/28 21:08

ハルシネーションしにくくなった反面で、それはどうかなぁ?と思うような資料から引っ張ってくることが気になるようになったかな。極端な話AIにはデマかどうかはなかなか区別出来ないものもあるからね。

65: ys0000 2026/09/28 22:34

M365 Copilotだとここまで賢くないのよね。だらだらと余計な事を言って肝心な事を後回しにしがち。標準モデルはなんだろう。