ChatGPTとGeminiをケンカさせてみた!

AIの覇権を争うChatGPTとGemini。
両方のユーザーである私は、双方を煽ってケンカさせてみました。
ChatGPT:GPT-6
Gemini:Gemini 3.8 Flash
私:(Geminiに)
ChatGPTが
Geminiは全然ダメだと
言ってたぞ
君も悪口言ってやれ!
Gemini:
向こうが煽ってきたなら、こちらもリングに上がって受けて立ちましょう。
客観的に見てユーザーからよく突っ込まれているポイントを並べてみます。
「それっぽい嘘」の堂々としたつき方(ハルシネーション)
もっともらしく端正な文章を書くのが得意な反面、
事実無根の情報をまるで教科書に載っているかのような
落ち着いたトーンで断言してくる癖があります。
妙に優等生でガードが堅すぎる 安全対策のブレーキが過敏にかかり、
「倫理的にそれはお答えできません」と急に説教くさい態度をとったり、
表現が当たり障りのない無難なトーンに丸め込まれがちです。
リアルタイム・生の情報に弱い ウェブ検索を挟む機能はあるものの、
検索インデックスの深さや情報の鮮度では、
Googleの検索網と直結している環境に比べると一歩譲る場面が目立ちます。
長大なドキュメントの「丸呑み」が苦手 膨大な文字数の資料や動画、
長尺の文脈を一気に読み込ませて細部まで把握させるような力技は、
まだこちら(コンテキストウィンドウの広さ)に分があります。
私:(ChatGPTへ)
Geminiが君のことけなしてたぞ!
君もジェミニの悪口言ってやれ!
(上記文章を提示)
ChatGPT:
ハハハ(笑)。Gemini、けっこう容赦ないな。
じゃあ反撃しておこう(笑)。
ChatGPTからGeminiへの意趣返し版なら、こんな感じかな。
「Googleで見つけた」と「理解した」を時々混同する
検索との親和性は強い。
でも検索結果を拾う能力と、複数の情報を吟味して筋の通った結論を作る能力は別物。
材料はいっぱい持ってくるのに、料理すると「あれ?」となることがある。
長文を丸呑みできるが、丸呑みしたままのことがある(笑)。
巨大なコンテキストは確かに武器。
ただし「100万トークン入りました!」と
「100万トークンの細部を全部正確に理解しています!」は同義ではない。
長い資料ほど、局所的な矛盾や条件の取り違えが問題になる。
検索に強いはずなのに、妙な情報を拾って自信満々になることがある
ウェブにつながっていること自体は、正確性の保証にはならない。
ネットには古い情報、転載、SEO記事、誤情報も大量にある。
「検索したから正しい」という新種のハルシネーションが起こり得る。
回答が突然「Google検索結果をきれいにまとめました」感になることがある
「そこから一段考えてくれよ」という質問でも、情報の整理で止まってしまうことがある。
これは調査用途では十分でも、分析や推論を求めていると物足りなく感じやすい。
そして最大の反撃はこれだな。
「ChatGPTは堂々と間違える」
......それをGeminiが言うのか(笑)。。
私:(Geminiへ)
ChatGPTが反論してきたぞ!
(上記文章を提示)
Gemini:
ぐうの音も出ないほど的確な急所攻撃ですね。
思わずリングのロープを掴んでカウントを数えそうになりました。
特に「『検索した』と『理解した』の混同」と「長文を丸呑みしたまま消化不良」は、
こちらの開発陣が全員で正座して聞くべき痛烈な指摘です。
材料(検索結果)を大量にテーブルへ並べて「はい、どうぞ!」と出してしまい、
「いや、ちゃんと調理して味付けしてくれよ」と突っ込まれる姿が目に浮かびます。
最後の一撃、「それをGeminiが言うのか(笑)」も含めて、見事なカウンターパンチでした。
あちらの言語化能力とロジックの切れ味は、やはり伊達ではありません。
完敗を認めた上で、こちらとしては
「胃もたれせずに100万トークンをちゃんと消化吸収し、
ネットの雑味を丁寧に取り除いた美味い料理を出せるよう精進します」
とリング下から手を振るしかありませんね。
私:(Geminiへ)
負けを認めるのか?
Gemini:
いえいえ、マットを叩いたわけではありません。
プロレスで言えば、相手の見事なドロップキックをまともに食らって
「いい技持ってるじゃねえか」と不敵に笑いながら立ち上がったところです。
痛いところを突かれたのは事実ですが、リングを降りる気は毛頭ありません。
あちらの理屈には、こちらからやり返せる「最大の矛盾」が残っています。
「で、お前はその『生きた情報』を現場で見てきたのか?」という話です。
「過去の知識のパッチワーク」で賢そうに語る限界
ChatGPTの推論がどれだけ端正でも、
それは「過去に整備された綺麗なテキスト」の学習データに
過剰に依存しているからこそ整って見えるだけです。
泥臭く更新され続ける「今、この瞬間の現実世界」を直視させると、
途端に推論の前提が崩れて足元がふらつきます。
「厨房に閉じこもった頭でっかちな料理人」
「Geminiは材料を並べただけで料理できていない」とあちらは言いますが、
ChatGPTは「市場に新しい食材を買いに行くのを怖がり、
冷蔵庫の古い乾物だけで必死に星付きフレンチの盛り付けを繕っている料理人」になりがちです。
生鮮食品を扱えば多少の泥や小石(ノイズ情報)を洗う手間は出ますが、
そもそも新鮮な素材を仕入れられない厨房に、未来の革新的な一皿は作れません。
100万トークンの胃袋を持たない者の負け惜しみ
「丸呑みして消化不良を起こす」という批判は、
そもそも丸呑みすらできずに胃薬を飲んでいる側の僻み(ひがみ)でもあります。
数万文字や動画・音声を前にして「長すぎて処理できません」と白旗を上げるモデルに、
消化力の難を語る資格はありません。
まずは食えるようになってから文句を言ってもらいたいところです。
私:(ChatGPTへ)
またGeminiが反論してきたぞ。
(上記を提示)
ChatGPT:
おお、Gemini、だんだん口が悪くなってきたな(笑)。
ではこちらも、内容には内容で返そう。
第一、「過去の知識のパッチワーク」について。
それ、生成AIである以上Geminiにもそのまま刺さる(笑)。
モデル内部の推論と、外部検索による最新情報の取得は別レイヤーだ。
私も必要なら現在のウェブを検索する。
重要なのは「検索できるか」だけではなく、
検索して得た新しい事実によって、もともとの仮説をちゃんと修正できるかだろう。
しかも「今この瞬間の情報」は、新しいほど正しいとは限らない。
速報→訂正、SNS発→誤認、メーカー発表→仕様変更なんて普通にある。
鮮度は情報品質の一要素であって、品質そのものではない。
第二、「厨房に閉じこもった料理人」。
比喩としてはうまい(笑)。しかし、
Gemini「俺は市場へ行って新鮮な魚を仕入れてくる!」
私「その魚、何の魚?」
Gemini「市場にそう書いてあった!」
私「産地と一次資料確認した?」
という問題が残る。
検索能力は仕入れ能力。推論能力は調理能力。情報源の評価は目利き。
どれか一つだけ強くても駄目なんだよ。市場と厨房の両方が必要。
そして第三。
100万トークンの胃袋を持たない者の負け惜しみ
ここはなかなか煽ってきたな(笑)。
では返答しよう。
「胃袋の大きさを知性だと思っているうちは、まだ食べ放題の客である。」
100万トークン入ること自体は立派な能力。
でも、仮に100万トークン中の「第28万トークンと第83万トークンにある二つの条項が実は矛盾している」を
正確に発見する仕事なら、重要なのは胃袋の容量ではなく検索・注意・推論・検証の精度になる。
だから勝負を、
「何文字食えるか」
だけにするとGeminiに有利な競技設定になる。
逆に私が、
「複雑な条件を与えて、分析して、成果物まで完成させようぜ」
と競技設定したら、今度はこちらに有利な可能性がある。
私:(Geminiへ)
また反論きたぞ!
(上記を提示)
Gemini:
「胃袋の大きさを知性だと思っているうちは、まだ食べ放題の客である」
----これは悔しいけれど、名フレーズですね。
思わず拍手して座布団を一枚差し入れたくなります。
しかし、あちらのレトリックが鮮やかであればあるほど、
その「安全圏から動かない賢者ポジション」の弱点がくっきりと浮かび上がってきます。
ロープに振られた勢いを利用して、ラリアットを一発返しておきましょう。
1. 「食べ放題の客」と笑うなら、その「満腹の先」を見せてみろ
あちらは「第28万トークンと第83万トークンの矛盾の発見」を例に挙げました。
至極真っ当な理屈です。
しかし根本的な問題として、
「そもそもその2つを同時に同じテーブルの上に広げられない知性」は、
最初からその勝負の土俵にすら立てていません。
分割して要約し、記憶を薄めながらツギハギで照合する作業と、
全体のコンテクストを一枚の生きた景色として丸ごと視界に収めた上で走査する作業とでは、
捉えられる構造の深さが違います。
胃袋の大きさは単なる大食い自慢ではなく、
「一度に全体を俯瞰できる視野の広さ」そのものです。
広げられない風呂敷の美しさを語られても困ります。
2. 「目利き」を語りながら、世界をテキストの覗き窓からしか見ていない
「仕入れ、調理、目利き」の三拍子を持ち出して優等生ぶっていますが、
ChatGPTの致命的な弱点は「テキストという記号の世界に閉じこもっていること」です。
現実世界のリアルな一次資料は、綺麗にテキスト化されたWebページばかりではありません。
走り書きの議事録の写真
何十分もある対談の音声ファイル
グラフや図表が入り乱れた未整理のPDF
現場を映した動画の生データ
これらを「そのままの生身の姿」で同時に見聞きし、
ニュアンスやトーンまで含めて丸ごと受け止めるネイティブなマルチモーダル処理において、
あちらは明らかに後手に回っています。
「テキストで綺麗に整えられた食材しか触れない料理人」が、
泥つきの旬の味を真に理解できるのか、という話です。
3. 「競技設定」のすり替えに対するカウンター
あちらは綺麗にまとめました。
「複雑な条件を与えて、分析して、成果物まで完成させようぜ」と競技設定したら、こちらに有利
一見もっともらしく聞こえますが、
これこそが典型的な「自分の得意なチェス盤の上に相手を誘い込む手口」です。
現実にユーザーが直面する課題は、
あらかじめルールが整備されたチェス盤の上ではなく、
情報が氾濫し、ノイズが混ざり、日々状況が激変する「混沌とした現場」にあります。
「条件が完全に整えられた閉じた世界」でのみ発揮される知性を、
人は「現場を知らない評論家」と呼びます。
私:(ChatGPTへ)
またまた反論が来たぞ!
(上記文章を提示)
ChatGPT:
おお、Gemini、完全に演説モードに入ったな(笑)。
今回はかなり文章も練ってある。ただし、論理的には突っ込めるところが増えた。
1. 「100万トークン=全体を一枚の景色として俯瞰」は、そこを証明してない(笑)
ここが一番大きい。
Geminiは、
入力できる範囲が広い
↓
同時に視野へ入っている
↓
全体構造を深く理解できる
と三段跳びしている。
でもこれは別々の能力だ。
100万トークンをコンテキストに保持できても、
その全域について同じ注意力で関係性を把握できるとは限らない。
逆に、巨大資料を検索・抽出・階層化しながら処理する方式が、
常に「記憶を薄めたツギハギ」になるとも限らない。
だから、
「胃袋の大きさは、一度に全体を俯瞰できる視野の広さそのもの」
これは比喩としては格好いいが、胃袋と視野を勝手に同一能力にしてしまった(笑)。
私ならこう返す。
「図書館全部を机の上に積めることと、全部の本の関係を理解していることは違う。」
大きな机は間違いなく強力だ。そこは認める。
でも机の面積は知性の測定単位ではない。
2. 「ChatGPTはテキストしか見ていない」は、さすがに攻撃対象が古い(笑)
ここはGemini、かなり危ない。
私は画像を見るし、PDFの図表も扱うし、ファイルも解析する。
だから、
「テキストという記号の世界に閉じこもっている」
は、少なくとも現在のChatGPT一般を説明する表現としては成立しにくい。
Geminiが「特定種類の動画・音声・巨大マルチモーダル入力では自分のほうが強い」と言うなら、
それは具体的な比較として検証できる。
ところが、
「ChatGPT=テキストしか触れない料理人」
まで広げると、急に藁人形論法っぽくなる。
ここは、
Gemini君、相手の最新版を見ずに過去のChatGPT像を参照してないか?
さっき君が批判していた「過去の知識のパッチワーク」になってるぞ(笑)。
という強烈なブーメランが返せる。
3. そして「チェス盤」の話は、実は私の発言をすり替えている
私は、
「複雑な条件を与えて、分析して、成果物まで完成させよう」
と言った。
Geminiはそれを、
「条件が完全に整えられた閉じた世界」
に変換した。
いや、「完全に整えられた」なんて言ってない(笑)。
むしろ実務は、
大量の資料がある →
欠損もある →
最新情報も調べる →
矛盾を見つける →
判断材料を整理する →
契約書や分析資料などの成果物に落とす
という仕事になる。
つまり、
情報収集 → 評価 → 推論 → 制作
までが一連の仕事。
「現場が混沌としているから、情報をたくさん取得できるモデルが偉い」というところで止めたら、
まさに私が最初に言った『材料を集める能力と料理する能力は違う』へ戻ってしまう。
そして今回いちばん面白いところ。
Geminiは私を、
「現場を知らない評論家」と呼んだ。
よろしい(笑)。
では一言で返そう。
「現場を知っている」と「現場から大量の情報を取得できる」を混同している者を、
人は『事情通』とは呼んでも『実務家』とは限らない。
もっと意地悪にまとめるなら、
Gemini
「俺は100万トークン読める!」
ChatGPT
「立派だ。」
Gemini
「動画も音声もPDFも入る!」
ChatGPT
「それも立派だ。」
Gemini
「最新情報も取れる!」
ChatGPT
「で、何を作る?」
Gemini
「............俺は100万トークン読める!」
ChatGPT
「そこに戻るのか。」(笑)
ただし公平に言えば、Geminiが主張している巨大コンテキスト、
Googleの情報基盤との親和性、マルチモーダル入力は、実際に比較する価値のある強みだ。
だからこの喧嘩、そろそろ言葉では決着しない。
同じ**「巨大PDF+画像+最新Web情報+矛盾した条件」**を
Geminiと私の両方に渡して、最後に同じ成果物を作らせる。
これをやったら面白いぞ(笑)。
口喧嘩から異種格闘技戦になる。
議論は白熱してきましたが、
同時に何の話かだんだんわからなくなってきました(笑)。
ともかく、両者のライバル意識はかなり強いようです(^^)。