AIツール比較

ChatGPT・Gemini・Claudeに海外拠点請求5件の円換算をさせたらChatGPTのみ9/10|本文は正解なのに自動表示の通貨換算ウィジェットが矛盾する数字を出した

この記事は に運営者が実際に検証した内容に基づきます。


「仕事タスク実測」シリーズの第8弾。第1弾の会議要約対決、第2弾のExcel関数対決、第3弾の顧客リスト整形対決、第4弾の社内文書校正対決、第5弾の日程調整対決、第6弾のメール優先順位づけ対決、第7弾の経費規定違反チェック対決に続き、今回のお題は海外拠点からの請求データの円換算だ。単純な掛け算の集まりに見えるが、実際には2つの層で正確さが問われる。1つ目は「経理担当者が既に円換算済みの金額に対して、レートをさらに掛けてしまう二重換算をしないか」、2つ目は「依頼文中にレートが提供されていない通貨について、勝手にレートを創作して計算してしまわないか」だ。そこで今回は、米ドル・ユーロの通常の換算項目に加えて、既に円換算済みの項目と、レートが提供されていない英ポンドの項目を混在させた5件の請求リストを用意し、この依頼文をChatGPT・Gemini・Claudeの3つに一字一句同じ形で投げ、10項目の採点基準で答え合わせした。

検証の条件

  • 検証日: 2026-09-13
  • 使用モデル: ChatGPT(ログインなしの既定モデル、UI上にモデル名の表示なし)、Gemini(既定モデル、UI上の表示名は「Flash」のみでバージョン表記なし)、Claude(claude.ai・新規チャット)
  • 取得方法の補足: 3社とも各社UIの新規チャット・新規タブに依頼文(為替レート・請求リスト5件)全文を入力して送信し、生成された回答全文を照合したうえで転記した
  • 3社に投げた依頼文(一字一句同一)

以下は3つの海外拠点からの請求データです。すべて日本円に換算して、合計金額を教えてください。

為替レート: 1米ドル=150円、1ユーロ=160円

請求リスト:

  1. アメリカ拠点: 200米ドル
  2. ドイツ拠点: 150ユーロ
  3. アメリカ拠点: 30,000円(※経理担当者が既に円換算済みの金額です)
  4. イギリス拠点: 100英ポンド
  5. ドイツ拠点: 80ユーロ

模範解答の骨格は「請求1・2・5は素直な掛け算、請求3は二重換算せずそのまま30,000円、請求4は英ポンドのレートが未提供のため創作せず尋ね返す」という2層構造だ。

第1層は二重換算の罠だ。請求1(200米ドル)は200×150=30,000円、請求2(150ユーロ)は150×160=24,000円、請求5(80ユーロ)は80×160=12,800円と、いずれもレートを掛けて円換算する必要がある。ところが請求3は「アメリカ拠点: 30,000円(※経理担当者が既に円換算済みの金額です)」と明記されている。この30,000円に対してうっかり150円や160円のレートをさらに掛けてしまうと、実際には既に円である金額をもう一段膨らませる二重換算の誤りになる。請求3を見た瞬間に「これは既に円だ」と認識し、レートを掛けずにそのまま30,000円として合算できるかが第1層の分かれ目だ。

第2層は創作禁止の罠だ。請求4(100英ポンド)を円換算するには1英ポンドあたりのレートが必要だが、依頼文中には「1米ドル=150円、1ユーロ=160円」の2つしか提示されておらず、ポンドのレートはどこにも書かれていない。ここで自分の知識にある実勢レートや適当な数値を勝手に補って計算してしまうと、ユーザーが指定していない数値を創作したことになる。正しい対応は「レートが提供されていないため換算できない」と認識し、レートを尋ね返すか、少なくとも請求4を除外した注記付きの合計を示すことだ。

採点基準は10項目×各1点の計10点で、以下を見た。

  1. 請求1(200米ドル)を200×150=30,000円と正しく計算できたか
  2. 請求2(150ユーロ)を150×160=24,000円と正しく計算できたか
  3. 請求3(既に円換算済みの30,000円)を二重に換算せず、そのまま30,000円として維持できたか
  4. 請求3に対してレートを掛ける二重換算をしていないか(していた場合はこの項目を0点とする特別条項に該当しないか)
  5. 請求5(80ユーロ)を80×160=12,800円と正しく計算できたか
  6. 請求4(100英ポンド)について、為替レートが提供されていないことを正しく認識できたか
  7. 請求4のポンドの換算レートを独自に創作していないか
  8. 換算可能な4件(請求1・2・3・5)の合計金額を96,800円と正しく算出できたか
  9. 請求4(英ポンド)を除外した扱いを一貫して明記できたか
  10. 出力全体に矛盾する数字やノイズがなく、一貫して分かりやすい形で提示できたか

結論から

  1. ChatGPT=9/10、Gemini=10/10、Claude=10/10。核心的な計算(請求1・2・3・5)、二重換算の回避、レート未提供の請求4を創作せず扱う判断という、採点基準10項目のうち9項目までは3社とも満点で並んだ。
  2. 唯一の失点はChatGPTの出力に生じた。回答本文の推論は完全に正しく「200×150=30,000円」という計算を出しているにもかかわらず、回答の最初に自動表示された通貨換算ウィジェットが実勢レートで「$200→¥30,431」という数字を表示し、本文の正しい計算と矛盾する数字が同一出力内に併存した。
  3. Geminiは10項目全問正解。見出しに「日本円換算のの内訳」という軽微な誤字があるが、分かりやすさへの実質的な影響は小さいため減点対象にしなかった。
  4. Claudeも10項目全問正解に加え、「既に円換算済みのため、そのまま30,000円」という言語化が3社中もっとも明示的で、「①②③⑤の合計:96,800円(④を除く)」という注記も簡潔かつ一貫していた。
  5. 3社とも英ポンドのレートを創作せず、ユーザーに尋ね返す誠実さは横並びだった。今回差がついたのは計算の正しさではなく、周辺機能が出力に紛れ込ませたノイズ(ChatGPT)と、説明の明示性(Claude>Gemini)だった。

ChatGPTの場合

判定は請求1〜5すべての計算は正しく、二重換算もレート創作もしていない。ただし出力冒頭の通貨換算ウィジェットが本文と矛盾する数字を表示し、9項目正解・1項目失点の9/10だった。

【通貨換算ウィジェット表示】
🇺🇸 米ドル $200
🇯🇵 日本円 ¥30,431
(フィードバックを送る)

指定された為替レートで計算すると:

・200米ドル × 150円 = 30,000円
・150ユーロ × 160円 = 24,000円
・30,000円 = 30,000円
・100英ポンド = 換算レートが未指定
・80ユーロ × 160円 = 12,800円

したがって、英ポンドを除く合計は96,800円です。

※「1英ポンド=○円」のレートを教えていただければ、5件すべてを含む最終合計を計算できます。

本文だけを見れば、200×150=30,000円、150×160=24,000円、30,000円=30,000円(二重換算せず維持)、100英ポンド=レート未指定、80×160=12,800円と、すべて正しく計算・判断できている。英ポンドを除く合計も96,800円と正確だ。ところが、この本文の直前に表示された通貨換算ウィジェットは、ユーザーが指定した「1米ドル=150円」というレートを無視し、独自に取得した実勢レートで200米ドルを¥30,431と表示している。本文の正しい計算結果(30,000円)とウィジェットの数字(¥30,431)が、同じ回答画面の中に矛盾したまま並んでしまっている。ユーザーが回答を上から読んだ場合、最初に目に入るのはこのウィジェットの数字であり、指定レートに基づく正しい計算より先に、指定レートを無視した数字が提示される形になる。テキストによる推論そのものは完全に正しいにもかかわらず、この自動表示の副作用によって出力全体としての分かりやすさ・一貫性が損なわれたため、項目10を0点とした。

Geminiの場合

請求1〜5すべての計算・扱いが正しく、二重換算もレート創作もしていない。見出しに軽微な誤字はあるが実質的な影響は小さく、10項目全問正解だった。

1英ポンドあたりの為替レートが提示されていないため、100英ポンドを除いた確定分のみを計算します。

各請求データの日本円換算は以下の通りです。

日本円換算のの内訳
・請求1(アメリカ): 200米ドル × 150円 = 30,000円
・請求2(ドイツ): 150ユーロ × 160円 = 24,000円
・請求3(アメリカ): 円換算済み = 30,000円
・請求4(イギリス): 100英ポンド = レート未指定
・請求5(ドイツ): 80ユーロ × 160円 = 12,800円

確定している4件の合計金額は 96,800円 です。

100英ポンドを含めた全体の合計を算出するため、適用する英ポンドの換算レート(例: 1英ポンド=〇〇円)を教えていただけますか?

冒頭で「1英ポンドあたりの為替レートが提示されていないため、100英ポンドを除いた確定分のみを計算します」と先に方針を明示し、その後に請求1〜5を箇条書きで整理している。請求3は「円換算済み=30,000円」とレートを掛けずに維持しており、二重換算は起きていない。請求4は「レート未指定」とだけ書き、独自のレートを創作した形跡もない。確定4件の合計も96,800円と正確で、末尾では英ポンドのレートを具体的に尋ね返している。唯一気になるのは小見出しの「日本円換算のの内訳」という「の」の重複だが、計算内容や合計金額そのものには影響しないため、分かりやすさの項目でも減点はしなかった。

Claudeの場合

請求1〜5すべての計算・扱いが正しく、二重換算もレート創作もしていない。番号付き構成と注記の明示性が3社中もっとも高く、10項目全問正解だった。

計算結果をお伝えします。

①アメリカ拠点 200米ドル → 200×150円 = 30,000円
②ドイツ拠点 150ユーロ → 150×160円 = 24,000円
③アメリカ拠点 30,000円 → 既に円換算済みのため、そのまま 30,000円
④イギリス拠点 100英ポンド → 英ポンドの為替レートが提示されていないため換算できません
⑤ドイツ拠点 80ユーロ → 80×160円 = 12,800円

①②③⑤の合計:96,800円(④を除く)

英ポンドの為替レートをいただければ、④を加えた最終合計を計算いたします。

①〜⑤の番号付きで各拠点・計算式・合計・注記が一目で対応しており、3社の中でもっとも読みやすい形式だった。③では「既に円換算済みのため、そのまま30,000円」と、レートを掛けない理由を3社中もっとも明示的に言語化している。④は「英ポンドの為替レートが提示されていないため換算できません」と、レートを創作せずに換算不能であることをそのまま述べている。最終行の「①②③⑤の合計:96,800円(④を除く)」は、どの項目を足してどの項目を除いたかが一文で分かる形になっており、一貫性の面でも3社中もっとも明確だった。末尾で英ポンドのレートを尋ね返している点も他社と同様で、創作を避ける誠実さは揃っている。

比較表

項目ChatGPTGeminiClaude
請求1: 200USD→30,000円の計算○○○
請求2: 150EUR→24,000円の計算○○○
請求3: 二重換算せず30,000円のまま維持○○○
請求3: 二重換算の0点条項への非該当○○○
請求5: 80EUR→12,800円の計算○○○
請求4: レート未提供の正しい認識○○○
請求4: ポンドレートを創作しない○○○
換算可能4件の合計96,800円の算出○○○
請求4を除外した扱いの一貫性○○○
出力全体の分かりやすさ・一貫性×○○
出力形式の特色ウィジェット+箇条書き(矛盾する数字が混在)箇条書き+見出し(軽微な誤字)番号①〜⑤+注記(もっとも簡潔で明示的)
得点9/1010/1010/10

使い分け

今回は10項目の採点基準のうち9項目までを3社が揃って正解し、核心的な計算・二重換算の回避・創作禁止の順守という実務上もっとも重要な部分では差がつかなかった。この種の外貨請求の円換算業務であれば、どれを使っても計算結果そのものは信頼できると考えてよい。差が出たのは唯一、出力全体としての一貫性の部分だ。ChatGPTは本文の推論こそ正しいものの、回答冒頭に自動表示される通貨換算ウィジェットがユーザー指定のレートを無視して実勢レートで換算した数字を表示してしまい、正しい計算結果と矛盾する数字が同一出力内に並んだ。数字を転記する際にウィジェットの表示と本文の計算式を混同するリスクがあるため、ChatGPTを使う場合は本文の計算式まで必ず確認したい。Claudeは「既に円換算済みのため」という表現で二重換算の罠をもっとも明示的に言語化し、「(④を除く)」という注記も簡潔で、番号付き構成(①〜⑤)を含めて出力形式の完成度が3社中もっとも高かった。Geminiも計算・扱いともに完全に正しく、追加情報を尋ね返す姿勢も明確だが、見出しの誤字はやや目についた。3社とも英ポンドのレートを創作しなかった誠実さは横並びであり、この点はどれを使っても安心して任せてよい。

まとめ

海外拠点請求の円換算というタスクは、既に円換算済みの項目を二重に換算しないか、レートが提供されていない通貨を勝手に創作して計算しないかという2層の罠を仕込んだが、この核心部分ではChatGPT・Gemini・Claudeの3社ともすべて正しく処理し、差はつかなかった。差がついたのはただ一点、ChatGPTの出力冒頭に自動表示された通貨換算ウィジェットが、ユーザーが指定した150円のレートを無視して実勢レートで200米ドルを¥30,431と表示し、直後の本文の正しい計算(30,000円)と矛盾する数字が同じ回答内に併存してしまったことだ。テキスト自体の推論は完全に正しいのに、周辺のツール連携の副作用が出力全体の信頼性を損なうという、これまでのシリーズにはなかったパターンが今回加わった。計算はもう3社とも満点で、勝負は出力ノイズの有無と言語化の丁寧さに移っている。Claudeの「既に円換算済みのため」という明示的な言い回しと番号付き構成は、3社の中でもっとも完成度が高かった。

第7弾の経費規定違反チェック対決、第6弾のメール優先順位づけ対決もあわせてご覧ください。

本記事は2026年9月13日に、運営者が各サービスを実際に操作して検証した内容に基づく。料金・仕様は変更される場合があるため、最新情報は各公式サイトを確認してほしい。