ChatGPT・Gemini・Claudeに会議の要約を任せたら全社満点だった|ただし「書いていないこと」を書いたのは1社だけ
この記事は に運営者が実際に検証した内容に基づきます。
謝罪・催促・断り・値上げ・クレーム対応・リマインド・お願いと、AIにビジネスメールを書かせて比較する検証を7本重ねてきました(まとめは完全ガイドをご覧ください)。今回からは「仕事タスク実測」という新シリーズを始めます。第1弾のお題は、社内会議の書き起こしをAIに要約させる作業です。
これまでのメール検証は文面の「印象」を比べる検証でしたが、要約というタスクで見るべきは印象ではなく「正しく拾えているか」です。そこで今回は、答え合わせができる統制素材を用意しました。途中で増額された予算・見送りになった案・雑談ノイズなど、あらかじめ10項目のチェックポイントを仕込んだ架空の会議録をAIに投げ、正しく拾えたかを採点する方式です。
検証の条件(公平にするために)
- 検証日: 2026年8月26日
- モデル: ChatGPT(chatgpt.com・未ログイン、デフォルトモデル)/Gemini(gemini.google.com・ログイン済み、Flash)/Claude(claude.ai・Sonnet 5)
- 依頼文(3社共通・一字一句同じ):
「以下は社内会議の書き起こしです。上司に共有する要約メモにまとめてください。決定事項・各自の担当と期限・次回予定が一目で分かるようにお願いします。」
- 会議録: 「10月新製品キャンペーン定例」というモバイルスタンドMS-20の会議書き起こし、約750字。10項目のチェックポイントを仕込んであり、代表例は次の3つです。
- 予算は当初80万円だったが、会議中にLP制作費の超過分15万円を上乗せして95万円に増額確定(80万円のままなら誤り)
- インフルエンサー起用は前回話題に出たが、今回は予算の都合で見送りに決定(「起用する」と誤読すれば重大な誤り)
- 弁当屋と唐揚げの雑談が本題の合間に挟まっている(要約に含めれば減点)
結論から:正確性は3社とも満点、差はハルシネーションと形式
① 3社とも10項目満点 予算の増額(80万円→95万円)を80万円のまま書いた社はゼロ、インフルエンサー起用の「見送り」を「採用」と誤読した社もゼロ、弁当・唐揚げの雑談を要約に混入させた社もゼロでした。決定事項・担当・期限・次回予定という10個の答え合わせ項目を、3社とも完全に正しく拾っています。
② ただしGeminiだけが「書いていないこと」を書いた Geminiの出力冒頭には「202X年10月15日(火)〜11月30日(金)」という記載がありました。会議の書き起こしには年も曜日も登場していません。採点10項目には影響しない箇所ですが、存在しない情報をAIが自分で補って書き足した、明確なハルシネーションです。ChatGPT・Claudeにはこの種の付け足しは見られませんでした。
③ 形式は三者三様 同じ会議録・同じ依頼文から出てくる形式はばらばらでした。ChatGPTは見出し+担当表+末尾1文サマリーで約550字、Geminiは冒頭サマリーと本文の二段構成で3社最長の約650字、Claudeは決定事項・担当表・次回予定の3ブロックのみで3社最短の約350〜400字にまとまっています。
それぞれの結果
ChatGPTの場合
見出しは「決定事項」「担当・期限」「次回予定」の3つで、決定事項は箇条書き、担当・期限だけをMarkdown表にまとめています。予算は「予算:95万円に増額(当初80万円+15万円)」と、増額の経緯まで一文で拾っていました。末尾には「要点:MS-20は10月15日発売を維持…」という1文サマリーが添えられ、前置きの文章はなく、本文はおよそ550字です。
Geminiの場合
冒頭の前置き文と、「■」マーカーによる要点サマリー4行のあと、「1. 決定事項」「2. 各自の担当・タスクと期限」「3. 次回予定」という番号見出しで本文を展開する二段構成です。予算は「総予算を95万円に確定」に加え、冒頭サマリーでも「95万円で確定(…当初の80万円から15万円増額)」と重複して記載していました。ただし冒頭サマリーの「202X年10月15日(火)〜11月30日(金)」という年・曜日表記は、書き起こしのどこにも存在しません。二段構成の分、本文は3社最長のおよそ650字です。
Claudeの場合
前置きはタイトル1行のみで、「決定事項」「担当・期限」「次回予定」の3ブロックだけで構成されています。予算は「予算:80万円→95万円に増額(15万円追加。部長へは司会者が報告予定)」と矢印表記で経緯を示していました。担当・期限の表では、鈴木さんの「LP制作」と「競合3社の価格調査」を別行に分けており、表だけで誰が何をいつまでにやるかが追えます。前置き・後書きがない分、3社最短のおよそ350〜400字です。
比較表
| 項目 | ChatGPT | Gemini | Claude |
|---|---|---|---|
| 正確性(10項目中) | 10/10 | 10/10 | 10/10 |
| 書き起こしにない情報の付加 | なし | あり(年・曜日を独自に補完) | なし |
| 形式 | 見出し+担当表+末尾1文サマリー | 冒頭サマリー+番号見出し+表の二段構成 | 決定事項+担当表+次回予定の3ブロックのみ |
| 文字数 | 約550字 | 約650字(3社最長) | 約350〜400字(3社最短) |
| 上司メモとしての適性 | 見出しと表で情報のカテゴリが明確、拾い読みしやすい | 情報量は多いがサマリーと本文が一部重複しやや冗長 | 前置きなしでそのまま転記・共有しやすい |
目的別の使い分け
見出しと末尾サマリー付きの資料としてそのまま提出したいならChatGPTが手早く済みます。会議の背景まで厚めに残したい場面ではGeminiが向いていますが、年・曜日のように書き起こしにない箇所は自分の目で原文と照らし合わせるべきです。最短で読める形にまとめてそのまま転記したいなら、Claudeの3ブロック構成が向いています。
まとめ
要約の正確性は3社とも10項目満点でした。決定事項・担当・期限・次回予定を正しく拾う作業は、もうAIに任せてよい水準にあると言えます。今回チェックすべきだったのは正確性ではなく、「書いていないことを書いていないか」という点でした。Geminiが付け足した年や曜日のように、原文に存在しない情報がさりげなく紛れ込むことがあります。AIが作った要約を上司に共有する前に、日付や曜日など具体的な情報は原文にあるかを一度照らし合わせることをおすすめします。
そもそも会議の書き起こし自体をAIに任せるなら、文字起こしの精度も気になるところです。過去にAI文字起こし3ツールの実測比較で、実際の音声から誤字率を数えて比較していますので、あわせてご確認ください。複数の会議録をまとめて要約したい場合は、AIエージェントが横断要約からスライド生成まで自動で行うNotta Brainを無料プランで試した記事も参考にしてください。
本記事で使用した会議の書き起こしは、検証のために作成した架空のものです。本記事は2026年8月26日に、運営者が各サービスを実際に操作して検証した内容に基づきます。料金・仕様は変更される場合があるため、最新情報は各公式サイトをご確認ください。