GeminiとClaudeにレシート・棒グラフ・表の3枚の画像を送って読み取りの速さと正確さを比べました。Claudeは3課題とも17.3秒以内で最速でしたが棒グラフの5本を6つと数えました。Geminiは25.7〜31.8秒かかりましたが3課題すべて正解でした。
- GeminiとClaudeにレシート・棒グラフ・表の画像を送ると両方とも日本語で答えが返ってくる
- 速さはClaudeが13.9〜17.3秒でGeminiの25.7〜31.8秒より速い
- レシートの合計金額¥1,758と日付はGeminiもClaudeも正解した
- 棒グラフ5本の値はGeminiが全部正解だがClaudeは5つではなく6つの値を返した
- 20セルの売上表はGeminiもClaudeも全セル一致でMarkdownに書き起こせた
- ChatGPTとMicrosoft Copilotは今回の編集部の操作の都合で試せなかった
画像を送って聞く方法はGeminiもClaudeも添付して1行書くだけだった
GeminiやClaudeに画像を送って質問する手順はどちらも同じです。新しいチャットを開いてクリップのアイコンから画像ファイルを添付し、聞きたいことを日本語で書いて送信します。今回の検証では次の3つの質問を使いました。
- レシートの画像を添付して合計金額と日付を聞く(易)
- 棒グラフの画像を添付して5本の棒の値を読み取らせる(中)
- 表の写真を添付してMarkdownの表に書き起こさせる(難)
それぞれの課題で送った質問文はこちらです。読者のみなさんも同じ文を使って試せます。
このレシートの合計金額と日付を教えてください。
このグラフの5つの棒の値を、左から順に数字だけで書き出してください。
この画像の表を、そのまま Markdown の表に書き起こしてください。数字を1つも変えないでください。
画像の添付は特別な設定なしで使えます。ChatGPTにファイルを添付する方法と基本的な操作は同じで、GeminiもClaudeもチャット画面の入力欄にあるクリップのアイコンを押してファイルを選ぶだけです。今回はすべてPNG形式の画像を送りました。
Claudeは3課題とも17.3秒以内で答えたが棒グラフだけ値を1つ多く返した
2026年9月25日にGeminiとClaudeに同じ3枚の画像を送って速さと正確さを比べました。Geminiの画面には「Pro 拡張」、Claudeの画面には「Opus 5.5 中」というモデル名が表示されていました。
速さはClaudeが全課題で上回りました。いちばん速かったのは棒グラフの読み取りで13.9秒です。レシートは17.3秒、表の書き起こしは15.3秒でした。Geminiはレシートに26.3秒、棒グラフに31.8秒、表に25.7秒かかっています。

ただし正確さではGeminiが上です。Geminiは3課題すべて正解でしたが、Claudeは棒グラフの課題で5本の棒に対して6つの値を返しました。レシートの合計金額と日付、表の20セルの書き起こしはClaudeも全部正解しています。速さと正確さの両方で1位になったAIはありませんでした。
レシートの合計と日付はGeminiが26.3秒・Claudeが17.3秒で両方正解だった
最初の課題は架空のレシート画像の読み取りです。サンプルマート本店の買い物レシートの画像を送り、合計金額と日付を聞きました。レシートには6品目(牛乳¥268・食パン¥198・たまご¥328・バナナ¥158・ヨーグルト¥178・洗剤¥498)が印字されています。小計は¥1,628で消費税(8%)の¥130を足した合計が¥1,758です。正しい答えは合計¥1,758と2026年9月10日です。
Geminiの回答は26.3秒で正解
2026年9月25日にGeminiの新しいチャットでレシートのPNG画像を添付して質問したところ、26.3秒で答えが返ってきました。回答の文字数は80字です。Geminiは「合計金額: ¥1,758」「日付: 2026年9月10日」とだけ返しました。過不足のないすっきりした答えです。合計金額も日付も正しいので正解です。品目名や個々の金額には一切触れず質問された2点だけを返しています。
Claudeの回答は17.3秒で正解、さらに税率の矛盾まで指摘した
同じレシート画像をClaudeに送ったところ、17.3秒で答えが返りました。回答の文字数は195字でGeminiの80字より多くなっています。Claudeは合計金額¥1,758と日付2026年9月10日を正しく答えたうえで小計¥1,628や消費税(8%)¥130といった内訳まで読み取りました。

さらに「洗剤は通常10%課税の対象です。全品目に8%が適用されているため税率区分を確認してください」と指摘しています。聞いていないことまで分析して返すのはClaudeの特徴です。ただしこれは架空のレシートなので税率区分の指摘が正しいかどうかはこの検証では確かめていません。
棒グラフの5本の値はGeminiが全部正解したがClaudeは6つ返した
2つ目の課題は棒グラフの読み取りです。商品Aの月別売上を示す5本の棒グラフの画像を送り、左から順に値を数字だけで書き出すよう指示しました。グラフのタイトルは「商品A(タンブラー)の月別売上 1〜5月」です。5本中4本が同じ値の12,000で3月だけ13,200に上がる形をしています。棒の高さの差が小さいため読み間違えやすい図です。正しい答えは12000、12000、13200、12000、12000の5つです。
Geminiは31.8秒で5本とも正解した
Geminiは31.8秒で答えを返しました。回答は「12,000, 12,000, 13,200, 12,000, 12,000」で5つの値が左から正しい順番で並んでいます。文字数は45字と短く、聞かれたことだけに答えました。値の数も並び順もすべて正解です。Geminiは半角カンマと半角スペースで区切った1行の数値だけを返しています。グラフのタイトルや補足説明は付いていません。

Claudeは13.9秒で答えたが5つではなく6つの値を返した
Claudeは13.9秒で答えを返しました。Geminiの31.8秒と比べると速さでは大きく上回っています。ところが返ってきたのは5つではなく6つの数値でした。5本の棒グラフなのに値が1つ多く並んでいます。Claudeの回答では最初に12,000が1つ出たあと空行を挟んで残りの5つ(12,000・12,000・13,200・12,000・12,000)が続いています。最初の12,000が余分に出た形です。回答の文字数は57字でGeminiの45字より少し多い程度でした。棒の数だけ間違えて個々の数値は正しく読めているのがこの課題でのClaudeの特徴です。

正しい答えは[12000, 12000, 13200, 12000, 12000]の5つです。Claudeの回答にはこの5つの値はすべて含まれていますが先頭付近に12000が1つ余分に入っています。「5つの棒の値を」と明示したにもかかわらず6つ返しているため正解の基準(5つとも一致)を満たしませんでした。文字や数字の読み取りは正確でもグラフのような視覚的な情報を数値に変換する場面では数え間違いが起きることがあるという結果です。

表の写真をMarkdownに書き起こすとGeminiもClaudeも20セル全部一致した
3つ目の課題は表の写真の書き起こしです。2025年7〜10月の商品A〜商品Eの売上データ(千円)が入った表の画像を送り、Markdownの表にそのまま書き起こすよう指示しました。表のデータは4行×5列の合計20セルです。値は3桁から5桁のカンマ区切りの整数(千円単位)です。たとえば7月の商品Cは14,400ですが10月には4,800まで下がっています。セルごとの数字の幅が大きい表です。
Geminiは25.7秒で20セル全部を正しく書き起こした
Geminiは25.7秒で回答しました。文字数は234字です。ヘッダー(月・商品A〜商品E)と4行のデータをタブ区切りのMarkdown形式で返しました。「2025年 7〜10月の売上(千円)」というタイトルまで読み取っています。全20セルの値を正しい答えと突き合わせたところすべて一致しました。たとえば7月の商品Cは14,400で10月の商品Eは8,500というように桁の異なる数字もすべて正確に読み取っています。

Claudeは15.3秒で20セル全部を正しく書き起こした
Claudeは15.3秒で回答しました。文字数は244字でGeminiの234字と近い量です。Claudeは表のヘッダーをMarkdownのパイプ形式(| 月 | 商品A |のような書き方)で出力したあとタブ区切りのデータを続けています。データ部分の全20セルを正しい答えと突き合わせたところすべて一致しました。Claudeは末尾に「(単位:千円)」と補足も付けています。

レシートの読み取りでもそうでしたがClaudeは聞かれたことに加えて補足情報を返す傾向があります。正確さの面ではGeminiもClaudeも20セル全部が一致でこの課題は引き分けです。速さではClaudeが15.3秒、Geminiが25.7秒でClaudeのほうが速い結果になりました。
3課題を並べるとClaudeが全課題で速くGeminiが全課題で正確だった
3つの課題の速さと正確さを1つの表にまとめます。ChatGPTとMicrosoft Copilotは今回の編集部の操作の都合で結果を取得できなかったため×としています。
GeminiとClaudeの画像読み取り結果一覧
| 課題 | Gemini(秒) | Gemini正誤 | Claude(秒) | Claude正誤 |
|---|---|---|---|---|
| レシート(易) | 26.3秒 | ○ 正解 | 17.3秒 | ○ 正解 |
| 棒グラフ(中) | 31.8秒 | ○ 5値正解 | 13.9秒 | △ 6値返却 |
| 表→Markdown(難) | 25.7秒 | ○ 20セル一致 | 15.3秒 | ○ 20セル一致 |
速さだけを見るとClaudeが3課題すべてで上回りました。いちばん差が大きかったのは棒グラフの読み取りでClaudeが13.9秒に対してGeminiは31.8秒でした。レシートはClaudeが17.3秒、Geminiが26.3秒です。表の書き起こしはClaudeが15.3秒、Geminiが25.7秒でした。
正確さを見るとGeminiが3課題とも正解でした。Claudeはレシートと表は正解でしたが棒グラフだけ5本に対して6つの値を返しています。レシートの合計金額¥1,758と日付2026年9月10日はGeminiもClaudeも間違えていません。表の20セルもGeminiもClaudeも全部一致しています。差がついたのは棒グラフだけです。回答の文字数にも傾向が出ました。レシートの課題ではGeminiが80字でClaudeが195字でした。Claudeの回答にはGeminiが触れなかった品目の内訳や消費税の計算や税率の矛盾の指摘まで含まれています。この補足が文字数を増やしています。棒グラフではGeminiが45字でClaudeは57字です。5つの値を書き出すだけなのでどちらも短い回答でした。表の書き起こしではGeminiが234字でClaudeが244字とほぼ同じ量でした。表のように形式が決まっている出力では文字数の差が小さくなっています。
速さで選ぶならClaude、正確に数えるならGeminiを選ぶ
速さを重視する場面ではClaudeが向いています。レシートや請求書の内容をすぐに確認したいときや表の画像をすばやくテキストにしたいときはClaudeのほうが速く答えが返ってきます。今回の検証ではClaudeが13.9〜17.3秒でGeminiが25.7〜31.8秒でした。
グラフや数を正確に読む必要があるならGeminiを選ぶ
棒グラフや円グラフのように数を数えたり値を読み取ったりする場面ではGeminiのほうが安心です。今回Geminiは棒グラフの5本を正しく5つの値として返しましたがClaudeは6つ返しました。売上レポートや分析資料のグラフから数字を取り出すような用途ではGeminiを使うか、Claudeの答えを元のグラフと突き合わせて確かめるのがよいでしょう。

レシートや表の読み取りはどちらを選んでも大きな差はない
文字と数字が並ぶレシートや表の画像であればGeminiもClaudeもほぼ同じ正確さで読み取れました。ChatGPTの画像読み取り検証ではレシートを4段階に崩して照合していますがClaudeもGeminiもきれいなレシート画像であれば問題なく合計金額と日付を正解しています。手書きの文字や印刷がかすれた書類の読み取り精度はこの検証では試していません。
画像を送るときはAIの答えを元のデータと必ず突き合わせる
今回の検証でわかったのはAIの画像読み取りは「だいたい合っているがたまに数え間違える」ということです。Claudeは13.9秒という速さでグラフの値を返しましたが5本を6つと数えています。速さに安心してそのまま使うと間違った数字がレポートや資料に入ってしまいます。
AIに画像を送って出てきた答えは必ず元のデータと突き合わせてください。とくにグラフの値の読み取りは要注意です。棒や線の数が合っているか、数字の桁が正しいかを目で確かめるひと手間が必要です。文字や数字がはっきり写っているレシートや表であればGeminiもClaudeも正確に読めましたが条件が悪い画像(暗い・傾いている・手ブレがある)での精度はこの検証では確かめていません。
各AIの画像入力に関する公式の説明はGeminiが「Upload & analyze files in Gemini Apps」、Claudeが「Upload files to Claude」として公開されています。Microsoft CopilotのCSV分析検証でも数値の正確さに差が出ていたようにAIごとに得意な場面と苦手な場面があります。用途に合ったAIを選ぶことが大切です。今回の検証ではGeminiもClaudeも画像の添付だけで日本語の質問に日本語で答えました。設定の変更やプラグインの追加は必要ありません。
ChatGPTとMicrosoft Copilotは今回の操作の都合で試せなかった
今回の検証ではChatGPTとMicrosoft Copilotの結果を取得できませんでした。ChatGPTは画像を添付して質問を送りましたが画面から答えを取り出す処理が時間内に完了しませんでした。レシートの課題で300.3秒を使いきりました。棒グラフで302.1秒、表で301.7秒も同様です。Microsoft Copilotはログインの読み込みが間に合わず入力欄が表示されませんでした。45秒以内に入力欄が出てこなかったため3課題すべてを試さずに打ち切っています。
これはChatGPTやMicrosoft Copilotの不具合ではなくAInformation編集部の自動操作の側の問題です。どちらのAIも公式に画像の入力に対応しています。次回の検証であらためてChatGPTとMicrosoft Copilotを含む4AIでの比較を行う予定です。
関連する記事とツール
- ChatGPTの個別ページ
- Geminiの個別ページ
- Claudeの個別ページ
- Microsoft Copilotの個別ページ
- ChatGPTの画像読み取りはどこまで正確?レシートを4段階に崩して照合した
- 議事録を4AIに72回投げるとCopilotだけ指示を4回守らなかった
- Copilot検索は嘘を23秒で見抜いたが最新AIの名前は5件とも違った
- ChatGPTにファイルを添付する方法とエクセルだけ読み込めないことがある理由とは
レシートや表の画像はGeminiもClaudeもほぼ正確に読めました。差が出たのは棒グラフの読み取りです。Claudeは速いものの棒を1つ多く数えています。画像をAIに送って出てきた数字は元のデータと突き合わせてください。ChatGPTとMicrosoft Copilotは編集部の操作の都合で今回試せなかったため次回検証します。
- AIに画像を送って質問するにはどうすればいい?
- GeminiもClaudeも新しいチャットを開いてクリップのアイコンから画像を添付し聞きたいことを日本語で書いて送るだけです。今回の検証ではPNG形式の画像を3枚送りましたがどちらも問題なく読み取れました。操作に特別な設定は要りません。
- GeminiとClaudeで画像の読み取りが速いのはどっち?
- 2026年9月25日の検証ではClaudeのほうが速いです。レシートは17.3秒、棒グラフは13.9秒、表は15.3秒で答えました。Geminiはレシートに26.3秒、棒グラフに31.8秒、表に25.7秒かかりました。3課題ともClaudeが速い結果でした。
- AIは画像の中の数字を間違えることがある?
- あります。2026年9月25日の検証ではClaudeが棒グラフの5本の棒に対して6つの値を返しました。レシートや表の数字は正確でしたがグラフのように視覚的な情報を数値にする場面では間違えることがあります。AIの答えは必ず元のデータと突き合わせてください。
- レシートや表の画像はどのくらい正確に読める?
- この検証ではレシートの合計金額¥1,758と日付2026年9月10日はGeminiもClaudeも正解しました。20セルの表をMarkdownに書き起こす課題でも全セルが一致しています。文字と数字がはっきり写っている画像であれば高い精度で読み取れます。
- ChatGPTやMicrosoft Copilotでも画像を読み取れる?
- ChatGPTもMicrosoft Copilotも公式に画像の入力に対応しています。今回の検証ではAInformation編集部の操作の都合で結果を取得できませんでした。どちらのAIの不具合でもなく編集部側の問題です。次回あらためて検証する予定です。
