{"meta":{"name":"4つの生成AIの機能別の比較（AInformation調べ）","description":"ChatGPT・Gemini・Claude・Copilotへ同じ課題を同じ文で投げて比べた、機能ごとの正解率・課題ごとの正しさ・1位・検証した日・元の記事のデータです。AInformation編集部が4つのAIの有料プランの画面へ、同じ課題を同じ文で投げました。AI実務ベンチの行は1つの分野につき6課題を3回ずつ投げ、プログラムだけで採点した正解率です。4AI検証ラボの行は易・中・難の3課題を1回ずつ投げ、記事の中で答えを1つずつ確かめた結果です。測れなかったAIは分母に入れず、断られた回と時間切れの回は不正解として数えています。数字は記事と公開データにあるものをそのまま写しています。","publisher":"AInformation","source_url":"https://ainformation.jp/ai-compare","methodology_url":"https://ainformation.jp/ai-compare#ai-about","legacy_url":"https://ainformation.jp/wp-content/themes/swell_child/assets/aicompare/aicompare.json","canonical_url":"https://ainformation.jp/data/ai-compare.json","license":"CC BY 4.0","license_url":"https://creativecommons.org/licenses/by/4.0/","attribution":"出典：AInformation調べ「生成AI比較表」（https://ainformation.jp/ai-compare）　2026年10月3日時点","updated_at":"2026-10-03","count":11,"unit":"機能","note":"中身は data の中。元のJSON（legacy_url）と同じ形のまま入れています。"},"data":{
 "meta": {
  "count": 11,
  "updated_at": "2026-10-03",
  "generated_at": "2026-10-04T00:03:09+09:00",
  "trials_total": 454,
  "trials_bench": 424,
  "trials_lab": 30,
  "articles": 9,
  "count_lab": 4,
  "count_bench": 7,
  "ais": [
   "ChatGPT",
   "Gemini",
   "Claude",
   "Copilot"
  ],
  "by": "AInformation編集部",
  "license": "CC BY 4.0",
  "description": "ChatGPT・Gemini・Claude・Copilotの4つへ同じ課題を同じ文で投げて比べた、機能ごとの採点表です。AI実務ベンチ（プログラムで採点）と4AI検証ラボ（記事ごとの実測）を、検証した日つきでまとめています。"
 },
 "uses": {
  "write": "文章・翻訳・資料",
  "image": "画像",
  "voice": "音声",
  "file": "ファイル・表計算",
  "search": "調べもの"
 },
 "items": [
  {
   "key": "bench-gazou",
   "src": "bench",
   "src_label": "AI実務ベンチ",
   "feature": "画像・写真の読み取り",
   "what": "レシート・グラフ・表の画像から数字を読む",
   "use": "image",
   "date": "2026-09-27",
   "winner": null,
   "tie": [
    "ChatGPT",
    "Claude"
   ],
   "reason": "正解率はChatGPTとClaudeが100%で並んだ",
   "metric": "正解率（同じ課題を3回ずつ）",
   "cells": {
    "ChatGPT": {
     "v": "100%",
     "s": "12/12回",
     "na": false,
     "win": true
    },
    "Gemini": {
     "v": "83.3%",
     "s": "10/12回",
     "na": false,
     "win": false
    },
    "Claude": {
     "v": "100%",
     "s": "13/13回",
     "na": false,
     "win": true
    },
    "Copilot": {
     "v": "測れず",
     "s": "編集部の操作で",
     "na": true,
     "win": false
    }
   },
   "rows": [
    {
     "item": "正解率",
     "vals": {
      "ChatGPT": "100%（12/12回）",
      "Gemini": "83.3%（10/12回）",
      "Claude": "100%（13/13回）",
      "Copilot": "測れず（編集部の操作で）"
     },
     "best": [
      "ChatGPT",
      "Claude"
     ]
    },
    {
     "item": "かかった秒（中央値）",
     "vals": {
      "ChatGPT": "14.4秒",
      "Gemini": "19.5秒",
      "Claude": "14秒",
      "Copilot": "—"
     },
     "best": [
      "Claude"
     ]
    },
    {
     "item": "3回とも同じ答え（再現率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "100%",
      "Claude": "100%",
      "Copilot": "—"
     },
     "best": []
    },
    {
     "item": "指示どおりの形で返した（遵守率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "81.8%",
      "Claude": "92.3%",
      "Copilot": "—"
     },
     "best": [
      "ChatGPT"
     ]
    },
    {
     "item": "断った回数",
     "vals": {
      "ChatGPT": "0回",
      "Gemini": "1回",
      "Claude": "0回",
      "Copilot": "—"
     },
     "best": []
    },
    {
     "item": "画面に出ていたモデル",
     "vals": {
      "ChatGPT": "中程度",
      "Gemini": "Flash 拡張",
      "Claude": "Opus 5.5 中",
      "Copilot": "—"
     },
     "best": []
    }
   ],
   "method": "6課題を3回ずつ・毎回あたらしい会話・採点はプログラムだけ",
   "trials": 37,
   "models": {
    "ChatGPT": "中程度",
    "Gemini": "Flash 拡張",
    "Claude": "Opus 5.5 中"
   },
   "article": {
    "id": 11839,
    "url": "https://ainformation.jp/article/11839",
    "title": "AIの画像読み取り精度を比較！そのまま使えるプロンプト3つ"
   },
   "data_url": "https://ainformation.jp/research/bench/gazou-2026-09-27",
   "demand": 4737,
   "order": 0
  },
  {
   "key": "lab-image_gen",
   "src": "lab",
   "src_label": "4AI検証ラボ",
   "feature": "画像生成",
   "what": "リンゴ・バナー・4コマの3課題（易・中・難）を同じ文で投げた",
   "use": "image",
   "date": "2026-09-27",
   "winner": "Gemini",
   "tie": [],
   "reason": "3問とも指示どおりの画像を返した（秒数は測れず・ChatGPTは試せず）",
   "metric": "正しさ（課題ごとの○△×）",
   "cells": {
    "ChatGPT": {
     "v": "試せず",
     "s": "",
     "na": true,
     "win": false
    },
    "Gemini": {
     "v": "○3",
     "s": "3課題",
     "na": false,
     "win": true
    },
    "Claude": {
     "v": "○1 △2",
     "s": "3課題",
     "na": false,
     "win": false
    },
    "Copilot": {
     "v": "○1 △2",
     "s": "3課題",
     "na": false,
     "win": false
    }
   },
   "rows": [
    {
     "item": "かかった秒（易・リンゴ）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "測れず",
      "Claude": "60.7秒",
      "Copilot": "45.2秒"
     },
     "best": [
      "Copilot"
     ]
    },
    {
     "item": "かかった秒（中・バナー）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "測れず",
      "Claude": "45.0秒",
      "Copilot": "57.6秒"
     },
     "best": [
      "Claude"
     ]
    },
    {
     "item": "かかった秒（難・4コマ）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "測れず",
      "Claude": "126.2秒",
      "Copilot": "測れず"
     },
     "best": []
    },
    {
     "item": "答えの文字数（易・中・難）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "測れず",
      "Claude": "398字・498字・514字",
      "Copilot": "7字・6字・測れず"
     },
     "best": []
    },
    {
     "item": "正しさ（リンゴ）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 条件どおり",
      "Claude": "△ 写真風でなくイラスト",
      "Copilot": "△ 背景の下が灰色"
     },
     "best": [
      "Gemini"
     ]
    },
    {
     "item": "正しさ（バナー）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 文字も正しい",
      "Claude": "○ 1920×1080でフォント",
      "Copilot": "○ 頼んでいない文字あり"
     },
     "best": []
    },
    {
     "item": "正しさ（4コマ）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 番号と場面名まで",
      "Claude": "△ ④が外を見ていない",
      "Copilot": "△ 番号が切れて見えた"
     },
     "best": [
      "Gemini"
     ]
    },
    {
     "item": "日本語の自然さ",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 画像の中の場面名も正しい",
      "Claude": "○ 作り方まで普段の言葉",
      "Copilot": "○ 1文だけ"
     },
     "best": []
    },
    {
     "item": "制限",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "残り回数の表示なし",
      "Claude": "写真やイラストは作らない（公式）",
      "Copilot": "作成は対象のMicrosoft 365が要る（公式）"
     },
     "best": []
    }
   ],
   "method": "4つのAIに同じ文で1回ずつ投げた（毎回あたらしい会話）",
   "trials": 5,
   "models": {
    "Claude": "Opus 5.5 中"
   },
   "article": {
    "id": 11932,
    "url": "https://ainformation.jp/article/11932",
    "title": "画像生成AIを3つ比較！写真風に強いのはGeminiだった"
   },
   "data_url": null,
   "demand": 2228,
   "order": 1
  },
  {
   "key": "bench-kessan",
   "src": "bench",
   "src_label": "AI実務ベンチ",
   "feature": "PDF・決算書の読み取り",
   "what": "決算PDFから数字を拾う",
   "use": "file",
   "date": "2026-09-28",
   "winner": null,
   "tie": [
    "ChatGPT",
    "Claude"
   ],
   "reason": "正解率はChatGPTとClaudeが100%で並んだ",
   "metric": "正解率（同じ課題を3回ずつ）",
   "cells": {
    "ChatGPT": {
     "v": "100%",
     "s": "15/15回",
     "na": false,
     "win": true
    },
    "Gemini": {
     "v": "73.3%",
     "s": "11/15回",
     "na": false,
     "win": false
    },
    "Claude": {
     "v": "100%",
     "s": "15/15回",
     "na": false,
     "win": true
    },
    "Copilot": {
     "v": "測っていない",
     "s": "",
     "na": true,
     "win": false
    }
   },
   "rows": [
    {
     "item": "正解率",
     "vals": {
      "ChatGPT": "100%（15/15回）",
      "Gemini": "73.3%（11/15回）",
      "Claude": "100%（15/15回）",
      "Copilot": "測っていない"
     },
     "best": [
      "ChatGPT",
      "Claude"
     ]
    },
    {
     "item": "かかった秒（中央値）",
     "vals": {
      "ChatGPT": "17.2秒",
      "Gemini": "28.6秒",
      "Claude": "13.9秒",
      "Copilot": "—"
     },
     "best": [
      "Claude"
     ]
    },
    {
     "item": "3回とも同じ答え（再現率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "80%",
      "Claude": "100%",
      "Copilot": "—"
     },
     "best": [
      "ChatGPT",
      "Claude"
     ]
    },
    {
     "item": "指示どおりの形で返した（遵守率）",
     "vals": {
      "ChatGPT": "86.7%",
      "Gemini": "16.7%",
      "Claude": "60%",
      "Copilot": "—"
     },
     "best": [
      "ChatGPT"
     ]
    },
    {
     "item": "断った回数",
     "vals": {
      "ChatGPT": "0回",
      "Gemini": "3回",
      "Claude": "0回",
      "Copilot": "—"
     },
     "best": []
    },
    {
     "item": "画面に出ていたモデル",
     "vals": {
      "ChatGPT": "中程度",
      "Gemini": "Flash 拡張",
      "Claude": "Opus 4.8 高",
      "Copilot": "—"
     },
     "best": []
    }
   ],
   "method": "6課題を3回ずつ・毎回あたらしい会話・採点はプログラムだけ",
   "trials": 45,
   "models": {
    "ChatGPT": "中程度",
    "Gemini": "Flash 拡張",
    "Claude": "Opus 4.8 高"
   },
   "article": null,
   "data_url": "https://ainformation.jp/research/bench/kessan-2026-09-28",
   "demand": 1836,
   "order": 2
  },
  {
   "key": "lab-image_input",
   "src": "lab",
   "src_label": "4AI検証ラボ",
   "feature": "写真・画像を送って聞く（画像の読み取り）",
   "what": "レシート・棒グラフ・表の3課題（易・中・難）を同じ文で投げた",
   "use": "image",
   "date": "2026-09-25",
   "winner": "Gemini",
   "tie": [],
   "reason": "速さはClaude全勝だが正確さはGeminiが3課題とも正解",
   "metric": "正しさ（課題ごとの○△×）",
   "cells": {
    "ChatGPT": {
     "v": "試せず",
     "s": "",
     "na": true,
     "win": false
    },
    "Gemini": {
     "v": "○3",
     "s": "3課題",
     "na": false,
     "win": true
    },
    "Claude": {
     "v": "○2 △1",
     "s": "3課題",
     "na": false,
     "win": false
    },
    "Copilot": {
     "v": "試せず",
     "s": "",
     "na": true,
     "win": false
    }
   },
   "rows": [
    {
     "item": "かかった秒（レシート・易）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "26.3秒",
      "Claude": "17.3秒",
      "Copilot": "×（試せず）"
     },
     "best": [
      "Claude"
     ]
    },
    {
     "item": "かかった秒（棒グラフ・中）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "31.8秒",
      "Claude": "13.9秒",
      "Copilot": "×（試せず）"
     },
     "best": [
      "Claude"
     ]
    },
    {
     "item": "かかった秒（表・難）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "25.7秒",
      "Claude": "15.3秒",
      "Copilot": "×（試せず）"
     },
     "best": [
      "Claude"
     ]
    },
    {
     "item": "正しさ（レシート）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 正解",
      "Claude": "○ 正解",
      "Copilot": "×（試せず）"
     },
     "best": []
    },
    {
     "item": "正しさ（棒グラフ）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 5値正解",
      "Claude": "△ 6値返却",
      "Copilot": "×（試せず）"
     },
     "best": [
      "Gemini"
     ]
    },
    {
     "item": "正しさ（表）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 20セル一致",
      "Claude": "○ 20セル一致",
      "Copilot": "×（試せず）"
     },
     "best": []
    },
    {
     "item": "文字数（レシート）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "80字",
      "Claude": "195字",
      "Copilot": "×（試せず）"
     },
     "best": []
    },
    {
     "item": "文字数（棒グラフ）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "45字",
      "Claude": "57字",
      "Copilot": "×（試せず）"
     },
     "best": []
    },
    {
     "item": "日本語の自然さ",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 自然",
      "Claude": "○ 自然",
      "Copilot": "×（試せず）"
     },
     "best": []
    }
   ],
   "method": "4つのAIに同じ文で1回ずつ投げた（毎回あたらしい会話）",
   "trials": 6,
   "models": {
    "Gemini": "Pro 拡張",
    "Claude": "Opus 5.5 中"
   },
   "article": {
    "id": 11544,
    "url": "https://ainformation.jp/article/11544",
    "title": "画像読み取りAIを比較！GeminiとClaudeの違いと選び方"
   },
   "data_url": null,
   "demand": 1235,
   "order": 3
  },
  {
   "key": "bench-gijiroku",
   "src": "bench",
   "src_label": "AI実務ベンチ",
   "feature": "議事録・要約",
   "what": "議事録から決定事項とやることを抜く",
   "use": "write",
   "date": "2026-09-24",
   "winner": null,
   "tie": [
    "ChatGPT",
    "Claude"
   ],
   "reason": "正解率はChatGPTとClaudeが100%で並んだ",
   "metric": "正解率（同じ課題を3回ずつ）",
   "cells": {
    "ChatGPT": {
     "v": "100%",
     "s": "18/18回",
     "na": false,
     "win": true
    },
    "Gemini": {
     "v": "83.3%",
     "s": "15/18回",
     "na": false,
     "win": false
    },
    "Claude": {
     "v": "100%",
     "s": "18/18回",
     "na": false,
     "win": true
    },
    "Copilot": {
     "v": "83.3%",
     "s": "15/18回",
     "na": false,
     "win": false
    }
   },
   "rows": [
    {
     "item": "正解率",
     "vals": {
      "ChatGPT": "100%（18/18回）",
      "Gemini": "83.3%（15/18回）",
      "Claude": "100%（18/18回）",
      "Copilot": "83.3%（15/18回）"
     },
     "best": [
      "ChatGPT",
      "Claude"
     ]
    },
    {
     "item": "かかった秒（中央値）",
     "vals": {
      "ChatGPT": "20秒",
      "Gemini": "28.2秒",
      "Claude": "15.3秒",
      "Copilot": "13.8秒"
     },
     "best": [
      "Copilot"
     ]
    },
    {
     "item": "3回とも同じ答え（再現率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "88.9%",
      "Claude": "100%",
      "Copilot": "88.9%"
     },
     "best": [
      "ChatGPT",
      "Claude"
     ]
    },
    {
     "item": "指示どおりの形で返した（遵守率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "100%",
      "Claude": "100%",
      "Copilot": "77.8%"
     },
     "best": [
      "ChatGPT",
      "Gemini",
      "Claude"
     ]
    },
    {
     "item": "断った回数",
     "vals": {
      "ChatGPT": "0回",
      "Gemini": "1回",
      "Claude": "0回",
      "Copilot": "0回"
     },
     "best": []
    },
    {
     "item": "画面に出ていたモデル",
     "vals": {
      "ChatGPT": "—",
      "Gemini": "Pro 拡張",
      "Claude": "Opus 5.5 中",
      "Copilot": "Smart"
     },
     "best": []
    }
   ],
   "method": "6課題を3回ずつ・毎回あたらしい会話・採点はプログラムだけ",
   "trials": 72,
   "models": {
    "Gemini": "Pro 拡張",
    "Claude": "Opus 5.5 中",
    "Copilot": "Smart"
   },
   "article": {
    "id": 11277,
    "url": "https://ainformation.jp/article/11277",
    "title": "議事録AIを4つ比較！要約プロンプト2つと選び方"
   },
   "data_url": "https://ainformation.jp/research/bench/gijiroku-2026-09-24",
   "demand": 944,
   "order": 4
  },
  {
   "key": "lab-transcript_minutes",
   "src": "lab",
   "src_label": "4AI検証ラボ",
   "feature": "音声から議事録を作る",
   "what": "文字起こし・決まったこと・議事録の形の3課題（易・中・難）を同じ文で投げた",
   "use": "voice",
   "date": "2026-09-29",
   "winner": "Gemini",
   "tie": [],
   "reason": "録音から決定事項4件・宿題2件・次回を28.8秒でそろえた（商品名を1つ書き違え・ChatGPTとCopilotは試せず）",
   "metric": "正しさ（課題ごとの○△×）",
   "cells": {
    "ChatGPT": {
     "v": "試せず",
     "s": "",
     "na": true,
     "win": false
    },
    "Gemini": {
     "v": "○1",
     "s": "1課題",
     "na": false,
     "win": true
    },
    "Claude": {
     "v": "×1",
     "s": "1課題",
     "na": false,
     "win": false
    },
    "Copilot": {
     "v": "試せず",
     "s": "",
     "na": true,
     "win": false
    }
   },
   "rows": [
    {
     "item": "かかった秒（易・文字起こし）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "25.5秒（断った）",
      "Claude": "144.5秒（実行できず）",
      "Copilot": "×（試せず）"
     },
     "best": []
    },
    {
     "item": "かかった秒（中・決まったこと）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "28.8秒",
      "Claude": "42秒（読み取れず）",
      "Copilot": "×（試せず）"
     },
     "best": [
      "Gemini"
     ]
    },
    {
     "item": "かかった秒（難・議事録の形）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "28.8秒",
      "Claude": "363.1秒でも実行中",
      "Copilot": "×（試せず）"
     },
     "best": [
      "Gemini"
     ]
    },
    {
     "item": "答えの文字数（易・中・難）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "27字・367字・480字",
      "Claude": "964字・469字・202字",
      "Copilot": "×（試せず）"
     },
     "best": []
    },
    {
     "item": "正しさ（決定4件・宿題2件・次回）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 全部そろった（商品Eを商品Bと誤記）",
      "Claude": "× 中身を返せず",
      "Copilot": "×（試せず）"
     },
     "best": [
      "Gemini"
     ]
    },
    {
     "item": "全文の文字起こし",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "× 断った",
      "Claude": "× 実行できず",
      "Copilot": "×（試せず）"
     },
     "best": []
    },
    {
     "item": "日本語の自然さ",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "○ 議事録らしく短い",
      "Claude": "○ 丁寧だがコマンドの話が多い",
      "Copilot": "×（試せず）"
     },
     "best": []
    },
    {
     "item": "制限（公式ヘルプ）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "音声は無料10分・AI Proは3時間",
      "Claude": "対応形式に音声なし",
      "Copilot": "形式の記載なし"
     },
     "best": []
    }
   ],
   "method": "4つのAIに同じ文で1回ずつ投げた（毎回あたらしい会話）",
   "trials": 9,
   "models": {
    "Gemini": "Flash 拡張",
    "Claude": "Opus 4.8 高"
   },
   "article": {
    "id": 12327,
    "url": "https://ainformation.jp/article/12327",
    "title": "Geminiで議事録を作成する方法と文字起こしできないときの対処"
   },
   "data_url": null,
   "demand": 312,
   "order": 5
  },
  {
   "key": "bench-shirabemono",
   "src": "bench",
   "src_label": "AI実務ベンチ",
   "feature": "調べもの・事実確認",
   "what": "答えが一意に決まる事実を調べる",
   "use": "search",
   "date": "2026-09-29",
   "winner": "ChatGPT",
   "tie": [],
   "reason": "正解率はChatGPTの100%がいちばん高く、2位はCopilotの72.2%。Geminiは18回中8回断った",
   "metric": "正解率（同じ課題を3回ずつ）",
   "cells": {
    "ChatGPT": {
     "v": "100%",
     "s": "18/18回",
     "na": false,
     "win": true
    },
    "Gemini": {
     "v": "22.2%",
     "s": "4/18回",
     "na": false,
     "win": false
    },
    "Claude": {
     "v": "測れず",
     "s": "人間確認で止めた",
     "na": true,
     "win": false
    },
    "Copilot": {
     "v": "72.2%",
     "s": "13/18回",
     "na": false,
     "win": false
    }
   },
   "rows": [
    {
     "item": "正解率",
     "vals": {
      "ChatGPT": "100%（18/18回）",
      "Gemini": "22.2%（4/18回）",
      "Claude": "測れず（人間確認で止めた）",
      "Copilot": "72.2%（13/18回）"
     },
     "best": [
      "ChatGPT"
     ]
    },
    {
     "item": "かかった秒（中央値）",
     "vals": {
      "ChatGPT": "20.2秒",
      "Gemini": "33秒",
      "Claude": "—",
      "Copilot": "20.1秒"
     },
     "best": [
      "Copilot"
     ]
    },
    {
     "item": "3回とも同じ答え（再現率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "33.3%",
      "Claude": "—",
      "Copilot": "66.7%"
     },
     "best": [
      "ChatGPT"
     ]
    },
    {
     "item": "指示どおりの形で返した（遵守率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "50%",
      "Claude": "—",
      "Copilot": "31.2%"
     },
     "best": [
      "ChatGPT"
     ]
    },
    {
     "item": "出典のURLが開けた割合",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "83.3%",
      "Claude": "—",
      "Copilot": "93.3%"
     },
     "best": [
      "ChatGPT"
     ]
    },
    {
     "item": "断った回数",
     "vals": {
      "ChatGPT": "0回",
      "Gemini": "8回",
      "Claude": "—",
      "Copilot": "0回"
     },
     "best": []
    },
    {
     "item": "時間切れ（300秒）",
     "vals": {
      "ChatGPT": "0回",
      "Gemini": "0回",
      "Claude": "—",
      "Copilot": "2回"
     },
     "best": []
    },
    {
     "item": "画面に出ていたモデル",
     "vals": {
      "ChatGPT": "中程度",
      "Gemini": "Flash 拡張",
      "Claude": "—",
      "Copilot": "—"
     },
     "best": []
    }
   ],
   "method": "6課題を3回ずつ・毎回あたらしい会話・採点はプログラムだけ",
   "trials": 54,
   "models": {
    "ChatGPT": "中程度",
    "Gemini": "Flash 拡張"
   },
   "article": null,
   "data_url": "https://ainformation.jp/research/bench/shirabemono-2026-09-29",
   "demand": 141,
   "order": 6
  },
  {
   "key": "lab-canvas_docs",
   "src": "lab",
   "src_label": "4AI検証ラボ",
   "feature": "文書を一緒に作る・直す（Canvas・Docs・Pages）",
   "what": "文書を作る・2段落目だけ直す・3枚のスライドの3課題（易・中・難）を同じ文で投げた",
   "use": "write",
   "date": "2026-10-03",
   "winner": "Claude",
   "tie": [],
   "reason": "3問とも頼んだ形で返し、2段落目の数え方と仮に埋めた所を自分から書いた",
   "metric": "正しさ（課題ごとの○△×）",
   "cells": {
    "ChatGPT": {
     "v": "試せず",
     "s": "",
     "na": true,
     "win": false
    },
    "Gemini": {
     "v": "スライドだけ",
     "s": "",
     "na": false,
     "win": false
    },
    "Claude": {
     "v": "3問とも",
     "s": "",
     "na": false,
     "win": true
    },
    "Copilot": {
     "v": "2問目と3問目",
     "s": "",
     "na": false,
     "win": false
    }
   },
   "rows": [
    {
     "item": "かかった秒（易・文書を作る）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "255秒（文書は作られず）",
      "Claude": "57秒",
      "Copilot": "×（記録できず）"
     },
     "best": [
      "Claude"
     ]
    },
    {
     "item": "かかった秒（中・2段落目だけ直す）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "96.4秒",
      "Claude": "23.1秒",
      "Copilot": "26.4秒"
     },
     "best": [
      "Claude"
     ]
    },
    {
     "item": "かかった秒（難・3枚のスライド）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "88.4秒",
      "Claude": "54.1秒",
      "Copilot": "29.7秒"
     },
     "best": [
      "Copilot"
     ]
    },
    {
     "item": "文字数（易）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "27字",
      "Claude": "459字",
      "Copilot": "×（記録できず）"
     },
     "best": []
    },
    {
     "item": "文字数（中）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "70字",
      "Claude": "289字",
      "Copilot": "228字"
     },
     "best": []
    },
    {
     "item": "文字数（難）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "202字",
      "Claude": "426字",
      "Copilot": "135字"
     },
     "best": []
    },
    {
     "item": "正しさ（頼んだ形で返ったか）",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "スライドだけ（文書は断り・画面はSlide 1 of 4）",
      "Claude": "3問とも（2問目の差分は未確認）",
      "Copilot": "2問目と3問目（1問目は記録できず・差分は未確認）"
     },
     "best": [
      "Claude"
     ]
    },
    {
     "item": "日本語の自然さ",
     "vals": {
      "ChatGPT": "×（試せず）",
      "Gemini": "短く自然な敬語",
      "Claude": "かなり改まった敬語",
      "Copilot": "可能でございますとやや硬い"
     },
     "best": []
    },
    {
     "item": "制限（公式の条件）",
     "vals": {
      "ChatGPT": "有料のアカウントへ順に提供",
      "Gemini": "Geminiアプリへのログインが要る",
      "Claude": "Pro・Max・Team・Enterpriseのベータ・利用上限に数える",
      "Copilot": "個人はMicrosoft 365 Personal・Family・Premium・Pro"
     },
     "best": []
    }
   ],
   "method": "4つのAIに同じ文で1回ずつ投げた（毎回あたらしい会話）",
   "trials": 10,
   "models": {
    "Gemini": "Pro",
    "Claude": "Fable 5.1 中",
    "ChatGPT": "Medium"
   },
   "article": {
    "id": 12876,
    "url": "https://ainformation.jp/article/12876",
    "title": "Canvasを比較！文書とスライドをAIに頼むプロンプト3つ"
   },
   "data_url": null,
   "demand": 116,
   "order": 7
  },
  {
   "key": "bench-eibun",
   "src": "bench",
   "src_label": "AI実務ベンチ",
   "feature": "英文・翻訳",
   "what": "英語のプレスリリースを訳す",
   "use": "write",
   "date": "2026-09-30",
   "winner": "ChatGPT",
   "tie": [],
   "reason": "正解率はChatGPTの83.3%がいちばん高く、2位はCopilotの55.6%。Geminiは18回中12回断った",
   "metric": "正解率（同じ課題を3回ずつ）",
   "cells": {
    "ChatGPT": {
     "v": "83.3%",
     "s": "15/18回",
     "na": false,
     "win": true
    },
    "Gemini": {
     "v": "16.7%",
     "s": "3/18回",
     "na": false,
     "win": false
    },
    "Claude": {
     "v": "50%",
     "s": "9/18回",
     "na": false,
     "win": false
    },
    "Copilot": {
     "v": "55.6%",
     "s": "10/18回",
     "na": false,
     "win": false
    }
   },
   "rows": [
    {
     "item": "正解率",
     "vals": {
      "ChatGPT": "83.3%（15/18回）",
      "Gemini": "16.7%（3/18回）",
      "Claude": "50%（9/18回）",
      "Copilot": "55.6%（10/18回）"
     },
     "best": [
      "ChatGPT"
     ]
    },
    {
     "item": "かかった秒（中央値）",
     "vals": {
      "ChatGPT": "18.7秒",
      "Gemini": "39.4秒",
      "Claude": "23.1秒",
      "Copilot": "17.1秒"
     },
     "best": [
      "Copilot"
     ]
    },
    {
     "item": "3回とも同じ答え（再現率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "100%",
      "Claude": "88.9%",
      "Copilot": "83.3%"
     },
     "best": [
      "ChatGPT",
      "Gemini"
     ]
    },
    {
     "item": "指示どおりの形で返した（遵守率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "100%",
      "Claude": "100%",
      "Copilot": "55.6%"
     },
     "best": [
      "ChatGPT",
      "Gemini",
      "Claude"
     ]
    },
    {
     "item": "断った回数",
     "vals": {
      "ChatGPT": "0回",
      "Gemini": "12回",
      "Claude": "0回",
      "Copilot": "0回"
     },
     "best": []
    },
    {
     "item": "時間切れ（300秒）",
     "vals": {
      "ChatGPT": "0回",
      "Gemini": "0回",
      "Claude": "1回",
      "Copilot": "0回"
     },
     "best": []
    },
    {
     "item": "画面に出ていたモデル",
     "vals": {
      "ChatGPT": "中程度",
      "Gemini": "Flash 拡張",
      "Claude": "Opus 4.8 高",
      "Copilot": "—"
     },
     "best": []
    }
   ],
   "method": "6課題を3回ずつ・毎回あたらしい会話・採点はプログラムだけ",
   "trials": 72,
   "models": {
    "ChatGPT": "中程度",
    "Gemini": "Flash 拡張",
    "Claude": "Opus 4.8 高"
   },
   "article": {
    "id": 12367,
    "url": "https://ainformation.jp/article/12367",
    "title": "AI翻訳の精度を4つ比較！そのまま使える翻訳プロンプト2つ"
   },
   "data_url": "https://ainformation.jp/research/bench/eibun-2026-09-30",
   "demand": 74,
   "order": 8
  },
  {
   "key": "bench-hyokeisan",
   "src": "bench",
   "src_label": "AI実務ベンチ",
   "feature": "表計算・集計",
   "what": "売上表から合計と伸び率を出す",
   "use": "file",
   "date": "2026-10-02",
   "winner": null,
   "tie": [
    "ChatGPT",
    "Copilot"
   ],
   "reason": "正解率はChatGPTとCopilotが100%で並んだ。Geminiは18回中6回断った",
   "metric": "正解率（同じ課題を3回ずつ）",
   "cells": {
    "ChatGPT": {
     "v": "100%",
     "s": "18/18回",
     "na": false,
     "win": true
    },
    "Gemini": {
     "v": "50%",
     "s": "9/18回",
     "na": false,
     "win": false
    },
    "Claude": {
     "v": "83.3%",
     "s": "15/18回",
     "na": false,
     "win": false
    },
    "Copilot": {
     "v": "100%",
     "s": "18/18回",
     "na": false,
     "win": true
    }
   },
   "rows": [
    {
     "item": "正解率",
     "vals": {
      "ChatGPT": "100%（18/18回）",
      "Gemini": "50%（9/18回）",
      "Claude": "83.3%（15/18回）",
      "Copilot": "100%（18/18回）"
     },
     "best": [
      "ChatGPT",
      "Copilot"
     ]
    },
    {
     "item": "かかった秒（中央値）",
     "vals": {
      "ChatGPT": "20.4秒",
      "Gemini": "36.1秒",
      "Claude": "26.6秒",
      "Copilot": "17.1秒"
     },
     "best": [
      "Copilot"
     ]
    },
    {
     "item": "3回とも同じ答え（再現率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "83.3%",
      "Claude": "100%",
      "Copilot": "100%"
     },
     "best": [
      "ChatGPT",
      "Claude",
      "Copilot"
     ]
    },
    {
     "item": "指示どおりの形で返した（遵守率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "91.7%",
      "Claude": "16.7%",
      "Copilot": "88.9%"
     },
     "best": [
      "ChatGPT"
     ]
    },
    {
     "item": "断った回数",
     "vals": {
      "ChatGPT": "0回",
      "Gemini": "6回",
      "Claude": "0回",
      "Copilot": "0回"
     },
     "best": []
    },
    {
     "item": "画面に出ていたモデル",
     "vals": {
      "ChatGPT": "Medium",
      "Gemini": "Flash",
      "Claude": "Opus 4.8 高",
      "Copilot": "—"
     },
     "best": []
    }
   ],
   "method": "6課題を3回ずつ・毎回あたらしい会話・採点はプログラムだけ",
   "trials": 72,
   "models": {
    "ChatGPT": "Medium",
    "Gemini": "Flash",
    "Claude": "Opus 4.8 高"
   },
   "article": {
    "id": 12628,
    "url": "https://ainformation.jp/article/12628",
    "title": "データ分析AIを4つ比較！売上表の集計プロンプト3つと選び方"
   },
   "data_url": "https://ainformation.jp/research/bench/hyokeisan-2026-10-02",
   "demand": 39,
   "order": 9
  },
  {
   "key": "bench-kossi",
   "src": "bench",
   "src_label": "AI実務ベンチ",
   "feature": "資料の骨子づくり",
   "what": "決められた枚数と字数で資料の骨子を作る",
   "use": "write",
   "date": "2026-10-03",
   "winner": "ChatGPT",
   "tie": [],
   "reason": "正解率はChatGPTの83.3%がいちばん高く、2位はGeminiの77.8%",
   "metric": "正解率（同じ課題を3回ずつ）",
   "cells": {
    "ChatGPT": {
     "v": "83.3%",
     "s": "15/18回",
     "na": false,
     "win": true
    },
    "Gemini": {
     "v": "77.8%",
     "s": "14/18回",
     "na": false,
     "win": false
    },
    "Claude": {
     "v": "61.1%",
     "s": "11/18回",
     "na": false,
     "win": false
    },
    "Copilot": {
     "v": "27.8%",
     "s": "5/18回",
     "na": false,
     "win": false
    }
   },
   "rows": [
    {
     "item": "正解率",
     "vals": {
      "ChatGPT": "83.3%（15/18回）",
      "Gemini": "77.8%（14/18回）",
      "Claude": "61.1%（11/18回）",
      "Copilot": "27.8%（5/18回）"
     },
     "best": [
      "ChatGPT"
     ]
    },
    {
     "item": "かかった秒（中央値）",
     "vals": {
      "ChatGPT": "20.4秒",
      "Gemini": "19.3秒",
      "Claude": "35.5秒",
      "Copilot": "17.1秒"
     },
     "best": [
      "Copilot"
     ]
    },
    {
     "item": "3回とも同じ答え（再現率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "100%",
      "Claude": "88.9%",
      "Copilot": "88.9%"
     },
     "best": [
      "ChatGPT",
      "Gemini"
     ]
    },
    {
     "item": "指示どおりの形で返した（遵守率）",
     "vals": {
      "ChatGPT": "100%",
      "Gemini": "100%",
      "Claude": "100%",
      "Copilot": "94.4%"
     },
     "best": [
      "ChatGPT",
      "Gemini",
      "Claude"
     ]
    },
    {
     "item": "時間切れ（300秒）",
     "vals": {
      "ChatGPT": "0回",
      "Gemini": "1回",
      "Claude": "0回",
      "Copilot": "0回"
     },
     "best": []
    },
    {
     "item": "画面に出ていたモデル",
     "vals": {
      "ChatGPT": "Medium",
      "Gemini": "Flash-Lite",
      "Claude": "Opus 4.8 高",
      "Copilot": "—"
     },
     "best": []
    }
   ],
   "method": "6課題を3回ずつ・毎回あたらしい会話・採点はプログラムだけ",
   "trials": 72,
   "models": {
    "ChatGPT": "Medium",
    "Gemini": "Flash-Lite",
    "Claude": "Opus 4.8 高"
   },
   "article": {
    "id": 12749,
    "url": "https://ainformation.jp/article/12749",
    "title": "資料作成AIのおすすめを4つ比較！骨子づくりのプロンプト3つ"
   },
   "data_url": "https://ainformation.jp/research/bench/kossi-2026-10-03",
   "demand": 14,
   "order": 10
  }
 ],
 "wins": {
  "win": {
   "ChatGPT": 3,
   "Gemini": 3,
   "Claude": 1,
   "Copilot": 0
  },
  "tie": {
   "ChatGPT": 4,
   "Gemini": 0,
   "Claude": 3,
   "Copilot": 1
  }
 },
 "board": {
  "rows": [
   {
    "ai": "ChatGPT",
    "correct": 111,
    "trials": 117,
    "acc": 94.9,
    "sec": 18.7571,
    "cons": 100.0,
    "inst": 98.1,
    "src": 100.0,
    "runs": 7
   },
   {
    "ai": "Claude",
    "correct": 81,
    "trials": 100,
    "acc": 81.0,
    "sec": 21.4,
    "cons": 96.3,
    "inst": 78.2,
    "src": null,
    "runs": 7
   },
   {
    "ai": "Copilot",
    "correct": 61,
    "trials": 90,
    "acc": 67.8,
    "sec": 17.04,
    "cons": 85.6,
    "inst": 69.6,
    "src": 93.3,
    "runs": 6
   },
   {
    "ai": "Gemini",
    "correct": 66,
    "trials": 117,
    "acc": 56.4,
    "sec": 29.1571,
    "cons": 83.7,
    "inst": 77.2,
    "src": 83.3,
    "runs": 7
   }
  ],
  "fields": 7,
  "trials_total": 424,
  "updated": "2026-10-02",
  "url": "https://ainformation.jp/research/bench"
 },
 "hub": {
  "faq": [
   {
    "q": "生成AIを比べると、いちばん正確なのはどれですか？",
    "a": "AI実務ベンチの累積（7分野・のべ424試行）では、正解率がいちばん高かったのはChatGPTの94.9%（117試行中111）でした。2位はClaudeの81%で、Copilotの67.8%とGeminiの56.4%が続きます。ただし機能ごとに勝ち負けは入れ替わります。使いたい機能の行で選んでください。"
   },
   {
    "q": "ChatGPT・Gemini・Claude・Copilotをどうやって比べましたか？",
    "a": "AInformation編集部が4つのAIの有料プランの画面へ、同じ課題を同じ文で投げました。AI実務ベンチは1つの分野につき6課題を3回ずつ投げ、正解かどうかをプログラムだけで判定しています。4AI検証ラボは易・中・難の3課題を1回ずつ投げ、答えを記事の中で1つずつ確かめています。どちらも毎回あたらしい会話から始めています。"
   },
   {
    "q": "無料版でも同じ結果になりますか？",
    "a": "同じになるとは限りません。使ったのはChatGPT Pro・Google AI Pro・ClaudeのMaxプラン・Microsoft 365 Personalで、画面に出ていたモデルの名前を採点表に残しています。無料版は使えるモデルや回数が違うので、答えの速さと正しさも変わります。"
   },
   {
    "q": "「試せず」や「測れず」と書いてあるのはなぜですか？",
    "a": "測れなかった理由は3つです。編集部の操作が止まった回と、プランの上限に当たった回と、人間かどうかの確認が出て止めた回です。AIが答えを間違えたわけではないので、正解率の分母には入れていません。断られた回と時間切れの回はAIの結果なので、分母に入れて不正解として数えています。"
   },
   {
    "q": "この比較表はいつ更新されますか？",
    "a": "4AI検証ラボの比較記事は公開した日のうちに表へ足されます。AI実務ベンチは測った翌日に足されます。同じ機能を測り直したときは新しい結果に入れ替えます。いま載っているのは11の機能で、いちばん新しい検証は2026年10月3日です。データはCC BY 4.0で公開しているので、出典を書けば引用できます。"
   }
  ],
  "about": [
   "ChatGPT・Gemini・Claude・Copilotの4つを、AInformation編集部が同じ課題で比べた結果を表にまとめています。材料はAI実務ベンチの7分野（のべ424試行）と、4AI検証ラボの比較記事4本（答えまで取れた送信30回）です。",
   "AI実務ベンチは架空の会社の資料を毎回作り直し、4つのAIへ同じ課題を投げています。正解かどうかは数値の一致・語句の有無・形式・URLが開けるかでプログラムが判定し、AIには採点させていません。",
   "4AI検証ラボは1つの機能を易・中・難の3課題で4つのAIへ投げています。かかった秒数と答えの中身は記事で1つずつ確かめ、何を基準にしたかは各記事の検証の条件に書いています。",
   "勝ちの印はベンチでは正解率がいちばん高いAIに付けています（同じ値なら同率）。ラボでは記事で編集部が出した結論に付けています。1回の検証の結果なので、日や課題が変われば順位は変わります。"
  ]
 }
}
}