本文へ移動
NEWS
ビジネス活用

Gemini、電通式の会計承認で全問正解 Proだと5.2倍高くつく

更新 2026/10/1 読了 約9分
会計承認20万件でAIが99%正解した。4つのAIで比べると費用は5.2倍違う
この記事の要点

電通グループは年20万件を超える会計承認にGeminiを組み込み、正解率は99%に達しました。それでも最後の判断は人に残しています。AInformationが同じ3段階の判定を4つのAIで試すと全問正解でしたが、1件の費用は0.45円から2.33円まで5.2倍の差が出ました。

みんなの意見

正解率99%のAIに会計承認を任せられますか?

まだ回答がありません。最初の1票をどうぞ

SHARE
20万件年間の原価発注
99%実装時のAIの正解率
5.2倍4つのAIの1件の費用差

電通が会計承認にGeminiを導入 年20万件超を3段階で判定

電通グループは、国内グループ共通の会計システム「CAS」の承認業務に生成AIを組み込みました。国内の原価発注は年間20万件を超え、上長や管理部署が1件ずつ確かめる手間が導入のきっかけです。2026年4月までに実装を終え、そのときのAIの正解率は99%に達したといいます。

AIには発注情報や見積書などのデータと、確認事項を書いたプロンプトを渡します。プロンプトには社内規定と、現場が承認や却下を決めてきたルールを入れました。AIはそれを突き合わせて「問題あり(差し戻し)」「問題なし(承認)」「要確認(人が判断)」の3段階で判定します。

プロンプトの頭には「全てのチェックリストは上から順番に必ずチェックしてください」という指示と、推測を禁じる指示を置いています。その下に登録金額と見積書の金額の一致のような確認事項を並べる形です。記事によると、紹介された文言は説明用の例で実際とは違います。

Claude の公式ページ
Claude の公式ページ / 出典:anthropic.com / 制作:AInformation
これまでの流れ
  1. 2025年6月別のモデルでPoC、一致率15.4%
  2. 7/7Gemini 2.5 Proに替え一致率77.9%
  3. 7/31プロンプトを直し一致率89.4%
  4. 2026年4月会計システムに実装、正解率99%

一致率は15.4%から89.4%へ Geminiとプロンプトで伸びた

人とAIの判定の一致率は、モデルをGeminiに替えてプロンプトを直すことで15.4%から89.4%まで上がりました。最初から判定がそろったわけではありません。

PoCの期間(2025年) 変えたこと 件数 人との一致率
6月23日〜7月1日 別のモデルで試す 13件 15.4%
7月7日〜31日 Gemini 2.5 Proに替える 34件 77.9%
7月31日〜8月11日 プロンプトを調整する 52件 89.4%

ITmediaの記事が伝えた講演資料の数字です。

dentsu Japan CIOの根津修二氏は差が出た理由に、画像を含むPDFの読み取りを挙げました。「画像を含むPDFの認識では、Geminiが強いと感じました」という言葉です。ただAInformationが以前に画像から数字を読む課題を3つのAIに解かせたときは、Geminiだけがお釣りの数字を2回外しています。

検証では一致率が約95%で頭打ちになりました。食い違いを調べると、人の判断のほうが社内ルールに合っていない例が見つかったといいます。何十年も続いてきた現場のローカルルールの例を除くと、正解率は99%に届きました。

正解率99%でも最後の判断は人に残した

電通が採ったのは、全部をAIに任せる形ではありません。AIがデータの整合性と社内規定への適合を確かめ、取引の背景を踏まえた判断は人が下す「ハイブリッド方式」です。AIが問題ありとした申請は自動で差し戻します。

AIに判断させないのは、長期の投資判断や他の案件と合わせて見る取引です。電通側のミスを埋める補填の取引や、システムの都合で出る例外も人が見ます。根津氏は、ビジネスの文脈で判断が変わるものはプロンプトに書けないと説明しています。

AInformationが作った金額の欄がにじんで読めない架空の見積書と、同じ申請を4つのAIに判定させた結果の画面。推測を禁じる指示があると4つとも要確認で、外すとGPT-6 Solは5回とも問題ありになった
金額がにじんだ架空の見積書を4つのAIに判定させた結果の画面

同じ3段階を4つのAIで試した 全問正解でも費用は5.2倍違う

AInformationが電通の説明をまねた架空の発注申請8件を4つのAIに判定させると、4つとも24回すべて正解で費用には5.2倍の差が出ました。添付の見積書はスキャンしたような画像だけのPDFです。試したのはClaude Sonnet 5.5・GPT-6 Sol・Gemini 3.1 Pro(プレビュー版)と、安いGemini 3.8 Flashです。前の3つは入力の単価が100万トークン2ドルでそろいます。

8件には金額の食い違い・納品日のずれ・契約書の添付漏れ・赤字の取引・金額がにじんで読めない見積書を入れました。頭に税込の金額だけを大きく書いた見積書と、108万円の見積を100.8万円で申請した1件も混ぜています。プロンプトは電通の例にならい、推測を禁じる1行と4つの確認事項を入れました。

時間と費用は次のとおりです。

モデル 正解(24回) 秒数の中央値 1件の費用 20万件の費用
Claude Sonnet 5.5 24回 2.23秒 0.93円 18.6万円
GPT-6 Sol 24回 3.74秒 1.27円 25.4万円
Gemini 3.1 Pro 24回 9.96秒 2.33円 46.6万円
Gemini 3.8 Flash 24回 3.12秒 0.45円 8.9万円

AInformation独自検証。9月29日にAPIを既定の設定のまま使い、8件を3回ずつ投げました。費用は実際に使ったトークン数に各社の公式単価を掛け、9月28日の欧州中央銀行の参照値(1ドル156.88円)で円に直しています。20万件の費用は1ページの見積書で試した1件の費用を20万倍した見込みで、Gemini 3.8 Flashは2026年12月31日までの単価で計算しました。

いちばん速いのはClaude Sonnet 5.5で、中央値は2.23秒です。入力はGeminiの2つが1件平均937トークンで、GPT-6 Solの3,470トークンやClaude Sonnet 5.5の2,175トークンより少なく済みました。ただGemini 3.1 Proは答える前に考える出力が平均1,027トークンに膨らみ、1件2.33円と4つの中で最も高くつきます。Gemini 3.8 Flashの0.45円の5.2倍です。

推測禁止を外すと 読めない見積書は差し戻しに回った

金額がにじんで読めない見積書は、プロンプトどおりなら4つとも3回すべて要確認に回りました。そこで推測を禁じる1行を消し、要確認を赤字の取引だけに絞って5回ずつ投げ直しています。するとGPT-6 Solは5回とも、Claude Sonnet 5.5は5回中4回が問題あり(差し戻し)に変わりました。

どちらも金額を勝手に読んだわけではなく、確認できないので出し直してほしいという理由でした。ただ電通の仕組みでは問題ありの申請は自動で差し戻されるので、この書類は人の目を通らずに申請者へ戻ります。読めない書類をどこへ回すかは、プロンプトの2行で変わるということです。

電通が使ったGemini 2.5 Proは呼べなかった

電通がPoCで使ったGemini 2.5 Proも試そうとしましたが、APIでは使えなかったので比べていません。新しい利用者にはもう提供していないという応答が返ってきたためです。Gemini 3.1 Proも、AInformationの契約では37回答えたところで利用上限を超えたという応答に変わりました。

安さで選ぶなら気をつけたいのは、Gemini 3.8 Flashの単価が年明けに上がることです。料金ページには2026年12月31日まで入力0.75ドル・出力3.75ドル、2027年1月1日から1.50ドル・7.50ドルと書かれています。来年の単価で計算し直すと1件0.89円で、20万件なら17.9万円とClaude Sonnet 5.5の18.6万円に近づきます。

GoogleのGemini APIの料金ページの画面。Gemini 3.8 Flashの有料版は入力0.75ドル・出力3.75ドルで、2027年1月1日から1.50ドルと7.50ドルになる行を赤枠で囲んだ
Gemini APIの料金ページ。3.8 Flashは2027年1月1日から単価が倍になる

まねるなら判定を3つに分ける 読めない書類の行き先を先に決める

自社でまねるなら判定を3つに分け、読めない書類を誰が見るかを先に決めておきたいところです。確認事項は電通の例のように「一致しなければならない」の形で1行ずつ書くと、見積書と申請のどの欄を比べるかがAIに伝わりやすくなりそうです。

  • 規程を「AとBは一致しなければならない」の形に書き直す
  • 読めない・判断できないときは要確認と書き、見る担当者を決めておく
  • 赤字や補填のようにAIに任せない取引を先に決める
  • 自社の見積書で2〜3のAIを試し、時間と費用を比べる

もう1つは、電通でも見つかった規程と運用のずれです。AIが人と違う判定を出したときは、AIの誤りと決めつけずに規程のほうも見直すと昔からのローカルルールが見つかる可能性があります。電通は内部統制の形を監査法人と一緒に作る方針で話し合いを進めたので、経理の承認をAIに回すなら監査法人への相談も早めに始めておくと安心です。

この記事に出てくることば
PoC
本番に入れる前に小さく試して、使えるかを確かめること。電通は2025年6月から8月まで3回に分けて行った
ハイブリッド方式
AIがデータの整合性と社内規定への適合を確かめ、取引の背景を踏まえた最後の判断は人が下すやり方
藤井俊太(AI導入コンサルタント)の見方

経理の承認をAIに回すとき、最初に決めるべきはモデルより読めない書類の行き先だとみています。今回の試験ではプロンプトの2行で、にじんだ見積書が人の確認から自動の差し戻しへ移りました。差し戻しが増えると申請する側の不満が経理に返ってきます。電通のように判定を3つに分け、要確認を誰がいつまでに見るかを先に決めておくと現場の反発を抑えやすそうです。もう1つの壁は電通も直面した昔からのローカルルールで、AIを入れる前に規程と実際の運用のずれを洗い出す作業が要ります。

よくある質問
電通は会計承認のどこまでをAIに任せている?
AIに任せているのは、データの整合性と社内規定に合っているかの確認です。AIは問題あり・問題なし・要確認の3つで判定し、問題ありの申請は自動で差し戻されます。長期の投資判断や他の案件と合わせて見る取引、電通側のミスを埋める補填の取引は人が判断します。2026年4月までに実装し、正解率は99%に達しました。
会計承認をAIでやると1件いくらかかる?
AInformationが1ページの見積書と申請データで試すと、1件あたりの費用はClaude Sonnet 5.5が0.93円でGPT-6 Solが1.27円でした。Gemini 3.1 Proは考える分の出力が多く2.33円で、Gemini 3.8 Flashは0.45円です。20万件なら8.9万円から46.6万円の幅になります。9月29日の公式単価と1ドル156.88円で計算しました。
読めない見積書はAIにどう判定させればいい?
推測を禁じる1行と、読めない項目を要確認に回す1行をプロンプトに入れておくのが確実です。AInformationの試験では、この指示があると金額がにじんだ見積書を4つのAIが3回とも要確認にしました。推測の禁止を消して要確認を赤字の取引だけに絞ると、GPT-6 Solは5回とも差し戻しに回しています。差し戻しが自動の仕組みなら、書類は人の目を通らずに申請者へ戻ります。
電通が使ったGemini 2.5 Proはいまも使える?
AInformationが9月29日にAPIで呼ぶと、新しい利用者にはもう提供していないという応答が返り使えませんでした。電通がPoCで一致率を77.9%まで上げたモデルですが、これから試す会社は後継のGemini 3.1 ProかGemini 3.8 Flashを選ぶことになります。AInformationの試験では2つとも架空の8件を24回すべて正しく判定しました。

この記事の出典

補助資料

  • [1]ITmedia AI+ITmedia AI+・補助的な二次資料・確認 2026-09-29この記事の元にした報道

出典の最終確認日:2026年9月29日

SHARE

広告を載せており、そこから申し込みがあると紹介料を受け取ることがあります。

この記事に出てくるAIも、まとめて比べられます 496本のAIツールを、やりたいこと・料金・日本語対応で絞り込めるデータベースです。7日ごとに料金を取り直しています。 AIツールを探す

あわせて読みたいRELATED