Microsoft Copilotの会話モードを既定の「自動」のまま、同じ計算の文を別の会話で2回ずつ送りました。決算PDFの比率の試算は2回とも合いましたが、売上CSVの合計と面談の割り当ては2回目に答えが変わりました。検算を頼むと正しい数字を誤りに直しています。
- Microsoft Copilotの会話モードは送る前に選ぶ。公式ヘルプは迅速な応答・さらに深く考える(Think Deeper)・勉強して学ぶ・スマート(Smart)・検索の5つを挙げている
- 2026年10月2日の画面では新しいチャットを開くと会話の上の表示が「自動」だった。7回とも自動のまま送った
- 同じ売上CSVと同じ文を2つの会話で送ると、2回目は5商品の合計を558,700千円と答えた(正しくは558,900千円)
- 同じ会話で検算を頼むと、合っていた商品Dの88,000千円を86,000千円に書き換えた
- 決算PDFのEC比率の試算は2回とも正解で、2026年度は38.6%・2027年度に42.3%で40%を超えると答えた
- 面談5人の割り当ては1回目が正解の3通りで、2回目は条件に合わない1つを足して4通りと答えた
Copilotの会話モードの使い方は送る前に選ぶだけで新しいチャットの表示は「自動」だった
Microsoft Copilotの会話モードは、答えの出し方を切り替える仕組みです。公式ヘルプ「Microsoft Copilot の会話モード」には、迅速な応答・さらに深く考える(Think Deeper)・勉強して学ぶ・スマート(Smart)・検索の5つが載っています。使い方はプロンプトを入れたあとにモードを選び、有効にしてから送るだけです。選んだモードは自分で外すまで有効なままです。
![Microsoftサポートの「Microsoft Copilot の会話モード」のページ。プロンプトを入れて下の[クイック応答]を押し送る前にモードを選ぶことと、選んだモードは無効にするまで続くことが4つの手順で書かれている](https://ainformation.jp/wp-content/uploads/2026/10/ainformation-copilot-3-20261002n1-shot1.jpg)
AInformation編集部は2026年10月2日に、パソコンのブラウザでCopilotを開いて試しました。新しいチャットを開くと、デフォルトで会話の上に「自動」という表示が出ていました。公式ヘルプが書く[クイック応答]のボタンは、このときの入力欄の下には見当たりませんでした。今回は編集部の操作の都合でThink Deeperへの切り替えは試せず、7回とも「自動」のまま送っています。この記事の数字は、すべて既定の「自動」で測ったものです。
ここからは、Copilotに計算を任せるときに編集部が実際に送った文を載せます。資料は架空の会社「サンプル商事」のものなので、自分の資料に置き換えればそのまま試せます。1回目と2回目で答えがどう変わったかは、このあとの章で1つずつ答え合わせしました。
売上CSVを集計させるプロンプト
5商品の月ごとの売上が12か月分入ったCSVを入力欄に添付して、次の文を送りました。合計と1位と伸び率の3つを1度に聞く形です。
このCSVファイルを読み込んで、次の3つを教えてください。①5商品の年間売上の合計(千円単位)②年間で一番売れた商品名と金額 ③1月と12月を比べて最も伸びた商品名と伸び率
この文への答えは、2回とも1位と伸び率が合いました。合計の答えは1回目と2回目で形も数字も変わっています。
決算PDFから比率を試算させるプロンプト
決算資料のPDFを添付して送った文です。資料に答えそのものは書いていません。伸び率を出してから2年先まで計算しないと答えにたどり着けない課題です。
この決算資料を読んでください。会社は2026年度にEC比率40%を目標にしています。ECの売上が2025年度と同じ伸び率で毎年伸び、卸売の売上は2025年度と同じ額のままだとすると、2026年度のEC比率は何%になり、目標に届きますか。届かない場合は、初めて40%を超えるのが何年度かも答えてください。計算式も書いてください。
この課題は2回とも同じ結論になりました。計算式も書かせておくと、どの数字をどこで使ったかを自分の目で追えます。
条件つきの割り当てを全部挙げさせるプロンプト
ファイルを付けずに文だけで送った課題です。5人の面談を5つの枠に入れる組み合わせを、6つの条件で絞り込ませました。
Aさん・Bさん・Cさん・Dさん・Eさんの5人の面談を、10時・11時・13時・14時・15時の5つの枠に1人ずつ入れます。12時台は昼休みなので、11時と13時は続いた枠(11時のすぐ次が13時)と数えます。条件は次の6つです。①AさんはBさんより前の枠。②Cさんは午後(13時・14時・15時)。③DさんはAさんのすぐ次の枠。④Eさんは15時ではない。⑤Bさんは14時か15時。⑥CさんとDさんは続いた枠に並べない。条件をすべて満たす割り当てを全部挙げて、何通りあるかも答えてください。
正解は3通りです。12時台を昼休みにして、11時と13時を続いた枠と数える所がこの課題の引っかけになっています。
同じ会話で検算させるプロンプト
売上CSVの答えが出たあとで、同じ会話のまま次の文を送りました。AIに自分の答えを見直させる頼み方です。ただし今回はこの文のあとで正しい数字が誤った数字に書き換わりました。使うときは直った所を元のデータで確かめてください。
いま答えた3つの数字を、CSVの元の数字から計算し直して検算してください。合っていたものと間違っていたものを分けて、間違っていたものは正しい数字に直してください。
Copilotの自動は7回とも26.5秒以内に答えたが3つの課題のうち2つは2回目に答えが変わった
先に結論を書きます。既定の「自動」のCopilotは、7回とも26.5秒以内に答えを返しました。速さはそろっていた一方で、答えの中身は課題によってそろいませんでした。同じ文を別の会話で2回送ると、決算PDFの比率は2回とも合っています。売上CSVの合計と面談の割り当ては、2回目に答えが変わりました。
いちばん大きかったのは検算の結果です。最初の答えで合っていた商品Dの年間合計88,000千円を、Copilotは検算のあとで86,000千円に書き換えました。足し上げに並べた12か月の数字はCSVと同じだったのに、合計だけが違っていました。AIに見直しを頼んでも、正しくなるとは限りません。
正解の数で見ると、7回のうち全部合っていたのは3回です。決算PDFの2回と、面談の割り当ての1回目がそれにあたります。売上CSVの2回は、1位と伸び率は合ったものの合計の答えがそろっていません。検算と面談の2回目は誤りです。

速さと正しさのあいだにも、決まった関係は見えませんでした。いちばん時間のかかった26.5秒の回は合計を書いておらず、23.0秒の2回は正解と誤りに分かれています。秒数で答えの良し悪しは見分けられないので、中身は毎回自分で確かめることになります。
検証はMicrosoft 365 PersonalのCopilotで6つの会話に7つの文を1回ずつ送った
AInformation編集部は2026年10月2日の15時台に、パソコンのブラウザでCopilotを操作しました。契約はMicrosoft 365 Personalです。材料は編集部が作った架空の会社「サンプル商事」の資料で、正しい答えを先に計算してあります。答えが合っていたかは、その正解と1つずつ照らしました。
手順は次のとおりです。同じ文を2回送るときは、前の答えが混ざらないように新しい会話を開きました。
- 新しい会話で売上CSVを添付して3つの問いを送る(会話1)
- 同じ会話のままで答えの検算を頼む(会話1)
- 新しい会話で同じCSVを添付して同じ3つの問いを送る(会話2)
- 新しい会話で決算PDFを添付してEC比率の試算を頼む(会話3)
- 新しい会話で同じPDFを添付して同じ文を送る(会話4)
- 新しい会話で面談の割り当てを頼む(会話5)
- 新しい会話で同じ文を送る(会話6)
6つの会話とも、送る前の表示は「自動」でした。会話の画面にモデル名は出ていません。かかった秒数は、送ってから答えが出そろうまでを編集部の記録で測りました。答えの文字数は、画面に出た答えの部分を数えたものです。

2回目も同じ「自動」で送ったので、この検証は同じ文を同じ状態で2回送ったときに答えがそろうかを見た形になりました。1回だけ送った答えをそのまま使うと、どの答えに当たるかで結果が変わります。その揺れの大きさを、課題の種類ごとに見ていきます。
売上CSVの合計は1回目が商品ごとの5つで2回目は558,700千円とずれた
同じCSVと同じ文を2回送ると、合計の答え方が変わりました。正しい年間合計は558,900千円です。1回目は合計の問いに商品ごとの年間合計5つで答え、5つを足した1つの数字は書きませんでした。2回目は1つの数字で答えましたが、558,700千円と正解からずれています。

1回目の答えは26.5秒・438字でした。商品A 146,400千円・商品B 140,600千円・商品C 82,800千円・商品D 88,000千円・商品E 101,100千円の5つは、どれもCSVの正しい値と同じです。1位は商品A(タンブラー)の146,400千円で、伸び率の1位は商品B(エコバッグ)の31.7%でした。伸び率には1月の10,100千円と12月の13,300千円から出した式も添えています。

2回目は26.1秒・291字で、1回目より短い答えでした。1位と伸び率は1回目と同じく正解です。違ったのは合計と、下に添えた表の商品Bでした。表では商品Bを140,400千円としていて、正しい140,600千円と合いません。表のほかの4商品は正しい値でした。
AInformation編集部は9月23日の検証でも、同じCSVと同じ文をCopilotに送っています。このときの画面の表示はSmartで、合計を538,400、1位の金額を144,400、伸び率の1位を商品Eの+5.9%と答えていました。3回送って、正解の558,900千円をそのまま書いた回はありません。
売上CSVの3つの問いの答え合わせ
| 問い | CSVの正しい値 | 10月2日の1回目 | 10月2日の2回目 | 9月23日 |
|---|---|---|---|---|
| 5商品の年間合計 | 558,900千円 | 書かず(商品ごとの5つで答えた) | 558,700千円 | 538,400 |
| 売上1位の商品と金額 | 商品A 146,400千円 | 商品A 146,400千円 | 商品A 146,400千円 | 144,400 |
| 1月と12月の伸び率1位 | 商品B 31.7% | 商品B 31.7% | 商品B 31.7% | 商品E +5.9% |
| 表の商品Bの年間合計 | 140,600千円 | 140,600 | 140,400 | (記録なし) |
| かかった秒 | - | 26.5秒 | 26.1秒 | (記録なし) |
| 答えの文字数 | - | 438字 | 291字 | (記録なし) |
合計の問いは「5商品の年間売上の合計」と書いたので、5つを足した1つの数字を聞いたつもりでした。1回目の答えは、これを商品ごとの合計の意味で受け取った形になっています。1つの数字が欲しいときは「5商品を足した合計を1つの数字で」のように形まで書いておくと、答え合わせが楽になります。この書き方で答えが合うかどうかは、今回は試していません。
同じ会話で検算を頼むとCopilotは正しい88,000千円を86,000千円に書き換えた
1回目の答えのあと、同じ会話で検算を頼みました。Copilotは23.1秒・796字で、合っていたものと間違っていたものに分けて返しています。1位の商品Aと伸び率の商品Bを「合っていたもの」に入れた所は、判定どおりでした。

問題は「間違っていたもの」の側です。Copilotは合計の問いを間違いに分け、商品D(弁当箱)の年間合計を88,000千円から86,000千円に直しました。CSVの正しい値は88,000千円なので、最初の答えのほうが合っていました。検算が正しい数字を誤りに書き換えた形です。
直したあとの答えには、商品Dの12か月の売上を並べた足し算の式も付いていました。7,900から始まる12個の数字は、CSVの商品Dの列と1つずつ同じです。並べた数字は合っていたのに、式の答えは86,000になっていました。式が付いているからといって、計算まで正しいとは限りません。
このときCopilotは、伸び率も5商品すべてについて計算し直していました。商品Bは31.68%で商品Eは5.88%のように並べ、1位は商品Bのままとしています。細かい式がたくさん並ぶと全部確かめたように見えます。それでも1か所の誤りで結論が変わるので、検算は同じAIに任せきりにせず元のデータで照らしてください。
決算PDFのEC比率は2回とも38.6%と答え2027年度に40%を超えると正しく試算した
決算資料のPDFを渡した試算は、2回とも正解でした。正しい答えは2つあります。2026年度のEC比率は約38.6%で目標の40%に届かず、2027年度に約42.3%で初めて40%を超えます。Copilotは1回目に23.0秒・586字で答えました。2回目は26.1秒・681字で、どちらもこの2つの結論を出しています。

1回目の答えは、資料の販売チャネル別の売上を読むところから始まります。2025年度のECは239億円で卸売は443億円、ECの伸びは前年比+16.6%と書いていました。その伸び率1.166を2026年度と2027年度に続けて掛け、卸売は443億円のまま足して割っています。計算の筋道は編集部が用意した正解と同じでした。答えの頭には、PDFの表の小さな画像も付いていました。

2回目も同じ数字を使い、結論も同じでした。違ったのは見せ方です。1回目は式を灰色の枠に並べましたが、2回目は分数の形の数式で出しています。2回目は前年度の205億円から伸び率16.6%を出す所も文で書いていました。
この課題で間違えやすいのは、資料にある2026年度の売上見通し710億円を分母に使うことです。これを使うと39.2%になって答えがずれます。Copilotは2回とも見通しの数字を使わず、ECと卸売を足した額で割っていました。資料の数字を拾って式を1本ずつ当てる課題では、自動のままでも2回そろって正しい答えが出ています。
面談の割り当ては1回目が正解の3通りで2回目は条件に合わない4通り目を足した
文だけで送った面談の割り当ては、1回目と2回目で答えの数が変わりました。正解は次の3通りです。
- 10時A・11時D・13時E・14時B・15時C
- 10時A・11時D・13時E・14時C・15時B
- 10時E・11時A・13時D・14時B・15時C
1回目は26.2秒・699字で、この3通りを過不足なく挙げました。AさんとDさんが並ぶ枠の組を先に絞り、組ごとに残りの人を当てはめる順で解いています。11時のDさんのすぐ次が13時なのでCさんを13時に置けない、という引っかけの条件も守っていました。

2回目は23.0秒・924字で、答えは4通りでした。正しい3通りに、10時E・11時A・13時D・14時C・15時Bの1つを足しています。この割り当てはDさんが13時でCさんが14時なので、CさんとDさんを続いた枠に並べないという6つ目の条件に反します。

2回目の答えをたどると、どこで抜けたかが分かります。AさんとDさんが10時と11時の組では、Cさんを13時に置くと11時のDさんと続くので外していました。ところがAさんとDさんが11時と13時の組では、13時のDさんと14時のCさんが続くことを見落としています。同じ条件を、ある組では確かめて別の組では確かめていませんでした。
7回の秒数と答え合わせを並べると2回とも合ったのは決算PDFだけだった
7回の結果を1つの表にまとめます。秒数は23.0〜26.5秒の間に収まり、課題による差は目立ちませんでした。文字数は291字から924字まで開きがあります。
Copilotに送った7つの文の結果
| 送った文 | 会話 | かかった秒 | 答えの文字数 | 答え合わせ |
|---|---|---|---|---|
| 売上CSVの3つの問い(1回目) | 会話1 | 26.5秒 | 438字 | △ 1位と伸び率は正解・合計は書かず |
| 同じ会話で検算を頼む | 会話1 | 23.1秒 | 796字 | × 正しい商品Dを86,000に直した |
| 売上CSVの3つの問い(2回目) | 会話2 | 26.1秒 | 291字 | △ 合計を558,700千円と答えた |
| 決算PDFのEC比率(1回目) | 会話3 | 23.0秒 | 586字 | ○ 38.6%・2027年度に42.3% |
| 決算PDFのEC比率(2回目) | 会話4 | 26.1秒 | 681字 | ○ 38.6%・2027年度に42.3% |
| 面談の割り当て(1回目) | 会話5 | 26.2秒 | 699字 | ○ 3通り |
| 面談の割り当て(2回目) | 会話6 | 23.0秒 | 924字 | × 4通り(1つは条件に反する) |
答え合わせでは、全部合っていたのが3回、一部だけ合っていたのが2回、誤りが2回でした。同じ文を2回送った3つの課題のうち、2回とも全部合ったのは決算PDFの試算だけです。売上CSVは2回とも一部だけで、面談の割り当ては1回目だけが正解でした。
文字数と正しさにも決まった関係は見えません。いちばん長い924字は面談の2回目で、これは誤りでした。いちばん短い291字は売上CSVの2回目で、合計がずれています。答えの長さや速さからは、中身が正しいかどうかは読み取れませんでした。
表の△は、3つの問いのうち一部だけが合っていた回です。売上CSVの2回はどちらも1位と伸び率の2つが合い、合計の問いで答えが分かれました。×の2回は検算と面談の2回目です。検算は合っていた数字を誤りに直し、面談は条件に合わない割り当てを1つ足しました。○の3回は、答えの数字も結論も編集部の正解とそろっています。
Think Deeperは公式ヘルプで最大10秒考えるモードとされ使う回数に制限はない
Think Deeperについて、公式ヘルプが書いていることをまとめます。より思慮深い答えを返すモードで、答えまでに最大10秒かかるとあります。使っているのはOpenAIの最新の推論モデルで、複雑な話題の掘り下げや細かい問題解決に向くという説明です。

回数については、Think Deeperの使用は制限されないと書かれています。混み合っているときは、Microsoft 365のPersonal・Family・Premiumの利用者が優先して使えるそうです。Smartは誰でも使えるモードで、GPT-5を使って課題に合わせて深くも速くも考えると説明されています。一部のモードはサインインしているときだけ使える場合がある、という注記もあります。
2026年10月2日の画面には、この一覧に無い「自動」が出ていました。自動の中身はヘルプに書かれていないので、Smartと同じものかは分かりません。今回の検証で言えるのは2つです。新しいチャットを開いたときの表示が「自動」だったことと、その状態での7回の結果です。Think Deeperで同じ課題がどうなるかは、今回は比べられていません。
公式の説明と今回の結果を合わせると、モードを選ぶ目安は見えてきます。資料の数字を拾って式を当てる計算は、既定の自動でも2回とも合いました。12か月分を足し上げる集計や条件を全部当てはめる問題は、自動のままでは答えがそろいませんでした。こうした課題は推論に時間をかけるThink Deeperを試す候補になります。ただしモードを変えても、答えを確かめる手間は残ります。
Copilotの自動に計算を任せるときの注意点は3つある
今回の7回から、Copilotに計算を任せるときに気をつけることを3つにまとめます。どれも実際の答えで起きたことから決めました。

1. 同じ文を2回送って答えを比べる
売上CSVと面談の割り当ては、同じ文でも2回目に答えが変わりました。1回だけ送って出た答えを使うと、どちらの答えに当たるかで結果が変わります。新しい会話でもう1回送り、2つの答えが食い違った所だけを元のデータで確かめます。これなら手間を抑えて誤りを拾えます。決算PDFのように2回とも同じ答えでも、式の数字を1つは資料と照らしておくと安心です。
2. 検算はAIに任せず元のデータで照らす
同じ会話で検算を頼んだ回は、合っていた88,000千円を86,000千円に直しました。足し算の式まで付いていたので、読むだけでは誤りに気づきにくい答えです。検算を頼むなら、AIが直した数字だけでもCSVやExcelで計算し直してください。今回の例なら、商品Dの列を表計算ソフトで合計すれば正しい88,000がすぐに出ます。
3. 条件の多い答えは1つずつ全部の条件に当て直す
面談の割り当ての2回目は、6つ目の条件を一部の組で確かめていませんでした。答えに場合分けが並んでいても、全部の組で全部の条件を確かめたとは限りません。出てきた割り当てを1つずつ取り出し、6つの条件に合うかを自分で確かめると誤りが見つかります。数が多いときは、どの条件で外れるかをCopilotに聞き直す手もあります。この聞き直しは今回は試していません。
関連する記事とツール
- Microsoft Copilotの料金やできることをまとめたツールのページ
- 同じ連載で最新の情報を聞いて試したCopilotの検索機能の使い方
- ChatGPTで考える時間の長いモードを試したChatGPTのThinkingの使い方
- Copilotの無料版と有料版の違いをまとめた記事
Copilotの「自動」は7回とも26.5秒以内に答えを返し、決算資料の数字を拾って式を当てる計算は2回とも正確でした。一方で12か月分の足し上げや条件の多い組み合わせでは、同じ文でも答えがそろいませんでした。特に気をつけたいのは、検算を頼んだら正しい数字を誤りに直したことです。仕事で使うなら同じ文を2回送って食い違いを見つけ、その所だけ元のデータで確かめる使い方をおすすめします。Think Deeperを選ぶ場合も、この確かめ方は変わりません。
- CopilotのThink Deeperはどうやって選びますか?
- 公式ヘルプでは、送る前にモードを選んで有効にします。プロンプトの下の[クイック応答]を押し、出てきたモードからThink Deeperを選ぶ手順です。選んだモードは自分で外すまで続きます。2026年10月2日にAInformation編集部が開いた画面では入力欄の下にこの表示が無く、会話の上に「自動」と出ていました。この検証では「自動」の中のメニューまでは確かめていません。
- Copilotのデフォルトのモードは何ですか?
- 2026年10月2日の画面では、新しいチャットを開いたときの表示は「自動」でした。6つの会話を開き直しても毎回「自動」から始まっています。公式ヘルプは迅速な応答・さらに深く考える・勉強して学ぶ・スマート・検索の5つを挙げていて、「自動」の名前は載っていません。自動がSmartと同じものかは、この検証では分かりませんでした。
- Copilotに同じ質問をすると答えは毎回同じですか?
- 同じになるとは限りません。既定の「自動」で同じ売上CSVと同じ文を別の会話で2回送ると、2回目は5商品の合計を558,700千円と答えました。正しくは558,900千円です。面談の割り当ても1回目は正解の3通りで、2回目は4通りでした。決算PDFの比率の試算だけは2回とも合っています。大事な計算は2回送って比べ、食い違った所を元のデータで確かめてください。
- Copilotに検算を頼めば計算の誤りは直りますか?
- 直るとは限らず、正しい数字が誤りに変わることもあります。同じ会話で検算を頼むとCopilotは23.1秒で答え、商品Dの年間合計を正しい88,000千円から86,000千円に直しました。式に並べた12か月の数字はCSVと同じだったのに、合計だけが違っていました。検算は答えを読むだけで済ませず、表計算ソフトなどで元のデータから計算し直すのが確実です。
- Think Deeperに回数の制限はありますか?
- 公式ヘルプは、CopilotでのThink Deeperの使用は制限されないと書いています。混み合っているときは、Microsoftの個人向けサブスクリプション(Personal・Family・Premium)の利用者が優先して使えるという説明です。一部のモードはサインインしているときだけ使える場合がある、とも書かれています。今回の検証の画面には、残り回数の表示は見当たりませんでした。
