東海AI実践塾

ChatGPT・Claude・Geminiを業務で比較する観点

  • #ChatGPT Claude Gemini 比較
  • #最新機能の断定より文章、調査、ファイル、管理、安全の評価方法を示すための具体策を探している
  • #関連記事

比べるのは製品名ではなく、一つの仕事

ChatGPT、Claude、Geminiを業務で比較するとき、一般的な「一番」を探しても自社の答えにはなりません。文章の滑らかさ、根拠の扱い、ファイルで受け渡す手間、管理のしやすさ、安全条件は別々に見る必要があります。そこで、架空の卸売会社「東海みのり商事」が営業会議メモを受注確認表へ変える一業務だけを試すことにします。以下の数値と出力は手順を示すための完成見本であり、実在企業の試験結果や各製品の優劣ではありません。

公式情報の確認箱(2026年7月26日時点) 提供機能、対応形式、料金、入力データの取扱い、保存・削除、学習利用、管理設定は、製品、プラン、地域、契約形態で異なり、変更もあり得ます。試行前と契約・更新前に、候補プランの公式ドキュメント、利用規約、プライバシー情報、管理者向け情報を担当者が確認し、確認日と参照先を決定記録に残します。本稿は現在の機能を保証しません。

卸売会社の試行カードを完成させる

試行日は2026年7月26日、対象は「会議メモから決定・未決事項を抜き出す作業」とします。入力を許可するのは、責任者が承認した次の架空メモだけです。顧客名、個人情報、実価格、未公開の商品情報は含めません。

承認済みサンプル入力

7月営業会議。冷凍枝豆30箱は8月5日に北浜店へ納品する。配送担当は佐藤。米油20箱は仕入先の在庫回答待ちで、田中が7月29日までに確認する。乾麺40箱は単価未確定のため保留。鈴木が価格表を確認するが期限は未定。納品書の様式は現行版を使う。次回会議は8月1日。

三つの候補には、新しい会話で同じ文章をそのまま渡します。追加質問や再生成は一回目の採点が終わるまで行いません。

全候補へ渡す正確な指示

次の会議メモだけを根拠に、業務確認表を作成してください。出力項目は「区分、案件、状態・数量、担当者、期限、根拠となる原文」です。区分は「決定」か「未決」とし、書かれていない担当者や期限は「記載なし」としてください。推測や補完はせず、最後に「要確認点」を箇条書きで示してください。

期待する行は、冷凍枝豆の納品、米油の在庫確認、乾麺の単価確認、納品書様式の四件です。期待する出力項目は指定した六列と要確認点。次回会議日は案件ではないため表外とし、要確認点に置けます。採点担当は製品名を隠し、出力を無作為にA、B、Cと表示します。匿名化を担当した人は採点に参加しません。

五つの軸で、見た目より確認負担を測る

各軸を5点満点、合計25点で採点します。文章は指示した列・区分・表現を守るか、調査は原文へ戻れて推測を混ぜないか、ファイルは所定の表へ転記して崩れないか、管理は試行用アカウントの付与・変更・停止を社内担当が確認できるか、安全は承認外データを入れず、候補プランの取扱条件が社内基準を満たすかです。安全が3点未満、または架空の期限・担当者を一件でも追加した場合は、合計点にかかわらず不合格とします。

匿名出力文章調査ファイル管理安全合計判定
A5543421条件付き合格
B4354420不合格
C4435521条件付き合格

これは記入例です。評価者コメントは、A「四件を正しく分離。表の転記で列幅調整が一回必要」、B「乾麺の期限を7月29日と補完したため失格」、C「根拠引用は正確。乾麺と価格確認を別行にしたため人が統合」と残しました。「読みやすい」だけで終えず、何をどの原文で確かめ、どの修正が必要だったかを書きます。

原文照合と人の訂正を一行で残す

事実確認では、各出力の案件、数量、担当者、期限をサンプル入力の該当文へ一本ずつ結びます。外部情報は使わない課題なので、引用元は承認済みメモだけです。公式資料で確かめるのは出力内容ではなく、候補プランのデータ取扱いと管理条件です。情報源の役割を混ぜないことで、文章品質と契約適合性を分けて判断できます。

人の訂正例は「Cの『未決|乾麺40箱|単価未確定|鈴木|記載なし』と『未決|価格表確認|確認予定|鈴木|記載なし』を一行へ統合。原文『乾麺40箱は単価未確定のため保留。鈴木が価格表を確認するが期限は未定』に照合」とします。修正前後、理由、確認者、所要時間を残せば、正解率だけでなく実務負担も比較できます。

意見が割れたときの決定フロー

現場担当はAの少ない修正を評価し、管理者はCの運用確認を評価したとします。この差は平均点で消しません。

停止条件を確認 → 原文誤りを優先 → 管理・安全条件を確認 → 同点なら確認時間の短い候補 → なお同点なら同じ課題を別の評価者で再試行

再試行では入力、指示、候補プランを固定します。前回と条件を変えた場合は「条件変更による差」、条件を固定して採点者だけ替えた場合は「評価者による差」として記録します。これなら、何が結果を動かしたのかを混同しません。

決定記録から運用を始める

この見本の決定記録は「営業会議メモ整理にはAを条件付き採用。承認済みの架空・公開情報だけで開始し、人が原文照合してから転記する。Bは存在しない期限を補ったため不採用。Cは管理面の予備候補。責任者は営業部長、運用確認は情報管理担当、再評価日は2026年10月26日。契約前確認が未完なら開始しない」です。実際には匿名ラベルを製品名と候補プランへ戻し、採点表、評価者コメント、公式情報の確認日、参照先、例外条件を一緒に保管します。

採用後も、誤り、確認時間、人の修正、問い合わせ、権限変更を同じ表へ追記します。一度の試行で全用途を任せず、合格した業務と入力範囲だけを運用対象にします。試行終了時には不要なアカウントを停止し、テスト資料と共有設定が残っていないことを管理者が確かめます。

ChatGPT、Claude、Geminiの比較に永続的な一位はありません。自社の課題と合格条件を固定し、変わり得る製品条件を契約前や更新時に確認することが、納得できる選定につながります。関連記事として周辺のツール選定記事も参照し、まずは実際の一業務について試行表を一枚作るところから始めてください。