AI News Analysis · Vol.15

OpenAI Presence発表を企業はどう読むか|
提供条件と導入前の4項目

発表事実とOpenAI自身の事例を分け、導入前に決める4項目まで整理する

updated 2026.08.03
read 3 min
ガバナンス 生成AI活用
author
五月女 裕太 ビジョン・コンサルティング
AI Center of Excellence 所属
AI コンサルタント

生成AIコンペ2年連続最優秀賞(日経・日刊工業新聞ほか掲載)/AWS Summit 2025事例ブース登壇/AWS主催生成AIセミナー2025 2度登壇など、業界トップを走るAIエキスパート。

このAIコンサルタントに相談する
answer

OpenAIは2026年7月22日、電話・チャットで顧客や従業員に対応する企業向けAIエージェント「Presence」を発表しました。競争軸が「答えられるか」から「権限・承認・人への引き継ぎを含め、安全に仕事を完了できるか」へ広がったため、導入前に対象業務・許可操作・引き継ぎ条件・評価方法を決める必要があります。

This article is for you

この記事は、こんな経営層・責任者の方に向けています

次のどれかに心当たりがあれば、本記事の整理をそのまま導入準備のたたき台にできます。

  • DX推進部門
  • カスタマーサポート責任者
  • 情報システム部門
  1. 発表記事を読んでも、従来のチャットボットと何が違うか説明できない
  2. 電話・チャット対応をAI化したいが、AIに任せてよい操作の境界が決まっていない
  3. 「75%自動化」の数字を自社にも当てはめてよいのか判断できない
  4. 製品が一般提供されたらすぐ試すべきか、今できる準備から始めるべきか迷う
01

何が発表されたか

Presenceは、企業の顧客対応や社内支援を電話・チャットで行うAIエージェントです。企業がポリシー、実行してよい操作、承認、人へ渡す条件を設定し、シミュレーションと評価を繰り返して改善する設計が発表されています。

OpenAIの2026年7月22日の公式発表によると、Presenceは会話を返すだけでなく、企業の業務システムやルールにつながり、顧客・従業員の依頼を処理するためのエージェントです。会社側がポリシーと許可する操作を定め、必要な場面では承認を求め、人へ引き継ぎます。展開前後にはガードレール、シミュレーション、評価を使い、運用データから改善を続ける考え方が示されています。

ただし、誰でも今すぐ契約できる一般的なSaaSとして発表されたわけではありません。OpenAIは、対象となる企業顧客への限定的な一般提供と説明したうえで、まだセルフサービス型の製品としては提供していないと明記しています。導入は、OpenAIのForward Deployed Engineers(企業の現場で導入を支援する技術者)と、選定されたグローバルシステムインテグレーターが主導します。利用可能地域、価格、標準機能の詳細は、発表ページだけでは確定できません。

basis

2026年8月3日時点の確認。Presenceの提供条件は、7月22日の公式発表から変更を確認できませんでした。OpenAIは7月31日に、モデル単価だけでなく、再試行・人の確認・エラーを含む「成果を完了する総コスト」でAIを評価する考え方を示しています。本記事の4項目も、導入後の成果と安全を同時に測るための準備として位置づけます。

発表で示された企業向けエージェントの構成 fig_01 · presence_structure
  • 顧客・従業員
  • Presence
  • 業務システム
  • 会社のポリシー
  • 承認・人への引き継ぎ
  • 評価・改善
  1. 電話またはチャットで依頼する
  2. 照会・更新・処理を実行する
  3. 許可する操作と境界を定める
  4. 人が判断する条件を決める
  5. シミュレーションと実績で改善する
ニュースの本質は新しい会話画面ではなく、企業の権限・承認・評価を業務実行の周囲に置いたことです。

図はOpenAI公式発表の記述をもとにビジョン・コンサルティングが構造化したものです。製品の内部構成を示すものではありません。

02

なぜ企業にとって重要か

重要なのは、AIが答えを作るだけでなく、顧客情報を見て処理を実行する段階へ進む点です。便利さと同時に、誤操作、権限逸脱、説明責任のリスクも増えます。導入の主役はモデル選びではなく、業務と統制の設計になります。

従来のFAQボットなら、誤回答の主な影響は「間違った案内」です。業務を実行するエージェントでは、予約変更、返金、契約情報の更新、社内申請など、現実の状態が変わり得ます。だから、回答精度だけを測っても不十分です。

どのデータを参照できるか、どの操作は自動でよいか、金額や顧客属性によって人の承認へ切り替えるか、失敗時に誰が止めるかまで設計します。ここを決めずに製品を選んでも、本番判断の材料はそろいません。

この方向性は、OpenAIが2026年2月に発表したFrontierともつながります。Frontierは企業の共有コンテキスト、ツール、評価、エージェントのID・権限・境界を扱う基盤として説明されています。Presenceは、その基盤上で電話・チャットの業務を担う具体的なエージェント層と読むと理解しやすいでしょう。

前段落のPresenceとFrontierの関係は、公式2資料を組み合わせた本記事の解釈です。製品構成や契約形態の保証ではありません。

03

発表された数字をどう読むか

PresenceはOpenAI自身の英語電話サポート窓口を支えており、受信した問い合わせの75%を人に渡さず解決している、とOpenAIは報告しています。また、Codexを使った改善ループにより、10日間で人への引き継ぎ率を15パーセントポイント下げたとしています。ただし、これはOpenAI自身の事例であり、他社でも同じ成果が出るという予測値ではありません。

OpenAIが自社事例として報告した2つの結果と、その観測期間 fig_02 · openai_internal_result
75% Presenceが人に渡さず解決した問い合わせの割合 OpenAI · 2026-07-22 announcement
15ポイント Codexの改善ループで人への引き継ぎ率が下がった幅 OpenAI · 2026-07-22 announcement
10日間 その変化を観測した期間 OpenAI · 2026-07-22 announcement
2つの結果と、その観測期間です。いずれもOpenAI自身の英語電話サポート窓口で観測されたもので、15パーセントポイントの低下はCodexによる改善ループを回した結果です。他社での再現を示す予測値ではありません。

数字を読むには、対象業務、問い合わせの難しさ、解決の定義、観測期間、母数が必要です。公式発表ページから読み取れるのは、OpenAI自身の英語電話サポートという文脈と、75%、15パーセントポイント、10日間という結果だけです。すべての企業・言語・業務で再現するとは書かれていません。

日本語で同じ結果が出るかは、発表ページからは分かりません。分かるのは、SoftBankが自然な日本語による顧客との会話をテストしていると記されていることだけです。ほかに、金融のBBVAがメキシコでの音声サポートを、航空のIAGが悪天候など需要が急に高まる場面での対応を模索しているとあります。いずれも検討・テストの段階として書かれており、結果の数値は公表されていません。

また「75%」はコスト削減率でも顧客満足度でもありません。自社で使う場合は、解決率だけでなく、誤処理率、再問い合わせ率、人への引き継ぎ後の修正量、顧客満足、重大事故を同時に測る必要があります。

発表された数字から確認できること・できないこと fig_03 · number_reading
metricconfirmednot_confirmed
問い合わせの75%OpenAIが自社の英語電話サポート窓口で人へ渡さず解決した割合として報告他社での再現率、費用削減率、顧客満足度
15パーセントポイント減OpenAIがCodexを使った改善ループの10日間の効果として報告引き継ぎを減らすこと自体が品質向上かどうか
10日間上記の変化を観測した期間長期安定性、繁忙期、業務変更時の性能
数字は結果の報告であり、対象業務・母数・解決の定義が変われば別の値になります。

列は順に、発表された数字/公式発表から確認できること/公式発表からは確認できないことです。「確認できないこと」は否定ではなく、発表ページの範囲では判断材料が無いという意味です。

04

導入前に企業は何を決めるか

VC実務整理

製品を待つ間に、対象業務、AIに許可する操作、人へ渡す条件、合否を決める評価指標を定義できます。この4点が曖昧なままでは、製品デモが成功しても本番判断へ進めません。まず1つの業務で書き切ります。

製品の利用可否を待たずに決められる4項目 fig_04 · pre_adoption_4
  1. 対象業務 開始と完了が分かる単位まで絞る 「問い合わせ対応」では広すぎます。「パスワード再設定の案内」「配送状況の照会」のように、開始条件と完了状態が分かる単位にします。
  2. 許可する操作 読む・書く・実行の境界を分ける 読むだけ、下書きまで、更新まで、金銭を伴う処理、の境界を分けます。操作ごとに参照データと権限を最小化します。
  3. 人へ渡す条件 AIが止まる条件を先に決める 本人確認に失敗、例外規定、一定金額以上、怒りや苦情、回答確信度の低下など、AIが止まる条件を先に決めます。
  4. 評価指標 価値と安全を同時に測る 解決率だけでなく、誤処理、再問い合わせ、修正時間、顧客満足、重大事故をセットで測ります。改善しても安全指標が悪化した場合は広げません。
話題性を理由に製品から入らず、業務と判断条件を先に固定します。製品選定はその後です。
4項目を書き切ったあとの2つの結論 fig_05 · start_decision
go_pilot 小規模検証へ進む 対象業務・許可操作・引き継ぎ・評価を説明でき、失敗時に止める責任者が決まっている。実データを使わない小規模検証で、成功条件と停止条件を同時に試す。
back_to_design 業務設計へ戻る 4項目のどれかが空欄。製品デモの前に、業務責任者と一緒に定義し直す。
4項目を1枚で説明でき、失敗時に止める責任者が決まっていれば小規模検証へ進みます。どれかが空欄なら、製品比較ではなく業務設計へ戻ります。

次の行動は1つです。最も件数が多く、処理が定型で、間違えたときに取り消せる問い合わせを1つ選び、4項目をA4一枚に書いてください。Presenceの提供条件が自社に合うかは、その後にOpenAIへ確認します。

05

よくある質問

Presenceは今すぐ誰でも使えますか?Q1

いいえ。公式発表は、まだセルフサービス型の製品としては提供していないと明記しています。対象となる企業顧客への限定的な一般提供で、導入はOpenAIのForward Deployed Engineersと、選定されたグローバルシステムインテグレーターが主導します。価格・地域は発表ページだけでは確定できないため、OpenAIへ確認が必要です。

自社でも75%の問い合わせを自動化できると見込んでよいですか?Q2

いいえ。OpenAIが自社の英語電話サポート窓口で報告した結果です。自社の業務では、対象・母数・解決定義を固定して小さく測り直します。

従来のチャットボットとの一番大きな違いは何ですか?Q3

発表上の違いは、会話に加えて業務システムを使った操作、会社のポリシー、承認、人への引き継ぎ、評価改善を一体として扱う点です。実際に使える範囲は個別導入で確認します。

06

出典と調査方法

  1. OpenAI, Introducing OpenAI Presence(2026-07-22) — 提供内容、統制、社内事例、提供範囲
  2. OpenAI, Introducing OpenAI Frontier(2026-02-05) — 共有コンテキスト、ツール、評価、ID・権限・境界
  3. OpenAI, Building abundant intelligence(2026-07-31) — 成果を完了する総コストでAIを評価する考え方
  4. NIST AI Risk Management Framework — AIリスク管理の参照枠組み

本記事は2026年7月22日の発表を、2026年8月3日時点の公式公開情報で再確認したニュース解説です。速報ではなく、企業が導入前に決める事項を整理することを目的としています。OpenAIの発表事実と、ビジョン・コンサルティングによる導入上の解釈・提案を区別して記載しています。製品仕様、提供地域、価格は変更される可能性があります。

Vision Consulting

PoCを「技術実験」で終わらせず、経営判断まで設計する。

対象業務の選定、現状値の計測、評価設計、ガバナンス、本番移行判定を一つの意思決定プロセスとして整理します。

share