CHATGPT ADS GUIDE 16 / テスト運用

2026年9月最新版

ChatGPT広告のテスト運用|続ける・直す・止める・保留の判断基準

ChatGPT広告のテストは、配信・クリック後・事業成果の3段階に分けて判断します。開始前に決めること、判定日の置き方、母数が足りないときの「保留」の扱い、予算週や反映時間などテスト中に効く仕様を、公開事例とあわせて整理します。

掲載事例は他社の公開情報に基づくもので、当社の運用実績ではありません。判断の基準や数値の目安は株式会社Ikigaiの提案で、成果を保証するものではありません。

この記事の要点

  1. 判断は「配信」「クリック後」「事業成果」の3段階に分けます。 段階ごとに判定日と条件を開始前に決めておくと、途中で迷いません。
  2. CPCや問い合わせ単価だけで増額を決めません。 公開事例には、問い合わせ単価はGoogle検索広告より安かったのに、顧客獲得単価はGoogle検索広告の方が低かったという報告もあります。母数が足りないときは「保留」を選択肢に入れます。
  3. 変更は1回に1つにし、記録を残します。 予算週や数字の反映の遅れを踏まえて判定日を置かないと、仕様による動きを成果の変化と取り違えます。

読んでほしい人:ChatGPT広告のテストを始める、または始めたばかりの広告担当者。
この記事で扱わないこと:予算額の決め方は費用の記事、社内向けの提案書のまとめ方は社内提案の記事で扱います。

開始前に決める6つのこと

テストが終わってから「何を確かめたかったのか」を考えると、都合のよい指標を選んでしまいます。配信を始める前に、次を1枚にまとめます。

項目

決める内容

例

確かめたいこと

この媒体で何が分かれば次に進めるか

「比較検討中の人から、既存媒体並みの単価で問い合わせが取れるか」

主要な成果と定義

何を1件と数えるか

無料相談フォームの送信完了(資料請求は別に集計)

判定日

いつ、誰が判断するか

開始7日後・14日後・30日後。判断者は広告責任者

判断の条件

続ける・直す・止める・保留の条件

下の「判断表」

予算の上限と停止条件

使ってよい総額、止める条件

総額10万円まで。日予算を超える日が続いたら、予算週の枠の残りを確認する(1日2倍までは仕様の範囲)

記録の方法

変更と結果をどこに残すか

変更ログ表と週1回のレビュー

公式のFAQは、ChatGPT広告には広告主・業種・キャンペーン種類をまたいだベンチマークがまだないと明記しています。他社の数字を合格ラインに使うのではなく、自社の既存媒体の数字を比較の基準に置きます。

3段階で判断する

図1:テストの判断は3段階に分ける。公式ヘルプの仕様と公開事例をもとに当社作成。判定日は例です。
図1:テストの判断は3段階に分ける。公式ヘルプの仕様と公開事例をもとに当社作成。判定日は例です。

段階1:配信(目安は開始から7日)

見るのは、表示回数・消化額・予算の消化ペースです。ここでは「配信が回っているか」だけを確かめます。

  • 公式は、新しく始めたキャンペーンで配信が確認できず、明らかな原因も見当たらない場合、少なくとも24時間は待ってから配信の問題として扱うよう案内しています。明らかなエラーや、請求・審査の問題が表示されている場合は、待たずにサポートへ連絡します
  • 表示・クリック・CTRは約15分ごとに更新されますが、消化額は約7〜8時間遅れ、CPCやCPMはさらに後で確定します。コンバージョンの反映には24〜48時間かかることがあります
  • 日予算は7日間の平均として扱われ、1日の上限は日予算の2倍です。予算週(日曜〜土曜)の枠を早く使い切ると、有効のまま次の週まで止まり得ます(詳しくは配信されないときの記事)

配信が出ない場合の確認順は配信されないときの記事にまとめています。

段階2:クリック後(目安は14日)

見るのは、クリックがサイトに届いているか、LPで予定した行動が起きているかです。

  • 広告のクリック数と、GA4などのサイト側のセッション数を比べます。公式も、クリックとセッションは読み込み・リダイレクト・同意設定・ブラウザの制限などで一致しないと説明しています
  • 開発者向けAPI企業Qは、クリックがサイトのセッションになった割合を、クリックの先を評価する指標の1つにしました(ChatGPT広告は70%超と報告。詳しくはB2B事例の記事)
  • 反対に、英国のマーケ支援会社Yは43クリックを得たものの、サイト訪問を確認できていないと書いています(出典を確認)

クリック後に何が起きているかが分からないまま、段階3の判断には進めません。計測の確認方法は効果測定の記事で扱っています。

段階3:事業成果(目安は30日以降)

見るのは、問い合わせ・購入の件数と単価、さらに可能なら有効な商談・受注・売上です。

米国の広告支援会社Vは、B2B企業の30日間で、ChatGPT広告の問い合わせ単価はGoogle検索広告より低かった一方、顧客獲得単価はGoogle検索広告の方が低かったと報告しています。最終的な受注数はまだ確定していないとも書いています(数字と注意点はB2B事例の記事)。

この例のように、問い合わせ単価だけを見ると、正反対の判断をすることがあります。 B2Bや高額商材では、段階3の判定日を営業期間に合わせて後ろに置くか、「30日時点では受注未確定」と明記したうえで判断します。

判断表:続ける・直す・止める・保留

以下は当社がテスト設計で使う判断表の例です。数値は商材と予算に合わせて決め直してください。

判断

条件の例

次の行動

続ける(広げる)

主要な成果が既存媒体の許容単価に収まり、件数も判断に足りる

予算を段階的に増やす、同じ型で相談場面を増やす

直す

配信・クリックは出ているが、クリック後か成果の段階で止まっている

止まっている段階の要素(LP、広告文、成果の定義)を1つだけ変える

止める

十分な件数を集めても許容単価に届かない、または審査・計測の問題が解消できない

停止し、学びを記録する。再開の条件を書いておく

保留

件数が少なく、良し悪しを判断できない

期間か予算を延ばすか、判断を先送りする理由を記録する

「保留」を判断の選択肢に入れておくことが、少額テストでは特に大切です。当社は目安として、比べる対象(広告や期間)ごとに、クリックが100件に届かないうちはCTR・CVRの優劣を、成果が10件に届かないうちは獲得単価の優劣を断定しないことを勧めています。

母数が小さいときの読み方

公開例

結果

読み方

オーストリアの広告支援会社U(自社集客、2026年9月5日開始・9月時点の掲載値。随時更新)

€48.57、3,063表示、18クリック、問い合わせ0件

本人も「0件は結論ではなく、数が小さすぎる」と書いている。止める根拠にも続ける根拠にもならない

ドイツの語学学校S(運用は広告支援会社)

1週間で€100.14、成果1件

運用者自身が「2件目が取れていればCPLは半分」と注意している。1件の単価は大きく揺れる

NZのマーケ支援会社Z(自社集客)

9日間で30クリック、成果の計測は未導入

成果0件ではなく未計測。計測を入れるまで段階3の判断はできない

出典:広告支援会社U、語学学校S、マーケ支援会社Z

テスト中に効いてくる仕様

判断を誤りやすい仕様をまとめます。

仕様

テストへの影響

新規の広告グループでは、入札方法の既定が「成果を最大化(Maximize results)」

予算内で件数を増やす設定で、CPA・CPC・ROASの目標達成は保証されない。上限を決めたいときは手動の上限入札を選ぶ

成果最適化は1キャンペーンにつき標準イベント1つ。カスタムイベントは使えない

最適化するイベントは作成後に変えられない。発生が少なすぎるイベントは評価しにくいと公式も書いている

成果最適化の表示課金は、2026年9月25日時点で「ベータ、提供を急速に拡大中」

使えるかはアカウントごとに確認する。クリック課金から表示課金へは、キャンペーンの複製で移行する

ベータ期間中は配信や消化額が変動し得る。成果最適化の目的は予算を使い切ることではなく成果の改善(公式)

予算を使い切らない日があっても不具合とは限らない。消化額より成果の推移で判断する

広げるときの進め方

公開事例では、結果を確かめながら配信を広げた例が報告されています。いずれも広告主の自己報告です。

  • 住宅サービス仲介ABは、屋根・便利屋・空調など約20のカテゴリで試験を始めました。日予算・クリック課金・成果最適化キャンペーンを順に使い始め、成果最適化キャンペーンで結果が大きく変わったことを受けて、30近いカテゴリを追加したと報告しています。成果最適化の開始以降、問い合わせ単価は34%下がったとしていますが、期間と件数は公表されていません(出典を確認(住宅サービス仲介ABの事例))
  • AI語学学習アプリPは、キャンペーンを地域別に分け、学習の目的ごとに広告グループを作りました。新しい国で配信できるようになると、通常1〜2日で追加したと説明しています(出典を確認(AI語学学習アプリPの事例))
  • フォーム作成SaaS ACは、4月の開始以降、キャンペーン設定・入札・広告・成果イベント・LPなどで100回を超える最適化を行い、月額の投資を変えずに有料流入が3.4倍になったと報告しています(出典を確認(フォーム作成SaaS ACの事例))

3社とも、結果を見ながら配信の単位(カテゴリ・地域・広告)を増やしたと報告していますが、どこまで確かめてから広げたかは公表されていません。広げる幅と速さも事例によって違います(当社の整理)。住宅サービス仲介ABは30近いカテゴリを追加し、AI語学学習アプリPは新しい国に1〜2日で広げています。自社で試す場合は、どの単位(相談場面・地域・カテゴリ)で広げたかを記録しておくと、後から効果を分けて確かめやすくなります(当社の提案)。

改善の順番

止まっている段階から直します。複数を同時に変えないのが原則です。

  1. 表示が出ない → 審査、予算週、入札、地域・対象の広さ(配信されないときの記事)
  2. 表示はあるがクリックが少ない → 広告文・画像・相談場面の選び方(広告文・画像・LPの記事)
  3. クリックはあるが成果がない → LPの到達、フォーム、計測(成果が出ないときの記事)
  4. 成果はあるが質が低い → 成果の定義、LPで求める行動、相談場面の選び方

この記事で分からないこと

  • 自社の商材で何日・何件あれば判断できるか。 成果の発生頻度と単価で変わります。判断表の数値は例です
  • 公開事例の改善が、どの変更によるものか。 事例の多くは、複数の変更を重ねた結果として報告されています
  • 成果最適化の表示課金が、日本のアカウントでいつ使えるか。 公式はベータとしており、提供状況はアカウントごとの確認が必要です

記録のテンプレート

変更ログ

日時

対象(キャンペーン/広告グループ/広告)

変更前

変更後

理由

実行者

週1回のレビュー

週

表示

クリック

サイト到達

主要な成果

有効な成果(商談・購入など)

判断(続ける/直す/止める/保留)

次に変えること

同じ日に2か所を変えた場合は、次のレビューでどちらが効いたかを断定しないでください。

よくある質問

Q. テスト期間は何日が適切ですか。 当社の目安は、配信の確認に7日、クリック後の確認に14日、成果の判断に30日です。公式の基準はありません。成果の発生が遅い商材では判定日を後ろにずらすことを勧めています。

Q. CPCが安いので、すぐ増額してよいですか。 クリック後の到達と成果を確かめてからにしてください。問い合わせ単価が安くても、受注に至る割合が低ければ、顧客獲得単価は高くなることがあります。

Q. 最初から成果最適化を使うべきですか。 成果イベントが正しく送られていて、ある程度の件数が見込めるなら選択肢になります。公式は、発生が少なすぎるイベントは評価しにくく、最適化するイベントは作成後に変えられないとしています。件数が見込めない少額テストでは、クリック目的で始めて計測だけを先に動かす方法もあります。

Q. テストの途中で広告を追加してもよいですか。 追加してかまいませんが、変更ログに残してください。追加した日を境に数字が変わった場合、追加の影響なのか、予算週や反映の遅れなのかを区別する必要があります。

Q. 成果が0件のまま30日たったら、止めるべきですか。 まず、計測が正しく動いていたか、クリックがサイトに届いていたかを確かめます。計測が動いていなかったなら「0件」ではなく「未計測」です。計測が正しく、十分なクリックがあっても成果がないなら、止めるか、LPと相談場面を変えて再テストするかを判断します。

まとめ

  • 判断は「配信」「クリック後」「事業成果」の3段階。判定日と条件を開始前に決める
  • 他社の数字ではなく、自社の既存媒体の数字を比較の基準に置く
  • 問い合わせ単価だけで判断しない。受注までの距離が長い商材は判定日を後ろにずらす
  • 母数が小さいときは「保留」を選ぶ。0件と未計測を区別する
  • 変更は1回に1つ。予算週と反映の遅れを踏まえて数字を読む

テストの判断表や記録の形を自社の商材に合わせて作りたい場合は、既存媒体の成果の数字をお手元に用意のうえ20分の無料相談をご利用ください。

出典

いずれも2026年9月25日に本文を確認しています。事例の数値は各社が公表した条件での結果です。

変更履歴

日付

内容

2026年9月25日

初版。公式ヘルプ6本と公開事例9件を本文確認。成果最適化の表示課金がベータと明記された点を反映

次回確認予定:2026年9月28日。 成果最適化と入札の仕様を中心に見直します。

NEXT STEP

自社の商材なら、
何から試す?

商材・主要な成果・検証予算から、準備することを整理します。
広告や計測のどこから手をつけるか、まずはご相談ください。

ChatGPT広告の出稿・運用を相談する

GPT広告専門店の20分無料相談