洽詢合作

AI 廣告投放

小預算做廣告 A/B 測試:AI 產多版素材

小預算也能做廣告 A/B 測試:用 AI 一次產出多版文案、圖片與影片開頭,每次只變一個變數,附測試計畫表與提示詞。

封面:小預算廣告測試|一次只改一處,數據幫你決定

預算不多,不代表只能憑感覺選素材。這篇說明怎麼用 AI 一次做出多個版本的文案、圖片與短影音開頭,再用平台內建的測試功能,一次只比較一個變數,讓數據幫你決定下一步。適合每月廣告預算有限的小店老闆、電商賣家與行銷人員。各平台功能與數字以官方最新說明為準。

常見的卡關

  • 「我做了兩支廣告,一支比較貴、一支比較便宜,可是兩支同時換了圖也改了字,到底是哪裡有差?」
  • 「一天只投幾百元,每個版本只分到幾十次點擊,這樣看得出差別嗎?」
  • 「想多試幾個版本,但做素材太花時間,結果每次都用同一張圖、同一段文案。」

這三個問題其實連在一起:素材做得少,所以一次改很多;一次改很多,就說不出原因;預算又小,數據自然不夠穩。AI 能幫忙的是第一段,把做素材的時間壓低;後面兩段要靠測試方法。

用 AI 之後差在哪

項目 以前 現在
做多版素材 一次做一兩版,每版都要重寫、重排 用 AI 先產出多個文案方向、圖片構圖與影片開頭腳本,人再挑 2 到 3 版
變數管理 想到什麼就改什麼 先定一個基準版,每個版本只改一處,並用表格記錄
判讀結果 看哪個數字比較好看 事先寫好指標、最少成果數與停損規則,再對照平台結果
下一輪 憑印象決定 依上一輪的結論,只換下一個變數

一次只變一個變數的 A/B 測試版本設計

圖:一個基準版加三個測試版,每版只改一處。資料:Meta 企業商家使用說明(A/B 測試最佳作法)。

怎麼做:一步一步

1. 先寫一句假設與一個指標。 Meta 的說明建議,在選擇變數之前先有假設,例如「自訂受眾的成效優於興趣受眾」。小預算可以寫得更簡單:「文案第一句放價格,每次成果成本會比放情境更低」。指標則照廣告目標選一個,Meta 的 A/B 測試是以每次成果成本等指標判定哪個版本較好。

2. 定下基準版,這一輪只選一個變數。 Meta 提供廣告創意、廣告受眾、版位等類型的變數,並建議新手先用單一變數,才看得出變數如何影響成效。官方也說明,同時測多個變數時,你無法確知是哪個變數造成差異。素材是小預算最容易動手的一類,所以建議第一輪先測創意:文案、圖片、影片開頭三選一。

3. 請 AI 產出多版,再由人挑。 下面這段提示詞可以直接複製,把括號內容換成自己的資料:

你是廣告文案助手。請依下列資料,為同一個產品寫 6 個廣告文案版本。
規則:
1. 只改「第一句」的切角,其餘內容(產品資訊、行動呼籲)六版完全一致。
2. 六個切角分別是:價格、使用情境、解決的問題、客人回饋(只能用我提供的真實評價)、限時活動、數字。
3. 不得出現「第一」「最有效」「百分之百」等絕對用語,不得編造數字、評價或獎項。
4. 每版標示「切角名稱」與字數,第一句不超過 25 個中文字。

產品:(名稱與一句話介紹)
目標客群:(例如 25 到 40 歲、通勤上班族)
我提供的資料:(價格、規格、活動期限、真實評價)
行動呼籲:(例如:點擊了解更多)

圖片與影片開頭也用同樣邏輯。圖片請 AI 或設計工具產出 3 種構圖或背景,產品本身的外觀、顏色與規格以實拍為準,不要讓 AI 改動。短影音則請 AI 寫 3 種前 3 秒開頭,例如問題式、結果式、數字式,後面接同一段內容。AI 的產出只是候選,上線前要由人核對事實、字數、授權與平台規格。

4. 用平台的測試功能,不要手動開關廣告。 Meta 不建議手動開啟和關閉廣告組合這類非正式測試,因為可能造成投遞效率低落,結果也不可靠;A/B 測試會把受眾分成不重疊的組別,並建議兩個版本使用相同預算。可以在廣告管理員的 A/B 測試,或「實驗」工具建立。YouTube 與 Google Ads 也有各自的功能:

  • YouTube 工作室:可以對標題、縮圖或兩者的組合做 A/B 測試,最多 3 個版本;目前僅限電腦版,Shorts 不支援,勝出依據是觀看時間占比,不是點閱率,官方預期約兩週內完成。
  • Google Ads 影片實驗:基本的 A/B 測試只開放給部分影片廣告類型(Video Reach 的 Efficient Reach 與 Video View),其他類型要用自訂實驗;結果在 95% 信賴水準時才算定論。

5. 設定時間與預算。 Meta 建議測試至少排 7 天,最多 30 天,少於 7 天可能得不到明確結果;預算要足以產生判斷勝負所需的成果數。Meta 另外說明,廣告組合通常要在最後一次重大編輯後的一週內獲得約 50 個成果,才會離開「系統學習階段」,在這之前成效比較不穩定。所以小預算的原則是:版本數少一點,也不要頻繁改動。

6. 填測試計畫表。 開跑前填好,結束後再回來補結論。可整段複製到筆記或試算表:

測試名稱:
測試期間:____/____/____ 至 ____/____/____(至少 7 天)
假設:如果(做法),那麼(指標)會(變好或變差),因為(原因)
唯一變數:[ ] 文案  [ ] 圖片  [ ] 影片開頭(只能勾一個)
基準版 A:
測試版 B:
測試版 C(選填):
固定不變:受眾、版位、預算、導向頁面、最佳化目標
預算:每版每天 NT$____,共 ____ 天,總額 NT$____
主要指標:(例如每次成果成本)
最少成果數:每版至少 ____ 次,未達不下結論
停損規則:任一版花到 NT$____ 仍無成果,先暫停檢視
結果:A ____ / B ____ / C ____
結論:[ ] B 勝  [ ] C 勝  [ ] 平手  [ ] 資料不足,延長測試
下一輪要測的變數:

7. 讀結果,決定下一輪。 Meta 的結果頁會標出勝出版本與信賴水準;若時間太短、成果數不足,系統會建議延長測試。勝出後不用急著全押,建議再用同樣方法測下一個變數,例如文案定了,再測圖片。Meta 也提醒,在某個行銷活動目標贏的素材,換到別的目標不必然有同樣表現,要重新測。

示範情境

以下是虛構的示範,不是實際客戶成果。一家賣手作皮件的小店,想比較三種廣告文案第一句:A 版寫使用情境、B 版寫價格、C 版寫客人回饋(使用店家自己整理的真實評價)。圖片、影片、受眾、版位、導向頁面全部相同。

項目 設定
唯一變數 文案第一句
期間與預算 7 天,每版每天 NT$200,三版共 NT$4,200
主要指標 每次加入購物車成本
最少成果數 每版至少 20 次加入購物車才下結論(示範值,依自己的預算調整)
停損規則 任一版花到 NT$600 仍零成果,先暫停檢視

選加入購物車而不選購買當指標,是因為小預算很難在一週內累積足夠的購買次數;加入購物車次數多一些,比較容易看出差距。假設第 7 天,每版約 5,000 次曝光,結果是 A 版 11 次、B 版 17 次、C 版 12 次加入購物車。B 版看起來多了五成多,但每版都沒到事先訂的 20 次。這時的做法是在計畫表記為「資料不足」,延長幾天,或把 B 版當作方向,下一輪留下 B 版再測圖片,並寫明「方向,不是定論」。

要注意的地方

樣本太小,差距很可能是運氣。 這是小預算最大的判讀風險。用常見的雙比例檢定試算(示範數字,由我們自行計算,不是平台數據):兩版曝光數相同,加入購物車 11 次對 17 次,看起來多了五成多,但如果兩版其實一樣好,光靠運氣就有三成多的機率看到這種差距。點擊也一樣,點擊 50 次對 70 次,看起來差了四成,仍有約 7% 到 8% 的機率只是巧合;同樣的比例放大十倍,500 次對 700 次,結論才站得住腳。成果的絕對次數比百分比重要。

各平台對「勝出」的門檻不同。 Meta 的說明指出,信賴水準 65% 以上的 A/B 測試就會顯示為勝出者;Google Ads 影片實驗則把 95% 視為定論,並說明可在較低信賴水準看到方向性結果。看到「勝出」標示時,仍要回頭看每版的成果數,再決定要不要把預算整個移過去。信賴水準的意思是「重做一次測試,得到相同結果的機率」,不代表未來的成效。

測試受眾要夠大、版本要夠不同。 Meta 說明,A/B 測試會把受眾分組,受眾太小或預算太低都可能讓投遞效果不佳;測試受眾或版位時,組別若過於相似,系統也很難判定誰是贏家。素材也同理,三版文案若只差一兩個字,數據很難分出高下。同一批受眾也不要同時用在其他進行中的行銷活動,重疊會影響結果。

中途不要改設定。 測試期間改文案、受眾或預算,會讓比較失去意義。YouTube 的測試也是:測試中途更改標題或縮圖,測試就會停止,必須重來。

AI 素材要人審。 AI 可能寫出不存在的功能、不實的數字或過度承諾的文字。價格、活動期限、規格逐項核對;人物肖像、音樂與圖片要確認授權;AI 生成內容的標示規定,以各平台與法規的官方最新說明為準。

費用與成效以後台為準。 本文的預算與成果數都是示範,成效無法事先預期。

需要協助?

如果你想把這套流程建起來,千金國際的「AI 多版素材測試」可以協助設計測試計畫、產出多版素材並整理測試結論;若要連同成效整理一起做,也可以搭配「成效報表與優化」。歡迎來信聊聊你的產品與預算。

服務內容與進行方式,請看〈AI 廣告預算分析與投放〉,或寫信到 service@qianjinintl.com。

來源