預算討論到QA測試這個環節的時候,我們很常聽到業主問:「這塊可以用AI跑嗎?這樣是不是可以省一些?」
這個問題問得很合理。AI工具發展這麼快,自動化測試聽起來比找一群人坐在那裡玩遊戲更有效率,也更省錢。
我們的態度是:AI在QA測試裡確實有它可以做的事,但真人測試找得到的問題例如遊玩感受、心流、畫面呈現與當下情境是否對味、難易度數據是否有符合玩家TA等,AI目前難以做到如此人性的調教,而較善於高重複性、精確的邏輯是否有BUG。這兩件事不會互相取代、是合作關係,先清晰各自能做什麼,才能在預算有限的情況下做出合理的決定。
簡短答案:不能只選一個。自動化適合驗證可重複、可量化的功能與壓力;真人 QA 負責判斷節奏、理解、情緒和真實裝置情境。行銷遊戲若少了真人測試,最容易漏掉的往往不是 Bug,而是玩家離開、品牌訊息沒被看到的原因。
AI可以做到的事

在真人與AI測試環節時,自動化測試工具在某些環節確實很有效率。重複性高的功能測試——按鈕有沒有反應、頁面跳轉有沒有錯誤、資料有沒有正確寫入後端——這類有明確對錯標準的測試,AI跑起來比真人快很多,也不會因為重複操作而漏掉東西。
壓力測試也是。模擬大量使用者同時上線、測試伺服器在高流量下的穩定性,這種需要大規模重複操作的測試,自動化工具比真人有優勢。
如果一個遊戲的功能邏輯清楚、測試條件可以被明確定義,自動化測試可以節省相當多的時間。
真人測試找得到的問題與感受,對於AI來說不見得是問題

遊戲QA測試裡最關鍵的部分,不是功能有沒有運作,而是體驗對不對。對品牌業主來說,這個差距的影響不只是遊戲好不好玩——它直接影響這次活動能不能達成行銷目標。
我們做過一個專案,功能測試全部通過,邏輯上沒有任何問題。真人測試的時候,一個測試員在第三關玩了幾分鐘之後說:「我不太想繼續了,但我說不上來為什麼。」
這句話讓我們回去重新看那個關卡的設計。後來發現,關卡的節奏在某個時間點突然變慢,回饋感消失了,玩家的注意力就在那裡斷掉。這個問題在功能層面完全正常,自動化測試不會標記它,因為它沒有任何「錯誤」。
但這個問題不解決,放在行銷活動的情境裡,後果很具體——玩家在第三關離開,品牌想傳遞的訊息沒有被看到,活動頁面的停留時間縮短,轉換率交不出來。這不只是遊戲體驗的問題,是這次行銷投入能不能回收的問題。
上線前發現這個問題,調整一個關卡的節奏,成本很低。上線後才發現,除了修改本身,還要面對已經流失的玩家、已經縮水的活動數據,以及品牌在這次活動裡本來可以累積的東西。
真人QA測試帶來的,是真實的使用情境

另一個AI測試很難模擬的,是真實使用情境的多樣性。
不同年齡、不同裝置使用習慣、不同網路環境、不同對遊戲的熟悉程度——這些差異會讓同一個遊戲在不同人身上產生完全不同的體驗。
我們測試的時候,會刻意找背景不同的測試者。有些問題只有在不熟悉遊戲操作的人身上才會出現,有些問題只有在用舊款手機、網路不穩的環境下才會被觸發。AI可以模擬裝置規格,但它模擬不了一個真實的人在真實情境下的反應。
有一次,一個測試員用平板橫放玩我們的遊戲,發現某個按鈕被系統列擋住了,點不到。這個問題在正常的測試裝置上完全不會出現,也不在任何人的預想範圍內。就是因為有真人用他習慣的方式在玩,才找到這個問題。
QA被低估的,是它的時間成本

很多業主在評估QA的時候,低估的不只是它需要的人力與成本,而是它需要的時間。
找到問題、回去修、再測一輪——這個循環在每個專案裡都會發生,而且發生的次數通常比預期多。小遊戲的QA可能需要兩週,複雜一點的專案可能更長。
如果時程上把QA壓縮得太短,最後只有兩個結果:帶著問題上線,讓玩家先遇到;或者延期,打亂原本的行銷規劃。
這兩個結果都不是業主想要的。
QA不是開發完成之後才開始的事,它需要在規劃階段就被納入時程,給它足夠的時間。
我們自己怎麼做

CI/CD系統處理程式整合和部署流程,GitHub Actions跑工作流程自動化,某些專案會用modl.ai來跑場景測試。抽獎類的專案,轉盤、小瑪莉、心理測驗結合隨機運勢,這類涉及概率計算的,我們會請技術人員專門寫自動化測試,模擬大量玩家同時上線的情境,確認機率正常、不會出現讓業主虧損的漏洞。
但這些工具背後,選擇用哪個、怎麼設定參數、測試邏輯怎麼寫,都是真人在做的判斷。每一個專案的自動化流程都要從頭客製,沒有辦法直接套用上一個案子的設定。
工具跑完,只能確認遊戲「能動」。
「能動」跟「好玩」之間的距離,沒有工具能量。我們做的是內容文化導向的行銷遊戲,不是高複雜度的大型手遊,在這個類型裡,玩家願不願意繼續、有沒有在某個時間點感覺到什麼,這些問題自動化測試是回答不了的。
所以真人測試這個環節,我們從來沒有把它省掉過。每次真人測試,都會找到至少一個工具找不到的問題。有時候是體驗上的細節,有時候是沒預料到的使用情境,有時候就是測試員說了一句「感覺哪裡不太對」然後我們回去調,調完再測,遊戲就順了。
這些問題如果沒在上線前找到,就會在上線後被玩家找到。
延伸閱讀
常見問題
自動化測試和真人QA,有辦法選一個就好嗎?
不管哪一種遊戲,真人QA都是必要的。差別只在於由誰來做——我們自己的團隊、客戶這邊自行安排,還是找專門的測試人員。自動化工具可以幫忙跑重複性高的功能驗證,但它沒辦法感受體驗對不對。這兩件事不是二選一,而是各有各的角色。
什麼樣的遊戲,自動化測試可以幫上比較多忙?
看遊戲的類型。如果是點擊抽獎、轉盤這類操作單純的遊戲,自動化測試可以有效驗證機率和功能是否正常。如果遊戲有劇情、有闖關、有情緒投入,玩家需要被帶著走、需要在某個時間點感覺到成就感,這些靠自動化測試是看不出來的,還是需要真人坐下來玩過才知道。
QA測試一定要找外部的人嗎?內部人員可以做嗎?
內部人員可以參與,但有一個很常被忽略的盲點:品牌方的內部同仁對自己的品牌太熟悉了,反而很難站在真實受眾的角度去感受這個遊戲。他們知道品牌在說什麼、知道活動的脈絡,但真正的玩家是帶著零背景點進來的。那個「第一次接觸」的感受,只有真正的外部使用者才能給你。找背景多樣的外部測試者,往往能找到內部團隊完全沒有預料到的使用盲點。
QA測試應該在開發的哪個階段開始?
越早開始越好,不要等到所有功能都完成才開始測試。在開發過程中分階段測試,可以在問題還小的時候就發現,修改成本低很多。等到最後才一次做QA,問題堆積起來處理的時間壓力會很大。
如果上線後才發現問題,還能補救嗎?
可以,但代價不同。上線前發現的問題,修改的時間和成本相對可控。上線後才發現,除了修改本身,還要面對玩家已經遇到問題、可能已經流失、或者已經對品牌產生負面印象的狀況。這個影響很難用數字量化,但它是真實的。
想把需求整理成可執行的遊戲方案?
如果你正在規劃行銷遊戲,不確定自動化測試與真人 QA 應該如何分工,可以先把玩法、受眾、裝置與上線時程一起盤點。

