寫程式的 AI 自己說測過了,等於讓選手兼裁判
AI 一直說「已經修好了」,但我重新整理畫面還是一樣,怎麼辦?
2026 Aug 04 Vibe Coding Fixer
這個狀況我自己每週都遇到。AI 說「已經修正,請重新整理確認」,我重新整理,一模一樣。再問一次,它說「抱歉,這次真的修好了」,還是一樣。
先講一個基本認知:AI 說「測過了」,常常在唬你。不是它故意的,是它沒有真的去看畫面。它改了程式碼,然後根據「我改了這段,所以應該會好」推論出「已修復」。這是推論,不是驗證。
所以你要做的不是繼續問它,是自己建立一個排查順序。順序對了,多數狀況十分鐘內能找到原因。
先排除三個最常見的原因
第一,它改的檔案,不是你看的那份。
很多工具是本機改、線上跑。AI 在本機把檔案改好了,但沒有部署到線上,或者部署到一半失敗了。你看的是線上,當然沒變。問它一句:「你改的檔案,現在線上跑的是不是這一份?」
第二,快取。
瀏覽器有快取、CDN 有快取、有些平台自己也有快取。改是真的改了,你看到的是舊的。用無痕視窗開、在網址後面加一個沒用過的參數像 ?v=2,或等幾分鐘再看。我自己驗部署一定帶一個新參數,不然很容易看到舊快取就誤判沒生效。
第三,它改的地方,根本不是問題所在。
你說「按鈕沒反應」,它去改按鈕的樣式。你說「表單送不出去」,它去改表單的欄位。它修的是它猜的那個問題,不是你遇到的問題。這種情況下它說修好了,也沒有說謊,它修好了它以為的那個東西。
為什麼不能讓 AI 自己驗收
我看過一位同樣用 AI 自建整套系統的開發者分享他的流程。他自己也說「AI 說測過了常常在唬你」,但他的工具清單裡,沒有任何一個獨立的測試工具。
這等於讓寫程式的 AI 自己當裁判。選手說「我進球了」,沒有人去看球有沒有進門。
我的做法是把兩件事拆開。「要測什麼」可以交給 AI 想,它現在在設計測試條件這件事上進步很多。但「實際去點、去填、去看結果」要交給一個不會幻覺的東西:真的瀏覽器,或者你自己的眼睛。
可信的不是 AI,是那個真的去做了動作的東西。自動化的前提是決定性,不是聰明。
你可以怎麼要求 AI
不要接受「已修復」三個字。改成要它給你這些:
一、它到底改了哪個檔案的哪一段,用一句話講。
二、你要怎麼自己驗證:打開哪個網址、做什麼動作、應該看到什麼。
三、如果驗證失敗,它下一個會懷疑的地方是哪裡。
第二點最重要。當它要寫出「你應該看到什麼」的時候,它就被迫把推論變成一個可以被打臉的預測。很多時候它寫到這裡,會自己發現「等一下,這樣改應該不會影響那個畫面」。
然後你照著做。看到了,就是修好了。沒看到,你有一個具體的回報:「我照你說的做,預期看到 A,實際看到 B。」這句話比「還是一樣」有用一百倍。
把驗證步驟留下來
那份「打開哪個網址、做什麼、應該看到什麼」的步驟,不要用完就丟。
下次 AI 又改到附近的東西,你就再跑一次同一份步驟。這是最便宜的「確認沒弄壞上次的功能」的方法,不用懂任何測試工具。
我自己的習慣是把這些步驟存在一個文件裡,每個功能一段。改完就照著跑,每次跑的方式都一樣。一個每次跑都不一樣的驗證,測的是「AI 這次有沒有照做」,不是「網站對不對」。
一個容易掉進去的循環
最糟的狀況是你一直重複「還是一樣」,它一直重複「這次修好了」,來回十幾次,程式碼被改得越來越亂,最後連原本能動的地方都壞了。
看到第三次「還是一樣」,就停。不要再讓它猜。回到上面那三個原因,一個一個自己排除。
如果三個都排除了還是不對,那問題可能不在它改的那一層。這時候需要的不是再問一次,是換一個問法,或者換一個人看。
你上一次遇到「修好了但沒變」,是自己先確認過線上跑的是哪一份,還是直接又問了 AI 一次?
如果你做到一半卡住,可以把狀況寫信給我。也歡迎訂閱我的電子報:https://iamlouis.ai/subscribe/edm
ABOUT ME

路老闆 Louis
路老闆有限公司創辦人、Compassio 個人品牌一站式網站系統的開發者。二十年網站與行銷實戰經驗,長期陪伴講師、顧問與創作者把專業變成品牌。每週透過電子報與 Podcast《路老闆的個人品牌診療室》,分享個人品牌、網站經營與 AI 行銷的實務觀察。
如想留言評分,請先 登入會員!