每次大型 AI 模型更新後的四十八小時,社群都會準時上演同一齣戲。

「是不是又降智了?」

「昨天還好好的 prompt,今天開始胡言亂語。」

「本來順順的工作流,一夜之間全爛掉。」

我相信這些抱怨不是幻覺。

供應商不可能完整交代到底改了什麼,模型就是變了。

你的工作流真的壞了,時間也真的被浪費了。

會生氣,完全合理。

但有一件事,值得在生氣之餘想一下:

模型會變,你控制不了。 工作流會壞得這麼慘,你控制得了。

你手上的,可能不是方法,是咒語

回想一下,那段「本來好好的」prompt 是怎麼來的。

大概不是一次寫成的。

是幾十次試錯,慢慢調整出來的:

  • 加一句「你是資深編輯」,效果變好了,留著。
  • 把要求換個順序,輸出穩定了,留著。
  • 莫名其妙加了句「深呼吸慢慢想」,居然真的有用——也留著。

半年下來,你得到一段三千字的東西。

它有效。

但你說不清楚,為什麼有效。

其實它有效的原因只有一個:

某個版本的模型,「剛好」會對這些字句,做出你要的反應。

這是偶然。

模型一更新,偶然消失,咒語失效。

你把偶然當成了必然,然後在偶然消散的那天,說模型降智了。

這裡有個三分鐘測試:

如果明天把模型換掉——換另一家的,甚至換成一位人類助理。

你能不能用三分鐘,把任務講清楚?

給什麼輸入、要什麼輸出、做到什麼程度算好。

  • 講得清楚,你持有的是規格。
  • 講不清楚,你持有的是咒語。

咒語有爛掉的一天。規格不會。

兩個晚上,和三十分鐘

說個具體的例子。

一位每週發電子報的作者,靠一段三千字的 mega-prompt 產草稿。

某次模型更新,語氣整個跑掉。

他花了兩個晚上重新「馴化」,一邊調,一邊在社群發文抱怨:「模型又降智了。」

後來他做了三件事。

  1. 把選題標準、語氣指南、代表作範例從一坨咒語裡拆出來,存進自己的筆記系統。
  2. 把一次生成,拆成四個小步驟。
  3. 再留下十組「素材 → 認可成品」的對照,當測試集。

然後,下一次模型更新來了。

十組測試跑一遍,十分鐘:只有「語氣校正」這步走樣,其他三步正常。

修指令、補一個反例。三十分鐘,收工。

同一天,社群還在吵降智。

為什麼降智的爭論,永遠吵不完

因為它不可檢驗。

你覺得變笨了,他覺得還好。

雙方都拿不出證據,只能比誰的軼事多、誰的截圖慘。

那十組測試對照做的事,是把「感覺變笨了」,變成「第三步在這兩個輸入上走樣了」。

將疑似變笨這種玄學情況,拆解成工程問題,然後快速解決。

別人喊降智的時候,你已經開始重新跑原本的工作流了。

一個我不會給的承諾

最後,有句市面上很流行的話,我不會這樣喊:

「照這個方法做,模型再怎麼更新都不會壞。」

不可能。

模型會繼續變,這你永遠控制不了。

你能控制的是另外三件事:

壞的時候,多快知道、多快定位、多快修好。

把不可預期的崩壞,變成可偵測、可定位、可小幅修復的維護。

這句話聽起來沒有很酷,但它是真的。

做到它的方法,不在任何一段神奇 prompt 裡。

我把完整的做法,整理成了一套框架,之後告訴你。

下次模型更新的那天——

你手上的,會是一套方法,

還是一段剛好還沒失效的咒語?