每次大型 AI 模型更新後的四十八小時,社群都會準時上演同一齣戲。
「是不是又降智了?」
「昨天還好好的 prompt,今天開始胡言亂語。」
「本來順順的工作流,一夜之間全爛掉。」
我相信這些抱怨不是幻覺。
供應商不可能完整交代到底改了什麼,模型就是變了。
你的工作流真的壞了,時間也真的被浪費了。
會生氣,完全合理。
但有一件事,值得在生氣之餘想一下:
模型會變,你控制不了。 工作流會壞得這麼慘,你控制得了。
你手上的,可能不是方法,是咒語
回想一下,那段「本來好好的」prompt 是怎麼來的。
大概不是一次寫成的。
是幾十次試錯,慢慢調整出來的:
- 加一句「你是資深編輯」,效果變好了,留著。
- 把要求換個順序,輸出穩定了,留著。
- 莫名其妙加了句「深呼吸慢慢想」,居然真的有用——也留著。
半年下來,你得到一段三千字的東西。
它有效。
但你說不清楚,為什麼有效。
其實它有效的原因只有一個:
某個版本的模型,「剛好」會對這些字句,做出你要的反應。
這是偶然。
模型一更新,偶然消失,咒語失效。
你把偶然當成了必然,然後在偶然消散的那天,說模型降智了。
這裡有個三分鐘測試:
如果明天把模型換掉——換另一家的,甚至換成一位人類助理。
你能不能用三分鐘,把任務講清楚?
給什麼輸入、要什麼輸出、做到什麼程度算好。
- 講得清楚,你持有的是規格。
- 講不清楚,你持有的是咒語。
咒語有爛掉的一天。規格不會。
兩個晚上,和三十分鐘
說個具體的例子。
一位每週發電子報的作者,靠一段三千字的 mega-prompt 產草稿。
某次模型更新,語氣整個跑掉。
他花了兩個晚上重新「馴化」,一邊調,一邊在社群發文抱怨:「模型又降智了。」
後來他做了三件事。
- 把選題標準、語氣指南、代表作範例從一坨咒語裡拆出來,存進自己的筆記系統。
- 把一次生成,拆成四個小步驟。
- 再留下十組「素材 → 認可成品」的對照,當測試集。
然後,下一次模型更新來了。
十組測試跑一遍,十分鐘:只有「語氣校正」這步走樣,其他三步正常。
修指令、補一個反例。三十分鐘,收工。
同一天,社群還在吵降智。
為什麼降智的爭論,永遠吵不完
因為它不可檢驗。
你覺得變笨了,他覺得還好。
雙方都拿不出證據,只能比誰的軼事多、誰的截圖慘。
那十組測試對照做的事,是把「感覺變笨了」,變成「第三步在這兩個輸入上走樣了」。
將疑似變笨這種玄學情況,拆解成工程問題,然後快速解決。
別人喊降智的時候,你已經開始重新跑原本的工作流了。
一個我不會給的承諾
最後,有句市面上很流行的話,我不會這樣喊:
「照這個方法做,模型再怎麼更新都不會壞。」
不可能。
模型會繼續變,這你永遠控制不了。
你能控制的是另外三件事:
壞的時候,多快知道、多快定位、多快修好。
把不可預期的崩壞,變成可偵測、可定位、可小幅修復的維護。
這句話聽起來沒有很酷,但它是真的。
做到它的方法,不在任何一段神奇 prompt 裡。
我把完整的做法,整理成了一套框架,之後告訴你。
下次模型更新的那天——
你手上的,會是一套方法,
還是一段剛好還沒失效的咒語?