
什麼是計畫謬誤?校準專案時程的四種方法
計畫謬誤指人們預測自己任務的工期時系統性偏樂觀,連過去多次延誤的經驗都擋不住,小從報稅與畢業論文、大到雪梨歌劇院與各國巨額工程都有紀錄。整理成因機制,並提供參考類別預測、任務拆解、回想相關經驗與預先驗屍四種校準方法。
- 計畫謬誤
- 計畫謬誤是什麼
- 計畫謬誤 例子
- 專案時程估計
- 時程估計方法
- 估計偏誤
- 參考類別預測
- reference class forecasting
- 外部觀點
- 內部觀點
- 預先驗屍
- premortem
- 任務拆解
- 樂觀偏誤
- 專案管理偏誤
約 26 分鐘閱讀作者:Whoops 編輯團隊
計畫謬誤(planning fallacy)是心理學家 Kahneman 與 Tversky 在 1979 年提出的偏誤:人在估計自己任務的完成時間時,會呈現樂觀偏誤並系統性低估實際所需時間。後續研究把它擴充成更完整的形態:我們低估未來行動的時間、成本與風險,同時高估它的效益。以下整理這個偏誤的證據、成因,以及四種有研究或實務依據的校準方法,從個人任務一路談到大型專案。
行銷與網站工作的人對這個現象不陌生。官網改版原訂近期上線,之後仍在等待資料搬遷。活動頁答應客戶儘快交付,結果卡在法務意見與素材檔期。內容產製持續排入新稿,結算時達成率仍明顯不足。這些情況裡,責備執行的人沒有意義,因為問題出在估計的形成方式,而估計的形成方式可以改。
先講定義與三組經典研究,接著看大型專案的統計證據與雪梨歌劇院的完整案例,拆解內部觀點與外部觀點的差異,列出六個讓估計失準的機制,與錨定效應、樂觀偏誤等相鄰概念劃清界線,把場景拉回行銷實務,收在四種校準方法與一張工作流程對照表。適合三種人讀:要對客戶承諾時程的行銷主管、負責排程與資源協調的專案成員,以及經常覺得自己「明明很認真卻一直在趕工」的執行者。
與站上其他文章的銜接先講清楚。計畫謬誤屬於判斷偏誤家族,這個家族如何影響消費者與行銷決策,消費者心理學的完整整理有系統性的說明。同家族的錨定效應與它互為表裡,後面會用一節專門對照。挑參考案例時怎麼避開只看成功者的陷阱,可以再對照倖存者偏差的解析。這幾篇合起來,剛好覆蓋行銷人做預測時最常踩的三種系統性錯誤。
計畫謬誤的定義:樂觀的預測,冷漠的記憶
計畫謬誤的定義可以寫成一句話:對未來任務所需時間的預測,呈現出樂觀偏誤,系統性低估實際所需。這個現象有個令人生氣的特質:即使當事人知道自己過去對類似任務的預測曾過度樂觀,下一次估計仍可能照樣樂觀。知識改變不了預測,因為預測的原料根本不是那些知識。
Buehler、Griffin 與 Ross 三位學者在 1994 年的論文裡給過更精準的描述:對自己的專案將按計畫進行抱持信心,即使明知絕大多數類似專案都曾延誤,這種傾向就叫計畫謬誤。這個定義點出了兩個成分:一是「自己的」,二是「即使明知」。換成白話:別人的案子會拖,是常態。我的案子會拖,是不可思議。
2003 年,Lovallo 與 Kahneman 在《哈佛商業評論》把定義擴充到時間之外:低估未來行動的時間、成本與風險,同時高估同一個行動的效益(Delusions of Success 一文)。這個擴充很重要,因為它解釋了為什麼商業決策會出現「大膽的預測、保守的行動」這種矛盾組合:效益被高估、成本被低估,投資評估的中間那格報酬率就被灌水了。專案還沒開始,帳面上就已經贏了。
還有一個反方向的細節值得記住:計畫謬誤只作用在對「自己任務」的預測上。當旁觀者預測別人的任務時,偏誤方向會反過來,傾向高估所需時間,呈現悲觀偏誤。這解釋了職場上常見的對峙:執行團隊與外部顧問給出差距很大的工期,雙方都以為對方不專業。其實兩邊各自踩在不同的偏誤上,真正的答案需要第三種來源,後面的校準方法會給。
三組經典研究:從畢業論文到報稅季節
第一組證據來自前面提到的 1994 年論文(Exploring the "Planning Fallacy")。研究團隊找來 37 位正在寫畢業論文的心理系學生,請他們估計自己還需要多少天才能完成。學生的最佳估計平均是 33.9 天。實際的平均完成時間是 55.5 天,比估計多了六成以上。只有大約三成的學生,真的在自己預測的時間內交出論文。
更有意思的是研究還請學生做了兩個情境估計:如果一切順利到不能再順利,要幾天。如果一切糟到不能再糟,又要幾天。順利情境的平均是 27.4 天,最壞情境的平均是 48.6 天。實際完成時間平均為 55.5 天,高於最壞情境估計的平均 48.6 天。這是計畫謬誤最扎心的證據形式:連想像力開到最悲觀的檔位,都不夠悲觀。
第二組證據測的是校準程度。另一項研究請學生針對自己的個人學業專案,給出三個完成時間:有五成把握完成的時間、七成五把握的時間,以及九成九把握的時間。結果只有 13% 的人在自稱五成把握的時間點前完成,19% 的人在七成五的時間點前完成,45% 的人在九成九的時間點前完成。換句話說,受訪者自認「幾乎一定會做到」的期限,有超過一半的人做不到。人對自己預測的信心,本身就是膨風的。
日常任務也逃不掉。1997 年發表的一項加拿大報稅者調查發現,人們寄出報稅表的時間,平均比自己的預測晚了約一個星期。這些受訪者對自己過去遲寄的紀錄一清二楚,沒有半點誤解,只是堅信這一次會不一樣。研究者把這個現象列為計畫謬誤的定義性特徵:人們承認自己過去的預測太樂觀,同時堅持現在這個預測是務實的。
把三組數據放在一起看,可以得出一個對實務很有用的結論:這些研究顯示,即使是學生與有生活經驗的成人,也會出現計畫謬誤。寫論文的學生不笨,報稅的成人都很有生活經驗,問題出在預測的建構方式。當大腦用「想像這件事順利展開的劇本」來代替「統計類似事情的真實分佈」,樂觀就是數學上的必然。要修的不是人,是估計的流程。
當專案放大:十個有九個超支的鐵律
個人任務如此,巨型專案更慘。專案管理學者 Flyvbjerg 整理大型基礎建設的績效資料,結論直接寫在他 2014 年的綜述論文裡(What You Should Know About Megaprojects and Why):十個巨型專案有九個成本超支。實質超支在五成以內算常見,超過五成也不算少見。他把這個現象命名為巨額專案的鐵律:超支、超時,一次又一次。
案例的名單本身就很有說服力。英法海底隧道實質超支八成。丹佛國際機場晚啟用十六個月,總成本 48 億美元,超出預期二十多億。波士頓把高架道路埋進地下的 Big Dig 工程,原編預算 28 億美元(1988 年幣值),實際花了 80.8 億,晚了七年。英國全民醫療的 IT 系統超支四到七倍。雪梨歌劇院超支約 1,400 個百分點。柏林布蘭登堡機場原定 2011 年 10 月啟用、預算 28.3 億歐元,拖到 2020 年 10 月 31 日才開幕,支出接近一百億歐元。
名單還可以往下列。歐洲戰機計畫比原訂晚了六年,超支金額約 80 億歐元。芬蘭 Olkiluoto 核電廠三號機 2005 年動工時預定 2009 年完工,實際到 2023 年才完工,成本從約 30 億歐元膨脹到約一百億。韋伯太空望遠鏡超支約 90 億美元,發射比原始規劃晚了十四年。這些專案橫跨國防、能源與科學,規模與領域各不相同,劇本卻像同一個模板印出來的:初期承諾的日期與數字,與最終兌現的差距以倍數計。
| 專案 | 成本超支幅度 | 時程結果 |
|---|---|---|
| 英法海底隧道 | 實質 80% | 未列時程結果 |
| 丹佛國際機場 | 200% | 晚啟用十六個月 |
| 波士頓 Big Dig | 220% | 晚了七年 |
| 英國 NHS IT 系統 | 400% 至 700% | 未列時程結果 |
| 雪梨歌劇院 | 約 1,400% | 晚了十年 |
| 柏林布蘭登堡機場 | 約 253%(28.3 億逼近一百億歐元) | 2011 年承諾,2020 年開幕 |
表中超支幅度沿用 2014 年那份綜述的實質口徑;正文裡丹佛與波士頓的金額是計畫當年幣值的絕對數字。百分比與絕對值出自不同基準,並用時以各自來源為準。
更麻煩的是這不是偶發的年代問題。同一份綜述指出,在可取得可比數據的七十年區間裡,超支幅度持續維持高檔,民間部門與公共部門皆然,有資料的國家與洲別也通通中獎。換句話說,在這七十年間,巨額專案的超支幅度沒有明顯改善。這組資料呈現的是超支結果,不能單獨把全部差距歸因於計畫謬誤。
跟行銷工作距離最近的版本是大型 IT 專案。麥肯錫與牛津大學重大計畫管理中心合作、以超過 5,400 個 IT 專案為基礎的 2012 年研究發現:初始預算超過 1,500 萬美元的大型 IT 專案中,有一半嚴重爆掉預算,平均超支 45%、超時 7%,交付價值比承諾少了 56%(Delivering large-scale IT projects on time, on budget, and on value)。還有 17% 的 IT 專案糟糕到可能威脅公司存續,這類被稱為黑天鵝的個案,預算超支幅度定義在兩倍以上,極端可達四倍。官網改版、電商平台遷移、CRM 導入,全都落在這個光譜上。
雪梨歌劇院:計畫謬誤的標準教材
如果要挑一個案例讓主管秒懂計畫謬誤,雪梨歌劇院大概是最好用的(沿革資料見雪梨歌劇院條目)。1957 年的原始估計:造價 350 萬澳鎊,相當於改制後約 700 萬澳幣,並且在 1963 年 1 月 26 日澳洲國慶日啟用。實際結局:1973 年才完工,造價 1.02 億澳幣,實質超支 1,357%,晚了十年。標價七百萬的地標,最終付出十四倍以上的代價。
它是怎麼走歪的。新南威爾斯州政府擔心輿論與經費轉向,急著讓工程早點開始,於是在建築師還沒完成最終設計圖的狀態下,1959 年 3 月就動工。外殼的幾何形狀遲遲無法定案,中途從拋物線改成球面切塊,等於邊蓋邊改結構。到 1961 年 1 月,工程已經落後四十七週,而這時距離原定啟用日只剩兩年。每一個環節都在告訴你:時程的失守找不到單一意外可以歸咎,它從第一天起就沒有站穩過。
雪梨歌劇院把計畫謬誤的三個放大器展示得很完整。未定案就開工,讓後續的每一次設計變更都直接侵蝕時程。政治壓力主導啟動時點,讓「先上再說」壓過了準備度評估。造價的數字也在設計之前就定案:1957 年喊出的 350 萬澳鎊,比外殼結構的解法早了四年。行銷專案裡對應的場景一模一樣:客戶簽約的壓力讓提案時程先天樂觀,需求還沒鎖定就答應了上線日,改版過程的每一輪意見都在重播雪梨的外殼難題。
為什麼會估不準:內部觀點與外部觀點
Kahneman 自己最愛講的例子,是一個課程開發專案,Flyvbjerg 在 2006 年的論文裡完整重述了它(From Nobel Prize to Project Management)。當年 Kahneman 參與一個團隊,為以色列高中設計新科目教材,成員是一批學者與教師。某天團隊討論:整個專案要多久才能完成。每個人匿名寫下自己估的月數,答案是 18 到 30 個月之間。
接著團隊裡一位課程開發的資深專家被問了另一個問題:回想你見過的類似團隊,在他們目前這個階段,後來各花了多久才收尾。專家想了半天,不太舒服地承認:他想得到的可比團隊裡,約有四成根本從未完成任務。有完成的,他想不到有哪一個花少於七年,也想不到有哪一個花超過十年。再追問:我們這個團隊有比那些更強嗎。專家的答案是沒有,資源與潛力甚至略低於平均。
理性的下一步顯而易見:認賠收手,或至少重新設定期望。實際發生的事是團隊無視這些資訊,照原樣推進,結果花了八年才完成,而且成果幾乎沒有被使用。同樣一個問題,同一批人,兩種問法得到 18 到 30 個月與七到十年兩個世界。這兩種問法,就是內部觀點與外部觀點的全部差別。
內部觀點是這樣預測的:緊盯眼前這個專案的目標、手上的資源、預期的障礙,在腦中構思進度開展的劇本,再把當前的趨勢外推到未來。聽起來非常專業,問題是劇本裡只放得下想得到的元素,而延誤的來源,意料之外的審查、生病、需求追加、跨單位等待,在事前剛好都屬於想不到的那一類。外部觀點則完全不管眼前專案的細節,甚至不嘗試預測會發生什麼事,它去找一整類類似專案的經驗,攤開這個參考類別的成果分佈,再把眼前專案放進那個分佈裡定位。

內外之差有實驗支持。研究顯示,只要請人回答幾個需要採取外部觀點的簡單問題,預測就顯著變準。一個經典的對照是:請新生自評入學後的學業表現會贏過同系同學的百分比,平均答案竟是 84%,這在數學上根本不可能成立,平均而言,這些學生把自己放在分佈的右半邊。計畫謬誤就是同一種心理在時間軸上的版本:專案估計容易把自己放到「順利的那一邊」,而忽略分佈本身。
Kahneman 與 Tversky 在 1979 年的論文裡已經把藥方寫好了:分析者應當盡一切努力,把預測問題框限到能夠善用所有可得分佈資訊的形態。Flyvbjerg 對這句話的評語是,這或許是透過改善方法來提升預測準確度的唯一最重要建言。記住這句話,四種校準方法裡的第一個,就是這句話的工程化。
六個讓估計失準的機制
機制一:聚焦於未來的劇本
聚焦謬誤(focalism)是解釋計畫謬誤的一種機制:預測時注意力全部押在未來這個任務上,根本沒有回想過去那些「當時也以為很單純」的類似任務。你在心裡演練的是改版上線時的事,而不是過往上線延誤的情況。劇本式的想像力很動人,但它是最好的情境,最好的情境拿來當基準線,就不叫估計,叫許願。
機制二:記憶本身就有偏
那把過去的經驗叫回來總可以了吧。Roy 等學者的研究給了壞消息:人對過去事件時長的記憶,本身就系統性低估。過去那次的等待、中斷、來回修改,在回憶裡都被壓縮掉,只留下主幹。既然回憶裡的過去比真實的過去快,用回憶校正未來,等於拿一份灌過水的對帳單理財。這也是為什麼校準方法裡特別強調書面紀錄,記憶不能上場。
機制三:自利歸因與印象整飾
Buehler 團隊的解釋還加上一層社會動機。人們回顧過去表現時傾向自利歸因:準時完工歸功於自己,延誤歸咎於外部因素,於是歷史證據一進入自我敘事就被過濾。更有趣的是,當受試者匿名做預測時,樂觀偏誤竟然消失了。這說樂觀的估計有一部分是做給別人看的:報一個令人滿意的時程,比報一個真實的時程更受歡迎。估計不只是認知活動,也是表演。
機制四:任務沒有被拆開
Kruger 與 Evans 在 2004 年提出的機制更機械:多工面的任務在預測時沒有被自然拆解成子任務。寫一份白皮書這個估算單位,心裡只出現「寫」,不會自動浮出訪談、找圖、校稿、法務確認這些零碎工序,而工期恰恰藏在零碎裡。任務在腦中是一塊,時間就會被估成一塊。這直接對應到校準方法裡的拆解法,後面會看到拆解被驗證的效果。
機制五:團體預測沒有免疫
不要指望開會能中和偏誤。Sanna 與同事在 2005 年的三個研究證實,計畫謬誤照樣作用於團體任務的預測,而且時間框架愈寬鬆、對成功完成的想像愈豐富,預測就愈樂觀。會議室裡的集體想像,本質上是多個人共用同一個劇本,劇本裡的難關還是隱形的。人多不會自動產生分佈資訊,只會產生共識。
機制六:制度性動機,策略性誤導
這一層已經超出心理學,進入誘因設計。專案規劃經常發生在需要爭取核准的場合,規劃者有動機把數字壓低,先拿到授權再說。研究文獻把這種蓄意低報稱為策略性誤導,背後的邏輯很冷:事後的超支容易被原諒,事前的誠實數字很難被核准。提案比稿殺價、內部搶預算、給客戶一個聽了會簽字的日期,屬於同一個物種。它跟前面五個機制的差別在於:這一個不是判斷錯誤,是賽局選擇,解法也不在認知,在治理。
與相鄰概念的界線
樂觀偏誤(optimism bias)是最常被混用的鄰居。它是較廣的認知偏誤,與過度自信及忽略成果分佈資訊有關。計畫謬誤可以看成這種傾向在預測自己任務時的具體表現,Kahneman 與 Tversky 的診斷是:人的判斷普遍樂觀,源頭在過度自信,加上對成果分佈資訊的忽視。講白話:樂觀偏誤是你覺得明天會更好,計畫謬誤是你覺得這週一定做得完,後者可以被流程校正,前者比較接近體質。
若要進一步比較相鄰概念,可以讀錨定效應與調整不足的解析。
資訊界流傳的 Hofstadter 法則是工程師版的自我調侃,出自 Douglas Hofstadter 在 1979 年的著作《Gödel, Escher, Bach》:Hofstadter's law: It always takes longer than you expect, even when you take into account Hofstadter's law. Hofstadter 法則:事情的耗時總是比你預期的長,即使你把這條法則本身考慮進去也一樣。它好笑的地方在於自指:你知道會低估,於是加了緩衝,而加完緩衝的數字又成了新的預期,繼續被低估。這條法則提醒我們,靠「自己多留心」並沒有療效,因為多留心仍然是內部觀點的一種。
軟體工程還有一條布魯克斯法則,出自《人月神話》:對已經延誤的專案增加人手,溝通與訓練的開銷會讓它更晚。它跟計畫謬誤經常成對出現,因為低估時程的專案,接下來最常見的補救動作就是加人,然後在更高的人力成本上再次延誤。估錯是第一次受傷,用錯方法救火是第二次,傷口還更深。
行銷與網站專案裡的計畫謬誤
把鏡頭拉回行銷現場。網站改版是標準的重災區:設計定稿、內容搬遷、轉址規劃、SEO 檢查、第三方串接,每一項在排程表上都只是一格,每一格展開來都有各自的等待與來回。麥肯錫那份研究的樣本正是這類大型 IT 工程,45% 的平均超支聽起來像嚇唬人的故事,其實是幾千個案子的平均地心引力。活動上線也同構:檔期協調、素材審核、法務意見、投放系統的審核佇列,排程時這些環節連名字都還不存在,何況估時間。
內容產製的版本更隱蔽。一篇深度文章從選題到發布,中間有研究、訪談、寫作、審稿、配圖、上稿,寫作本身可能只佔部分時間。排程表以「篇」為單位時,所有周邊工序被壓縮成一個欄位,於是每個月的產能都被高估。SEO 的成效時程則是另一種計畫謬誤:排名與流量的累積速度取決於搜尋引擎的週期與競爭環境,這個變數完全不在團隊控制範圍內,對客戶承諾「短期見效」的提案,先天就是把外部世界的分佈資訊排除在估計之外。計畫謬誤在這類對外承諾裡的破壞力,比內部排程更大:內部估錯頂多加班消化,對外估錯,燒掉的是信任與下一張合約。
代理商與客戶之間的動力,會把前述兩種偏誤同時放大。內部團隊出於印象整飾報出樂觀時程,客戶端的採購與老闆又帶著旁觀者的悲觀偏誤全面打折,雙方在各自主觀裡討價還價,得標的那個數字跟現實的分佈沒有直接關係,只反映談判力量。策略性誤導也活在同一條縫裡:比稿需要漂亮的天數,先贏再說。要跳出這個賽局,更多誠意幫不上忙,真正需要的是一個雙方都無法否認的外部基準,這正是下一節的主題。
校準方法一:外部觀點與參考類別預測
參考類別預測(reference class forecasting)是把 Kahneman 那句「善用分佈資訊」工程化的方法,學理基礎正是 Kahneman 與 Tversky 的原始研究。操作上三個步驟:第一步,找出一組過去的、類似的專案,這組就是參考類別。第二步,為這個類別建立你要預測的那個參數(工期或成本)的機率分佈。第三步,把眼前這個專案跟分佈相比對,用分佈替它定位出最可能的結果。注意第二步的用詞是分佈,不是平均值:平均值告訴你中央在哪,分佈才告訴你尾端拖多長。
這個方法已經被政府採用。Flyvbjerg 與工程顧問公司 COWI 在 2004 年把方法落成實務指引,由英國交通部在當年六月以官方指引文件的形式發布。第一批實際應用之一,是愛丁堡輕軌二號線在 2004 年 10 月的商業案例審查。當時這條線的預估總成本是 3.2 億英鎊,其中 6,400 萬英鎊被列為應變預備金,相當於扣除預備金後基礎預算的 25%。顧問公司用參考類別預測重算:第八十百分位的數值,即有八成機會守得住的上限,是 4 億英鎊,等於 57% 的預備金。第五十百分位則是 3.57 億英鎊,等於 40% 的預備金。
這個案例的後續很有教育意義。這條輕軌線最終晚了三年,在 2014 年 5 月通車,決算成本 7.76 億英鎊,換算回 2004 年幣值是 6.28 億,高於文中列出的第八十百分位數值。它證明了兩件事:參考類別預測給出的數字遠比內部估計接近現實,而且它自己也可能被更大的分佈尾部教訓。自此之後,這套方法陸續用在英國其他大型專案,包括倫敦造價 150 億英鎊(當時約合 290 億美元)的 Crossrail,荷蘭、丹麥、瑞士也各自採用了不同形態的參考類別預測。
百分位的語言值得學起來。多數排程會議只問一個數字:什麼時候好。參考類別預測改問:你有五成把握的日期是哪天,有八成把握的日期又是哪天。對外承諾用保守的百分位,內部管理用中位數,兩個數字之間的差距就是誠實的風險溢價,它有統計基礎,而不是憑感覺加上一段緩衝。雪梨歌劇院式的災難沒有辦法根除,但你可以事先知道尾巴有多長,並決定要不要賭。
這個方法最技術性的難點叫參考類別難題:類別劃太寬,平均值失真,劃太窄,樣本又不夠。預測一本心理學教科書的寫作時間,類別該是所有書籍、所有教科書,還是所有心理學教科書。文獻裡甚至給它起了個別名叫參考類別網球,來回攻防沒有終點。實務上的解法是分層:先用大類別拿分佈形狀,再用小類別做方向性調整,並且誠實記錄類別的定義,讓下次可以修正。
行銷團隊不需要資料庫也能起步。把團隊過去完成與流產的專案都納入,建成一張表:類型、規模、當初承諾的時程、實際時程。這張表就是你的參考類別。特別注意流產的也要放進來,只挑完成案例做基準,等於在抽樣時先刪掉了分佈的右尾,Kahneman 那位課程專家口中「四成根本沒做完」的證據就會被你親手過濾掉,這正是倖存者偏差在估時裡的變形。

校準方法二:把任務拆開列舉
第二個方法直接針對機制四。Kruger 與 Evans 的論文標題就是處方:不想遲到,就先列舉(If you don't want to be late, enumerate)。他們的實驗涵蓋幾種日常任務:節日購物、出門約會前的準備、文件排版、備餐。被提示先把任務拆成子項再估計的受試者,給出的時間估計明顯更長,其中部分實驗裡,偏誤幅度直接縮小。拆解會把「報告」這一塊概念攤開成一組具體工序,各項工序會喚起各自的等待與前置。
同一份研究還給了一個省力的線索:拆解的除偏效果隨任務複雜度上升,任務愈多工面,拆解的幫助愈大。這對行銷工作很關鍵,因為行銷任務幾乎全是多工面物種。反過來說,真正單純的任務不需要儀式,硬拆只是表演。評估要不要拆的標準很簡單:這件事牽涉幾個不同的人、幾個不同的系統、幾個需要等待的核准。只要牽涉不同人員、系統或核准等待,就值得列舉。
拆解也有成本。後續研究把相關現象稱為分段效應:任務整體估的時間,顯著小於子任務時間估計的總和,而這種拆解同時需要大量認知資源,不適合每天每事都做。實務上的折衷是把拆解留給關鍵路徑:決定上線日的那條鏈,逐環列舉,其餘用參考類別的法則整體抓分佈。認知預算花在槓桿最大的地方。

校準方法三:回想相關經驗,寫下預測紀錄
第三個方法來自 Buehler 團隊 1994 年論文的第四個實驗。受試者拿到一份電腦作業,預測自己何時完成。實驗操弄他們估計前的注意力方向:一組先回想並描述過去做類似作業的經驗,一組被引導回想「相關」的過去經驗,還有一組對照組直接估。結果相當細膩:一般性的回想沒有產生效果,只有被引導回想相關經驗的那組,預測顯著變長,低估現象消失。準時完成率也說了同一件事:回想相關經驗組有 60% 的人在自己預測的時間內完成,對照組只有 29.3%,一般回想組 38.1%。
「相關」兩個字是重點。胡亂回想上禮拜做了什麼,抓到的是不相干的樣本,大腦照樣把它們編織成樂觀的感覺。唯有明確指向同類任務的記憶,才能啟動外部觀點。這給了會議室一個具體可用的提問順序:與其問「這要多久」,先問「上一次做這種事,當時估多久,實際多久」。同樣的團隊,換一個起手問句,答案就從劇本切換到分佈。
而記憶靠不住,機制二已經講過,人對過去時長的記憶本身會縮水。所以第三個方法的完整形態是書面的:替每個專案留下一行紀錄,承諾時程、實際時程、差異原因,三個欄位就夠。這份紀錄同時對抗兩個敵人,記憶的低估,以及報稅研究揭露的那個定義性特徵:承認過去樂觀,堅持這次務實。當過去的預測與實際並列在紙上,「這次不一樣」就需要提出證據,而不只是語氣。
這份實驗還留下一個對排程文化很有殺傷力的註腳。同一份實驗顯示,截止日會影響行為:拿到兩週期限的組別平均花 9.1 天交件,一週組平均 4.3 天。這組結果顯示完成時間會隨期限改變。管理者的直覺是把期限抓緊來對抗延誤,實驗顯示這一招確實有效,只不過作用的位置跟多數人以為的不同。
校準方法四:預先驗屍
第四個方法處理的是機制三的社會層。心理學家 Klein 在《哈佛商業評論》提出的預先驗屍(premortem),出發點是一個 1989 年的實驗發現:Mitchell、Russo 與 Pennington 證實,前瞻後見,也就是把未來事件想像成已經發生,能讓人正確指出未來結果成因的能力提升三成(Performing a Project Premortem)。事先想像「專案已經失敗」,比事先想像「專案可能失敗」,能挖出更多真實的失敗原因。
程序很簡單。專案啟動前,主持人宣布:這個專案已經徹底失敗了。接下來幾分鐘,在場每個人獨立寫下自己能想到的每一個失敗原因,特別是那些平常基於禮貌或政治顧慮不會說出口的顧慮。獨立書寫是設計過的:它繞過會議裡的從眾壓力,讓最資淺成員的疑慮與最資深成員的判斷在同一張紙上平起平坐,直接對治匿名實驗揭露的印象整飾動機。
寫完之後,從專案經理開始,每個人輪流唸出一條原因,不重複,直到列完。主持人把清單收攏,回頭檢視計畫本身可以怎麼強化。注意這個方法與一般風險清單的差別:風險清單問「可能出什麼問題」,答案寫成可能性,語氣軟,權重低。預先驗屍問「已經出了什麼問題」,答案是既成事實的解剖,同一條風險被寫進來時的心理重量完全不同。三成的成因辨識提升,就來自這個框架的位移。

把四種方法裝進工作流程
四種方法不是四選一,它們各自瞄準不同環節。參考類別預測決定基準線從哪裡來,任務拆解處理基準線的粒度,回想相關經驗與預測紀錄維持資料的供應,預先驗屍則在承諾之前做一輪總體檢。用一張表對照時點與產出。
| 時點 | 動作 | 產出 |
|---|---|---|
| 估計前 | 翻出自己的預測紀錄與參考類別分佈 | 外部基準線 |
| 估計中 | 關鍵路徑逐環列舉子任務 | 拆解後的工序清單 |
| 估計後 | 以 P50 供內部管理、P80 供對外承諾 | 雙軌時程承諾 |
| 承諾前 | 跑一輪預先驗屍 | 失敗原因清單與補強項 |
| 結案後 | 回寫實際時程與差異原因 | 下一輪的參考類別 |
文化的部分沒有工具可以代勞。Flyvbjerg 與 Gardner 的觀察值得放進管理制度裡:政府出資的專案常因為怕被下一任翻案而倉促開工,而較長的規劃期,結果反而更快更省。急著動工省下的前置時間,會在執行期連本帶利吐回去。對行銷組織的翻譯很直接:讓誠實的時程在制度上安全。估得準的人拿到肯定,敢報壞消息的會議不變成批鬥大會,四種方法才有長出來的土壤。
常見問題
以下整理與計畫謬誤和時程校準相關的常見疑問。







