計畫謬誤時程校準:歷史紀錄、等待工序、風險檢查
估計時程時,將歷史紀錄、等待工序與風險條件納入,避免只靠順利展開的想像。

什麼是計畫謬誤?校準專案時程的四種方法

計畫謬誤指人們預測自己任務的工期時系統性偏樂觀,連過去多次延誤的經驗都擋不住,小從報稅與畢業論文、大到雪梨歌劇院與各國巨額工程都有紀錄。整理成因機制,並提供參考類別預測、任務拆解、回想相關經驗與預先驗屍四種校準方法。

  • 計畫謬誤
  • 計畫謬誤是什麼
  • 計畫謬誤 例子
  • 專案時程估計
  • 時程估計方法
  • 估計偏誤
  • 參考類別預測
  • reference class forecasting
  • 外部觀點
  • 內部觀點
  • 預先驗屍
  • premortem
  • 任務拆解
  • 樂觀偏誤
  • 專案管理偏誤

約 26 分鐘閱讀作者:Whoops 編輯團隊

本頁目錄

計畫謬誤(planning fallacy)是心理學家 Kahneman 與 Tversky 在 1979 年提出的偏誤:人在估計自己任務的完成時間時,會呈現樂觀偏誤並系統性低估實際所需時間。後續研究把它擴充成更完整的形態:我們低估未來行動的時間、成本與風險,同時高估它的效益。以下整理這個偏誤的證據、成因,以及四種有研究或實務依據的校準方法,從個人任務一路談到大型專案。

行銷與網站工作的人對這個現象不陌生。官網改版原訂近期上線,之後仍在等待資料搬遷。活動頁答應客戶儘快交付,結果卡在法務意見與素材檔期。內容產製持續排入新稿,結算時達成率仍明顯不足。這些情況裡,責備執行的人沒有意義,因為問題出在估計的形成方式,而估計的形成方式可以改。

先講定義與三組經典研究,接著看大型專案的統計證據與雪梨歌劇院的完整案例,拆解內部觀點與外部觀點的差異,列出六個讓估計失準的機制,與錨定效應、樂觀偏誤等相鄰概念劃清界線,把場景拉回行銷實務,收在四種校準方法與一張工作流程對照表。適合三種人讀:要對客戶承諾時程的行銷主管、負責排程與資源協調的專案成員,以及經常覺得自己「明明很認真卻一直在趕工」的執行者。

與站上其他文章的銜接先講清楚。計畫謬誤屬於判斷偏誤家族,這個家族如何影響消費者與行銷決策,消費者心理學的完整整理有系統性的說明。同家族的錨定效應與它互為表裡,後面會用一節專門對照。挑參考案例時怎麼避開只看成功者的陷阱,可以再對照倖存者偏差的解析。這幾篇合起來,剛好覆蓋行銷人做預測時最常踩的三種系統性錯誤。

計畫謬誤的定義:樂觀的預測,冷漠的記憶

計畫謬誤的定義可以寫成一句話:對未來任務所需時間的預測,呈現出樂觀偏誤,系統性低估實際所需。這個現象有個令人生氣的特質:即使當事人知道自己過去對類似任務的預測曾過度樂觀,下一次估計仍可能照樣樂觀。知識改變不了預測,因為預測的原料根本不是那些知識。

Buehler、Griffin 與 Ross 三位學者在 1994 年的論文裡給過更精準的描述:對自己的專案將按計畫進行抱持信心,即使明知絕大多數類似專案都曾延誤,這種傾向就叫計畫謬誤。這個定義點出了兩個成分:一是「自己的」,二是「即使明知」。換成白話:別人的案子會拖,是常態。我的案子會拖,是不可思議。

2003 年,Lovallo 與 Kahneman 在《哈佛商業評論》把定義擴充到時間之外:低估未來行動的時間、成本與風險,同時高估同一個行動的效益(Delusions of Success 一文)。這個擴充很重要,因為它解釋了為什麼商業決策會出現「大膽的預測、保守的行動」這種矛盾組合:效益被高估、成本被低估,投資評估的中間那格報酬率就被灌水了。專案還沒開始,帳面上就已經贏了。

還有一個反方向的細節值得記住:計畫謬誤只作用在對「自己任務」的預測上。當旁觀者預測別人的任務時,偏誤方向會反過來,傾向高估所需時間,呈現悲觀偏誤。這解釋了職場上常見的對峙:執行團隊與外部顧問給出差距很大的工期,雙方都以為對方不專業。其實兩邊各自踩在不同的偏誤上,真正的答案需要第三種來源,後面的校準方法會給。

三組經典研究:從畢業論文到報稅季節

第一組證據來自前面提到的 1994 年論文(Exploring the "Planning Fallacy")。研究團隊找來 37 位正在寫畢業論文的心理系學生,請他們估計自己還需要多少天才能完成。學生的最佳估計平均是 33.9 天。實際的平均完成時間是 55.5 天,比估計多了六成以上。只有大約三成的學生,真的在自己預測的時間內交出論文。

更有意思的是研究還請學生做了兩個情境估計:如果一切順利到不能再順利,要幾天。如果一切糟到不能再糟,又要幾天。順利情境的平均是 27.4 天,最壞情境的平均是 48.6 天。實際完成時間平均為 55.5 天,高於最壞情境估計的平均 48.6 天。這是計畫謬誤最扎心的證據形式:連想像力開到最悲觀的檔位,都不夠悲觀。

第二組證據測的是校準程度。另一項研究請學生針對自己的個人學業專案,給出三個完成時間:有五成把握完成的時間、七成五把握的時間,以及九成九把握的時間。結果只有 13% 的人在自稱五成把握的時間點前完成,19% 的人在七成五的時間點前完成,45% 的人在九成九的時間點前完成。換句話說,受訪者自認「幾乎一定會做到」的期限,有超過一半的人做不到。人對自己預測的信心,本身就是膨風的。

日常任務也逃不掉。1997 年發表的一項加拿大報稅者調查發現,人們寄出報稅表的時間,平均比自己的預測晚了約一個星期。這些受訪者對自己過去遲寄的紀錄一清二楚,沒有半點誤解,只是堅信這一次會不一樣。研究者把這個現象列為計畫謬誤的定義性特徵:人們承認自己過去的預測太樂觀,同時堅持現在這個預測是務實的。

把三組數據放在一起看,可以得出一個對實務很有用的結論:這些研究顯示,即使是學生與有生活經驗的成人,也會出現計畫謬誤。寫論文的學生不笨,報稅的成人都很有生活經驗,問題出在預測的建構方式。當大腦用「想像這件事順利展開的劇本」來代替「統計類似事情的真實分佈」,樂觀就是數學上的必然。要修的不是人,是估計的流程。

當專案放大:十個有九個超支的鐵律

個人任務如此,巨型專案更慘。專案管理學者 Flyvbjerg 整理大型基礎建設的績效資料,結論直接寫在他 2014 年的綜述論文裡(What You Should Know About Megaprojects and Why):十個巨型專案有九個成本超支。實質超支在五成以內算常見,超過五成也不算少見。他把這個現象命名為巨額專案的鐵律:超支、超時,一次又一次。

案例的名單本身就很有說服力。英法海底隧道實質超支八成。丹佛國際機場晚啟用十六個月,總成本 48 億美元,超出預期二十多億。波士頓把高架道路埋進地下的 Big Dig 工程,原編預算 28 億美元(1988 年幣值),實際花了 80.8 億,晚了七年。英國全民醫療的 IT 系統超支四到七倍。雪梨歌劇院超支約 1,400 個百分點。柏林布蘭登堡機場原定 2011 年 10 月啟用、預算 28.3 億歐元,拖到 2020 年 10 月 31 日才開幕,支出接近一百億歐元。

名單還可以往下列。歐洲戰機計畫比原訂晚了六年,超支金額約 80 億歐元。芬蘭 Olkiluoto 核電廠三號機 2005 年動工時預定 2009 年完工,實際到 2023 年才完工,成本從約 30 億歐元膨脹到約一百億。韋伯太空望遠鏡超支約 90 億美元,發射比原始規劃晚了十四年。這些專案橫跨國防、能源與科學,規模與領域各不相同,劇本卻像同一個模板印出來的:初期承諾的日期與數字,與最終兌現的差距以倍數計。

專案成本超支幅度時程結果
英法海底隧道實質 80%未列時程結果
丹佛國際機場200%晚啟用十六個月
波士頓 Big Dig220%晚了七年
英國 NHS IT 系統400% 至 700%未列時程結果
雪梨歌劇院約 1,400%晚了十年
柏林布蘭登堡機場約 253%(28.3 億逼近一百億歐元)2011 年承諾,2020 年開幕

表中超支幅度沿用 2014 年那份綜述的實質口徑;正文裡丹佛與波士頓的金額是計畫當年幣值的絕對數字。百分比與絕對值出自不同基準,並用時以各自來源為準。

更麻煩的是這不是偶發的年代問題。同一份綜述指出,在可取得可比數據的七十年區間裡,超支幅度持續維持高檔,民間部門與公共部門皆然,有資料的國家與洲別也通通中獎。換句話說,在這七十年間,巨額專案的超支幅度沒有明顯改善。這組資料呈現的是超支結果,不能單獨把全部差距歸因於計畫謬誤。

跟行銷工作距離最近的版本是大型 IT 專案。麥肯錫與牛津大學重大計畫管理中心合作、以超過 5,400 個 IT 專案為基礎的 2012 年研究發現:初始預算超過 1,500 萬美元的大型 IT 專案中,有一半嚴重爆掉預算,平均超支 45%、超時 7%,交付價值比承諾少了 56%(Delivering large-scale IT projects on time, on budget, and on value)。還有 17% 的 IT 專案糟糕到可能威脅公司存續,這類被稱為黑天鵝的個案,預算超支幅度定義在兩倍以上,極端可達四倍。官網改版、電商平台遷移、CRM 導入,全都落在這個光譜上。

雪梨歌劇院:計畫謬誤的標準教材

如果要挑一個案例讓主管秒懂計畫謬誤,雪梨歌劇院大概是最好用的(沿革資料見雪梨歌劇院條目)。1957 年的原始估計:造價 350 萬澳鎊,相當於改制後約 700 萬澳幣,並且在 1963 年 1 月 26 日澳洲國慶日啟用。實際結局:1973 年才完工,造價 1.02 億澳幣,實質超支 1,357%,晚了十年。標價七百萬的地標,最終付出十四倍以上的代價。

它是怎麼走歪的。新南威爾斯州政府擔心輿論與經費轉向,急著讓工程早點開始,於是在建築師還沒完成最終設計圖的狀態下,1959 年 3 月就動工。外殼的幾何形狀遲遲無法定案,中途從拋物線改成球面切塊,等於邊蓋邊改結構。到 1961 年 1 月,工程已經落後四十七週,而這時距離原定啟用日只剩兩年。每一個環節都在告訴你:時程的失守找不到單一意外可以歸咎,它從第一天起就沒有站穩過。

雪梨歌劇院把計畫謬誤的三個放大器展示得很完整。未定案就開工,讓後續的每一次設計變更都直接侵蝕時程。政治壓力主導啟動時點,讓「先上再說」壓過了準備度評估。造價的數字也在設計之前就定案:1957 年喊出的 350 萬澳鎊,比外殼結構的解法早了四年。行銷專案裡對應的場景一模一樣:客戶簽約的壓力讓提案時程先天樂觀,需求還沒鎖定就答應了上線日,改版過程的每一輪意見都在重播雪梨的外殼難題。

為什麼會估不準:內部觀點與外部觀點

Kahneman 自己最愛講的例子,是一個課程開發專案,Flyvbjerg 在 2006 年的論文裡完整重述了它(From Nobel Prize to Project Management)。當年 Kahneman 參與一個團隊,為以色列高中設計新科目教材,成員是一批學者與教師。某天團隊討論:整個專案要多久才能完成。每個人匿名寫下自己估的月數,答案是 18 到 30 個月之間。

接著團隊裡一位課程開發的資深專家被問了另一個問題:回想你見過的類似團隊,在他們目前這個階段,後來各花了多久才收尾。專家想了半天,不太舒服地承認:他想得到的可比團隊裡,約有四成根本從未完成任務。有完成的,他想不到有哪一個花少於七年,也想不到有哪一個花超過十年。再追問:我們這個團隊有比那些更強嗎。專家的答案是沒有,資源與潛力甚至略低於平均。

理性的下一步顯而易見:認賠收手,或至少重新設定期望。實際發生的事是團隊無視這些資訊,照原樣推進,結果花了八年才完成,而且成果幾乎沒有被使用。同樣一個問題,同一批人,兩種問法得到 18 到 30 個月與七到十年兩個世界。這兩種問法,就是內部觀點與外部觀點的全部差別。

內部觀點是這樣預測的:緊盯眼前這個專案的目標、手上的資源、預期的障礙,在腦中構思進度開展的劇本,再把當前的趨勢外推到未來。聽起來非常專業,問題是劇本裡只放得下想得到的元素,而延誤的來源,意料之外的審查、生病、需求追加、跨單位等待,在事前剛好都屬於想不到的那一類。外部觀點則完全不管眼前專案的細節,甚至不嘗試預測會發生什麼事,它去找一整類類似專案的經驗,攤開這個參考類別的成果分佈,再把眼前專案放進那個分佈裡定位。

劇本與歷史分開估:順利劇本、類似專案、成果分布
內部觀點依目前專案構思進度;外部觀點先看類似專案的實際結果,再定位眼前任務。

內外之差有實驗支持。研究顯示,只要請人回答幾個需要採取外部觀點的簡單問題,預測就顯著變準。一個經典的對照是:請新生自評入學後的學業表現會贏過同系同學的百分比,平均答案竟是 84%,這在數學上根本不可能成立,平均而言,這些學生把自己放在分佈的右半邊。計畫謬誤就是同一種心理在時間軸上的版本:專案估計容易把自己放到「順利的那一邊」,而忽略分佈本身。

Kahneman 與 Tversky 在 1979 年的論文裡已經把藥方寫好了:分析者應當盡一切努力,把預測問題框限到能夠善用所有可得分佈資訊的形態。Flyvbjerg 對這句話的評語是,這或許是透過改善方法來提升預測準確度的唯一最重要建言。記住這句話,四種校準方法裡的第一個,就是這句話的工程化。

六個讓估計失準的機制

機制一:聚焦於未來的劇本

聚焦謬誤(focalism)是解釋計畫謬誤的一種機制:預測時注意力全部押在未來這個任務上,根本沒有回想過去那些「當時也以為很單純」的類似任務。你在心裡演練的是改版上線時的事,而不是過往上線延誤的情況。劇本式的想像力很動人,但它是最好的情境,最好的情境拿來當基準線,就不叫估計,叫許願。

機制二:記憶本身就有偏

那把過去的經驗叫回來總可以了吧。Roy 等學者的研究給了壞消息:人對過去事件時長的記憶,本身就系統性低估。過去那次的等待、中斷、來回修改,在回憶裡都被壓縮掉,只留下主幹。既然回憶裡的過去比真實的過去快,用回憶校正未來,等於拿一份灌過水的對帳單理財。這也是為什麼校準方法裡特別強調書面紀錄,記憶不能上場。

機制三:自利歸因與印象整飾

Buehler 團隊的解釋還加上一層社會動機。人們回顧過去表現時傾向自利歸因:準時完工歸功於自己,延誤歸咎於外部因素,於是歷史證據一進入自我敘事就被過濾。更有趣的是,當受試者匿名做預測時,樂觀偏誤竟然消失了。這說樂觀的估計有一部分是做給別人看的:報一個令人滿意的時程,比報一個真實的時程更受歡迎。估計不只是認知活動,也是表演。

機制四:任務沒有被拆開

Kruger 與 Evans 在 2004 年提出的機制更機械:多工面的任務在預測時沒有被自然拆解成子任務。寫一份白皮書這個估算單位,心裡只出現「寫」,不會自動浮出訪談、找圖、校稿、法務確認這些零碎工序,而工期恰恰藏在零碎裡。任務在腦中是一塊,時間就會被估成一塊。這直接對應到校準方法裡的拆解法,後面會看到拆解被驗證的效果。

機制五:團體預測沒有免疫

不要指望開會能中和偏誤。Sanna 與同事在 2005 年的三個研究證實,計畫謬誤照樣作用於團體任務的預測,而且時間框架愈寬鬆、對成功完成的想像愈豐富,預測就愈樂觀。會議室裡的集體想像,本質上是多個人共用同一個劇本,劇本裡的難關還是隱形的。人多不會自動產生分佈資訊,只會產生共識。

機制六:制度性動機,策略性誤導

這一層已經超出心理學,進入誘因設計。專案規劃經常發生在需要爭取核准的場合,規劃者有動機把數字壓低,先拿到授權再說。研究文獻把這種蓄意低報稱為策略性誤導,背後的邏輯很冷:事後的超支容易被原諒,事前的誠實數字很難被核准。提案比稿殺價、內部搶預算、給客戶一個聽了會簽字的日期,屬於同一個物種。它跟前面五個機制的差別在於:這一個不是判斷錯誤,是賽局選擇,解法也不在認知,在治理。

與相鄰概念的界線

樂觀偏誤(optimism bias)是最常被混用的鄰居。它是較廣的認知偏誤,與過度自信及忽略成果分佈資訊有關。計畫謬誤可以看成這種傾向在預測自己任務時的具體表現,Kahneman 與 Tversky 的診斷是:人的判斷普遍樂觀,源頭在過度自信,加上對成果分佈資訊的忽視。講白話:樂觀偏誤是你覺得明天會更好,計畫謬誤是你覺得這週一定做得完,後者可以被流程校正,前者比較接近體質。

若要進一步比較相鄰概念,可以讀錨定效應與調整不足的解析。

資訊界流傳的 Hofstadter 法則是工程師版的自我調侃,出自 Douglas Hofstadter 在 1979 年的著作《Gödel, Escher, Bach》:Hofstadter's law: It always takes longer than you expect, even when you take into account Hofstadter's law. Hofstadter 法則:事情的耗時總是比你預期的長,即使你把這條法則本身考慮進去也一樣。它好笑的地方在於自指:你知道會低估,於是加了緩衝,而加完緩衝的數字又成了新的預期,繼續被低估。這條法則提醒我們,靠「自己多留心」並沒有療效,因為多留心仍然是內部觀點的一種。

軟體工程還有一條布魯克斯法則,出自《人月神話》:對已經延誤的專案增加人手,溝通與訓練的開銷會讓它更晚。它跟計畫謬誤經常成對出現,因為低估時程的專案,接下來最常見的補救動作就是加人,然後在更高的人力成本上再次延誤。估錯是第一次受傷,用錯方法救火是第二次,傷口還更深。

行銷與網站專案裡的計畫謬誤

把鏡頭拉回行銷現場。網站改版是標準的重災區:設計定稿、內容搬遷、轉址規劃、SEO 檢查、第三方串接,每一項在排程表上都只是一格,每一格展開來都有各自的等待與來回。麥肯錫那份研究的樣本正是這類大型 IT 工程,45% 的平均超支聽起來像嚇唬人的故事,其實是幾千個案子的平均地心引力。活動上線也同構:檔期協調、素材審核、法務意見、投放系統的審核佇列,排程時這些環節連名字都還不存在,何況估時間。

內容產製的版本更隱蔽。一篇深度文章從選題到發布,中間有研究、訪談、寫作、審稿、配圖、上稿,寫作本身可能只佔部分時間。排程表以「篇」為單位時,所有周邊工序被壓縮成一個欄位,於是每個月的產能都被高估。SEO 的成效時程則是另一種計畫謬誤:排名與流量的累積速度取決於搜尋引擎的週期與競爭環境,這個變數完全不在團隊控制範圍內,對客戶承諾「短期見效」的提案,先天就是把外部世界的分佈資訊排除在估計之外。計畫謬誤在這類對外承諾裡的破壞力,比內部排程更大:內部估錯頂多加班消化,對外估錯,燒掉的是信任與下一張合約。

代理商與客戶之間的動力,會把前述兩種偏誤同時放大。內部團隊出於印象整飾報出樂觀時程,客戶端的採購與老闆又帶著旁觀者的悲觀偏誤全面打折,雙方在各自主觀裡討價還價,得標的那個數字跟現實的分佈沒有直接關係,只反映談判力量。策略性誤導也活在同一條縫裡:比稿需要漂亮的天數,先贏再說。要跳出這個賽局,更多誠意幫不上忙,真正需要的是一個雙方都無法否認的外部基準,這正是下一節的主題。

校準方法一:外部觀點與參考類別預測

參考類別預測(reference class forecasting)是把 Kahneman 那句「善用分佈資訊」工程化的方法,學理基礎正是 Kahneman 與 Tversky 的原始研究。操作上三個步驟:第一步,找出一組過去的、類似的專案,這組就是參考類別。第二步,為這個類別建立你要預測的那個參數(工期或成本)的機率分佈。第三步,把眼前這個專案跟分佈相比對,用分佈替它定位出最可能的結果。注意第二步的用詞是分佈,不是平均值:平均值告訴你中央在哪,分佈才告訴你尾端拖多長。

這個方法已經被政府採用。Flyvbjerg 與工程顧問公司 COWI 在 2004 年把方法落成實務指引,由英國交通部在當年六月以官方指引文件的形式發布。第一批實際應用之一,是愛丁堡輕軌二號線在 2004 年 10 月的商業案例審查。當時這條線的預估總成本是 3.2 億英鎊,其中 6,400 萬英鎊被列為應變預備金,相當於扣除預備金後基礎預算的 25%。顧問公司用參考類別預測重算:第八十百分位的數值,即有八成機會守得住的上限,是 4 億英鎊,等於 57% 的預備金。第五十百分位則是 3.57 億英鎊,等於 40% 的預備金。

這個案例的後續很有教育意義。這條輕軌線最終晚了三年,在 2014 年 5 月通車,決算成本 7.76 億英鎊,換算回 2004 年幣值是 6.28 億,高於文中列出的第八十百分位數值。它證明了兩件事:參考類別預測給出的數字遠比內部估計接近現實,而且它自己也可能被更大的分佈尾部教訓。自此之後,這套方法陸續用在英國其他大型專案,包括倫敦造價 150 億英鎊(當時約合 290 億美元)的 Crossrail,荷蘭、丹麥、瑞士也各自採用了不同形態的參考類別預測。

百分位的語言值得學起來。多數排程會議只問一個數字:什麼時候好。參考類別預測改問:你有五成把握的日期是哪天,有八成把握的日期又是哪天。對外承諾用保守的百分位,內部管理用中位數,兩個數字之間的差距就是誠實的風險溢價,它有統計基礎,而不是憑感覺加上一段緩衝。雪梨歌劇院式的災難沒有辦法根除,但你可以事先知道尾巴有多長,並決定要不要賭。

這個方法最技術性的難點叫參考類別難題:類別劃太寬,平均值失真,劃太窄,樣本又不夠。預測一本心理學教科書的寫作時間,類別該是所有書籍、所有教科書,還是所有心理學教科書。文獻裡甚至給它起了個別名叫參考類別網球,來回攻防沒有終點。實務上的解法是分層:先用大類別拿分佈形狀,再用小類別做方向性調整,並且誠實記錄類別的定義,讓下次可以修正。

行銷團隊不需要資料庫也能起步。把團隊過去完成與流產的專案都納入,建成一張表:類型、規模、當初承諾的時程、實際時程。這張表就是你的參考類別。特別注意流產的也要放進來,只挑完成案例做基準,等於在抽樣時先刪掉了分佈的右尾,Kahneman 那位課程專家口中「四成根本沒做完」的證據就會被你親手過濾掉,這正是倖存者偏差在估時裡的變形。

未完成案例也要留下:完成紀錄、流產紀錄、完整參考類別
建立參考類別時,把完成與未完成的專案都保留,避免只挑成功案例形成偏差。

校準方法二:把任務拆開列舉

第二個方法直接針對機制四。Kruger 與 Evans 的論文標題就是處方:不想遲到,就先列舉(If you don't want to be late, enumerate)。他們的實驗涵蓋幾種日常任務:節日購物、出門約會前的準備、文件排版、備餐。被提示先把任務拆成子項再估計的受試者,給出的時間估計明顯更長,其中部分實驗裡,偏誤幅度直接縮小。拆解會把「報告」這一塊概念攤開成一組具體工序,各項工序會喚起各自的等待與前置。

同一份研究還給了一個省力的線索:拆解的除偏效果隨任務複雜度上升,任務愈多工面,拆解的幫助愈大。這對行銷工作很關鍵,因為行銷任務幾乎全是多工面物種。反過來說,真正單純的任務不需要儀式,硬拆只是表演。評估要不要拆的標準很簡單:這件事牽涉幾個不同的人、幾個不同的系統、幾個需要等待的核准。只要牽涉不同人員、系統或核准等待,就值得列舉。

拆解也有成本。後續研究把相關現象稱為分段效應:任務整體估的時間,顯著小於子任務時間估計的總和,而這種拆解同時需要大量認知資源,不適合每天每事都做。實務上的折衷是把拆解留給關鍵路徑:決定上線日的那條鏈,逐環列舉,其餘用參考類別的法則整體抓分佈。認知預算花在槓桿最大的地方。

把等待放回關鍵路徑:不同人員、系統交接、核准等待
對決定交付日的關鍵路徑逐環列舉,把不同人員、系統與核准等待納入估計。

校準方法三:回想相關經驗,寫下預測紀錄

第三個方法來自 Buehler 團隊 1994 年論文的第四個實驗。受試者拿到一份電腦作業,預測自己何時完成。實驗操弄他們估計前的注意力方向:一組先回想並描述過去做類似作業的經驗,一組被引導回想「相關」的過去經驗,還有一組對照組直接估。結果相當細膩:一般性的回想沒有產生效果,只有被引導回想相關經驗的那組,預測顯著變長,低估現象消失。準時完成率也說了同一件事:回想相關經驗組有 60% 的人在自己預測的時間內完成,對照組只有 29.3%,一般回想組 38.1%。

「相關」兩個字是重點。胡亂回想上禮拜做了什麼,抓到的是不相干的樣本,大腦照樣把它們編織成樂觀的感覺。唯有明確指向同類任務的記憶,才能啟動外部觀點。這給了會議室一個具體可用的提問順序:與其問「這要多久」,先問「上一次做這種事,當時估多久,實際多久」。同樣的團隊,換一個起手問句,答案就從劇本切換到分佈。

而記憶靠不住,機制二已經講過,人對過去時長的記憶本身會縮水。所以第三個方法的完整形態是書面的:替每個專案留下一行紀錄,承諾時程、實際時程、差異原因,三個欄位就夠。這份紀錄同時對抗兩個敵人,記憶的低估,以及報稅研究揭露的那個定義性特徵:承認過去樂觀,堅持這次務實。當過去的預測與實際並列在紙上,「這次不一樣」就需要提出證據,而不只是語氣。

這份實驗還留下一個對排程文化很有殺傷力的註腳。同一份實驗顯示,截止日會影響行為:拿到兩週期限的組別平均花 9.1 天交件,一週組平均 4.3 天。這組結果顯示完成時間會隨期限改變。管理者的直覺是把期限抓緊來對抗延誤,實驗顯示這一招確實有效,只不過作用的位置跟多數人以為的不同。

校準方法四:預先驗屍

第四個方法處理的是機制三的社會層。心理學家 Klein 在《哈佛商業評論》提出的預先驗屍(premortem),出發點是一個 1989 年的實驗發現:Mitchell、Russo 與 Pennington 證實,前瞻後見,也就是把未來事件想像成已經發生,能讓人正確指出未來結果成因的能力提升三成(Performing a Project Premortem)。事先想像「專案已經失敗」,比事先想像「專案可能失敗」,能挖出更多真實的失敗原因。

程序很簡單。專案啟動前,主持人宣布:這個專案已經徹底失敗了。接下來幾分鐘,在場每個人獨立寫下自己能想到的每一個失敗原因,特別是那些平常基於禮貌或政治顧慮不會說出口的顧慮。獨立書寫是設計過的:它繞過會議裡的從眾壓力,讓最資淺成員的疑慮與最資深成員的判斷在同一張紙上平起平坐,直接對治匿名實驗揭露的印象整飾動機。

寫完之後,從專案經理開始,每個人輪流唸出一條原因,不重複,直到列完。主持人把清單收攏,回頭檢視計畫本身可以怎麼強化。注意這個方法與一般風險清單的差別:風險清單問「可能出什麼問題」,答案寫成可能性,語氣軟,權重低。預先驗屍問「已經出了什麼問題」,答案是既成事實的解剖,同一條風險被寫進來時的心理重量完全不同。三成的成因辨識提升,就來自這個框架的位移。

先獨立寫再一起找風險:假設已失敗、獨立書寫、補強計畫
預先驗屍先把失敗當作假設,各自寫下原因,再共同整理並補強計畫。

把四種方法裝進工作流程

四種方法不是四選一,它們各自瞄準不同環節。參考類別預測決定基準線從哪裡來,任務拆解處理基準線的粒度,回想相關經驗與預測紀錄維持資料的供應,預先驗屍則在承諾之前做一輪總體檢。用一張表對照時點與產出。

時點動作產出
估計前翻出自己的預測紀錄與參考類別分佈外部基準線
估計中關鍵路徑逐環列舉子任務拆解後的工序清單
估計後以 P50 供內部管理、P80 供對外承諾雙軌時程承諾
承諾前跑一輪預先驗屍失敗原因清單與補強項
結案後回寫實際時程與差異原因下一輪的參考類別

文化的部分沒有工具可以代勞。Flyvbjerg 與 Gardner 的觀察值得放進管理制度裡:政府出資的專案常因為怕被下一任翻案而倉促開工,而較長的規劃期,結果反而更快更省。急著動工省下的前置時間,會在執行期連本帶利吐回去。對行銷組織的翻譯很直接:讓誠實的時程在制度上安全。估得準的人拿到肯定,敢報壞消息的會議不變成批鬥大會,四種方法才有長出來的土壤。

常見問題

以下整理與計畫謬誤和時程校準相關的常見疑問。

常見問題

計畫謬誤和樂觀偏誤有什麼不同?
樂觀偏誤是對未來結果普遍高於統計的期待,屬於較廣的認知偏誤。計畫謬誤則是它的一個特定切面:對自己任務的工期、成本與風險,給出系統性偏低的數字。實務上的差別在於可處理性:任務層的估計可以用流程校正,廣義的體質傾向則需要靠外部資料與制度來框限。
明明記得以前都延誤,為什麼新的估計還是太樂觀?
兩個原因。第一,注意力押在未來任務的劇本上,過去的類似經驗根本沒有被叫出來比對,這是聚焦謬誤。第二,就算回想了,大腦留存的過去耗時本身就是縮水版,等待與中斷在回憶裡被壓縮,於是校準的原料先天不足。加拿大報稅調查裡的受訪者清楚記得自己遲寄的紀錄,卻照樣相信這次會準時,正是這種組合的展示。書面的預測紀錄是同時對付兩者的工具。
小型行銷團隊沒有大型資料庫,用得起參考類別預測嗎?
可以,而且門檻很低。參考類別預測的三個步驟是找一組過去的類似專案、建立成果分佈、把眼前專案放進分佈定位。團隊自己的歷史專案紀錄可以逐步形成參考類別,用來觀察分佈的大致形狀與尾端長度。要留意的是樣本必須包含失敗與流產的案例,只挑完成的案子會刪掉分佈右尾,等於用倖存者偏差再造一次樂觀。
預先驗屍和一般的風險評估有什麼差別?
問句的框架不同。風險評估問未來可能出什麼問題,答案以可能性的語氣寫下,權重低,容易流於形式。預先驗屍宣布專案已經失敗,請每個人獨立寫下失敗原因,把同一條隱憂變成既成事實的解剖。1989 年的實驗顯示這種前瞻後見能把正確辨識未來成因的能力提升三成。獨立書寫的設計還順帶處理了會議從眾壓力,讓不方便說的顧慮有正式出口。
有沒有可能反而把時程估得太長?
有,而且方向明確。研究顯示偏誤與立場綁定:對自己的任務,人傾向低估時間。換成旁觀者預測別人的任務,偏誤會反向,變成系統性高估。執行者與外部顧問各自報出的天數南轅北轍,常見的對峙就是這樣來的,兩邊各自站在不同的偏誤上。估計流程引進外部基準與分佈資料,目的就是讓數字脫離立場,而非把天平從一端搬到另一端。
給客戶的時程,應該直接灌水嗎?
灌水沒有依據,也撐不住追問。比較站得住的做法是雙軌報價:以參考類別分佈算出五成把握與八成把握兩個日期,對外承諾用保守的那個,內部管理用中位數那個,並向客戶說明兩者的統計含義。這比任意加上一段黑數更好溝通,被挑戰時也拿得出推理過程。反過來靠策略性低報搶下案子,等著兌現的是事後更難看的超支,這在大型專案統計裡已經反覆上演。
任務拆解有什麼副作用?
主要副作用是認知成本。拆解會讓子任務時間的加總大於整體任務的估計,這可用來減少低估,但同時代表它很耗腦力,不適合拿來估每一件小事。研究的另一個發現提供取捨依據:任務愈複雜、愈多工面,拆解的除偏效果愈大。實務上把拆解留給決定上線日的關鍵路徑,其餘任務用參考類別分佈整體處理,是兼顧準確與成本的配置。

主題聚落|消費者心理與 Persona 人物誌 看「品牌與行銷策略」中樞 →

相關文章

Whoops 巫普斯科技有限公司

專注技術 SEO、GEO/AEO 與 AI 搜尋實務。本站文章以可驗證資料、公開來源與實作觀察整理而成。

關於 Whoops編輯守則服務內容

想把這篇的方法用在自己的站上?

SEO 健檢、GEO/AEO 引用優化、網頁設計諮詢——把文章裡的方法落地到你的網站。