VIX 掉到 17.05、財報週安安靜靜:加碼之前,先用「換件測試」拆一次你手上那張績效表
讀者互動
0 次瀏覽,登入會員可按讚與收藏。
最近這幾天的盤面很無聊。2026 年 7 月 21 日美股收盤,恐慌指數 VIX 收在 17.05,前一個交易日還有 18.65,落在系統定義的「正常」區間中段;SPY 收在 748.28 美元,當天漲 0.83%;用波動率模型算出來的下一日年化波動率預估是 12.7%(以上取自 7 月 22 日的每日策略建議,該篇基於 7 月 21 日收盤數據,資料來源 yfinance)。
美股財報週已經開打,行事曆上密密麻麻,市場卻懶洋洋。
平靜的盤,最容易誘發同一個動作:打開那份存了很久的回測報告,看到年化多少、最大回檔多少、曲線一路往右上,然後把加碼鍵按下去。
這篇要處理的問題只有一個: 那張漂亮的績效表,是策略真的有效,還是樣本期送給你的?
一個可以帶走的動作:換件測試
修車廠診斷引擎抖動,做法是一次只換一個零件,換完發動看看還抖不抖。同時換五樣,你永遠不知道問題出在哪。
回測報告可以用同一套邏輯拆。任何一張績效表的背後,都掛著一串你看不見的設定:資料是誰供應的、測哪一段歷史、訊號幾點下單、報酬怎麼算、拿什麼尺去量、參數用幾年資料估、標的名單怎麼挑出來。 一次只換掉其中一件,其餘全部不動,然後看那張表活不活。
這就是換件測試。
我們自己跑了四個多月的實驗,每一件都親手換過,也每一件都被打過臉。以下這張清單是骨幹,先看表,再看每一項的實際落差。
| # | 換掉哪個零件 | 換法 | 我們自己那次的落差 |
|---|---|---|---|
| 1 | 資料來源 | Yahoo 行情 → 交易所原始紀錄交叉核對 | 年化波動率 26.04% → 17.96% |
| 2 | 樣本期 | 參數鎖死,換一段完全不同的歷史重跑 | 17 個候選只活 8 個,陣亡率 52.9% |
| 3 | 下單時點 | 訊號當天生效 → 延一天才能下單 | 風險調整後評分 1.98 → 0.81 |
| 4 | 報酬口徑 | 昨收到今收 → 今開到今收 | 風險調整後評分 3.514 → -0.168 |
| 5 | 量尺 | 收盤價估波動 → 高低價區間估波動 | 結論從「表現普通」翻成「明顯變差」 |
| 6 | 估計窗口 | 252 / 504 / 1000 / 2000 天各跑一遍 | 沒有一個窗口通吃五個時期 |
| 7 | 樣本名單 | 事後挑標的 → 事前鎖死並打時間戳記 | 統計強度 -5.16 → -2.20,聯合檢定全滅 |
七件裡面,只要有一件換完數字就垮,那張表就不能拿來當加碼的理由。
下面一件一件拆。
換件 1:換資料來源
先從最底下那層開始。連價格都可能是假的。
2014 年 7 月 23 日,颱風麥德姆讓台股休市。在〈市場休市,資料卻說有交易:一筆假行情如何把回測結論翻面〉這篇裡,我們打開一份 Yahoo Finance 的歷史行情,加權指數那天卻留著開高低收四個欄位。把前後兩天並排才看得出來:整列數字原封不動複製前一個交易日。2016 年 7 月 8 日也出現同樣的整列複製。0050 在其他颱風停市日則是另一種填法,四個價格全都相同、成交量掛零。
電腦不認識颱風假。回測程式看到日期和價格,就把那天算成一個報酬為零的交易日,滾動視窗往後位移一格,事件日期跟著錯開。
更兇的是另一種壞資料。0050 在 2014 年 1 月 2 日有過一筆約負 75% 的幻影拆股斷點,那天 0050 沒有蒸發四分之三市值,是價格供應商的前後期調整尺度沒接好。單日一個錯誤,會一路滲進 21 日、63 日、126 日的滾動波動率,凡是吃到那個視窗的模型都把人造斷點當成市場風暴。
清理前後重跑,同一份資料的四個讀數變成這樣:
| 回測讀數 | 未清理 | 清理後 |
|---|---|---|
| 0050 年化波動率 | 26.04% | 17.96% |
| VIX 對未來台股波動的解釋比例 | 3.64% | 25.67% |
| 每日調整策略的風險調整後評分 | 0.41 | 1.20 |
| 殖利率曲線與 126 日後波動的關係 | +0.117 | -0.272 |

最後一行請多看兩秒。殖利率曲線跟半年後波動的關係,清理前是正的 +0.117,清理後變成負的 -0.272,連方向都翻過來。
那次研究還有一個附帶收穫:清完資料,舊結論可能維持也可能翻盤,事前看不出來。跨境避險那份重跑之後主要結論仍然成立,殖利率曲線那份就整個轉向。四組實驗全部得重跑,逐項比對。
換件 1 的做法:拿一個獨立來源核對。加權指數缺資料時,去看同市場 ETF、成交量、融資融券或交易所統計。要注意兩個代號若都來自 Yahoo,背後可能是同一條供應鏈,源頭一起漏檔,核對兩遍也不會更可靠。我們那次掃出六個殘差候選,只有 2024 年 10 月 31 日康芮颱風成立,其餘五個分別被 ETF 行情、官方交易資料或春節假期邊界排除掉。
換件 2:換樣本期
這一件最殘忍,也最便宜。
2026 年 3 月,我們把連續編號的 68 個實驗全部重新分類統計,寫成〈換一個樣本期,一半的策略當場死掉:我們公開自己 68 個實驗的成績單〉。完全沒效果的 24 個,明確有效的 15 個,有效率 22.1%,無效率 35.3%。平均每 8.5 個實驗才換得到一個站得住腳的發現。
砍人的關卡在後面。68 個裡有 18 個走到「跨樣本期驗證」這一關,其中 17 個有明確的存活或陣亡判定。做法很單純:參數不准調,模型不准改,就是換一段完全不同的期間,用同樣的設定再測一次。
8 個存活,9 個陣亡。陣亡率 52.9%。

擲硬幣的存活率是 50%。我們這 17 個候選是 47.1%。
每一個陣亡的實驗,在第一段樣本期都拿出過看起來漂亮的成績。如果當時停手發文,會有九篇讀起來很有說服力、卻禁不起換期考驗的文章掛在站上。
那份成績單裡還藏著一個更貼近散戶的教訓。陣亡名單有三個實驗測的是同一件事:把一個預測得還不錯的模型,接上實際的下單規則。三個全部失敗。模型把明天的波動猜得比對照組準,換算成部位調整、扣掉交易成本之後,優勢就沒了。猜得準跟賺得到,中間隔著一段距離,而漂亮的預測準確度圖表通常不會把那段距離畫出來。
換件 2 的做法:問賣你策略的人一句「這條策略在哪一段期間測的,換另外一段還成立嗎」。如果對方只給你一張全期間的累積曲線,那張曲線沒有回答這個問題。
換件 3:換下單時點
有一年我們的研究系統跑出一個風險調整後評分 1.98 的策略,邏輯簡單到不行:VIX 高就減碼,VIX 低就加碼。一般基金經理能做到 0.5 到 1.0 就算優秀。1.98 是另一個等級。
在〈你看到的回測報酬可能是假的:一個讓評分膨脹 100% 的陷阱〉裡,我們自己把它推翻了。
起疑的點是另一個指標。那個 12/VIX 策略相對風險值模型的優勢比率顯示為 2.04 倍。一個不需要任何統計模型的簡單公式,比精心估計的模型好兩倍,說不通。
翻程式碼,問題出在一個看似無害的時間索引。程式用 今天的 VIX 決定 今天的持倉比例 ,再用 今天的報酬 算績效。VIX 和 SPY 的日報酬同期相關係數是 +0.65,股市暴跌那天 VIX 飆升,模型「已經知道」要減碼。每個暴跌日都被避開,每個大漲日都被抓到。
你不可能在早上九點半開盤前,就知道今天收盤時 VIX 會是多少。
改成用今天的 VIX 決定明天的持倉,延遲一天,讓訊號變成真的可以執行:
| 指標 | 修正前 | 修正後 | 膨脹幅度 |
|---|---|---|---|
| 風險調整後評分 | 1.98 | 0.81 | +145% |
| 12/VIX 相對風險值模型優勢 | 2.04 倍 | 1.08 倍 | +89% |
12/VIX 這條策略仍然有效,優勢從壓倒性縮成微弱。這才是可以拿去下單的版本。
有意思的是,同一份程式裡的傳統波動率模型完全不受影響。因為它的設計天生只吃過去的資料,用昨天收盤前的所有資訊預測今天的波動,沒有任何未來資訊可偷看。統計模型的價值在這裡,不在於它比較聰明,在於它比較誠實。
換件 3 的做法:拿到任何回測,先問訊號是幾點觀察到的、幾點下單的。用到「當天」任何資料去決定「當天」交易的策略,直接打回票。這個坑不限於 VIX,當天成交量、當天新聞情緒分數、當天隱含波動率,全都適用。
換件 4:換報酬口徑
換件 3 講的是時間索引錯一格,換件 4 是同一天裡面你到底賺得到哪一段。
2026 年 4 月,我們設計了一個跨市場策略,測試美股 SPY 的隔日走勢能不能預測台灣 0050 當日方向。這個假說有底:SPY 對台股的領先落後相關係數約 0.40,統計上通得過嚴格門檻。
結果非常好看。整段樣本的風險調整後評分 3.400,樣本外那段 5.053,五個時期全部勝出,方向準確度 64.1%。
然後程式碼被審了一遍,抓出三個高嚴重度問題,其中影響最大的是報酬計算方式。詳細過程寫在〈評分 3.5 到 -0.17:一個報酬計算選擇讓跨市場策略崩潰〉。
原版用的是昨收到今收。這段時間包含兩截:台股昨天 13:30 收盤到今天 09:00 開盤的隔夜跳空(約 20 小時),加上今天 09:00 到 13:30 的盤中走勢。
問題在於,美股訊號幾乎百分之百反映在隔夜跳空裡。台灣投資人在美股收盤後就知道 SPY 漲跌了,隔天開盤前就下單,開盤價已經把訊號消化掉。等你 09:00 進場,資訊早就沒了。
改成今開到今收,也就是你實際能吃到的那一段:
| 指標 | 昨收到今收 | 今開到今收(可交易) |
|---|---|---|
| 年化平均報酬 | 18.1% | 5.1% |
| 滾動相關係數(SPY→台股) | 0.410 | 0.009 |
| 策略風險調整後評分 | 3.514 | -0.168 |
| 方向準確度 | 63.9% | 50.2% |

方向準確度 50.2%,就是擲硬幣。相關係數從 0.410 掉到 0.009,領先落後訊號在開盤那一瞬間就被市場定價完畢。評分膨脹 +3.68,是我們遇過幅度最大的假突破。
領先落後訊號本身是真的,可以賺的那部分躺在你進不去的隔夜跳空裡。這跟更早一次的研究結論一致:那次算出來的超額報酬有 77% 到 93% 落在隔夜跳空,扣掉台指期 58.5 個基點的交易成本後不可執行。
換件 4 的做法:把報酬拆成「你進場前發生的」和「你進場後發生的」,只認後面那段。任何跨時區、跨市場、跨交易時段的策略,這一件必換。
換件 5:換量尺
前面四件都在換輸入,這一件換的是評分標準。
我們有個進階模型,原本在黃金 ETF(GLD)上用傳統的收盤價量尺檢驗,結論是「跟基準模型差不多,沒什麼特別優勢」。收盤價只是一個瞬間的價格。一檔股票白天可能從 100 漲到 105、跌到 97、再回到 100 收盤,收盤等於開盤,但當天波動很大。只看收盤,你會以為今天沒什麼事。
換成高低價區間量尺,拿當天最高價和最低價估真實波動,這個量尺在學術文獻上更可靠。重跑之後,〈你看的回測績效可能是假的:換個「量尺」,黃金模型就穿幫〉的結論是:那個進階模型其實在 明顯讓預測變差 ,差的程度遠超過統計顯著門檻。

同一個模型,同一段時間,只換一把更精準的尺,結論從「還好」變成「有害」。那次我們用了 4 種不同的波動量尺做穩健性檢驗,結果一致:傳統收盤價量尺掩蓋了模型的實際損害。
這件事離散戶比想像中近。「策略年化報酬 15%」是用日線、週線還是調整後收盤價算的?「A 基金比 B 基金好」是比波動率、比風險調整後評分,還是比最大回檔?換個指標排名可能翻盤。「我的投資組合波動率 12%」是用絕對報酬還是區間法算的?可能差一倍。
換件 5 的做法:多看幾個指標,別只看一個。看報酬也看最大回檔,看整段也看逐年。一個策略在五個不同指標下都還說得過去,才值得多看一眼。
換件 6:換估計窗口
前五件是抓錯,這一件是抓「你以為有標準答案的地方其實沒有」。
估模型參數要用多少歷史資料?一年(252 個交易日)、兩年、四年,還是直接拉八年讓模型看最多?直覺說資料越多越好。
在〈回測窗口設多久?我們把 252、504、1000、2000 天在五個時期跑了一遍〉裡,我們用同一個波動率模型預測 SPY,同時跑四種窗口,跨五個樣本外期間(2012–13、2014–15、2016–17、2020–21、2023–24,共 2,508 個交易日)比誰準。
| 樣本外期間 | 平均 VIX | 本期冠軍 |
|---|---|---|
| 2012-13 | 16.0 | W=504 |
| 2014-15 | 15.4 | W=252 |
| 2016-17 | 13.5 | W=1000 |
| 2020-21 | 24.5 | W=1000 |
| 2023-24 | 16.2 | W=252 |

平均排名:W=252 是 1.8,W=1000 是 2.0,W=504 是 2.4,W=2000 是 3.8。八年窗口五期全部墊底,一次都沒贏過。原因指向參數被 2008 金融海嘯之前的資料拉著走,把「波動會持續多久」估得太高:W=2000 的持久性估計在多個期間高達 0.992,W=252 只有 0.95 到 0.97。
有兩個地方值得停一下。第一,2020–21 那段高波動期,最好的是 W=1000,不是最短的 W=252。「市場亂的時候要用短窗口跟上」這個直覺在那段被打臉,2020 年的波動太極端,只看近一年的資料反而讓模型過度貼合單一危機。第二,我們對「較短窗口比較好」做了正式檢定,統計強度 -1.73,只達到 10% 水準的邊緣顯著;多重比較校正之後,11 組比較沒有任何一組達標。
結論要講到位:W=2000 確實最差,但「短窗口贏」這句話在統計上站得不夠穩。三個較短窗口之間並沒有顯著差異。
換件 6 的做法:把你的參數估計期間換成 0.5 倍和 2 倍各跑一次。三個版本結論一致,才叫穩。這件事也提醒一個更基本的問題:如果一份回測從頭到尾只有一組參數設定,那份回測沒有做過這一關。
換件 7:換樣本名單
最後一件,換的是「你測了哪些標的」。
在早期一組研究裡,我們測試台積電等大型股在季報公告後的異常波動行為,想看不同產業有沒有差異。IC 設計那組只放了聯發科和瑞昱兩家。這兩家在更早的分析裡就已經被標記為「季報後波動下降」的代表。沒有納入的是同屬 IC 設計的聯詠(同一套方法跑出來的係數是正的,方向相反)和群聯。
6 家裡先挑 2 家答案符合假說的進來,漏掉另外 4 家,其中至少 1 家答案相反。跑出來的結果自然漂亮,係數 -2.29×10⁻³,達到最高等級的顯著水準。
〈當「顯著」變不顯著:預先登錄如何揭穿 cherry-pick〉記錄了我們怎麼補這一刀。做法是在任何數字開始計算之前,先用固定的隨機種子從 8 個產業各自抽樣,把最後 32 家公司的清單寫成文件,提交進版本庫。那個提交的時間戳記早於任何估計運算,事後無法回頭「預先登錄」。
聯詠和群聯都進來了。數字變成這樣:
| 統計量 | 只選 2 家 | 預先登錄 31 家 |
|---|---|---|
| 樣本數 | 14 家 | 31 家 |
| IC 設計效果 | -2.29×10⁻³ | -1.24×10⁻³ |
| 統計強度 | -5.16 | -2.20 |
| 多重比較校正後 | 未校正 | 不再達標 |
| 全產業聯合檢定 | 達到顯著 | 不再顯著 |

效果縮水 46%,統計強度衰減 57%。最關鍵的是最後一行:把 8 個產業同時放進模型問「產業之間有沒有系統性差異」,聯合檢定完全失敗。IC 設計那組的信賴區間直接跨過 0 軸,裡面既有季報後波動下降的個股,也有上升的,同一產業內部的差異比產業之間還大。
基於這個結論,我們在後續的分析框架裡放棄了「以產業分桶」這個方向,改用個股自己的波動敏感度估計值分級。
換件 7 的做法:看到「這個策略在 A 股、B 股都有效」,先問樣本是事前決定還是事後挑的,以及測試過程中總共試了多少個沒被貼出來的版本。最後這個問題最關鍵也最難拿到答案。試了 100 個想法挑最好的那個來炫耀,跟只試了一個就成功,攤在紙上長得一模一樣。
全部換過還活著的東西長什麼樣
七件都在講怎麼把東西弄死。那通過的長什麼樣?
我們目前最穩的一個發現,是把 VIX 加進波動率模型的那個版本(A4f)。〈五個市場時代、從沒輸過:A4f 波動率預測的跨時間穩健性驗證〉把 2015 到 2026 年切成五個互不重疊的時段:低波動牛市(VIX 均值 15.1)、COVID 崩盤到復甦(26.4)、後 COVID 暴力修正、升息後期(15.9)、近期 AI 熱與貿易戰交替。
五段全勝,改善幅度從 +3.4% 到 +8.4%。整段樣本外期間(2,828 筆)合計改善 6.27%。

五連勝要怎麼讀?如果兩個模型預測力一樣、純靠運氣抽籤,連贏五次的機率是 3.1%。
還有兩個交叉檢查。第一,用一年期滾動視窗逐日計算「最近一年誰領先」,11 年樣本外期間裡沒有任何一個視窗是舊模型領先的。第二,模型裡決定 VIX 貢獻強度的那個關鍵參數,從 2015 到 2026 每三個月重估一次、共估了 45 次,45 次全部為正,沒有一次翻負。假設這個改進只是某段時間的偶然,那個參數應該會有幾次翻負或接近零。
誠實的邊界也要一起講。COVID 那段改善幅度最大(+8.4%),但只有 377 筆資料,統計力道不夠,不能宣稱顯著。中等 VIX(15 到 25)那個區間,兩個模型幾乎打平,改善只有 1%,而市場大多數時間就待在那裡。優勢明確的地方在極端平靜(+9.0%)和極端恐慌(VIX>35 時 +25.9%,樣本只有 63 筆)。
這才叫「通過換件測試」的樣子:換時代、換波動環境、換滾動視窗、換重估次數,結論方向都沒翻,而且每個沒把握的地方都標出來。
這週你可以做的事
VIX 17.05、財報週正在跑,帳面上多半是綠的。要加碼之前,把手上那張績效表拿出來,照這七件走一遍:
- 驗料 :報告裡最大的那個單日漲跌是哪一天?查一下那天市場真的有開嗎、有沒有除權息或拆股。找不到資料清理說明的漂亮曲線,可信度先打折。
- 換期 :這條策略在哪一段測的?拿另外一段完全不同的期間,參數不准動,重跑一次。
- 換時點 :訊號幾點觀察、幾點下單?用當天資料決定當天交易的,直接淘汰。
- 換口徑 :報酬有沒有把你進場前的跳空算進去?只認你進場後的那一段。
- 換量尺 :換兩個指標重排名次。只在一個指標下領先的策略,不算領先。
- 換窗口 :參數估計期間乘以 0.5 和 2 各跑一次,三個版本結論要一致。
- 換名單 :標的是事前定的還是事後挑的?總共試過幾個沒貼出來的版本?
七件全過,那張表才配得上你按下加碼鍵。七件裡有一件換完就垮,垮掉的那件就是你真正買到的東西。
市場很安靜的時候,這七件的成本最低。等波動回來再做,你會沒空。
本期精選
- 市場休市,資料卻說有交易:一筆假行情如何把回測結論翻面(2026-07-10):颱風停市日的複製行情與幻影拆股斷點,把 0050 年化波動率從 17.96% 灌到 26.04%。
- 換一個樣本期,一半的策略當場死掉:我們公開自己 68 個實驗的成績單(2026-07-22):68 個實驗完整成績單,走到跨期驗證的 17 個候選陣亡 9 個。
- 你看到的回測報酬可能是假的:一個讓評分膨脹 100% 的陷阱(2026-03-17):訊號延遲一天,風險調整後評分從 1.98 掉回 0.81。
- 評分 3.5 到 -0.17:一個報酬計算選擇讓跨市場策略崩潰(2026-04-02):美股對台股的領先訊號是真的,可賺的部分躺在你進不去的隔夜跳空裡。
- 你看的回測績效可能是假的:換個「量尺」,黃金模型就穿幫(2026-04-14):換一把更精準的波動量尺,黃金模型從「表現普通」變成「明顯有害」。
- 回測窗口設多久?我們把 252、504、1000、2000 天在五個時期跑了一遍(2026-06-21):八年窗口五期全墊底,但短窗口贏的幅度在統計上只是邊緣顯著。
- 當「顯著」變不顯著:預先登錄如何揭穿 cherry-pick(2026-06-06):6 家裡挑 2 家跑出三顆星,補齊到 31 家後聯合檢定全滅。
- 五個市場時代、從沒輸過:A4f 波動率預測的跨時間穩健性驗證(2026-06-06):換時代、換波動環境、換滾動視窗都沒翻,通過換件測試的樣子。
本期盤面數字取自 2026-07-22 每日策略建議(mile_bab9ba0f),資料來源 yfinance(SPY / GLD / ^VIX / 0050.TW),VIX 17.05 為 2026-07-21 收盤。各換件案例的樣本期間、實驗編號與原始結果檔路徑,見上列各篇文末標注。
免責聲明:本文為研究方法與投資教育用途,呈現的是我們內部研究流程的歷史紀錄與已發表分析,不構成任何投資建議。投資請自行判斷並承擔風險。
懶人包圖組



相關文章
先讀正式關聯,若無則使用標籤與主題相似度補齊