Benchmark evidence status
沒有 evidence pack,
就不稱為框架實測。
本頁不再以未附原始資料的固定數字,宣稱某個框架比較快。它公開的是一份可驗收的 benchmark 規格,以及目前尚未公開的項目。
Current publication status
目前沒有已公開、可下載的框架 benchmark dataset。
因此本站不對 Next.js、Astro、WordPress、Nuxt 或其他框架做數值排名。這不是否定它們的效能差異,而是避免把未附條件的數字當成可轉移結論。
Required evidence pack
每一個可發布比較都需要
可重建樣本
每個框架的 repo、commit hash、相同內容模型與 build/deploy 指令。
固定測試條件
瀏覽器與版本、裝置、網路、地點、日期、edge/origin 與 cache 狀態。
完整原始輸出
每次 run、樣本數、統計方式、異常值規則、trace 或 waterfall 與可下載資料。
Comparison contract
框架名稱不是比較設計。
要比較的是在明示條件下的樣本輸出,而不是抽離內容、部署與快取後的品牌印象。
01
內容等價
頁面類型、內容量、圖片、第三方程式與互動流程要能說明是否相同。
02
交付等價
CDN、edge、origin、cache、壓縮與部署流程不能被隱藏在框架名稱後。
03
量測等價
裝置、瀏覽器、網路、地點、期間、warm/cold 狀態與 run 的計算方式需一致。
04
結論等價
結果只能支撐被測樣本與條件;不同外掛、內容或流量結構需要重新驗證。
可以說的話
「在明示條件下,這個樣本觀察到 X;結果不保證能轉移到不同內容、外掛、CDN 或流量結構。」
不應說的話
「某框架一定更快」、「單次 Lighthouse 分數代表真實使用者」或未附資料的百分比改善。
Correction rule
資料修正時要保留比較邊界
若 commit、環境、樣本或原始 run 被修正,受影響的比較命題應同步更新。無法恢復原始條件時,結果不再維持為可發布 benchmark。
Reader check
讀者先問三件事
被測的是什麼?條件是否相同?結果究竟能外推到哪裡?若任一項找不到,頁面的數字不應直接用來選技術。
為什麼目前不直接列出最快的框架?
因為沒有可下載、可重建的資料集時,固定排名會遮蔽樣本、環境與應用差異。此頁公開的是未來可驗收的規格,而非替讀者做無證據選擇。
同一框架在兩個專案不同,是否代表 benchmark 沒用?
不代表;它表示比較條件與樣本需要被寫清楚。benchmark 的用途是說明可檢驗的差異,不是建立脫離情境的框架階級。