Kav 歷史量測摘要 量測日期:2026-09-29、2026-10-07。展示整理日期:2026-10-07。 高鐵整趟對話(使用者提出需求至最後回覆) Kav:22 秒(修前誤讀抵達時間)、20 秒、23 秒。 Claude in Chrome:118、151、98、98 秒。 約 22 vs 116 秒。Kav 列出 5 班,對照有時翻頁查更多;工作量不完全相同。 修前誤讀後加入欄名,重跑核對正確。單站小樣本,非所有任務的一般速度保證。 台銀匯率整趟對話 Kav 19 秒,對照 20 秒,各 1 次,未顯示速度優勢。 獨立程式執行樣本 高鐵 6.4 秒,Kev 呼叫 0 次。不能與整趟對話時間混算。 Switch 2 多站比價 5.6–7.8 秒,Kev 呼叫 18–31 次,約 6–11 千 token。 比價未做相同方法的速度對照;組合包判斷仍有誤判。 錄製真人驗收(2026-09-30) 前兩次因錄製/轉換問題失敗,修正後第 3 次示範產出草稿。 乾淨環境先被 cookie 視窗阻擋,補步驟後 6.2 秒重播,與標記 5 班車逐格一致。 換條件台中→左營 10/07 09:00,6.8 秒、5 列核對一致。示範本身 63 秒。 2026-10-01 使用者確認儲存。多步驟錄製與示範修復仍待真人驗收,2026-10-07 已暫停;591 兩個轉換缺口未修。 來源 260930-thsr-demo-acceptance 與 2026-10-07 專案狀態。 591 抓取與判斷對照(2026-10-07) 引擎 pick_groups 抓 30 筆列表文字:31 毫秒,僅抓取階段,非含載入、判斷、回覆的端到端時間。 Claude in Chrome 到真實頁面,三題 43 / 162 / 21 秒;每題輸入含快取累計 91 / 61 / 45 萬 token,不代表相同數量的新輸入或帳單成本。 Kev:30 列、18 題,零錯選,5 題該停全停。13 題唯一解含 2 題字面比對;排除後需模型的 11 題只選對 4 題,兩條件與比較級保守停下。 Claude 讀文字:26 列版 16 題全對,11 題唯一解與 5 題該停;整批 24.6 秒。瀏覽器組另 3 題全對。各組列數、題數不同,不是完整同題對照。 實驗只測選哪列,沒有端到端 pick 點擊;卡片標題文字不固定且開新分頁,現有 pick 無法完成。 pattern 曾漏 4/30 列;最新程式回傳 rows_skipped,讓規則漏列可見。 結論:本機程式抓取與驗證,判斷題交給 Claude;Kev 選配,不以本地模型加速為主張。 來源:261007-pick-judgment-experiment、DECISIONS 2026-10-07。 其他限制 建立流程、安裝、修復的一次性成本不包含在重用時間。 修復只在一個網站、兩種壞法上盲測。 對照 session 可能被釘選記憶污染,不是完全乾淨的盲測。 首頁播放速度和示意資料不是量測證據。 來源記錄 ID 260929-control-experiment-and-demo 260929-kev-usage-accounting 原始記錄存在專案 .flightwake/records/,公開於 https://github.com/kaiwutech-TW/kav-fastwebagent 。