訓練報告 · 跌倒
2026-08-05 · session:模型訓練 · MobileNetV3-Large · person-crop 384×384 正方形
同一個測試集對照,新版沒有比現役好(整體 AP 0.9904 vs 0.9953)。 依「沒退步才上版」原則維持現行模型。
但這次的資料不是白做 —— 它讓 ch20 從「幾乎無法評估」變成可以評估, 也讓 ch8 第一次有了資料。真正的判斷要等 ch8 的「倒地」樣本生成完才能下。
整體對照
兩個模型都沒看過這批新測試資料(現役 pat16 的訓練集與新測試集交集為 0),對照有效。
抓到率幾乎相同,但誤報從 3 次變 13 次。這是典型的「納入大量新場域資料後稀釋原有場域」, 與 PPE 全資料重訓的兩次實證同一個型態。
逐鏡頭
AP 欄位的箭頭是 v805b 相對現役的變化。「建議設定」是 v805b 在該鏡頭 先確保抓到 95% 以上、再取誤報最低的門檻。
| 鏡頭 | 考試用 倒地 | 考試用 沒倒地 |
v805b AP | pat16 AP | 建議門檻 | 該點表現 |
|---|---|---|---|---|---|---|
| 新東陽 ch10 | 41 | 172 | 1.000 | 1.000 | thr 0.95 | 抓到 100% · 誤報 0.0% |
| 新東陽 ch12 | 52 | 16 | 0.991 ▲0.003 | 0.988 | thr 0.95 | 抓到 90% · 誤報 6.2% |
| 新東陽 ch20 | 78 | 94 | 0.997 ▼0.003 | 1.000 | thr 0.74 | 抓到 96% · 誤報 1.1% |
| 新東陽 ch21 | 23 | 14 | 1.000 ▲0.003 | 0.997 | thr 0.87 | 抓到 96% · 誤報 0.0% |
| 新東陽 ch22 | 35 | 63 | 1.000 | 1.000 | thr 0.60 | 抓到 97% · 誤報 0.0% |
| 新東陽 ch23 | 33 | 36 | 1.000 | 1.000 | thr 0.95 | 抓到 100% · 誤報 0.0% |
| 新東陽 ch24 | 25 | 48 | 1.000 | 1.000 | thr 0.57 | 抓到 96% · 誤報 0.0% |
| 新東陽 ch6 | 21 | 55 | 1.000 | 1.000 | thr 0.95 | 抓到 100% · 誤報 0.0% |
| 新東陽 ch8 | 0 | 1,449 | 沒有「倒地」樣本,只能看誤報 | 0.0% | 0.0% | |
| 興農 151-11 | 47 | 207 | 0.998 ▼0.002 | 1.000 | thr 0.94 | 抓到 96% · 誤報 0.0% |
| 興農 151-14 | 44 | 208 | 1.000 | 1.000 | thr 0.95 | 抓到 100% · 誤報 0.0% |
| 興農 152-1 | 43 | 168 | 0.999 ▼0.001 | 1.000 | thr 0.92 | 抓到 95% · 誤報 0.0% |
| 興農 152-14 | 47 | 763 | 1.000 | 1.000 | thr 0.95 | 抓到 96% · 誤報 0.0% |
| 興農 152-6 | 41 | 189 | 1.000 | 1.000 | thr 0.95 | 抓到 95% · 誤報 0.0% |
| 興農 155-1 | 48 | 73 | 0.979 ▼0.017 | 0.996 | thr 0.46 | 抓到 96% · 誤報 2.7% |
| 興農 155-5 | 47 | 84 | 0.980 ▼0.014 | 0.994 | thr 0.95 | 抓到 96% · 誤報 2.4% |
| 興農 155-7 | 51 | 354 | 0.999 ▼0.001 | 1.000 | thr 0.95 | 抓到 98% · 誤報 0.0% |
| 愛烙達 頻道15-3樓後方走道 | 22 | 2 | 0.984 ▼0.012 | 0.996 | — | — |
| 愛烙達 頻道16-3樓走道+貨梯 | 21 | 50 | 0.996 ▲0.002 | 0.994 | thr 0.95 | 抓到 95% · 誤報 4.0% |
| 天銳國際 測試1 | 44 | 28 | 0.998 ▲0.001 | 0.997 | thr 0.62 | 抓到 95% · 誤報 3.6% |
| 天銳國際 測試2 | 32 | 34 | 1.000 | 1.000 | thr 0.86 | 抓到 97% · 誤報 0.0% |
🔴 這次要特別注意的兩件事
ch8 這次進來 4,483 個人,但全部都是「沒倒地」 —— 倒地的樣本還在生成中。
表面上看 v805b 在 ch8 的誤報是 2 次 / 1,449,現役 pat16 是 36 次, 看起來大勝。但這正是要小心的地方:
這次 ch20 用的是主線畫面(1472×704),畫面中一個人約 89×167 像素, 測試集從 2 個倒地樣本變成 78 個,AP 0.997。
模型與推論資訊
為什麼是正方形?躺著的人在畫面上是橫向扁平的, 沿用站姿的直立長方形裁切等於把人上下拉長 2–3 倍。改成正方形後,同樣資料下 AP 從 0.385 提升到 0.736、誤報降 62%。這是這個模型最關鍵的一個設定。
資料變化
| 來源 | 內容 | 人數 | 說明 |
|---|---|---|---|
| 新東陽 ch8 | 舊系統 39 段告警錄影 → 297 張畫面 | 4,483 | 全部「沒倒地」。畫面 100% 乾淨(零灰畫面),SAM3 描輪廓 |
| 新東陽 ch20 | 7 個主線畫面批次 → 61 張 | 520 | 含 87 個真實倒地。SAM3 重描輪廓後判定,與原人工標註一致 |
| 合計 | 總 crop 16,833 → 21,879 | +5,046 | — |
標註方式這一版改為 SAM3 人形輪廓(polygon)取代矩形框。 SAM3 抓到的人比原本多:ch8 從 4,533 → 6,147、ch20 從 482 → 520,多出來的主要是遠景排隊人群。
後續
產出:模型訓練 session · 2026-08-05 · 5090-2 · runs/fallcls_fall_sq_v805b