辨識核心已實作,產品化開發中
一場賽事拍完,照片要能依選手號碼搜尋,才方便大家找到自己。但照片裡的號碼不一定正對鏡頭,有時很小、有時被衣服遮住,也可能同時出現好幾個人。
我做的是這中間的辨識與後端處理:從照片找出號碼,再把結果交回呼叫系統。
先找到號碼在哪裡,再讀出來
辨識分成兩段。先用模型找出號碼布的位置,把那個區域裁出來,再辨識裡面的數字。這樣拆開後,結果不對時就能分辨:是沒找到號碼布,還是找到了、卻讀錯數字。
照片多了,還需要處理模型以外的事
我把接收請求的 API 和執行辨識的 GPU worker 分開。照片先進入任務佇列,worker 下載、辨識並保存結果,呼叫端可以稍後查詢。
這部分看起來不像模型那麼醒目,卻決定了整套東西能不能被其他程式使用。只跑得動一張圖,和能接住一批照片,是兩件不同的事。
接下來要驗證什麼
目前已有辨識核心、任務佇列與結果查詢。接下來的重點是用實際賽事資料比較錯辨、漏辨與整批完成時間;完整 SaaS、計量與容量承諾仍在產品化範圍內。

