指令 Gz2092 - SHX 文字辨識
一句話說明:框選一段由線段組成的舊字(SHX 字型),系統辨識出裡面藏著哪些字並還原成一般文字物件;辨識不到的字元會用「?」標示、整段變成紅色,提醒你必須複核。
這個指令能做什麼
用 Gz209 把 PDF 施工圖轉成 CAD 圖元後,圖上原本用 SHX 字型寫的文字(梁編號、鋼筋標註等)在轉檔過程中已經被拆成一堆線段——不是「文字」,選不到、複製不到,也搜尋不到。執行 Gz2092 後,你可以框選這些線段範圍,系統會辨識出裡面藏著哪些字,並在圖面上還原成可搜尋、可複製的一般文字物件。
決定最終文字內容的,一律是精確的形狀比對,不是猜測式的影像辨識(OCR):同一份圖裡,同一個字的線段形狀完全相同,只要你指認過一次,全圖所有長得一樣的形狀會立刻全部套用,不必逐一輸入每個重複出現的字。指認結果還會存進你的字型庫,之後遇到同樣的字型會愈用愈快。指認視窗裡另外可能出現 OCR 讀出的建議字元,那只是幫你先把輸入框填好的預填輔助,不會取代形狀比對,細節見下方操作步驟與〈注意事項〉。
已知會出錯的情況:
- 聚類可能出錯:可能把同一個字拆成兩團,或把相鄰兩個字誤併成一團,導致「指認字形」視窗列出的候選字本身就不完整或多餘
- 引線/尺寸線的轉折可能被誤認成字母(例如與「L」的形狀完全相同):這種情況下形狀比對一定會「精確命中」,系統無法自動分辨,只能靠尺寸差異事後排除,仍可能有漏網情況
- OCR 預填建議可能認錯:認錯時顯示出來的內容跟正確答案長得一模一樣,不會有任何提示告訴你「這個建議是錯的」
凡是牽涉鋼筋數量與規格的標註(例如「16-#3@15」),轉換後都必須人工複核,不可直接信任辨識結果。
適合什麼時候使用
| 情境 | 說明 |
|---|---|
| 剛用 Gz209 匯入 PDF 施工圖 | PDF 裡的 SHX 文字已變成線段,需要這個指令還原回可搜尋、可複製的文字 |
| 圖面上有大量重複的舊式字型標註 | 指認一次、同形狀全部套用,不必逐一輸入每個重複出現的字 |
操作步驟
-
執行 Gz2092,框選一段包含未知文字線段的範圍(可以是一整排標註,也可以是整張圖)。
-
系統會跳出「指認字形」視窗,列出所有還不認得的形狀(已經認得的預設隱藏,可用「顯示已認得的字形(可修正指認錯誤)」核選框叫出來修正)。視窗上方另有搜尋欄,輸入某個字元就能列出所有被指認成該字的形狀,用來揪出指認錯誤。

-
對每一個形狀輸入它代表的字元。若某個形狀其實不是文字(例如尺寸線的箭頭),可以留空不填,並勾選「未填寫者標記為『非文字』,日後不再詢問」,下次就不會再被列出來詢問。
對於還沒被形狀比對認出來的形狀,系統會另外跑一次 OCR,把結果當作參考列出。多數情況下這只是「建議」,仍需要你確認:只有當同一個形狀在圖上重複出現多次、每次 OCR 都讀出同一個答案,且該答案通過鋼筋標註格式檢查時,系統才會直接把建議預填進輸入框;其餘情況只會顯示 OCR 讀到的內容供參考,仍要靠你自行輸入。不論是否被預填,都請當作「建議」而非「答案」逐一核對後再送出,尤其是第一次出現、只讀到一次的形狀。
-
按「套用」,系統會把辨識結果轉換成文字物件寫入圖面;若只想先儲存這次的指認結果、暫不轉換圖面,可直接關閉視窗(會詢問是否保留指認)。
-
完成後會顯示一份明細:成功辨識與尚未指認的字元數量、建立了幾段文字,以及含有未指認字元的段落數。
執行後圖面會發生什麼
完全辨識成功的文字會以黃色寫入圖面;含有未指認字元的文字,不論圖層設定為何,整段強制顯示為紅色,並在缺字的位置用「?」佔位。

黃色是系統建立的文字圖層預設色(ByLayer);含未指認字元的文字則是系統直接改寫文字物件本身的顏色蓋過圖層色——紅色不是圖層設定,是刻意用來讓你在複核時一眼看到「這裡有問題」。
之所以要這麼明顯地標示,是因為鋼筋標註只要漏看一個字元(例如「16-#3@15」漏看了一個「-」),就會變成另一個合法但錯誤的標註,畫面上完全看不出差異。
原始的線段筆畫則分開處理:完整辨識的字元,其線段會移到「已辨識」圖層並自動關閉顯示;未指認的字元,其線段仍留在原圖層——這是你判斷「這個 ? 該填什麼」的唯一依據,關掉已辨識圖層後,畫面上剩下的線段就是還沒處理到的部分。
注意事項
看到紅色文字時務必複核,不要直接忽略——那代表這一段標註還缺字,且系統本來就無法幫你猜這個字是什麼。
- 指認結果會存進你的個人字型庫,跨案子持續累積,不需要每個新案子都重新指認一次。個人庫存放於本機使用者資料目錄(
%LocalAppData%\Grebarz\shx-fingerprints.json),可自行備份或搬到別台電腦延續累積成果。 - 若某個形狀在聚類時被拆散或誤併(常見於冒號的兩個點、中文字部件被拆開),可改用 Gz2093 直接框選整團筆畫手動指定。
- 辨識完成的文字與已辨識圖層固定使用「PDF_」開頭的圖層名稱,不會沿用你在 Gz209 匯入時自訂的圖層前綴。
- 決定最終文字內容的不是傳統的影像文字辨識(OCR),而是精確的線段形狀比對,因此準確率高,但也代表無法處理掃描件(拍照或掃描機掃出來的 PDF)。指認視窗裡出現的 OCR 建議字元,只是用來預填輸入框、降低逐格輸入負擔的輔助功能,不是最終辨識結果,也不會改變這裡說的核心機制。
相關指令
| 指令 | 關係 |
|---|---|
| Gz209 | 將 PDF 匯入為 CAD 圖元,是本指令的前置作業 |
| Gz2091 | 兩點比例校正,同一套流程中建議依序完成的前一步 |
| Gz2093 | 手動指定字形,Gz2092 自動辨識失手時的補救指令 |