AI-OCR ―― 読ませて、自信のない所だけ人が見る

写真を撮ると、文字を読み、どこを読んだか(枠)と読み取りの信頼度、その文字が何の項目かの確度を出します。入力欄を押すと画像の枠が光り、枠を押すと入力欄に飛びます。確かめて「確定」を押したものだけが残ります。

ゴールは全自動ではありません。人が見る所を、10か所から0.5か所に減らすことです。信頼度の高い所は見ずに確定し、赤い所だけ見ます。
画像を選ぶと読み取りを始めます。最初の1回は、読み取りの辞書(日本語)を読み込むので数十秒かかります。

画像は外へ送りません。読み取りはこの端末のブラウザの中で行います(Tesseract.js 5.1.1)。本番で精度を上げるときは、Claude に画像を読ませて二重に確かめます。

緑 85%以上黄 60〜85%赤 60%未満:人が見る

読み取り結果

まだ読み取っていません。

名刺の一覧(この端末に保存)

RPA・OCRは、Claudeで自分で作る方が優れている理由

RPA・OCRのパッケージ自作(Claude+この型)
やり方画面のクリックをまねる/決まった帳票の枠を読む読む → 判断する → 書く を1本のプログラムで。画面ではなくAPIを叩く
壊れ方画面や帳票の枠が変わると止まる項目の振り分けは文字の意味で決めるので、レイアウトが変わっても動く
人の確認全部見直すか、全部信じるか信頼度で色分けし、赤だけ見る(10か所 → 0.5か所)
費用ライセンス 年数十万円〜+保守サーバーとAPIで月数千円
直すまでベンダーに依頼その日。意地悪な見本を足して、決まりごとを直す

製造業なら:FAXの注文書 → 製番の下書き、ミルシート(材料の証明書)→ 材料と製番のひも付け、手書きの検査記録 → 検査成績書、取引先の名刺 → 顧客の一覧。