AI-OCRで注文書を読んで、受注登録まで試す
OCRエンジンと生成AIを切り替えて、同じ注文書を読み比べられます。印刷の注文書・スキャンしたPDF・手書きのFAXで、合う読み方が違うことをその場で確かめられます。
1読む書類を選ぶ
2読み方を選ぶ
OCRエンジン
生成AI(gemma4(ローカル))
生成AIは当社のサーバーで動くローカルのモデルです。客先の環境では、クラウドのAPIにも切り替えられます。
3結果を確かめて、受注登録する
4受注の一覧(あなたが登録した分だけ表示)
| 受注ID | 登録日時 | 注文番号 | 発注者 | 希望納期 | 明細 | 合計 | 読み方 | |
|---|---|---|---|---|---|---|---|---|
| まだありません。 | ||||||||
客先でOCRのデモを即興で組むためのフレームワーク
Kurage OCR Work は、この画面そのものを客先の書類に合わせて組み替えるための土台です。読み取りの部品と取り出す項目を設定で切り替え、画面・API・MCPのどこからでも同じ処理を呼べます。
PaddleOCR・Tesseract+OCRmyPDF・Docling・生成AIの直読みを同じ形の結果で返します。MinerUは利用者が自分で入れる追加の部品です。新しいエンジンも1つのクラスを足すだけで画面に出ます。
使わない(規則で拾う)/OCRの文字から項目にする/画像を直接見て項目にする、の3通り。AIを使えない客先でも、定型の帳票なら規則で動きます。
注文書・請求書・納品書など、取り出す項目と明細の列を profiles/*.json に書くだけで、画面の入力欄と生成AIへの指示が変わります。
確認した内容を台帳に登録し、CSVで書き出すか、基幹システムやkintoneの中継へJSONで送ります(送り先は設定で指定)。
AIエージェントから呼ぶ(MCP)
{"mcpServers":{"kocrwork":{"command":"/path/to/kocrwork/.venv/bin/python","args":["-m","kocrwork.mcp_server"]}}}
# 道具: list_engines / read_document(path, engine, llm, profile) / register_order(data) / list_orders
よくある質問
AI-OCRとは何ですか?
文字を読み取るOCRに、生成AIなどの判断を組み合わせて、書類から「注文番号」「金額」「明細」といった項目まで取り出す仕組みです。読み取った文字を項目に分ける部分と、手書きや崩れた文字を読む部分にAIを使います。
手書きのFAXも読めますか?
読めます。このデモの見本では、手書きで記入されたFAXの注文書を、OCRの文字だけで項目にすると約3割、生成AIに画像を直接見せると約9割の項目が正解と一致しました。見本の手書きは手書き風のフォントで作ったものなので、実際の書類で試して確かめてください。
生成AIを使わずに動かせますか?
動かせます。生成AIを「使わない」にすると、見出しの語の右や下にある値を規則で拾います。定型の印刷の注文書なら、PaddleOCRと規則だけで見本の全項目が一致しました。
書類を社外に出さずに使えますか?
使えます。OCRエンジンはすべて自社のサーバーで動き、生成AIもローカルのモデル(gemma4など)を選べます。このデモに上げたファイルは24時間で消えます。
どのエンジンを選べばいいですか?
印刷のきれいな書類はPaddleOCR、Excelなどから書き出した文字の入ったPDFはDocling、スキャンしたPDFを検索できるようにしたいならTesseract+OCRmyPDF、手書きや崩れたFAXは生成AIに画像を読ませる方法が向いています。「全部で読み比べる」で、手元の書類に合うものを確かめられます。