honkoku-ocr-onnx
「みんなで翻刻OCR」(honkoku-ocr-web) の v13 ONNX モデルのミラー。 ブラウザ (onnxruntime-web) でくずし字の行翻刻 (seq2seq) を行うために kuzushiji-web から利用する。
cross-origin isolation (COEP credentialless) 下で access-control-allow-origin: *
を返す自前ホストから取得するためにミラーしている。
ファイル / 構成
koten-layout-best.onnx— レイアウト/行検出 (koten-layout, YOLOv8 5クラス: 全体ページ/手書き/活字/図版/印判)kuzushiji-v13-encoder-int8.onnx— エンコーダ (int8 量子化)kuzushiji-v13-decoder-prefill-int8.onnx/kuzushiji-v13-decoder-step-int8.onnx— デコーダ (KV cache, int8 量子化)rtmdet-s-1280x1280.onnx— 代替の行検出器 (NDL古典籍OCR RTMDet、任意)
アーキテクチャ: ConvNeXt エンコーダ + RoBERTa デコーダ(greedy decoding)。
語彙表は kuzushiji-web 同梱の kuzushiji-vocab-v13.json を用いる。
精度
原典で定量指標(CER・文字正解率など)は公表されていません。 本リポジトリでも未測定のため数値は記載しません(判明・測定し次第追記)。 なお encoder/decoder は int8 量子化しているため、原典 fp32 より精度が下がる可能性があります。
License / Credit
CC BY 4.0 — © 2025 Yuta Hashimoto(国立歴史民俗博物館 / 国立国会図書館)。 原典: https://github.com/yuta1984/honkoku-ocr-web 本リポジトリは onnxruntime-web 用の int8 ONNX ミラー。クレジットと原典リンクの保持を必須とする。
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support