honkoku-ocr-onnx

「みんなで翻刻OCR」(honkoku-ocr-web) の v13 ONNX モデルのミラー。 ブラウザ (onnxruntime-web) でくずし字の行翻刻 (seq2seq) を行うために kuzushiji-web から利用する。

cross-origin isolation (COEP credentialless) 下で access-control-allow-origin: * を返す自前ホストから取得するためにミラーしている。

ファイル / 構成

  • koten-layout-best.onnx — レイアウト/行検出 (koten-layout, YOLOv8 5クラス: 全体ページ/手書き/活字/図版/印判)
  • kuzushiji-v13-encoder-int8.onnx — エンコーダ (int8 量子化)
  • kuzushiji-v13-decoder-prefill-int8.onnx / kuzushiji-v13-decoder-step-int8.onnx — デコーダ (KV cache, int8 量子化)
  • rtmdet-s-1280x1280.onnx — 代替の行検出器 (NDL古典籍OCR RTMDet、任意)

アーキテクチャ: ConvNeXt エンコーダ + RoBERTa デコーダ(greedy decoding)。 語彙表は kuzushiji-web 同梱の kuzushiji-vocab-v13.json を用いる。

精度

原典で定量指標(CER・文字正解率など)は公表されていません。 本リポジトリでも未測定のため数値は記載しません(判明・測定し次第追記)。 なお encoder/decoder は int8 量子化しているため、原典 fp32 より精度が下がる可能性があります。

License / Credit

CC BY 4.0 — © 2025 Yuta Hashimoto(国立歴史民俗博物館 / 国立国会図書館)。 原典: https://github.com/yuta1984/honkoku-ocr-web 本リポジトリは onnxruntime-web 用の int8 ONNX ミラー。クレジットと原典リンクの保持を必須とする。

Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support