画像を入れると、文字が出てきます。 文字の認識は、すべて手元のパソコンの中で行います。画像はどこへも送りません。
日本語(現代の活字から古典籍のくずし字まで)、中国語(漢文・現代文)、英語、チベット語を読めます。 資料に合わせて、読む道具(認識エンジン)を選べます。

ダウンロード
| Windows | Microsoft ストア(無料。ストアが署名するので警告は出ません) |
| macOS | Releases(署名・公証済みの .dmg) |
導入作業は要りません。PaddleOCR-VL のモデルを動かす llama-server はアプリに同梱しています。
読む道具(認識モデル)は、初めて使うときに取得します。
動画で見る
インストール、基本の使い方、いろいろな使い方の 3 本が続けて流れます。音声は無く、字幕で説明しています。
同じ内容を、写真つきの手順でも読めます: 使い方
できること
- 入力: 画像ファイル、クリップボード、ページ画像を集めたフォルダ、IIIF マニフェストの URL
- 出力: プレーンテキスト(
.txt)または TEI/XML(.xml) - 比較: 同じページを 2 つの読む道具で読ませて、結果を並べて確かめる
- 日本語・英語の画面、ライト・ダーク両対応
リンク
- 使い方 — 動画と、写真つきの手順
- ソースコード(MIT)
- プライバシーポリシー
開発
中村 覚(東京大学) 連絡先: nakamura@hi.u-tokyo.ac.jp