紙の教材を使っていると、カードにしたい語や説明を 打ち直す 手間で作成が止まります。写真を撮って、テキストとして取り出せれば その1段は消せます。
RepeCa の画像 OCR は、写真から文字を読み取り、一括作成のプレビューへ直接流します。 iPhone の中だけで動くので、通信も課金も発生しません。認識できるのは日本語と英語です(下記の制約に注意)。
このページは、その 画像 OCR の機能を、対応言語・出力形式・限界まで含めてまとめたものです。このサイトは RepeCa の開発元が運営しています。
どこで使えるか
画像 OCR は、次の2箇所から呼び出せます。
| 導線 | 起点 | 挙動 |
|---|---|---|
| 一括作成画面の「写真から読み取る(OCR)」 | フォルダ > 一括作成 | 抽出したテキスト行を、そのまま一括作成の入力欄へ流し込む |
| 1枚カード作成の「写真から」ボタン | カード追加モーダルの表/裏の入力欄横 | 抽出したテキストを、その欄へ追記する(表はスペース区切り・裏は改行区切り) |
どちらもカメラで撮るか、写真ライブラリから選ぶかを選べます。
対応言語は、日本語と英語だけです
中国語・韓国語・その他の言語には対応していません。
画像 OCR は Apple の Vision フレームワークを使っていますが、RepeCa はそのうち ja-JP と en-US の2言語に固定 して呼び出しています。フレームワーク自体は多くの言語を扱えますが、RepeCa の側で明示していない言語の文字は返ってきません。
これは、日本語学習と英語学習を主軸にしているアプリの構成上の判断です。中国語や韓国語の教材を撮影しても、文字はほぼ返ってこない ので、これらの言語で画像 OCR を使いたい場合は、他の手段(iOS 標準の Live Text など)を選んでください。
出力は「テキストの行」で、Q/A の分割は別の工程です
画像 OCR が返すのは、認識できた文字の行を並べた配列 です。「これが表・これが裏」といった構造は付いていません。
RepeCa は、この文字列を 一括作成のパーサ に渡します。パーサは次の4方式を 同時に試して、最もカード化できた方式を採用 します。
| 方式 | 書式 |
|---|---|
| Q/A マーカー | Q. 〜 の次の行に A. 〜 |
| 区切り文字 | 表,裏 / 表:裏 のように1行1カード |
| 空行区切り | 1行目が表、続く行が裏。カード間は空行 |
| CSV | カンマ区切り |
「これは Q/A です」とユーザー側で申告する必要はなく、判定は自動です。プレビューを確認してから取り込み、意図と違うカードは1枚単位で除外できます。
撮り方と、限界
認識そのものは Apple の Vision に委ねているため、精度は撮り方と対象に依存します。実装している立場から、期待するべきこと・しないほうがよいこと を先に書きます。
- 1段組の範囲 を、なるべく正対して、明るい場所で撮る (2段組は左右の行が交互に混ざります)
- 表組み はセルの対応関係が失われる (行の並びとして出てくる)
- 横書きの印刷物 は実用的な精度で読める
- 縦書きの書籍・手書きのノートは弱い (残っている課題です)
- 図の中の文字は本文と区別されず混ざる
「教科書を1ページ丸ごと」の使い方は、想定していません。取り込み量が多くなるほど、その後の復習負荷は必ず戻ってきます(1日20枚でも1年後には毎日約290枚)。撮った素材をどう割ってカードにするかは、暗記カードの作り方の原則 を参照してください。
端末の中だけで、通信も課金もありません
画像 OCR は、Apple の Vision フレームワーク と VNRecognizeTextRequest を使った 端末内の処理 です。写真がサーバーに送られることはなく、追加費用も発生しません。機内モードでも動きます。
教材の写真は著作物であることが多いので、この点は使ううえで実際に効いてきます。
iOS 標準の Live Text との違いは、手数だけです
認識そのものの精度は同じ です。iOS 標準の テキスト認識表示(Live Text) も、RepeCa の画像 OCR も、どちらも Apple の Vision を使っています。
違うのは アプリを移動しないで済む手数 だけです。写真アプリで長押ししてコピー、RepeCa に戻って一括作成に貼り付け——この手順が、RepeCa の中で完結します。
⚠️ 中国語・韓国語などの教材 については、Live Text のほうが対応言語の面で優位です(iOS 全体の設定に従うため)。写真経由の取り込みが必須であれば、iOS 標準側を使ってください。
動作条件と、正直に伝える制約
- iOS 16 以降 の iPhone で使えます(Apple の Vision フレームワークが日本語認識に対応したバージョン)
- 認識言語は日本語(
ja-JP)と英語(en-US)のみ。他の言語の文字はほぼ返ってきません - 縦書き・手書き は弱く、期待した精度が出にくいことがあります
- 写真1枚単位 の認識です。動画・ライブスキャンには対応していません
- 出力は テキストの行の配列 で、レイアウト(2段組・表・図)は失われます
対の記事:カードを作る側の話
写真から取り出したテキストを、どう割ってカードにするか は別の作業です。書式の整え方・失敗例・「ページ丸ごと」を避ける理由は、教える側の記事にまとめてあります。
- 教科書の写真から暗記カードを作る——iPhone だけで完結させる手順と、OCR の限界 — Live Text ルートと OCR ルートの手順・整形の書式・実装して分かったこと
- 暗記カードの作り方の原則 — 1枚に何を入れるかの設計
読み取れる文字の側だけ整えても、良いカードにはなりません。写真は素材の回収まで、カード化はもう一段の作業です。