コンテンツへスキップ
StemStudio
AI画像OCR

AI画像OCR

画像はブラウザ内で処理。初回またはキャッシュが失われたときにOCRの実行環境と認識データを取得します。

入力

入力

対応: PNG / JPEG / WebP / BMP / GIF(20MB、2,000万像素、各辺8,000pxまで。PDF・手書き文字は対象外)

文字が写った画像を1枚選びます。画像はブラウザー内で読み込まれます。

日本語は縦書き用の補助モデルも使います。英語が混ざった画像には「日本語 + 英語」を選んでください。

端末内OCRモデルの準備: OCRの実行環境と認識データは、初回またはキャッシュが失われたときに取得します。画像はStemStudioのサーバーへ送らず、Workerの中でTesseract.js 7.0.0を実行します。取得済みデータはブラウザのIndexedDBやHTTPキャッシュに残る場合があります。 選択した言語の初回またはキャッシュ未取得時は、約9.2 MBのOCRデータが必要です。必要なアセットにアクセスできない環境では実行できません。 モデルの出典・ライセンス・データ条件を見る

印刷された日本語や英語の文字を画像から読み取り、テキストとして確認・コピー・保存します。画像はブラウザー内で処理し、初回またはキャッシュが失われたときにOCRの実行環境と認識データを取得します。

1画像を選ぶ文字が写った画像2ブラウザで認識Worker内のOCRモデル3テキストを保存確認してコピー / .txt画像本体はブラウザ内に残り、OCRデータは同じサイトのアセットとして取得します。
画像OCR

使い方

  1. 1画像を選ぶ文字が写ったPNG・JPEG・WebPなどを1枚選びます。
  2. 2言語を選んで実行日本語、英語、日英混在のいずれかを選び、進捗を確認します。
  3. 3テキストを保存結果を目視で確認してから、コピーまたは.txtで保存します。

何ができる道具ですか

画像内の文字を読み取る

選択した画像から、OCRモデルが認識したプレーンテキストを返します。

画像は端末内

ファイルのアップロードは不要です。Tesseract.jsをWorkerで実行し、画像はStemStudioのサーバーへ送りません。

結果を確認して保存

読み取った文字は画面で確認、コピー、UTF-8のテキストファイルとして保存できます。

ツール一覧

制限と使いどころ

手書き文字やPDFも読み取れますか?

この最初の版はブラウザで読み込める1枚の画像と印刷文字を対象です。手書き文字、PDFの解析、検索可能なPDFへの変換は対象外です。

日本語の縦書きは?

日本語の補助モデルで縦書きも試しますが、保証ではありません。画像向き・解像度・照明によって誤読します。

画像はアップロードされますか?

画像本体はブラウザ内で処理されます。初回やキャッシュ失效時には、同じサイトからOCRの実行環境と認識データを取得する通信が行われます。

信頼度はなぜ正確率ではないのですか?

画面に出る信頼度はエンジン全体の目安です。すべての文字が正しいことを意味するものではありません。

よくある質問

表の構造や位置も保存されますか?

いいえ。初期版が返すのは認識したプレーンテキストだけです。表・座標・レイアウトの復元は別の機能として 검토します。

処理を中断できますか?

はい。実行中は「処理を中止」でWorkerを終了します。前の実行が新しい 결과를書き換えることはありません。

空の文字が返ったら失敗ですか?

正常な空結果として扱います。画像がぼけている、照明が悪い、傾きがある場合は、より鮮明な画像をお試しください。