AI画像OCR
入力
入力
対応: PNG / JPEG / WebP / BMP / GIF(20MB、2,000万像素、各辺8,000pxまで。PDF・手書き文字は対象外)文字が写った画像を1枚選びます。画像はブラウザー内で読み込まれます。
日本語は縦書き用の補助モデルも使います。英語が混ざった画像には「日本語 + 英語」を選んでください。
読み取った文字
実行すると、ここに文字が表示されます。
印刷された日本語や英語の文字を画像から読み取り、テキストとして確認・コピー・保存します。画像はブラウザー内で処理し、初回またはキャッシュが失われたときにOCRの実行環境と認識データを取得します。
使い方
- 1画像を選ぶ文字が写ったPNG・JPEG・WebPなどを1枚選びます。
- 2言語を選んで実行日本語、英語、日英混在のいずれかを選び、進捗を確認します。
- 3テキストを保存結果を目視で確認してから、コピーまたは.txtで保存します。
何ができる道具ですか
選択した画像から、OCRモデルが認識したプレーンテキストを返します。
ファイルのアップロードは不要です。Tesseract.jsをWorkerで実行し、画像はStemStudioのサーバーへ送りません。
読み取った文字は画面で確認、コピー、UTF-8のテキストファイルとして保存できます。
関連するツール
ツール一覧制限と使いどころ
手書き文字やPDFも読み取れますか?
この最初の版はブラウザで読み込める1枚の画像と印刷文字を対象です。手書き文字、PDFの解析、検索可能なPDFへの変換は対象外です。
日本語の縦書きは?
日本語の補助モデルで縦書きも試しますが、保証ではありません。画像向き・解像度・照明によって誤読します。
画像はアップロードされますか?
画像本体はブラウザ内で処理されます。初回やキャッシュ失效時には、同じサイトからOCRの実行環境と認識データを取得する通信が行われます。
信頼度はなぜ正確率ではないのですか?
画面に出る信頼度はエンジン全体の目安です。すべての文字が正しいことを意味するものではありません。
よくある質問
表の構造や位置も保存されますか?
いいえ。初期版が返すのは認識したプレーンテキストだけです。表・座標・レイアウトの復元は別の機能として 검토します。
処理を中断できますか?
はい。実行中は「処理を中止」でWorkerを終了します。前の実行が新しい 결과를書き換えることはありません。
空の文字が返ったら失敗ですか?
正常な空結果として扱います。画像がぼけている、照明が悪い、傾きがある場合は、より鮮明な画像をお試しください。