📷 OCR / 画像からテキスト抽出
ブラウザで鮮明でシンプルなスクリーンショットから文字を抽出します。無地の背景にある活字に適しています。画像は端末内で処理されます。結果は校正してからご利用ください。
言語を選ぶだけで、名前や番号、メールアドレスを貼り付けられるテキストに。画像はブラウザ内で読み取られます。
鮮明でシンプルな活字のスクリーンショットに適しています。手書き、ぼやけた写真、表、複雑なレイアウトでは認識精度が低下することがあります。原画像と照合してください。 外国語の文字にはAI画像翻訳ツールをお試しください。AIが文字を読み取り、レイアウトはそのままで画像の上で翻訳します。
- 認識モデルをダウンロード
- 認識エンジンを起動
- 文字の位置を検出
- 1 行ずつ文字を認識
- 高解像度の画像を使用する(300 DPI以上)
- テキストと背景のコントラストを明確にする
- テキストに合わせて正しい言語を選択する
- テキストを真っ直ぐ、整列した状態にする
- 色あせた画像や暗い画像には前処理を使用する
- スクリーンショットには PNG 形式が最適です
信頼度スコアはエンジンの推定値であり、実測の正解率ではありません。高いスコアでも文字を確認してください。
広告ブロッカーにより広告を表示できません
MiniWebtool は広告収入によって無料で提供されています。このツールがお役に立った場合は、広告なしの閲覧とより多い毎日の利用回数のためにアップグレードするか、MiniWebtool.com を許可して再読み込みしてください。
- MiniWebtool.com の広告を許可して再読み込み
- またはアップグレードして広告なしと高い日次上限を利用
📷 OCR / 画像からテキスト抽出
ブラウザで鮮明でシンプルなスクリーンショットから文字を抽出します。無地の背景にある活字に適しています。画像は端末内で処理されます。結果は校正してからご利用ください。
概要
- おすすめの画像: 背景が無地で、印刷または入力された文字がはっきり写っているスクリーンショットや写真に適しています。
- 対応言語: 英語、スペイン語、フランス語、ドイツ語、ロシア語、アラビア語、ヒンディー語、韓国語、中国語、日本語など、30以上の言語に対応しています。1枚の画像に中国語、日本語、英語を混在させることもできます。
- 対応画像形式: PNG、JPG、GIF、BMP、WebP、TIFFに対応しています。ドラッグ&ドロップ、ファイル選択、クリップボードから貼り付けて読み込めます。
- 認識結果: コピーまたはファイルとしてダウンロードできる編集可能なテキストが得られます。薄い画像は、明るさとコントラストを調整してから読み取れます。
- プライバシー: 文字はお使いの端末上で読み取られ、画像がアップロードされることはありません。
- 不向きな画像: 手書き文字、ぼやけた写真、複雑な表には適していません。手書き文字にはAI手書き文字テキスト化ツールツールをお使いください。
OCR(光学文字認識)とは何ですか?
光学文字認識(OCR)は、スキャンされた紙の文書、PDFファイル、またはデジタルカメラで撮影された画像など、さまざまな種類のドキュメントを編集および検索可能なテキストに変換する技術です。OCR技術は画像内の文字の形状を分析し、既知のパターンと照合して文字、数字、記号を特定します。
主な特徴
- 2 つのオープンソースエンジンをブラウザ内で実行:標準は 2026 年に公開された PP-OCRv6 で、日本語・中国語・英語を従来のエンジンより大幅に正確に読み取ります。ダウンロードの軽い Tesseract.js に切り替えることもできます。画像がサーバーに送信されることはありません。
- 30 以上の言語に対応:日本語、中国語(簡体字・繁体字)、英語、ほとんどのヨーロッパ言語は PP-OCRv6 が認識し、日本語・中国語・英語が混在した画像もまとめて読み取れます。韓国語、ロシア語、アラビア語、タイ語、ベトナム語などは Tesseract.js で認識します。
- 進み具合が見える:検出した文字の行がプレビュー上に枠で表示され、読み取った行から緑色に変わります。認識結果は 1 行ずつ表示され、残り時間の目安も確認できます。
- 複数のアップロード方法: 画像のドラッグ&ドロップ、クリックして参照、またはクリップボードから直接貼り付け(Ctrl+V / Cmd+V)が可能です。
- 画像の前処理: 明るさとコントラストを調整して、低品質や色あせた画像の認識精度を向上させます。
- 信頼性スコア: OCRエンジンが抽出されたテキストに対してどの程度の確信を持っているかを確認でき、手動での確認が必要な箇所を特定するのに役立ちます。
- コピーとダウンロード: ワンクリックでクリップボードにコピー、または抽出されたテキストをファイルとしてダウンロードできます。
このOCRツールの使い方
- 画像をアップロードする: 画像をアップロードエリアにドラッグ&ドロップするか、クリックしてファイルを参照するか、Ctrl+V(Macの場合はCmd+V)を使用してクリップボードから画像を貼り付けます。
- 言語を選択する: ドロップダウンメニューから画像内のテキストの言語を選択します。正しい言語を選択することで、認識精度が大幅に向上します。
- 画像設定を調整する(任意): 「画像の前処理」をクリックして、明るさとコントラストのコントロールにアクセスします。これは、低品質、色あせた、または暗い画像に特に有効です。
- テキストを抽出をクリック:「テキストを抽出」ボタンを押すと認識が始まります。進捗パネルには、モデルのダウンロード、エンジンの起動、文字の位置の検出、1 行ずつの認識という 4 つのステップが順に表示されます。初回は、画像を選んだ時点でモデルのダウンロードがバックグラウンドで始まります。
- 結果を確認して使用する: 抽出されたテキストが編集可能なテキストエリアに表示されます。直接編集したり、クリップボードにコピーしたり、テキストファイルとしてダウンロードしたりできます。
OCR精度を向上させるためのヒント
画質
解像度が高いほど、より良い結果が得られます。ドキュメントをスキャンする場合は、少なくとも 300 DPI を目指してください。ぼやけた画像、歪んだ画像、または過度に圧縮された画像は避けてください。
コントラストと照明
テキストと背景のコントラストが明確であることが不可欠です。内蔵の前処理コントロールを使用して、色あせた画像や低コントラストの画像を強調してください。白背景に黒文字が最も効果的です。
言語の選択
日本語・中国語・英語とほとんどのヨーロッパ言語は「自動検出」のままで大丈夫です。PP-OCRv6 は 1 つのモデルでこれらの言語を認識し、混在していても読み取れます。韓国語、ロシア語、タイ語、アラビア語、ベトナム語の画像は、メニューでその言語を選ぶと、対応する Tesseract.js のモデルに切り替わります。
テキストの向き
PP-OCRv6 は少し傾いた写真にも対応し、縦書き(右から左)の文字も読み取れます。画像全体が 90 度回転していたり上下逆さまだったりする場合は、正しい向きに直してから認識してください。
対応している画像形式
- PNG — スクリーンショットやテキストの多い画像に最適(可逆圧縮)
- JPEG/JPG — 一般的な写真形式で、スキャンされたドキュメントに適しています
- WebP — 品質とサイズのバランスが良いモダンな形式
- BMP — 非圧縮のビットマップ画像
- GIF — シンプルな画像をサポート(アニメーションGIFの場合は最初のフレームを使用)
- TIFF — プロ向けのスキャン形式(ブラウザのサポート状況は異なります)
一般的な活用シーン
スクリーンショットからのテキスト抽出
ウェブサイト、エラーメッセージ、チャットの会話、SNSの投稿などのスクリーンショットから素早くテキストを取得します。スクリーンショットを貼り付けて(Ctrl+V)、テキストを抽出するだけです。
プライバシーとセキュリティ
このツールの 2 つの認識エンジンは、どちらもブラウザ内で動作します。画像がサーバーにアップロードされることはなく、保存や共有もされません。ネットワークからダウンロードするのは認識モデルだけです。そのため、個人情報や機密情報を含む書類にも安心してお使いいただけます。
3 つの画像テキスト化方法の比較:Tesseract・PP-OCRv6・AI 認識
このページでは、ブラウザ内で動く 2 つのオープンソースエンジンを使えます。手書き文字や翻訳が必要な場合は AI ツールが向いています。左の 2 列の誤認識率は、14 枚の自作テスト画像(日本語・中国語・英語の文章、レシートの写真、道路標識の写真、アプリのスクリーンショット、縦書きなど)で実測した結果で、低いほど優秀です。AI 認識の列は向いている用途を示したもので、テストには含めていません。
| Tesseract.js | PP-OCRv6(標準) | AI 認識 | |
|---|---|---|---|
| 処理する場所 | お使いのブラウザ | お使いのブラウザ | サーバーにアップロードし、AI モデルが処理 |
| きれいな印刷文字の文章 | 誤認識率 0–2.5%(正しい言語を選んだ場合) | 0–0.5% | 対応。文脈から語句を判断できる |
| レシートの写真(傾き・ぼけ) | 8.4% | 0% | 対応 |
| 道路標識の写真 | 5.3% | 0% | 対応 |
| アプリのスクリーンショット(文字サイズが混在) | 17% | 0% | 対応 |
| 縦書き | ほぼ読み取れない(97%) | 3% | 対応 |
| 手書き文字 | 不向き | 不向き | 向いている |
| 1 枚あたりの時間 | 約 0.2–1.5 秒 | GPU 使用時 約 0.2–1.4 秒、CPU のみ 約 1–9 秒 | AI の応答次第 |
| 初回のダウンロード | 約 3–5 MB | 約 35 MB(以後ブラウザに保存) | 不要 |
| 言語 | 30 以上 | 日本語、中国語(簡体字・繁体字)、英語、ラテン文字の 17 言語 | 主要な言語のほとんど |
| 翻訳 | なし | なし | AI画像翻訳ツール:訳文を画像の元の位置に表示 |
| 料金 | 無料 | 無料 | 画像 1 枚につき 1 クレジット |
使い分けの目安:
- 普段のスクリーンショット、書類、写真:標準の PP-OCRv6 のままで十分です。
- モバイル通信量を節約したい、または古い端末:「認識エンジン」で Tesseract.js を選ぶと、ダウンロードがずっと軽くなります。きれいな印刷文字のスクリーンショットなら十分に読み取れます。
- 手書きのメモ、手紙、記入済みの書類:AI手書き文字テキスト化ツールを使ってください。
- 読めない外国語の画像:AI画像翻訳ツールなら、認識と翻訳を一度に行い、訳文を元の文字の位置にレイアウトを保ったまま表示します。翻訳後の画像をダウンロードすることもできます。
表の誤認識率は当社のテスト画像での結果で、実際の結果は画像の品質、フォント、レイアウトによって変わります。「自動検出」モードの Tesseract.js はまず英語で試し、その後ほかの言語を試すため、英語以外の画像は言語を選んだほうが確実です。
認識エンジンについて
PP-OCRv6 は、百度の PaddlePaddle チームが 2026 年 6 月に Apache 2.0 ライセンスで公開したオープンソースの OCR モデルです。このツールではその Small 版を使い、まず検出モデルで各行の文字の位置を見つけ、次に認識モデルで 1 行ずつ読み取ります。1 つのモデルで日本語、中国語(簡体字・繁体字)、英語、ほとんどのヨーロッパ言語を認識できます。ONNX Runtime Web を通じてブラウザ内で動作し、ブラウザが WebGPU に対応していれば自動的に GPU で高速化されます。
Tesseract.js は、長い歴史を持つオープンソース OCR エンジン Tesseract の JavaScript 版です。言語ごとに小さなモデルが用意されているためダウンロードが軽く、きれいな印刷文字のスクリーンショットに向いています。このツールでは、韓国語、ロシア語、タイ語、アラビア語、ベトナム語など、PP-OCRv6 が対応していない言語に使います。
よくある質問
このOCRツールを使用する際、画像データは安全ですか?
はい。このツールの 2 つの認識エンジン PP-OCRv6 と Tesseract.js は、どちらもブラウザ内で動作し、画像がサーバーにアップロードされることはありません。ネットワークからダウンロードするのは認識モデルだけで、文字の認識はすべてお使いの端末上で行われます。
このOCRツールはどの言語に対応していますか?
言語メニューには 30 以上の言語があります。日本語、中国語(簡体字・繁体字)、英語と、スペイン語、フランス語、ドイツ語、ポルトガル語、イタリア語、ポーランド語などラテン文字の 17 言語は PP-OCRv6 が認識し、日本語・中国語・英語が 1 枚に混在していてもまとめて読み取れます。韓国語、ロシア語、アラビア語、ヒンディー語、タイ語、ベトナム語などのほかの言語は、自動的に Tesseract.js で認識します。
対応している画像形式は何ですか?
PNG、JPEG、JPG、GIF、BMP、WebP、TIFFを含むすべての一般的な画像形式をサポートしています。ドラッグ&ドロップ、アップロードエリアのクリック、またはクリップボードからの貼り付けで画像をアップロードできます。
OCRの精度を向上させるにはどうすればよいですか?
OCR精度を向上させるには、高解像度の画像を使用し、テキストと背景のコントラストを明確にし、正しい言語を選択してください。また、内蔵の明るさとコントラスト調整を使用して画像の前処理を行い、画像が回転したり歪んだりしていないことを確認してください。 鮮明でシンプルな活字のスクリーンショットに適しています。手書き、ぼやけた写真、表、複雑なレイアウトでは認識精度が低下することがあります。原画像と照合してください。
このOCRツールはモバイルデバイスで動作しますか?
はい、このOCRツールは完全にレスポンシブで、スマートフォンやタブレットで動作します。カメラで直接写真を撮ってアップロードしたり、スクリーンショットを貼り付けたりできます。インターフェースは小さな画面に適応し、スムーズなモバイル体験を提供します。
OCR処理にはどのくらいの時間がかかりますか?
ブラウザが GPU アクセラレーション(WebGPU。最近の Chrome や Edge など)に対応していれば、PP-OCRv6 は通常 1 枚 1.5 秒以内で終わります。CPU のみの場合は文字量に応じて約 1〜9 秒かかります。初回は約 35 MB のモデルのダウンロードと、GPU の準備に数秒かかりますが、2 回目以降はずっと速くなります。処理中は進捗パネルに現在のステップと残り時間の目安が表示され、いつでもキャンセルできます。
初回にモデルをダウンロードするのはなぜですか?毎回ダウンロードされますか?
文字の認識はお使いの端末上で行うため、ブラウザがまず認識モデルを取得する必要があります。PP-OCRv6 は約 35 MB、Tesseract.js は約 3〜5 MB です。一度ダウンロードしたモデルはブラウザに保存され、次回からはそこから読み込むので、再ダウンロードは不要です。ブラウザのデータセーバーがオンの場合は、ダウンロードの軽い Tesseract.js が最初から選ばれます。
手書き文字を読み取ったり、画像の文字を翻訳したりできますか?
2 つのオープンソースエンジンは印刷文字向けです。手書き文字には AI手書き文字テキスト化ツール をお使いください。画像の文字を英語や他の言語に翻訳したいときは AI画像翻訳ツール が便利で、訳文を画像の元の位置にレイアウトを保ったまま入れてくれます。この 2 つの AI ツールは画像をサーバーにアップロードして処理し、画像 1 枚につき 1 クレジットを使います。
その他のリソース
- 光学文字認識 - Wikipedia
- PaddleOCR(PP-OCRv6)- GitHub リポジトリ
- Tesseract.js - GitHub リポジトリ
- Tesseract OCR 公式サイト
このコンテンツ、ページ、またはツールを引用する場合:
"📷 OCR / 画像からテキスト抽出"(https://MiniWebtool.com/ja/ocr-画像からテキスト抽出/)、MiniWebtool、https://MiniWebtool.com/
miniwebtool チームによる提供。最終更新日:2026年10月2日
画像ツール:
- 画像に線を追加
- 画像にテキストを追加
- アスペクト比電卓 新しい
- 画像を円形に切り抜き 新しい
- コラージュメーカー 人気
- 点つなぎジェネレーター 人気
- EXIFデータビューア・削除ツール 新しい
- GIF を反転
- 画像を反転
- GIFメーカー
- 画像モザイクツール
- 画像圧縮ツール
- 画像トリマー
- 画像エンハンサー
- 画像リサイズ
- 画像回転ツール 人気
- 画像分割ツール 人気
- 画像からASCIIアートへの変換器 新しい
- 画像からSVGトレーサー 新しい
- Lorem Picsum / プレースホルダー画像ジェネレーター 新しい
- 📷 OCR / 画像からテキスト抽出 新しい
- 印刷サイズ・解像度電卓 (DPI/PPI)
- 角丸画像ジェネレーター 新しい
- スクリーンショット装飾ツール 新しい
- デバイスモックアップ作成ツール 新しい
- ポラロイド風写真メーカー 新しい
- 画像背景色変更ツール 人気
- 画像に影を追加 新しい
- 画像に枠を追加 新しい
- 背景透過ツール 新しい
- 画像透明度変更ツール 新しい
- AI画像プロンプト生成ツール 新しい
- AI似合う髪型診断 人気
- AI手書き文字テキスト化ツール 新しい
- 古い写真のAI修復 新しい
- AIインテリアデザイン 新しい
- AI商品写真作成ツール 新しい
- AI画像翻訳ツール 新しい
- AIメニュー翻訳ツール 新しい
- AI漫画翻訳ツール 新しい
- 写真の透かし削除 新しい
- 画像の文字消し 新しい