写真やスキャンデータ内の文字をAIが自動で読み取り、文字データに変換します。
画像をアップロードして開始
VOLC TOOLSの画像文字起こしAI(OCR)は、画像の中に眠っている「テキスト情報」を瞬時にデジタル化し、再利用可能なデータへと変換するために開発されました。 スキャンした書類、スクリーンショット、スマートフォンの写真など、あらゆる視覚情報を「文字」として抽出することで、データ入力の手間を劇的に削減します。
当ツールの心臓部には、HPやGoogleによって長年開発が続けられてきたオープンソースのOCRエンジン「Tesseract」を、JavaScriptへ移植した「Tesseract.js」を採用しています。 WebAssembly(WASM)のパワーを借りることで、かつてはサーバーサイドでしか動作しなかった重厚な文字認識アルゴリズムを、あなたのブラウザ上で直接動作させています。 日本語と英語を同時に認識する「マルチランゲージ対応」により、複雑なレイアウトの文書でも高い精度でテキストを抽出します。
OCRを利用するシーンの多くは、契約書、領収書、あるいはプライベートなメモなど、機密性の高い情報を扱います。 多くのオンラインOCRサービスでは、画像を一度サーバーへアップロードする必要がありますが、VOLC TOOLSは**「ゼロ・アップロード」ポリシー**を貫いています。
A. 画像の解像度が高く、文字がはっきりと写っているほど精度が向上します。暗い場所で撮影された写真や、文字が歪んでいる場合は、明るい場所で撮り直すか、事前にコントラストを調整した画像を使用することをお勧めします。
A. 現在のモデルは活字(デジタルフォント)に最適化されています。非常に丁寧な手書き文字であれば認識できることもありますが、崩し字やクセの強い文字の認識は現時点では困難です。今後のアップデートで手書き対応モデルの導入を検討しています。
A. 現在、日本語と英語の混合認識に対応しています。一般的なビジネス文書やプログラミングコードの混在した画像であれば、設定を変えることなくそのまま読み取ることが可能です。