テキスト認識ソフトウェアOCRについて話す
私達はシンセン中国の大きい印刷会社です。 私達はすべての本の出版物、ハードカバーの本の印刷、ペーパーカバーの本の印刷、ハードカバーのノート、sprialの本の印刷、中綴じの本の印刷、小冊子の印刷、包装箱、カレンダー、あらゆる種類のPVC、製品パンフレット、ノート、児童書、ステッカー、すべてを提供します特殊紙カラー印刷製品の種類、ゲームcardandなど。
詳細についてはをご覧ください。
http://www.joyful-printing.com ENGのみ
http://www.joyful-printing.net
http://www.joyful-printing.org
電子メール:info@joyful-printing.net
漢字認識ソフトウェアの仕事は、コンピュータを「読み書き可能」にする方法を研究することです。 このシステムは通常、光電変換デバイスを使用して漢字またはワードボックスを電気信号に変換し、それをコンピュータに送信します。コンピュータはこれを自動的に認識して読み取るので、光学式と呼ばれます。 光学式文字認識(OCR)
OCR開発プロファイル
OCRの概念は、1929年にドイツの科学者Tausheckによって最初に提案されました。後に、アメリカの科学者Handelもまた、単語を識別するために技術を使うという考えを提案しました。 印刷された漢字の認識に関する最も初期の研究は、IBMのCaseyとNagyでした。 1966年に、彼らは1000文字の印刷された漢字を識別するためにテンプレートマッチングを使った漢字認識に関する最初の記事を発表しました。 1970年代初頭、日本の学者たちは漢字認識の研究を始め、多くの仕事をしました。 中国における漢字認識に関する研究は比較的遅く始まり、OCRの研究は1970年代後半に始まった。 初期のOCRソフトウェアは、認識率や製品化などのさまざまな要因により、実際の要件を満たしていませんでした。 同時に、ハードウェア機器のコストが高く、動作速度が遅いため、実用的なレベルには達していません。 情報部、報道部、出版部など、一部の部署だけがOCRソフトウェアを使用しています。 1986年以降、中国のOCR研究は大きな進歩を遂げ、漢字のモデリングと認識方法に革新をもたらしました。 それはシステム開発と開発アプリケーションで実りある結果を達成しました。 多くのユニットが中国のOCR製品を次々と発売しています。 1990年代以降、プラットフォームスキャナーの広範な応用と中国における情報自動化とオフィスオートメーションの普及により、OCR技術のさらなる発展が大いに促進され、そしてOCRの認識率が認識され、認識速度が満足されてきた。ユーザー 請求。
現在、多くの人気のあるOCRソフトウェアがあります。 英語のOCRには、OmniPage、Chinese OCR、清華Unisplendour OCR、清華Wentong OCR、Hanwang OCR、Zhongjing Shangshu OCR、Danqing OCR、Mengyu OCRが主に含まれます。 大量の漢字と複雑なフォントにもかかわらず、OCR技術は成熟しました。 多くのOCRソフトウェアは、白黒で印刷された漢字だけでなく、グレースケールやカラーで印刷された漢字も認識できます。 認識速度は速く、認識正解率は99%以上です。 Song、Bold、Scorpionなどのさまざまなフォントを認識できます。 伝統的な さまざまなフォント、異なるフォントサイズの混在を認識できます。 いくつかのOCRソフトウェアはまた、画像、表を識別することができます。 同時に、手書き漢字認識の研究において大きな進歩があり、正しい認識率は70%以上に達した。
OCRソフトウェアアプリケーション
スキャナー市場では、多くの種類のオフィス用および家庭用スキャナーにOCRソフトウェアが装備されています。 例えば、バイオレットスキャナーはバイオレットOCRを装備し、クリスタルスキャナーはShangshu OCRを装備し、そしてMustekスキャナーはDanqing OCRを装備する。 スキャナとOCRソフトウェアは、文書の入力からテキスト認識までの全プロセスを共有します。
文書スキャンは、オフィスの分野でよく使用されます。 新聞、雑誌などの出版物に関連する文書は、スキャナによってスキャンされ、その後のOCR認識のためにOCR識別が実行されるか、または画像ファイルとして記憶され、画像ファイルはテキストに変換される。 保存用のファイルまたはWordファイル。
さらに、デジタル情報の記憶および伝送は、低コスト、高効率だけでなく、植字およびネットワーク伝送の未開発のニーズにも適応可能である。 現在、中国には本、新聞、雑誌などの紙の宝物がたくさん残されており、それらを電子情報に変換することが急務です。 例えば、電子図書館の設立は、本がページごとにスキャンされることを必要とし、そしてOCRソフトウェアの識別は、単語の手動入力に取って代わる。これは、記入時間を大幅に短縮し、労働力を減らし、人員を節約しそしてコストを削減する。 入力の正確性、作業効率、および最新のオフィスオートメーションを向上させます。
現在、OCRソフトウェアとスキャナの組み合わせは、デジタル図書館、さまざまなレポートの識別、銀行や税制の標準の識別など、情報化時代の多くの分野に適用されています。 ネットワークと情報の発展と普及により、その適用範囲はますます広範囲になります。
OCRシステムの構成
漢字認識ソフトウェアOCRの機能は、漢字で記録された各漢字の様々なグラフィックスまたは画像、コンピュータによるプリントまたは手書き文字を認識し、漢字カテゴリコードをマークすることである。 したがって、漢字認識は最終的には画像認識の問題です。 大量の漢字、さまざまなフォント、フォント、および複雑な構造のため、漢字認識のプロセスは非常に複雑です。 次の表に示すように、OCRソフトウェアワークフローの概略図。
文書データ→スキャン入力→画像処理→レイアウト分割→テキスト認識→テキスト編集→文書保管
スキャナの普及と広範な応用により、OCRソフトウェアはスキャナとのインタフェースを提供し、スキャナドライバソフトウェアを使用するだけで済みます。 したがって、OCRソフトウェアは、主に、画像処理モジュール、レイアウト分割モジュール、テキスト認識モジュール、およびテキスト編集モジュールから構成される。
1.画像処理モジュール
画像処理モジュールは、主に、原稿の読み取り、画像の拡大縮小、回転などの機能を有する。 スキャナによる入力の後、文書は画像ファイルを形成し、画像処理モジュールは画像を拡大して汚れや傷を取り除くことができる。 画像が正しく回転していない場合は、テキスト認識の条件を良くするために、画像を手動または自動で回転させることができます。 認識率が高いです。
レイアウト分割モジュール
レイアウト分割モジュールは、レイアウト分割と変更分割、すなわち、レイアウトの理解、単語分割、正規化などを主に含み、自動または手動のレイアウトを選択することができる。 目的は、同じレイアウトで記事、表などを分離するようにOCRソフトウェアに指示することで、それらを別々にどのような順序で処理できるようにします。
3.テキスト認識モジュール
テキスト認識モジュールは、以下に示すように、OCRソフトウェアの中心部分である単純なテキスト認識プロセス図です。 テキスト認識モジュールは、主に入力された漢字に対して「読み」を実行しますが、複数行にすることはできず、行ごとにカットする必要があります。 漢字の場合、通常は1単語と1単語で認識されます(つまり、単一単語認識)。その後、正規化されます。 テキスト認識モジュールは異なるサンプル漢字の特徴を抽出し、認識を完了し、自動的に不審な単語を見つけ、そして関連付けの前後などの機能を持ちます。
スキャン入力原稿→ラインカット→ワードカット→帰化→認識特徴抽出→ワード認識
└-→分類前特徴抽出→特徴ライブラリ(辞書)→出力原稿
4.テキスト編集モジュール
テキスト編集モジュールは、主にOCR認識テキストを修正および編集します。 システムがそれが間違っていると認識した場合、テキストは赤または青の太字で表示され、選択のために同様のテキストを提供し、出力のためにエディターを選択します。
OCRソフトウェアの使い方
OCRソフトウェアには多くの種類がありますが、それらの使用方法は似ています。 最初のステップは、文書をスキャンしてからOCR認識を実行することです。 OCRソフトウェアの使用方法は次のとおりです。
1.文書スキャン
テキスト認識にOCRソフトウェアを使用するために、文書はOCRソフトウェアで直接スキャンすることができます。 OCRソフトウェアを実行した後、OCRソフトウェアインターフェイスが表示されます。
原稿の上端を下にしてルーラの端に合わせて、原稿をスキャナのガラス面に向けます。スキャンの準備をするためにカバーされています。 ウィンドウの[スキャン]ボタンをクリックして、スキャン用のスキャンドライバソフトウェアを起動します。 走査方法についてはここでは説明しない。 ただし、解像度は200〜400dpiに設定できます。 テキスト文書の場合は、明るさを調整することが重要です。
2. OCRの認識
操作を簡単にするために、メニューからオプションを選択すると、さまざまなアイコンがウィンドウの左側に表示されます。
使いやすくするために、最初に画面の左側に上から下にアイコンを入れます。
「ズームイン」ツール:画像を拡大するためのもの。 「縮小」ツール:画像を縮小するためのもの。 「認識領域設定」ツール:認識領域を設定する。 「認識順序設定」ツール:認識順序を設定するためのツール。 認識領域の削除ツール:認識領域を削除します。 「画像ノイズを消去」ツール:画像内の領域を消去します。 「画像を回転」ツール:画像を90°、180°または270°回転させます。 チルト補正ツール:手動の画像チルト補正用。
OCR識別の一般的な手順
(1)原稿がスキャンされた後、ウィンドウに現れる認識されるべきテキストは非常に小さい。 まず、「ズームイン」ツールを選択して画像を適切に拡大し、画像をより鮮明にします。 必要に応じて、「縮小」ツールを選択して画面のサイズを適切に縮小することもできます。
(2)画面を90°、180°、または270°回転させる必要がある場合は、イメージの回転ツールを使用してイメージを回転させます。 テキスト画面が傾斜している場合は、傾斜補正ツールを選択して画面を調整します。
(3)認識中に「認識領域設定」ツールを選択し、文字画面上で認識したい領域を枠で囲みます。 この場合、画面の状態に合わせて複数の領域を囲むことができます。 枠で囲まれた領域が正しくない場合は、[識別領域の削除]ツールを使用して選択した認識領域を削除できます。
(4)認識率を向上させるために、選択した認識領域にノイズや認識できない画像がある場合は、「画像ノイズを消去」ツールを選択して、ノイズを1ビットずつ消去することができます。 分割して消去する必要がある場合は、[イメージブロックの消去]ツールを選択できます。
(5)「認識」アイコンをクリックすると、OCR表示がテキスト分割を行ってから「認識」画面に移行し、認識されたテキストが段階的に表示され、次に「文書校正」ウィンドウに移行します。示す。
多くのOCRソフトウェアは、誤っている可能性があり、明確な色で表示され、変更可能なテキストを認識するテキスト変更機能を備えています。
(6)認識したファイルをテキスト(TXT)ファイルまたはWord RTFファイルとして保存します。

