JPH08305794A - 宛名行抽出装置 - Google Patents
宛名行抽出装置Info
- Publication number
- JPH08305794A JPH08305794A JP7105576A JP10557695A JPH08305794A JP H08305794 A JPH08305794 A JP H08305794A JP 7105576 A JP7105576 A JP 7105576A JP 10557695 A JP10557695 A JP 10557695A JP H08305794 A JPH08305794 A JP H08305794A
- Authority
- JP
- Japan
- Prior art keywords
- block
- size
- address
- unit
- group
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Landscapes
- Character Input (AREA)
- Character Discrimination (AREA)
Abstract
名行抽出を高精度に行える宛名行抽出装置を提供する。 【構成】 ラベリング部22は宛名の存在する領域の画
像をラベリングしてブロックを得る。ブロック分類部2
3はそれらブロックを局所的にグループ分けし、文字サ
イズ推定部24は各グループ毎にブロックの標準的なサ
イズである標準ブロックサイズを算出する。ベースブロ
ック選出部26はブロックの統合を開始するブロックで
あるベースブロックを選出する。行検証部29は、行成
長部27がベースブロックから統合を行って生成する統
合ブロックが宛名行らしいと判定した場合にはその出力
を行い、宛名行らしくないと判定した場合は、ベースブ
ロックの再選出、統合ブロックの再生成を各部に実行さ
せる。ベースブロックが見つからない場合には、標準ブ
ロックサイズの算出をやりなおす。
Description
り、特に、郵便物の宛名行を抽出する宛名行抽出装置に
関する。
査して得られるディジタル画像に対してレイアウト解析
処理を行った後に、抽出した個々の文字画像に対して文
字認識処理を行い、個々の文字画像に応じた文字コード
を得るといった手順で処理が進められる。ここで、レイ
アウト解析処理とは、入力画像から文字行を抽出し、書
式判定を行うまでの処理のことを示し、このレイアウト
解析処理に関する文献としては、たとえば、1985年に電
子情報通信学会論文誌(Vol.69-D No.11)の2123ページ
から2241ページに掲載された、馬場口らによる「手書き
文字列からの文字切り出しの基礎的考察」と題した論文
がある。
解析のための技術が開示されており、以下に記す手順に
従って、レイアウト解析が行われている。
タル画像に対して、孤立点除去を施す。 8連結ラベリングを行い連結成分の外接矩形を得
る。 得られた矩形同士の重複した部分の面積がしきい値
以上ならこれらの矩形を統合する。 矩形の中心座標を矩形面積で重み付けして、縦およ
び横方向に投影し、投影された点の集中の度合いの高い
点を宛名行の位置とする。 最小距離にある全ての矩形の組について、矩形統合
後の矩形が正方形に近いなら統合を行う。 矩形の面積の平均値を標準矩形面積とする。 矩形の縦横比が既定値以上である場合、矩形内の画
像を矩形長辺へ投影し、最小値で矩形を分割する。 文字列方向に矩形を統合して宛名行候補を生成す
る。
理によって得られた連結成分を統合することによって、
宛名行の抽出を図っている。
る、連結成分の統合により宛名文字を検出する技術で
は、郵便物に関わらず宛名文字の大きさを固定サイズと
するものが多かったため、文字の大きさの変動の影響を
受けやすいものであった。また、行間接触の分離の際に
も、分離点を算出するために、文字サイズとして固定値
を用いていたため、切り出す位置の精度を劣化させる原
因となっていた。
一通の郵便物上に書かれている文字サイズのバリエーシ
ョンが著しく大きいことがよくある。このため、これま
での多くの方式のように、文字のサイズが文字ごとに変
動することを想定しておらず、単一の文字サイズを想定
して宛名行の抽出を行う技術では、実際の文字サイズの
バリエーションに対応することはできず、誤った宛名行
の抽出が行われてしまうことがあった。
の基礎的考察」において提案されている技術では、文字
の標準的な大きさを求め、これを基準に文字同士の接触
の分離を試みてはいる。しかし、郵便物表面に宛名書き
以外の雑情報が混在している場合を考慮していないた
め、文字サイズの高精度な推定は不可能であった。この
結果、抽出される宛名行も不安定、不確実なものとなっ
てしまっていた。
り、接触している場合もあるのであるが、そのための配
慮がなされていない。このため、上記技術では、そのよ
うな場合に、標準的な文字の大きさの推定、さらには行
間接触の分離をはじめとする入り組んだ行の抽出ができ
ないという問題点があった。
ている文字サイズによらず、正確な宛名行の抽出が行え
る宛名行抽出装置を提供することにある。
名行に対しても、その宛名行の抽出が正確に行える宛名
行抽出装置を提供することにある。
(イ)郵便物の記載内容に応じた画像データから宛名以
外の記載情報を検出する雑情報検出手段と、(ロ)この
雑情報検出手段の検出結果を用いて郵便物の宛名の記載
に用いられている可能性が高い、宛名行の筆記方向を指
定する情報を含む書式候補を少なくとも1つ仮定する宛
名書式仮定手段と、(ハ)この宛名書式仮定手段が仮定
した各書式候補に対して、書式候補に応じた一領域分の
画像データから、黒画素が連結した閉領域を包含するサ
イズが最小である矩形のブロックを特定し、特定したブ
ロックに関する情報を出力するブロック特定手段と、
(ニ)このブロック特定手段が各書式候補に対して特定
した各ブロックの位置および大きさに関する情報を基
に、書式候補ごとに各ブロックを幾つかのグループに分
類するブロック分類手段と、(ホ)このブロック分類手
段が分類したグループごとに、それぞれに属するブロッ
クの大きさの平均値を算出し、算出結果を標準ブロック
サイズとして出力する標準ブロックサイズ算出手段と、
(ヘ)ブロック分類手段によって分類された各グループ
に属するブロックから、標準ブロックサイズ算出手段に
よってそのグループに対して算出された標準ブロックサ
イズとの大きさの差が所定値以内のブロックを宛名文字
ブロックとして特定し、その特定結果をグループごとに
出力する宛名文字ブロック特定手段と、(ト)この宛名
文字ブロック特定手段でグループごとに特定された宛名
文字ブロックから、所定の範囲内の大きさを持ち、その
グループに関する標準ブロックサイズに最も近い大きさ
を持つ宛名文字ブロックをベースブロックとして選出す
るベースブロック選出手段と、(チ)このベースブロッ
ク選出手段によってグループごとに選出されたベースブ
ロックと、そのグループに対応する書式候補における筆
記方向と直交する方向に関しての重複の度合いが所定値
以上の同一グループ内の宛名文字ブロックとを統合し、
各グループに対する統合結果をそれぞれ統合ブロックと
して出力するブロック統合手段と、(リ)このブロック
統合手段が、グループごとに出力する統合ブロックの画
像データ内での位置や大きさを書式候補単位で相互に比
較し、宛名行として最も適当な形態を有する統合ブロッ
クが得られた書式候補を郵便物に用いられている書式と
する書式決定手段とを具備する。
対象となる郵便物に対して、幾つかの書式を仮定してお
き、仮定された各書式に対して、その書式が使用されて
いた場合に、宛名が存在している可能性が高い部分に関
する一領域分の画像データに対して、1文字に相当する
ブロックを求めるとともに、ブロックを大まかに、グル
ープ分けしておく。そして、グループ分けの後に、グル
ープごとに、そのグループに含まれる文字の平均的な大
きさを推定し、推定した文字の大きさ(標準ブロックサ
イズ)を用いて、各ブロックの統合による宛名行(統合
ブロック)の生成が行われるように宛名行抽出装置を構
成する。
行を抽出する際に、統合を開始するブロックとなるベー
スブロックの選択が、各文字ブロックの大きさに応じて
行われることになり、その結果として、ブロックの統合
結果として得られる宛名行の高精度化が達成されること
になる。なお、標準ブロックサイズを算出する際には、
ブロックの長辺の長さを用いても良く、また、ブロック
の面積の平方根や、ブロックの幅を用いることもでき
る。
項1記載の発明における標準ブロックサイズ算出手段
を、グループに属する文字ブロックから既定の上限値と
下限値の範囲外の大きさを持つブロックを除外し、残っ
たグループ内のブロックの大きさの平均値と標準偏差と
を算出し、算出した平均値と大きさの隔たりが算出した
標準偏差の既定数倍以内のブロックに関する大きさの平
均値を再度算出し、算出結果を標準ブロックサイズとし
て出力するものとした場合には、さらに、的確にベース
ブロック選択が行われることになり、その結果として、
宛名行の高精度な抽出が可能となる。
名文字ブロック特定手段が、ブロック分類手段によって
分類された各グループに属するブロックから、標準ブロ
ックサイズ算出手段によってそのグループに対して算出
された標準ブロックサイズとの大きさの差が所定値以内
のブロックを、宛名文字ブロックと特定するとともに、
標準ブロックサイズよりその大きさが所定値以上大きな
ブロックが存在していた場合には、そのブロックを標準
ブロックサイズと同程度の大きさを有するブロックに分
割し、分割したブロックを宛名文字ブロックと特定する
ものとなるように宛名行抽出装置を構成した場合には、
宛名行間の入り組みが激しい郵便物から、正確な宛名行
が抽出できるようにもなる。
ック統合手段として、統合結果として得られた統合ブロ
ックが、標準ブロックサイズの所定数倍で定められる幅
や高さの上限値および下限値の範囲に含まれるという条
件を満たすか否かの判定を行い、条件を満たさないと判
定したときには、その統合ブロックを破棄するととも
に、ベースブロック選出手段に、そのグループに属する
文字ブロックの中から、まだベースブロックとして使用
されておらず、かつ、標準ブロックサイズとの大きさの
差が所定値以内でかつ最も小さいブロックをベースブロ
ックとして選出させるものを用いて、宛名行抽出装置を
構成した場合には、誤った宛名行の抽出が行われる可能
性を更に低いものとすることができる。
ースブロック選出手段が、あるグループ内にベースブロ
ックになり得るブロックが存在しない場合、標準ブロッ
クサイズ算出手段に、そのグループ内で宛名行に統合さ
れていないブロックを用いた、標準ブロックサイズの算
出を行わせるものとした場合には、入れ組で文字の大き
さの異なる2つの行が、ブロック分類手段によって予め
別なグループに分離できない場合にも、ブロックの大き
さの正しい平均値が算出されることなり、文字の大きさ
の異なる宛名行同士に入り組み、接触があるような場合
にも宛名行の抽出が的確に行えることになる。
る。
行抽出装置の機能ブロック図を示す。図示してあるよう
に、第1の実施例の宛名行抽出装置は、画像入力部11
と雑情報検出部12と宛名書式仮定部13と複数の宛名
行抽出部141 〜143 と書式判定部15とを備える。
なお、各部は、プロセッサ、メモリ等の周知の電子素子
を用いて形成されており、以下に記すように動作する。
の表面に描かれた文字あるいは郵便番号枠等の画像に応
じた多値のディジタル画像を出力する。雑情報検出部1
2は、画像入力部11が出力するディジタル画像に対し
て、ノイズ除去を施す。そして、ノイズ除去を施したデ
ィジタル画像を基に、郵便物表面に記載されている切
手、郵便番号枠等の宛名以外の物体の位置と大きさを検
出し、それらの検出結果を、宛名周辺情報として宛名書
式仮定部13に出力する。
3からの宛名周辺情報を基に、処理対象となっている郵
便物の書式を判定(仮定)し、その結果を出力する。
を説明する。図示してあるように、郵便物に宛名を書く
場合には、その長手方向が上下方向になるように郵便物
を置いて(縦長に置いて)書く場合(a、b)と、長手
方向が左右方向となるように郵便物を置いて(横長に置
いて)書く場合(c)とがあり、文字の筆記方向にも、
文字を縦書きする場合(a)と、横書きする場合(b、
c)とがある。
の宛名周辺情報(たとえば、切手の位置、郵便番号枠の
位置)を基に、郵便物を走査したときの向きを判定し、
画像内に線分が検出された場合には、線分の向きから文
字の筆記方向の限定を行い、宛名周辺情報に基づくルー
ルにより、宛名行の抽出対象となっている郵便物が、図
2に示した書式のうち、どの書式によるものであるかを
判断(仮定)し、その結果を、宛名行抽出部14に出力
する。なお、以後の説明においては、図2(a)のよう
な書式を「縦置き縦書き」、(b)のような書式を「縦
置き横書き」、(c)のような書式を「横置き横書き」
と表記することにする。
向と並行な線分が抽出されたときには、書式を「縦置き
縦書き」または「横置き横書き」に限定し、それ以上の
書式の限定が行えないときには(書式が一意に絞り込め
ないときには)、それら書式として用いられている可能
性がある複数の書式候補を出力する。また、書式候補を
出力する際には、宛名が存在する可能性の高い領域(以
下、宛名存在領域と記す)に関する情報をも出力する。
たとえば、「縦書き縦置き」の場合には、宛名は切手を
上側に置いたときに郵便番号枠の下から郵便物の終端ま
での右半分に存在する可能性が高いため、宛名存在領域
をその領域に設定し、設定した宛名存在領域に関する情
報を書式候補と併せて出力する。
式仮定部13が出力する書式候補と、その書式に該当す
る宛名存在領域の座標情報を受け取り、書式に応じた宛
名行の生成を行い、宛名行として出力する。この宛名行
抽出部の動作内容の詳細は後述する。宛名書式仮定部1
3から書式候補が複数出力された場合は、複数の宛名行
抽出部14が起動され、各宛名行抽出部14は、それぞ
れ別の書式候補に応じた宛名行の抽出処理を実行する。
抽出した宛名行候補を入力とし、それぞれの確からしさ
の判定を行い、最も確からしい書式を特定し、特定した
書式を出力する。
を詳細に説明する。なお、図3は、第1の実施例の宛名
行抽出装置において、2つの宛名行抽出部が起動される
場合の一例を示した図であり、(a)には、宛名行の抽
出が行われる画像を示してあり、(b)、(c)には、
2つの宛名行抽出部の抽出結果を示してある。
検出部と書式仮定部による処理が行われると、書式仮定
部は「横置き横書き」と「縦置き縦書き」という2つの
書式候補を出力し、2つの宛名行抽出部が起動されるこ
とになる。
られた宛名行抽出部は、図3(b)に模式的に示したよ
うな形で、宛名行を抽出し、各宛名行の幅、長さ、位置
等に関する情報を出力する。また、書式候補「縦置き縦
書き」が与えられた宛名行抽出部は、図3(c)に模式
的に示したような形で、宛名行を抽出し、各宛名行の
幅、長さ、位置等に関する情報を出力する。
準値と、書式候補が「横置き横書き」の場合の宛名行の
幅61との差、および、基準値と書式候補が「縦置き縦
書き」の場合の宛名行の幅63の差を算出する。この
際、宛名行が複数行ある場合には、同様の処理を他の宛
名行に対しても行い、書式候補ごとに、算出した差のコ
スト値を求め、コスト値の小さい方の書式を採用し、採
用した書式を用いた方の宛名行抽出部の出力を、最終出
力とする。
較を、長さ62、64に対して、あるいは位置等に関し
ても行うようにしても良い。また、予め宛名行の幅、長
さ、位置の頻度分布を多数の郵便物から計測しておき、
これを参照して、書式候補から1つの書式を選択するよ
うにすることもできる。
る。
おける各宛名行抽出部の機能ブロック図を示す。図示し
てあるように、宛名行抽出部14は、前処理部21とラ
ベリング部22とブロック分類部23と文字サイズ推定
部24と文字ブロック選出部25とベースブロック選出
部26と行検証部27とを備える。
し、孤立点除去を行い、宛名領域2値画像を生成する。
ラベリング部22は、宛名領域2値画像に対して8連結
ラベリングを行い、各黒画素連結成分の最小包囲矩形で
あるブロックに関する情報を出力する。
素で埋めたものを、垂直軸と水平軸のうち書式候補の文
字列方向と直交する方向に近い軸へ投影したヒストグラ
ムにスムージング処理を施した結果のヒストグラムを生
成し、ヒストグラムが“0”になる部分を境界とする連
続領域に寄与しているブロックを各連続領域ごとにピッ
クアップすることで、ブロックをグループに分類する。
ージングのマスクの大きさを予め決めた文字の大きさ程
度に設定することによって、「林」、「ル」のような文
字中に分離を含む文字においても、ヒストグラムをなま
らせて、1行が複数のグループに分割されることを防い
でいる。ブロック分類部23によってグループに分類さ
れたブロックは、グループごとに文字サイズ推定部24
と文字ブロック選出部25に出力される。
まれるブロックの大きさの平均値を算出し、それぞれの
グループにおける標準ブロックサイズとする。ブロック
の大きさとしては、たとえばブロックの幅、長辺の長
さ、面積の平方根等を用いることが出来るが、第1の実
施例の宛名行抽出装置では、ブロックの長辺の長さを用
いている。文字サイズ推定部24が算出した標準ブロッ
クサイズは文字ブロック選出部25とベースブロック選
出部26に出力される。
限値、下限値で規定される範囲に、長辺の長さが含まれ
ないブロックを処理対象から外し、残ったブロックに関
して大きさの平均値を算出しこれを標準ブロックサイズ
とするように構成することも出来る。
定部24で得られた標準ブロックサイズに従って、グル
ープに属する各ブロックが単一の宛名文字かどうかの判
定を行う。文字ブロック選出部25は、ブロックのサイ
ズと標準ブロックサイズの差が所定値以内の場合に、そ
のブロックが単一の文字に対応するものであると判定
し、そのようなブロックを文字ブロックとしてベースブ
ロック選出部26に出力する。
に属する文字ブロックから、標準ブロックサイズに最も
近い大きさを持つブロックを、ベースブロックとしてグ
ループごとに選出し、行成長部27に出力する。
6からのベースブロックを、ブロックを統合して宛名行
の抽出処理を行う際に統合を開始するブロックとして用
いて、各グループごとにそれぞれに属する文字ブロック
を統合して、宛名行の候補となる統合ブロックの生成を
行う。書式候補が縦書きの場合には、水平軸上でベース
ブロックとの重複が所定値以上あるブロックを統合し、
横書きの場合には垂直軸上でベースブロックとの重複が
所定値以上あるブロックを統合する。行成長部27は、
統合したブロックに対して同様な統合を順次行ってい
き、グループ内でブロックの統合がこれ以上行えなくな
るまでブロックの統合を続ける。そして、生成した統合
ブロックを宛名行候補として出力する(書式判定部15
に出力する)。
的な構成は、第1の実施例の宛名行抽出装置と同様のも
のであり、宛名行抽出部の機能だけを違えたものである
ため、宛名行抽出部に関する説明だけを行うことにす
る。
た宛名行抽出部内の文字サイズ推定部13は、各グルー
プに含まれるブロックの大きさの平均値を算出し、それ
ぞれのグループにおける標準ブロックサイズとしてい
た。第2の実施例では、文字サイズ推定部13は、グル
ープに属する文字ブロックをまず所定の上限値、下限値
の範囲外のブロックを除外し、残ったブロックの平均
値、標準偏差を求め、平均値とブロックの大きさの差が
標準偏差の所定数倍以内のもののみを用いて、再度、平
均値を算出し、その算出結果を標準ブロックサイズとす
る。
に設けられる宛名行抽出部の機能ブロック図を示す。図
から明らかなように、第3の実施例の宛名行抽出部14
の基本的な構成は、第1の実施例の宛名行抽出部(図4
参照)に、ブロック分割部28を付加したものとなって
いる。
ク分類部23とベースブロック選出部26と行成長部2
7の動作内容は、第1の実施例における動作と同一であ
るので、ここでは、その他の各部の動作の説明だけを行
うことにする。
4は、標準ブロックサイズを文字ブロック選出部25と
ベースブロック選出部26に出力するものであったが、
本実施例の文字サイズ推定部24は、標準ブロックサイ
ズを、文字ブロック選出部25とベースブロック選出部
26に出力するとともに、ブロック分割部28に対して
も出力する。
ブロックサイズとの差が既定値以内のサイズを持つブロ
ックを文字ブロックとして選出し、ベースブロック選出
部26に出力するとともに、標準ブロックサイズとの差
が既定値より大きく、かつ標準ブロックサイズより大き
いサイズを持つブロックを文字接触ブロックとして選出
し、ブロック分割部28に出力する。
の長辺の長さを標準ブロックサイズで割って四捨五入し
た数でブロックの長辺を等分割し、分割したブロック
を、それぞれ文字ブロックとして、ベースブロック選出
部26に出力する。
名行抽出装置では、行間に跨る文字接触が存在する場
合、そのブロックを無視して宛名行の抽出を行っていた
が、第3の実施例の宛名行抽出装置では、接触により大
きくなったブロックを予め分離し、分離したブロックが
行成長部に入力される。このため、第3の実施例の宛名
行抽出装置は、たとえば、行間の入り組みが存在してい
るときなとに、第1あるいは第2の実施例の宛名行抽出
装置に比して、より正確な宛名行の抽出が行えるものと
なっている。
に設けられる宛名行抽出部の機能ブロック図を示す。図
から明らかなように、第4の実施例の宛名行抽出部14
の基本的な構成は、第3の実施例の宛名行抽出部(図5
参照)に、行検証部29を付加したものとなっている。
1、ラベリング部22、ブロック分類部23、文字ブロ
ック選出部25、行成長部27、ブロック分割部28の
動作内容は、第3の実施例と同一であるため、説明は省
略する。
イズを文字ブロック選出部25、ベースブロック選出部
26、ブロック分割部28に加え、行検証部19に対し
ても出力する。
れる統合ブロックが、標準ブロックサイズの所定数倍で
定義される幅、高さ、統合ブロックに寄与している文字
ブロック間の距離のそれぞれの条件を満たすものである
場合、その統合ブロックを宛名行候補として出力する。
そして、上記の条件を満たさない場合には、ベースブロ
ック選出部26に対して、ベースブロック変更信号を出
力し、生成された統合ブロックを棄却する。
ック変更信号を受信すると、これまでベースブロックに
なっていない文字ブロックの中から、標準ブロックサイ
ズとの差が既定値以内でかつ最も標準ブロックサイズに
近いブロックを選出し、これを新しいベースブロックと
して行成長部27に出力する。
7、行検証部28は、上記のような一連の処理を繰り返
し、宛名行が文字ブロックとして記憶されている全ブロ
ックが宛名行に分類されるか、ベースブロックが選択で
きなくなった場合に、処理を終了する(宛名行抽出部の
処理が終了する)。
置では、行成長部の出力する統合ブロックが宛名行とし
ての条件を満たすか否かの判定が行われ、もし判定条件
を満たさない場合には、ベースブロックが再度選出され
て、宛名行の統合がやり直される。
は、統合ブロックが、標準ブロックサイズの所定数倍で
定義される幅、高さ、統合ブロックに寄与している文字
ブロック間の距離のそれぞれの条件を満たすものである
か否かにより、ベースブロックの再選出を行わせている
が、行検証部29に、生成された宛名行の位置関係か
ら、予め定められた条件を満たさない宛名行を破棄する
機能を持たせても良い。たとえば、(1)1行目はある
程度の長さを持つ、(2)1行目の書き出し位置は一定
領域内から書かれる、等の条件を定めておき、各条件を
満たさない宛名行を破棄させるように、行検証部29を
構成することも出来る。
さ、行同士の相対的な位置を記述した統計的なテーブル
を予め作成しておき、これにより抽出された宛名行の尤
度を算出し、規定値に満たない行を破棄させることも出
来る。
置で用いられている宛名行抽出部の機能ブロック図を示
す。図示してあるように、第5の実施例による宛名行抽
出装置14は、第4の実施例の宛名行抽出部(図6参
照)と、ベースブロック選出部26から文字サイズ推定
部24へ、フィードバックのための信号が送出できるよ
うに変更したものとなっている。
ク分類部23と文字ブロック選出部25と行成長部27
とブロック分割部28と行検証部29の動作は、第4の
実施例と同一であるので、その説明は省略する。
ック変更信号を受信すると、これまでベースブロックに
なっていない文字ブロックの中から、標準ブロックサイ
ズとの差が既定値以内でかつ最も標準ブロックサイズに
近いブロックを選出し、これをベースブロックとして行
成長部27に出力するが、このときにベースブロックに
成りうる文字ブロックが存在しない場合には、標準ブロ
ックサイズ修正信号、およびグループ内にまだ宛名行候
補に統合されていない文字ブロックである残存ブロック
を文字サイズ推定部24に対して出力する。
イズ修正信号と残存ブロックを受信すると残存ブロック
に関して、第1の実施例における文字サイズ推定部24
における処理と同様の手順で標準ブロックサイズを算出
し、文字ブロック選出部25とブロック分割部28とベ
ースブロック選出部26と行検証部29に対して出力
し、残存ブロックに関して宛名行候補ブロックの生成を
行う。
では、ベースブロック選出部26がベースブロックを選
出するときに、グループ内にまだ宛名行候補に統合され
ていない文字ブロックである残存ブロックが存在してい
るにもかかわらず、ベースブロックに成りうる文字ブロ
ックが存在しないようなときに、再度標準ブロックサイ
ズを修正してからベースブロックを選出しなおす。
ックを再度選出する際にベースブロックになりうるブロ
ックが存在しない場合、ベースブロックの選択を行わな
かった。このため、スキュー、行間の入り組み等で1つ
のグループ内に大きさの異なる行同士が混在するとき
に、残留するブロックが存在しているにもかかわらず、
ベースブロックが選択できないような不都合が生じてい
たが、この実施例では、上述のように、そのような不都
合が生じないので、宛名行の抽出が正確に行えることに
なる。
(a)に示したような入力画像に対する処理が、第5の
実施例の宛名行抽出装置で実行され、宛名書式仮定部1
3が、書式候補を「縦置き縦書き」とし、宛名存在領域
を、図8(b)の宛名存在領域30とした場合を例に、
第5の実施例による宛名行抽出装置の動作内容を、さら
に、具体的に説明する。
を受けた前処理部21は、宛名存在領域30の位置に相
当する宛名の画像に対して2値化処理を行い、2値画像
を生成する。ラベリング部22は、前処理部21が生成
した2値画像内をラベリングし、同図(c)に示したよ
うに、連結成分の最小包囲矩形であるブロックを出力す
る。
置き縦書き」であるから、各ブロックを水平軸へそれぞ
れ投影して、投影値が“0”になる部分でブロックをグ
ループ分けする。その結果、(c)に示した各ブロック
は、(d)に示したように、2つのグループ31A 、3
1B に分類されることになる。
段階では、各グループに、1つの宛名行だけが含まれる
とは限らず、グループ31A のように、1グループに複
数の宛名行が含まれることもある。
れている方のグループであるグループ31A に対する処
理手順を説明する。
に対して、ブロック同士の重複する部分の面積がブロッ
ク面積の既定値以上の割合を占める場合、これらのブロ
ックを統合すると同図(b)のようになる。
4は、ブロック分類部23からのブロックに関する情報
を基に、予め定められている上限値と下限値の範囲に含
まれる幅を持つブロックのみを取り出し、それらのブロ
ックの幅の平均値と標準偏差を算出する。そして、算出
した平均値とブロックの幅の差が、標準偏差の所定数倍
以下のブロックを選択し、選択したブロックの幅の平均
値を算出し、標準ブロックサイズとして出力する。
のようなブロックを含むグループ(図9の(b)と同じ
ものである)に対しては、図10(b)に示したような
ブロック群に対して、まず、ブロックの幅の平均値と標
準偏差とを算出し、その算出結果を用いて(c)に示し
たようなブロック群を選択する。そして、図10(c)
に示したようなブロック群に対して、再度、平均値の算
出を行い、その算出結果を、標準ブロックサイズ33と
して、文字ブロック選出手段25とブロック分割手段1
8とベースブロック選出部26と行検証部29に出力す
る。
装置の動作の説明を続ける。文字ブロック選出部25
は、対象としているグループ31A 内の各ブロックが、
その長辺と、文字サイズ推定部24が決定した標準ブロ
ックサイズとの比が、予め定められた上限値と下限値の
範囲に含まれているという条件を満たすものであるか否
かを判定する。そして、条件を満たしているブロック
を、文字ブロックとして選択してベースブロック選出部
26に出力し、条件を満たしていないブロックを、行間
接触ブロックとしてブロック分離部27に出力する。
プ31A では、同図(c)に模式的に示したように、標
準ブロックサイズ33との比が大きいブロック35が、
行間接触ブロックとされ、他のブロックは、文字ブロッ
クとされることになる。
イズで行間接触ブロックの幅を割り、四捨五入すること
で、行間接触ブロックをいくつに分離するかを決定し、
分離を実行する。このため、ブロック分離部27は、ブ
ロック35の長辺の長さと、標準ブロックサイズ33と
の比を算出することによって、ブロック35を2個のブ
ロックに分離することを決定する。そして、図9(c)
に模式的に示してあるように、分離位置36で分離を実
行し、分離した2個のブロックを、ベースブロック選出
部27に出力する。
(d)に示したようなブロックが入力されることにな
り、ベースブロック選出部27は、それらのブロックか
ら、標準ブロックサイズ33に最も近い大きさを持つブ
ロック34をベースブロックとして選出する。
書き」であるため、行成長部29は、(e)に示したよ
うに、水平軸上に投影したとき(すなわち、矢印38方
向に投影したとき)に、ベースブロック34と重複があ
るブロック(図において、網掛けが付してあるブロッ
ク)を、順次統合していく。そして、行成長部27は、
グループ内のブロックが全て文字行に統合されたとき、
あるいは、統合が行えなくなったときに、統合処理を停
止し、統合結果を行検証部29に出力するので、この場
合は、(f)に示したように、グループ31A 内の右半
分に存在する各ブロックの統合が行われた段階で、統合
結果が、統合ブロック38として出力されることにな
る。
のサイズ、統合に参加したブロックの配置等をチェック
し、条件に合うものは宛名行候補として、書式判定部1
5に出力する。また、行検証部29は、注目しているグ
ループにおいて宛名行に属さないブロックが存在するか
否かのチェックを行い、残存ブロックがある場合には、
グループ内に大きさの異なる宛名行が存在することを考
慮して、残存ブロックについて再度文字サイズの推定を
行い、文字サイズ推定部24における標準ブロックサイ
ズの修正後、文字ブロック選出部25とブロック分割部
28とベースブロック選出部26と行成長部27と行検
証部29に、残存ブロックに関する処理を再度実行させ
る。
に属さないブロックが存在している場合には、行検証部
29は、残存ブロックに対して、統合ブロック28内の
ブロックに対して行ったのと、同様の処理を実行する。
その結果、行成長部27に、(g)に模式的に示したよ
うに、新たな標準ブロックサイズ41とベースブロック
39が通知されることになり、行成長部27は、各ブロ
ックを統合していき、新たな統合ブロック42を生成す
ることになる。
の動作を各グループの残存ブロックがなくなるか、また
は標準ブロックサイズを更新しても新たな宛名行が生成
されなくなるまで続行し、その後、処理を終了する。
る宛名行抽出装置では、宛名行を生成する際の元となる
ベースブロックの選択が、1つのグループ内に存在する
ブロックのうち、小さなものを考慮に入れずに算出され
る平均的なブロックサイズを基に行われる構成となって
いるので、誤ったベースブロックから宛名行の成長が行
われ、その結果として誤った宛名行抽出が行われるとい
ったことが起こりにくい。
ように、宛名書きの文字の大きさは多様に変化するた
め、文字の大きさによらず、一定のパラメータによりベ
ースブロックの選択を行う構成である場合には、(a)
に示した宛名書きのように比較的小さい文字で構成され
る宛名行(たとえば、ワープロ出力された宛名行)の抽
出を可能とするためには、ベースブロックになり得るブ
ロック幅の下限を小さめにしておかなければならない。
しかし、そのように設定しておくと、(b)のように大
きな文字が筆記された郵便物では、図中、枠で示したよ
うに、文字単位ではなく、たとえば、文字の一部分がブ
ロックあるいはベースブロックと見なされてしまい、結
果として誤った宛名行抽出が行われてしまう。
では、図11(a)、(b)いずれのケースでも、正確
に1文字分のブロックがベースブロックに選択されるこ
とになるので、上述のような誤った宛名行抽出は行われ
ず、宛名行の成長が安定に行われることになる。
の宛名書きにおいても宛名氏名、市区町名、番地等の行
毎に文字の大きさが変化するものが多く見られるのであ
るが、各実施例の宛名行抽出装置では、そのような郵便
物の画像データは、同図(b)に示したように、グルー
プ311 、312 といったような形で、大まかにグルー
プ分けされ、グループ単位で宛名行の成長が行われる。
このため、一通の宛名書き内での文字の大きさが変化し
ていても、安定した宛名行の抽出が行えるようになって
いる。
記載の発明による宛名行抽出装置では、郵便物上に記載
されている文字サイズに応じて、宛名行を成長させる際
の元となるベースブロックの選択が行われるので、文字
サイズがどのようなものであっても、正確な宛名行の抽
出が行えることになる。
出装置では、文字ブロックの大きさの分布を考慮に入れ
て、宛名として不適当な文字ブロックを用いずに標準ブ
ロックサイズが算出され、その標準ブロックサイズを基
にベースブロックが選択されるので、ノイズ、及び文字
接触に影響されずに、高精度な文字サイズの推定が行わ
れることになり、その結果として、正確な宛名行の抽出
が行えることになる。
準ブロックサイズと比して大きなブロックがあった場合
には、そのブロックを分割して文字ブロックを生成する
ように宛名行抽出装置を構成した場合には、宛名行が入
り組んでいる場合にも、正確な宛名行の抽出が行える宛
名行抽出装置が得られることになる。
ロックの統合を行う(宛名行の生成を担当する)ブロッ
ク統合手段に、統合結果が宛名行として正しい形態のも
のか否かを判断する機能を付加すれば、誤った宛名行抽
出が行われる確率が極めて低い宛名行抽出装置を得るこ
とが出来ることになる。
行抽出装置を構成した場合には、文字の大きさの異なる
宛名行同士に入り組み、接触があるような場合にも、宛
名行の抽出が的確に行えることになる。
概要を示す機能ブロック図である。
定部が仮定する書式を説明するための説明図である。
定部の動作を説明するために用いた、処理対象とされる
画像と宛名行抽出部の出力との対応関係の概要を示した
模式図である。
に設けられる宛名行抽出部の機能ブロック図である。
に設けられる宛名行抽出部の機能ブロック図である。
に設けられる宛名行抽出部の機能ブロック図である。
に設けられる宛名行抽出部の機能ブロック図である。
明するために用いた、処理対象とされる画像と書式仮定
部が出力する情報および宛名行抽出部内のブロック分類
部が出力する情報との対応関係の概要を示した模式図で
ある。
するための本発明における書式判定部の入力例を示す説
明図である。
準ブロックサイズを算出する際にその大きさを参照する
ブロックを示した説明図である。
出装置とを比較するために用いた、異なるサイズの文字
で表現された同一の内容を有する宛名行の一例を示した
説明図である。
と、その宛名がグループ分けされる様子を示した説明図
である。
Claims (5)
- 【請求項1】 郵便物の記載内容に応じた画像データか
ら宛名以外の記載情報を検出する雑情報検出手段と、 この雑情報検出手段の検出結果を用いて前記郵便物の宛
名の記載に用いられている可能性が高い、宛名行の筆記
方向を指定する情報を含む書式候補を少なくとも1つ仮
定する宛名書式仮定手段と、 この宛名書式仮定手段が仮定した各書式候補に対して、
書式候補に応じた一領域分の前記画像データから、黒画
素が連結した閉領域を包含するサイズが最小である矩形
のブロックを特定し、特定したブロックに関する情報を
出力するブロック特定手段と、 このブロック特定手段が各書式候補に対して特定した各
ブロックの位置および大きさに関する情報を基に、書式
候補ごとに各ブロックを幾つかのグループに分類するブ
ロック分類手段と、 このブロック分類手段が分類したグループごとに、それ
ぞれに属するブロックの大きさの平均値を算出し、算出
結果を標準ブロックサイズとして出力する標準ブロック
サイズ算出手段と、 前記ブロック分類手段によって分類された各グループに
属するブロックから、前記標準ブロックサイズ算出手段
によってそのグループに対して算出された標準ブロック
サイズとの大きさの差が所定値以内のブロックを宛名文
字ブロックとして特定し、その特定結果を前記グループ
ごとに出力する宛名文字ブロック特定手段と、 この宛名文字ブロック特定手段でグループごとに特定さ
れた宛名文字ブロックから、所定の範囲内の大きさを持
ち、そのグループに関する前記標準ブロックサイズに最
も近い大きさを持つ宛名文字ブロックをベースブロック
として選出するベースブロック選出手段と、 このベースブロック選出手段によってグループごとに選
出されたベースブロックと、そのグループに対応する前
記書式候補における前記筆記方向と直交する方向に関し
ての重複の度合いが所定値以上の同一グループ内の宛名
文字ブロックとを統合し、各グループに対する統合結果
をそれぞれ統合ブロックとして出力するブロック統合手
段と、 このブロック統合手段が、グループごとに出力する統合
ブロックの前記画像データ内での位置や大きさを前記書
式候補単位で相互に比較し、宛名行として最も適当な形
態を有する統合ブロックが得られた書式候補を前記郵便
物に用いられている書式とする書式決定手段とを具備す
ることを特徴とする宛名行抽出装置。 - 【請求項2】 前記標準ブロックサイズ算出手段が、前
記グループに属する前記文字ブロックから既定の上限値
と下限値の範囲外の大きさを持つブロックを除外し、残
った前記グループ内のブロックの大きさの平均値と標準
偏差とを算出し、算出した平均値と大きさの隔たりが算
出した標準偏差の既定数倍以内のブロックに関する大き
さの平均値を再度算出し、算出結果を前記標準ブロック
サイズとして出力するものであることを特徴とする請求
項1記載の宛名行抽出装置。 - 【請求項3】 前記宛名文字ブロック特定手段が、前記
ブロック分類手段によって分類された各グループに属す
るブロックから、前記標準ブロックサイズ算出手段によ
ってそのグループに対して算出された標準ブロックサイ
ズとの大きさの差が所定値以内のブロックを、宛名文字
ブロックと特定するとともに、標準ブロックサイズより
その大きさが所定値以上大きなブロックが存在していた
場合には、そのブロックを前記標準ブロックサイズと同
程度の大きさを有するブロックに分割し、分割したブロ
ックを宛名文字ブロックと特定するものであることを特
徴とする請求項1または請求項2記載の宛名行抽出装
置。 - 【請求項4】 前記ブロック統合手段が、統合結果とし
て得られた前記統合ブロックが、前記標準ブロックサイ
ズの所定数倍で定められる幅や高さの上限値および下限
値の範囲に含まれるという条件を満たすか否かの判定を
行い、条件を満たさないと判定したときには、その統合
ブロックを破棄するとともに、前記ベースブロック選出
手段に、そのグループに属する前記文字ブロックの中か
ら、まだベースブロックとして使用されておらず、か
つ、標準ブロックサイズとの大きさの差が所定値以内で
かつ最も小さいブロックをベースブロックとして選出さ
せるものであることを特徴とする請求項3記載の宛名行
抽出装置。 - 【請求項5】 前記ベースブロック選出手段が、あるグ
ループ内にベースブロックになり得るブロックが存在し
ない場合、前記標準ブロックサイズ算出手段に、そのグ
ループ内で宛名行に統合されていないブロックを用い
た、標準ブロックサイズの算出を行わせるものであるこ
とを特徴とする請求項4記載の宛名行抽出装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP7105576A JP2827960B2 (ja) | 1995-04-28 | 1995-04-28 | 宛名行抽出装置 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP7105576A JP2827960B2 (ja) | 1995-04-28 | 1995-04-28 | 宛名行抽出装置 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPH08305794A true JPH08305794A (ja) | 1996-11-22 |
| JP2827960B2 JP2827960B2 (ja) | 1998-11-25 |
Family
ID=14411347
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP7105576A Expired - Lifetime JP2827960B2 (ja) | 1995-04-28 | 1995-04-28 | 宛名行抽出装置 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JP2827960B2 (ja) |
Cited By (4)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2007071707A (ja) * | 2005-09-07 | 2007-03-22 | Taisei Corp | リアルタイム地震情報を利用した地震動強さの予測方法および防災システム |
| JP2008033851A (ja) * | 2006-08-01 | 2008-02-14 | Nec Corp | 郵便自動区分機及び郵便自動区分方法 |
| JP2009026287A (ja) * | 2007-07-23 | 2009-02-05 | Sharp Corp | 文字画像抽出装置および文字画像抽出方法 |
| JP2018092604A (ja) * | 2016-11-25 | 2018-06-14 | 株式会社リコー | 情報処理装置、撮像装置、機器制御システム、移動体、情報処理方法およびプログラム |
-
1995
- 1995-04-28 JP JP7105576A patent/JP2827960B2/ja not_active Expired - Lifetime
Cited By (5)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2007071707A (ja) * | 2005-09-07 | 2007-03-22 | Taisei Corp | リアルタイム地震情報を利用した地震動強さの予測方法および防災システム |
| JP2008033851A (ja) * | 2006-08-01 | 2008-02-14 | Nec Corp | 郵便自動区分機及び郵便自動区分方法 |
| JP2009026287A (ja) * | 2007-07-23 | 2009-02-05 | Sharp Corp | 文字画像抽出装置および文字画像抽出方法 |
| US8750616B2 (en) | 2007-07-23 | 2014-06-10 | Sharp Kabushiki Kaisha | Character image extracting apparatus and character image extracting method |
| JP2018092604A (ja) * | 2016-11-25 | 2018-06-14 | 株式会社リコー | 情報処理装置、撮像装置、機器制御システム、移動体、情報処理方法およびプログラム |
Also Published As
| Publication number | Publication date |
|---|---|
| JP2827960B2 (ja) | 1998-11-25 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| EP1497787B1 (en) | System and method for identifying and extracting character strings from captured image data | |
| US8947736B2 (en) | Method for binarizing scanned document images containing gray or light colored text printed with halftone pattern | |
| EP1061469B1 (en) | Method and apparatus for selecting text and/or non-text blocks in a stored document | |
| US6014450A (en) | Method and apparatus for address block location | |
| US8306325B2 (en) | Text character identification system and method thereof | |
| US20010016069A1 (en) | Ruled line extracting apparatus for extracting ruled line from normal document image and method thereof | |
| JPH06309498A (ja) | 画像抽出方式 | |
| JPH096957A (ja) | 濃度画像の2値化方法および画像2値化装置 | |
| JP3485020B2 (ja) | 文字認識方法及び装置ならびに記憶媒体 | |
| JP4392907B2 (ja) | 文字切出し方法 | |
| JP2002207964A (ja) | 多値画像から二値画像を生成する画像処理装置および方法 | |
| JP4011646B2 (ja) | 行検出方法および文字認識装置 | |
| IL98293A (en) | A method for distinguishing between text and graphics | |
| JP2827960B2 (ja) | 宛名行抽出装置 | |
| US11430235B2 (en) | Image processing apparatus, image processing method, and storage medium | |
| JP2861860B2 (ja) | 宛名行抽出装置 | |
| JP4132822B2 (ja) | 画像内のオブジェクトの発見 | |
| JP3268552B2 (ja) | 領域抽出方法、宛名領域抽出方法、宛名領域抽出装置、及び画像処理装置 | |
| JP2000357287A (ja) | ナンバープレート認識方法および認識装置 | |
| JP2009116520A (ja) | 画像認識装置、画像認識方法及びプログラム | |
| Gayashan et al. | Old sinhala newspaper article segmentation for content recognition using image processing | |
| JP2714012B2 (ja) | 宛名領域検出装置 | |
| JPH09305707A (ja) | 画像抽出方式 | |
| JP2000210624A (ja) | 郵便宛名認識装置 | |
| Sambyal et al. | Connected component based English character set segmentation |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20080918 Year of fee payment: 10 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20080918 Year of fee payment: 10 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20090918 Year of fee payment: 11 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20090918 Year of fee payment: 11 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20100918 Year of fee payment: 12 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20110918 Year of fee payment: 13 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20120918 Year of fee payment: 14 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20130918 Year of fee payment: 15 |
|
| EXPY | Cancellation because of completion of term |