JPH08249346A - 文書検索装置及び文書生成方法 - Google Patents
文書検索装置及び文書生成方法Info
- Publication number
- JPH08249346A JPH08249346A JP7050987A JP5098795A JPH08249346A JP H08249346 A JPH08249346 A JP H08249346A JP 7050987 A JP7050987 A JP 7050987A JP 5098795 A JP5098795 A JP 5098795A JP H08249346 A JPH08249346 A JP H08249346A
- Authority
- JP
- Japan
- Prior art keywords
- word
- document
- index
- original
- notation
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
Landscapes
- Information Retrieval, Db Structures And Fs Structures Therefor (AREA)
Abstract
(57)【要約】
【目的】原文書そのものを持たなくても、検索された文
書の内容が復元できるようにする。 【構成】単語インデックス及び隣接インデックスを作成
するインデックス作成部210及び211の他に、原文
生成用のインデックスである単語再生インデックス、表
記再生インデックス及び原文表記インデックスを作成す
るインデックス作成部212、213及び214を設
け、入力装置2から入力された検索キー、単語インデッ
クス及び隣接インデックスをもとに検索部202にて文
書を検索し、検索した文書の内容表示の際には、原文生
成部204により、当該文書についての隣接インデック
スの示す各キーワードを先頭から順に参照し、そのキー
ワードまたはキーワード列を当該文書についての上記3
種の原文生成用インデックスをもとに原文書の表記の単
語に復元することで原文書を生成する構成とする。
書の内容が復元できるようにする。 【構成】単語インデックス及び隣接インデックスを作成
するインデックス作成部210及び211の他に、原文
生成用のインデックスである単語再生インデックス、表
記再生インデックス及び原文表記インデックスを作成す
るインデックス作成部212、213及び214を設
け、入力装置2から入力された検索キー、単語インデッ
クス及び隣接インデックスをもとに検索部202にて文
書を検索し、検索した文書の内容表示の際には、原文生
成部204により、当該文書についての隣接インデック
スの示す各キーワードを先頭から順に参照し、そのキー
ワードまたはキーワード列を当該文書についての上記3
種の原文生成用インデックスをもとに原文書の表記の単
語に復元することで原文書を生成する構成とする。
Description
【0001】
【産業上の利用分野】本発明は、データベース等に登録
された文書をキーワードをもとに検索する文書検索装置
及び検索された文書の内容を生成する文書生成方法に関
する。
された文書をキーワードをもとに検索する文書検索装置
及び検索された文書の内容を生成する文書生成方法に関
する。
【0002】
【従来の技術】データベース等に登録された大量の文書
から必要な文書を検索する文書検索装置の1つに、文書
の全文を検索対象としたフルテキストサーチにおいて、
日本語解析を用いて検索用のインデックスを予め作成し
ておき、実際の検索では当該検索用のインデックスを参
照する方式を適用する文書検索装置が知られている。
から必要な文書を検索する文書検索装置の1つに、文書
の全文を検索対象としたフルテキストサーチにおいて、
日本語解析を用いて検索用のインデックスを予め作成し
ておき、実際の検索では当該検索用のインデックスを参
照する方式を適用する文書検索装置が知られている。
【0003】この種の文書検索装置で用いられる検索用
のインデックスは2種類ある。第1のインデックスは単
語インデックスと呼ばれるもので、次の方式で作成され
る。
のインデックスは2種類ある。第1のインデックスは単
語インデックスと呼ばれるもので、次の方式で作成され
る。
【0004】まず、検索対象の全文書を形態素解析して
単語切りを行う。切られた単語は、異表記語(「コンピ
ュータ」と「コンピューター」のような関係のある語)
や同義語(「コンピュータ」と「電子計算機」のような
関係のある語)の関係にある単語群の代表語に置き換え
られる場合もある。
単語切りを行う。切られた単語は、異表記語(「コンピ
ュータ」と「コンピューター」のような関係のある語)
や同義語(「コンピュータ」と「電子計算機」のような
関係のある語)の関係にある単語群の代表語に置き換え
られる場合もある。
【0005】これらの単語は、データベースのキーワー
ドとして抽出するが、キーワードとして抽出しない品詞
情報が指定された単語は、文字単位に分割してキーワー
ドとして抽出される。
ドとして抽出するが、キーワードとして抽出しない品詞
情報が指定された単語は、文字単位に分割してキーワー
ドとして抽出される。
【0006】各文書に対するそれぞれのキーワードの有
無をマトリックスで表現することで作成されたものが単
語インデックスである。第2のインデックスは、形態素
解析によって区切られた文書中の単語や文字(キーワー
ド)の並び方の情報を文書毎に持たせた隣接インデック
スである。
無をマトリックスで表現することで作成されたものが単
語インデックスである。第2のインデックスは、形態素
解析によって区切られた文書中の単語や文字(キーワー
ド)の並び方の情報を文書毎に持たせた隣接インデック
スである。
【0007】従来、日本語解析を用いたフルテキストサ
ーチでは、上記の単語インデックス及び隣接インデック
スを用いて次のような検索が行われていた。まず、ユー
ザにより任意に入力された文字列(検索キー)は、イン
デックスの作成と同様に形態素解析によって単語単位ま
たは文字単位に分割される。
ーチでは、上記の単語インデックス及び隣接インデック
スを用いて次のような検索が行われていた。まず、ユー
ザにより任意に入力された文字列(検索キー)は、イン
デックスの作成と同様に形態素解析によって単語単位ま
たは文字単位に分割される。
【0008】次に単語インデックスが参照され、キーワ
ードを含む全ての文書がピックアップされる(1次絞り
込み)。更に、1次絞り込みでピックアップされた文書
の隣接インデックスが参照され、検索キーの並びと等し
いキーワードの並びを持つ文書が検索した文書としてピ
ックアップされる(2次絞り込み)。
ードを含む全ての文書がピックアップされる(1次絞り
込み)。更に、1次絞り込みでピックアップされた文書
の隣接インデックスが参照され、検索キーの並びと等し
いキーワードの並びを持つ文書が検索した文書としてピ
ックアップされる(2次絞り込み)。
【0009】検索した結果は、入力装置を介して指示さ
れたユーザからの要求に応じて、例えば検索した文書の
タイトル名の形で出力装置に出力される。この検索結果
の出力において、検索した文書の内容を表示する場合に
は、保存しておいた原文(原文書)が用いられる。
れたユーザからの要求に応じて、例えば検索した文書の
タイトル名の形で出力装置に出力される。この検索結果
の出力において、検索した文書の内容を表示する場合に
は、保存しておいた原文(原文書)が用いられる。
【0010】このように、検索用インデックス(を構成
する単語インデックス及び隣接インデックス)を利用し
た従来の文書検索装置では、文書検索において、全ての
検索対象の文書のテキスト(原文)についてその都度検
索キーとの文字列比較を行う必要がないことから、検索
効率が向上するものの、検索した文書の内容を表示する
ために、検索対象の文書全てのテキストを記憶装置に保
存しておく必要があった。
する単語インデックス及び隣接インデックス)を利用し
た従来の文書検索装置では、文書検索において、全ての
検索対象の文書のテキスト(原文)についてその都度検
索キーとの文字列比較を行う必要がないことから、検索
効率が向上するものの、検索した文書の内容を表示する
ために、検索対象の文書全てのテキストを記憶装置に保
存しておく必要があった。
【0011】また、従来の文書作成装置では、検索キー
自身、もしくは検索キーを含む前後の文字列の表示方法
を工夫して、文書中の検索キーの位置をユーザが一目で
視認(識別)できるようにする表示機能、例えば検索キ
ーを他の文字列とは異なる表示形態で表示する機能が用
意されている。このような特別の表示形態としては、反
転表示や高輝度表示(ハイライト表示)が知られている
が、便宜的にそれらを全てハイライト表示と呼ぶことに
する。
自身、もしくは検索キーを含む前後の文字列の表示方法
を工夫して、文書中の検索キーの位置をユーザが一目で
視認(識別)できるようにする表示機能、例えば検索キ
ーを他の文字列とは異なる表示形態で表示する機能が用
意されている。このような特別の表示形態としては、反
転表示や高輝度表示(ハイライト表示)が知られている
が、便宜的にそれらを全てハイライト表示と呼ぶことに
する。
【0012】従来、検索キーのハイライト表示は、出力
対象の文書(原文書)中の文字列と全ての検索キーとの
比較により該当する文字列を検出することにより行われ
ていた。また、検索キーの同義語や異表記語のハイライ
ト表示も、同様な比較(検索キーの同義語及び異表記語
と出力対象文書中の文字列との比較)により実施してお
り、検索キーをハイライト表示しながらの検索文書(の
原文)の表示に時間を要していた。
対象の文書(原文書)中の文字列と全ての検索キーとの
比較により該当する文字列を検出することにより行われ
ていた。また、検索キーの同義語や異表記語のハイライ
ト表示も、同様な比較(検索キーの同義語及び異表記語
と出力対象文書中の文字列との比較)により実施してお
り、検索キーをハイライト表示しながらの検索文書(の
原文)の表示に時間を要していた。
【0013】
【発明が解決しようとする課題】上記したように、従来
の日本語解析を用いたフルテキストサーチ方式の文書検
索装置において、検索によって得られた複数の文書中か
ら任意の文書を表示させるためには、検索用のインデッ
クス以外に、検索対象の文書のテキスト(原文書)を記
憶装置に保存しておかねばならず、そのために、必要と
なる記憶装置の容量が大きくなるという問題があった。
の日本語解析を用いたフルテキストサーチ方式の文書検
索装置において、検索によって得られた複数の文書中か
ら任意の文書を表示させるためには、検索用のインデッ
クス以外に、検索対象の文書のテキスト(原文書)を記
憶装置に保存しておかねばならず、そのために、必要と
なる記憶装置の容量が大きくなるという問題があった。
【0014】また、検索された文書の内容表示での検索
キーのハイライト表示では、出力対象の文書と全ての検
索キーとの文字列比較を逐一行うために、その表示速度
が遅く、更に検索キーの同義語や異表記語についてもハ
イライト表示等を行う場合には、文字列比較の回数が増
加して一層表示速度が遅くなるという問題があった。
キーのハイライト表示では、出力対象の文書と全ての検
索キーとの文字列比較を逐一行うために、その表示速度
が遅く、更に検索キーの同義語や異表記語についてもハ
イライト表示等を行う場合には、文字列比較の回数が増
加して一層表示速度が遅くなるという問題があった。
【0015】本発明は上記事情を考慮してなされたもの
でその目的は、検索用のインデックスの他に、原文生成
用のインデックスを用いることで、そのインデックスか
ら原文書を再生でき、もって原文書そのものを持たなく
ても、検索された文書の内容表示が行え、記憶装置の容
量削減が図れる文書検索装置及び文書生成方法を提供す
ることにある。
でその目的は、検索用のインデックスの他に、原文生成
用のインデックスを用いることで、そのインデックスか
ら原文書を再生でき、もって原文書そのものを持たなく
ても、検索された文書の内容表示が行え、記憶装置の容
量削減が図れる文書検索装置及び文書生成方法を提供す
ることにある。
【0016】本発明の他の目的は、検索された文書中に
含まれる検索キー等を他の文字列から識別可能なように
特別の表示を行うのに必要な文字列比較の回数を減少す
ることができ、もって表示速度の改善が図れる文書検索
装置及び文書生成・表示方法を提供することにある。
含まれる検索キー等を他の文字列から識別可能なように
特別の表示を行うのに必要な文字列比較の回数を減少す
ることができ、もって表示速度の改善が図れる文書検索
装置及び文書生成・表示方法を提供することにある。
【0017】
【課題を解決するための手段】本発明は、検索の対象と
なり得る全ての文書を形態素解析して単語切りを行い、
単語または当該単語が分割された各文字をキーワードと
して抽出することで、各文書に対するキーワードの有無
情報を示す(検索用インデックスの1つをなす)単語イ
ンデックスを作成するキーワード情報登録手段と、上記
各文書に含まれるキーワードの並び方を示す(検索用イ
ンデックスの1つをなす)隣接インデックスを文書毎に
作成する隣接情報登録手段と、上記隣接インデックスで
示される並び順の各キーワードまたはキーワード列を原
文書での表記に復元するための情報を示す原文生成イン
デックスを作成する原文生成情報登録手段と、検索キー
入力及び処理指示等に用いられる入力装置と、検索され
た文書の内容表示等に用いられる表示装置と、上記入力
装置から入力された検索キー、上記キーワード情報登録
手段により作成された単語インデックス及び上記隣接情
報登録手段により作成された隣接インデックスをもとに
文書を検索する文書検索手段と、この文書検索手段によ
り検索された文書の内容表示のために、当該文書につい
ての上記隣接インデックスの示す各キーワードを先頭か
ら順に参照し、そのキーワードまたはキーワード列を当
該文書についての上記原文生成インデックスをもとに原
文書の表記の単語に復元することで当該文書の原文書を
生成する原文生成手段と、この原文生成手段により生成
された原文書等を上記表示装置に表示出力する出力手段
とを備えたことを特徴とするものである。
なり得る全ての文書を形態素解析して単語切りを行い、
単語または当該単語が分割された各文字をキーワードと
して抽出することで、各文書に対するキーワードの有無
情報を示す(検索用インデックスの1つをなす)単語イ
ンデックスを作成するキーワード情報登録手段と、上記
各文書に含まれるキーワードの並び方を示す(検索用イ
ンデックスの1つをなす)隣接インデックスを文書毎に
作成する隣接情報登録手段と、上記隣接インデックスで
示される並び順の各キーワードまたはキーワード列を原
文書での表記に復元するための情報を示す原文生成イン
デックスを作成する原文生成情報登録手段と、検索キー
入力及び処理指示等に用いられる入力装置と、検索され
た文書の内容表示等に用いられる表示装置と、上記入力
装置から入力された検索キー、上記キーワード情報登録
手段により作成された単語インデックス及び上記隣接情
報登録手段により作成された隣接インデックスをもとに
文書を検索する文書検索手段と、この文書検索手段によ
り検索された文書の内容表示のために、当該文書につい
ての上記隣接インデックスの示す各キーワードを先頭か
ら順に参照し、そのキーワードまたはキーワード列を当
該文書についての上記原文生成インデックスをもとに原
文書の表記の単語に復元することで当該文書の原文書を
生成する原文生成手段と、この原文生成手段により生成
された原文書等を上記表示装置に表示出力する出力手段
とを備えたことを特徴とするものである。
【0018】また本発明は、上記原文生成情報登録手段
を、隣接インデックスに文字単位に分割されて登録され
たキーワード列を形態素解析後の状態の単語に戻すため
に、当該隣接インデックスの各キーワード毎に、形態素
解析後の状態の単語への再生が必要であるか否かを示
す、上記原文生成インデックスの1つをなす単語再生イ
ンデックスを文書毎に作成する単語再生インデックス作
成手段と、形態素解析後の状態の単語を原文書での表記
の単語に変換する必要があるか否かを示す、上記原文生
成インデックスの1つをなす表記再生インデックスを文
書毎に作成する表記再生インデックス作成手段と、形態
素解析後の状態の単語を原文書での表記の単語に変換す
るための文字列データの集まりである、上記原文生成イ
ンデックスの1つをなす原文表記インデックスを文書毎
に作成する原文表記インデックス作成手段とにより構成
したことをも特徴とする。
を、隣接インデックスに文字単位に分割されて登録され
たキーワード列を形態素解析後の状態の単語に戻すため
に、当該隣接インデックスの各キーワード毎に、形態素
解析後の状態の単語への再生が必要であるか否かを示
す、上記原文生成インデックスの1つをなす単語再生イ
ンデックスを文書毎に作成する単語再生インデックス作
成手段と、形態素解析後の状態の単語を原文書での表記
の単語に変換する必要があるか否かを示す、上記原文生
成インデックスの1つをなす表記再生インデックスを文
書毎に作成する表記再生インデックス作成手段と、形態
素解析後の状態の単語を原文書での表記の単語に変換す
るための文字列データの集まりである、上記原文生成イ
ンデックスの1つをなす原文表記インデックスを文書毎
に作成する原文表記インデックス作成手段とにより構成
したことをも特徴とする。
【0019】また本発明は、上記原文生成手段に、上記
検索された文書についての単語再生インデックスを先頭
から順に参照し、形態素解析後の状態の単語への再生を
必要とする隣接インデックスの対応するキーワード列に
ついては1つの単語として再生し、それ以外の隣接イン
デックスの対応するキーワードについてはそのまま単語
とし、その単語の表記変換が必要であることが表記再生
インデックスにより示されている場合には、当該単語を
原文表記インデックスの示す原文書での表記の単語に変
換する機能を持たせたことをも特徴とする。
検索された文書についての単語再生インデックスを先頭
から順に参照し、形態素解析後の状態の単語への再生を
必要とする隣接インデックスの対応するキーワード列に
ついては1つの単語として再生し、それ以外の隣接イン
デックスの対応するキーワードについてはそのまま単語
とし、その単語の表記変換が必要であることが表記再生
インデックスにより示されている場合には、当該単語を
原文表記インデックスの示す原文書での表記の単語に変
換する機能を持たせたことをも特徴とする。
【0020】また本発明は、検索された文書に含まれて
いる全ての検索キーと原文生成手段により生成される形
態素解析後の状態の単語とを比較し、その単語に一致す
る検索キーがある場合には、その単語に対応する原文書
での表記の単語に他の文字列と異なる特別の表示形態で
表示することを示す特別の情報を付加する表示修飾情報
付加手段を更に備え、上記出力手段が原文生成手段によ
り生成された原文書を表示する際には、上記特別の情報
が付加されている単語を他の単語とは異なる表示形態で
表示することをも特徴とする。
いる全ての検索キーと原文生成手段により生成される形
態素解析後の状態の単語とを比較し、その単語に一致す
る検索キーがある場合には、その単語に対応する原文書
での表記の単語に他の文字列と異なる特別の表示形態で
表示することを示す特別の情報を付加する表示修飾情報
付加手段を更に備え、上記出力手段が原文生成手段によ
り生成された原文書を表示する際には、上記特別の情報
が付加されている単語を他の単語とは異なる表示形態で
表示することをも特徴とする。
【0021】
【作用】上記の構成において、検索された文書の内容を
表示する場合には、隣接インデックス及び原文生成イン
デックスをもとに、原文生成手段により原文書が再構築
されて生成される。この再構築では、内容表示の対象と
なる文書の隣接インデックスに順に登録されたキーワー
ドまたはキーワード列を単語として再生していく処理が
行われる。このとき、原文生成用の原文生成インデック
スが参照され、隣接インデックスの単語が同義語や異表
記語群の代表語に置き換わっているときには、原文で使
われている単語、即ち原文での表記の単語に戻される。
表示する場合には、隣接インデックス及び原文生成イン
デックスをもとに、原文生成手段により原文書が再構築
されて生成される。この再構築では、内容表示の対象と
なる文書の隣接インデックスに順に登録されたキーワー
ドまたはキーワード列を単語として再生していく処理が
行われる。このとき、原文生成用の原文生成インデック
スが参照され、隣接インデックスの単語が同義語や異表
記語群の代表語に置き換わっているときには、原文で使
われている単語、即ち原文での表記の単語に戻される。
【0022】上記原文生成インデックスは、例えば、隣
接インデックスの各キーワード毎に、形態素解析後の状
態の単語への再生が必要であるか否かを示す単語再生イ
ンデックスと、形態素解析後の状態の単語を原文書での
表記の単語に変換する必要があるか否かを示す表記再生
インデックスと、形態素解析後の状態の単語を原文書で
の表記の単語に変換するための原文表記インデックスと
により構成されている。
接インデックスの各キーワード毎に、形態素解析後の状
態の単語への再生が必要であるか否かを示す単語再生イ
ンデックスと、形態素解析後の状態の単語を原文書での
表記の単語に変換する必要があるか否かを示す表記再生
インデックスと、形態素解析後の状態の単語を原文書で
の表記の単語に変換するための原文表記インデックスと
により構成されている。
【0023】このような原文生成インデックス構成とし
た場合、上記原文生成手段による原文書の再構築では、
検索された文書の単語再生インデックスが先頭から順に
参照されて、形態素解析後の状態の単語への再生を必要
とする隣接インデックスの対応するキーワード列につい
ては1つの単語として再生され、それ以外の隣接インデ
ックスの対応するキーワードについてはそのまま形態素
解析後の状態の単語とされる。また、その単語が、同義
語や異表記語群の代表語に置き換わっているときには、
その単語の表記変換が必要であることが表記再生インデ
ックスにより示されているため、その単語を原文表記イ
ンデックスの示す原文書での表記の単語に変換する処理
が行われる。また、その単語が原文書での表記に一致し
ているときには、その単語の表記変換が不要であること
が表記再生インデックスにより示されているため、その
単語がそのまま原文書での表記の単語とされる。
た場合、上記原文生成手段による原文書の再構築では、
検索された文書の単語再生インデックスが先頭から順に
参照されて、形態素解析後の状態の単語への再生を必要
とする隣接インデックスの対応するキーワード列につい
ては1つの単語として再生され、それ以外の隣接インデ
ックスの対応するキーワードについてはそのまま形態素
解析後の状態の単語とされる。また、その単語が、同義
語や異表記語群の代表語に置き換わっているときには、
その単語の表記変換が必要であることが表記再生インデ
ックスにより示されているため、その単語を原文表記イ
ンデックスの示す原文書での表記の単語に変換する処理
が行われる。また、その単語が原文書での表記に一致し
ているときには、その単語の表記変換が不要であること
が表記再生インデックスにより示されているため、その
単語がそのまま原文書での表記の単語とされる。
【0024】このようにして、隣接インデックスと原文
生成インデックスとから原文書が再構築されるため、原
文書そのものを記憶装置に保存しておく必要がなくな
る。また、検索された文書の内容を表示する場合におい
て、その文書に含まれている少なくとも検索キーを他と
は異なる特別の表示形態で表示するために、検索された
文書に含まれている全ての検索キーと原文生成手段によ
り生成される形態素解析後の状態の単語(即ち、同義
語、異表記群の代表語に置き換わっている可能性のある
単語)とが表示修飾情報付加手段にて比較され、その単
語に一致する検索キーがある場合には、その単語に対応
する原文書での表記の単語は、検索キー、当該検索キー
の同義語、または当該検索キーの異表記語であるとし
て、その原文書での表記の単語に他の文字列と異なる特
別の表示形態で表示することを示す特別の情報が付加さ
れる。
生成インデックスとから原文書が再構築されるため、原
文書そのものを記憶装置に保存しておく必要がなくな
る。また、検索された文書の内容を表示する場合におい
て、その文書に含まれている少なくとも検索キーを他と
は異なる特別の表示形態で表示するために、検索された
文書に含まれている全ての検索キーと原文生成手段によ
り生成される形態素解析後の状態の単語(即ち、同義
語、異表記群の代表語に置き換わっている可能性のある
単語)とが表示修飾情報付加手段にて比較され、その単
語に一致する検索キーがある場合には、その単語に対応
する原文書での表記の単語は、検索キー、当該検索キー
の同義語、または当該検索キーの異表記語であるとし
て、その原文書での表記の単語に他の文字列と異なる特
別の表示形態で表示することを示す特別の情報が付加さ
れる。
【0025】以上の結果、原文生成手段により生成され
た原文書を表示する場合に、上記特別の情報が付加され
ている単語を他の単語とは異なる表示形態で表示するこ
とが可能となる。
た原文書を表示する場合に、上記特別の情報が付加され
ている単語を他の単語とは異なる表示形態で表示するこ
とが可能となる。
【0026】このように、上記の構成においては、検索
された文書の内容表示で検索キーや当該検索キーの同義
語、異表記語をハイライト表示するのに、原文生成手段
による原文書生成時に隣接インデックス及び原文生成イ
ンデックスをもとに中間的に生成される形態素解析後の
状態の単語、即ち同義語、異表記語群の代表語に置き換
わっている可能性のある単語と検索キーとの比較を行え
ばよい。即ち上記の構成においては、従来のように原文
書と検索キーとの文字列比較を逐一行う必要がなく、更
に原文書と検索キーの同義語や異表記語との文字列比較
も行う必要がない。したがって、検索キーや、その同義
語、異表記語をハイライト表示しながらの、検索された
文書の内容表示の速度を向上することが可能となる。
された文書の内容表示で検索キーや当該検索キーの同義
語、異表記語をハイライト表示するのに、原文生成手段
による原文書生成時に隣接インデックス及び原文生成イ
ンデックスをもとに中間的に生成される形態素解析後の
状態の単語、即ち同義語、異表記語群の代表語に置き換
わっている可能性のある単語と検索キーとの比較を行え
ばよい。即ち上記の構成においては、従来のように原文
書と検索キーとの文字列比較を逐一行う必要がなく、更
に原文書と検索キーの同義語や異表記語との文字列比較
も行う必要がない。したがって、検索キーや、その同義
語、異表記語をハイライト表示しながらの、検索された
文書の内容表示の速度を向上することが可能となる。
【0027】なお、検索された文書中に含まれる検索キ
ーと、その同義語、異表記語とを区別して表示すること
を可能とするには、検索された文書に含まれている全て
の検索キーと原文生成手段により生成される形態素解析
後の状態の単語との比較で、その単語に一致する検索キ
ーがあった場合に、更にその検索キーとその単語に対応
する原文書での表記の単語とを比較し、一致しているな
らば、当該単語に検索キーと同一であることを示す第1
の表示形態での表示を指示する第1の情報を付加し、一
致していないならば、当該単語に検索キーの同義語また
は異表記語であることを示す第2の表示形態での表示を
指示する第2の情報を付加する構成の表示修飾情報付加
手段を用いればよい。
ーと、その同義語、異表記語とを区別して表示すること
を可能とするには、検索された文書に含まれている全て
の検索キーと原文生成手段により生成される形態素解析
後の状態の単語との比較で、その単語に一致する検索キ
ーがあった場合に、更にその検索キーとその単語に対応
する原文書での表記の単語とを比較し、一致しているな
らば、当該単語に検索キーと同一であることを示す第1
の表示形態での表示を指示する第1の情報を付加し、一
致していないならば、当該単語に検索キーの同義語また
は異表記語であることを示す第2の表示形態での表示を
指示する第2の情報を付加する構成の表示修飾情報付加
手段を用いればよい。
【0028】
【実施例】以下、図面を参照して本発明の実施例につき
説明する。図1は本発明の一実施例に係る文書検索装置
の概略構成を示すブロック図である。この文書検索装置
は、検索された文書の内容表示時に、原文書を必要とせ
ず、検索の前に予め作成しておいた原文生成用のインデ
ックスをもとに原文書の再構築を可能するもので、制御
装置1、入力装置2、表示装置3及び外部記憶装置4か
ら構成される。
説明する。図1は本発明の一実施例に係る文書検索装置
の概略構成を示すブロック図である。この文書検索装置
は、検索された文書の内容表示時に、原文書を必要とせ
ず、検索の前に予め作成しておいた原文生成用のインデ
ックスをもとに原文書の再構築を可能するもので、制御
装置1、入力装置2、表示装置3及び外部記憶装置4か
ら構成される。
【0029】制御装置1は、文書検索装置全体の制御を
司るもので、CPU、メモリなどから構成されている。
この制御装置1の機能構成については、図2を参照して
後述する。
司るもので、CPU、メモリなどから構成されている。
この制御装置1の機能構成については、図2を参照して
後述する。
【0030】入力装置2は、ユーザ操作に従う検索キー
ワード(検索キー)の入力、検索操作の指示入力等を行
うためのもので、例えばキーボード及びマウスなどから
構成されている。
ワード(検索キー)の入力、検索操作の指示入力等を行
うためのもので、例えばキーボード及びマウスなどから
構成されている。
【0031】表示装置3は、検索結果及び検索によって
検索された文書の内容等を表示するためのもので、例え
ばCRTディスプレイ、液晶ディスプレイ等である。外
部記憶装置4は、データベース、及び文書検索・原文生
成に用いる各種のインデックス等を格納するためのもの
で、例えば磁気ディスク装置である。
検索された文書の内容等を表示するためのもので、例え
ばCRTディスプレイ、液晶ディスプレイ等である。外
部記憶装置4は、データベース、及び文書検索・原文生
成に用いる各種のインデックス等を格納するためのもの
で、例えば磁気ディスク装置である。
【0032】制御装置1は、図2に示すように、検索/
原文生成処理部20、インデックス作成処理部21及び
バッファ部22から構成されている。検索/原文生成処
理部20は、文書検索と検索した文書の内容復元(原文
生成)等を司るもので、初期化部200、キー入力部2
01、検索部202、出力部203、原文生成部204
及びハイライト情報付加部205の各機能手段から構成
される。
原文生成処理部20、インデックス作成処理部21及び
バッファ部22から構成されている。検索/原文生成処
理部20は、文書検索と検索した文書の内容復元(原文
生成)等を司るもので、初期化部200、キー入力部2
01、検索部202、出力部203、原文生成部204
及びハイライト情報付加部205の各機能手段から構成
される。
【0033】インデックス作成処理部21は、検索用と
原文生成用の各種インデックスの作成を司るもので、単
語インデックス作成部210、隣接インデックス作成部
211、単語再生インデックス作成部212、表記再生
インデックス作成部213及び原文表記インデックス作
成部214の各機能手段から構成される。
原文生成用の各種インデックスの作成を司るもので、単
語インデックス作成部210、隣接インデックス作成部
211、単語再生インデックス作成部212、表記再生
インデックス作成部213及び原文表記インデックス作
成部214の各機能手段から構成される。
【0034】バッファ部22は、作業バッファ部22
0、検索キー保存部221、形態素解析後検索キー保存
部222及び単語バッファ部223の各記憶手段から構
成される。
0、検索キー保存部221、形態素解析後検索キー保存
部222及び単語バッファ部223の各記憶手段から構
成される。
【0035】初期化部200は、データベース検索処理
実行に際して、バッファ部22内の初期化を行うもので
ある。キー入力部201は、外部記憶装置4に格納され
たデータベース中の大量の文書から所望する文書を検索
するための検索キーを入力装置2から入力するものであ
る。
実行に際して、バッファ部22内の初期化を行うもので
ある。キー入力部201は、外部記憶装置4に格納され
たデータベース中の大量の文書から所望する文書を検索
するための検索キーを入力装置2から入力するものであ
る。
【0036】検索部202は、キー入力部201により
入力された検索キーを用いて、外部記憶装置4内のデー
タベースから該当する文書を検索する検索処理を行うも
のである。
入力された検索キーを用いて、外部記憶装置4内のデー
タベースから該当する文書を検索する検索処理を行うも
のである。
【0037】出力部203は、検索で該当した文書の一
覧の出力、及び文書の内容の出力を表示装置3に対して
行うものである。原文生成部204は、検索で該当した
文書の内容(原文)を、後述する原文生成インデックス
を用いて生成するものである。
覧の出力、及び文書の内容の出力を表示装置3に対して
行うものである。原文生成部204は、検索で該当した
文書の内容(原文)を、後述する原文生成インデックス
を用いて生成するものである。
【0038】ハイライト情報付加部205は、検索で該
当した文書の内容の出力において、該当検索キーの文字
列をハイライト表示するための表示修飾情報(ハイライ
ト情報)を付加するものである。
当した文書の内容の出力において、該当検索キーの文字
列をハイライト表示するための表示修飾情報(ハイライ
ト情報)を付加するものである。
【0039】単語インデックス作成部210は、各文書
に対するそれぞれのキーワード(単語または文字)の有
無をマトリックスで表現するための単語インデックスを
作成するものである。
に対するそれぞれのキーワード(単語または文字)の有
無をマトリックスで表現するための単語インデックスを
作成するものである。
【0040】隣接インデックス作成部211は、文書中
のキーワード(単語または文字)の並び方の情報を文書
毎に持つ隣接インデックスを作成するものである。単語
再生インデックス作成部212は、文字単位に分割して
隣接インデックスに登録されたキーワード列を形態素解
析時の単語に戻すための情報を文書毎に持つ単語再生イ
ンデックスを作成するものである。
のキーワード(単語または文字)の並び方の情報を文書
毎に持つ隣接インデックスを作成するものである。単語
再生インデックス作成部212は、文字単位に分割して
隣接インデックスに登録されたキーワード列を形態素解
析時の単語に戻すための情報を文書毎に持つ単語再生イ
ンデックスを作成するものである。
【0041】表記再生インデックス作成部213は、形
態素解析時の各単語について原文での表記の単語への変
換が必要か否かの情報を文書毎に持つ表記再生インデッ
クスを作成するものである。
態素解析時の各単語について原文での表記の単語への変
換が必要か否かの情報を文書毎に持つ表記再生インデッ
クスを作成するものである。
【0042】原文表記インデックス作成部214は、表
記再生インデックスで変換要が示されている原文での表
記の単語の列を文書毎に持つ原文表記インデックスを作
成するものである。
記再生インデックスで変換要が示されている原文での表
記の単語の列を文書毎に持つ原文表記インデックスを作
成するものである。
【0043】作業バッファ部220は、入力装置2から
入力された検索キー(検索キーワード)や、検索部20
2によるデータベースの検索処理によって得られたデー
タ等を、一時的に格納するためのものである。
入力された検索キー(検索キーワード)や、検索部20
2によるデータベースの検索処理によって得られたデー
タ等を、一時的に格納するためのものである。
【0044】検索キー保存部221は、内容出力の対象
となっている文書に含まれている検索キーを形態素解析
で単語切りされた区切れが分かる形で格納するためのも
のである。
となっている文書に含まれている検索キーを形態素解析
で単語切りされた区切れが分かる形で格納するためのも
のである。
【0045】形態素解析後検索キー保存部222は、検
索キー保存部221に格納されている単語(検索キー)
の同音語、異表記語を格納するためのものである。単語
バッファ部223は、隣接インデックスに格納された単
語をまとめて、形態素解析後の状態の単語に復元する途
中の単語を格納するためのものである。
索キー保存部221に格納されている単語(検索キー)
の同音語、異表記語を格納するためのものである。単語
バッファ部223は、隣接インデックスに格納された単
語をまとめて、形態素解析後の状態の単語に復元する途
中の単語を格納するためのものである。
【0046】次に、本実施例の文書検索装置における動
作を、(1)インデックスの作成処理、(2)文書検
索、検索文書の原文生成及び検索キーのハイライト表示
処理に分けて順次説明する。 (1)インデックスの作成処理 制御装置1では、文書検索の前処理として、検索に必要
な単語インデックス及び隣接インデックス(からなる検
索用インデックス)の作成と、原文生成に必要な単語再
生インデックス、表記再生インデックス及び原文表記イ
ンデックス(からなる原文生成インデックス)の作成と
が、当該制御装置1内のインデックス作成処理部21に
より行われる。
作を、(1)インデックスの作成処理、(2)文書検
索、検索文書の原文生成及び検索キーのハイライト表示
処理に分けて順次説明する。 (1)インデックスの作成処理 制御装置1では、文書検索の前処理として、検索に必要
な単語インデックス及び隣接インデックス(からなる検
索用インデックス)の作成と、原文生成に必要な単語再
生インデックス、表記再生インデックス及び原文表記イ
ンデックス(からなる原文生成インデックス)の作成と
が、当該制御装置1内のインデックス作成処理部21に
より行われる。
【0047】このインデックス作成は、外部記憶装置4
内のデータベースに格納されている大量の文書を対象
に、図3のフローチャートに従って1文書ずつ次のよう
に行われる。
内のデータベースに格納されている大量の文書を対象
に、図3のフローチャートに従って1文書ずつ次のよう
に行われる。
【0048】まず、インデックス作成処理部21(内の
図示せぬ日本語解析部)は、データベース中の全ての文
書に対してのインデックス作成が終了していない状態で
は(ステップS1)、即ちインデックスが作成されてい
ない文書が存在する場合には、その文書を外部記憶装置
4から読み出して周知の形態素解析を行い、単語単位に
分割する(ステップS2)。この分割された単語には、
同義語や異表記語の関係にある単語群の代表語に置き換
えられるものもある。例えば、「計算機」は「コンピュ
ータ」に、「使用する」の分割後の単語「使用」と「す
る」は「使う」と「す」に、それぞれ置き換えられる。
各単語には、品詞情報が付与される。
図示せぬ日本語解析部)は、データベース中の全ての文
書に対してのインデックス作成が終了していない状態で
は(ステップS1)、即ちインデックスが作成されてい
ない文書が存在する場合には、その文書を外部記憶装置
4から読み出して周知の形態素解析を行い、単語単位に
分割する(ステップS2)。この分割された単語には、
同義語や異表記語の関係にある単語群の代表語に置き換
えられるものもある。例えば、「計算機」は「コンピュ
ータ」に、「使用する」の分割後の単語「使用」と「す
る」は「使う」と「す」に、それぞれ置き換えられる。
各単語には、品詞情報が付与される。
【0049】次にインデックス作成処理部21は、ステ
ップS2での分割の対象となった文書中の全ての単語に
ついてインデックスへの登録が終了していない状態では
(ステップS3)、単語インデックス作成部210、隣
接インデックス作成部211、単語再生インデックス作
成部212、表記再生インデックス作成部213及び原
文表記インデックス作成部214により、ステップS4
からステップS8までのインデックス登録処理を行う。
ップS2での分割の対象となった文書中の全ての単語に
ついてインデックスへの登録が終了していない状態では
(ステップS3)、単語インデックス作成部210、隣
接インデックス作成部211、単語再生インデックス作
成部212、表記再生インデックス作成部213及び原
文表記インデックス作成部214により、ステップS4
からステップS8までのインデックス登録処理を行う。
【0050】まず、単語インデックス作成部210によ
りステップS4が実行される。このステップS4では、
先の形態素解析により単語毎に付与された品詞情報の中
で、形態素解析後の状態の単語の形そのままでキーワー
ドとして単語インデックスに登録することが指定されて
いる品詞情報を持つ単語については、形態素解析後の状
態の単語の表記のままで単語インデックスに登録され
る。
りステップS4が実行される。このステップS4では、
先の形態素解析により単語毎に付与された品詞情報の中
で、形態素解析後の状態の単語の形そのままでキーワー
ドとして単語インデックスに登録することが指定されて
いる品詞情報を持つ単語については、形態素解析後の状
態の単語の表記のままで単語インデックスに登録され
る。
【0051】また、それ以外の単語、即ち上記のような
指定のない品詞情報を持つ単語については、文字単位に
分割されて、その文字がキーワードとして単語インデッ
クスに登録される。
指定のない品詞情報を持つ単語については、文字単位に
分割されて、その文字がキーワードとして単語インデッ
クスに登録される。
【0052】ここで、形態素解析後の状態の単語は、異
表記語処理や同義語処理により一種の正規化が施される
ため、必ずしも原文の表記と同じであるとは限らない。
なお、形態素解析後の状態の単語の形そのままでキーワ
ードとして単語インデックスに登録するか否かは、ユー
ザによって指定されるものとする。
表記語処理や同義語処理により一種の正規化が施される
ため、必ずしも原文の表記と同じであるとは限らない。
なお、形態素解析後の状態の単語の形そのままでキーワ
ードとして単語インデックスに登録するか否かは、ユー
ザによって指定されるものとする。
【0053】図8は、以上の単語インデックスのデータ
構造を示す。この単語インデックスは、データベース中
の各文書内にキーワードとなる単語または文字が存在す
るか否かを、同図の例のように、各キーワード毎に各文
書の(識別子としての)文書番号に対応させてマトリッ
クスの形で示すものである。
構造を示す。この単語インデックスは、データベース中
の各文書内にキーワードとなる単語または文字が存在す
るか否かを、同図の例のように、各キーワード毎に各文
書の(識別子としての)文書番号に対応させてマトリッ
クスの形で示すものである。
【0054】キーワードとなる単語または文字には、固
有の識別番号(キーワード識別番号)が割り当てられ
る。この割り当ては、ステップS2での単語分割処理に
おいて行われ、新たな単語(または文字が)検出される
毎に、例えば新たなシリアル番号が識別番号として割り
当てられる。
有の識別番号(キーワード識別番号)が割り当てられ
る。この割り当ては、ステップS2での単語分割処理に
おいて行われ、新たな単語(または文字が)検出される
毎に、例えば新たなシリアル番号が識別番号として割り
当てられる。
【0055】次に、隣接インデックス作成部211によ
りステップS5が実行される。このステップS5では、
対象文書中の単語或いは文字(キーワード)の並び方の
情報が隣接インデックスに登録される。この隣接インデ
ックスは、各文書毎に、その文書中の単語或いは文字
が、その単語或いは文字に割り当てられたキーワード識
別番号に置き換えられたものである。
りステップS5が実行される。このステップS5では、
対象文書中の単語或いは文字(キーワード)の並び方の
情報が隣接インデックスに登録される。この隣接インデ
ックスは、各文書毎に、その文書中の単語或いは文字
が、その単語或いは文字に割り当てられたキーワード識
別番号に置き換えられたものである。
【0056】隣接インデックスの一例を図9に示す。但
し、以下の説明では、便宜上、文書中の単語或いは文字
(キーワード)がキーワード識別番号に置き換えられな
いものとする。
し、以下の説明では、便宜上、文書中の単語或いは文字
(キーワード)がキーワード識別番号に置き換えられな
いものとする。
【0057】そこで、文書中の単語或いは文字(キーワ
ード)がキーワード識別番号に置き換えられていない隣
接インデックスの一例を、原文(原文書)が「検索シス
テムは計算機を使用する。」の場合について図10に示
す。図10において、“/”は形態素解析後の状態の単
語に一致する単語(キーワード)のセパレータを示し、
“|”は形態素解析後の状態の単語が文字単位に分割さ
れた部分の各文字(キーワード)のセパレータを示す。
この図10には、隣接インデックスと対比させて、形態
素解析後の状態の単語列と、原文(原文書)での単語列
とが示されている。
ード)がキーワード識別番号に置き換えられていない隣
接インデックスの一例を、原文(原文書)が「検索シス
テムは計算機を使用する。」の場合について図10に示
す。図10において、“/”は形態素解析後の状態の単
語に一致する単語(キーワード)のセパレータを示し、
“|”は形態素解析後の状態の単語が文字単位に分割さ
れた部分の各文字(キーワード)のセパレータを示す。
この図10には、隣接インデックスと対比させて、形態
素解析後の状態の単語列と、原文(原文書)での単語列
とが示されている。
【0058】さて、上記ステップS5が終了すると、単
語再生インデックス作成部212によりステップS6が
実行される。このステップS6では、文字単位に分割し
て隣接インデックスに登録したキーワードを形態素解析
後の状態の単語に再構築(復元)するために、形態素解
析後の状態の単語としての始まりと終りを示すように、
隣接インデックスの1単位(1キーワード)毎に、例え
ば1ビットの情報(ここでは、論理“1”の1ビット情
報)が付加されて、単語再生インデックスに登録され
る。単語再生インデックスの一例を、図10の隣接イン
デックスと同一の文書(原文書)の場合について、形態
素解析後の状態の単語列に対応させて図11(a)に示
す。
語再生インデックス作成部212によりステップS6が
実行される。このステップS6では、文字単位に分割し
て隣接インデックスに登録したキーワードを形態素解析
後の状態の単語に再構築(復元)するために、形態素解
析後の状態の単語としての始まりと終りを示すように、
隣接インデックスの1単位(1キーワード)毎に、例え
ば1ビットの情報(ここでは、論理“1”の1ビット情
報)が付加されて、単語再生インデックスに登録され
る。単語再生インデックスの一例を、図10の隣接イン
デックスと同一の文書(原文書)の場合について、形態
素解析後の状態の単語列に対応させて図11(a)に示
す。
【0059】次に、表記再生インデックス作成部213
によりステップS7が実行される。このステップS7で
は、形態素解析後の状態の単語が前記したように原文の
表記と同じであるとは限らないことから、この形態素解
析後の状態の単語毎に、原文への表記への変換の要/不
要が例えば1ビットの情報で表され(ここでは、論理
“1”で変換要を示す)、表記再生インデックスに登録
される。表記再生インデックスの一例を、図10の隣接
インデックスと同一の文書の場合について、形態素解析
後の状態の単語列と、原文(原文書)での単語列とに対
応させて図11(b)に示す。
によりステップS7が実行される。このステップS7で
は、形態素解析後の状態の単語が前記したように原文の
表記と同じであるとは限らないことから、この形態素解
析後の状態の単語毎に、原文への表記への変換の要/不
要が例えば1ビットの情報で表され(ここでは、論理
“1”で変換要を示す)、表記再生インデックスに登録
される。表記再生インデックスの一例を、図10の隣接
インデックスと同一の文書の場合について、形態素解析
後の状態の単語列と、原文(原文書)での単語列とに対
応させて図11(b)に示す。
【0060】もし、原文への表記への変換が必要な場合
には、原文表記インデックス作成部214によりステッ
プS8が実行され、原文で表記されている単語がセパレ
ータと共に原文表記インデックスに順番に登録される。
この原文表記インデックスの一例を、図10の隣接イン
デックスと同一の文書の場合について、図11(c)に
示す。
には、原文表記インデックス作成部214によりステッ
プS8が実行され、原文で表記されている単語がセパレ
ータと共に原文表記インデックスに順番に登録される。
この原文表記インデックスの一例を、図10の隣接イン
デックスと同一の文書の場合について、図11(c)に
示す。
【0061】1つの単語について、上記ステップS4〜
S8のインデックス登録処理が行われると、ステップS
3に戻り、1つの文書中の全ての単語についてのインデ
ックス登録処理が終了したならば、ステップS1に戻
る。そして、データベース中の全ての文書に対してイン
デックス作成が行われたならば、一連のインデックス作
成処理は終了となる。
S8のインデックス登録処理が行われると、ステップS
3に戻り、1つの文書中の全ての単語についてのインデ
ックス登録処理が終了したならば、ステップS1に戻
る。そして、データベース中の全ての文書に対してイン
デックス作成が行われたならば、一連のインデックス作
成処理は終了となる。
【0062】以上の各インデックスは、外部記憶装置4
に保存される。なお、本実施例では、後述するようにデ
ータベース中の原文書は不要となるため、1つの文書中
の全ての単語についてのインデックス登録処理が終了す
る毎に、当該文書が外部記憶装置4から削除される。
に保存される。なお、本実施例では、後述するようにデ
ータベース中の原文書は不要となるため、1つの文書中
の全ての単語についてのインデックス登録処理が終了す
る毎に、当該文書が外部記憶装置4から削除される。
【0063】ここで、原文生成用のインデックスの容量
(単語再生インデックス、表記再生インデックス及び原
文表記インデックスを合わせた容量)は、検索用のイン
デックスの容量(単語インデックス及び隣接インデック
スを合わせた容量)の約1/10であり、当該検索用の
インデックスの容量はほぼ文書容量に一致する。
(単語再生インデックス、表記再生インデックス及び原
文表記インデックスを合わせた容量)は、検索用のイン
デックスの容量(単語インデックス及び隣接インデック
スを合わせた容量)の約1/10であり、当該検索用の
インデックスの容量はほぼ文書容量に一致する。
【0064】したがって、インデックス登録処理終了後
は原文書を持たないで済むことで、外部記憶装置4の必
要容量を大幅に減らす(約45%)ことができる。ま
た、従来と同じ記憶容量であれば、取り扱える文書数を
大幅に増やすことができる。 (2)文書検索、検索文書の原文生成及び検索キーのハ
イライト表示処理 次に、文書検索、検索文書の原文生成及び検索キーのハ
イライト表示処理を含む文書検索時の一連の処理につい
て図4のフローチャートを参照して説明する。
は原文書を持たないで済むことで、外部記憶装置4の必
要容量を大幅に減らす(約45%)ことができる。ま
た、従来と同じ記憶容量であれば、取り扱える文書数を
大幅に増やすことができる。 (2)文書検索、検索文書の原文生成及び検索キーのハ
イライト表示処理 次に、文書検索、検索文書の原文生成及び検索キーのハ
イライト表示処理を含む文書検索時の一連の処理につい
て図4のフローチャートを参照して説明する。
【0065】まず検索/原文生成処理部20は、初期化
部200により、検索/原文生成処理部20内の各部及
びバッファ部22内の各バッファの初期化を行い、検索
が実施できる状態にする(ステップS11)。
部200により、検索/原文生成処理部20内の各部及
びバッファ部22内の各バッファの初期化を行い、検索
が実施できる状態にする(ステップS11)。
【0066】このような状態で検索/原文生成処理部2
0は、ユーザが検索用のキーワード(検索キー)を入力
するための図15のような検索キー入力画面を表示装置
3に表示する。ユーザは、検索キー入力画面上で[検
索]ボタンを入力装置2のマウスを操作してクリック
し、入力装置2のキーボードを操作して検索キーとなる
所望の文字列(を含む検索式)を入力する。
0は、ユーザが検索用のキーワード(検索キー)を入力
するための図15のような検索キー入力画面を表示装置
3に表示する。ユーザは、検索キー入力画面上で[検
索]ボタンを入力装置2のマウスを操作してクリック
し、入力装置2のキーボードを操作して検索キーとなる
所望の文字列(を含む検索式)を入力する。
【0067】検索/原文生成処理部20は、キー入力部
201により、入力装置2からユーザ指定の文字列から
なる検索キー(を含む検索式)を入力する(ステップS
12)。
201により、入力装置2からユーザ指定の文字列から
なる検索キー(を含む検索式)を入力する(ステップS
12)。
【0068】キー入力部201により入力された検索キ
ー(検索式)は検索部202に渡されると共に、出力部
203を介して図15の例のように検索キー入力画面上
に表示される。この図15の例では、“画像”、“処
理”及び“特徴”の各文字列(単語)が全て存在する文
書を検索するための検索キー(検索式)が入力されてい
る様子が示されている。
ー(検索式)は検索部202に渡されると共に、出力部
203を介して図15の例のように検索キー入力画面上
に表示される。この図15の例では、“画像”、“処
理”及び“特徴”の各文字列(単語)が全て存在する文
書を検索するための検索キー(検索式)が入力されてい
る様子が示されている。
【0069】検索部202は、入力された検索キーによ
り全文検索を実行し、検索した結果を表示装置3に一覧
表示する(ステップS13)。この検索部202による
検索処理自体は[従来の技術]の欄で述べたのと同様で
あり、次のように行われる。
り全文検索を実行し、検索した結果を表示装置3に一覧
表示する(ステップS13)。この検索部202による
検索処理自体は[従来の技術]の欄で述べたのと同様で
あり、次のように行われる。
【0070】まず検索部202は、キー入力部201に
より入力された検索キーの文字列を対象に、(前記した
インデックス作成処理部21におけるインデックス作成
時と同様に)形態素解析して単語単位または文字単位に
分割する。
より入力された検索キーの文字列を対象に、(前記した
インデックス作成処理部21におけるインデックス作成
時と同様に)形態素解析して単語単位または文字単位に
分割する。
【0071】次に検索部202は、単語単位または文字
単位に分割された検索キー要素に一致する単語インデッ
クス部分(例えば検索キーが文書検索装置であれば、キ
ーワード“文書”についての単語インデックス部分と、
“検索”についての単語インデックス部分と、“装置”
についての単語インデックス部分)を外部記憶装置4か
ら作業バッファ部220に読み込む。
単位に分割された検索キー要素に一致する単語インデッ
クス部分(例えば検索キーが文書検索装置であれば、キ
ーワード“文書”についての単語インデックス部分と、
“検索”についての単語インデックス部分と、“装置”
についての単語インデックス部分)を外部記憶装置4か
ら作業バッファ部220に読み込む。
【0072】検索部202は、作業バッファ部220に
読み込んだ単語インデックス部分を参照して、キーワー
ドを全て含む文書の文書番号を抽出する(1次絞り込
み)。次に検索部202は、1次絞り込みで抽出された
全ての文書番号の文書についての隣接インデックスを外
部記憶装置4から作業バッファ部220に順次読み込
む。そして検索部202は、隣接インデックスを1文書
分読み込む毎に、当該インデックスを参照して、検索キ
ーの文字列の並びと等しいキーワードの並びを持つ隣接
インデックスであるか否かをチェックする。
読み込んだ単語インデックス部分を参照して、キーワー
ドを全て含む文書の文書番号を抽出する(1次絞り込
み)。次に検索部202は、1次絞り込みで抽出された
全ての文書番号の文書についての隣接インデックスを外
部記憶装置4から作業バッファ部220に順次読み込
む。そして検索部202は、隣接インデックスを1文書
分読み込む毎に、当該インデックスを参照して、検索キ
ーの文字列の並びと等しいキーワードの並びを持つ隣接
インデックスであるか否かをチェックする。
【0073】このようにして検索部202は、検索キー
の文字列の並びと等しいキーワードの並びを持つ文書の
文書番号を抽出する(2次絞り込み)。次に検索部20
2は、2次絞り込みで抽出された全ての文書番号の文書
についての例えばタイトルの一覧を文書検索結果一覧と
して出力部203により表示装置3に表示する。この文
書検索結果一覧の表示画面例を図16に示す。
の文字列の並びと等しいキーワードの並びを持つ文書の
文書番号を抽出する(2次絞り込み)。次に検索部20
2は、2次絞り込みで抽出された全ての文書番号の文書
についての例えばタイトルの一覧を文書検索結果一覧と
して出力部203により表示装置3に表示する。この文
書検索結果一覧の表示画面例を図16に示す。
【0074】ユーザは、図16に示したような文書検索
結果の一覧が表示されると、文書内容を表示させたい文
書があるならば、当該文書検索結果一覧の中から表示さ
せたい文書のタイトルを、入力装置2のマウスを操作し
てクリックすることで選択指定する。この指定内容はキ
ー入力部201により入力されて検索部202に送られ
る。
結果の一覧が表示されると、文書内容を表示させたい文
書があるならば、当該文書検索結果一覧の中から表示さ
せたい文書のタイトルを、入力装置2のマウスを操作し
てクリックすることで選択指定する。この指定内容はキ
ー入力部201により入力されて検索部202に送られ
る。
【0075】検索部202は、検索された文書の内容表
示が指定された場合(ステップS14)、選択指定され
た文書に含まれている全ての検索キーを、検索キー保存
部221に図12のフォーマットで格納すると共に、そ
の検索キーの表記が形態素解析や同義語、異表記語処理
で変換されたものを形態素解析後検索キー保存部222
に図13のフォーマットで格納し(ステップS15)、
原文生成部204に制御を渡す。なお、図12及び図1
3中の“¥0”は文字列の終りを示す。
示が指定された場合(ステップS14)、選択指定され
た文書に含まれている全ての検索キーを、検索キー保存
部221に図12のフォーマットで格納すると共に、そ
の検索キーの表記が形態素解析や同義語、異表記語処理
で変換されたものを形態素解析後検索キー保存部222
に図13のフォーマットで格納し(ステップS15)、
原文生成部204に制御を渡す。なお、図12及び図1
3中の“¥0”は文字列の終りを示す。
【0076】原文生成部204は、検索部202から制
御を渡されると、隣接インデックスと、(単語再生イン
デックス、表記再生インデックス及び原文表記インデッ
クスからなる)原文生成インデックス、更には検索キー
保存部221と検索キー保存部222を用いて、選択指
定された文書の内容、即ち原文書(原文)を生成する原
文生成処理を行う(ステップS16)。この原文生成部
204による原文生成処理の詳細を以下に説明する。
御を渡されると、隣接インデックスと、(単語再生イン
デックス、表記再生インデックス及び原文表記インデッ
クスからなる)原文生成インデックス、更には検索キー
保存部221と検索キー保存部222を用いて、選択指
定された文書の内容、即ち原文書(原文)を生成する原
文生成処理を行う(ステップS16)。この原文生成部
204による原文生成処理の詳細を以下に説明する。
【0077】まず、原文生成に用いられるインデックス
の1つである隣接インデックスは、図10のフォーマッ
トに示したように、文書が単語単位、文字単位に分割さ
れた形となっている。
の1つである隣接インデックスは、図10のフォーマッ
トに示したように、文書が単語単位、文字単位に分割さ
れた形となっている。
【0078】このような隣接インデックスをもとにして
原文を生成するのに、まず隣接インデックスを一旦形態
素解析後の状態に復元する。この形態素解析後の状態と
は、そのまま隣接インデックスに登録することが指定さ
れた品詞を持つ単語以外の単語を文字単位に分割して登
録する前の状態である。
原文を生成するのに、まず隣接インデックスを一旦形態
素解析後の状態に復元する。この形態素解析後の状態と
は、そのまま隣接インデックスに登録することが指定さ
れた品詞を持つ単語以外の単語を文字単位に分割して登
録する前の状態である。
【0079】次に、形態素解析後の状態を原文での表記
に戻す。これは、同義語、異表記語処理等で原文の表記
が置換された単語を原文での表記にすることで実現され
る。本実施例では、上記のような方法での原文生成を可
能とするために、単語再生インデックス、表記再生イン
デックス及び原文表記インデックスの3つの原文生成イ
ンデックスが、既に述べたように、単語インデックスと
隣接インデックスの検索用のインデックスを作成する際
に、作成されるようになっている。
に戻す。これは、同義語、異表記語処理等で原文の表記
が置換された単語を原文での表記にすることで実現され
る。本実施例では、上記のような方法での原文生成を可
能とするために、単語再生インデックス、表記再生イン
デックス及び原文表記インデックスの3つの原文生成イ
ンデックスが、既に述べたように、単語インデックスと
隣接インデックスの検索用のインデックスを作成する際
に、作成されるようになっている。
【0080】単語再生インデックスは、前記したように
図11(a)のフォーマットで示すデータ構造となって
おり、形態素解析後の状態の単語としての“始まり”と
“終り”を示すように、隣接インデックスの1単位(キ
ーワード)毎に1ビットの情報が付加される。
図11(a)のフォーマットで示すデータ構造となって
おり、形態素解析後の状態の単語としての“始まり”と
“終り”を示すように、隣接インデックスの1単位(キ
ーワード)毎に1ビットの情報が付加される。
【0081】表記再生インデックスは、形態素解析後の
状態の単語を原文での表記の単語に変換するのに用いら
れるもので、前記したように図11(b)のフォーマッ
トで示すデータ構造となっており、変換要/不要の1ビ
ット情報を形態素解析後の状態の単語毎に持つ。
状態の単語を原文での表記の単語に変換するのに用いら
れるもので、前記したように図11(b)のフォーマッ
トで示すデータ構造となっており、変換要/不要の1ビ
ット情報を形態素解析後の状態の単語毎に持つ。
【0082】原文表記インデックスは、形態素解析後の
状態の単語を原文での表記の単語に変換するための文字
列データの集合であり、前記したように図11(c)に
示したデータ構造となっている。変換を要する形態素解
析後の状態の単語であった場合、原文表記インデックス
から順次単語を取り出すことで、原文での表示の単語に
置き換えることが可能となる。
状態の単語を原文での表記の単語に変換するための文字
列データの集合であり、前記したように図11(c)に
示したデータ構造となっている。変換を要する形態素解
析後の状態の単語であった場合、原文表記インデックス
から順次単語を取り出すことで、原文での表示の単語に
置き換えることが可能となる。
【0083】次に、以上の各インデックスを用いた原文
生成の手順について、図5及び図6のフローチャートを
参照して説明する。まず原文生成部204は、ユーザに
より選択指定された内容表示を行うべき文書、即ち原文
の生成を行うべき文書の単語再生インデックス(図11
(a)参照)から、単語の再生の開始または終了等を示
すビットデータを読み込む(ステップS21)。
生成の手順について、図5及び図6のフローチャートを
参照して説明する。まず原文生成部204は、ユーザに
より選択指定された内容表示を行うべき文書、即ち原文
の生成を行うべき文書の単語再生インデックス(図11
(a)参照)から、単語の再生の開始または終了等を示
すビットデータを読み込む(ステップS21)。
【0084】ここで、形態素解析後の状態の単語への再
生中である場合(ステップS22)、或いは上記読み込
んだビットデータが形態素解析後の状態の単語への再生
開始を示すビット(論理“1”ビット)の場合、即ち再
生中でなくても形態素解析後の状態の単語への再生開始
を示す場合(ステップS23)には、原文生成部204
は、形態素解析後の状態の単語に再生するために、その
ビットに対応する隣接インデックス(図10または図1
1(a)参照)の文字(キーワード)を単語バッファ部
223に追加する(ステップS24)。
生中である場合(ステップS22)、或いは上記読み込
んだビットデータが形態素解析後の状態の単語への再生
開始を示すビット(論理“1”ビット)の場合、即ち再
生中でなくても形態素解析後の状態の単語への再生開始
を示す場合(ステップS23)には、原文生成部204
は、形態素解析後の状態の単語に再生するために、その
ビットに対応する隣接インデックス(図10または図1
1(a)参照)の文字(キーワード)を単語バッファ部
223に追加する(ステップS24)。
【0085】次に原文生成部204は、図11(a)に
示した単語再生インデックスから読み込んだビットデー
タが単語の再生の終了を示していないならば(ステップ
S25)、単語の再生を続けるためにステップS21に
戻り、終了を示しているならば、単語バッファ部223
にある単語を形態素解析後の状態の単語とする(ステッ
プS26)。
示した単語再生インデックスから読み込んだビットデー
タが単語の再生の終了を示していないならば(ステップ
S25)、単語の再生を続けるためにステップS21に
戻り、終了を示しているならば、単語バッファ部223
にある単語を形態素解析後の状態の単語とする(ステッ
プS26)。
【0086】このようにして、単語バッファ部223内
に形態素解析後の状態の単語が再生される様子の一例
を、形態素解析で単語切りされた「システム」が「シ」
「ス」「テ」「ム」と文字単位に分割された場合の単語
再生について図14に示す。
に形態素解析後の状態の単語が再生される様子の一例
を、形態素解析で単語切りされた「システム」が「シ」
「ス」「テ」「ム」と文字単位に分割された場合の単語
再生について図14に示す。
【0087】一方、単語の再生中でなく、且つ単語の再
生の開始でもない場合(ステップS23)には、原文生
成部204は、図10に示した隣接インデックスの単語
をそのまま形態素解析後の状態の単語とする(ステップ
S27)。
生の開始でもない場合(ステップS23)には、原文生
成部204は、図10に示した隣接インデックスの単語
をそのまま形態素解析後の状態の単語とする(ステップ
S27)。
【0088】原文生成部204は、ステップS26また
はS27を実行すると、読み取り、もしくは再生した形
態素解析後の状態の単語に対応する図11(b)に示し
たような表記再生インデックスのビットデータを読み取
る(ステップS28)。
はS27を実行すると、読み取り、もしくは再生した形
態素解析後の状態の単語に対応する図11(b)に示し
たような表記再生インデックスのビットデータを読み取
る(ステップS28)。
【0089】次に原文生成部204は、表記再生インデ
ックスから読み取ったビットデータが論理“1”の場
合、即ち原文と表記が異なっていることが示されている
場合には(ステップS29)、図11(c)に示したよ
うな原文表記インデックスを用いて形態素解析後の状態
の単語を原文での表記の単語に置換する(ステップS3
0)。ここで、原文生成インデックスでのセパレータで
区切られる文字列の並びは、表記再生インデックスでの
論理“1”のビットに対応する隣接インデックスの単語
の並びに一致するため、原文での表記の単語への変換は
正しく行える。
ックスから読み取ったビットデータが論理“1”の場
合、即ち原文と表記が異なっていることが示されている
場合には(ステップS29)、図11(c)に示したよ
うな原文表記インデックスを用いて形態素解析後の状態
の単語を原文での表記の単語に置換する(ステップS3
0)。ここで、原文生成インデックスでのセパレータで
区切られる文字列の並びは、表記再生インデックスでの
論理“1”のビットに対応する隣接インデックスの単語
の並びに一致するため、原文での表記の単語への変換は
正しく行える。
【0090】これに対し、表記再生インデックスから読
み取ったビットデータが論理“0”の場合、即ち原文と
表記が同一であることが示されている場合には(ステッ
プS29)、原文生成部204は、形態素解析後の状態
の単語をそのまま原文での表記の単語とする(ステップ
S31)。
み取ったビットデータが論理“0”の場合、即ち原文と
表記が同一であることが示されている場合には(ステッ
プS29)、原文生成部204は、形態素解析後の状態
の単語をそのまま原文での表記の単語とする(ステップ
S31)。
【0091】このようにして、原文での表記の単語を生
成すると、原文生成部204は、文書の内容表示で検索
キー等のハイライト表示が指定されているか否かをチェ
ックする(ステップS32)。
成すると、原文生成部204は、文書の内容表示で検索
キー等のハイライト表示が指定されているか否かをチェ
ックする(ステップS32)。
【0092】もし、ハイライト表示が指定されている場
合には、原文生成部204は、ハイライト情報付加部2
05に制御を渡して、検索キー、更にはその同義語及び
異表記語をハイライト表示するためのハイライト情報の
付加処理を行わせ(ステップS33)、しかる後に後述
するステップS34に進む。
合には、原文生成部204は、ハイライト情報付加部2
05に制御を渡して、検索キー、更にはその同義語及び
異表記語をハイライト表示するためのハイライト情報の
付加処理を行わせ(ステップS33)、しかる後に後述
するステップS34に進む。
【0093】一方、ハイライト表示が指定されていない
場合には、原文生成部204は、そのままステップS3
4に進む。ここで、上記ステップS33のハイライト情
報の付加処理の詳細を図7のフローチャートを参照して
説明する。
場合には、原文生成部204は、そのままステップS3
4に進む。ここで、上記ステップS33のハイライト情
報の付加処理の詳細を図7のフローチャートを参照して
説明する。
【0094】まず、ハイライト情報の付加処理の開始時
において、形態素解析後検索キー保存部222には、検
索キー保存部221に保存されている検索キー(単語)
が同義語及び異表記語で置換されたものが既に格納され
ている。
において、形態素解析後検索キー保存部222には、検
索キー保存部221に保存されている検索キー(単語)
が同義語及び異表記語で置換されたものが既に格納され
ている。
【0095】また、図5のフローチャートのステップS
26またはS27の処理により、隣接インデックス等を
もとにして、文書中の形態素解析後の状態の単語が復元
されている。
26またはS27の処理により、隣接インデックス等を
もとにして、文書中の形態素解析後の状態の単語が復元
されている。
【0096】このような状態において、ハイライト情報
付加部205は、検索キー保存部221に保存されてい
る検索キーの全単語と上記(ステップS26またはS2
7の処理で)復元されている形態素解析後の状態の単語
とを比較する(ステップS41)。
付加部205は、検索キー保存部221に保存されてい
る検索キーの全単語と上記(ステップS26またはS2
7の処理で)復元されている形態素解析後の状態の単語
とを比較する(ステップS41)。
【0097】ここで、検索キー保存部221には、(内
容表示の対象となっている)検索された文書に必ず含ま
れている検索キーの単語だけが保存されているため、複
数の検索キーの少なくとも1つが存在する文書を検索す
る場合には、その全ての検索キーの単語を比較対象とす
るのと異なり、ステップS41での比較処理での処理負
担を軽減することができる。
容表示の対象となっている)検索された文書に必ず含ま
れている検索キーの単語だけが保存されているため、複
数の検索キーの少なくとも1つが存在する文書を検索す
る場合には、その全ての検索キーの単語を比較対象とす
るのと異なり、ステップS41での比較処理での処理負
担を軽減することができる。
【0098】さて、ステップS41での比較で同一の単
語が検出されなかった場合、即ち復元された形態素解析
後の状態の単語に一致する単語が検索キー保存部221
に存在しない場合(ステップS42)、ハイライト情報
付加部205は、何も行わない。
語が検出されなかった場合、即ち復元された形態素解析
後の状態の単語に一致する単語が検索キー保存部221
に存在しない場合(ステップS42)、ハイライト情報
付加部205は、何も行わない。
【0099】一方、ステップS41での比較で同一の単
語が検出された場合、即ち復元された形態素解析後の状
態の単語に一致する単語が検索キー保存部221に存在
する場合には(ステップS42)、ハイライト情報付加
部205は、検索キー保存部221に保存されている検
索キーの該当する単語と、先のステップS30またはス
テップS31の処理により得られている原文での表記の
単語とを比較する(ステップS43)。
語が検出された場合、即ち復元された形態素解析後の状
態の単語に一致する単語が検索キー保存部221に存在
する場合には(ステップS42)、ハイライト情報付加
部205は、検索キー保存部221に保存されている検
索キーの該当する単語と、先のステップS30またはス
テップS31の処理により得られている原文での表記の
単語とを比較する(ステップS43)。
【0100】このステップS43での比較の結果、上記
両単語が同一の単語である場合には(ステップS4
4)、ハイライト情報付加部205は、ステップS30
またはステップS31の処理により得られている原文で
の表記の単語のハイライト情報として、“検索キーと同
一”である旨を示す情報を当該単語に付加する(ステッ
プS45)。
両単語が同一の単語である場合には(ステップS4
4)、ハイライト情報付加部205は、ステップS30
またはステップS31の処理により得られている原文で
の表記の単語のハイライト情報として、“検索キーと同
一”である旨を示す情報を当該単語に付加する(ステッ
プS45)。
【0101】これに対し、上記両単語が同一の単語でな
い場合には(ステップS44)、ハイライト情報付加部
205は、ステップS30またはステップS31の処理
により得られている原文での表記の単語のハイライト情
報として、“検索キーの同義語または異表記語”である
旨を示す情報を当該単語に付加する(ステップS4
6)。
い場合には(ステップS44)、ハイライト情報付加部
205は、ステップS30またはステップS31の処理
により得られている原文での表記の単語のハイライト情
報として、“検索キーの同義語または異表記語”である
旨を示す情報を当該単語に付加する(ステップS4
6)。
【0102】以上のステップS45またはステップS4
6が実行されると、或いは上記ステップS42で同一の
単語でないと判断されると、1つの単語に対する図7の
フローチャートに示す一連のハイライト情報付加処理、
即ち図6中のステップS33の処理は終了となり、ハイ
ライト情報が付加された或いは付加されていない原文の
単語が原文生成部204により出力部203に出力され
る(ステップS34)。
6が実行されると、或いは上記ステップS42で同一の
単語でないと判断されると、1つの単語に対する図7の
フローチャートに示す一連のハイライト情報付加処理、
即ち図6中のステップS33の処理は終了となり、ハイ
ライト情報が付加された或いは付加されていない原文の
単語が原文生成部204により出力部203に出力され
る(ステップS34)。
【0103】また、ハイライト表示が指定されていない
場合には(ステップS32)、上記ステップS34にお
いて、ハイライト情報が付加されていない原文の単語が
原文生成部204により出力部203に出力される。
場合には(ステップS32)、上記ステップS34にお
いて、ハイライト情報が付加されていない原文の単語が
原文生成部204により出力部203に出力される。
【0104】原文生成部204は、出力部203への単
語出力を行うと、ユーザにより選択指定された文書にお
ける全ての単語を生成したか否かをチェックし(ステッ
プS35)、未生成の単語が残っているならば、上記し
た一連のステップS21〜S35の処理を繰り返す。
語出力を行うと、ユーザにより選択指定された文書にお
ける全ての単語を生成したか否かをチェックし(ステッ
プS35)、未生成の単語が残っているならば、上記し
た一連のステップS21〜S35の処理を繰り返す。
【0105】これに対し、ユーザ指定の文書における全
ての単語の生成が終了した場合(ステップS35)に
は、原文生成部204は、図5及び図6のフローチャー
トで示される一連の原文生成処理を終了する。
ての単語の生成が終了した場合(ステップS35)に
は、原文生成部204は、図5及び図6のフローチャー
トで示される一連の原文生成処理を終了する。
【0106】さて、出力部203は、原文生成部204
から単語を受け取ると、当該単語にハイライト情報が付
加されていないならば、当該単語を通常の表示形態で表
示装置3に表示し、ハイライト情報が付加されているな
らば、当該単語をそのハイライト情報に固有の表示形態
で表示装置3に表示する(ステップS17)。
から単語を受け取ると、当該単語にハイライト情報が付
加されていないならば、当該単語を通常の表示形態で表
示装置3に表示し、ハイライト情報が付加されているな
らば、当該単語をそのハイライト情報に固有の表示形態
で表示装置3に表示する(ステップS17)。
【0107】例えば、表示装置3がモノクロディスプレ
イの場合であれば、“検索キーと同一”を示すハイライ
ト情報のときは該当する単語(検索キー)が反転表示さ
れ、“検索キーの同義語または異表記語”を示すハイラ
イト情報のときは該当する単語(検索キーの同義語や異
表記語)が高輝度表示される。この表示装置3がモノク
ロディスプレイの場合の検索文書の内容表示の例を図1
7に示す。
イの場合であれば、“検索キーと同一”を示すハイライ
ト情報のときは該当する単語(検索キー)が反転表示さ
れ、“検索キーの同義語または異表記語”を示すハイラ
イト情報のときは該当する単語(検索キーの同義語や異
表記語)が高輝度表示される。この表示装置3がモノク
ロディスプレイの場合の検索文書の内容表示の例を図1
7に示す。
【0108】また、表示装置3がカラーディスプレイの
場合には、該当単語がハイライト情報に応じてそれぞれ
異なる色で表示される。なお、“検索キーと合致しな
い”単語、更にはハイライト表示が指定されていない場
合の単語にも、通常表示のためのハイライト情報を付加
するようにしてもよい。
場合には、該当単語がハイライト情報に応じてそれぞれ
異なる色で表示される。なお、“検索キーと合致しな
い”単語、更にはハイライト表示が指定されていない場
合の単語にも、通常表示のためのハイライト情報を付加
するようにしてもよい。
【0109】さて、キー入力部201は、出力部203
により文書内容の表示出力が実行された場合、或いはス
テップS14で文書内容の表示出力が指定されていない
と判断された場合には、ユーザによる入力装置2の操作
により検索終了が指定されているか否か(検索を続行す
るか)をチェックする(ステップS18)。もし、検索
を続行する場合には、ステップS12に戻り、検索を終
了する場合には、図4のフローチャートに示す文書検索
時の一連の処理を終了する。
により文書内容の表示出力が実行された場合、或いはス
テップS14で文書内容の表示出力が指定されていない
と判断された場合には、ユーザによる入力装置2の操作
により検索終了が指定されているか否か(検索を続行す
るか)をチェックする(ステップS18)。もし、検索
を続行する場合には、ステップS12に戻り、検索を終
了する場合には、図4のフローチャートに示す文書検索
時の一連の処理を終了する。
【0110】なお、本発明は前記実施例に限定されるも
のではなく、その要旨を逸脱しない範囲で種々変形して
実施することが可能である。例えば、前記実施例では、
単語再生インデックスとして、図11(a)の例のよう
に、形態素解析後の状態の単語を構成する分割された文
字列(キーワード列)の先頭文字(先頭キーワード)
と、最終文字(最終キーワード)に対応して、論理
“1”(第1の論理値)のビットデータが付加され、そ
れ以外の文字(キーワード)及び単語(キーワード)に
対応して論理“0”(第2の論理値)のビットデータが
付加されるものとしたが、形態素解析後の状態の単語を
構成する分割された文字列の各文字に対応して、論理
“1”(第1の論理値)のビットデータが付加されるも
のであっても構わない。要は、形態素解析後の状態の単
語への再生が必要なキーワード(文字)であるか否かが
示されるデータ構造の単語再生インデックスであればよ
い。
のではなく、その要旨を逸脱しない範囲で種々変形して
実施することが可能である。例えば、前記実施例では、
単語再生インデックスとして、図11(a)の例のよう
に、形態素解析後の状態の単語を構成する分割された文
字列(キーワード列)の先頭文字(先頭キーワード)
と、最終文字(最終キーワード)に対応して、論理
“1”(第1の論理値)のビットデータが付加され、そ
れ以外の文字(キーワード)及び単語(キーワード)に
対応して論理“0”(第2の論理値)のビットデータが
付加されるものとしたが、形態素解析後の状態の単語を
構成する分割された文字列の各文字に対応して、論理
“1”(第1の論理値)のビットデータが付加されるも
のであっても構わない。要は、形態素解析後の状態の単
語への再生が必要なキーワード(文字)であるか否かが
示されるデータ構造の単語再生インデックスであればよ
い。
【0111】
【発明の効果】以上詳述したように本発明によれば、従
来の検索用インデックスの他に、原文生成用のインデッ
クスを追加することにより、原文書を別途保存すること
なく、原文(検索文書の内容)が表示できる。したがっ
て、文書検索装置全体として必要な記憶装置の容量が小
さくなり、限られた容量の記憶装置に、より多くの文書
(の検索用インデックス)を登録することができる。
来の検索用インデックスの他に、原文生成用のインデッ
クスを追加することにより、原文書を別途保存すること
なく、原文(検索文書の内容)が表示できる。したがっ
て、文書検索装置全体として必要な記憶装置の容量が小
さくなり、限られた容量の記憶装置に、より多くの文書
(の検索用インデックス)を登録することができる。
【0112】また、本発明によれば、検索された文書の
内容表示において、その文書中に含まれる検索キー、更
には当該検索キーの同義語、異表記語をハイライト表示
する(即ち他の文字列から識別可能なように特別の表示
形態で表示する)のに、原文生成時に隣接インデックス
及び原文生成インデックスをもとに生成される形態素解
析後の状態の単語(同義語、異表記語群の代表語に置き
換えられた単語)と検索キーとを比較するだけで、その
ハイライト表示の対象となる単語が検出できるため、検
索キーの同義語及び異表記語と検索された文書中の文字
列との比較を行う必要もなく(即ち検索された文書中の
文字列が検索キーの同義語または異表記語であるかの判
定を行う必要もなく)、検索キー等をハイライト表示し
ながらの検索された文書の内容表示の速度を向上させる
ことができる。
内容表示において、その文書中に含まれる検索キー、更
には当該検索キーの同義語、異表記語をハイライト表示
する(即ち他の文字列から識別可能なように特別の表示
形態で表示する)のに、原文生成時に隣接インデックス
及び原文生成インデックスをもとに生成される形態素解
析後の状態の単語(同義語、異表記語群の代表語に置き
換えられた単語)と検索キーとを比較するだけで、その
ハイライト表示の対象となる単語が検出できるため、検
索キーの同義語及び異表記語と検索された文書中の文字
列との比較を行う必要もなく(即ち検索された文書中の
文字列が検索キーの同義語または異表記語であるかの判
定を行う必要もなく)、検索キー等をハイライト表示し
ながらの検索された文書の内容表示の速度を向上させる
ことができる。
【図1】本発明の一実施例に係る文書検索装置の概略構
成を示すブロック図。
成を示すブロック図。
【図2】図1中の制御装置1の詳細な機能構成を示すブ
ロック図。
ロック図。
【図3】同実施例におけるインデックス作成処理の流れ
を説明するためのフローチャート。
を説明するためのフローチャート。
【図4】同実施例における文書検索、検索文書の原文生
成及び検索キーのハイライト表示処理を含む文書検索時
の一連の処理の流れを説明するためのフローチャート。
成及び検索キーのハイライト表示処理を含む文書検索時
の一連の処理の流れを説明するためのフローチャート。
【図5】同実施例において各種インデックスを用いて原
文書を生成する処理の流れを説明するためのフローチャ
ートの一部を示す図。
文書を生成する処理の流れを説明するためのフローチャ
ートの一部を示す図。
【図6】同実施例において各種インデックスを用いて原
文書を生成する処理の流れを説明するためのフローチャ
ートの残りを示す図。
文書を生成する処理の流れを説明するためのフローチャ
ートの残りを示す図。
【図7】同実施例における原文書の生成処理において、
検索キーのハイライト表示を行うための情報を付加する
処理の流れを説明するためのフローチャート。
検索キーのハイライト表示を行うための情報を付加する
処理の流れを説明するためのフローチャート。
【図8】同実施例における単語インデックスのデータ構
造を示す図。
造を示す図。
【図9】同実施例における隣接インデックスのデータ構
造を示す図。
造を示す図。
【図10】同実施例における隣接インデックスを用いた
原文生成を例を挙げて説明するための図。
原文生成を例を挙げて説明するための図。
【図11】同実施例における原文生成インデックスのフ
ォーマットと格納例を示す図であり、同図(a)は単語
再生インデックスのフォーマットと格納例、同図(b)
は表記再生インデックスのフォーマットと格納例、同図
(c)は原文表記インデックスのフォーマットと格納例
を示す。
ォーマットと格納例を示す図であり、同図(a)は単語
再生インデックスのフォーマットと格納例、同図(b)
は表記再生インデックスのフォーマットと格納例、同図
(c)は原文表記インデックスのフォーマットと格納例
を示す。
【図12】同実施例における検索キー保存部221のフ
ォーマットと格納例を示す図。
ォーマットと格納例を示す図。
【図13】同実施例における形態素解析後検索キー保存
部222のフォーマットと格納例を示す図。
部222のフォーマットと格納例を示す図。
【図14】同実施例における形態素解析後の状態の単語
を生成する際の、単語バッファ部223内の単語再生の
遷移の一例を示す図。
を生成する際の、単語バッファ部223内の単語再生の
遷移の一例を示す図。
【図15】同実施例における検索キー入力画面例を示す
図。
図。
【図16】同実施例における文書検索結果一覧の表示画
面例を示す図。
面例を示す図。
【図17】同実施例における検索された文書の内容表示
画面例を示す図。
画面例を示す図。
1…制御装置、2…入力装置、3…表示装置,4…外部
記憶装置、20…検索/原文生成処理部、21…インデ
ックス作成処理部、22…バッファ部、200…初期化
部、201…キー入力部、202…検索部、203…出
力部、204…原文生成部、205…ハイライト情報付
加部(表示修飾情報付加手段)、210…単語インデッ
クス作成部(キーワード情報登録手段)、211…隣接
インデックス作成部(隣接情報登録手段)、212…単
語再生インデックス作成部(原文生成情報登録手段)、
213…表記再生インデックス作成部(原文生成情報登
録手段)、214…原文表記インデックス作成部(原文
生成情報登録手段)、220…作業バッファ部、221
…検索キー保存部、222…形態素解析後検索キー保存
部、223…単語バッファ部。
記憶装置、20…検索/原文生成処理部、21…インデ
ックス作成処理部、22…バッファ部、200…初期化
部、201…キー入力部、202…検索部、203…出
力部、204…原文生成部、205…ハイライト情報付
加部(表示修飾情報付加手段)、210…単語インデッ
クス作成部(キーワード情報登録手段)、211…隣接
インデックス作成部(隣接情報登録手段)、212…単
語再生インデックス作成部(原文生成情報登録手段)、
213…表記再生インデックス作成部(原文生成情報登
録手段)、214…原文表記インデックス作成部(原文
生成情報登録手段)、220…作業バッファ部、221
…検索キー保存部、222…形態素解析後検索キー保存
部、223…単語バッファ部。
───────────────────────────────────────────────────── フロントページの続き (72)発明者 尾崎 敏宏 東京都青梅市新町1381番地1 東芝コンピ ュ―タエンジニアリング株式会社内 (72)発明者 中本 幸夫 東京都青梅市新町1381番地1 東芝コンピ ュ―タエンジニアリング株式会社内
Claims (11)
- 【請求項1】 検索された文書の内容を生成する文書生
成方法であって、 形態素解析によって区切られた文書中の単語または当該
単語が分割された各文字をキーワードとして、そのキー
ワードの並び方を示す隣接インデックス、及び当該隣接
インデックスで示される並び順の各キーワードまたはキ
ーワード列の原文書での表記に復元するための情報を示
す原文生成インデックスを各種文書毎に予め作成してお
き、 検索された文書の内容を生成する際には、当該文書につ
いての前記隣接インデックスの示す各キーワードを先頭
から順に参照し、そのキーワードまたはキーワード列を
当該文書についての前記原文生成インデックスをもとに
原文書の表記の単語に復元し、 この復元した単語を順に連結していくことにより元の文
書を再生することを特徴とする文書生成方法。 - 【請求項2】 検索された文書の内容を生成する文書生
成方法であって、 形態素解析によって区切られた文書中の単語または当該
単語が分割された各文字をキーワードとして、そのキー
ワードの並び方を示す隣接インデックス、当該隣接イン
デックスに文字単位に分割されて登録されたキーワード
列を形態素解析後の状態の単語に戻すために、当該隣接
インデックスの各キーワード単位毎に、形態素解析後の
状態の単語への再生が必要であるか否かを示す単語再生
インデックス、形態素解析後の状態の単語を原文書での
表記の単語に変換する必要があるか否かを示す表記再生
インデックス、及び形態素解析後の状態の単語を原文書
での表記の単語に変換するための文字列データの集まり
である原文表記インデックスを各種文書毎に予め作成し
ておく第1の段階と、 検索された文書の内容を生成する際には、当該文書につ
いての前記単語再生インデックスを先頭から順に参照
し、形態素解析後の状態の単語への再生を必要とする前
記隣接インデックスの対応するキーワード列については
1つの単語として再生し、それ以外の前記隣接インデッ
クスの対応するキーワードについてはそのまま単語とす
る第2の段階と、 この第2の段階が実行される毎に、当該第2の段階で得
られた単語の表記変換が必要か否かを前記表記再生イン
デックスを参照して判断し、変換が必要であれば、当該
単語を前記原文表記インデックスの示す原文書での表記
の単語に変換し、変換が不要であれば、当該単語をその
まま原文書での表記の単語とする第3の段階とを具備
し、 前記第3の段階で得られた単語を順に連結していくこと
により元の文書を再生することを特徴とする文書生成方
法。 - 【請求項3】 検索された文書の内容を生成し、その生
成した文書の内容を表示出力する際には、当該文書中に
含まれる少なくとも検索キーを他の文字列と異なる特別
の表示形態で表示する文書生成・表示方法であって、 形態素解析によって区切られた文書中の単語または当該
単語が分割された各文字をキーワードとして、そのキー
ワードの並び方を示す隣接インデックス、及び当該隣接
インデックスで示される並び順の各キーワードまたはキ
ーワード列を原文書での表記に復元するための情報を示
す原文生成インデックスを各種文書毎に予め作成してお
き、 検索された文書の内容を生成する際には、当該文書につ
いての前記隣接インデックスの示す各キーワードを先頭
から順に参照し、そのキーワードまたはキーワード列を
当該文書についての前記原文生成インデックスをもとに
原文書の表記の単語に復元すると共に、その単語が前記
特別の表示形態での表示対象語である場合には、その旨
の特別の情報を付加し、 前記復元した単語を順に連結していくことにより元の文
書を再生して表示し、その際に前記特別の情報が付加さ
れている単語については前記特別の表示形態で表示する
ことを特徴とする文書生成・表示方法。 - 【請求項4】 検索された文書の内容を生成し、その生
成した文書の内容を表示出力する際には、当該文書中に
含まれる少なくとも検索キーを他の文字列と異なる特別
の表示形態で表示する文書生成・表示方法であって、 形態素解析によって区切られた文書中の単語または当該
単語が分割された各文字をキーワードとして、そのキー
ワードの並び方を示す隣接インデックス、当該隣接イン
デックスに文字単位に分割されて登録されたキーワード
列を形態素解析後の状態の単語に戻すために、当該隣接
インデックスの各キーワード毎に、形態素解析後の状態
の単語への再生が必要であるか否かを示す単語再生イン
デックス、形態素解析後の状態の単語を原文書での表記
の単語に変換する必要があるか否かを示す表記再生イン
デックス、及び形態素解析後の状態の単語を原文書での
表記の単語に変換するための文字列データの集まりであ
る原文表記インデックスを各種文書毎に予め作成してお
く第1の段階と、 検索された文書の内容を生成する際には、当該文書につ
いての前記単語再生インデックスを先頭から順に参照
し、形態素解析後の状態の単語への再生を必要とする前
記隣接インデックスの対応するキーワード列については
1つの単語として再生し、それ以外の前記隣接インデッ
クスの対応するキーワードについてはそのまま単語とす
る第2の段階と、 この第2の段階が実行される毎に、当該第2の段階で得
られた単語の表記変換が必要か否かを前記表記再生イン
デックスを参照して判断し、変換が必要であれば、当該
単語を前記原文表記インデックスの示す原文書での表記
の単語に変換し、変換が不要であれば、当該単語をその
まま原文書での表記の単語とする第3の段階と、 この第3の段階が実行される毎に、当該第3の段階で得
られた単語が前記特別の表示形態での表示対象語である
か否かを判断し、特別の表示形態での表示対象語であれ
ば、当該単語にその旨の特別の情報を付加する第4の段
階と、 この第4の段階で前記特別の情報が付加された或いは付
加されなかった単語を順に連結していくことにより元の
文書を再生して表示し、その際に前記特別の情報が付加
されている単語については前記特別の表示形態で表示す
る第5の段階とを具備することを特徴とする文書生成・
表示方法。 - 【請求項5】 前記第4の段階では、前記検索された文
書に含まれている全ての前記検索キーと前記第2の段階
で得られた形態素解析後の状態の単語とを比較し、その
単語に一致する検索キーがある場合には、前記第3の段
階で得られた単語が前記特別の表示形態での表示対象語
であるとして、当該単語にその旨の特別の情報を付加す
ることを特徴とする請求項4記載の文書生成・表示方
法。 - 【請求項6】 前記特別の表示形態での表示対象語が、
文書中に含まれる検索キー、当該検索キーの同義語及び
当該検索キーの異表記語であることを特徴とする請求項
3または請求項4に記載の文書生成・表示方法。 - 【請求項7】 前記第4の段階では、前記検索された文
書に含まれている全ての前記検索キーと前記第2の段階
で得られた形態素解析後の状態の単語とを比較し、その
単語に一致する検索キーがあるならば、更にその検索キ
ーと前記第3の段階で得られた単語とを比較し、一致し
ているならば、当該単語に検索キーと同一であることを
示す第1の表示形態での表示を指示する第1の情報を付
加し、一致していないならば、当該単語に検索キーの同
義語または異表記語であることを示す第2の表示形態で
の表示を指示する第2の情報を付加し、 前記第5の段階では、前記第1の情報が付加されている
単語と、前記第2の情報が付加されている単語について
は、当該情報に従い、前記第1または第2の情報のいず
れも付加されていない単語とは異なるそれぞれ固有の表
示形態で表示することを特徴とする請求項4記載の文書
生成・表示方法。 - 【請求項8】 日本語解析を用いて作成された検索用の
インデックスをもとにフルテキスト検索を実行し、検索
キーを含む文書を出力する文書検索装置であって、 検索の対象となり得る全ての文書を形態素解析して単語
切りを行い、単語または当該単語が分割された各文字を
キーワードとして抽出することで、各文書に対するキー
ワードの有無情報を示す、前記検索用インデックスの1
つをなす単語インデックスを作成するキーワード情報登
録手段と、 前記各文書に含まれるキーワードの並び方を示す、前記
検索用インデックスの1つをなす隣接インデックスを文
書毎に作成する隣接情報登録手段と、 前記隣接インデックスで示される並び順の各キーワード
またはキーワード列を原文書での表記に復元するための
情報を示す原文生成インデックスを作成する原文生成情
報登録手段と、 検索キー入力及び処理指示等に用いられる入力装置と、 検索された文書の内容表示等に用いられる表示装置と、 前記入力装置から入力された検索キー、前記キーワード
情報登録手段により作成された単語インデックス及び前
記隣接情報登録手段により作成された隣接インデックス
をもとに文書を検索する文書検索手段と、 この文書検索手段により検索された文書の内容表示のた
めに、当該文書についての前記隣接インデックスの示す
各キーワードを先頭から順に参照し、そのキーワードま
たはキーワード列を当該文書についての前記原文生成イ
ンデックスをもとに原文書の表記の単語に復元すること
で当該文書の原文書を生成する原文生成手段と、 この原文生成手段により生成された原文書等を前記表示
装置に表示出力する出力手段とを具備することを特徴と
する文書検索装置。 - 【請求項9】 前記原文生成情報登録手段は、前記隣接
インデックスに文字単位に分割されて登録されたキーワ
ード列を形態素解析後の状態の単語に戻すために、当該
隣接インデックスの各キーワード単位毎に、形態素解析
後の状態の単語への再生が必要であるか否かを示す、前
記原文生成インデックスの1つをなす単語再生インデッ
クスを文書毎に作成する単語再生インデックス作成手段
と、形態素解析後の状態の単語を原文書での表記の単語
に変換する必要があるか否かを示す、前記原文生成イン
デックスの1つをなす表記再生インデックスを文書毎に
作成する表記再生インデックス作成手段と、形態素解析
後の状態の単語を原文書での表記の単語に変換するため
の文字列データの集まりである、前記原文生成インデッ
クスの1つをなす原文表記インデックスを文書毎に作成
する原文表記インデックス作成手段とを含んでおり、 前記原文生成手段は、前記検索された文書についての前
記単語再生インデックスを先頭から順に参照し、形態素
解析後の状態の単語への再生を必要とする前記隣接イン
デックスの対応するキーワード列については1つの単語
として再生し、それ以外の前記隣接インデックスの対応
するキーワードについてはそのまま単語とし、その単語
の表記変換が必要であることが前記表記再生インデック
スにより示されている場合には、当該単語を前記原文表
記インデックスの示す原文書での表記の単語に変換する
ことで、全て原文書での表記の単語として生成すること
を特徴とする請求項8記載の文書検索装置。 - 【請求項10】 前記検索された文書に含まれている全
ての前記検索キーと前記原文生成手段により生成される
前記形態素解析後の状態の単語とを比較し、その単語に
一致する検索キーがある場合には、その単語に対応する
原文書での表記の単語に他の文字列と異なる特別の表示
形態で表示することを示す特別の情報を付加する表示修
飾情報付加手段を更に具備し、 前記出力手段は、前記原文生成手段により生成された原
文書を表示する際には、前記特別の情報が付加されてい
る単語を他の単語とは異なる表示形態で表示することを
特徴とする請求項9記載の文書検索装置。 - 【請求項11】 前記検索された文書に含まれている全
ての前記検索キーと前記原文生成手段により生成される
前記形態素解析後の状態の単語とを比較し、その単語に
一致する検索キーがあるならば、更にその検索キーとそ
の単語に対応する原文書での表記の単語とを比較し、一
致しているならば、当該単語に検索キーと同一であるこ
とを示す第1の表示形態での表示を指示する第1の情報
を付加し、一致していないならば、当該単語に検索キー
の同義語または異表記語であることを示す第2の表示形
態での表示を指示する第2の情報を付加する表示修飾情
報付加手段を更に具備し、 前記出力手段は、前記原文生成手段により生成された原
文書を表示する際には、前記第1の情報が付加されてい
る単語と、前記第2の情報が付加されている単語につい
ては、当該情報に従い、前記第1または第2の情報のい
ずれも付加されていない単語とは異なるそれぞれ固有の
表示形態で表示することを特徴とする請求項9記載の文
書検索装置。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP7050987A JPH08249346A (ja) | 1995-03-10 | 1995-03-10 | 文書検索装置及び文書生成方法 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP7050987A JPH08249346A (ja) | 1995-03-10 | 1995-03-10 | 文書検索装置及び文書生成方法 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPH08249346A true JPH08249346A (ja) | 1996-09-27 |
Family
ID=12874158
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP7050987A Pending JPH08249346A (ja) | 1995-03-10 | 1995-03-10 | 文書検索装置及び文書生成方法 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JPH08249346A (ja) |
Cited By (4)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US6470334B1 (en) | 1999-01-07 | 2002-10-22 | Fuji Xerox Co., Ltd. | Document retrieval apparatus |
| JP2008234559A (ja) * | 2007-03-23 | 2008-10-02 | Yahoo Japan Corp | ドキュメント絞り込み検索装置、方法及びプログラム |
| JP2008283412A (ja) * | 2007-05-10 | 2008-11-20 | Nippon Hoso Kyokai <Nhk> | コメント収集解析装置およびそのプログラム |
| JP2010170324A (ja) * | 2009-01-22 | 2010-08-05 | Toshiba Corp | 知識共有支援装置とその方法及びプログラム |
-
1995
- 1995-03-10 JP JP7050987A patent/JPH08249346A/ja active Pending
Cited By (4)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US6470334B1 (en) | 1999-01-07 | 2002-10-22 | Fuji Xerox Co., Ltd. | Document retrieval apparatus |
| JP2008234559A (ja) * | 2007-03-23 | 2008-10-02 | Yahoo Japan Corp | ドキュメント絞り込み検索装置、方法及びプログラム |
| JP2008283412A (ja) * | 2007-05-10 | 2008-11-20 | Nippon Hoso Kyokai <Nhk> | コメント収集解析装置およびそのプログラム |
| JP2010170324A (ja) * | 2009-01-22 | 2010-08-05 | Toshiba Corp | 知識共有支援装置とその方法及びプログラム |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| JP3181548B2 (ja) | 情報検索装置及び情報検索方法 | |
| US6442540B2 (en) | Information retrieval apparatus and information retrieval method | |
| US10169354B2 (en) | Indexing and search query processing | |
| EP0525427A2 (en) | Non-text object storage and retrieval | |
| JPH08147320A (ja) | 情報検索方法及びシステム | |
| JP2000148748A (ja) | 仮名漢字変換及び画像検索表示システム | |
| US5899989A (en) | On-demand interface device | |
| JP3689954B2 (ja) | 異種コード文字列転記装置および電子辞書 | |
| JP2957875B2 (ja) | 文書情報検索装置及び文書検索結果表示方法 | |
| JP2004318510A (ja) | 対訳情報作成装置、対訳情報作成用プログラム、対訳情報作成方法、対訳情報検索装置、対訳情報検索用プログラム及び対訳情報検索方法 | |
| JPH0844771A (ja) | 情報検索装置 | |
| JP2009104475A (ja) | 類似文書検索装置、類似文書検索方法およびプログラム | |
| JP4904920B2 (ja) | 雛形文書作成プログラム、雛形文書作成方法および雛形文書作成装置 | |
| JP3778270B2 (ja) | 選択履歴管理情報、選択履歴情報、情報記憶媒体、及びユーザーインターフェース補助システム | |
| JP4416644B2 (ja) | 予測機能付き文字処理装置、方法、記録媒体およびプログラム | |
| JP4300056B2 (ja) | 概念表現生成方法、プログラム、記憶媒体及び概念表現生成装置 | |
| JPH10105561A (ja) | 検索条件生成装置、検索条件生成方法、文書検索装置及び文書検索用媒体 | |
| JPH08137892A (ja) | 文書検索方法及び文書検索装置 | |
| JP3734101B2 (ja) | ハイパーメディア構築支援装置 | |
| JP4034503B2 (ja) | 文書検索システムおよび文書検索方法 | |
| JPH08249341A (ja) | 文書データベースの文書格納・検索装置 | |
| JP4248828B2 (ja) | 文書処理装置、文書処理方法及び記録媒体 | |
| JP3210842B2 (ja) | 情報処理装置 | |
| KR20020003701A (ko) | 디지털 문서의 키워드를 자동으로 추출하는 방법 | |
| JP2563645B2 (ja) | 文書検索装置 |