JP2003307997A - 語学教育システム、音声データ処理装置、音声データ処理方法、音声データ処理プログラム、及び記憶媒体 - Google Patents
語学教育システム、音声データ処理装置、音声データ処理方法、音声データ処理プログラム、及び記憶媒体Info
- Publication number
- JP2003307997A JP2003307997A JP2002112709A JP2002112709A JP2003307997A JP 2003307997 A JP2003307997 A JP 2003307997A JP 2002112709 A JP2002112709 A JP 2002112709A JP 2002112709 A JP2002112709 A JP 2002112709A JP 2003307997 A JP2003307997 A JP 2003307997A
- Authority
- JP
- Japan
- Prior art keywords
- voice data
- audio data
- reproduction
- function
- voice
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
Landscapes
- Electrically Operated Instructional Devices (AREA)
Abstract
(57)【要約】
【課題】 デジタル信号で記録された音声データを自動
的に区分分けすることができる音声データ処理装置など
を提供すること。 【解決手段】 まず、デジタル信号で記録された音声デ
ータの無音部分を検出する。音声データは、無音状態が
所定の条件を満たした場合に、無音部分であると判断さ
れる。次に無音部分の所定の位置に区分分け用の境界位
置を設定する。音声データの区分分けは、各区分の区分
番号及び各区分の開始位置と終了位置を記録したテーマ
ファイルと呼ばれるテキストファイルを生成することに
より行う。生成されたテーマファイルは、元の音声デー
タと関連付けられている。そして音声データを再生する
再生手段は、音声データを再生する際に、当該音声デー
タに関連付けられたテーマファイルに記録されている内
容を解釈して、音声データを区分ごとに再生する。
的に区分分けすることができる音声データ処理装置など
を提供すること。 【解決手段】 まず、デジタル信号で記録された音声デ
ータの無音部分を検出する。音声データは、無音状態が
所定の条件を満たした場合に、無音部分であると判断さ
れる。次に無音部分の所定の位置に区分分け用の境界位
置を設定する。音声データの区分分けは、各区分の区分
番号及び各区分の開始位置と終了位置を記録したテーマ
ファイルと呼ばれるテキストファイルを生成することに
より行う。生成されたテーマファイルは、元の音声デー
タと関連付けられている。そして音声データを再生する
再生手段は、音声データを再生する際に、当該音声デー
タに関連付けられたテーマファイルに記録されている内
容を解釈して、音声データを区分ごとに再生する。
Description
【0001】
【発明の属する技術分野】本発明は、音声データ処理装
置、音声データ処理方法、音声データ処理プログラム、
記憶媒体、及び語学教育システムに関する。詳しくは、
音声データの無音部分を認識することにより音声データ
に区分を設定しようとしたものに係るものである。
置、音声データ処理方法、音声データ処理プログラム、
記憶媒体、及び語学教育システムに関する。詳しくは、
音声データの無音部分を認識することにより音声データ
に区分を設定しようとしたものに係るものである。
【0002】
【従来の技術】従来のLL(Language Lab
oratory)システムは、教師のLL専用機を複数
の学習者用のLL専用機に接続して構築されていた。L
Lシステムが構築された教室はLL教室と呼ばれてい
る。LL専用機はLL教育以外には利用が難しいので、
LL教室はLL教育以外の目的で使用されることはなか
った。
oratory)システムは、教師のLL専用機を複数
の学習者用のLL専用機に接続して構築されていた。L
Lシステムが構築された教室はLL教室と呼ばれてい
る。LL専用機はLL教育以外には利用が難しいので、
LL教室はLL教育以外の目的で使用されることはなか
った。
【0003】LLシステムでは、カセットテープなどの
磁気テープにアナログ信号で録音した教材用の音声デー
タを教師用のLL専用機から学習者用のLL専用機に送
信する。そして学習者は、自分のLL専用機でこの音声
データを磁気テープなどに録音し、これを用いてドリル
学習を行っていた。
磁気テープにアナログ信号で録音した教材用の音声デー
タを教師用のLL専用機から学習者用のLL専用機に送
信する。そして学習者は、自分のLL専用機でこの音声
データを磁気テープなどに録音し、これを用いてドリル
学習を行っていた。
【0004】語学学習では、1つのセンテンスを繰り返
し聞いて繰り返し話すというドリル学習が非常に重要で
ある。学習者はドリル学習の際の自己の音声を磁気テー
プなどに録音することができるようになっており、これ
を再生して自己の発音を矯正することもできる。
し聞いて繰り返し話すというドリル学習が非常に重要で
ある。学習者はドリル学習の際の自己の音声を磁気テー
プなどに録音することができるようになっており、これ
を再生して自己の発音を矯正することもできる。
【0005】そのため、LL専用機は、LL教材の音声
データ中のセンテンスを検出してセンテンスごとに再生
する機能を備えている。ここで、センテンスとは、例え
ば「Hi,my name is John.」などと
いった、練習用のひとまとまりの例文である。
データ中のセンテンスを検出してセンテンスごとに再生
する機能を備えている。ここで、センテンスとは、例え
ば「Hi,my name is John.」などと
いった、練習用のひとまとまりの例文である。
【0006】センテンスごとの再生の仕方、即ち再生モ
ードには、例えばセンテンス再生モードやリピート再生
モードなどがある。センテンス再生モードは、センテン
スを再生した後一旦停止し、ユーザからの再生指示を待
って次のセンテンスの再生を行うものである。
ードには、例えばセンテンス再生モードやリピート再生
モードなどがある。センテンス再生モードは、センテン
スを再生した後一旦停止し、ユーザからの再生指示を待
って次のセンテンスの再生を行うものである。
【0007】リピート再生モードは、同一のセンテンス
を繰り返し何度も再生するモードである。これにより、
学習者はLL教材音声を聞き発音練習するといったドリ
ル学習を何度も繰り返すことができる。
を繰り返し何度も再生するモードである。これにより、
学習者はLL教材音声を聞き発音練習するといったドリ
ル学習を何度も繰り返すことができる。
【0008】LL教材の音声データのセンテンスの検出
は、例えば、教材でセンテンスとセンテンスの間に無音
部分を設け、この無音部分を磁気ヘッドにて検出するこ
とにより行ったり、あるいは人間の耳には聞こえない周
波数の高い信号を教材に埋め込んでおいてこれを検出す
るなどして行っていた。
は、例えば、教材でセンテンスとセンテンスの間に無音
部分を設け、この無音部分を磁気ヘッドにて検出するこ
とにより行ったり、あるいは人間の耳には聞こえない周
波数の高い信号を教材に埋め込んでおいてこれを検出す
るなどして行っていた。
【0009】ところで、最近のIT技術の進展に伴い、
LL教材用の音声データを光ディスクや光磁気ディスク
あるいはICメモリなどにデジタル信号で録音すること
が行われるようになってきている。これらデジタル信号
で録音された音声データはパーソナルコンピュータ(以
下PC)で容易に再生可能である。
LL教材用の音声データを光ディスクや光磁気ディスク
あるいはICメモリなどにデジタル信号で録音すること
が行われるようになってきている。これらデジタル信号
で録音された音声データはパーソナルコンピュータ(以
下PC)で容易に再生可能である。
【0010】一方、近年急激に進展しているIT技術に
対応するため、コンピュータリテラシー(コンピュータ
を使いこなす技能)を学校教育に取り入れる動きも盛ん
になってきた。これは、複数台のPCを設置したコンピ
ュータ教室を学校に設け、学習者がコンピュータ実習を
行うものである。
対応するため、コンピュータリテラシー(コンピュータ
を使いこなす技能)を学校教育に取り入れる動きも盛ん
になってきた。これは、複数台のPCを設置したコンピ
ュータ教室を学校に設け、学習者がコンピュータ実習を
行うものである。
【0011】これらの動きに伴って、コンピュータ教室
とLL教室を兼ね備えたシステムの要望が近年急激に高
まってきている。即ち、コンピュータ実習用のPCを用
いて語学教育も行えるようにするものである。このシス
テムを用いれば、LL教室とコンピュータ教室を別個に
設ける必要がなく、費用、スペースの省略を図ることが
できる。
とLL教室を兼ね備えたシステムの要望が近年急激に高
まってきている。即ち、コンピュータ実習用のPCを用
いて語学教育も行えるようにするものである。このシス
テムを用いれば、LL教室とコンピュータ教室を別個に
設ける必要がなく、費用、スペースの省略を図ることが
できる。
【0012】
【発明が解決しようとする課題】ところが、PC上でL
L教材用の音声データを利用する場合、デジタル信号に
て音声データを用意する必要がある。しかし、これらデ
ジタル信号化されたLL教材は、一般にセンテンスごと
に区切られていないため、ドリル学習に必要となるセン
テンス検出、センテンスリピートなど、センテンスごと
の再生ができなかった。
L教材用の音声データを利用する場合、デジタル信号に
て音声データを用意する必要がある。しかし、これらデ
ジタル信号化されたLL教材は、一般にセンテンスごと
に区切られていないため、ドリル学習に必要となるセン
テンス検出、センテンスリピートなど、センテンスごと
の再生ができなかった。
【0013】そのため、これらPCやデジタル信号化さ
れたLL教材を組み合せたLLシステムは、従来のLL
専用機とカセットテープの組み合せで構成されていたL
Lシステム代替品としてはユーザの要求を満たしていな
かった。
れたLL教材を組み合せたLLシステムは、従来のLL
専用機とカセットテープの組み合せで構成されていたL
Lシステム代替品としてはユーザの要求を満たしていな
かった。
【0014】また、膨大な量のアナログ信号による過去
のLL教材用の音声データの蓄積があるが、これをPC
を用いたLL教育に利用する場合、センテンスごとの再
生を行うためには、これら音声データを一旦デジタル信
号に変換した後、手動編集でセンテンスに分けるしかな
かった。
のLL教材用の音声データの蓄積があるが、これをPC
を用いたLL教育に利用する場合、センテンスごとの再
生を行うためには、これら音声データを一旦デジタル信
号に変換した後、手動編集でセンテンスに分けるしかな
かった。
【0015】そこで、本発明の目的は、デジタル信号で
記録された音声データを自動的に区分分けすることがで
きる音声データ処理装置などを提供することである。
記録された音声データを自動的に区分分けすることがで
きる音声データ処理装置などを提供することである。
【0016】
【課題を解決するための手段】本発明は、前記目的を達
成するために、音声データを取得し、当該音声データの
中の無音部分を検出する。そして、検出した無音部分を
用いて当該音声データに区分を設定する。音声データ中
の無音部分の判断は次に3つの条件が満たされた場合に
無音部分と判断することができる。(1)音量の大きさ
が所定の閾値より小さい、(2)音量の大きさが前記閾
値より小さい状態が持続する時間が所定の閾値より大き
い、(3)音量の大きさが前記閾値より大きい状態が出
現してもその持続時間が所定の閾値より短い。区分の境
界の位置は、検出した無音部分の所定の位置に設定する
ことができる。このように、無音部分に区分の境界位置
を設定することにより、音声データをこれら境界位置で
区分することがきる。これら区分の境界位置を表す情報
は、当該音声データにおけるこれら境界位置のを記録し
た区分情報として当該音声データとは別個に生成するこ
とができる。音声データの再生手段は、当該音声データ
に関する区分情報をから当該音声データに設定された区
分の境界位置を認識し、当該音声データを区分に関して
選別的に再生することができる。例えば、選択された区
分を開始位置から終了位置まで再生し、再生位置が終了
位置に達した場合に、再生位置を当該終了位置で保持し
たまま一時停止状態とするか、又は再生位置を次の区分
の開始位置に移動し、再生位置をここに保持したまま再
生を一時停止することができる。また、選択された区分
を開始位置から終了位置まで再生し、再生位置が終了位
置に達した場合に、再生位置を当該区分の開始位置に移
動して再生を一時停止状態とすることもできる。更に音
声を取得し、これを音声データに変換して保持する録音
手段を更に備えることもできる。前記再生手段での音声
データの再生と前記録音手段の作動を同時に開始するこ
とにより、前記再生手段で再生する音声データ(第1の
音声データ)と前記録音手段で生成する音声データ(第
2の音声データ)の開始位置を揃えることができる。即
ち、前記第2の音声データを前記第1の音声データに同
期させて録音することができる。また、前記第1の音声
データと前記第2の音声データを開始位置から同時に再
生することにより、前記第1の音声データと前記第2の
音声データを同期させて再生することができる。また、
前記第1の音声データと前記第2の音声データの開始位
置が揃っているため、前記第1の音声データの任意の位
置を前記第2の音声データの特定の位置に対応付けるこ
とができる。即ち、前記第1の音声データの開始位置と
前記第2の音声データの開始位置をそれぞれ基準位置と
して、前記第1の音声データの任意の位置を前記第2の
音声データの任意の位置に対応させることができる。そ
のため、前記第1の音声データを途中から再生する場合
も、前記第1の音声データの再生に同期して前記第2の
音声データを再生することができる。更に、前記第1の
音声データの音声波形図と前記第2の音声波形図をそれ
ぞれ生成する手段と、生成したこれら音声波形図を比較
可能に表示する手段を具備することもできる。ホストコ
ンピュータに端末をネットワーク接続した場合、ホスト
コンピュータで音声データと区分情報を用意し、これを
前記ネットワークを介して前記端末に送信することがで
きる。この場合、端末では、区分情報からを用いて当該
音声データを区分単位で再生することができる。また、
端末に録音手段を備えて、音声を録音することもでき
る。録音手段で生成した録音音声データの無音部分を用
いて、当該録音音声データを区分分けする区分情報を生
成することができる。そして、生成した区分情報と、録
音音声データを端末からホストコンピュータに送信する
こともできる。
成するために、音声データを取得し、当該音声データの
中の無音部分を検出する。そして、検出した無音部分を
用いて当該音声データに区分を設定する。音声データ中
の無音部分の判断は次に3つの条件が満たされた場合に
無音部分と判断することができる。(1)音量の大きさ
が所定の閾値より小さい、(2)音量の大きさが前記閾
値より小さい状態が持続する時間が所定の閾値より大き
い、(3)音量の大きさが前記閾値より大きい状態が出
現してもその持続時間が所定の閾値より短い。区分の境
界の位置は、検出した無音部分の所定の位置に設定する
ことができる。このように、無音部分に区分の境界位置
を設定することにより、音声データをこれら境界位置で
区分することがきる。これら区分の境界位置を表す情報
は、当該音声データにおけるこれら境界位置のを記録し
た区分情報として当該音声データとは別個に生成するこ
とができる。音声データの再生手段は、当該音声データ
に関する区分情報をから当該音声データに設定された区
分の境界位置を認識し、当該音声データを区分に関して
選別的に再生することができる。例えば、選択された区
分を開始位置から終了位置まで再生し、再生位置が終了
位置に達した場合に、再生位置を当該終了位置で保持し
たまま一時停止状態とするか、又は再生位置を次の区分
の開始位置に移動し、再生位置をここに保持したまま再
生を一時停止することができる。また、選択された区分
を開始位置から終了位置まで再生し、再生位置が終了位
置に達した場合に、再生位置を当該区分の開始位置に移
動して再生を一時停止状態とすることもできる。更に音
声を取得し、これを音声データに変換して保持する録音
手段を更に備えることもできる。前記再生手段での音声
データの再生と前記録音手段の作動を同時に開始するこ
とにより、前記再生手段で再生する音声データ(第1の
音声データ)と前記録音手段で生成する音声データ(第
2の音声データ)の開始位置を揃えることができる。即
ち、前記第2の音声データを前記第1の音声データに同
期させて録音することができる。また、前記第1の音声
データと前記第2の音声データを開始位置から同時に再
生することにより、前記第1の音声データと前記第2の
音声データを同期させて再生することができる。また、
前記第1の音声データと前記第2の音声データの開始位
置が揃っているため、前記第1の音声データの任意の位
置を前記第2の音声データの特定の位置に対応付けるこ
とができる。即ち、前記第1の音声データの開始位置と
前記第2の音声データの開始位置をそれぞれ基準位置と
して、前記第1の音声データの任意の位置を前記第2の
音声データの任意の位置に対応させることができる。そ
のため、前記第1の音声データを途中から再生する場合
も、前記第1の音声データの再生に同期して前記第2の
音声データを再生することができる。更に、前記第1の
音声データの音声波形図と前記第2の音声波形図をそれ
ぞれ生成する手段と、生成したこれら音声波形図を比較
可能に表示する手段を具備することもできる。ホストコ
ンピュータに端末をネットワーク接続した場合、ホスト
コンピュータで音声データと区分情報を用意し、これを
前記ネットワークを介して前記端末に送信することがで
きる。この場合、端末では、区分情報からを用いて当該
音声データを区分単位で再生することができる。また、
端末に録音手段を備えて、音声を録音することもでき
る。録音手段で生成した録音音声データの無音部分を用
いて、当該録音音声データを区分分けする区分情報を生
成することができる。そして、生成した区分情報と、録
音音声データを端末からホストコンピュータに送信する
こともできる。
【0017】
【発明の実施の形態】以下、本発明の好適な実施の形態
について詳細に説明する。 (1)実施形態の概要 本実施の形態は、従来LL専用機を使用して行われてい
た語学学習授業のうち、学習者用のドリル学習機能など
をPC上で実現したものである。センテンスリピートな
どの機能による「繰り返し聞いて話す」というドリル学
習に必要な処理をPC上で実現可能とすることができ
る。
について詳細に説明する。 (1)実施形態の概要 本実施の形態は、従来LL専用機を使用して行われてい
た語学学習授業のうち、学習者用のドリル学習機能など
をPC上で実現したものである。センテンスリピートな
どの機能による「繰り返し聞いて話す」というドリル学
習に必要な処理をPC上で実現可能とすることができ
る。
【0018】本実施の形態では、音声データの無音部分
を検出し、検出した無音部分に境界を設けることによ
り、音声データを複数の部分に区分する。この区分への
分割は、音声データを分割したり、あるいは音声データ
中に境界位置を書き込むなどして直接音声データを区分
するのではなく、各区分の区分番号及び各区分の開始位
置と終了位置を記録したテーマファイルと呼ばれるテキ
ストファイルを生成することにより行う。
を検出し、検出した無音部分に境界を設けることによ
り、音声データを複数の部分に区分する。この区分への
分割は、音声データを分割したり、あるいは音声データ
中に境界位置を書き込むなどして直接音声データを区分
するのではなく、各区分の区分番号及び各区分の開始位
置と終了位置を記録したテーマファイルと呼ばれるテキ
ストファイルを生成することにより行う。
【0019】生成されたテーマファイルは、元の音声デ
ータとファイル名を同じに設定し、拡張子をテーマファ
イル特有のもの、例えば「thm」などとすることによ
り元の音声データと関連付けられる。
ータとファイル名を同じに設定し、拡張子をテーマファ
イル特有のもの、例えば「thm」などとすることによ
り元の音声データと関連付けられる。
【0020】音声データを再生する再生手段は、音声デ
ータを再生する際に、当該音声データと同じファイル名
で拡張子が「thm」であるテーマファイルを検索す
る。そして、テーマファイルから各区分の区分番号、開
始位置、終了位置を読み出し、これに従って、当該音声
データを区分ごとに再生する。
ータを再生する際に、当該音声データと同じファイル名
で拡張子が「thm」であるテーマファイルを検索す
る。そして、テーマファイルから各区分の区分番号、開
始位置、終了位置を読み出し、これに従って、当該音声
データを区分ごとに再生する。
【0021】(2)実施形態の詳細
図1は、本実施の形態に係る音声データ処理システム5
の構成を示した図である。本実施の形態では、一例とし
て音声データ処理システム5がLL教材を処理して再生
する場合について説明する。ユーザの音声を録音する場
合については後の実施例で説明する。
の構成を示した図である。本実施の形態では、一例とし
て音声データ処理システム5がLL教材を処理して再生
する場合について説明する。ユーザの音声を録音する場
合については後の実施例で説明する。
【0022】ここで、LL教材とは、LL教室で語学教
育のために用いられる音声素材である。LL教材には、
LL教室専用に録音された語学教材の他に、教師が語学
教育用に録音した外国語によるテレビ・ラジオニュー
ス、映画、ドラマ、天気予報などもある。
育のために用いられる音声素材である。LL教材には、
LL教室専用に録音された語学教材の他に、教師が語学
教育用に録音した外国語によるテレビ・ラジオニュー
ス、映画、ドラマ、天気予報などもある。
【0023】音声データ処理システム5は、アナログ音
声データ入力部6、デジタル音声データ生成部7、デジ
タル音声データ入力部8、音声データ格納部10、識別
条件入力部11、区分設定部12、境界位置設定部1
5、再生部16、再生モード入力部17、出力部18な
どから構成されている。
声データ入力部6、デジタル音声データ生成部7、デジ
タル音声データ入力部8、音声データ格納部10、識別
条件入力部11、区分設定部12、境界位置設定部1
5、再生部16、再生モード入力部17、出力部18な
どから構成されている。
【0024】これらの構成要素は、例えば音声データ処
理システム5をPCで構成する場合、CPU(Cent
ral Processing Unit)が音声デー
タ処理プログラムを実行することにより、ソフトウェア
的に構成されるものである。なお、音声データ処理シス
テム5は、それぞれの構成要素の機能を備えたデバイス
を用いてハードウェア的に構成することもできる。
理システム5をPCで構成する場合、CPU(Cent
ral Processing Unit)が音声デー
タ処理プログラムを実行することにより、ソフトウェア
的に構成されるものである。なお、音声データ処理シス
テム5は、それぞれの構成要素の機能を備えたデバイス
を用いてハードウェア的に構成することもできる。
【0025】また、PCの他に、例えばゲーム機などの
プログラム実行機能を持つ装置で音声データ処理プログ
ラムを実行することによって、音声データ処理システム
5を実現することもできる。
プログラム実行機能を持つ装置で音声データ処理プログ
ラムを実行することによって、音声データ処理システム
5を実現することもできる。
【0026】アナログ音声データ入力部6は、例えば、
カセットテープレコーダやレコードプレーヤなどのアナ
ログ音声データ読み取り装置によって構成されている。
これによってアナログ音声データ入力部6からカセット
テープやレコードなどのアナログメディアに録音された
従来のLL教材の音声データ(以下教材音声データ)を
入力することができる。
カセットテープレコーダやレコードプレーヤなどのアナ
ログ音声データ読み取り装置によって構成されている。
これによってアナログ音声データ入力部6からカセット
テープやレコードなどのアナログメディアに録音された
従来のLL教材の音声データ(以下教材音声データ)を
入力することができる。
【0027】デジタル音声データ生成部7は、アナログ
音声データ入力部6からのアナログ信号による教材音声
データを受け取り、所定のサンプリング周波数にてサン
プリングしてデジタル信号に変換する。そして、生成し
たデジタル音声データを音声データ格納部10に出力す
る。
音声データ入力部6からのアナログ信号による教材音声
データを受け取り、所定のサンプリング周波数にてサン
プリングしてデジタル信号に変換する。そして、生成し
たデジタル音声データを音声データ格納部10に出力す
る。
【0028】デジタル信号に変換する際のサンプリング
周波数やビットレートは、ユーザが設定することができ
るようになっている。デフォルト値は、サンプリング周
波数が44.1[kHz]であり、音声を量子化するた
めのビットレートは16[ビット]である。
周波数やビットレートは、ユーザが設定することができ
るようになっている。デフォルト値は、サンプリング周
波数が44.1[kHz]であり、音声を量子化するた
めのビットレートは16[ビット]である。
【0029】デジタル音声データ入力部8は、デジタル
信号で生成された教材音声データを読み取って、これを
音声データ格納部10に所定のデータ形式で出力する。
信号で生成された教材音声データを読み取って、これを
音声データ格納部10に所定のデータ形式で出力する。
【0030】例えば、教材音声データがオーディオCD
(Compact Disc)で提供されている場合
は、デジタル音声データ入力部8は、教材音声データを
読み取る読み取り装置(CDプレーヤ)と、オーディオ
CDから教材音声データをリッピング(抽出)するリッ
パーを備えている。リッパーはオーディオCDから抽出
した音声データをWAVE形式のデータに変換するツー
ルである。
(Compact Disc)で提供されている場合
は、デジタル音声データ入力部8は、教材音声データを
読み取る読み取り装置(CDプレーヤ)と、オーディオ
CDから教材音声データをリッピング(抽出)するリッ
パーを備えている。リッパーはオーディオCDから抽出
した音声データをWAVE形式のデータに変換するツー
ルである。
【0031】音声データ格納部10は、デジタル音声デ
ータ生成部7やデジタル音声データ入力部8から受け取
ったデジタル音声データを所定のファイル形式にて記憶
装置に格納する音声データ格納手段と、記憶装置に格納
されいる教材音声データを読み出して区分設定部12や
再生部16に送る音声データ読み出し手段を構成してい
る。音声データ格納部10は、音声データ取得手段を構
成している。
ータ生成部7やデジタル音声データ入力部8から受け取
ったデジタル音声データを所定のファイル形式にて記憶
装置に格納する音声データ格納手段と、記憶装置に格納
されいる教材音声データを読み出して区分設定部12や
再生部16に送る音声データ読み出し手段を構成してい
る。音声データ格納部10は、音声データ取得手段を構
成している。
【0032】音声ファイルの形式には、例えばWAVE
形式やMP3形式など様々な形式があり、ユーザがこれ
らの形式から選択できるようになっている。本実施の形
態では、最も一般的な形式であるWAVE形式が選択さ
れているものとする。
形式やMP3形式など様々な形式があり、ユーザがこれ
らの形式から選択できるようになっている。本実施の形
態では、最も一般的な形式であるWAVE形式が選択さ
れているものとする。
【0033】音声データ格納部10が音声ファイルを読
み書きする記憶装置としては、例えば半導体メモリやハ
ードディスク、光磁気ディスク、磁気ディスクなどの読
み書き可能な記憶媒体がある。
み書きする記憶装置としては、例えば半導体メモリやハ
ードディスク、光磁気ディスク、磁気ディスクなどの読
み書き可能な記憶媒体がある。
【0034】識別条件入力部11は、有音部分と無音部
分が連続して記録されているデジタル音声データから、
無音部分を識別する条件を入力する機能部である。本実
施の形態では、以下の3つの条件を設定し、これら3つ
の条件を共に満たす部分を無音部分と判断することとし
た。なお、これらの2つを組み合せたり、あるいは単独
で用いて無音部分を識別しても良い。
分が連続して記録されているデジタル音声データから、
無音部分を識別する条件を入力する機能部である。本実
施の形態では、以下の3つの条件を設定し、これら3つ
の条件を共に満たす部分を無音部分と判断することとし
た。なお、これらの2つを組み合せたり、あるいは単独
で用いて無音部分を識別しても良い。
【0035】(識別条件1)予め設定した音量(ボリュ
ーム)以下の音の部分を無音部分として識別する。音量
の設定は、最大ボリュームに対する百分率で行うことが
できるようになっている。この音量の閾値のデフォルト
値は10[%]である。この値は、0[%]から99
[%]の間でユーザが任意に設定することができる。
ーム)以下の音の部分を無音部分として識別する。音量
の設定は、最大ボリュームに対する百分率で行うことが
できるようになっている。この音量の閾値のデフォルト
値は10[%]である。この値は、0[%]から99
[%]の間でユーザが任意に設定することができる。
【0036】古いカセットテープなど、無音部分のノイ
ズが大きい場合は、音量を高めに設定し、オーディオC
Dなど、無音部分のノイズが小さい場合は、音量を低め
に設定することにより、適切に無音部分を判断すること
ができる。
ズが大きい場合は、音量を高めに設定し、オーディオC
Dなど、無音部分のノイズが小さい場合は、音量を低め
に設定することにより、適切に無音部分を判断すること
ができる。
【0037】(識別条件2)音量が識別条件1で定めた
閾値より小さい無音状態が予め設定されている所定の最
短時間以上継続する場合、この部分を無音部分として識
別する。これにより、発話途中の息継ぎ部分などで短時
間の無音状態が生じる部分で教材音声データが区切られ
るのを防ぐことができる。
閾値より小さい無音状態が予め設定されている所定の最
短時間以上継続する場合、この部分を無音部分として識
別する。これにより、発話途中の息継ぎ部分などで短時
間の無音状態が生じる部分で教材音声データが区切られ
るのを防ぐことができる。
【0038】この最短時間の閾値として、デフォルト値
は、0.7[秒]に設定されている。この値は、0.1
[秒]から99.9[秒]の間で、0.1[秒]単位で
ユーザが任意に設定することができる。
は、0.7[秒]に設定されている。この値は、0.1
[秒]から99.9[秒]の間で、0.1[秒]単位で
ユーザが任意に設定することができる。
【0039】(識別条件3)音量が識別条件1で定めた
閾値より大きい有音状態の継続時間が予め設定した最短
時間より短い場合は、無音部分として識別する。これに
より、アナログ信号で記録された教材音声データにあり
がちな単発的なノイズなどを無音部分と判断することが
できる。この最短時間の閾値のデフォルト値は0.4
[秒]である。この値は、0.1[秒]から99.9
[秒]間でユーザが任意に設定できるようになってい
る。
閾値より大きい有音状態の継続時間が予め設定した最短
時間より短い場合は、無音部分として識別する。これに
より、アナログ信号で記録された教材音声データにあり
がちな単発的なノイズなどを無音部分と判断することが
できる。この最短時間の閾値のデフォルト値は0.4
[秒]である。この値は、0.1[秒]から99.9
[秒]間でユーザが任意に設定できるようになってい
る。
【0040】以上の識別条件1、2、3で設定された各
閾値は設定情報として所定の条件設定用のテキストファ
イルに保存される(特定のOS(Operating
System)では、INIファイルと呼ばれることも
ある)。そして、音声データ処理システム5の起動時
に、このテキストファイルが読み込まれ、各閾値が設定
される。なお、このテキストファイルには、識別条件
1、2、3用のパラメータの他に、各種の設定情報が記
録されている。
閾値は設定情報として所定の条件設定用のテキストファ
イルに保存される(特定のOS(Operating
System)では、INIファイルと呼ばれることも
ある)。そして、音声データ処理システム5の起動時
に、このテキストファイルが読み込まれ、各閾値が設定
される。なお、このテキストファイルには、識別条件
1、2、3用のパラメータの他に、各種の設定情報が記
録されている。
【0041】境界位置設定部15は、教材音声データを
無音部分のどこで区切るか、その境界位置を設定する機
能部である。
無音部分のどこで区切るか、その境界位置を設定する機
能部である。
【0042】図2(a)は、教材音声データの波形図の
一例を示した図である。この図では、右方向は時間を、
上下方向は音声の強度を表している。音声は、振動する
ため、時間軸を中心に上下に振動するが、この図では、
煩雑を避けるため、振動の包絡線を示してある。
一例を示した図である。この図では、右方向は時間を、
上下方向は音声の強度を表している。音声は、振動する
ため、時間軸を中心に上下に振動するが、この図では、
煩雑を避けるため、振動の包絡線を示してある。
【0043】この教材音声データは、LL教材専用に録
音されたものを例としたものであって、有音部分21、
21、21、・・・、(以下有音部分21)と、有音部
分21を区切る無音部分22、22、22、・・・、
(以下無音部分22)が交互に繰り返される。有音部分
21は、外国語による例文が発音されるモデルボイスの
部分である。
音されたものを例としたものであって、有音部分21、
21、21、・・・、(以下有音部分21)と、有音部
分21を区切る無音部分22、22、22、・・・、
(以下無音部分22)が交互に繰り返される。有音部分
21は、外国語による例文が発音されるモデルボイスの
部分である。
【0044】本実施の形態では、境界位置の設定位置と
して、次の3つのうち、何れかをユーザが選択できるよ
うにした。
して、次の3つのうち、何れかをユーザが選択できるよ
うにした。
【0045】図2(b)は、無音部分の開始位置、即ち
センテンスの終了位置の直後に境界位置25、25、2
5、・・・、を設定するものである。このように、無音
部分の開始位置に境界位置25、25、25、・・・、
を設定すると、有音部分を頭出し再生した場合に、無音
部分から再生されるため、センテンスが開始するまでの
間、ユーザはモデルボイスに集中し、心的な準備を行う
ことができる。
センテンスの終了位置の直後に境界位置25、25、2
5、・・・、を設定するものである。このように、無音
部分の開始位置に境界位置25、25、25、・・・、
を設定すると、有音部分を頭出し再生した場合に、無音
部分から再生されるため、センテンスが開始するまでの
間、ユーザはモデルボイスに集中し、心的な準備を行う
ことができる。
【0046】図2(c)は、無音部分の終了位置、即
ち、有音部分の開始位置に境界位置26、26、26、
・・・、を設定するものである。より詳細には、図2
(d)に示したように、無音部分の終了位置より500
[ミリ秒]手前、即ち有音部分の開始位置より500
[ミリ秒]手前に、境界位置26、26、26、・・
・、を設定する。
ち、有音部分の開始位置に境界位置26、26、26、
・・・、を設定するものである。より詳細には、図2
(d)に示したように、無音部分の終了位置より500
[ミリ秒]手前、即ち有音部分の開始位置より500
[ミリ秒]手前に、境界位置26、26、26、・・
・、を設定する。
【0047】境界位置26、26、26、・・・、を無
音部分の終了位置、即ち、有音部分の開始位置の直前に
設定すると、例えば中国語の「シュ」の音のように、モ
デルボイス開始前からわずかに始まっている音が区切ら
れてしまうことがある。
音部分の終了位置、即ち、有音部分の開始位置の直前に
設定すると、例えば中国語の「シュ」の音のように、モ
デルボイス開始前からわずかに始まっている音が区切ら
れてしまうことがある。
【0048】一方、境界位置をセンテンスの開始前35
0[ミリ秒]に設定すれば、ほとんど全ての外国語にお
いて、モデルボイス開始直前のわずかな音声が区切られ
るのを防げることが実験によって分かっている。そのた
め、本実施の形態では、350[ミリ秒]より更に余裕
を見て500[ミリ秒]の位置で有音部分を区切ること
とした。
0[ミリ秒]に設定すれば、ほとんど全ての外国語にお
いて、モデルボイス開始直前のわずかな音声が区切られ
るのを防げることが実験によって分かっている。そのた
め、本実施の形態では、350[ミリ秒]より更に余裕
を見て500[ミリ秒]の位置で有音部分を区切ること
とした。
【0049】このように、有音部分の開始位置に境界位
置26、26、26、・・・、を設定すると、区切られ
た有音部分を頭出しした場合に、即座に有音部分を再生
することができる。
置26、26、26、・・・、を設定すると、区切られ
た有音部分を頭出しした場合に、即座に有音部分を再生
することができる。
【0050】図2(e)は、無音部分の開始位置に境界
位置28、28、28、・・・、を設定し、更に無音部
分の終了位置に境界位置27、27、27、・・・、を
設定したものである。即ち、有音部分の両端に境界位置
を設定したものである。より詳細には、境界位置27は
有音部分の開始位置よりも500[ミリ秒]手前に設定
してある。
位置28、28、28、・・・、を設定し、更に無音部
分の終了位置に境界位置27、27、27、・・・、を
設定したものである。即ち、有音部分の両端に境界位置
を設定したものである。より詳細には、境界位置27は
有音部分の開始位置よりも500[ミリ秒]手前に設定
してある。
【0051】このように、区分の境界位置を有音部分の
両端に設定することにより、例えば無音部分をスキップ
して有音部分のみを再生したり、有音部分を頭出し再生
する場合は、境界位置27、27、27、・・・、を用
いるなど、より決めの細かい再生が可能となる。
両端に設定することにより、例えば無音部分をスキップ
して有音部分のみを再生したり、有音部分を頭出し再生
する場合は、境界位置27、27、27、・・・、を用
いるなど、より決めの細かい再生が可能となる。
【0052】境界位置設定部15では、以上の境界位置
のうち、何れを採用するかを選択できるようになってい
る。選択した内容は、先の条件設定用のテキストファイ
ルに記録され、次回に音声データ処理システム5を起動
した際に、前回の設定値が呼び出されるようになってい
る。
のうち、何れを採用するかを選択できるようになってい
る。選択した内容は、先の条件設定用のテキストファイ
ルに記録され、次回に音声データ処理システム5を起動
した際に、前回の設定値が呼び出されるようになってい
る。
【0053】以上境界位置の3つのパターンについて説
明したが、境界位置の設定はこれに限定するものではな
く、例えば無音部分の中間に設定するなど、他の位置を
用いても良い。
明したが、境界位置の設定はこれに限定するものではな
く、例えば無音部分の中間に設定するなど、他の位置を
用いても良い。
【0054】図1に戻り、区分設定部12は、音声デー
タ格納部10から教材音声データを読み込み、所定の手
順でセンテンス分けをする機能部である。なお、以下で
は、無音部分に境界を設けることにより、音声データを
区分することをセンテンス分けと呼ぶことにする。
タ格納部10から教材音声データを読み込み、所定の手
順でセンテンス分けをする機能部である。なお、以下で
は、無音部分に境界を設けることにより、音声データを
区分することをセンテンス分けと呼ぶことにする。
【0055】また、無音部分を検出し、これによって隣
り合う無音部分の間にある有音部分を検出することをセ
ンテンスの検出と呼ぶことにする。更に、無音部分に設
けた境界によって生成された区分をセンテンスと呼ぶこ
とにする。
り合う無音部分の間にある有音部分を検出することをセ
ンテンスの検出と呼ぶことにする。更に、無音部分に設
けた境界によって生成された区分をセンテンスと呼ぶこ
とにする。
【0056】音声データ格納部10が教材音声データを
センテンス分けする手順は以下の通りである。 (1)識別条件入力部11から取得した識別条件に基づ
いて教材音声データの無音部分を識別し、センテンスを
検出する。
センテンス分けする手順は以下の通りである。 (1)識別条件入力部11から取得した識別条件に基づ
いて教材音声データの無音部分を識別し、センテンスを
検出する。
【0057】(2)識別した無音部分において、境界位
置設定部15で設定された位置に境界位置を設定する。 (3)設定した境界位置を記録したファイル(以下テー
マファイルと呼ぶ)を出力する。
置設定部15で設定された位置に境界位置を設定する。 (3)設定した境界位置を記録したファイル(以下テー
マファイルと呼ぶ)を出力する。
【0058】後述するように、テーマファイルは、セン
テンス番号、センテンスの開始位置、センテンスの終了
位置を記録したテキストファイルである。テーマファイ
ルは教材音声データを区分するための区分情報を記録し
ている。生成されたテーマファイルは、元の教材音声デ
ータと所定の方法で関連付けられる。
テンス番号、センテンスの開始位置、センテンスの終了
位置を記録したテキストファイルである。テーマファイ
ルは教材音声データを区分するための区分情報を記録し
ている。生成されたテーマファイルは、元の教材音声デ
ータと所定の方法で関連付けられる。
【0059】例えば、テーマファイルのファイル名を元
の教材音声データと同じファイル名に設定して拡張子を
「thm」などとテーマファイルに特有なものにするこ
とにより、テーマファイルと教材音声データを関連付け
ることができる。この場合、テーマファイルに対して所
定の操作(例えば、テーマファイルを表すアイコンをク
リックする)を行うと自動的に関連付けられた教材音声
データが再生されるように構成することもできる。
の教材音声データと同じファイル名に設定して拡張子を
「thm」などとテーマファイルに特有なものにするこ
とにより、テーマファイルと教材音声データを関連付け
ることができる。この場合、テーマファイルに対して所
定の操作(例えば、テーマファイルを表すアイコンをク
リックする)を行うと自動的に関連付けられた教材音声
データが再生されるように構成することもできる。
【0060】後述するようにセンテンスの認識は、テー
マファイルに記録されているデータを参照して行うよう
になっており、教材音声データそのものを分割したり、
あるいは境界位置を特定する情報を埋め込んだりするこ
とは行わない。
マファイルに記録されているデータを参照して行うよう
になっており、教材音声データそのものを分割したり、
あるいは境界位置を特定する情報を埋め込んだりするこ
とは行わない。
【0061】即ち、教材音声データそのものを加工する
必要はない。なお、教材音声データを境界位置で分割す
るなど、教材音声データそのものを加工することにより
センテンス分けすることも可能である。
必要はない。なお、教材音声データを境界位置で分割す
るなど、教材音声データそのものを加工することにより
センテンス分けすることも可能である。
【0062】図3は、区分設定部12が出力したテーマ
ファイルの一例を示した図である。テーマファイルは、
図に示したように、列31〜列35の5列の数値からな
るテキストファイルである。テーマファイルのファイル
名は、元となった教材音声データのファイル名と同じに
設定してあり、拡張子は「thm」となるように構成し
てある。
ファイルの一例を示した図である。テーマファイルは、
図に示したように、列31〜列35の5列の数値からな
るテキストファイルである。テーマファイルのファイル
名は、元となった教材音声データのファイル名と同じに
設定してあり、拡張子は「thm」となるように構成し
てある。
【0063】図4は、テーマファイルの構成を説明する
ための図である。列31は、センテンス番号を示してい
る。図の例では、音声データがセンテンス番号0番から
11番まで、12個のセンテンスにセンテンス分けされ
ている。
ための図である。列31は、センテンス番号を示してい
る。図の例では、音声データがセンテンス番号0番から
11番まで、12個のセンテンスにセンテンス分けされ
ている。
【0064】列32は、各センテンスの開始位置ブロッ
ク数をバイトを単位として表したものである。列33
は、教材音声データの開始位置からの各センテンスの開
始位置までの時間を表したものである。
ク数をバイトを単位として表したものである。列33
は、教材音声データの開始位置からの各センテンスの開
始位置までの時間を表したものである。
【0065】列34は、各センテンスの終了位置ブロッ
ク数をバイトを単位として表したものである。図3に示
したテーマファイルは、無音部分の開始位置を境界位置
とした場合のものであり、そのため、列34での終了位
置ブロック数は、次のセンテンスの開始位置ブロック数
と等しくなっている。列35は、教材音声データの開始
位置からの各センテンスの終了位置までの時間を表した
ものである。
ク数をバイトを単位として表したものである。図3に示
したテーマファイルは、無音部分の開始位置を境界位置
とした場合のものであり、そのため、列34での終了位
置ブロック数は、次のセンテンスの開始位置ブロック数
と等しくなっている。列35は、教材音声データの開始
位置からの各センテンスの終了位置までの時間を表した
ものである。
【0066】一般に、WAVE形式の音声データでは、
音声データ中の位置をブロック数と呼ばれるパラメータ
により指定することができる。そこで、センテンスの開
始位置を特定するブロック数を開始位置ブロック数と呼
び、センテンスの終了位置を特定するブロック数を終了
位置ブロック数と呼ぶことにした。
音声データ中の位置をブロック数と呼ばれるパラメータ
により指定することができる。そこで、センテンスの開
始位置を特定するブロック数を開始位置ブロック数と呼
び、センテンスの終了位置を特定するブロック数を終了
位置ブロック数と呼ぶことにした。
【0067】より詳細には、開始位置ブロック数、終了
位置ブロック数とは、WAVE形式のデータにおけるF
ormatチャンクのwBlockAlignの値であ
る。WAVE Audio FormatはRIFF
(Resource Interchange Fil
e Format)ファイルの1形式であり、RIFF
ファイルのデータはチャンク(Chunk)という基本
データブロックで構成されている。
位置ブロック数とは、WAVE形式のデータにおけるF
ormatチャンクのwBlockAlignの値であ
る。WAVE Audio FormatはRIFF
(Resource Interchange Fil
e Format)ファイルの1形式であり、RIFF
ファイルのデータはチャンク(Chunk)という基本
データブロックで構成されている。
【0068】WAVE形式の音声データのチャンク構造
は「Formatチャンク」、「Factチャンク」、
「Dateチャンク」の3つで構成されていている。F
ormatチャンクの中のwBlockAlignによ
って、音声データの位置を特定することができる。以上
のように、区分設定部12は、無音部分を検出する検出
手段と、区分情報を生成する区分情報生成手段を構成し
ている。
は「Formatチャンク」、「Factチャンク」、
「Dateチャンク」の3つで構成されていている。F
ormatチャンクの中のwBlockAlignによ
って、音声データの位置を特定することができる。以上
のように、区分設定部12は、無音部分を検出する検出
手段と、区分情報を生成する区分情報生成手段を構成し
ている。
【0069】図1に戻り、再生部16は、区分設定部1
2が生成したテーマファイルを参照しながらセンテンス
の開始位置や終了位置を認識し、これを用いて音声デー
タを再生する機能部であり、再生手段を構成している。
再生部16は、教材音声データを再生する際に、同じフ
ァイル名で拡張子が「thm」に設定されているテーマ
ファイルを検索してこれを取得する。
2が生成したテーマファイルを参照しながらセンテンス
の開始位置や終了位置を認識し、これを用いて音声デー
タを再生する機能部であり、再生手段を構成している。
再生部16は、教材音声データを再生する際に、同じフ
ァイル名で拡張子が「thm」に設定されているテーマ
ファイルを検索してこれを取得する。
【0070】再生部16は、最後に再生した区分を特定
する再生情報を記憶する記憶手段を備えており、この再
生情報を用いて各種のモードにて再生を行うことができ
る。本実施の形態では、再生部16は、通し再生モー
ド、センテンス再生モード、リピート再生モード、範囲
指定再生モード、無音部スキップ再生モード、ポーズ挿
入再生モード、ピッチコントロール再生モードの各モー
ドからユーザが選択したモードにて再生できるように構
成した。
する再生情報を記憶する記憶手段を備えており、この再
生情報を用いて各種のモードにて再生を行うことができ
る。本実施の形態では、再生部16は、通し再生モー
ド、センテンス再生モード、リピート再生モード、範囲
指定再生モード、無音部スキップ再生モード、ポーズ挿
入再生モード、ピッチコントロール再生モードの各モー
ドからユーザが選択したモードにて再生できるように構
成した。
【0071】通し再生モードは、センテンスの区分に関
わらず、音声データを最初から最後まで通して再生する
モードである。LL教材の全体を通して聞く場合に有利
なモードである。
わらず、音声データを最初から最後まで通して再生する
モードである。LL教材の全体を通して聞く場合に有利
なモードである。
【0072】センテンス再生モードは、1つのセンテン
スを開始位置から再生し、そのセンテンスの終了位置ま
で再生したら停止、又は停止位置にて一時停止状態(ポ
ーズ状態)となる再生モードである。ユーザは再生指示
を入力することにより、次のセンテンスを開始位置から
再生することができる。この場合、再生部16は、区分
順再生手段を構成している。
スを開始位置から再生し、そのセンテンスの終了位置ま
で再生したら停止、又は停止位置にて一時停止状態(ポ
ーズ状態)となる再生モードである。ユーザは再生指示
を入力することにより、次のセンテンスを開始位置から
再生することができる。この場合、再生部16は、区分
順再生手段を構成している。
【0073】図5(a)は、センテンス再生を説明する
ための音声波形図である。図5(a)において、教材音
声データはセンテンス41、42、43、・・・、から
成り立っているものとする。
ための音声波形図である。図5(a)において、教材音
声データはセンテンス41、42、43、・・・、から
成り立っているものとする。
【0074】再生部16は、センテンス41から教材音
声データを再生するものとする。再生部16は、センテ
ンス41を再生し終えると、一時停止状態となる。そし
て、ユーザからの再生指示が入力されるとセンテンス4
2を再生し、再生を終えるとまた一時停止状態となる。
そして、ユーザから再度再生指示が入力されるとセンテ
ンス43を再生し、再生を終えるとまた一時停止状態と
なる。以降この動作を繰り返す。この場合、再生部16
は、繰り返し再生手段を構成している。
声データを再生するものとする。再生部16は、センテ
ンス41を再生し終えると、一時停止状態となる。そし
て、ユーザからの再生指示が入力されるとセンテンス4
2を再生し、再生を終えるとまた一時停止状態となる。
そして、ユーザから再度再生指示が入力されるとセンテ
ンス43を再生し、再生を終えるとまた一時停止状態と
なる。以降この動作を繰り返す。この場合、再生部16
は、繰り返し再生手段を構成している。
【0075】センテンス再生モードでは、ユーザは、各
センテンスが再生された後に当該センテンスを復唱して
練習することができる。そして、発音が上達するまで復
唱を繰り返し、発音を十分マスターした後、図示しない
再生ボタンを選択して次のセンテンスを練習することが
できる。
センテンスが再生された後に当該センテンスを復唱して
練習することができる。そして、発音が上達するまで復
唱を繰り返し、発音を十分マスターした後、図示しない
再生ボタンを選択して次のセンテンスを練習することが
できる。
【0076】リピート再生モードは、1つのセンテンス
を再生し、終了位置に達したら当該センテンスの開始位
置に戻って一時停止する動作モードである。ユーザは再
生指示を入力することにより、当該センテンスを再度再
生することができる。また、センテンスの開始位置で一
時停止せずに、開始位置に戻ったら自動的に再生を行う
ように構成しても良い。
を再生し、終了位置に達したら当該センテンスの開始位
置に戻って一時停止する動作モードである。ユーザは再
生指示を入力することにより、当該センテンスを再度再
生することができる。また、センテンスの開始位置で一
時停止せずに、開始位置に戻ったら自動的に再生を行う
ように構成しても良い。
【0077】図5(b)は、リピート再生モードを説明
するための音声波形図である。図は、センテンス42を
選択し、リピート再生しているところを示している。再
生部16は、センテンス42を再生し、終了位置に達す
るとセンテンス42の開始位置に戻って一時停止状態と
なる。
するための音声波形図である。図は、センテンス42を
選択し、リピート再生しているところを示している。再
生部16は、センテンス42を再生し、終了位置に達す
るとセンテンス42の開始位置に戻って一時停止状態と
なる。
【0078】ユーザが再生指示を入力すると、再度、セ
ンテンス42の再生を行い、終了位置に達すると、また
開始位置に戻って一時停止状態となる。再生部16はユ
ーザが停止を指示するまでこれを繰り返す。
ンテンス42の再生を行い、終了位置に達すると、また
開始位置に戻って一時停止状態となる。再生部16はユ
ーザが停止を指示するまでこれを繰り返す。
【0079】このようにリピート再生モードでは、各セ
ンテンスのうち、任意のセンテンスを選択して繰り返し
再生することができるようになっている。リピート再生
モードにより、ユーザは、聞き取りが難しい発音の部分
を繰り返し聞き、外国語の発音に慣れることができる。
ンテンスのうち、任意のセンテンスを選択して繰り返し
再生することができるようになっている。リピート再生
モードにより、ユーザは、聞き取りが難しい発音の部分
を繰り返し聞き、外国語の発音に慣れることができる。
【0080】範囲指定モードは、センテンスに関係な
く、教材音声データでユーザが任意に指定した範囲を再
生するモードである。範囲の指定方法は、例えば、ディ
スプレイに表示された音声波形図で、ユーザが波形表示
部分をドラッグするとその範囲が指定されるように構成
することができる。このように、再生部16は再生範囲
を指定する範囲指定手段を備えている。
く、教材音声データでユーザが任意に指定した範囲を再
生するモードである。範囲の指定方法は、例えば、ディ
スプレイに表示された音声波形図で、ユーザが波形表示
部分をドラッグするとその範囲が指定されるように構成
することができる。このように、再生部16は再生範囲
を指定する範囲指定手段を備えている。
【0081】無音部スキップ再生モードは、教材音声デ
ータのうち、無音部を飛ばして(スキップして)有音部
分のみを再生するモードである。このモードで教材音声
データを再生するためには、有音部分の両端にセンテン
スの境界が設定されていることが必要である。
ータのうち、無音部を飛ばして(スキップして)有音部
分のみを再生するモードである。このモードで教材音声
データを再生するためには、有音部分の両端にセンテン
スの境界が設定されていることが必要である。
【0082】図5(c)は、無音部スキップモードを説
明するための音声波形図である。再生部16は、無音部
分45をスキップし、センテンス46を開始位置から再
生する。そして、センテンス46の終了位置に達する
と、無音部分47をスキップし、センテンス48を開始
位置から再生する。そして、センテンス48の終了位置
に達すると無音部分49をスキップしてセンテンス50
を再生する。
明するための音声波形図である。再生部16は、無音部
分45をスキップし、センテンス46を開始位置から再
生する。そして、センテンス46の終了位置に達する
と、無音部分47をスキップし、センテンス48を開始
位置から再生する。そして、センテンス48の終了位置
に達すると無音部分49をスキップしてセンテンス50
を再生する。
【0083】無音部スキップ再生モードにより、ユーザ
は、無音部分をスキップして教材音声データを再生する
ことができる。そのため、LL教材の全体構成を把握し
たい場合や、復習のためにLL教材の全体を通して聞き
たい場合などに、無音部分を再生する時間を省略するこ
とができる。
は、無音部分をスキップして教材音声データを再生する
ことができる。そのため、LL教材の全体構成を把握し
たい場合や、復習のためにLL教材の全体を通して聞き
たい場合などに、無音部分を再生する時間を省略するこ
とができる。
【0084】ポーズ挿入再生モードは、センテンスの切
れ目にポーズ(一時停止)を挿入して再生するモードで
ある。無音部分が短い教材の場合に無音部分を再生した
のと同様な効果を得ることができる。
れ目にポーズ(一時停止)を挿入して再生するモードで
ある。無音部分が短い教材の場合に無音部分を再生した
のと同様な効果を得ることができる。
【0085】図5(d)は、ポーズ挿入再生モードを説
明するための図である。再生部16は、センテンス53
を再生した後、ポーズ54を挿入する。即ち、音声の再
生を一時停止する。そして、所定の時間が経過すると、
再生部16は、センテンス55の再生を開始する。そし
て、センテンス55の再生が終了するとポーズ56を挿
入する。
明するための図である。再生部16は、センテンス53
を再生した後、ポーズ54を挿入する。即ち、音声の再
生を一時停止する。そして、所定の時間が経過すると、
再生部16は、センテンス55の再生を開始する。そし
て、センテンス55の再生が終了するとポーズ56を挿
入する。
【0086】以下、再生部16は、センテンス57の再
生、ポーズ58の挿入、センテンス59の再生、・・
・、とセンテンスの再生とポーズの挿入を交互に繰り返
す。ポーズの長さは、その直前のセンテンスの再生時間
に比例するように設定することもできるし、一定時間と
なるように設定することもできる。
生、ポーズ58の挿入、センテンス59の再生、・・
・、とセンテンスの再生とポーズの挿入を交互に繰り返
す。ポーズの長さは、その直前のセンテンスの再生時間
に比例するように設定することもできるし、一定時間と
なるように設定することもできる。
【0087】教材音声データが、ニュースや天気予報、
映画など、LL教育用に構成されていない素材を録音し
たものである場合、有音部分の間にLL教育に十分な無
音部分が設けられていない。
映画など、LL教育用に構成されていない素材を録音し
たものである場合、有音部分の間にLL教育に十分な無
音部分が設けられていない。
【0088】このようなときにポーズ挿入再生モードを
用いると有音部分の間に無音部分が擬似的に挿入され、
有音部分間に無音部分が設けられている通常のLL教材
と同様に利用できるようになる。ユーザは、ポーズの所
で発音練習などができる。
用いると有音部分の間に無音部分が擬似的に挿入され、
有音部分間に無音部分が設けられている通常のLL教材
と同様に利用できるようになる。ユーザは、ポーズの所
で発音練習などができる。
【0089】ピッチコントロール再生モードは、センテ
ンスの再生速度を変化させて再生するモードである。再
生部16は、DPC(Digital Pitch C
ontroller)を備えており、LL教材の再生速
度を変化させても音程(音の高さ)が変化しないように
なっている。DPCは、音声の再生速度と音程を個別に
変化させる技術であって、これを用いると、音声の再生
速度に関わらず音程を一定に保つことができる。
ンスの再生速度を変化させて再生するモードである。再
生部16は、DPC(Digital Pitch C
ontroller)を備えており、LL教材の再生速
度を変化させても音程(音の高さ)が変化しないように
なっている。DPCは、音声の再生速度と音程を個別に
変化させる技術であって、これを用いると、音声の再生
速度に関わらず音程を一定に保つことができる。
【0090】例えば、カセットテープの送り速度を変化
させるなどして、アナログ信号で録音された音声データ
を低速再生、高速再生すると、それに伴って音声の周波
数成分も低周波側あるいは高周波側にシフトして音程が
変化してしまう。
させるなどして、アナログ信号で録音された音声データ
を低速再生、高速再生すると、それに伴って音声の周波
数成分も低周波側あるいは高周波側にシフトして音程が
変化してしまう。
【0091】再生部16は、デジタル信号で録音された
音声をDPCを用いて再生するため、再生速度に関係な
く音程を一定に保つことができる。そのため、ユーザ
は、再生速度を変化させても容易にセンテンスを聞き取
ることができる。なお、ピッチコントロール再生モード
は、センテンス再生モードやリピート再生モードなど他
の再生モードと併用することが可能である。
音声をDPCを用いて再生するため、再生速度に関係な
く音程を一定に保つことができる。そのため、ユーザ
は、再生速度を変化させても容易にセンテンスを聞き取
ることができる。なお、ピッチコントロール再生モード
は、センテンス再生モードやリピート再生モードなど他
の再生モードと併用することが可能である。
【0092】図6(a)は、再生速度を遅くした場合を
説明するための波形図である。再生部16は、音声デー
タからセンテンス61を取得し、再生時間を延ばしてセ
ンテンス62を再生する。音程は変化しない。
説明するための波形図である。再生部16は、音声デー
タからセンテンス61を取得し、再生時間を延ばしてセ
ンテンス62を再生する。音程は変化しない。
【0093】図6(b)は、再生時間を短縮した場合を
説明するための波形図である。再生部16は、センテン
ス61を取得し、再生時間を短縮してセンテンス63を
再生する。音程は変化しない。
説明するための波形図である。再生部16は、センテン
ス61を取得し、再生時間を短縮してセンテンス63を
再生する。音程は変化しない。
【0094】ピッチコントロール再生モードを用いるこ
とにより、ユーザは、教材の発音が速くて聞き取りが困
難な場合に、再生速度を遅くしてその発音に慣れること
ができる。また、教材を高速で再生した後、元の速度で
再生すると、元の発音の早さが遅く感じられ、聞き取り
が容易になる。このようにピッチコントロール再生モー
ドを利用して、ユーザはリスニング能力の向上を図るこ
とができる。
とにより、ユーザは、教材の発音が速くて聞き取りが困
難な場合に、再生速度を遅くしてその発音に慣れること
ができる。また、教材を高速で再生した後、元の速度で
再生すると、元の発音の早さが遅く感じられ、聞き取り
が容易になる。このようにピッチコントロール再生モー
ドを利用して、ユーザはリスニング能力の向上を図るこ
とができる。
【0095】図1に戻り、再生モード入力部17は、以
上で説明した各種の再生モードを設定するための機能部
である。後述するように、音声データ処理システム5の
ユーザインターフェースは、GUI(Graphica
l User Interface)によって提供され
ており、ユーザは、ディスプレイ上に表示されたボタン
などをマウスなどで選択することにより、再生モード入
力部17に再生モードを入力することができるようにな
っている。
上で説明した各種の再生モードを設定するための機能部
である。後述するように、音声データ処理システム5の
ユーザインターフェースは、GUI(Graphica
l User Interface)によって提供され
ており、ユーザは、ディスプレイ上に表示されたボタン
などをマウスなどで選択することにより、再生モード入
力部17に再生モードを入力することができるようにな
っている。
【0096】出力部18は、再生部16が再生した音声
を出力する機能部である。再生部16は、音声データを
アナログ信号として出力する。出力部18はアンプとス
ピーカを備えており、再生部16が出力した信号を増幅
した後、物理的に再生する。
を出力する機能部である。再生部16は、音声データを
アナログ信号として出力する。出力部18はアンプとス
ピーカを備えており、再生部16が出力した信号を増幅
した後、物理的に再生する。
【0097】図7は、音声データ処理システム5が音声
データをセンテンス分けする動作を説明するためのフロ
ーチャートである。各構成部分の動作は、所定のプログ
ラムに従って、CPUが行うものとする。まず、デジタ
ル音声データ生成部7又はデジタル音声データ入力部8
から教材音声データを取得し、所定のファイル形式にて
音声データ格納部10に教材音声データを格納する(ス
テップ5)。
データをセンテンス分けする動作を説明するためのフロ
ーチャートである。各構成部分の動作は、所定のプログ
ラムに従って、CPUが行うものとする。まず、デジタ
ル音声データ生成部7又はデジタル音声データ入力部8
から教材音声データを取得し、所定のファイル形式にて
音声データ格納部10に教材音声データを格納する(ス
テップ5)。
【0098】この音声データに対してセンテンス検出を
行わない場合は(ステップ10;N)は、処理を終了す
る。この音声データに対してセンテンス検出を行う場合
は(ステップ10;Y)、区分設定部12によってセン
テンス検出を行う(ステップ15)。
行わない場合は(ステップ10;N)は、処理を終了す
る。この音声データに対してセンテンス検出を行う場合
は(ステップ10;Y)、区分設定部12によってセン
テンス検出を行う(ステップ15)。
【0099】センテンス検出は次のように行われる。ま
ず識別条件入力部11で設定された識別条件1、2、3
を用いて無音部分を認識する。次に、境界位置設定部1
5で設定された位置に境界を設定する。この境界により
音声データがセンテンスごとに区分され、よってセンテ
ンス検出が行われたことになる。
ず識別条件入力部11で設定された識別条件1、2、3
を用いて無音部分を認識する。次に、境界位置設定部1
5で設定された位置に境界を設定する。この境界により
音声データがセンテンスごとに区分され、よってセンテ
ンス検出が行われたことになる。
【0100】センテンス検出を終えた後、区分設定部1
2は、センテンス番号と、当該センテンスの開始位置と
終了位置を記録したテーマファイルを生成し(ステップ
20)、処理を終了する。
2は、センテンス番号と、当該センテンスの開始位置と
終了位置を記録したテーマファイルを生成し(ステップ
20)、処理を終了する。
【0101】図8は、センテンス分けされた音声データ
をセンテンス再生モードにて再生する場合の手順を説明
するためのフローチャートである。まず、再生部16
は、音声データと当該音声データに関連付けられたテー
マファイルを取得した後、カウンタiを0にリセットす
る(ステップ50)。
をセンテンス再生モードにて再生する場合の手順を説明
するためのフローチャートである。まず、再生部16
は、音声データと当該音声データに関連付けられたテー
マファイルを取得した後、カウンタiを0にリセットす
る(ステップ50)。
【0102】再生部16は、テーマファイルを参照しな
がらi番目のセンテンスを再生する(ステップ55)。
ただし、音声データ中のセンテンスのセンテンス番号
は、0番、1番、2番、・・・、といったように0番か
ら始まっている。
がらi番目のセンテンスを再生する(ステップ55)。
ただし、音声データ中のセンテンスのセンテンス番号
は、0番、1番、2番、・・・、といったように0番か
ら始まっている。
【0103】再生位置がi番目のセンテンスの終了位置
に達すると、再生部16は一時停止状態となる(ステッ
プ60)。再生部16は、停止した位置が、音声データ
の終了位置か否かを判断する(ステップ65)。
に達すると、再生部16は一時停止状態となる(ステッ
プ60)。再生部16は、停止した位置が、音声データ
の終了位置か否かを判断する(ステップ65)。
【0104】音声データの終了位置であった場合は(ス
テップ65;Y)、再生部16は再生処理を終了する。
音声データの終了位置でなかった場合は(ステップ6
5;N)、再生部16は、カウンタiに1を加算し、i
=i+1とする(ステップ70)。
テップ65;Y)、再生部16は再生処理を終了する。
音声データの終了位置でなかった場合は(ステップ6
5;N)、再生部16は、カウンタiに1を加算し、i
=i+1とする(ステップ70)。
【0105】次に、再生部16は、ユーザから再生指示
があったか否かを判断し(ステップ75)、指示されて
いない場合は(ステップ75;N)、一時停止状態を維
持する(ステップ80)。
があったか否かを判断し(ステップ75)、指示されて
いない場合は(ステップ75;N)、一時停止状態を維
持する(ステップ80)。
【0106】ユーザから再生指示があった場合は(ステ
ップ75;Y)、ステップ55に戻りi番目のセンテン
スを再生する。
ップ75;Y)、ステップ55に戻りi番目のセンテン
スを再生する。
【0107】以上、本実施の形態では、一例として音声
データ処理システム5をLL教材を処理して再生するも
のとして説明したが、これに限定するものではなく、様
々な分野で同様な音声データ処理を行うものに利用する
ことができる。
データ処理システム5をLL教材を処理して再生するも
のとして説明したが、これに限定するものではなく、様
々な分野で同様な音声データ処理を行うものに利用する
ことができる。
【0108】本実施の形態では、音声データは、WAV
E形式のデータとして取り扱うこととしたが、これに限
定するものではなく、例えば、MP3形式のデータ(W
AVE形式のデータを所定のアルゴリズムに従って圧縮
したもの)など、他の種類のファイル形式を利用するよ
うにすることもできる。
E形式のデータとして取り扱うこととしたが、これに限
定するものではなく、例えば、MP3形式のデータ(W
AVE形式のデータを所定のアルゴリズムに従って圧縮
したもの)など、他の種類のファイル形式を利用するよ
うにすることもできる。
【0109】音声データとして、MP3形式のように、
圧縮したデータを用いる場合、例えば、デジタル音声デ
ータ生成部7とデジタル音声データ入力部8は、デジタ
ル音声データをWAVE形式のファイルで出力する。そ
して、音声データ格納部10がWAVE形式のファイル
をコーディングして所定の形式(例えば、MP3形式)
にてファイルを生成し、記憶装置に格納する。
圧縮したデータを用いる場合、例えば、デジタル音声デ
ータ生成部7とデジタル音声データ入力部8は、デジタ
ル音声データをWAVE形式のファイルで出力する。そ
して、音声データ格納部10がWAVE形式のファイル
をコーディングして所定の形式(例えば、MP3形式)
にてファイルを生成し、記憶装置に格納する。
【0110】区分設定部12と再生部16は、音声デー
タ格納部10から読み出した所定の形式のファイルをW
AVE形式のファイルに展開した後、それぞれセンテン
ス分け、音声の再生を行うようにする。
タ格納部10から読み出した所定の形式のファイルをW
AVE形式のファイルに展開した後、それぞれセンテン
ス分け、音声の再生を行うようにする。
【0111】(実施例)次に、音声データ処理システム
5をLL教室に適用した場合の実施例について説明す
る。図9は、本実施例に係るLL教室システム71のシ
ステム構成を示した図である。LL教室システム71
は、LL教室として使用できる他、コンピュータリテラ
シー教育を行うためのいわゆるパソコン教室としても利
用できるようになっている。
5をLL教室に適用した場合の実施例について説明す
る。図9は、本実施例に係るLL教室システム71のシ
ステム構成を示した図である。LL教室システム71
は、LL教室として使用できる他、コンピュータリテラ
シー教育を行うためのいわゆるパソコン教室としても利
用できるようになっている。
【0112】LL教室システム71は、大きく分けて教
師側端末群72と学習者側端末群73から構成されてい
る。教師側端末群72の端末と学習者側端末群73の端
末はLAN(Local Area Network)
88によって接続されている。
師側端末群72と学習者側端末群73から構成されてい
る。教師側端末群72の端末と学習者側端末群73の端
末はLAN(Local Area Network)
88によって接続されている。
【0113】教師側端末群72は、教師用PC75、コ
ントロールPC76、コントロールユニット77、AV
機器78などから構成されている。教師用PC75は、
教師がLL教育やコンピュータリテラシー教育のために
利用するためのPCであり、ホストコンピュータを構成
している。
ントロールPC76、コントロールユニット77、AV
機器78などから構成されている。教師用PC75は、
教師がLL教育やコンピュータリテラシー教育のために
利用するためのPCであり、ホストコンピュータを構成
している。
【0114】教師用PC75には、音声データ処理シス
テム5a(後述)を用いて教材音声データをセンテンス
に区切るための音声データ処理プログラムがインストー
ルされている。
テム5a(後述)を用いて教材音声データをセンテンス
に区切るための音声データ処理プログラムがインストー
ルされている。
【0115】教師は、教師用PC75で教材音声データ
をセンテンスに区切り(即ちテーマファイルを生成
し)、音声データとテーマファイルを学習者側端末群7
3の各端末に送信することができる。
をセンテンスに区切り(即ちテーマファイルを生成
し)、音声データとテーマファイルを学習者側端末群7
3の各端末に送信することができる。
【0116】本実施例では、教師用PC75で教材音声
データをセンテンス分けするように構成したが、これに
限定せず、教材音声データを学習者用PC80に送信
し、学習者用PC80側でこれをセンテンス分けするよ
うに構成することもできる。
データをセンテンス分けするように構成したが、これに
限定せず、教材音声データを学習者用PC80に送信
し、学習者用PC80側でこれをセンテンス分けするよ
うに構成することもできる。
【0117】また、図示しないが、教師用PC75は、
ヘッドフォンとマイクロフォンを備えたヘッドセットが
接続されている。ヘッドフォンにより教師に音声を出力
することができると共に、マイクロフォンで教師の音声
を検出することができる。
ヘッドフォンとマイクロフォンを備えたヘッドセットが
接続されている。ヘッドフォンにより教師に音声を出力
することができると共に、マイクロフォンで教師の音声
を検出することができる。
【0118】AV機器78は、ビデオデッキ、テープデ
ッキ、CDプレーヤ、DVDプレーヤなどの各種AV機
器から構成されている。これらのAV機器を用いて、例
えば教育用のビデオを再生するなどして、LL教育やコ
ンピュータリテラシー教育に利用することができる。
ッキ、CDプレーヤ、DVDプレーヤなどの各種AV機
器から構成されている。これらのAV機器を用いて、例
えば教育用のビデオを再生するなどして、LL教育やコ
ンピュータリテラシー教育に利用することができる。
【0119】AV機器78で再生した音声はスピーカ8
6や教師のヘッドセットや学習者のヘッドセット82か
ら出力することができる。また、AV機器78で再生し
た映像はプロジェクター85で投影したり、教師用PC
75、学習者用PC80のディスプレイ上に表示したり
することができる。
6や教師のヘッドセットや学習者のヘッドセット82か
ら出力することができる。また、AV機器78で再生し
た映像はプロジェクター85で投影したり、教師用PC
75、学習者用PC80のディスプレイ上に表示したり
することができる。
【0120】また、磁気テープや光ディスク、光磁気デ
ィスクなどのメディアに記録されているLL教材をAV
機器78で再生して、教師用PC75にデータを取り込
み、これを教師用PC75でセンテンス分けすることも
できる。
ィスクなどのメディアに記録されているLL教材をAV
機器78で再生して、教師用PC75にデータを取り込
み、これを教師用PC75でセンテンス分けすることも
できる。
【0121】コントロールPC76は、コントロールユ
ニット77を制御するための端末である。コントロール
PC76は、コントロールユニット77を介してAV機
器78などを制御することができるようになっている。
ニット77を制御するための端末である。コントロール
PC76は、コントロールユニット77を介してAV機
器78などを制御することができるようになっている。
【0122】コントロールユニット77は、AV機器7
8を制御すると共に、AV機器78とスピーカ86、プ
ロジェクター85、学習者用PC80とのデータの送受
信を制御する。例えば、音声データをスピーカ86に送
信し、ヘッドセット82には送信しないなど送信先を選
択することができる。
8を制御すると共に、AV機器78とスピーカ86、プ
ロジェクター85、学習者用PC80とのデータの送受
信を制御する。例えば、音声データをスピーカ86に送
信し、ヘッドセット82には送信しないなど送信先を選
択することができる。
【0123】学習者側端末群73は、各学習者用に設け
られた複数の学習者用ユニットから構成されている。学
習者用ユニットは、学習者用PC80、80、80、・
・・、とこれら学習者用PC80に設けられた接続装置
81、ヘッドセット82から構成されている。
られた複数の学習者用ユニットから構成されている。学
習者用ユニットは、学習者用PC80、80、80、・
・・、とこれら学習者用PC80に設けられた接続装置
81、ヘッドセット82から構成されている。
【0124】ヘッドセット82は、音声データを学習者
に出力するヘッドフォンと学習者の音声を検出するマイ
クロフォンから構成されている。ユーザは、ヘッドフォ
ンを用いてLL教材の音声やマイクロフォンで検出した
自分の音声を聞くことができると共に、自分の音声をマ
イクロフォンを用いて録音することができる。また、学
習者と教師はヘッドセットを介して個別に会話すること
ができる。
に出力するヘッドフォンと学習者の音声を検出するマイ
クロフォンから構成されている。ユーザは、ヘッドフォ
ンを用いてLL教材の音声やマイクロフォンで検出した
自分の音声を聞くことができると共に、自分の音声をマ
イクロフォンを用いて録音することができる。また、学
習者と教師はヘッドセットを介して個別に会話すること
ができる。
【0125】接続装置81は、ヘッドセット82を学習
者用PC80とコントロールユニット77に接続するた
めの装置である。
者用PC80とコントロールユニット77に接続するた
めの装置である。
【0126】学習者用PC80は、LL教育用のプログ
ラムとコンピュータリテラシー用のプログラムがインス
トールしてあり、何れの目的にも利用できるようになっ
ている。
ラムとコンピュータリテラシー用のプログラムがインス
トールしてあり、何れの目的にも利用できるようになっ
ている。
【0127】学習者用PC80には、音声データ処理シ
ステム5aがインストールされており、教師用PC75
から教材音声データとテーマファイルを受信して、教材
音声データをセンテンス分けして再生することができ
る。また、マイクロフォンを用いて録音した学習者の音
声をセンテンス分けすることもできる。
ステム5aがインストールされており、教師用PC75
から教材音声データとテーマファイルを受信して、教材
音声データをセンテンス分けして再生することができ
る。また、マイクロフォンを用いて録音した学習者の音
声をセンテンス分けすることもできる。
【0128】LAN88は、所定の規格によりネットワ
ーク接続で構成されている。LAN88を介して、教師
用PC75から学習者用PC80に教材音声データやテ
ーマファイルを送信したり、学習者用PC80から教師
用PC75へ録音した学習者の音声を送信したり、ある
いは、教師と学習者が音声のやり取りができるなど、各
種のデータの送受信を行うことができる。
ーク接続で構成されている。LAN88を介して、教師
用PC75から学習者用PC80に教材音声データやテ
ーマファイルを送信したり、学習者用PC80から教師
用PC75へ録音した学習者の音声を送信したり、ある
いは、教師と学習者が音声のやり取りができるなど、各
種のデータの送受信を行うことができる。
【0129】教師は、学習者が自己の発音を録音した音
声データ(以下録音音声データ)をLAN88を介して
学習者用PC80から教師用PC75に提出させること
ができる。教師は、これら提出された録音音声データに
より、学習者の発音を評価することができる。
声データ(以下録音音声データ)をLAN88を介して
学習者用PC80から教師用PC75に提出させること
ができる。教師は、これら提出された録音音声データに
より、学習者の発音を評価することができる。
【0130】また、学習者から提出された録音音声デー
タに無音部分が含まれている場合、教師は音声データ処
理システム5aを用いてこれをセンテンス分けし、無音
部分をスキップして再生することも可能である。
タに無音部分が含まれている場合、教師は音声データ処
理システム5aを用いてこれをセンテンス分けし、無音
部分をスキップして再生することも可能である。
【0131】図10は、学習者用PC80の構成の一例
を示した図である。教師用PC75の構成も基本的には
同じである。
を示した図である。教師用PC75の構成も基本的には
同じである。
【0132】学習者用PC80は、図10に示すように
システム全体を制御するための制御部101を備えてい
る。この制御部101には、データバスなどのバスライ
ン114を介して、入力装置としてのキーボード102
やマウス103、表示装置104、印刷装置105、記
憶装置106、記憶媒体駆動装置107、通信制御装置
108、入出力インターフェース109などが接続され
ている。
システム全体を制御するための制御部101を備えてい
る。この制御部101には、データバスなどのバスライ
ン114を介して、入力装置としてのキーボード102
やマウス103、表示装置104、印刷装置105、記
憶装置106、記憶媒体駆動装置107、通信制御装置
108、入出力インターフェース109などが接続され
ている。
【0133】制御部101は、CPU111、ROM
(Read Only Memory)112、RAM
(Random Access Memory)113
を備えている。ROM112は、CPU111が各種制
御や演算を行うための各種プログラムやデータが予め格
納されたリードオンリーメモリである。
(Read Only Memory)112、RAM
(Random Access Memory)113
を備えている。ROM112は、CPU111が各種制
御や演算を行うための各種プログラムやデータが予め格
納されたリードオンリーメモリである。
【0134】RAM113は、CPU111にワーキン
グメモリとして使用されるランダムアクセスメモリであ
る。このRAM113には、センテンス分けなどのデー
タ処理のために録音音声データを一時的に読み込んで保
存するためのエリアや、学習者が録音した音声を一時的
に記憶しておくエリアや、コンピュータリテラシー教育
に用いるプログラムが使用するエリアなどの各種エリア
が確保可能になっている。
グメモリとして使用されるランダムアクセスメモリであ
る。このRAM113には、センテンス分けなどのデー
タ処理のために録音音声データを一時的に読み込んで保
存するためのエリアや、学習者が録音した音声を一時的
に記憶しておくエリアや、コンピュータリテラシー教育
に用いるプログラムが使用するエリアなどの各種エリア
が確保可能になっている。
【0135】CPU111は、所定のプログラムに従っ
て演算や制御を行う機能部である。CPU111は、レ
ジスタと呼ばれる記憶部を内部に備えており、処理対象
のデータをレジスタに読み込んでこれを処理するように
なっている。本実施例では、データ処理速度を高速化す
るため、処理対象のデータを一旦RAM113の所定の
エリアに記憶した後、これをレジスタに読み込む構成と
した。
て演算や制御を行う機能部である。CPU111は、レ
ジスタと呼ばれる記憶部を内部に備えており、処理対象
のデータをレジスタに読み込んでこれを処理するように
なっている。本実施例では、データ処理速度を高速化す
るため、処理対象のデータを一旦RAM113の所定の
エリアに記憶した後、これをレジスタに読み込む構成と
した。
【0136】キーボード102は、仮名文字を入力する
ための仮名キーやテンキー、各種機能を実行するための
機能キー、カーソルキー、などの各種キーが配置されて
いる。学習者はキーボード102から自分の音声を録音
したファイルのファイル名を入力したり、各種コマンド
を入力したりすることができる。
ための仮名キーやテンキー、各種機能を実行するための
機能キー、カーソルキー、などの各種キーが配置されて
いる。学習者はキーボード102から自分の音声を録音
したファイルのファイル名を入力したり、各種コマンド
を入力したりすることができる。
【0137】マウス103は、ポインティングデバイス
である。マウス103を用いて表示装置104に表示さ
れたキーやアイコンなどを選択することにより、音声デ
ータの再生を開始したりストップさせたりなど、各種の
コマンドを入力することができる。
である。マウス103を用いて表示装置104に表示さ
れたキーやアイコンなどを選択することにより、音声デ
ータの再生を開始したりストップさせたりなど、各種の
コマンドを入力することができる。
【0138】表示装置104は、例えばCRTや液晶デ
ィスプレイなどが使用される。表示装置104上に、ア
イコンやその他の表示を行うことにより、GUIによる
ユーザインターフェースが提供される。学習者は、表示
装置104上で、LL教材の音声波形を確認できる他、
自分の発音の音声波形も確認することができる。
ィスプレイなどが使用される。表示装置104上に、ア
イコンやその他の表示を行うことにより、GUIによる
ユーザインターフェースが提供される。学習者は、表示
装置104上で、LL教材の音声波形を確認できる他、
自分の発音の音声波形も確認することができる。
【0139】印刷装置105は、紙などの印刷媒体に文
字や絵などの印刷を行うための装置である。この印刷装
置としては、レーザプリンタ、ドットプリンタ、インク
ジェットプリンタ、ページプリンタ、感熱式プリンタ、
熱転写式プリンタ、などの各種印刷装置が使用される。
学習者は、印刷装置105を用いてLL教材の音声波形
や自分の音声波形を印刷することができる。
字や絵などの印刷を行うための装置である。この印刷装
置としては、レーザプリンタ、ドットプリンタ、インク
ジェットプリンタ、ページプリンタ、感熱式プリンタ、
熱転写式プリンタ、などの各種印刷装置が使用される。
学習者は、印刷装置105を用いてLL教材の音声波形
や自分の音声波形を印刷することができる。
【0140】記憶装置106は、読み書き可能な記憶媒
体と、その記憶媒体に対してプログラムやデータなどの
各種情報を読み書きするための駆動装置で構成されてい
る。記憶装置106に使用される記憶媒体としては、主
としてハードディスクが使用されるが、半導体メモリや
光磁気ディスクなどの他の種類の記憶媒体を用いること
も可能である。
体と、その記憶媒体に対してプログラムやデータなどの
各種情報を読み書きするための駆動装置で構成されてい
る。記憶装置106に使用される記憶媒体としては、主
としてハードディスクが使用されるが、半導体メモリや
光磁気ディスクなどの他の種類の記憶媒体を用いること
も可能である。
【0141】記憶装置106はプログラム格納部11
5、データ格納部116などを有している。プログラム
格納部115には、音声データ処理システム5a(後
述)を実現するための音声データ処理プログラムやLA
N88を介して通信を行うための通信プログラム、コン
ピュータリテラシー教育で使用する様々なアプリケーシ
ョンソフトウェア、学習者用PC80を機能させるため
の基本プログラムであるOS(Operating S
ystem)などが格納されている。
5、データ格納部116などを有している。プログラム
格納部115には、音声データ処理システム5a(後
述)を実現するための音声データ処理プログラムやLA
N88を介して通信を行うための通信プログラム、コン
ピュータリテラシー教育で使用する様々なアプリケーシ
ョンソフトウェア、学習者用PC80を機能させるため
の基本プログラムであるOS(Operating S
ystem)などが格納されている。
【0142】データ格納部116には、教師用PC75
から受信した音声データファイルやテーマファイル、学
習者が自己の発音を録音したデータファイル、その他コ
ンピュータリテラシーで用いるアプリケーションソフト
ウェアで用いるデータファイルなどの各種のデータファ
イルが格納されている。
から受信した音声データファイルやテーマファイル、学
習者が自己の発音を録音したデータファイル、その他コ
ンピュータリテラシーで用いるアプリケーションソフト
ウェアで用いるデータファイルなどの各種のデータファ
イルが格納されている。
【0143】記憶媒体駆動装置107は、CPU111
が着脱可能な記憶媒体に対してコンピュータプログラム
やデータファイルを読み書きするための駆動装置であ
る。
が着脱可能な記憶媒体に対してコンピュータプログラム
やデータファイルを読み書きするための駆動装置であ
る。
【0144】記憶媒体とは、具体的には、フレキシブル
ディスク、ハードディスク、磁気テープなどの磁気記憶
媒体、メモリチップやICカードなどの半導体記憶媒
体、CD−ROMやMO、PD(相変化書き換え型光デ
ィスク)などの光学的に情報が読み取られる記憶媒体、
紙カードや紙テープなどの用紙(及び、用紙に相当する
機能を持った媒体)を用いた記憶媒体、その他各種方法
でコンピュータプログラムなどが記憶される記憶媒体が
含まれる。
ディスク、ハードディスク、磁気テープなどの磁気記憶
媒体、メモリチップやICカードなどの半導体記憶媒
体、CD−ROMやMO、PD(相変化書き換え型光デ
ィスク)などの光学的に情報が読み取られる記憶媒体、
紙カードや紙テープなどの用紙(及び、用紙に相当する
機能を持った媒体)を用いた記憶媒体、その他各種方法
でコンピュータプログラムなどが記憶される記憶媒体が
含まれる。
【0145】学習者は、記憶媒体駆動装置107を用い
てLL教材用の音声データを着脱可能な記憶媒体に記憶
することができる。そして、これを自宅に持って帰り、
自宅のPCなどでこれを再生し、自宅学習することがで
きる。
てLL教材用の音声データを着脱可能な記憶媒体に記憶
することができる。そして、これを自宅に持って帰り、
自宅のPCなどでこれを再生し、自宅学習することがで
きる。
【0146】また、教師から宿題として出された発音練
習課題を記憶媒体に記憶して自宅に持って帰ることもで
きる。更に、学習者は自宅で宿題の結果である練習後の
発音を記憶媒体に録音してLL教室に持参し、LAN8
8を介して教師用PC75に提出することもできる。
習課題を記憶媒体に記憶して自宅に持って帰ることもで
きる。更に、学習者は自宅で宿題の結果である練習後の
発音を記憶媒体に録音してLL教室に持参し、LAN8
8を介して教師用PC75に提出することもできる。
【0147】本実例の学習者用PC80において使用さ
れる記憶媒体としては、主として、データの読み書き可
能な半導体メモリや光磁気ディスクなどが用いられる。
また、これら記憶媒体は、LL教育目的以外に、コンピ
ュータリテラシー教育目的に使用することもできる。
れる記憶媒体としては、主として、データの読み書き可
能な半導体メモリや光磁気ディスクなどが用いられる。
また、これら記憶媒体は、LL教育目的以外に、コンピ
ュータリテラシー教育目的に使用することもできる。
【0148】また、記憶媒体駆動装置107から各種プ
ログラムを読み込んで学習者用PC80にインストール
することもできる。例えば、音声データ処理プログラム
を記録した記憶媒体を記憶媒体駆動装置107にセット
し、当該記憶媒体から音声データ処理プログラムを読み
込んで、記憶装置106に格納(インストール)するこ
とができる。
ログラムを読み込んで学習者用PC80にインストール
することもできる。例えば、音声データ処理プログラム
を記録した記憶媒体を記憶媒体駆動装置107にセット
し、当該記憶媒体から音声データ処理プログラムを読み
込んで、記憶装置106に格納(インストール)するこ
とができる。
【0149】通信制御装置108は、LAN88を介し
て学習者用PC80と教師用PC75に接続するための
制御装置である。学習者用PC80は、通信制御装置1
08を介して教師用PC75からLL教材用の音声デー
タや教師用PC75で生成されたテーマファイルを受信
することができる。通信制御装置108は、端末側受信
手段と、端末側送信手段を構成している。また、教師用
PC75の通信制御装置はホスト側送信手段を構成して
いる。
て学習者用PC80と教師用PC75に接続するための
制御装置である。学習者用PC80は、通信制御装置1
08を介して教師用PC75からLL教材用の音声デー
タや教師用PC75で生成されたテーマファイルを受信
することができる。通信制御装置108は、端末側受信
手段と、端末側送信手段を構成している。また、教師用
PC75の通信制御装置はホスト側送信手段を構成して
いる。
【0150】入出力インターフェース109は、学習者
用PC80と外部機器を接続するためのインターフェー
スである。本実施例では、接続装置81(図示せず)を
介してヘッドセット82が接続されている。ヘッドセッ
トは音声を学習者に出力するヘッドフォン118と、学
習者が発する音声を検出するマイクロフォン119から
構成されている。
用PC80と外部機器を接続するためのインターフェー
スである。本実施例では、接続装置81(図示せず)を
介してヘッドセット82が接続されている。ヘッドセッ
トは音声を学習者に出力するヘッドフォン118と、学
習者が発する音声を検出するマイクロフォン119から
構成されている。
【0151】教材音声データの再生音声はヘッドフォン
118から出力される。また、学習者はマイクロフォン
119を用いて自分の音声を学習者用PC80に入力す
ることができる。
118から出力される。また、学習者はマイクロフォン
119を用いて自分の音声を学習者用PC80に入力す
ることができる。
【0152】図11は、本実施例に係る音声データ処理
システム5aの構成を示した図である。音声データ処理
システム5aは、プログラム格納部115に格納されい
る音声データ処理プログラムをCPU111が実行し、
ソフトウェア的に実現されたものである。
システム5aの構成を示した図である。音声データ処理
システム5aは、プログラム格納部115に格納されい
る音声データ処理プログラムをCPU111が実行し、
ソフトウェア的に実現されたものである。
【0153】音声データ処理システム5aは、音声デー
タ処理システム5に録音機能を付加し、本実施例用にカ
スタマイズしたものである。音声データ処理システム5
と同じ構成要素には、同じ符号を付し、説明を省略す
る。
タ処理システム5に録音機能を付加し、本実施例用にカ
スタマイズしたものである。音声データ処理システム5
と同じ構成要素には、同じ符号を付し、説明を省略す
る。
【0154】ヘッドセット82は、ヘッドフォン118
とマイクロフォン119から構成されている。ヘッドセ
ット82は、学習者が頭部に装着する。ヘッドフォン1
18からは、再生部16が再生した音声が出力される。
とマイクロフォン119から構成されている。ヘッドセ
ット82は、学習者が頭部に装着する。ヘッドフォン1
18からは、再生部16が再生した音声が出力される。
【0155】マイクロフォン119は、学習者の音声を
検出し、これをアナログ信号として出力する。マイクロ
フォン119は、音声取得手段を構成している。学習者
の音声はデジタル音声データ生成部7でデジタル信号に
変換された後、一時格納部120により格納される。デ
ジタル音声データ生成部7は録音音声データ生成部を構
成している。
検出し、これをアナログ信号として出力する。マイクロ
フォン119は、音声取得手段を構成している。学習者
の音声はデジタル音声データ生成部7でデジタル信号に
変換された後、一時格納部120により格納される。デ
ジタル音声データ生成部7は録音音声データ生成部を構
成している。
【0156】一時格納部120は、RAM113に確保
された音声データ格納エリアに学習者の音声を一時的に
保持する機能部である。一時格納部120は、録音音声
データを一時的に保持する保持手段を構成している。一
時格納部120は、録音ボタン125が学習者により選
択されると音声データ格納エリアに録音音声データの格
納を開始し、録音を始める。録音ボタン125は、GU
I上に構成された録音ボタンである。
された音声データ格納エリアに学習者の音声を一時的に
保持する機能部である。一時格納部120は、録音音声
データを一時的に保持する保持手段を構成している。一
時格納部120は、録音ボタン125が学習者により選
択されると音声データ格納エリアに録音音声データの格
納を開始し、録音を始める。録音ボタン125は、GU
I上に構成された録音ボタンである。
【0157】録音を開始した後、図示しない停止ボタン
が学習者により選択されると一時格納部120は、録音
を停止する。このように、録音ボタン125は、録音状
態の作動と停止を切替える切替え手段を構成している。
学習者が再度録音ボタン125を選択すると、音声デー
タ処理システム5aは、先にRAM113に格納した録
音音声データを消去し、新たな録音音声データの格納を
開始する。
が学習者により選択されると一時格納部120は、録音
を停止する。このように、録音ボタン125は、録音状
態の作動と停止を切替える切替え手段を構成している。
学習者が再度録音ボタン125を選択すると、音声デー
タ処理システム5aは、先にRAM113に格納した録
音音声データを消去し、新たな録音音声データの格納を
開始する。
【0158】OSの機能により、再度録音ボタン125
を選択すると、既にRAM113に格納してある音声デ
ータを保存するか廃棄するかの確認を、録音ボタン12
5を選択する都度学習者に問い合わせしてくる場合があ
る。
を選択すると、既にRAM113に格納してある音声デ
ータを保存するか廃棄するかの確認を、録音ボタン12
5を選択する都度学習者に問い合わせしてくる場合があ
る。
【0159】LL学習では、学習者は何度も発音を試
み、納得のいく発音ができたときにこれを保存すること
が行われている。そのため、録音ボタン125を選択す
るたびに、先に録音した録音音声データの保存確認を行
うのは、LL学習にとって不必要であるばかりか煩雑で
ある。そのため、音声データ処理システム5aでは、録
音ボタン125が再度選択された場合は、自動的に先に
録音した録音音声データを削除し、新たな録音音声デー
タの記憶を行うようにプログラムを構成した。
み、納得のいく発音ができたときにこれを保存すること
が行われている。そのため、録音ボタン125を選択す
るたびに、先に録音した録音音声データの保存確認を行
うのは、LL学習にとって不必要であるばかりか煩雑で
ある。そのため、音声データ処理システム5aでは、録
音ボタン125が再度選択された場合は、自動的に先に
録音した録音音声データを削除し、新たな録音音声デー
タの記憶を行うようにプログラムを構成した。
【0160】ファイル保存部122は、一時格納部12
0に一時的に格納されている録音音声データをファイル
としてデータ格納部116などに保存するための機能部
である。ファイル保存部122は、保存ボタン124が
学習者に選択されることにより起動する。保存ボタン1
24は、GUI上に構成された保存ボタンである。
0に一時的に格納されている録音音声データをファイル
としてデータ格納部116などに保存するための機能部
である。ファイル保存部122は、保存ボタン124が
学習者に選択されることにより起動する。保存ボタン1
24は、GUI上に構成された保存ボタンである。
【0161】学習者は、録音ボタン125を用いて納得
がいくまで自己の発音の録音を繰り返すことができる。
そして、うまく発音できたところで保存ボタン124を
選択して、その音声データをファイルとして保存するこ
とができる。
がいくまで自己の発音の録音を繰り返すことができる。
そして、うまく発音できたところで保存ボタン124を
選択して、その音声データをファイルとして保存するこ
とができる。
【0162】区分設定部12は、一時格納部120で一
時的に保存された学習者の録音音声データをセンテンス
分けすることができる。区分設定部12は、センテンス
分けの結果生成したテーマファイルを再生部16に出力
する。また、図示しないが区分設定部12には、識別条
件入力部11と境界位置設定部15が接続されている。
このように、本実施例では録音音声データをセンテンス
分けできるため、録音音声データの無音部分を取り除い
た有音部分を教師に提出することも可能である。これに
よって、教師は無音部分を聞く時間を節約することがで
きる。
時的に保存された学習者の録音音声データをセンテンス
分けすることができる。区分設定部12は、センテンス
分けの結果生成したテーマファイルを再生部16に出力
する。また、図示しないが区分設定部12には、識別条
件入力部11と境界位置設定部15が接続されている。
このように、本実施例では録音音声データをセンテンス
分けできるため、録音音声データの無音部分を取り除い
た有音部分を教師に提出することも可能である。これに
よって、教師は無音部分を聞く時間を節約することがで
きる。
【0163】再生部16は、一時格納部120で一時的
に保存された録音音声データをテーマファイルに従っ
て、センテンスごとに再生することができる。再生モー
ドは、実施の形態で説明したものと同じである。このよ
うに、本実施例では学習者の音声をもセンテンス分けす
ることができる。
に保存された録音音声データをテーマファイルに従っ
て、センテンスごとに再生することができる。再生モー
ドは、実施の形態で説明したものと同じである。このよ
うに、本実施例では学習者の音声をもセンテンス分けす
ることができる。
【0164】音声データ格納部10は、教師用PC75
から送信されてきた教材音声データを格納する機能部で
ある。教師用PC75から当該音声データのテーマファ
イルも送られてきた場合は、これも格納する。
から送信されてきた教材音声データを格納する機能部で
ある。教師用PC75から当該音声データのテーマファ
イルも送られてきた場合は、これも格納する。
【0165】再生部16は、教材音声データと録音音声
データを同期再生することもできるし、個別に再生する
こともできる。教材音声データや録音音声データにテー
マファイルが作成されている場合はこれらテーマファイ
ルを用いてセンテンスごとに再生することができる。
データを同期再生することもできるし、個別に再生する
こともできる。教材音声データや録音音声データにテー
マファイルが作成されている場合はこれらテーマファイ
ルを用いてセンテンスごとに再生することができる。
【0166】また、教師用PC75から送られてきた音
声データにテーマファイルが付随していなかった場合
は、区分設定部12は区分を設定し、再生部16で当該
音声データをセンテンスごとに再生することもできる。
声データにテーマファイルが付随していなかった場合
は、区分設定部12は区分を設定し、再生部16で当該
音声データをセンテンスごとに再生することもできる。
【0167】即ち、学習者用PC80で使用する教材音
声データは、予め教師用PC75でセンテンス分けする
こともできるし、学習者用PC80でセンテンス分けす
ることもできる。
声データは、予め教師用PC75でセンテンス分けする
こともできるし、学習者用PC80でセンテンス分けす
ることもできる。
【0168】波形生成部121は、教材音声データや録
音音声データを用いて音声波形を生成する波形図生成手
段である。波形生成部121で生成した音声波形はディ
スプレイ123で表示される。ディスプレイ123は、
表示装置104(図10)に設けられた表示手段であ
る。波形生成部121には、一時格納部120で格納し
た録音音声データと、音声データ格納部10で格納され
た教材音声データが入力できるようになっている。
音音声データを用いて音声波形を生成する波形図生成手
段である。波形生成部121で生成した音声波形はディ
スプレイ123で表示される。ディスプレイ123は、
表示装置104(図10)に設けられた表示手段であ
る。波形生成部121には、一時格納部120で格納し
た録音音声データと、音声データ格納部10で格納され
た教材音声データが入力できるようになっている。
【0169】波形生成部121は、複数の音声データを
同時に処理すことができ、録音音声データと教材音声デ
ータから同時にそれぞれの波形図を生成することができ
る。そのため、ディスプレイ123では、録音音声デー
タの音声波形と、教材音声データの音声波形をリアルタ
イムで比較可能に表示することができる。
同時に処理すことができ、録音音声データと教材音声デ
ータから同時にそれぞれの波形図を生成することができ
る。そのため、ディスプレイ123では、録音音声デー
タの音声波形と、教材音声データの音声波形をリアルタ
イムで比較可能に表示することができる。
【0170】図12は、音声データ処理システム5aの
操作画面130の一例を示した図である。操作画面13
0は、音声データ処理システム5aのユーザインターフ
ェースを提供するものである。
操作画面130の一例を示した図である。操作画面13
0は、音声データ処理システム5aのユーザインターフ
ェースを提供するものである。
【0171】ポインタ152は、学習者が机上などでマ
ウス103を移動させると、それに同期して操作画面1
30上を移動するようになっている。操作画面130上
には、コマンドなどに対応したボタンやアイコンなどの
各種のオブジェクトが配置されている。
ウス103を移動させると、それに同期して操作画面1
30上を移動するようになっている。操作画面130上
には、コマンドなどに対応したボタンやアイコンなどの
各種のオブジェクトが配置されている。
【0172】ポインタ152をこれらオブジェクトにあ
わせて所定の操作(例えばマウス103の所定のボタン
をクリックしたり、ダブルクリックしたり、ドラッグし
たりなど)を行うと、例えば、オブジェクトに対応付け
られたコマンドが入力されるなど、オブジェクトに関連
付けられた所定の情報を学習者用PC80に入力するこ
とができる。以下では、ボタンにポインタ152を合わ
せてクリックすることをボタンをクリックするなどと記
すことにする。
わせて所定の操作(例えばマウス103の所定のボタン
をクリックしたり、ダブルクリックしたり、ドラッグし
たりなど)を行うと、例えば、オブジェクトに対応付け
られたコマンドが入力されるなど、オブジェクトに関連
付けられた所定の情報を学習者用PC80に入力するこ
とができる。以下では、ボタンにポインタ152を合わ
せてクリックすることをボタンをクリックするなどと記
すことにする。
【0173】ファイル操作エリア132は、ファイルを
開いたり保存したりなどファイル管理を行うためのエリ
アである。ファイル操作エリア132は、LL教材用の
ファイルを操作する欄(開くボタン133)と学習者用
(ユーザ用)のファイルを操作する欄(開くボタン13
4と保存ボタン124)に区分されている。
開いたり保存したりなどファイル管理を行うためのエリ
アである。ファイル操作エリア132は、LL教材用の
ファイルを操作する欄(開くボタン133)と学習者用
(ユーザ用)のファイルを操作する欄(開くボタン13
4と保存ボタン124)に区分されている。
【0174】開くボタン133は、LL教材用のプログ
ラムを選択して音声ファイルを開くボタンである。本実
施例では、LL教材は、例えば、「放課後」、「課外活
動」、「海外旅行」などの各プログラムから構成されい
ている。そして、各プログラムは、更に複数のレッスン
から構成されている。
ラムを選択して音声ファイルを開くボタンである。本実
施例では、LL教材は、例えば、「放課後」、「課外活
動」、「海外旅行」などの各プログラムから構成されい
ている。そして、各プログラムは、更に複数のレッスン
から構成されている。
【0175】教材音声データは、各レッスンごとに音声
ファイルとして用意してある。これらの教材音声データ
は、教師用PC75からLAN88を介して学習者用P
C80に送信されてきたものを学習者用PC80のデー
タ格納部116に格納したものである。
ファイルとして用意してある。これらの教材音声データ
は、教師用PC75からLAN88を介して学習者用P
C80に送信されてきたものを学習者用PC80のデー
タ格納部116に格納したものである。
【0176】なお、これらの音声データは着脱可能な記
憶媒体に記憶しておいたものを記憶媒体駆動装置107
から学習者用PC80に読み込み、データ格納部116
に格納しても良い。
憶媒体に記憶しておいたものを記憶媒体駆動装置107
から学習者用PC80に読み込み、データ格納部116
に格納しても良い。
【0177】データ格納部116は、LL教材用のファ
イルを格納するLL教材用ディレクトリや、学習者が自
分の音声を録音したファイルなど学習者固有のファイル
を格納する学習者用ディレクトリなど、用途別にディレ
クトリが形成されている。
イルを格納するLL教材用ディレクトリや、学習者が自
分の音声を録音したファイルなど学習者固有のファイル
を格納する学習者用ディレクトリなど、用途別にディレ
クトリが形成されている。
【0178】開くボタン133をクリックすると、LL
教材用のディレクトリが開かれる。そして、当該ディレ
クトリ内の各プログラムとレッスンを一覧表示するウイ
ンドウが操作画面130上に現れるようになっている。
学習者が任意のレッスンの表示をクリックすると、当該
レッスン用の音声ファイルが開かれ、教材音声データが
RAM113に読み込まれる。
教材用のディレクトリが開かれる。そして、当該ディレ
クトリ内の各プログラムとレッスンを一覧表示するウイ
ンドウが操作画面130上に現れるようになっている。
学習者が任意のレッスンの表示をクリックすると、当該
レッスン用の音声ファイルが開かれ、教材音声データが
RAM113に読み込まれる。
【0179】なお、ウインドウとは、ディスプレイに表
示される画面の中で枠によって区切られたエリアであっ
て、アプリケーションソフトウェアなどの表示を行う部
分である。通常は、ウインドウは大きさを変更したり表
示位置を移動したりすることができる。ウインドウは閉
じるボタンを備えており、このボタンをクリックしてウ
インドウを閉じることができる。
示される画面の中で枠によって区切られたエリアであっ
て、アプリケーションソフトウェアなどの表示を行う部
分である。通常は、ウインドウは大きさを変更したり表
示位置を移動したりすることができる。ウインドウは閉
じるボタンを備えており、このボタンをクリックしてウ
インドウを閉じることができる。
【0180】教材音声データに既にテーマファイルが作
成されている場合は(例えば教師が予め教材をセンテン
ス分けした場合など)、開いた教材音声データのテーマ
ファイルも共にRAM113に読み込まれる。再生部1
6は、このテーマファイルを参照しながらRAM113
に格納された音声データをセンテンス分けして再生する
ことができる。
成されている場合は(例えば教師が予め教材をセンテン
ス分けした場合など)、開いた教材音声データのテーマ
ファイルも共にRAM113に読み込まれる。再生部1
6は、このテーマファイルを参照しながらRAM113
に格納された音声データをセンテンス分けして再生する
ことができる。
【0181】開くボタン134は、学習者がドリル学習
などで利用する学習者個人用の録音音声ファイルを開く
ためのボタンである。開くボタン134をクリックする
と学習者用のディレクトリが開かれ、当該ディレクトリ
に格納されている音声ファイルの一覧を表示するウイン
ドウがディスプレイ123上に現れる。
などで利用する学習者個人用の録音音声ファイルを開く
ためのボタンである。開くボタン134をクリックする
と学習者用のディレクトリが開かれ、当該ディレクトリ
に格納されている音声ファイルの一覧を表示するウイン
ドウがディスプレイ123上に現れる。
【0182】ところで、音声データ処理システム5aで
は、様々な発音課題が学習者に与えられ、学習者はそれ
を録音するようになっている。学習者は、ドリル学習な
どで録音した音声の録音音声データを音声ファイルとし
てデータ格納部116に保存することができる。学習者
は自分の音声を録音してそれを再生して聞くことによ
り、LL教材の発音と自分の発音を比較することができ
る。
は、様々な発音課題が学習者に与えられ、学習者はそれ
を録音するようになっている。学習者は、ドリル学習な
どで録音した音声の録音音声データを音声ファイルとし
てデータ格納部116に保存することができる。学習者
は自分の音声を録音してそれを再生して聞くことによ
り、LL教材の発音と自分の発音を比較することができ
る。
【0183】学習者は、一覧表示されたファイルのう
ち、所望のものをクリックすることにより、当該ファイ
ルを開くことができる。音声ファイルは開かれるとRA
M113に読み込まれ、再生部16により再生可能とな
る。当該音声ファイルにテーマファイルが作成されてい
る場合は、当該テーマファイルも共にRAM113に読
み込まれる。そして、再生部16は、このテーマファイ
ルを参照しながら音声ファイルをセンテンス分けして再
生することができる。
ち、所望のものをクリックすることにより、当該ファイ
ルを開くことができる。音声ファイルは開かれるとRA
M113に読み込まれ、再生部16により再生可能とな
る。当該音声ファイルにテーマファイルが作成されてい
る場合は、当該テーマファイルも共にRAM113に読
み込まれる。そして、再生部16は、このテーマファイ
ルを参照しながら音声ファイルをセンテンス分けして再
生することができる。
【0184】保存ボタン124は、学習者が録音した録
音音声データを保存するためのボタンである。学習者は
ヘッドフォン118から聞こえるLL教材の音声を参考
にしながらマイクロフォン119に対して発音する。学
習者が発音した音声の録音音声データは一時格納部12
0によりRAM113に一時的に記憶される。
音音声データを保存するためのボタンである。学習者は
ヘッドフォン118から聞こえるLL教材の音声を参考
にしながらマイクロフォン119に対して発音する。学
習者が発音した音声の録音音声データは一時格納部12
0によりRAM113に一時的に記憶される。
【0185】学習者は、この一時的に記憶した自分の音
声を再生して聞き、これを保存するか否かを判断するこ
とができる。保存すると判断した場合は保存ボタン12
4をクリックする。
声を再生して聞き、これを保存するか否かを判断するこ
とができる。保存すると判断した場合は保存ボタン12
4をクリックする。
【0186】すると、ファイル保存部122は、一時格
納部120で一時的に記憶した録音音声データを音声フ
ァイルとしてデータ格納部116に格納する。ファイル
名は所定の名称が自動的に付与されるが、学習者がキー
ボード102を用いて任意のファイル名を入力すること
も可能である。
納部120で一時的に記憶した録音音声データを音声フ
ァイルとしてデータ格納部116に格納する。ファイル
名は所定の名称が自動的に付与されるが、学習者がキー
ボード102を用いて任意のファイル名を入力すること
も可能である。
【0187】音量調節エリア138は、ヘッドフォン1
18から出力される音声の音量を調節するためのエリア
である。音量調節エリア138はスライドバーであっ
て、つまみ139を備えている。そして、学習者はマウ
ス103を用いてつまみ139を左右にドラッグするこ
とにより、つまみ139を左右にスライドさせることが
できる。つまみ139を右にスライドすると音量が大き
くなり、左にスライドすると音量が小さくなるようにな
っている。
18から出力される音声の音量を調節するためのエリア
である。音量調節エリア138はスライドバーであっ
て、つまみ139を備えている。そして、学習者はマウ
ス103を用いてつまみ139を左右にドラッグするこ
とにより、つまみ139を左右にスライドさせることが
できる。つまみ139を右にスライドすると音量が大き
くなり、左にスライドすると音量が小さくなるようにな
っている。
【0188】なお、ドラッグとは、ポインタ152を対
象物(ここではつまみ139)に合わせて、所定のマウ
スボタンを押したままポインタ152を移動させること
をいう。対象物は、ポインタ152と共に移動するよう
になっている。
象物(ここではつまみ139)に合わせて、所定のマウ
スボタンを押したままポインタ152を移動させること
をいう。対象物は、ポインタ152と共に移動するよう
になっている。
【0189】再生速度調節エリア140は、ピッチコン
トロール再生モードを設定するエリアである。再生速度
調節エリア140はスライドバーであって、つまみ14
1を備えている。学習者はマウス103を用いてつまみ
141を左右にドラッグすることにより、つまみ141
を左右にスライドさせることができる。
トロール再生モードを設定するエリアである。再生速度
調節エリア140はスライドバーであって、つまみ14
1を備えている。学習者はマウス103を用いてつまみ
141を左右にドラッグすることにより、つまみ141
を左右にスライドさせることができる。
【0190】つまみ141を左にスライドすると音声デ
ータの再生速度が遅くなり、つまみ141を右にスライ
ドすると音声データの再生速度が速くなる。つまみ14
1のデフォルトの位置は、スライド領域の中央(再生速
度が1倍に設定されている)となっている。再生速度は
±50[%]の範囲で調節できるようになっている。つ
まみ141を移動させて音声データの再生速度を変化さ
せてもDPCの作用により、音程は一定に保たれるよう
になっている。
ータの再生速度が遅くなり、つまみ141を右にスライ
ドすると音声データの再生速度が速くなる。つまみ14
1のデフォルトの位置は、スライド領域の中央(再生速
度が1倍に設定されている)となっている。再生速度は
±50[%]の範囲で調節できるようになっている。つ
まみ141を移動させて音声データの再生速度を変化さ
せてもDPCの作用により、音程は一定に保たれるよう
になっている。
【0191】センテンス番号表示エリア142は、現在
の再生しているセンテンスを表示するエリアである。セ
ンテンス番号は「現在再生しているセンテンス番号/総
センテンス数」で表示される。
の再生しているセンテンスを表示するエリアである。セ
ンテンス番号は「現在再生しているセンテンス番号/総
センテンス数」で表示される。
【0192】音声データの再生は、教材音声データを再
生する場合と、録音音声データを再生する場合がある
が、本実施例では、センテンス番号表示エリア142に
は教材音声データのセンテンス番号を表示するように構
成した。しかし、録音音声データのセンテンス番号を表
示するエリアを設けることも可能である。
生する場合と、録音音声データを再生する場合がある
が、本実施例では、センテンス番号表示エリア142に
は教材音声データのセンテンス番号を表示するように構
成した。しかし、録音音声データのセンテンス番号を表
示するエリアを設けることも可能である。
【0193】なお、センテンス番号の表示の他に、「現
在の再生位置の再生開始位置からの経過時間/音声デー
タの総再生時間」によって、現在の再生位置を表すこと
も可能である。
在の再生位置の再生開始位置からの経過時間/音声デー
タの総再生時間」によって、現在の再生位置を表すこと
も可能である。
【0194】波形表示エリア155は、教材音声データ
の音声波形を表示するエリアである。これは波形生成部
121が生成したものである。本実施例では、音声波形
を音声の強度により[dB]で表すこととした。図面上
下方向に強度を表す軸を、図面右方向に時間軸をとって
いる。
の音声波形を表示するエリアである。これは波形生成部
121が生成したものである。本実施例では、音声波形
を音声の強度により[dB]で表すこととした。図面上
下方向に強度を表す軸を、図面右方向に時間軸をとって
いる。
【0195】波形表示エリア155は再生カーソル15
7を備えている。再生カーソル157は、現在の再生位
置を表している。再生カーソル157の表示位置は、教
材音声データの再生の進行に従って変化し、画面左から
右方向へ移動する。
7を備えている。再生カーソル157は、現在の再生位
置を表している。再生カーソル157の表示位置は、教
材音声データの再生の進行に従って変化し、画面左から
右方向へ移動する。
【0196】波形表示エリア156は、学習者が録音し
た音声の音声波形を表示するエリアである。これは波形
生成部121が生成したものである。再生カーソル15
8の表示位置は、教材音声データの再生の進行に従って
変化し、画面左から右方向へ移動する。
た音声の音声波形を表示するエリアである。これは波形
生成部121が生成したものである。再生カーソル15
8の表示位置は、教材音声データの再生の進行に従って
変化し、画面左から右方向へ移動する。
【0197】音実施例では、波形表示エリア155と同
様に音声波形を音声の強度により[dB]で表すことと
した。強度を表す軸、時間軸のスケールも波形表示エリ
ア155と同じに設定している。
様に音声波形を音声の強度により[dB]で表すことと
した。強度を表す軸、時間軸のスケールも波形表示エリ
ア155と同じに設定している。
【0198】なお、図示しないが波形表示エリア155
と波形表示エリア156の強度を表す軸、時間軸のスケ
ールは変更することができる。これら軸のスケールは、
波形表示エリア155と波形表示エリア156で個別に
変更することもできるし、波形表示エリア155と波形
表示エリア156のスケールが同一になるように同期さ
せて変更させることもできる。
と波形表示エリア156の強度を表す軸、時間軸のスケ
ールは変更することができる。これら軸のスケールは、
波形表示エリア155と波形表示エリア156で個別に
変更することもできるし、波形表示エリア155と波形
表示エリア156のスケールが同一になるように同期さ
せて変更させることもできる。
【0199】波形表示エリア155と波形表示エリア1
56のスケールを同一に揃えると、両者の音声波形を同
一スケールで比較することができる。
56のスケールを同一に揃えると、両者の音声波形を同
一スケールで比較することができる。
【0200】以上のように、波形表示エリア155と波
形表示エリア156で、教材音声データと録音音声デー
タの音声波形を表示することにより、学習者は両者の音
声波形を比較することができる。
形表示エリア156で、教材音声データと録音音声デー
タの音声波形を表示することにより、学習者は両者の音
声波形を比較することができる。
【0201】学習者は、両者の波形を比較しながら自己
の録音音声波形を教材音声波形に近づけるように練習す
ることにより、正しい発音を身に付けることができる。
の録音音声波形を教材音声波形に近づけるように練習す
ることにより、正しい発音を身に付けることができる。
【0202】表示移動バー145は、波形表示エリア1
55、波形表示エリア156に表示されている音声波形
の表示位置を変化させるためのスライドバーである。表
示移動バー145はつまみ146を備えている。つまみ
146は、マウス操作でドラッグすることにより左右に
スライドさせることができるようになっている。
55、波形表示エリア156に表示されている音声波形
の表示位置を変化させるためのスライドバーである。表
示移動バー145はつまみ146を備えている。つまみ
146は、マウス操作でドラッグすることにより左右に
スライドさせることができるようになっている。
【0203】つまみ146を左にスライドさせると、波
形表示エリア155、波形表示エリア156に表示され
た音声波形が右方向に移動し、表示範囲を音声データの
開始位置方向に移動させることができる。
形表示エリア155、波形表示エリア156に表示され
た音声波形が右方向に移動し、表示範囲を音声データの
開始位置方向に移動させることができる。
【0204】逆につまみ146を右にスライドすると波
形表示エリア155、波形表示エリア156に表示され
た音声波形が左方向に移動し、表示範囲を音声データの
終了位置方向に移動させることができる。
形表示エリア155、波形表示エリア156に表示され
た音声波形が左方向に移動し、表示範囲を音声データの
終了位置方向に移動させることができる。
【0205】本実施例では、つまみ146をスライドす
ると波形表示エリア155と波形表示エリア156で表
示されている範囲が同期して移動し、学習者が教材の音
声波形と自己の音声波形を常に比較できるように構成し
たが、スライドバーを波形表示エリア155、波形表示
エリア156の両者に設け、波形図を別々に移動するよ
うに構成しても良い。
ると波形表示エリア155と波形表示エリア156で表
示されている範囲が同期して移動し、学習者が教材の音
声波形と自己の音声波形を常に比較できるように構成し
たが、スライドバーを波形表示エリア155、波形表示
エリア156の両者に設け、波形図を別々に移動するよ
うに構成しても良い。
【0206】拡大ボタン150は、波形表示エリア15
5と波形表示エリア156に表示された音声波形を拡大
するボタンである。拡大ボタン150をクリックする
と、波形表示エリア155と波形表示エリア156の強
度の軸、時間軸のスケールが変化し、これらエリアの中
央を中心としてそれぞれ音声波形が拡大される。
5と波形表示エリア156に表示された音声波形を拡大
するボタンである。拡大ボタン150をクリックする
と、波形表示エリア155と波形表示エリア156の強
度の軸、時間軸のスケールが変化し、これらエリアの中
央を中心としてそれぞれ音声波形が拡大される。
【0207】拡大ボタン150は、例えば、1.1倍、
1.3倍、1.5倍、・・・、などとクリックするごと
に段階的に音声波形を拡大できるようになっている。学
習者がLL教材の音声波形と自己の音声波形を比較し易
いように、波形表示エリア155と波形表示エリア15
6の拡大率は同一となるようになっている。なお、波形
表示エリア155と波形表示エリア156で拡大率を別
々に設定するように構成することも可能である。
1.3倍、1.5倍、・・・、などとクリックするごと
に段階的に音声波形を拡大できるようになっている。学
習者がLL教材の音声波形と自己の音声波形を比較し易
いように、波形表示エリア155と波形表示エリア15
6の拡大率は同一となるようになっている。なお、波形
表示エリア155と波形表示エリア156で拡大率を別
々に設定するように構成することも可能である。
【0208】縮小ボタン151は、波形表示エリア15
5と波形表示エリア156に表示された音声波形を縮小
するボタンである。縮小ボタン151をクリックする
と、波形表示エリア155と波形表示エリア156の強
度の軸と時間軸のスケールが変化し、これらエリアの中
央を中心としてそれぞれ音声波形が縮小される。
5と波形表示エリア156に表示された音声波形を縮小
するボタンである。縮小ボタン151をクリックする
と、波形表示エリア155と波形表示エリア156の強
度の軸と時間軸のスケールが変化し、これらエリアの中
央を中心としてそれぞれ音声波形が縮小される。
【0209】縮小ボタン151は、例えば、0.9倍、
0.7倍、0.5倍、・・・、などとクリックするごと
に段階的に音声波形を縮小できるようになっている。学
習者がLL教材の音声波形と自己の音声波形を比較し易
いように、波形表示エリア155と波形表示エリア15
6の縮小率は同一となるようになっている。なお、波形
表示エリア155と波形表示エリア156の縮小率を別
々に設定するように構成することも可能である
0.7倍、0.5倍、・・・、などとクリックするごと
に段階的に音声波形を縮小できるようになっている。学
習者がLL教材の音声波形と自己の音声波形を比較し易
いように、波形表示エリア155と波形表示エリア15
6の縮小率は同一となるようになっている。なお、波形
表示エリア155と波形表示エリア156の縮小率を別
々に設定するように構成することも可能である
【0210】プログラム表示エリア165は、LL教材
のうち、現在選択されているプログラム名とレッスン番
号を表示する欄である。プログラム表示エリア165を
参照することにより、学習者は、LL教材のどの部分を
学習しているのか知ることができる。
のうち、現在選択されているプログラム名とレッスン番
号を表示する欄である。プログラム表示エリア165を
参照することにより、学習者は、LL教材のどの部分を
学習しているのか知ることができる。
【0211】教材音声データ操作ボタン群160は、教
材音声データを操作するための各種ボタンから構成され
ている。これらのボタンは、教材音声データがセンテン
ス分けされている場合とされていない場合で機能が異な
る。以下に教材音声データがセンテンス分けされている
場合の機能について説明する。
材音声データを操作するための各種ボタンから構成され
ている。これらのボタンは、教材音声データがセンテン
ス分けされている場合とされていない場合で機能が異な
る。以下に教材音声データがセンテンス分けされている
場合の機能について説明する。
【0212】巻き戻しボタン171は、センテンスごと
に教材音声データを巻き戻すボタンである。巻き戻しボ
タン171を1回クリックすると、現在の再生位置か
ら、現在再生中のセンテンスの開始位置に再生位置が移
動する。
に教材音声データを巻き戻すボタンである。巻き戻しボ
タン171を1回クリックすると、現在の再生位置か
ら、現在再生中のセンテンスの開始位置に再生位置が移
動する。
【0213】巻き戻しボタン171を2回続けてクリッ
クすると、現在の再生位置のあるセンテンスの1つ前の
センテンスの開始位置に再生位置が設定される。このよ
うに、巻き戻しボタン171を複数回クリックすること
により、再生位置をセンテンス単位で教材音声データの
開始位置方向に移動させることができる。
クすると、現在の再生位置のあるセンテンスの1つ前の
センテンスの開始位置に再生位置が設定される。このよ
うに、巻き戻しボタン171を複数回クリックすること
により、再生位置をセンテンス単位で教材音声データの
開始位置方向に移動させることができる。
【0214】停止ボタン172は、教材音声データの再
生を停止するためのボタンである。停止ボタン172を
クリックすると、再生位置が現在再生中のセンテンスの
開始位置に移動した後、再生が停止する。
生を停止するためのボタンである。停止ボタン172を
クリックすると、再生位置が現在再生中のセンテンスの
開始位置に移動した後、再生が停止する。
【0215】早送りボタン173は、センテンスごとに
教材音声データを早送りするボタンである。早送りボタ
ン173を1回クリックすると、現在の再生位置から、
現在再生中のセンテンスの次のセンテンスの開始位置に
再生位置が移動する。
教材音声データを早送りするボタンである。早送りボタ
ン173を1回クリックすると、現在の再生位置から、
現在再生中のセンテンスの次のセンテンスの開始位置に
再生位置が移動する。
【0216】早送りボタン173を2回続けてクリック
すると、現在の再生位置のあるセンテンスの2つ先のセ
ンテンスの開始位置に再生位置が設定される。このよう
に、早送りボタン173を複数回クリックすることによ
り、再生位置をセンテンス単位で教材音声データの終了
位置方向に移動させることができる。
すると、現在の再生位置のあるセンテンスの2つ先のセ
ンテンスの開始位置に再生位置が設定される。このよう
に、早送りボタン173を複数回クリックすることによ
り、再生位置をセンテンス単位で教材音声データの終了
位置方向に移動させることができる。
【0217】リピート再生ボタン174は、教材音声デ
ータをリピート再生モードで再生するためのボタンであ
る。リピート再生ボタン174をクリックすると、教材
音声データはリピート再生モードにて再生される。
ータをリピート再生モードで再生するためのボタンであ
る。リピート再生ボタン174をクリックすると、教材
音声データはリピート再生モードにて再生される。
【0218】再生ボタン175は、教材音声データを通
し再生モードで再生するためのボタンである。
し再生モードで再生するためのボタンである。
【0219】一時停止ボタン176は、教材音声データ
の再生を一時停止状態にするためのボタンである。教材
音声データ再生中に一時停止ボタン176をクリックす
ると再生部16は、教材音声データの再生を一時停止す
る。再生位置は一時停止した時点の位置に保持される。
再度一時停止ボタン176をクリックすると再生部16
は、再生を一時停止した位置から教材音声データの再生
を再開する。
の再生を一時停止状態にするためのボタンである。教材
音声データ再生中に一時停止ボタン176をクリックす
ると再生部16は、教材音声データの再生を一時停止す
る。再生位置は一時停止した時点の位置に保持される。
再度一時停止ボタン176をクリックすると再生部16
は、再生を一時停止した位置から教材音声データの再生
を再開する。
【0220】センテンス再生ボタン177は、教材音声
データをセンテンス再生モードにて再生するボタンであ
る。
データをセンテンス再生モードにて再生するボタンであ
る。
【0221】また、図示しないが、センテンス再生モー
ド、リピート再生モードの他に、無音部スキップ再生モ
ード、ポーズ挿入再生モード用のボタンも備えてありこ
れらのモードでの再生も行えるようになっている。
ド、リピート再生モードの他に、無音部スキップ再生モ
ード、ポーズ挿入再生モード用のボタンも備えてありこ
れらのモードでの再生も行えるようになっている。
【0222】また、センテンスに関係なく、波形表示エ
リア155上で任意の区間を指定して教材音声データを
再生することもできる。区間指定は、波形表示エリア1
55上にポインタ152を置いて左右にドラッグするこ
とにより行う。
リア155上で任意の区間を指定して教材音声データを
再生することもできる。区間指定は、波形表示エリア1
55上にポインタ152を置いて左右にドラッグするこ
とにより行う。
【0223】波形表示エリア155では、ポインタ15
2がドラッグされた範囲の波形図の背景が変色しこの区
間が指定される。この状態で再生ボタン175をクリッ
クすると区間指定された部分のみ再生することができ
る。
2がドラッグされた範囲の波形図の背景が変色しこの区
間が指定される。この状態で再生ボタン175をクリッ
クすると区間指定された部分のみ再生することができ
る。
【0224】同期再生録音ボタン群161は、教材音声
データと録音音声データを同期させて操作するためのボ
タンから構成されている。
データと録音音声データを同期させて操作するためのボ
タンから構成されている。
【0225】同期再生ボタン184は、教材音声データ
と録音音声データを同期再生するボタンである。同期再
生ボタン184をクリックすると、波形表示エリア15
5に表示されている教材音声データと波形表示エリア1
56に表示されている録音音声データを同期再生するこ
とができる。即ち、教材音声データの開始位置と録音音
声データの開始位置を揃えて同時に再生することができ
る。
と録音音声データを同期再生するボタンである。同期再
生ボタン184をクリックすると、波形表示エリア15
5に表示されている教材音声データと波形表示エリア1
56に表示されている録音音声データを同期再生するこ
とができる。即ち、教材音声データの開始位置と録音音
声データの開始位置を揃えて同時に再生することができ
る。
【0226】本実例では、同期再生はセンテンスごとに
実行されるように構成した。即ち教材音声データのセン
テンスの開始位置から再生が開始し、終了位置に達する
と一時停止状態となる。録音音声データもこれに同期し
て再生され、教材音声データのセンテンスの開始位置に
対応する位置から再生が開始され、教材音声データのセ
ンテンスの終了位置に対応する位置で一時停止状態とな
る。
実行されるように構成した。即ち教材音声データのセン
テンスの開始位置から再生が開始し、終了位置に達する
と一時停止状態となる。録音音声データもこれに同期し
て再生され、教材音声データのセンテンスの開始位置に
対応する位置から再生が開始され、教材音声データのセ
ンテンスの終了位置に対応する位置で一時停止状態とな
る。
【0227】なお、これは、同期再生の方法をセンテン
スごとの再生に限定するものではなく、同期録音が複数
のセンテンスに渡って行われたときは、同期再生を当該
複数のセンテンスに渡って行うなど、同期録音の態様に
応じて同期再生を行うように構成することもできる。
スごとの再生に限定するものではなく、同期録音が複数
のセンテンスに渡って行われたときは、同期再生を当該
複数のセンテンスに渡って行うなど、同期録音の態様に
応じて同期再生を行うように構成することもできる。
【0228】また、教材音声データを任意の位置から再
生し、これに同期して録音音声を再生するように構成す
ることも可能である。これは、教材音声データの開始位
置と録音音声の開始位置が揃えてあるため、これら開始
位置を基準として、教材音声データの任意の位置を録音
音声データに対応させることができるためである。
生し、これに同期して録音音声を再生するように構成す
ることも可能である。これは、教材音声データの開始位
置と録音音声の開始位置が揃えてあるため、これら開始
位置を基準として、教材音声データの任意の位置を録音
音声データに対応させることができるためである。
【0229】例えば、教材音声データの任意の位置(位
置1とする)を、教材録音データの開始位置から計測し
(例えば開始位置からの経過時間、開始位置からのブロ
ック数など)する。そして、録音音声データの開始位置
から、先の計測で得られた計測値で特定される位置(位
置2とする)を取得する。教材音声データ上の位置1
は、録音音声データ上の位置2に対応する。
置1とする)を、教材録音データの開始位置から計測し
(例えば開始位置からの経過時間、開始位置からのブロ
ック数など)する。そして、録音音声データの開始位置
から、先の計測で得られた計測値で特定される位置(位
置2とする)を取得する。教材音声データ上の位置1
は、録音音声データ上の位置2に対応する。
【0230】教材音声データを任意の位置から再生する
場合は、まず、開始位置を基準とした教材音声データの
再生位置(位置1)を取得する。次に、開始位置を基準
とした録音音声データ上の対応する位置(位置2)を取
得する。そして、教材音声データを位置1から、録音音
声データを位置2から同時に再生する。
場合は、まず、開始位置を基準とした教材音声データの
再生位置(位置1)を取得する。次に、開始位置を基準
とした録音音声データ上の対応する位置(位置2)を取
得する。そして、教材音声データを位置1から、録音音
声データを位置2から同時に再生する。
【0231】これによって、教材音声データと録音音声
データを任意の再生位置から同期再生することができ
る。以上、同期再生することにより、学習者は、LL教
材の音声と自己の音声を比較することができる。
データを任意の再生位置から同期再生することができ
る。以上、同期再生することにより、学習者は、LL教
材の音声と自己の音声を比較することができる。
【0232】同期録音ボタン183は、教材音声データ
を再生しながら、教材音声データに同期して学習者の音
声を録音することができる。即ち、教材音声データの再
生と、録音音声データの生成が同時に開始する。そのた
め、教材音声データの開始位置と録音音声データの開始
位置を揃えることができる。
を再生しながら、教材音声データに同期して学習者の音
声を録音することができる。即ち、教材音声データの再
生と、録音音声データの生成が同時に開始する。そのた
め、教材音声データの開始位置と録音音声データの開始
位置を揃えることができる。
【0233】本実施例では、同期録音はセンテンスごと
に実行されるように構成した。即ち、教材音声データの
センテンスの再生が開始すると、これと同時に録音音声
データの生成が開始され、当該センテンスの再生が終了
すると、教材音声データの再生は停止する。一方録音音
声データの生成は、学習者が停止ボタン182をクリッ
クしたときに終了する。
に実行されるように構成した。即ち、教材音声データの
センテンスの再生が開始すると、これと同時に録音音声
データの生成が開始され、当該センテンスの再生が終了
すると、教材音声データの再生は停止する。一方録音音
声データの生成は、学習者が停止ボタン182をクリッ
クしたときに終了する。
【0234】なお、これは、同期再生の方法をセンテン
スごとの再生に限定するものではなく、例えば、ユーザ
が停止を指示するまで複数のセンテンスに渡って同期録
音するように構成することもできる。同期録音機能を用
いることにより、学習者は、教材音声データによる発音
例を聞いた後、教材音声データの無音部分で、発音例を
復唱し、これを録音することができる。
スごとの再生に限定するものではなく、例えば、ユーザ
が停止を指示するまで複数のセンテンスに渡って同期録
音するように構成することもできる。同期録音機能を用
いることにより、学習者は、教材音声データによる発音
例を聞いた後、教材音声データの無音部分で、発音例を
復唱し、これを録音することができる。
【0235】このようにして同期録音した録音音声デー
タと教材音声データを同期再生ボタン184をクリック
して再生すると、LL教材の発音例と学習者の発音が交
互に再生され、学習者は、自己の発音をLL教材の発音
と比較することができる。
タと教材音声データを同期再生ボタン184をクリック
して再生すると、LL教材の発音例と学習者の発音が交
互に再生され、学習者は、自己の発音をLL教材の発音
と比較することができる。
【0236】一時停止ボタン186は、同期再生状態、
又は同期録音状態を一時停止するボタンである。同期再
生ボタン184がクリックされて教材音声データと録音
音声データが同期再生されているときに一時停止ボタン
186をクリックすると、双方のデータの再生が一時停
止状態となる。この状態で同期再生ボタン184又は一
時停止ボタン186をクリックすると、双方のデータ
が、一時停止となっている位置から再生される。
又は同期録音状態を一時停止するボタンである。同期再
生ボタン184がクリックされて教材音声データと録音
音声データが同期再生されているときに一時停止ボタン
186をクリックすると、双方のデータの再生が一時停
止状態となる。この状態で同期再生ボタン184又は一
時停止ボタン186をクリックすると、双方のデータ
が、一時停止となっている位置から再生される。
【0237】同期録音ボタン183がクリックされて学
習者の音声を同期録音しているときに一時停止ボタン1
86をクリックすると、教材音声データの再生が一時停
止し、録音状態も一時停止する。この状態で同期録音ボ
タン183又は一時停止ボタン186をクリックする
と、教材音声データが一時停止となった位置から再生さ
れると共に、録音も一時停止となった位置から再開され
る。
習者の音声を同期録音しているときに一時停止ボタン1
86をクリックすると、教材音声データの再生が一時停
止し、録音状態も一時停止する。この状態で同期録音ボ
タン183又は一時停止ボタン186をクリックする
と、教材音声データが一時停止となった位置から再生さ
れると共に、録音も一時停止となった位置から再開され
る。
【0238】停止ボタン182は、同期再生状態、又は
同期録音状態を停止するボタンである。同期再生ボタン
184がクリックされて教材音声データと録音音声デー
タが同期再生されているときに停止ボタン182をクリ
ックすると、双方のデータの再生が停止状態となる。
同期録音状態を停止するボタンである。同期再生ボタン
184がクリックされて教材音声データと録音音声デー
タが同期再生されているときに停止ボタン182をクリ
ックすると、双方のデータの再生が停止状態となる。
【0239】また、同期録音ボタン183がクリックさ
れて学習者の音声を同期録音しているとき停止ボタン1
82をクリックすると、教材音声データの再生と録音状
態が停止する。
れて学習者の音声を同期録音しているとき停止ボタン1
82をクリックすると、教材音声データの再生と録音状
態が停止する。
【0240】以上に説明した同期再生、同期録音を用い
ることにより、同時通訳学習で用いられる「シャドウイ
ング」という学習方法を実現することができる。シャド
ウイングとは、モデルボイス(教材音声データを再生し
た音声)を聞きながら訳して話したり、あるいはモデル
ボイスを聞きながら、数秒遅れでモデルボイスを復唱す
る学習方法である。
ることにより、同時通訳学習で用いられる「シャドウイ
ング」という学習方法を実現することができる。シャド
ウイングとは、モデルボイス(教材音声データを再生し
た音声)を聞きながら訳して話したり、あるいはモデル
ボイスを聞きながら、数秒遅れでモデルボイスを復唱す
る学習方法である。
【0241】プログラム表示エリア190は、録音音声
データのうち、現在選択されているものを表示する欄で
ある。録音音声データは、LL教材のプログラム及びレ
ッスンに対応して生成されるようになっている。プログ
ラム表示エリア190には、当該録音音声データに対応
するプログラムとレッスンが表示される。
データのうち、現在選択されているものを表示する欄で
ある。録音音声データは、LL教材のプログラム及びレ
ッスンに対応して生成されるようになっている。プログ
ラム表示エリア190には、当該録音音声データに対応
するプログラムとレッスンが表示される。
【0242】録音音声データ操作ボタン群162は、録
音音声データを操作するための各種ボタンから構成され
ている。これらのボタンの機能は、録音音声データがセ
ンテンス分けさせている場合とされていない場合で異な
るが、以下では、録音音声データがセンテンス分けされ
ているものとして説明する。
音音声データを操作するための各種ボタンから構成され
ている。これらのボタンの機能は、録音音声データがセ
ンテンス分けさせている場合とされていない場合で異な
るが、以下では、録音音声データがセンテンス分けされ
ているものとして説明する。
【0243】録音ボタン198は、マイクロフォン11
9で検出した学習者の音声の録音を開始するボタンであ
る。録音を開始した後は、一時停止ボタン196をクリ
ックして録音を一時停止したり、停止ボタン192をク
リックして録音を停止することができる。
9で検出した学習者の音声の録音を開始するボタンであ
る。録音を開始した後は、一時停止ボタン196をクリ
ックして録音を一時停止したり、停止ボタン192をク
リックして録音を停止することができる。
【0244】録音音声データは、保存してあった音声フ
ァイルを開いてこれに上書きしても良いし、あるいは、
新規の音声ファイルを生成してこれに書き込むこともで
きる。
ァイルを開いてこれに上書きしても良いし、あるいは、
新規の音声ファイルを生成してこれに書き込むこともで
きる。
【0245】録音を一時停止した場合は録音ボタン19
8又は一時停止ボタン196をクリックすると一時停止
状態を解除し録音を再開することができる。録音を停止
した後、再度録音を再開すると、先に録音した音声デー
タは自動的に消去され、新しい音声データが記録され
る。
8又は一時停止ボタン196をクリックすると一時停止
状態を解除し録音を再開することができる。録音を停止
した後、再度録音を再開すると、先に録音した音声デー
タは自動的に消去され、新しい音声データが記録され
る。
【0246】巻き戻しボタン191は、録音音声データ
の再生位置をセンテンス単位で録音音声データ開始位置
方向に移動させるボタンであり、基本的機能は巻き戻し
ボタン171と同じである。
の再生位置をセンテンス単位で録音音声データ開始位置
方向に移動させるボタンであり、基本的機能は巻き戻し
ボタン171と同じである。
【0247】停止ボタン192は、録音音声データの再
生を停止したり、あるいは録音を停止するためのボタン
である。早送りボタン193は、録音音声データの再生
位置をセンテンス単位で録音音声データ終了位置方向に
移動させるためのボタンであり、基本的機能は早送りボ
タン173と同様である。
生を停止したり、あるいは録音を停止するためのボタン
である。早送りボタン193は、録音音声データの再生
位置をセンテンス単位で録音音声データ終了位置方向に
移動させるためのボタンであり、基本的機能は早送りボ
タン173と同様である。
【0248】リピート再生ボタン194は、録音音声デ
ータをリピート再生モードで再生するためのボタンであ
り、基本的機能はリピート再生ボタン174と同様であ
る。再生ボタン195は、録音音声データを通し再生モ
ードで再生するためのボタンであり、基本的機能はリピ
ート再生ボタン174と同様である。
ータをリピート再生モードで再生するためのボタンであ
り、基本的機能はリピート再生ボタン174と同様であ
る。再生ボタン195は、録音音声データを通し再生モ
ードで再生するためのボタンであり、基本的機能はリピ
ート再生ボタン174と同様である。
【0249】一時停止ボタン196は、録音状態を一時
停止する他は、録音音声データの再生を一時停止するな
ど基本的機能は一時停止ボタン176と同様である。セ
ンテンス再生ボタン197は、録音音声データをセンテ
ンス再生するボタンであり、基本的機能はセンテンス再
生ボタン177と同様である。
停止する他は、録音音声データの再生を一時停止するな
ど基本的機能は一時停止ボタン176と同様である。セ
ンテンス再生ボタン197は、録音音声データをセンテ
ンス再生するボタンであり、基本的機能はセンテンス再
生ボタン177と同様である。
【0250】また、センテンスに関係なく、波形表示エ
リア156上で任意の区間を指定して再生することもで
きる。区間指定は、波形表示エリア156上にポインタ
152を置いて左右にドラッグすることにより行う。
リア156上で任意の区間を指定して再生することもで
きる。区間指定は、波形表示エリア156上にポインタ
152を置いて左右にドラッグすることにより行う。
【0251】波形表示エリア156上では、ポインタ1
52がドラッグされた範囲の波形図の背景が変色しこの
区間が指定される。この状態で再生ボタン195をクリ
ックすると区間指定された部分のみ再生することができ
る。
52がドラッグされた範囲の波形図の背景が変色しこの
区間が指定される。この状態で再生ボタン195をクリ
ックすると区間指定された部分のみ再生することができ
る。
【0252】メニュー欄201は、ファイルメニュー2
02、セッティングメニュー203、ツールメニュー2
04、ヘルプメニュー205の各ドロップダウンメニュ
ーから構成されている。
02、セッティングメニュー203、ツールメニュー2
04、ヘルプメニュー205の各ドロップダウンメニュ
ーから構成されている。
【0253】ファイルメニュー202をクリックすると
「録音用ファイル新規作成」、「教材音声データを開
く」、「録音音声データを開く」、「録音音声データの
保存」、「終了」などのサブメニューがドロップダウン
メニューとして表示される。
「録音用ファイル新規作成」、「教材音声データを開
く」、「録音音声データを開く」、「録音音声データの
保存」、「終了」などのサブメニューがドロップダウン
メニューとして表示される。
【0254】「録音用ファイル新規作成」をクリックす
ると録音用のファイルが新規に生成される。この録音用
ファイルは、学習者が自己の音声を録音し、その音声デ
ータを格納するためのファイルである。このファイルに
対して学習者が録音を開始すると、その音声波形は波形
表示エリア156に表示される。
ると録音用のファイルが新規に生成される。この録音用
ファイルは、学習者が自己の音声を録音し、その音声デ
ータを格納するためのファイルである。このファイルに
対して学習者が録音を開始すると、その音声波形は波形
表示エリア156に表示される。
【0255】「教材音声データを開く」、「録音音声デ
ータを開く」の各サブメニューが提供する機能は、それ
ぞれ開くボタン133、開くボタン134が提供する機
能と同様である。「録音音声データの保存」が提供する
機能は保存ボタン135と同様である。「終了」は、音
声データ処理システム5aを終了する機能を提供する。
ータを開く」の各サブメニューが提供する機能は、それ
ぞれ開くボタン133、開くボタン134が提供する機
能と同様である。「録音音声データの保存」が提供する
機能は保存ボタン135と同様である。「終了」は、音
声データ処理システム5aを終了する機能を提供する。
【0256】セッティングメニュー203をクリックす
ると「デバイス設定」、「システム設定」などのサブメ
ニューがドロップダウンメニューとして表示される。
「デバイス設定」を選択すると、音声録音時のデバイス
の設定及びサンプリングレートなどを設定することがで
きる。「システム設定」を選択すると、識別条件1〜識
別条件3の各閾値を設定することができる。
ると「デバイス設定」、「システム設定」などのサブメ
ニューがドロップダウンメニューとして表示される。
「デバイス設定」を選択すると、音声録音時のデバイス
の設定及びサンプリングレートなどを設定することがで
きる。「システム設定」を選択すると、識別条件1〜識
別条件3の各閾値を設定することができる。
【0257】ツールメニュー204は、「センテンスス
キャン」がドロップダウンメニューとして表示される。
「センテンススキャン」を選択すると、現在システムに
読み込んでいる教材音声データや録音音声データを選択
してセンテンス分けすることができる。既に、テーマフ
ァイルが作成されている場合は、新規に作成したテーマ
ファイルで上書きされる。
キャン」がドロップダウンメニューとして表示される。
「センテンススキャン」を選択すると、現在システムに
読み込んでいる教材音声データや録音音声データを選択
してセンテンス分けすることができる。既に、テーマフ
ァイルが作成されている場合は、新規に作成したテーマ
ファイルで上書きされる。
【0258】ヘルプメニュー205は、「ヘルプ」、
「バージョン情報」がドロップダウンメニューとして表
示される。「ヘルプ」を選択すると、音声データ処理シ
ステム5aの操作方法などに関するヘルプ画面を表示す
ることができる。
「バージョン情報」がドロップダウンメニューとして表
示される。「ヘルプ」を選択すると、音声データ処理シ
ステム5aの操作方法などに関するヘルプ画面を表示す
ることができる。
【0259】学習者はヘルプ画面でキーワード検索など
を行い、所望の情報を取得することができる。「バージ
ョン情報」を選択すると、音声データ処理システム5a
のバージョン情報を表示することができる。また、教材
音声データに、教材で発話される内容を文字にて記録し
たスクリプト情報を備えておき、教材音声データの再生
に同期してスクリプトを表示するように構成することも
できる。
を行い、所望の情報を取得することができる。「バージ
ョン情報」を選択すると、音声データ処理システム5a
のバージョン情報を表示することができる。また、教材
音声データに、教材で発話される内容を文字にて記録し
たスクリプト情報を備えておき、教材音声データの再生
に同期してスクリプトを表示するように構成することも
できる。
【0260】図13は、音声波形の表示形態の他の例を
説明するための図である。波形生成部121は、音声の
強弱を波形図化したが、音声の波形表示形態はこれに限
定するものではなく、例えば音声の周波数成分を表示す
ることもできる。
説明するための図である。波形生成部121は、音声の
強弱を波形図化したが、音声の波形表示形態はこれに限
定するものではなく、例えば音声の周波数成分を表示す
ることもできる。
【0261】人間は、発話された単語を耳で聞き取り、
その単語を識別する。ところで、言語によって、単語の
識別性を発揮する周波数帯域が異なる場合がある。例え
ば英語は日本語に比べて高い周波数帯域が単語の認識に
用いられていることが知られている。そのため、学習対
象である外国語を周波数成分において真似ることは重要
である。
その単語を識別する。ところで、言語によって、単語の
識別性を発揮する周波数帯域が異なる場合がある。例え
ば英語は日本語に比べて高い周波数帯域が単語の認識に
用いられていることが知られている。そのため、学習対
象である外国語を周波数成分において真似ることは重要
である。
【0262】図13は、発話された単語の周波数成分を
表示したものである。図のように周波数軸、強度軸、時
間軸の3次元的なグラフとなる。音声データの周波数成
分への分解は、例えばFFT(Fast Fourie
r Transform)などのアルゴリズムを用いて
音声データを解析する機能を波形生成部121に備え
る。
表示したものである。図のように周波数軸、強度軸、時
間軸の3次元的なグラフとなる。音声データの周波数成
分への分解は、例えばFFT(Fast Fourie
r Transform)などのアルゴリズムを用いて
音声データを解析する機能を波形生成部121に備え
る。
【0263】図14は、録音音声データをセンテンス検
出する場合の動作を説明するためのフローチャートであ
る。まず、CPU111が所定のプログラムに従ってフ
ァイル保存形式ダイアログを学習者に提示し、ファイル
形式(WAVE形式、MP3形式など)を選択させる
(ステップ100)。
出する場合の動作を説明するためのフローチャートであ
る。まず、CPU111が所定のプログラムに従ってフ
ァイル保存形式ダイアログを学習者に提示し、ファイル
形式(WAVE形式、MP3形式など)を選択させる
(ステップ100)。
【0264】次に、マイクロフォン119で学習者の音
声を検出してデジタル音声データ生成部7でこれをデジ
タル信号に変換し、録音する(ステップ105)。次
に、一時格納部120がステップ100で選択されたフ
ァイル形式にて音声ファイルを生成する(ステップ11
0)。
声を検出してデジタル音声データ生成部7でこれをデジ
タル信号に変換し、録音する(ステップ105)。次
に、一時格納部120がステップ100で選択されたフ
ァイル形式にて音声ファイルを生成する(ステップ11
0)。
【0265】次に、CPU111が所定のプログラムに
従ってセンテンス検出ダイアログを学習者に提示し、生
成した音声ファイルでセンテンス検出するか否かを選択
させる(ステップ115)。センテンス検出しない場合
は(ステップ115;N)、処理を終了する。
従ってセンテンス検出ダイアログを学習者に提示し、生
成した音声ファイルでセンテンス検出するか否かを選択
させる(ステップ115)。センテンス検出しない場合
は(ステップ115;N)、処理を終了する。
【0266】センテンス検出する場合は(ステップ11
5;Y)、区分設定部12が識別条件1、2、3により
無音部分を検出して境界位置を設定することによりセン
テンス検出する(ステップ120)。
5;Y)、区分設定部12が識別条件1、2、3により
無音部分を検出して境界位置を設定することによりセン
テンス検出する(ステップ120)。
【0267】次に、区分設定部12がセンテンス検出し
た各センテンスのセンテンス番号と、当該センテンスの
開始位置及び終了位置を記録したテーマファイルを生成
して(ステップ125)、処理を終了する。
た各センテンスのセンテンス番号と、当該センテンスの
開始位置及び終了位置を記録したテーマファイルを生成
して(ステップ125)、処理を終了する。
【0268】図15は、音声データ処理システム5aを
インターネットを介して構成した一例を示した図であ
る。実施例では、LL教室内で教師用PC75と学習者
用PC80をLAN88で接続して音声データ処理シス
テム5aを構成した。
インターネットを介して構成した一例を示した図であ
る。実施例では、LL教室内で教師用PC75と学習者
用PC80をLAN88で接続して音声データ処理シス
テム5aを構成した。
【0269】音声データ処理システム5aは、LAN8
8の代わりにインターネット211を用いることによ
り、LL教室内に限定せずに構築することができる。こ
の場合、教師用PC75はLLサーバ210となり、学
習者の学習者用PC80は、端末212となる。
8の代わりにインターネット211を用いることによ
り、LL教室内に限定せずに構築することができる。こ
の場合、教師用PC75はLLサーバ210となり、学
習者の学習者用PC80は、端末212となる。
【0270】LLサーバ210は、端末212に教材音
声データとテーマファイルを送信する。学習者は端末2
12で送られてきた教材音声データを用いてLL学習を
行う。学習者は課題などになっている録音音声データを
教師に提出する場合は、録音音声データを端末212か
らLLサーバ210に送信する。
声データとテーマファイルを送信する。学習者は端末2
12で送られてきた教材音声データを用いてLL学習を
行う。学習者は課題などになっている録音音声データを
教師に提出する場合は、録音音声データを端末212か
らLLサーバ210に送信する。
【0271】このように、インターネットを介して音声
データ処理システム5aを構築すると、LL教室を用意
する必要がなく、学習者は自宅などでLL教育を受ける
ことができる。
データ処理システム5aを構築すると、LL教室を用意
する必要がなく、学習者は自宅などでLL教育を受ける
ことができる。
【0272】以上に説明した実施の形態及び実施例によ
り以下のような効果を得ることができる。音声データか
らセンテンスの切れ目を自動検出し、センテンス分けす
ることができる。センテンス検出することにより、リピ
ート再生モード、センテンス再生モードなどの各種再生
モードを実現することができる。
り以下のような効果を得ることができる。音声データか
らセンテンスの切れ目を自動検出し、センテンス分けす
ることができる。センテンス検出することにより、リピ
ート再生モード、センテンス再生モードなどの各種再生
モードを実現することができる。
【0273】リピート再生モードやセンテンス再生モー
ドなどの語学学習に特化した再生モードを実現したこと
により、学習者は、教材を繰り返し聞き、繰り返し話す
ことができ、高い学習効果が期待できる。
ドなどの語学学習に特化した再生モードを実現したこと
により、学習者は、教材を繰り返し聞き、繰り返し話す
ことができ、高い学習効果が期待できる。
【0274】同期再生、同期録音などにより、学習者は
シャドウイングを行うことができる。高圧縮音声ファイ
ルフォーマットに対応することにより、記憶媒体に教材
音声データを記憶させ自宅への持ち帰ることが容易にな
る。
シャドウイングを行うことができる。高圧縮音声ファイ
ルフォーマットに対応することにより、記憶媒体に教材
音声データを記憶させ自宅への持ち帰ることが容易にな
る。
【0275】コンピュータリテラシー教育用に設置した
コンピュータ教室をLL教室として利用することがで
き、費用と場所の節減を図ることができる。また、学習
者の音声を録音して音声波形図を生成することができる
ため、教材音声データの波形図と比較しながら発音の矯
正を行うことができる。
コンピュータ教室をLL教室として利用することがで
き、費用と場所の節減を図ることができる。また、学習
者の音声を録音して音声波形図を生成することができる
ため、教材音声データの波形図と比較しながら発音の矯
正を行うことができる。
【0276】高圧縮音声ファイルフォーマットへ対応す
ることにより、インターネットなどを用いて、教材音声
データを送信することができ、遠隔語学教育という新た
なマーケットを開拓することができる。
ることにより、インターネットなどを用いて、教材音声
データを送信することができ、遠隔語学教育という新た
なマーケットを開拓することができる。
【0277】教材音声データの学習者に販売することに
より(インターネットでのダウンロードなど)、1校あ
たりの学習者数を急激に増加することができる。教室の
みにインストールした場合、受講者は60名程度だが、
その授業を受講する学習者は何百人といる。
より(インターネットでのダウンロードなど)、1校あ
たりの学習者数を急激に増加することができる。教室の
みにインストールした場合、受講者は60名程度だが、
その授業を受講する学習者は何百人といる。
【0278】以上、本発明の1実施形態及び1実施例に
ついて説明したが、本発明は説明した実施形態及び実施
例に限定されるものではなく、各請求項に記載した範囲
において各種の変形を行うことが可能である。
ついて説明したが、本発明は説明した実施形態及び実施
例に限定されるものではなく、各請求項に記載した範囲
において各種の変形を行うことが可能である。
【0279】例えば、音声データ処理システム5、音声
データ処理システム5aは、LL教室以外にも聾唖者の
発話訓練システムとして利用することもできる。聾唖者
は、モデルボイスの波形と自己の音声の波形を比較しな
がら発音練習を行っている。そこで、音声データ処理シ
ステム5aを用いることにより、ユーザは、聾唖者用の
発話練習教材をセンテンス分けし、波形図を見ながら繰
り返し発音練習を行うことができる。
データ処理システム5aは、LL教室以外にも聾唖者の
発話訓練システムとして利用することもできる。聾唖者
は、モデルボイスの波形と自己の音声の波形を比較しな
がら発音練習を行っている。そこで、音声データ処理シ
ステム5aを用いることにより、ユーザは、聾唖者用の
発話練習教材をセンテンス分けし、波形図を見ながら繰
り返し発音練習を行うことができる。
【発明の効果】本発明によれば、デジタル信号で記録さ
れた音声データを自動的にセンテンス分けすることがで
きる。
れた音声データを自動的にセンテンス分けすることがで
きる。
【図1】本実施の形態に係る音声データ処理システムの
構成を示した図である。
構成を示した図である。
【図2】(a)は、教材音声データの波形図の一例を示
した図である。(b)〜(e)は、境界位置の設定位置
を説明するための図である。
した図である。(b)〜(e)は、境界位置の設定位置
を説明するための図である。
【図3】テーマファイルの一例を示した図である。
【図4】テーマファイルの構成を説明するための図であ
る。
る。
【図5】(a)〜(d)は、各再生モードを説明するた
めの図である。
めの図である。
【図6】(a)、(b)は、ピッチコントロール再生モ
ードを説明するための図である。
ードを説明するための図である。
【図7】センテンス分けの手順を説明するためのフロー
チャートである。
チャートである。
【図8】センテンス分けされた音声データの再生手順を
説明するためのフローチャートである。
説明するためのフローチャートである。
【図9】本実施例に係るLL教室システムのシステム構
成を示した図である。
成を示した図である。
【図10】学習者用PCの構成の一例を示した図であ
る。
る。
【図11】本実施例に係る音声データ処理システムの構
成を示した図である。
成を示した図である。
【図12】操作画面の一例を示した図である。
【図13】音声波形の表示形態の他の例を説明するため
の図である。
の図である。
【図14】録音音声データをセンテンス検出動作を説明
するためのフローチャートである。
するためのフローチャートである。
【図15】 音声データ処理システムをインターネット
を介して構成した一例を示した図である。
を介して構成した一例を示した図である。
5 音声データ処理システム
6 アナログ音声データ入力部
7 デジタル音声データ生成部
8 デジタル音声データ入力部
10 音声データ格納部
11 識別条件入力部
12 区分設定部
15 境界位置設定部
16 再生部
17 再生モード入力部
18 出力部
21 有音部分
22 無音部分
25 境界位置
26 境界位置
27 境界位置
28 境界位置
31 列
32 列
33 列
34 列
35 列
41 センテンス
42 センテンス
43 センテンス
45 無音部分
46 センテンス
47 無音部分
48 センテンス
49 無音部分
50 センテンス
53 センテンス
54 ポーズ
55 センテンス
56 ポーズ
57 センテンス
58 ポーズ
59 センテンス
61 センテンス
62 センテンス
63 センテンス
71 LL教室システム
72 教師側端末群
73 学習者側端末群
75 教師用PC
76 コントロールPC
77 コントロールユニット
78 AV機器
80 学習者用PC
81 接続装置
82 ヘッドセット
85 プロジェクター
86 スピーカ
88 LAN
101 制御部
102 キーボード
103 マウス
104 表示装置
105 印刷装置
106 記憶装置
107 記憶媒体駆動装置
108 通信制御装置
109 入出力インターフェース
111 CPU
112 ROM
113 RAM
114 バスライン
115 プログラム格納部
116 データ格納部
118 ヘッドフォン
119 マイクロフォン
120 一時格納部
121 波形生成部
122 ファイル保存部
123 ディスプレイ
124 保存ボタン
125 録音ボタン
130 操作画面
133 開くボタン
134 開くボタン
135 保存ボタン
138 音量調節エリア
139 つまみ
140 再生速度調節エリア
141 つまみ
142 センテンス番号表示エリア
145 表示移動バー
146 つまみ
150 拡大ボタン
151 縮小ボタン
155 波形表示エリア
156 波形表示エリア
157 再生カーソル
158 再生カーソル
165 プログラム表示エリア
171 巻き戻しボタン
172 停止ボタン
173 早送りボタン
174 リピート再生ボタン
175 再生ボタン
176 一時停止ボタン
177 センテンス再生ボタン
182 停止ボタン
183 同期録音ボタン
184 同期再生ボタン
186 一時停止ボタン
191 巻き戻しボタン
192 停止ボタン
193 早送りボタン
194 リピート再生ボタン
195 再生ボタン
196 一時停止ボタン
197 センテンス再生ボタン
198 録音ボタン
201 メニュー欄
202 ファイルメニュー
203 セッティングメニュー
204 ツールメニュー
205 ヘルプメニュー
─────────────────────────────────────────────────────
フロントページの続き
(51)Int.Cl.7 識別記号 FI テーマコート゛(参考)
G10L 21/06 G10L 3/00 N
Fターム(参考) 2C028 AA03 AA06 BA03 BB07 BC05
BD02 BD03 CA09 CA10 CA11
CB04 DA02 DA04
5D045 AB12 DB01
Claims (61)
- 【請求項1】 ホストコンピュータと端末がネットワー
クにて接続可能に配設された語学教育システムであっ
て、 前記ホストコンピュータは、 デジタル信号により生成された音声データを取得する音
声データ取得手段と、 前記音声データに区分を設定する区分情報を取得する区
分情報取得手段と、 前記取得した音声データと前記区分情報を前記端末に送
信するホスト側送信手段と、 を具備し、 前記端末は、前記送信された音声データと前記送信され
た区分情報を受信する端末側受信手段と、 前記音声データを前記区分情報による区分単位で再生す
る再生手段と、 を具備したことを特徴とする語学教育システム。 - 【請求項2】 前記ホストコンピュータは、前記取得し
た音声データの無音部分を検出する検出手段と、 前記検出した無音部分を用いて、前記区分情報を生成す
る区分情報生成手段と、 を備え、 前記区分情報取得手段は、前記区分情報生成手段から、
前記区分情報を取得することを特徴とする請求項1に記
載の語学教育システム。 - 【請求項3】 前記端末は、 音声を取得する音声取得手段と、 前記取得した音声からデジタル信号による録音音声デー
タを生成する録音音声データ生成手段と、 前記生成した録音音声データの無音部分を検出する検出
手段と、 前記検出部分を用いて、前記録音音声データの区分情報
を生成する区分情報生成手段と、 前記生成した区分情報を用いて、前記録音音声データを
前記区分ごとに再生する再生手段と、 を具備したことを特徴とする請求項1に記載の語学教育
システム。 - 【請求項4】 前記端末は、 前記録音音声データ生成手段で生成した録音音声データ
と、 前記区分情報生成手段で生成した区分情報と、 を前記ホストコンピュータに送信する端末側送信手段
と、 を具備したことを特徴とする請求項3に記載の語学教育
システム。 - 【請求項5】 前記端末側送信手段は、 前記区分情報生成手段で生成した区分情報を用いて、前
記録音音声データ生成手段で生成した録音音声データの
うち、前記検出手段で検出した無音部分を除いた部分を
前記ホストコンピュータに送信することを特徴とする請
求項3に記載の語学教育システム。 - 【請求項6】 デジタル信号により生成された音声デー
タを取得する音声データ取得手段と、 前記取得した音声データの無音部分を検出する検出手段
と、 前記検出した無音部分を用いて、前記音声データに区分
を設定する区分情報を生成する区分情報生成手段と、 を具備したことを特徴とする音声データ処理装置。 - 【請求項7】 前記検出手段は、前記取得した音声デー
タにおいて、所定の閾値より小さい音量の状態の継続時
間が所定の時間より長く継続する部分、及び、所定の閾
値より大きい音量の状態の継続時間が所定の時間より短
い部分の少なくとも1つを無音部分として検出すること
を特徴とする請求項6に記載の音声データ処理装置。 - 【請求項8】 前記区分情報生成手段は、前記無音部分
の開始位置、又は前記無音部分の終了位置から350ミ
リ秒以上前に前記区分の境界位置を設定することを特徴
とする請求項6に記載の音声データ処理装置。 - 【請求項9】 前記取得した音声データを、前記生成し
た区分情報による区分単位で再生する再生手段を具備し
たことを特徴とする請求項6に記載の音声データ処理装
置。 - 【請求項10】 デジタル信号により生成された音声デ
ータを取得する音声データ取得手段と、 前記取得した音声データに区分を設定する区分情報を取
得する区分情報取得手段と、 前記音声データを、前記取得した区分情報による区分単
位で再生する再生手段と、 を具備した音声データ処理装置。 - 【請求項11】 前記再生手段は、最後に再生した区分
を特定する再生情報を記憶する記憶手段と、 前記記憶した再生情報で特定される前記最後に再生した
区分の次の区分を再生する区分順再生手段と、 を具備したことを特徴とする請求項10に記載の音声デ
ータ処理装置。 - 【請求項12】 前記再生手段は、最後に再生した区分
を特定する再生情報を記憶する記憶手段と、 前記記憶した再生情報で特定される前記最後に再生した
区分を再度再生する繰り返し再生手段と、 を具備したことを特徴とする請求項10に記載の音声デ
ータ処理装置。 - 【請求項13】 前記音声データにおいて再生範囲を指
定する再生範囲指定手段を更に具備し、 前記再生手段は、前記再生範囲指定手段で指定された再
生範囲を、前記区分に関係なく再生することを特徴とす
る請求項10に記載の音声データ処理装置。 - 【請求項14】 音声データを再生する再生手段と、 音声を取得する音声取得手段と、 前記取得した音声からデジタル信号による録音音声デー
タを生成する録音音声データ生成手段と、 前記生成した録音音声データを保持する保持手段と、 を具備し、 前記音声データ生成手段は、前記再生手段にて再生され
ている前記音声データに同期して前記録音音声データを
生成することを特徴とする音声データ処理装置。 - 【請求項15】 前記再生手段は、前記音声データに区
分を設定する区分情報を用いて、前記音声データを区分
単位で再生することを特徴とする請求項14に記載の音
声データ処理装置。 - 【請求項16】 前記音声データの波形図と、前記録音
音声データの音声波形図と、を比較可能に表示する表示
手段を具備したことを特徴とする請求項14に記載の音
声データ処理装置。 - 【請求項17】 前記録音音声データ生成手段の作動状
態と停止状態を切替える切替え手段を具備し、前記切替
え手段で前記作動状態と停止状態を繰り返し切替える場
合に、前記保持手段は、先に前記保持した録音音声デー
タを記憶手段に記憶するか否かの確認を行わずに、新規
の録音音声データの保持を行うことを特徴とする請求項
14に記載の音声データ処理装置。 - 【請求項18】 前記生成した録音音声データの無音部
分を検出する検出手段と、 前記検出した無音部分を用いて、前記録音音声データに
区分を設定する区分情報を生成する区分情報生成手段
と、 前記生成した録音音声データを、前記生成した区分情報
による区分単位で再生する録音音声データ再生手段を具
備したことを特徴とする請求項14に記載の音声データ
処理装置。 - 【請求項19】 前記検出手段は、前記取得した録音音
声データにおいて、所定の閾値より小さい音量の状態の
継続時間が所定の時間より長く継続する部分、及び、所
定の閾値より大きい音量の状態の継続時間が所定の時間
より短い部分の少なくとも1つを無音部分として検出す
ることを特徴とする請求項14に記載の音声データ処理
装置。 - 【請求項20】 音声データ取得手段と、検出手段と、
区分情報生成手段とを備えたコンピュータにおいて、 前記音声データ取得手段で、デジタル信号により生成さ
れた音声データを取得する音声データ取得ステップと、 前記検出手段で、前記取得した音声データの無音部分を
検出する検出ステップと、 前記区分情報生成手段で、前記検出した無音部分を用い
て、前記音声データに区分を設定する区分情報を生成す
る区分情報生成ステップと、 から構成されたことを特徴とする音声データ処理方法。 - 【請求項21】 前記検出ステップは、前記取得した音
声データにおいて、所定の閾値より小さい音量の状態の
継続時間が所定の時間より長く継続する部分、及び、所
定の閾値より大きい音量の状態の継続時間が所定の時間
より短い部分の少なくとも1つを無音部分として検出す
ることを特徴とする請求項20に記載の音声データ処理
方法。 - 【請求項22】 前記区分情報生成ステップは、前記無
音部分の開始位置、又は前記無音部分の終了位置から3
50ミリ秒以上前に前記区分の境界位置を設定すること
を特徴とする請求項20に記載の音声データ処理方法。 - 【請求項23】 前記コンピュータは再生手段を更に具
備し、 前記再生手段で、前記取得した音声データを、前記生成
した区分情報による区分単位で再生する再生ステップを
備えたことを特徴とする請求項20に記載の音声データ
処理方法。 - 【請求項24】 音声データ取得手段と、区分情報取得
手段と、再生手段を具備したコンピュータにおいて、 前記音声データ取得手段で、デジタル信号により生成さ
れた音声データを取得する音声データ取得ステップと、 前記区分情報取得手段で、前記取得した音声データに区
分を設定する区分情報を取得する区分情報取得ステップ
と、 前記再生手段で、前記音声データを、前記取得した区分
情報による区分単位で再生する再生ステップと、 から構成されたことを特徴とする音声データ処理方法。 - 【請求項25】 前記コンピュータは、記憶手段と区分
順再生手段を備え、 前記再生ステップは、最後に再生した区分を特定する再
生情報を前記記憶手段で記憶する記憶ステップと、 前記記憶した再生情報で特定される前記最後に再生した
区分の次の区分を前記区分順再生手段で再生する区分順
再生ステップと、 から構成されたことを特徴とする請求項24に記載の音
声データ処理方法。 - 【請求項26】 前記コンピュータは、記憶手段と繰り
返し再生手段を備え、 前記再生ステップは、最後に再生した区分を特定する再
生情報を前記記憶手段で記憶する記憶ステップと、 前記記憶した再生情報で特定される前記最後に再生した
区分を前記繰り返し再生手段で再度再生する繰り返し再
生ステップと、 から構成されたことを特徴とする請求項24に記載の音
声データ処理方法。 - 【請求項27】 前記コンピュータは、再生範囲指定手
段を備え、 前記再生範囲指定手段で、前記音声データにおいて再生
範囲を指定する再生範囲指定ステップを更に備え、 前記再生ステップは、前記再生範囲指定手段で指定され
た再生範囲を、前記区分に関係なく再生することを特徴
とする請求項24に記載の音声データ処理方法。 - 【請求項28】 再生手段と、音声取得手段と、録音音
声データ生成手段と、保持手段と、を備えたコンピュー
タにおいて、 前記再生手段で、音声データを再生する再生ステップ
と、 前記音声取得手段で、音声を取得する音声取得ステップ
と、 前記録音音声データ生成手段で、前記取得した音声から
デジタル信号による録音音声データを生成する録音音声
データ生成ステップと、 前記保持手段で、前記生成した録音音声データを保持す
る保持ステップと、 から構成され、 前記音声データ生成ステップは、前記再生手段にて再生
されている前記音声データに同期して前記録音音声デー
タを生成することを特徴とする音声データ処理方法。 - 【請求項29】 前記再生ステップは、前記音声データ
に区分を設定する区分情報を用いて、前記音声データを
区分単位で再生することを特徴とする請求項28に記載
の音声データ処理方法。 - 【請求項30】 前記コンピュータは、表示手段を備
え、 前記音声データの波形図と、前記録音音声データの音声
波形図と、を前記表示手段で比較可能に表示する表示ス
テップを備えたことを特徴とする請求項28に記載の音
声データ処理方法。 - 【請求項31】 前記録音音声データ生成ステップの作
動状態と停止状態を切替える切替え手段を具備し、前記
切替え手段で前記作動状態と停止状態を繰り返し切替え
る場合に、前記保持手段は、先に前記保持した録音音声
データを記憶手段に記憶するか否かの確認を行わずに、
新規の録音音声データの保持を行うことを特徴とする請
求項28に記載の音声データ処理方法。 - 【請求項32】 前記コンピュータは、検出手段と、区
分情報生成手段と、再生手段を備え、 前記検出手段で、前記生成した録音音声データの無音部
分を検出する検出ステップと、 前記区分情報生成手段で、前記検出した無音部分を用い
て、前記録音音声データに区分を設定する区分情報を生
成する区分情報生成ステップと、 前記再生手段で、前記生成した録音音声データを、前記
生成した区分情報による区分単位で再生する録音音声デ
ータ再生ステップを備えたことを特徴とする請求項28
に記載の音声データ処理方法。 - 【請求項33】 前記検出ステップは、前記取得した録
音音声データにおいて、所定の閾値より小さい音量の状
態の継続時間が所定の時間より長く継続する部分、及
び、所定の閾値より大きい音量の状態の継続時間が所定
の時間より短い部分の少なくとも1つを無音部分として
検出することを特徴とする請求項28に記載の音声デー
タ処理方法。 - 【請求項34】 デジタル信号により生成された音声デ
ータを取得する音声データ取得機能と、 前記取得した音声データの無音部分を検出する検出機能
と、 前記検出した無音部分を用いて、前記音声データに区分
を設定する区分情報を生成する区分情報生成機能と、 をコンピュータで実現するための音声データ処理プログ
ラム。 - 【請求項35】 前記検出機能は、前記取得した音声デ
ータにおいて、所定の閾値より小さい音量の状態の継続
時間が所定の時間より長く継続する部分、及び、所定の
閾値より大きい音量の状態の継続時間が所定の時間より
短い部分の少なくとも1つを無音部分として検出するこ
とを特徴とする請求項34に記載の音声データ処理プロ
グラム。 - 【請求項36】 前記区分情報生成機能は、前記無音部
分の開始位置、又は前記無音部分の終了位置から350
ミリ秒以上前に前記区分の境界位置を設定することを特
徴とする請求項34に記載の音声データ処理プログラ
ム。 - 【請求項37】 前記取得した音声データを、前記生成
した区分情報による区分単位で再生する再生機能を具備
したことを特徴とする請求項34に記載の音声データ処
理プログラム。 - 【請求項38】 デジタル信号により生成された音声デ
ータを取得する音声データ取得機能と、 前記取得した音声データに区分を設定する区分情報を取
得する区分情報取得機能と、 前記音声データを、前記取得した区分情報による区分単
位で再生する再生機能と、 をコンピュータで実現するための音声データ処理プログ
ラム。 - 【請求項39】 前記再生機能は、最後に再生した区分
を特定する再生情報を記憶する記憶機能と、 前記記憶した再生情報で特定される前記最後に再生した
区分の次の区分を再生する区分順再生機能と、 を具備したことを特徴とする請求項38に記載の音声デ
ータ処理プログラム。 - 【請求項40】 前記再生機能は、最後に再生した区分
を特定する再生情報を記憶する記憶機能と、 前記記憶した再生情報で特定される前記再生した区分を
再度再生する繰り返し再生機能と、 を具備したことを特徴とする請求項38に記載の音声デ
ータ処理プログラム。 - 【請求項41】 前記音声データにおいて再生範囲を指
定する再生範囲指定機能を更に具備し、 前記再生機能は、前記再生範囲指定機能で指定された再
生範囲を、前記区分に関係なく再生することを特徴とす
る請求項38に記載の音声データ処理プログラム。 - 【請求項42】 音声データを再生する再生機能と、 音声を取得する音声取得機能と、 前記取得した音声からデジタル信号による録音音声デー
タを生成する録音音声データ生成機能と、 前記生成した録音音声データを保持する保持機能と、 をコンピュータで実現するための音声データ処理プログ
ラムであって、 前記録音音声データ生成機能は、前記再生機能にて再生
されている前記音声データに同期して前記録音音声デー
タを生成することを特徴とする音声データ処理プログラ
ム。 - 【請求項43】 前記再生機能は、前記音声データに区
分を設定する区分情報を用いて、前記音声データを区分
単位で再生することを特徴とする請求項42に記載の音
声データ処理プログラム。 - 【請求項44】 前記音声データの波形図と、前記録音
音声データの音声波形図と、を比較可能に表示する表示
機能を具備したことを特徴とする請求項42に記載の音
声データ処理プログラム。 - 【請求項45】 前記録音音声データ生成機能の作動状
態と停止状態を切替える切替え機能を具備し、前記切替
え機能で前記作動状態と停止状態を繰り返し切替える場
合に、前記保持機能は、先に前記保持した録音音声デー
タを記憶機能に記憶するか否かの確認を行わずに、新規
の録音音声データの保持を行うことを特徴とする請求項
42に記載の音声データ処理プログラム。 - 【請求項46】 前記生成した録音音声データの無音部
分を検出する検出機能と、 前記検出した無音部分を用いて、前記録音音声データに
区分を設定する区分情報を生成する区分情報生成機能
と、 前記生成した録音音声データを、前記生成した区分情報
による区分単位で再生する録音音声データ再生機能を具
備したことを特徴とする請求項42に記載の音声データ
処理プログラム。 - 【請求項47】 前記検出機能は、前記取得した録音音
声データにおいて、所定の閾値より小さい音量の状態の
継続時間が所定の時間より長く継続する部分、及び、所
定の閾値より大きい音量の状態の継続時間が所定の時間
より短い部分の少なくとも1つを無音部分として検出す
ることを特徴とする請求項42に記載の音声データ処理
プログラム。 - 【請求項48】 デジタル信号により生成された音声デ
ータを取得する音声データ取得機能と、 前記取得した音声データの無音部分を検出する検出機能
と、 前記検出した無音部分を用いて、前記音声データに区分
を設定する区分情報を生成する区分情報生成機能と、 をコンピュータで実現するための音声データ処理プログ
ラムを記憶したコンピュータが読み取り可能な記憶媒
体。 - 【請求項49】 前記検出機能は、前記取得した音声デ
ータにおいて、所定の閾値より小さい音量の状態の継続
時間が所定の時間より長く継続する部分、及び、所定の
閾値より大きい音量の状態の継続時間が所定の時間より
短い部分の少なくとも1つを無音部分として検出するこ
とを特徴とする請求項48に記載の記憶媒体。 - 【請求項50】 前記区分情報生成機能は、前記無音部
分の開始位置、又は前記無音部分の終了位置から350
ミリ秒以上前に前記区分の境界位置を設定することを特
徴とする請求項48に記載の記憶媒体。 - 【請求項51】 前記取得した音声データを、前記生成
した区分情報による区分単位で再生する再生機能を具備
したことを特徴とする請求項48に記載の記憶媒体。 - 【請求項52】 デジタル信号により生成された音声デ
ータを取得する音声データ取得機能と、 前記取得した音声データに区分を設定する区分情報を取
得する区分情報取得機能と、 前記音声データを、前記取得した区分情報による区分単
位で再生する再生機能と、 をコンピュータで実現するための音声データ処理プログ
ラムを記憶したコンピュータが読み取り可能な記憶媒
体。 - 【請求項53】 前記再生機能は、最後に再生した区分
を特定する再生情報を記憶する記憶機能と、 前記記憶した再生情報で特定される前記最後に再生した
区分の次の区分を再生する区分順再生機能と、 を具備したことを特徴とする請求項52に記載の記憶媒
体。 - 【請求項54】 前記再生機能は、最後に再生した区分
を特定する再生情報を記憶する記憶機能と、 前記記憶した再生情報で特定される前記最後に再生した
区分を再度再生する繰り返し再生機能と、 を具備したことを特徴とする請求項52に記載の記憶媒
体。 - 【請求項55】 前記音声データにおいて再生範囲を指
定する再生範囲指定機能を更に具備し、 前記再生機能は、前記再生範囲指定機能で指定された再
生範囲を、前記区分に関係なく再生することを特徴とす
る請求項52に記載の記憶媒体。 - 【請求項56】 音声データを再生する再生機能と、 音声を取得する音声取得機能と、 前記取得した音声からデジタル信号による録音音声デー
タを生成する録音音声データ生成機能と、 前記生成した録音音声データを保持する保持機能と、 をコンピュータで実現するための音声データ処理プログ
ラムを記憶したコンピュータが読み取り可能な記憶媒体
であって、 前記録音音声データ生成機能は、前記再生機能にて再生
されている前記音声データに同期して前記録音音声デー
タを生成することを特徴とする記憶媒体。 - 【請求項57】 前記再生機能は、前記音声データに区
分を設定する区分情報を用いて、前記音声データを区分
単位で再生することを特徴とする請求項56に記載の記
憶媒体。 - 【請求項58】 前記音声データの波形図と、前記録音
音声データの音声波形図と、を比較可能に表示する表示
機能を具備したことを特徴とする請求項56に記載の記
憶媒体。 - 【請求項59】 前記録音音声データ生成機能の作動状
態と停止状態を切替える切替え機能を具備し、前記切替
え機能で前記作動状態と停止状態を繰り返し切替える場
合に、前記保持機能は、先に前記保持した録音音声デー
タを記憶機能に記憶するか否かの確認を行わずに、新規
の録音音声データの保持を行うことを特徴とする請求項
56に記載の記憶媒体。 - 【請求項60】 前記生成した録音音声データの無音部
分を検出する検出機能と、 前記検出した無音部分を用いて、前記録音音声データに
区分を設定する区分情報を生成する区分情報生成機能
と、 前記生成した録音音声データを、前記生成した区分情報
による区分単位で再生する録音音声データ再生機能を具
備したことを特徴とする請求項56に記載の記憶媒体。 - 【請求項61】 前記検出機能は、前記取得した録音音
声データにおいて、所定の閾値より小さい音量の状態の
継続時間が所定の時間より長く継続する部分、及び、所
定の閾値より大きい音量の状態の継続時間が所定の時間
より短い部分の少なくとも1つを無音部分として検出す
ることを特徴とする請求項56に記載の記憶媒体。
Priority Applications (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP2002112709A JP2003307997A (ja) | 2002-04-15 | 2002-04-15 | 語学教育システム、音声データ処理装置、音声データ処理方法、音声データ処理プログラム、及び記憶媒体 |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP2002112709A JP2003307997A (ja) | 2002-04-15 | 2002-04-15 | 語学教育システム、音声データ処理装置、音声データ処理方法、音声データ処理プログラム、及び記憶媒体 |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JP2003307997A true JP2003307997A (ja) | 2003-10-31 |
Family
ID=29395098
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP2002112709A Pending JP2003307997A (ja) | 2002-04-15 | 2002-04-15 | 語学教育システム、音声データ処理装置、音声データ処理方法、音声データ処理プログラム、及び記憶媒体 |
Country Status (1)
| Country | Link |
|---|---|
| JP (1) | JP2003307997A (ja) |
Cited By (23)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2004021102A (ja) * | 2002-06-19 | 2004-01-22 | Eigyotatsu Kofun Yugenkoshi | 会話練習システムおよびその方法 |
| JP2004302171A (ja) * | 2003-03-31 | 2004-10-28 | Ffc Ltd | 語学学習装置,語学学習用プログラムおよび語学学習用記録媒体 |
| JP2005301953A (ja) * | 2004-04-12 | 2005-10-27 | Kenichi Asano | 聞き手の側のペースで音声とそれに対応する文章を関連させる方法 |
| JP2006201491A (ja) * | 2005-01-20 | 2006-08-03 | Advanced Telecommunication Research Institute International | 発音評定装置、およびプログラム |
| JP2006301507A (ja) * | 2005-04-25 | 2006-11-02 | Sony Corp | 再生単位分割装置及び再生単位分割方法 |
| JP2006349782A (ja) * | 2005-06-14 | 2006-12-28 | Hitachi Ltd | 情報配信システム |
| JP2007041302A (ja) * | 2005-08-03 | 2007-02-15 | Casio Comput Co Ltd | 音声再生装置および音声再生処理プログラム |
| WO2007145079A1 (ja) * | 2006-06-12 | 2007-12-21 | Kazuo Ishikawa | 反復再生学習機およびプログラム |
| JP2009020457A (ja) * | 2007-07-13 | 2009-01-29 | Univ Waseda | 音声処理装置およびプログラム |
| WO2009019872A1 (ja) * | 2007-08-06 | 2009-02-12 | Straight Word Inc. | 通訳支援システム、通訳支援プログラム、通訳支援方法 |
| WO2009025155A1 (ja) * | 2007-08-21 | 2009-02-26 | Voxmol Llc | 音声再生方法、音声再生装置およびコンピュータ・プログラム |
| JP2009147635A (ja) * | 2007-12-13 | 2009-07-02 | Toshiba Corp | 携帯電話機 |
| JP2010191235A (ja) * | 2009-02-19 | 2010-09-02 | Straight Word Inc | 記憶支援システム、記憶支援プログラム、及び記憶支援方法 |
| JP2010257558A (ja) * | 2009-04-28 | 2010-11-11 | Victor Co Of Japan Ltd | 記録再生装置 |
| JP2011085641A (ja) * | 2009-10-13 | 2011-04-28 | Power Shift Inc | 語学学習支援システム及び語学学習支援方法 |
| JP2012527007A (ja) * | 2009-05-13 | 2012-11-01 | ドハン イ | マルチメディアファイル再生方法およびマルチメディア再生機器 |
| US8737629B2 (en) | 2006-09-25 | 2014-05-27 | Yamaha Corporation | Audio signal processing system |
| JP2015025873A (ja) * | 2013-07-24 | 2015-02-05 | 株式会社ベネッセコーポレーション | 情報処理装置、情報処理方法及びプログラム |
| JP2016525765A (ja) * | 2014-06-06 | 2016-08-25 | シャオミ・インコーポレイテッド | マルチメディア再生方法、装置、プログラム、及び記録媒体 |
| US9483953B2 (en) | 2011-08-10 | 2016-11-01 | Casio Computer Co., Ltd. | Voice learning apparatus, voice learning method, and storage medium storing voice learning program |
| JP2018055076A (ja) * | 2016-09-28 | 2018-04-05 | 博司 関口 | デジタル音声情報記録媒体、プログラムおよび音響再生装置 |
| JP2020144269A (ja) * | 2019-03-07 | 2020-09-10 | 理 小山 | 多言語コンテンツの教育用再生方法、そのためのデータ構造及びプログラム |
| JP7587670B1 (ja) | 2023-12-28 | 2024-11-20 | 悠介 中内 | 音情報の学習支援装置、音情報の学習支援方法、音情報の学習支援プログラム及び記録媒体 |
-
2002
- 2002-04-15 JP JP2002112709A patent/JP2003307997A/ja active Pending
Cited By (26)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2004021102A (ja) * | 2002-06-19 | 2004-01-22 | Eigyotatsu Kofun Yugenkoshi | 会話練習システムおよびその方法 |
| JP2004302171A (ja) * | 2003-03-31 | 2004-10-28 | Ffc Ltd | 語学学習装置,語学学習用プログラムおよび語学学習用記録媒体 |
| JP2005301953A (ja) * | 2004-04-12 | 2005-10-27 | Kenichi Asano | 聞き手の側のペースで音声とそれに対応する文章を関連させる方法 |
| JP2006201491A (ja) * | 2005-01-20 | 2006-08-03 | Advanced Telecommunication Research Institute International | 発音評定装置、およびプログラム |
| JP2006301507A (ja) * | 2005-04-25 | 2006-11-02 | Sony Corp | 再生単位分割装置及び再生単位分割方法 |
| JP2006349782A (ja) * | 2005-06-14 | 2006-12-28 | Hitachi Ltd | 情報配信システム |
| JP2007041302A (ja) * | 2005-08-03 | 2007-02-15 | Casio Comput Co Ltd | 音声再生装置および音声再生処理プログラム |
| WO2007145079A1 (ja) * | 2006-06-12 | 2007-12-21 | Kazuo Ishikawa | 反復再生学習機およびプログラム |
| US8737629B2 (en) | 2006-09-25 | 2014-05-27 | Yamaha Corporation | Audio signal processing system |
| JP2009020457A (ja) * | 2007-07-13 | 2009-01-29 | Univ Waseda | 音声処理装置およびプログラム |
| WO2009019872A1 (ja) * | 2007-08-06 | 2009-02-12 | Straight Word Inc. | 通訳支援システム、通訳支援プログラム、通訳支援方法 |
| JP2009042291A (ja) * | 2007-08-06 | 2009-02-26 | Straight Word Inc | 通訳支援システム、通訳支援プログラム、通訳支援方法 |
| WO2009025155A1 (ja) * | 2007-08-21 | 2009-02-26 | Voxmol Llc | 音声再生方法、音声再生装置およびコンピュータ・プログラム |
| JPWO2009025155A1 (ja) * | 2007-08-21 | 2010-11-18 | ボックスモル エルエルシー | 音声再生方法、音声再生装置およびコンピュータ・プログラム |
| JP2009147635A (ja) * | 2007-12-13 | 2009-07-02 | Toshiba Corp | 携帯電話機 |
| JP2010191235A (ja) * | 2009-02-19 | 2010-09-02 | Straight Word Inc | 記憶支援システム、記憶支援プログラム、及び記憶支援方法 |
| JP2010257558A (ja) * | 2009-04-28 | 2010-11-11 | Victor Co Of Japan Ltd | 記録再生装置 |
| JP2012527007A (ja) * | 2009-05-13 | 2012-11-01 | ドハン イ | マルチメディアファイル再生方法およびマルチメディア再生機器 |
| JP2011085641A (ja) * | 2009-10-13 | 2011-04-28 | Power Shift Inc | 語学学習支援システム及び語学学習支援方法 |
| US9483953B2 (en) | 2011-08-10 | 2016-11-01 | Casio Computer Co., Ltd. | Voice learning apparatus, voice learning method, and storage medium storing voice learning program |
| JP2015025873A (ja) * | 2013-07-24 | 2015-02-05 | 株式会社ベネッセコーポレーション | 情報処理装置、情報処理方法及びプログラム |
| JP2016525765A (ja) * | 2014-06-06 | 2016-08-25 | シャオミ・インコーポレイテッド | マルチメディア再生方法、装置、プログラム、及び記録媒体 |
| JP2018055076A (ja) * | 2016-09-28 | 2018-04-05 | 博司 関口 | デジタル音声情報記録媒体、プログラムおよび音響再生装置 |
| JP2020144269A (ja) * | 2019-03-07 | 2020-09-10 | 理 小山 | 多言語コンテンツの教育用再生方法、そのためのデータ構造及びプログラム |
| JP7587670B1 (ja) | 2023-12-28 | 2024-11-20 | 悠介 中内 | 音情報の学習支援装置、音情報の学習支援方法、音情報の学習支援プログラム及び記録媒体 |
| JP2025104750A (ja) * | 2023-12-28 | 2025-07-10 | 悠介 中内 | 音情報の学習支援装置、音情報の学習支援方法、音情報の学習支援プログラム及び記録媒体 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| KR101826714B1 (ko) | 말하기 학습 기능을 구비한 외국어 학습 시스템 및 외국어 학습 방법 | |
| US6728680B1 (en) | Method and apparatus for providing visual feedback of speed production | |
| CN111711834B (zh) | 录播互动课的生成方法、装置、存储介质以及终端 | |
| JP5634853B2 (ja) | 電子コミックのビューワ装置、電子コミックの閲覧システム、ビューワプログラム、ならびに電子コミックの表示方法 | |
| US20100298959A1 (en) | Speech reproducing method, speech reproducing device, and computer program | |
| CN103348338A (zh) | 文件格式、服务器、数字漫画的观看器设备、数字漫画产生设备 | |
| US6205427B1 (en) | Voice output apparatus and a method thereof | |
| Roy | NewsComm--a hand-held device for interactive access to structured audio | |
| KR20000012538A (ko) | 동영상에 포함된 외국어 대사의 학습을 위한 캡션제어방법 및 그 기록매체 | |
| JP5083155B2 (ja) | 辞書機能を備えた電子装置およびプログラム | |
| KR100469392B1 (ko) | 학습 시스템 및 방법과 그 학습 방법의 프로그램을컴퓨터가 읽을 수 있도록 저장한 기록매체 | |
| JP2005321706A (ja) | 電子書籍の再生方法及びその装置 | |
| KR20230069402A (ko) | 사용자를 위한 오디오 코믹북 변환 방법, 오디오 코믹북 제공 방법 및 상기 방법을 수행하는 사용자 단말 | |
| JP2004325905A (ja) | 外国語学習装置および外国語学習プログラム | |
| JP2018146961A (ja) | 音声再生装置及び音楽再生プログラム | |
| JP2000206987A (ja) | 音声認識装置 | |
| JP2023131648A (ja) | システムおよびプログラム | |
| JP2005284490A (ja) | データ記録装置およびデータ再生装置 | |
| JPH0816089A (ja) | 発音比較学習装置 | |
| JP2010107926A (ja) | 語学ヒアリング能力およびシャドーイング能力を向上させる学習教材及びその作成方法 | |
| KR20030091170A (ko) | 휴대용 디지탈 어학학습기 | |
| KR100389451B1 (ko) | 저장된 질의/응답문의 재생을 통한 학습 보조 장치 | |
| KR20010076136A (ko) | 휴대용 독서기 | |
| JP4354337B2 (ja) | 手話学習機能付きカラオケ装置 | |
| KR20210091971A (ko) | 언어 학습 음원 분석 방법 및 언어 학습 음원을 재생하는 전자 디바이스 |