JPH0950424A - ダンプ採取装置およびダンプ採取方法 - Google Patents
ダンプ採取装置およびダンプ採取方法Info
- Publication number
- JPH0950424A JPH0950424A JP7200154A JP20015495A JPH0950424A JP H0950424 A JPH0950424 A JP H0950424A JP 7200154 A JP7200154 A JP 7200154A JP 20015495 A JP20015495 A JP 20015495A JP H0950424 A JPH0950424 A JP H0950424A
- Authority
- JP
- Japan
- Prior art keywords
- dump
- processor
- processing
- storage device
- processors
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Granted
Links
Classifications
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/14—Error detection or correction of the data by redundancy in operations
- G06F11/1402—Saving, restoring, recovering or retrying
- G06F11/1415—Saving, restoring, recovering or retrying at system level
- G06F11/1438—Restarting or rejuvenating
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/22—Detection or location of defective computer hardware by testing during standby operation or during idle time, e.g. start-up testing
Landscapes
- Engineering & Computer Science (AREA)
- Theoretical Computer Science (AREA)
- General Engineering & Computer Science (AREA)
- Quality & Reliability (AREA)
- Physics & Mathematics (AREA)
- General Physics & Mathematics (AREA)
- Computer Hardware Design (AREA)
- Debugging And Monitoring (AREA)
- Multi Processors (AREA)
- Hardware Redundancy (AREA)
Abstract
ログラムを実行するシステムのダンプ採取装置およびダ
ンプ採取方法に関し、ダンプの採取に伴うシステムの停
止時間を短縮することを目的とする。 【構成】 複数の処理プロセッサ2〜4は通信網10に
よって接続されて並列プログラム1の実行を行う。処理
プロセッサ4に障害が発生した場合、停止手段5が、複
数の処理プロセッサ2〜4の動作を停止させる。そし
て、ダンプ書込手段6が、障害が発生した障害プロセッ
サ4の内部記憶装置に、処理プロセッサ2,3の各ダン
プを書き込む。ダンプ書込手段6によるダンプ書き込み
が完了した後、再起動手段7が、処理プロセッサ2,3
を再起動させる。障害プロセッサ4に書き込まれた各ダ
ンプおよび障害プロセッサ4自身のダンプは、読出手段
9によって外部記憶装置8へ読み出される。
Description
を用いて1つの並列プログラムを実行するシステムのダ
ンプ採取装置およびダンプ採取方法に関し、特に、分散
メモリ型並列型計算機における複数のダンプの採取装置
および採取方法に関する。
な状態に陥ったとき、主記憶装置あるいは2次記憶装置
の内容をダンプ(DUMP)として採取して外部記憶装
置へ送り、それを基にオペレーションシステムの障害の
原因究明を行っている。
結ぶ通信網とを備え、各処理プロセッサが独立した記憶
装置とCPUとを備えた分散メモリ型並列型計算機にお
いては、通信網によりデータの交換や同期を行いなが
ら、複数の処理プロセッサが同一の並列プログラムを実
行することが行われている。こうした分散メモリ型並列
型計算機においても、システムの異常時にはダンプの採
取が行われる。
算機システムにおいて、そのうちの複数の処理プロセッ
サを用いて1つの並列プログラムを実行しているとき
に、それらの複数の処理プロセッサのいずれかに障害が
発生した場合、その並列プログラムを実行していた処理
プロセッサ全ての動作が停止され、それらの処理プロセ
ッサ全てにおけるダンプが採取され、外部記憶装置のフ
ァイルに吐き出される。
のうち、障害が発生した処理プロセッサ以外のプロセッ
サには何ら問題がないので、それらのプロセッサに対し
ては、ダンプの吐き出し後、再起動が行われる。
よって動作が停止してから再起動するまでのシステム停
止時間は当然、最小限に抑えることが要求される。
ダンプを外部記憶装置へ書き込むことに要する時間は一
般的に長くかかる。しかも、最近の処理プロセッサでは
内部メモリ量が増大しているのでその所要時間は更に長
くなる傾向にあり、また、ダンプを採取すべき処理プロ
セッサの数が多くなればそれだけトータルのシステム停
止時間は長くなる。
利益をもたらすことであり、できるだけシステムの停止
時間を短くする必要がある。本発明はこのような点に鑑
みてなされたものであり、複数の処理プロセッサを備え
て並列プログラムを実行するシステムにおいて、ダンプ
の採取に伴うシステムの停止時間を短縮することを図っ
たダンプ採取装置およびダンプ採取方法を提供すること
を目的とする。
成するために、図1に示すように、並列プログラム1を
実行する複数の処理プロセッサ2〜4のいずれかに障害
が発生したときに、複数の処理プロセッサ2〜4の動作
を停止させる停止手段5と、障害が発生した障害プロセ
ッサ(例えば処理プロセッサ4に障害が発生したとす
る)の内部記憶装置に、複数の処理プロセッサ2〜4の
うちの障害プロセッサ4を除いた処理プロセッサ2,3
の各ダンプを書き込むダンプ書込手段6とを、有するこ
とを特徴とするダンプ採取装置が提供される。
プ書込手段6によるダンプ書き込みが完了した後、複数
の処理プロセッサ2〜4のうちの障害プロセッサ4を除
いた処理プロセッサ2,3を再起動させる再起動手段7
と、障害プロセッサ4に書き込まれた各ダンプおよび障
害プロセッサ4自身のダンプを外部記憶装置8へ読み出
す読出手段9とを有する。
ッサ2〜4は通信網10によって接続されて並列プログ
ラム1の実行を行う。ここで、複数の処理プロセッサ2
〜4のうちの処理プロセッサ4に障害が発生したと仮定
する。
複数の処理プロセッサ2〜4の動作を停止させる。そし
て、ダンプ書込手段6が、障害が発生した障害プロセッ
サ4の内部記憶装置に、処理プロセッサ2,3の各ダン
プを書き込む。このダンプ書き込みは、各処理プロセッ
サ間におけるリード/ライト処理であるので、処理プロ
セッサと外部記憶装置との間のリード/ライト処理に比
べて格段に高速度に行われる。
完了した後、再起動手段7が、障害プロセッサ4を除い
た処理プロセッサ2,3を再起動させる。したがって、
障害プロセッサ4を除いた処理プロセッサ2,3に関し
ては、従来に比べて格段に短い停止時間の後、再起動さ
れることになる。
ダンプおよび障害プロセッサ4自身のダンプは、読出手
段9によって外部記憶装置8へ読み出される。これに要
する時間は従来通りの時間であるが、このときには、既
に障害プロセッサ4を除いた他の正常な処理プロセッサ
2,3は動作再開しているので、この所要時間は何ら問
題とならない。
する。まず、本発明の第1の実施例の原理構成を、図1
を参照して説明する。第1の実施例は、並列プログラム
1を実行する複数の処理プロセッサ2〜4のいずれかに
障害が発生したときに、複数の処理プロセッサ2〜4の
動作を停止させる停止手段5と、障害が発生した障害プ
ロセッサ(例えば処理プロセッサ4に障害が発生したと
する)の内部記憶装置に、複数の処理プロセッサ2〜4
のうちの障害プロセッサ4を除いた処理プロセッサ2,
3の各ダンプを書き込むダンプ書込手段6とを備える。
また、ダンプ書込手段6によるダンプ書き込みが完了し
た後、複数の処理プロセッサ2〜4のうちの障害プロセ
ッサ4を除いた処理プロセッサ2,3を再起動させる再
起動手段7と、障害プロセッサ4に書き込まれた各ダン
プおよび障害プロセッサ4自身のダンプを外部記憶装置
8へ読み出す読出手段9とを備える。
成を示す。図中、制御用プロセッサ11およびプロセッ
サ12〜15が通信網16によって接続され、プロセッ
サ12〜15が並列プログラム17を実行する。プロセ
ッサ12〜15は、独立した内部記憶装置とCPUとを
有し、通信網16を介して互いにデータの交換や同期を
行いながら、並列プログラム17を実行する。プロセッ
サ12〜15の各内部記憶装置は、システムプログラム
(オペーレーションシステム)およびユーザプログラム
(アプリケーションプログラム)により使用される。シ
ステムに異常が発生した場合には、システム異常の原因
を調査するために、プロセッサ12〜15において主に
システムプログラムに使用された各内部記憶装置内の情
報(ダンプ)が採取される必要がある。
および読出手段9は、図2(A)に示す制御用プロセッ
サ11の動作により実現する機能である。なお、図1に
おけるダンプ書込手段6は、図2(A)に示す制御用プ
ロセッサ11からプロセッサ12〜15へ送られたダン
プドライバ(ダンプ取得プログラム)を、プロセッサ1
2〜15が実行することにより実現する機能である。
は、図2(A)のプロセッサ12〜15に対応し、同様
に、並列プログラム1は並列プログラム17に、通信網
10は通信網16に対応する。
生した場合に、制御用プロセッサ11から各プロセッサ
12〜15にダンプドライバが送られる様子を示し、図
2(C)は、プロセッサ12,13,15から異常プロ
セッサ14の内部記憶装置へダンプが書き込まれる様子
を示している。こうした制御用プロセッサ11によるダ
ンプ採取の処理手順を図3を参照して説明する。
プ採取の処理手順を示すフローチャートである。以下、
図中のステップに沿って説明する。 〔S1〕制御用プロセッサ11がプロセッサ12〜15
を監視して、異常の発生を検出する。異常の発生を検出
すると、制御用プロセッサ11は、並列プログラム17
を実行していたプロセッサ12〜15の動作を停止させ
る。図中の「PE」は Processing Element の略号であ
り、プロセッサを指す。以下、プロセッサ14に異常が
発生したと仮定して説明する。
制御用プロセッサ11からダンプドライバを送る。ダン
プドライバは、ダンプを読み出して送り、所定の場所に
書き込むためのプログラムである。
外のプロセッサ12,13,15に制御用プロセッサ1
1からダンプドライバを送る。 〔S4〕ダンプドライバを実行することにより、プロセ
ッサ12,13,15は、自己のダンプを異常の発生し
たプロセッサ14へそれぞれ読み出す。それぞれ読み出
されたダンプは、プロセッサ12,13,15の各内部
記憶装置のスカラメモリ上に書き込まれていたオペレー
ションシステムに関連するメモリダンプである。
より、異常の発生したプロセッサ14は、送られた各ダ
ンプを自己の内部記憶装置へ書き込む。特に、これらの
ダンプは、プロセッサ14の内部記憶装置のユーザプロ
グラム用に使用されていたベクトルメモリ上に書き込ま
れる。
たプロセッサ14に一番多く存在するので、ダンプを、
異常の発生したプロセッサ14に集約することは、集約
に要する時間を一番短くすることにつながる。
用プロセッサ11は、異常の発生したプロセッサ14以
外のプロセッサ12,13,15にIPL(Initial Pro
gramLoader)を実行させて再起動させ、運用を再開させ
る。
ッサ14に書き込まれた各ダンプおよびプロセッサ14
自身のダンプを読み出して、外部記憶装置のファイル上
に書き込む。このファイルを基に、異常の原因の究明が
別途行われる。
ッサ14にIPLを実行させて再起動させ、運用を再開
させる。つぎに、本発明の第2の実施例を説明する。
成と同じである。図4(A)は、第2の実施例の具体的
な構成を示す。図1における停止手段5、再起動手段
7、および読出手段9は、図4(A)に示す制御用プロ
セッサ21の動作により実現する機能である。なお、図
1におけるダンプ書込手段6は、図4(A)に示す制御
用プロセッサ21からプロセッサ22〜27へ送られた
ダンプドライバ(ダンプ取得プログラム)を、プロセッ
サ22〜27が実行することにより実現する機能であ
る。
は、図4(A)のプロセッサ22〜27に対応し、同様
に、並列プログラム1は並列プログラム29に、通信網
10は通信網28に対応する。ただし、図4(A)で
は、並列プログラム29をプロセッサ22〜26が実行
し、プロセッサ27は実行しない例を示す。
生した場合に、プロセッサ22,23,25,26から
異常プロセッサ24の内部記憶装置へダンプが書き込ま
れる様子を示している。第2の実施例では、書き込まれ
るダンプのデータ量が多く、異常プロセッサ24の内部
記憶装置が全てを格納しきれない場合に対処した装置を
提供している。こうした制御用プロセッサ21によるダ
ンプ採取の処理手順を図5を参照して説明する。
プ採取の処理手順を示すフローチャートである。このフ
ローチャートは、図3に示す第1の実施例のフローチャ
ートと基本的には同じであるので、異なる部分だけを説
明する。なお、図5のステップS11〜S15が図3の
ステップS1〜S5にそれぞれ対応し、また、図5のス
テップS18〜S20が図3のステップS6〜S8にそ
れぞれ対応する。
いたプロセッサ22〜26のうちでプロセッサ24に異
常が発生した場合に、プロセッサ22,23,25,2
6の各ダンプが異常プロセッサ24へ書き込まれる(集
約される)が、この異常プロセッサ24の内部記憶装置
が一杯になってしまっていないか否かを判別する。一杯
にならず、プロセッサ22,23,25,26から送ら
れた各ダンプが全部格納できたときにはステップS18
へ進み、一方、一杯になってしまい、送られたダンプの
全部は格納できていないときにはステップS17へ進
む。
格納しきれなかった残りのダンプを新たに格納すべきプ
ロセッサを決定する。この決定は、制御用プロセッサ2
1がシステム監視プログラムを実行することにより自動
的に行われる。例えば、図4の異常プロセッサ24の右
側に並ぶプロセッサ25,26を、さらには左側のプロ
セッサ22,23をこの順に順次対象として、既に自己
のダンプの異常プロセッサ24への転送を完了している
かどうかを調べる。そして、既に自己のダンプの転送を
完了しているプロセッサが見つかったら、最初に見つか
ったプロセッサを、残りのダンプを格納すべきプロセッ
サとして決定する。図4の例ではプロセッサ25が、残
りのダンプを格納すべきプロセッサに決定されている。
15の実行では、プロセッサ25の内部記憶装置に残り
のダンプが書き込まれる。そして、ステップS18で
は、プロセッサ22,23,26が再起動され、ステッ
プS19では、プロセッサ24,S25から外部記憶装
置へダンプが吐き出される。
れるダンプのデータ量が多く、異常プロセッサ24の内
部記憶装置が全てを格納しきれない場合に、既に自己の
ダンプの転送を完了しているプロセッサを一意的に決定
して、そのプロセッサに、格納しきれなかったダンプを
格納することを可能としている。
処理プロセッサによって並列プログラムと実行している
ときに異常が発生した場合、異常が発生したプロセッサ
に、関連する他の処理プロセッサのダンプを集め、それ
らの他の処理プロセッサについては運用を再開させる。
これによって、ダンプの採取に伴うシステムの停止時間
が、従来のように各処理プロセッサのダンプを外部記憶
装置へ吐き出す場合に比べて、短縮することができる。
したがって、障害時にユーザに対して与える影響を最小
限に止めることができ、信頼性を向上できる。
実施例の具体的な構成を示し、(B)は制御用プロセッ
サから各プロセッサにダンプドライバが送られる様子を
示し、(C)は各プロセッサから異常プロセッサへダン
プが書き込まれる様子を示している。
実施例の具体的な構成を示し、(B)は各プロセッサか
ら異常プロセッサ等にダンプが書き込まれる様子を示し
ている。
Claims (9)
- 【請求項1】 複数の処理プロセッサを用いて1つの並
列プログラムを実行するシステムのダンプ採取装置にお
いて、 並列プログラムを実行する複数の処理プロセッサのいず
れかに障害が発生したときに、当該複数の処理プロセッ
サの動作を停止させる停止手段と、 前記障害が発生した障害プロセッサの内部記憶装置に、
前記複数の処理プロセッサのうちの前記障害プロセッサ
を除いた処理プロセッサの各ダンプを書き込むダンプ書
込手段と、 を有することを特徴とするダンプ採取装置。 - 【請求項2】 前記ダンプ書込手段によるダンプ書き込
みが完了した後、前記複数の処理プロセッサのうちの前
記障害プロセッサを除いた処理プロセッサを再起動させ
る再起動手段を、更に有することを特徴とする請求項1
記載のダンプ採取装置。 - 【請求項3】 前記障害プロセッサに書き込まれた各ダ
ンプおよび前記障害プロセッサ自身のダンプを外部記憶
装置へ読み出す読出手段を、更に有することを特徴とす
る請求項1記載のダンプ採取装置。 - 【請求項4】 前記読出手段によるダンプ読み出しが完
了した後、前記障害プロセッサを再起動させる障害プロ
セッサ再起動手段を更に有することを特徴とする請求項
3記載のダンプ採取装置。 - 【請求項5】 前記ダンプ書込手段によるダンプ書き込
みが完了した後、前記複数の処理プロセッサのうちの前
記障害プロセッサを除いた処理プロセッサを再起動させ
る再起動手段と、 前記障害プロセッサに書き込まれた各ダンプおよび前記
障害プロセッサ自身のダンプを外部記憶装置へ読み出す
読出手段と、 を更に有し、 前記ダンプ書込手段は、前記障害プロセッサの内部記憶
装置に前記ダンプの全てを書き込みきれない場合には、
前記複数の処理プロセッサのうちで既に自己のダンプの
送出を済んでいる送出済プロセッサの内部記憶装置に、
残りのダンプを書き込む手段を含み、 前記再起動手段は、前記ダンプの全てを書き込みきれな
い場合に、前記複数の処理プロセッサのうちの前記障害
プロセッサおよび前記送出済プロセッサを除いた処理プ
ロセッサを再起動させる手段を含み、 前記読出手段は、前記ダンプの全てを書き込みきれない
場合に、前記障害プロセッサおよび前記送出済プロセッ
サに書き込まれた各ダンプ、並びに前記障害プロセッサ
自身のダンプを前記外部記憶装置へ読み出す手段を含む
ことを特徴とする請求項1記載のダンプ採取装置。 - 【請求項6】 前記ダンプ書込手段により前記障害プロ
セッサの内部記憶装置に書き込まれる処理プロセッサの
ダンプは、オペレーションシステムに関わるメモリダン
プであることを特徴とする請求項1記載のダンプ採取装
置。 - 【請求項7】 制御プロセッサおよび複数の処理プロセ
ッサを備え、複数の処理プロセッサを用いて1つの並列
プログラムを実行するシステムにおける前記制御プロセ
ッサによるダンプ採取方法において、 (1)並列プログラムを実行する複数の処理プロセッサ
のいずれかに障害が発生したときに、前記複数の処理プ
ロセッサによる処理を停止させ、 (2)前記複数の処理プロセッサにダンプ取得プログラ
ムを送り、 (3)前記送られたダンプ取得プログラムにより、前記
障害プロセッサの内部記憶装置に、前記複数の処理プロ
セッサのうちの前記障害プロセッサを除いた処理プロセ
ッサの各ダンプを書き込ませ、 (4)前記ステップ(3)によるダンプ書き込み完了後
に、前記複数の処理プロセッサのうちの前記障害プロセ
ッサを除いた処理プロセッサを再起動させ、 (5)前記障害プロセッサに書き込まれた各ダンプおよ
び前記障害プロセッサ自身のダンプを外部記憶装置へ読
み出させることを特徴とするダンプ採取方法。 - 【請求項8】 (6)前記ステップ(5)によるダンプ
読み出し完了後に、前記障害プロセッサを再起動させる
ことを特徴とする請求項7記載のダンプ採取方法。 - 【請求項9】 前記ステップ(3)において、前記障害
プロセッサの内部記憶装置に前記ダンプの全てを書き込
みきれない場合には、前記複数の処理プロセッサのうち
で既に自己のダンプの送出を済んでいる送出済プロセッ
サの内部記憶装置に、残りのダンプを書き込ませ、 前記ステップ(4)において、前記ダンプの全てを書き
込みきれない場合に、前記複数の処理プロセッサのうち
の前記障害プロセッサおよび前記送出済プロセッサを除
いた処理プロセッサを再起動させ、 前記ステップ(5)において、前記ダンプの全てを書き
込みきれない場合に、前記障害プロセッサおよび前記送
出済プロセッサに書き込まれた各ダンプ、並びに前記障
害プロセッサ自身のダンプを前記外部記憶装置へ読み出
させることを特徴とする請求項7記載のダンプ採取方
法。
Priority Applications (3)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP20015495A JP3481737B2 (ja) | 1995-08-07 | 1995-08-07 | ダンプ採取装置およびダンプ採取方法 |
| US08/623,995 US5884019A (en) | 1995-08-07 | 1996-03-29 | System and method for collecting dump information in a multi-processor data processing system |
| DE19615644A DE19615644C2 (de) | 1995-08-07 | 1996-04-22 | Verfahren zum Sammeln von Speicherauszugsinformationen durch einen Steuerprozessor und Datenverarbeitungsanlage zur Durchführung des Verfahrens |
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| JP20015495A JP3481737B2 (ja) | 1995-08-07 | 1995-08-07 | ダンプ採取装置およびダンプ採取方法 |
Publications (2)
| Publication Number | Publication Date |
|---|---|
| JPH0950424A true JPH0950424A (ja) | 1997-02-18 |
| JP3481737B2 JP3481737B2 (ja) | 2003-12-22 |
Family
ID=16419694
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP20015495A Expired - Lifetime JP3481737B2 (ja) | 1995-08-07 | 1995-08-07 | ダンプ採取装置およびダンプ採取方法 |
Country Status (3)
| Country | Link |
|---|---|
| US (1) | US5884019A (ja) |
| JP (1) | JP3481737B2 (ja) |
| DE (1) | DE19615644C2 (ja) |
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2016042618A (ja) * | 2014-08-13 | 2016-03-31 | 富士電機株式会社 | 制御装置及び制御方法 |
Families Citing this family (19)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| DE19827432C2 (de) * | 1997-07-25 | 2001-07-26 | Siemens Ag | Verfahren zur Speicherung von Rechner-Zustandsdaten bei einem Störfall, der ein anschließendes Wieder-Hochfahren des Rechners erfordert |
| JP3389842B2 (ja) * | 1997-10-08 | 2003-03-24 | トヨタ自動車株式会社 | データ修復システム及び車両用データ修復装置並びにデータ修復プログラムを記録した媒体 |
| US6675324B2 (en) * | 1999-09-27 | 2004-01-06 | Intel Corporation | Rendezvous of processors with OS coordination |
| US6643802B1 (en) * | 2000-04-27 | 2003-11-04 | Ncr Corporation | Coordinated multinode dump collection in response to a fault |
| US6738928B1 (en) * | 2000-06-19 | 2004-05-18 | Hewlett-Packard Development Company, L.P. | Method and expert system for analysis of crash dumps |
| US6832342B2 (en) * | 2001-03-01 | 2004-12-14 | International Business Machines Corporation | Method and apparatus for reducing hardware scan dump data |
| US6912670B2 (en) * | 2002-01-22 | 2005-06-28 | International Business Machines Corporation | Processor internal error handling in an SMP server |
| US6973598B2 (en) * | 2002-01-28 | 2005-12-06 | Dell Products L.P. | Computer system with improved data capture system |
| US8799706B2 (en) * | 2004-03-30 | 2014-08-05 | Hewlett-Packard Development Company, L.P. | Method and system of exchanging information between processors |
| US20050240806A1 (en) * | 2004-03-30 | 2005-10-27 | Hewlett-Packard Development Company, L.P. | Diagnostic memory dump method in a redundant processor |
| US7308609B2 (en) * | 2004-04-08 | 2007-12-11 | International Business Machines Corporation | Method, data processing system, and computer program product for collecting first failure data capture information |
| CN1755660B (zh) * | 2004-09-28 | 2010-09-29 | 惠普开发有限公司 | 冗余处理器中的诊断存储器转储方法 |
| US7383471B2 (en) * | 2004-12-28 | 2008-06-03 | Hewlett-Packard Development Company, L.P. | Diagnostic memory dumping |
| US7590885B2 (en) * | 2005-04-26 | 2009-09-15 | Hewlett-Packard Development Company, L.P. | Method and system of copying memory from a source processor to a target processor by duplicating memory writes |
| US9176803B2 (en) * | 2006-08-14 | 2015-11-03 | International Business Machines Corporation | Collecting data from a system in response to an event based on an identification in a file of the data to collect |
| US8127099B2 (en) * | 2006-12-26 | 2012-02-28 | International Business Machines Corporation | Resource recovery using borrowed blocks of memory |
| US8473818B2 (en) * | 2009-10-12 | 2013-06-25 | Empire Technology Development Llc | Reliable communications in on-chip networks |
| KR20190037666A (ko) * | 2017-09-29 | 2019-04-08 | 에스케이하이닉스 주식회사 | 데이터 저장 장치 및 그것의 동작 방법 |
| US11379290B2 (en) | 2019-07-17 | 2022-07-05 | International Business Machines Corporation | Prioritizing and parallelizing the capture of data for debugging computer programs |
Family Cites Families (2)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| DE69021712T2 (de) * | 1990-02-08 | 1996-04-18 | Ibm | Wiederanlaufkennzeichnungsmechanismus für fehlertolerierende Systeme. |
| US5634096A (en) * | 1994-10-31 | 1997-05-27 | International Business Machines Corporation | Using virtual disks for disk system checkpointing |
-
1995
- 1995-08-07 JP JP20015495A patent/JP3481737B2/ja not_active Expired - Lifetime
-
1996
- 1996-03-29 US US08/623,995 patent/US5884019A/en not_active Expired - Lifetime
- 1996-04-22 DE DE19615644A patent/DE19615644C2/de not_active Expired - Fee Related
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JP2016042618A (ja) * | 2014-08-13 | 2016-03-31 | 富士電機株式会社 | 制御装置及び制御方法 |
Also Published As
| Publication number | Publication date |
|---|---|
| US5884019A (en) | 1999-03-16 |
| JP3481737B2 (ja) | 2003-12-22 |
| DE19615644A1 (de) | 1997-02-13 |
| DE19615644C2 (de) | 1998-07-09 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| JPH0950424A (ja) | ダンプ採取装置およびダンプ採取方法 | |
| EP0479230B1 (en) | Recovery method and apparatus for a pipelined processing unit of a multiprocessor system | |
| JP5392594B2 (ja) | 仮想計算機冗長化システム、コンピュータシステム、仮想計算機冗長化方法、及びプログラム | |
| JPH07117903B2 (ja) | 障害回復方法 | |
| US5056091A (en) | Method for handling errors detected in a computer system | |
| JPS59123058A (ja) | マシンチエツク処理方式 | |
| JPH0465411B2 (ja) | ||
| US8032791B2 (en) | Diagnosis of and response to failure at reset in a data processing system | |
| CN100394394C (zh) | 容错双工计算机系统及其控制方法 | |
| EP3534259B1 (en) | Computer and method for storing state and event log relevant for fault diagnosis | |
| CN109343986B (zh) | 处理内存故障的方法与计算机系统 | |
| JPH02294739A (ja) | 障害検出方式 | |
| JPH07183891A (ja) | 計算機システム | |
| JPH11120154A (ja) | コンピュータシステムにおけるアクセス制御装置および方法 | |
| JPH06342387A (ja) | 情報処理装置に於ける障害情報採取方式 | |
| JP2785992B2 (ja) | サーバプログラムの管理処理方式 | |
| JPS6229820B2 (ja) | ||
| JPH0869593A (ja) | プラント性能監視システム | |
| JP2922981B2 (ja) | タスクの実行継続方法 | |
| JPH03273344A (ja) | フォールトトレラントシステム | |
| JPH0667909A (ja) | 障害回復方式 | |
| JPH04124735A (ja) | システム起動方式 | |
| JP3019409B2 (ja) | マルチプロセッサシステムのマシンチェックテスト方法 | |
| JPH0746344B2 (ja) | 通信システムの障害情報収集方法 | |
| JPH03156646A (ja) | 障害情報の出力方式 |
Legal Events
| Date | Code | Title | Description |
|---|---|---|---|
| A01 | Written decision to grant a patent or to grant a registration (utility model) |
Free format text: JAPANESE INTERMEDIATE CODE: A01 Effective date: 20030930 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20071010 Year of fee payment: 4 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20081010 Year of fee payment: 5 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20081010 Year of fee payment: 5 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20091010 Year of fee payment: 6 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20091010 Year of fee payment: 6 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20101010 Year of fee payment: 7 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20101010 Year of fee payment: 7 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20111010 Year of fee payment: 8 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20111010 Year of fee payment: 8 |
|
| FPAY | Renewal fee payment (event date is renewal date of database) |
Free format text: PAYMENT UNTIL: 20121010 Year of fee payment: 9 |