JPH02118872A - I/oの読み取りに対するエラーチェック機能を有したデュアルレールプロセッサ - Google Patents
I/oの読み取りに対するエラーチェック機能を有したデュアルレールプロセッサInfo
- Publication number
- JPH02118872A JPH02118872A JP1220114A JP22011489A JPH02118872A JP H02118872 A JPH02118872 A JP H02118872A JP 1220114 A JP1220114 A JP 1220114A JP 22011489 A JP22011489 A JP 22011489A JP H02118872 A JPH02118872 A JP H02118872A
- Authority
- JP
- Japan
- Prior art keywords
- data
- error
- memory
- zone
- central processing
- Prior art date
- Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
- Pending
Links
Classifications
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/16—Error detection or correction of the data by redundancy in hardware
- G06F11/1629—Error detection by comparing the output of redundant processing systems
- G06F11/1633—Error detection by comparing the output of redundant processing systems using mutual exchange of the output between the redundant processing components
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/0703—Error or fault processing not based on redundancy, i.e. by taking additional measures to deal with the error or fault not making use of redundancy in operation, in hardware, or in data representation
- G06F11/0706—Error or fault processing not based on redundancy, i.e. by taking additional measures to deal with the error or fault not making use of redundancy in operation, in hardware, or in data representation the processing taking place on a specific hardware platform or in a specific software environment
- G06F11/0721—Error or fault processing not based on redundancy, i.e. by taking additional measures to deal with the error or fault not making use of redundancy in operation, in hardware, or in data representation the processing taking place on a specific hardware platform or in a specific software environment within a central processing unit [CPU]
- G06F11/0724—Error or fault processing not based on redundancy, i.e. by taking additional measures to deal with the error or fault not making use of redundancy in operation, in hardware, or in data representation the processing taking place on a specific hardware platform or in a specific software environment within a central processing unit [CPU] in a multiprocessor or a multi-core unit
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/0703—Error or fault processing not based on redundancy, i.e. by taking additional measures to deal with the error or fault not making use of redundancy in operation, in hardware, or in data representation
- G06F11/0706—Error or fault processing not based on redundancy, i.e. by taking additional measures to deal with the error or fault not making use of redundancy in operation, in hardware, or in data representation the processing taking place on a specific hardware platform or in a specific software environment
- G06F11/0727—Error or fault processing not based on redundancy, i.e. by taking additional measures to deal with the error or fault not making use of redundancy in operation, in hardware, or in data representation the processing taking place on a specific hardware platform or in a specific software environment in a storage system, e.g. in a DASD or network based storage system
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/0703—Error or fault processing not based on redundancy, i.e. by taking additional measures to deal with the error or fault not making use of redundancy in operation, in hardware, or in data representation
- G06F11/079—Root cause analysis, i.e. error or fault diagnosis
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/14—Error detection or correction of the data by redundancy in operations
- G06F11/1402—Saving, restoring, recovering or retrying
- G06F11/1415—Saving, restoring, recovering or retrying at system level
- G06F11/142—Reconfiguring to eliminate the error
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/16—Error detection or correction of the data by redundancy in hardware
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/16—Error detection or correction of the data by redundancy in hardware
- G06F11/1629—Error detection by comparing the output of redundant processing systems
- G06F11/165—Error detection by comparing the output of redundant processing systems with continued operation after detection of the error
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/0703—Error or fault processing not based on redundancy, i.e. by taking additional measures to deal with the error or fault not making use of redundancy in operation, in hardware, or in data representation
- G06F11/0751—Error or fault detection not based on redundancy
- G06F11/0754—Error or fault detection not based on redundancy by exceeding limits
- G06F11/076—Error or fault detection not based on redundancy by exceeding limits by exceeding a count or rate limit, e.g. word- or bit count limit
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/08—Error detection or correction by redundancy in data representation, e.g. by using checking codes
- G06F11/10—Adding special bits or symbols to the coded information, e.g. parity check, casting out 9's or 11's
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/08—Error detection or correction by redundancy in data representation, e.g. by using checking codes
- G06F11/10—Adding special bits or symbols to the coded information, e.g. parity check, casting out 9's or 11's
- G06F11/1008—Adding special bits or symbols to the coded information, e.g. parity check, casting out 9's or 11's in individual solid state devices
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/16—Error detection or correction of the data by redundancy in hardware
- G06F11/1658—Data re-synchronization of a redundant component, or initial sync of replacement, additional or spare unit
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/16—Error detection or correction of the data by redundancy in hardware
- G06F11/20—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
- G06F11/16—Error detection or correction of the data by redundancy in hardware
- G06F11/20—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements
- G06F11/2097—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements maintaining the standby controller/processing unit updated
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F11/00—Error detection; Error correction; Monitoring
- G06F11/22—Detection or location of defective computer hardware by testing during standby operation or during idle time, e.g. start-up testing
- G06F11/2205—Detection or location of defective computer hardware by testing during standby operation or during idle time, e.g. start-up testing using arrangements specific to the hardware being tested
-
- G—PHYSICS
- G06—COMPUTING OR CALCULATING; COUNTING
- G06F—ELECTRIC DIGITAL DATA PROCESSING
- G06F2201/00—Indexing scheme relating to error detection, to error correction, and to monitoring
- G06F2201/845—Systems in which the redundancy can be transformed in increased performance
Landscapes
- Engineering & Computer Science (AREA)
- Theoretical Computer Science (AREA)
- Quality & Reliability (AREA)
- Physics & Mathematics (AREA)
- General Engineering & Computer Science (AREA)
- General Physics & Mathematics (AREA)
- Health & Medical Sciences (AREA)
- Biomedical Technology (AREA)
- Hardware Redundancy (AREA)
- Retry When Errors Occur (AREA)
Abstract
(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。
め要約のデータは記録されません。
Description
【発明の詳細な説明】
産業上の利用分野
本発明は、耐欠陥マルチブロセッザコンピュータシステ
ムを形成する方法及びシステムに係る。
ムを形成する方法及びシステムに係る。
従来の技術
データ処理が中断されないことが重要であるようなコン
ピュータシステムの用途は多数ある。
ピュータシステムの用途は多数ある。
このような用途としては、例えば、ファイナンスの業界
、原子カプラントのような厳密な工業設備、そして一般
には、コンピュータシステムの欠陥によって重大な破壊
を招く場合が挙げられる。
、原子カプラントのような厳密な工業設備、そして一般
には、コンピュータシステムの欠陥によって重大な破壊
を招く場合が挙げられる。
耐欠陥コンピュータシステムは、成る欠陥が生じてもデ
ータ処理を継続できるように複数のシステム又はシステ
ム部品を備えた色々な程度の冗長度で形成されている。
ータ処理を継続できるように複数のシステム又はシステ
ム部品を備えた色々な程度の冗長度で形成されている。
耐欠陥コンピュータシステムを得るために多数の解決策
が利用されている。
が利用されている。
1つの解決策においては、各々がそれ自身のメモリを有
した多数のマルチプロセッサが別々のタスクを実行する
。別の解決策においては、多数のマルチプロセッサが共
通のメモリを共有し、別々のタスクを実行する。更に別
の解決策は、各々それ自身のメモリを有する2つ以上の
マイクロプロセッサを使用してこれらが同じタスクを一
緒に行うようにすることである。更に別の解決策は、共
通のメモリを共有する2つ以上のマルチプロセッサを用
いて同じタスクを一緒に行うようにすることである。
した多数のマルチプロセッサが別々のタスクを実行する
。別の解決策においては、多数のマルチプロセッサが共
通のメモリを共有し、別々のタスクを実行する。更に別
の解決策は、各々それ自身のメモリを有する2つ以上の
マイクロプロセッサを使用してこれらが同じタスクを一
緒に行うようにすることである。更に別の解決策は、共
通のメモリを共有する2つ以上のマルチプロセッサを用
いて同じタスクを一緒に行うようにすることである。
上記の4つの解決策を組み合わせて使用する耐欠陥コン
ピュータシステムも考えられる。1つの公知の耐欠陥コ
ンピュータシステムにおいては、4つの中央処理ユニッ
トが使用され、そのうちの2つは第1のボードにおいて
デユーブレックス形態で作動しそして他の2つは第2の
ボードにおいてデユープレックス形態で作動する。各ボ
ードからの出力が等しいとき及び等しくないときを検出
するために比較器が使用される。これらが等しくないこ
とが比較器によって検出された場合には、欠陥ボードが
自動的に停止され、その後、他のボードによって出力が
与えられる。
ピュータシステムも考えられる。1つの公知の耐欠陥コ
ンピュータシステムにおいては、4つの中央処理ユニッ
トが使用され、そのうちの2つは第1のボードにおいて
デユーブレックス形態で作動しそして他の2つは第2の
ボードにおいてデユープレックス形態で作動する。各ボ
ードからの出力が等しいとき及び等しくないときを検出
するために比較器が使用される。これらが等しくないこ
とが比較器によって検出された場合には、欠陥ボードが
自動的に停止され、その後、他のボードによって出力が
与えられる。
発明が解決しようとする課題
公知の耐欠陥コンピュータシステムは、種々の程度の耐
欠陥特性を与えるが、その本来の目的を満たさず、然も
、本発明によつ、でもたらされるような効果も与えない
。
欠陥特性を与えるが、その本来の目的を満たさず、然も
、本発明によつ、でもたらされるような効果も与えない
。
そこで、本発明の目的は、通常同時に動作する二重のコ
ンピュータシステムを有した耐欠陥コンピュータ方法及
びシステムを提供することである。このような二重構成
は、単一欠陥点が生じないように確保し、一方のシステ
ムのエラー又は欠陥によって全コンピュータシステムが
作動不能にならないようにする。更に、このような欠陥
は、全て、エラーを生じさせたモジュール又は素子を作
動不能にするか又は無視することによって修正すること
ができる。
ンピュータシステムを有した耐欠陥コンピュータ方法及
びシステムを提供することである。このような二重構成
は、単一欠陥点が生じないように確保し、一方のシステ
ムのエラー又は欠陥によって全コンピュータシステムが
作動不能にならないようにする。更に、このような欠陥
は、全て、エラーを生じさせたモジュール又は素子を作
動不能にするか又は無視することによって修正すること
ができる。
本発明の更に別の目的及び効果は、以下の説明にその一
部分が記載されていると共に、以下の説明からその一部
分が明らかであろうし、又、本発明を実施することによ
って学び取ることができよう0本発明の目的及び効果は
、特許請求の範囲に特に指摘する方法、装置及びその組
み合わせによって実現されそして達成されるであろう。
部分が記載されていると共に、以下の説明からその一部
分が明らかであろうし、又、本発明を実施することによ
って学び取ることができよう0本発明の目的及び効果は
、特許請求の範囲に特に指摘する方法、装置及びその組
み合わせによって実現されそして達成されるであろう。
課題を解決するための手段
これら及び他の目的を達成するために、以下で述べるよ
うに実施される本発明によれば、プロセッサ間エラーチ
ェック機能を有するデュアルプロセッサのデータ処理シ
ステムにおいて、一連の命令を実行する第1の中央処理
ユニットと、この第1の中央処理ユニットと独立して及
び同期して上記一連の命令を実行する第2の中央処理ユ
ニットと、上記第1の中央処理ユニットに接続され。
うに実施される本発明によれば、プロセッサ間エラーチ
ェック機能を有するデュアルプロセッサのデータ処理シ
ステムにおいて、一連の命令を実行する第1の中央処理
ユニットと、この第1の中央処理ユニットと独立して及
び同期して上記一連の命令を実行する第2の中央処理ユ
ニットと、上記第1の中央処理ユニットに接続され。
上記第1の中央処理ユニットに入力されるべきデータを
受け取る第1のデータバスと、上記第2の中央処理ユニ
ットに接続され、上記第2の中央処理ユニットに入力さ
れるべきデータを受け取る第2のデータバスと、上記第
1及び第2のデータバスに接続され、上記第1及び第2
のデータバスを経て送られたデータをチェックすると共
に、上記データを上記第1及び第2の中央処理ユニット
に供給する前にI10読み取りに対するエラーを検出す
るためのエラーチェック手段であって、上記第1及び第
2のデータバスの上記データが等しくないときにエラー
を指示するための比較手段を含んでいるエラーチェック
手段と、上記ニラ−チェック手段から検出されたエラー
に応答して、システムを同期状態に保ちながらエラーの
原因を分析するためのエラー分離手段とを具備すること
を特徴とするデュアルプロセッサのデータ処理システム
が提供される。
受け取る第1のデータバスと、上記第2の中央処理ユニ
ットに接続され、上記第2の中央処理ユニットに入力さ
れるべきデータを受け取る第2のデータバスと、上記第
1及び第2のデータバスに接続され、上記第1及び第2
のデータバスを経て送られたデータをチェックすると共
に、上記データを上記第1及び第2の中央処理ユニット
に供給する前にI10読み取りに対するエラーを検出す
るためのエラーチェック手段であって、上記第1及び第
2のデータバスの上記データが等しくないときにエラー
を指示するための比較手段を含んでいるエラーチェック
手段と、上記ニラ−チェック手段から検出されたエラー
に応答して、システムを同期状態に保ちながらエラーの
原因を分析するためのエラー分離手段とを具備すること
を特徴とするデュアルプロセッサのデータ処理システム
が提供される。
本発明の別の特徴によれば、デュアルプロセッサのデー
タ処理システムは、上記第1及び第2の中央処理ユニッ
トに接続された主メモリユニットを具備し、エラーチェ
ック手段は、第1及び第2の入力バス上の入力データが
等しくないときにエラーの存在を指示するメモリ制御手
段を備えている。
タ処理システムは、上記第1及び第2の中央処理ユニッ
トに接続された主メモリユニットを具備し、エラーチェ
ック手段は、第1及び第2の入力バス上の入力データが
等しくないときにエラーの存在を指示するメモリ制御手
段を備えている。
本発明の別の特徴においては、上記メモリ制御手段は、
上記第1データバスに接続された一次メモリ制御器であ
って、上記第1データバスから上記主メモリユニットへ
データを転送するための手段を含んだ一次メモリ制御器
と、上記第2バスに接続されたミラーメモリ制御器であ
って、上記第2のデータバスからのデータをエラーチェ
ックの目的で上記第1データバスからのデータと比較す
る手段を含んでいるようなミラーメモリ制御器とを備え
ている。
上記第1データバスに接続された一次メモリ制御器であ
って、上記第1データバスから上記主メモリユニットへ
データを転送するための手段を含んだ一次メモリ制御器
と、上記第2バスに接続されたミラーメモリ制御器であ
って、上記第2のデータバスからのデータをエラーチェ
ックの目的で上記第1データバスからのデータと比較す
る手段を含んでいるようなミラーメモリ制御器とを備え
ている。
又、本発明の特徴によれば、第1の処理システムを具備
し、このシステムは、一連の命令を実行する第1の中央
処理ユニットと、該第1の中央処理ユニットと独立して
及び同期して上記一連の命令を実行する第2の中央処理
ユニットと、上記第1の中央処理ユニットに接続され、
上記第1の中央処理ユニットに入力されるべきデータを
受け取る第1のデータバスと、上記第2の中央処理ユニ
ットに接続され、上記第2の中央処理ユニットに入力さ
れるべきデータを受け取る第2のデータバスと、上記第
1及び第2のデータバスに接続され、上記第1及び第2
のデータバスを経て送られたデータをチェックすると共
に、上記第1及び第2の中央処理ユニットに上記データ
を供給する前にI/Oの読み取りに対するエラーを検出
するための第1のエラーチェック手段であって、上記第
1及び第2データバス上の上記データが等しくないとき
にエラーを指示する第1比較手段を備えているような第
1のエラーチェック手段とを備えており、そして更に、
上記第1の処理システムと実質的に同期して作動する第
2の処理システムを具備し、この第2の処理システムは
、上記一連の命令を実行する第3の中央処理ユニットと
、該第3の中央処理ユニットと独立して及び同期して上
記一連の命令を実行する第4の中央処理ユニットと。
し、このシステムは、一連の命令を実行する第1の中央
処理ユニットと、該第1の中央処理ユニットと独立して
及び同期して上記一連の命令を実行する第2の中央処理
ユニットと、上記第1の中央処理ユニットに接続され、
上記第1の中央処理ユニットに入力されるべきデータを
受け取る第1のデータバスと、上記第2の中央処理ユニ
ットに接続され、上記第2の中央処理ユニットに入力さ
れるべきデータを受け取る第2のデータバスと、上記第
1及び第2のデータバスに接続され、上記第1及び第2
のデータバスを経て送られたデータをチェックすると共
に、上記第1及び第2の中央処理ユニットに上記データ
を供給する前にI/Oの読み取りに対するエラーを検出
するための第1のエラーチェック手段であって、上記第
1及び第2データバス上の上記データが等しくないとき
にエラーを指示する第1比較手段を備えているような第
1のエラーチェック手段とを備えており、そして更に、
上記第1の処理システムと実質的に同期して作動する第
2の処理システムを具備し、この第2の処理システムは
、上記一連の命令を実行する第3の中央処理ユニットと
、該第3の中央処理ユニットと独立して及び同期して上
記一連の命令を実行する第4の中央処理ユニットと。
上記第3の中央処理ユニットに接続され、上記第3の中
央処理ユニットに入力されるべきデータを受け取る第3
のデータバスと、上記第4の中央処理ユニットに接続さ
れ、上記第4の中央処理ユニットに入力されるべきデー
タを受け取る第4のデータバスと、上記第3及び第4の
データバスに接続され、上記第3及び第4のデータバス
を経て送られたデータをチェックすると共に、上記第3
及び第4の中央処理ユニットに上記データを供給する前
にI/Oの読み取りに対するエラーを検出するための第
2のエラーチェック手段であって、上記第3及び第4デ
ータバス上の上記データが等しくないときにエラーを指
示する第2比較手段を備えているような第2のエラーチ
ェック手段とを備えており、そして更に、上記第1と第
2の処理システム間に接続されたクロスリンク通信手段
であって、上記第1と第2の処理システム間に両方向性
の同期通信を与えるクロスリンク通信手段を備えたこと
を特徴とする耐欠陥コンピュータシステムが提供される
。
央処理ユニットに入力されるべきデータを受け取る第3
のデータバスと、上記第4の中央処理ユニットに接続さ
れ、上記第4の中央処理ユニットに入力されるべきデー
タを受け取る第4のデータバスと、上記第3及び第4の
データバスに接続され、上記第3及び第4のデータバス
を経て送られたデータをチェックすると共に、上記第3
及び第4の中央処理ユニットに上記データを供給する前
にI/Oの読み取りに対するエラーを検出するための第
2のエラーチェック手段であって、上記第3及び第4デ
ータバス上の上記データが等しくないときにエラーを指
示する第2比較手段を備えているような第2のエラーチ
ェック手段とを備えており、そして更に、上記第1と第
2の処理システム間に接続されたクロスリンク通信手段
であって、上記第1と第2の処理システム間に両方向性
の同期通信を与えるクロスリンク通信手段を備えたこと
を特徴とする耐欠陥コンピュータシステムが提供される
。
又、本発明によれば、上記第1又は第2のエラーチェッ
ク手段から検出されたエラーに応答して、上記第1及び
第2の処理システムを同期状態に保ちながらエラーの原
因を分析するエラー分離手段を備えたデュアルプロセッ
サのコンピュータシステムが提供される。
ク手段から検出されたエラーに応答して、上記第1及び
第2の処理システムを同期状態に保ちながらエラーの原
因を分析するエラー分離手段を備えたデュアルプロセッ
サのコンピュータシステムが提供される。
本明細書に含まれてその一部分を構成する添付図面は1
本発明の一実施例を示すもので、これを参照しながら本
発明の詳細な説明する。
本発明の一実施例を示すもので、これを参照しながら本
発明の詳細な説明する。
実施例
以下、添付図面を参照し、本発明の好ましい実施例を詳
細に説明する。
細に説明する。
A、システムの説明
第1図は1本発明の目的を達成する耐欠陥コンピュータ
システム10のブロック図である。この耐欠陥コンピュ
ータシステム10は、ゾーン又はステーションと称する
二重のシステムを含んでいる0通常のモードにおいては
、これらゾーンが同時に作動する。この二重構成では、
単一欠陥点が生じないように確保すると共に、一方のゾ
ーンのエラー又は欠陥によってコンピュータシステム1
0が作動不能にならないようにする。更に、このような
全ての欠陥は、その欠陥を生じたモジュール又は素子を
作動不能にするか又は無視することによって修正するこ
とができる。2つのゾーン11及び11′が二重の処理
システム2o及び20′を含むものとして第1図に示さ
れている。然し乍ら、二重性は処理システムの範囲を賊
える。
システム10のブロック図である。この耐欠陥コンピュ
ータシステム10は、ゾーン又はステーションと称する
二重のシステムを含んでいる0通常のモードにおいては
、これらゾーンが同時に作動する。この二重構成では、
単一欠陥点が生じないように確保すると共に、一方のゾ
ーンのエラー又は欠陥によってコンピュータシステム1
0が作動不能にならないようにする。更に、このような
全ての欠陥は、その欠陥を生じたモジュール又は素子を
作動不能にするか又は無視することによって修正するこ
とができる。2つのゾーン11及び11′が二重の処理
システム2o及び20′を含むものとして第1図に示さ
れている。然し乍ら、二重性は処理システムの範囲を賊
える。
第2図は、耐欠陥コンピュータシステ1110の物理的
なハードウェアを示していると共にシステムの二重性を
示している。各ゾーン11及び11′は、各々、別々の
キャビネット12及び12′に収容される。キャビネッ
ト12は、バッテリ13と、電力レギュレータ14と、
冷却ファン16と、交流入力17とを備えている。キャ
ビネット12′は、キャビネット12の要素12−14
.16及び17に対応する別々の要素を備えている。
なハードウェアを示していると共にシステムの二重性を
示している。各ゾーン11及び11′は、各々、別々の
キャビネット12及び12′に収容される。キャビネッ
ト12は、バッテリ13と、電力レギュレータ14と、
冷却ファン16と、交流入力17とを備えている。キャ
ビネット12′は、キャビネット12の要素12−14
.16及び17に対応する別々の要素を備えている。
以下で詳細に述べるように、処理システム2o及び20
′は、バックプレーンによって相互接続された多数のモ
ジュールを備えている。成るモジュールが欠陥又はエラ
ーを含んでいる場合には。
′は、バックプレーンによって相互接続された多数のモ
ジュールを備えている。成るモジュールが欠陥又はエラ
ーを含んでいる場合には。
コンピュータシステム10を作動不能にすることなくそ
のモジュールを取外して交換することができる。これは
、処理システム20及び20’ が物理的に別々のもの
であって、別々のバンクプレーンを有しており、これら
バックプレーンにモジュールを差し込んで互いに独立し
て動作させることができるからである。従って、一方の
処理システムが動作を続けている間に他方の処理システ
ムのバックプレーンからモジュールを取り外したり差し
込んだりすることができる。
のモジュールを取外して交換することができる。これは
、処理システム20及び20’ が物理的に別々のもの
であって、別々のバンクプレーンを有しており、これら
バックプレーンにモジュールを差し込んで互いに独立し
て動作させることができるからである。従って、一方の
処理システムが動作を続けている間に他方の処理システ
ムのバックプレーンからモジュールを取り外したり差し
込んだりすることができる。
二重の処理システム20及び20′は同一のものであっ
て、同一のモジュールを含んでいる。
て、同一のモジュールを含んでいる。
従って、処理システム20についてのみ完全に説明すれ
ば、処理システム20′が同等に動作することが理解さ
れよう。
ば、処理システム20′が同等に動作することが理解さ
れよう。
処理システム20は、第3図及び第4図に詳細に示され
たCPUモジュール30を備えている。
たCPUモジュール30を備えている。
このCPUモジュール30は、以下で詳細に説明するク
ロスリンク通路25によって処理システム20′のCP
Uモジュール30′に相互接続される。クロスリンク通
路25は、処理システム20と20′との間のデータ送
信経路を形成し、処理システム2o及び20’ が同期
して動作するよう確保するタイミング信号を搬送する。
ロスリンク通路25によって処理システム20′のCP
Uモジュール30′に相互接続される。クロスリンク通
路25は、処理システム20と20′との間のデータ送
信経路を形成し、処理システム2o及び20’ が同期
して動作するよう確保するタイミング信号を搬送する。
又、処理システム20は、第3図及び第17図に詳細に
示されたI10モジュール100.110及び120を
備えている。これらI10モジュール100.110及
び120の各々は、二重レールモジュール相互接続部1
30及ヒ132 ニよってCPUモジュール30に接続
されている。
示されたI10モジュール100.110及び120を
備えている。これらI10モジュール100.110及
び120の各々は、二重レールモジュール相互接続部1
30及ヒ132 ニよってCPUモジュール30に接続
されている。
モジュール相互接続部130及び132は、処理システ
ム2oのためのバックプレーンとして働く。
ム2oのためのバックプレーンとして働く。
B、耐欠陥システムの原理
耐欠陥コンピュータシステム10は、各要素が二重にな
っているので、単一欠陥点をもつことがない、処理シス
テム20及び20’の各々は。
っているので、単一欠陥点をもつことがない、処理シス
テム20及び20’の各々は。
欠陥停止処理システムであり、即ち、これらシステムは
サブシステム内の欠陥又はエラーを検出するとそれらが
制御されない状態で他のサブシステムへ伝播するのを防
止することができる。
サブシステム内の欠陥又はエラーを検出するとそれらが
制御されない状態で他のサブシステムへ伝播するのを防
止することができる。
2つの欠陥停止処理システム2o及び20’は、規定の
状態で動作する幾つかの要素によって相互接続されて、
フェイルセーフシステムを形成する。耐欠陥コンピュー
タシステム10として実施されるフェイルセーフシステ
ムにおいては、欠陥停止処理システム20及び20′の
一方に欠陥が生じた場合でもコンピユークシステ11全
体が処理を続けることができる。
状態で動作する幾つかの要素によって相互接続されて、
フェイルセーフシステムを形成する。耐欠陥コンピュー
タシステム10として実施されるフェイルセーフシステ
ムにおいては、欠陥停止処理システム20及び20′の
一方に欠陥が生じた場合でもコンピユークシステ11全
体が処理を続けることができる。
一般に、2つの欠陥停止処理システム20及び20′は
ロックステップ同期状態で動作する。
ロックステップ同期状態で動作する。
3つの重要な例外がある。その第1は、以下で詳細に述
べるブートストラップ技術によって両方のプロセッサを
同期状態にもっていくときの初期化である。第2の例外
は、処理システム20及び20′が2つの異なるワーク
ロードにおいて独立して(非同期で)動作するときであ
る。第3の例外は、処理システム2o及び20′に幾つ
かのエラーが生じるときである。この第3の例外におい
ては、処理システム又はモジュールの1つが動作不能に
され、同期動作が終了となる。
べるブートストラップ技術によって両方のプロセッサを
同期状態にもっていくときの初期化である。第2の例外
は、処理システム20及び20′が2つの異なるワーク
ロードにおいて独立して(非同期で)動作するときであ
る。第3の例外は、処理システム2o及び20′に幾つ
かのエラーが生じるときである。この第3の例外におい
ては、処理システム又はモジュールの1つが動作不能に
され、同期動作が終了となる。
二重処理システム20及び20’の同期は、同じ入力を
受けて同じ既知の状態でスタートするときに常に同じマ
シン状態に入ってエラーが生じない限り同じ結果を与え
る決定的なマシンとして各システムを処理することによ
って実行される。
受けて同じ既知の状態でスタートするときに常に同じマ
シン状態に入ってエラーが生じない限り同じ結果を与え
る決定的なマシンとして各システムを処理することによ
って実行される。
処理システム20及び20’は、同一の構成にされ、同
じ入力を受け、それ故、同じ状態を通る。
じ入力を受け、それ故、同じ状態を通る。
従って、両方のプロセッサが同期して動作する限りこれ
らプロセッサが同じ結果を与えそして同じ状態に入らな
ければならない、処理システムが同じ状態にないか又は
異なった結果を与える場合には、処理システム20及び
20′の一方に欠陥が生じたと仮定される。修正処置を
とるためには欠陥源を分離し、例えば、欠陥モジュール
を動作不能にしなければならない。
らプロセッサが同じ結果を与えそして同じ状態に入らな
ければならない、処理システムが同じ状態にないか又は
異なった結果を与える場合には、処理システム20及び
20′の一方に欠陥が生じたと仮定される。修正処置を
とるためには欠陥源を分離し、例えば、欠陥モジュール
を動作不能にしなければならない。
エラー検出には、一般に、付加的な処理時間又は論理の
形態のオーバーヘッドが含まれる。このようなオーバー
ヘッドを最小にするためには、耐欠陥動作に適合するよ
うにできるだけ頻繁にならないようにシステムがエラー
をチェックしなければならない、CPUモジュール30
及び30’からデータが出力される前に行うエラーチェ
ックは非常に僅かでなければならない、さもなくば、原
子炉の場合と同様に内部の処理エラーによって外部のシ
ステムに不適切な動作が生じ、このような状態を防止す
るように耐欠陥システムが設計されている。
形態のオーバーヘッドが含まれる。このようなオーバー
ヘッドを最小にするためには、耐欠陥動作に適合するよ
うにできるだけ頻繁にならないようにシステムがエラー
をチェックしなければならない、CPUモジュール30
及び30’からデータが出力される前に行うエラーチェ
ックは非常に僅かでなければならない、さもなくば、原
子炉の場合と同様に内部の処理エラーによって外部のシ
ステムに不適切な動作が生じ、このような状態を防止す
るように耐欠陥システムが設計されている。
付加的なエラーチェックを行う理由は幾つかある。例え
ば、欠陥又はエラーを分離するためには、CPUモジュ
ール30及び30’ によって受け取ったデータを記憶
又は使用の前にチェックすることが望ましい、さもなく
ば、エラーのある記憶データが後でアクセスされて付加
的なエラーが生じたときには、エラーの発生源を見つけ
ることが困難もしくは不可能となる。これは、特に、エ
ラーのあるデータがいつの間にか記憶された場合にいえ
ることである1時間がたったりエラーデータが後で処理
されたときにはエラー発生源への追跡動作が破壊される
。
ば、欠陥又はエラーを分離するためには、CPUモジュ
ール30及び30’ によって受け取ったデータを記憶
又は使用の前にチェックすることが望ましい、さもなく
ば、エラーのある記憶データが後でアクセスされて付加
的なエラーが生じたときには、エラーの発生源を見つけ
ることが困難もしくは不可能となる。これは、特に、エ
ラーのあるデータがいつの間にか記憶された場合にいえ
ることである1時間がたったりエラーデータが後で処理
されたときにはエラー発生源への追跡動作が破壊される
。
エラーが検出される前に記憶される時間の長さを表わす
「エラー待ち時間」も後で問題を生じさせる。例えば、
めったに使用しないルーチンは。
「エラー待ち時間」も後で問題を生じさせる。例えば、
めったに使用しないルーチンは。
コンピュータシステムが手前のエラーによって減少した
容量で既に動作しているときには待ち時間エラーをカバ
ーしない、コンピュータシステムの容量が減少したとき
には、待ち時間エラーによってシステムがクラッシュす
る。
容量で既に動作しているときには待ち時間エラーをカバ
ーしない、コンピュータシステムの容量が減少したとき
には、待ち時間エラーによってシステムがクラッシュす
る。
更に、二重レールシステムである処理システム20及び
20’ においては、メモリのような共有リソースのご
とき単一レールシステムにデータを転送する前にエラー
をチェックすることが所望される。というのは、このよ
うな転送の後には2つの独立したデータリソースがもは
やなく、単一レールシステムのエラーが後で検出された
場合には、エラーの追跡が不可能ではないまでも困難に
なるからである。
20’ においては、メモリのような共有リソースのご
とき単一レールシステムにデータを転送する前にエラー
をチェックすることが所望される。というのは、このよ
うな転送の後には2つの独立したデータリソースがもは
やなく、単一レールシステムのエラーが後で検出された
場合には、エラーの追跡が不可能ではないまでも困難に
なるからである。
C,モジュールの説明
1、CPUモジュール
第1図に示されたC P tJモジュール30の要素が
第3図及び第4図に詳細に示されている。第3図はCP
Uモジュールのブロック図であり、第4図はCPUモジ
ュール30、I10モジュール100及びそれらの相互
接続部のブロック図である。CPUモジュール30及び
30′に含まれた要素及びその動作は同じであるから、
CPUモジュール30についてのみ説明する。
第3図及び第4図に詳細に示されている。第3図はCP
Uモジュールのブロック図であり、第4図はCPUモジ
ュール30、I10モジュール100及びそれらの相互
接続部のブロック図である。CPUモジュール30及び
30′に含まれた要素及びその動作は同じであるから、
CPUモジュール30についてのみ説明する。
CPUモジュール30は、二重のCPU40及び50を
含んでいる。これらCPU40及び50は、当業者に知
ら九でいる標準的な中央処理ユニットである。ここに述
べる好ましい実施例では、CPU40及び50は、本発
明の譲受人゛であるデジタルエクイップメント社によっ
て製造されたVAX(登録商標)プロセッサである。
含んでいる。これらCPU40及び50は、当業者に知
ら九でいる標準的な中央処理ユニットである。ここに述
べる好ましい実施例では、CPU40及び50は、本発
明の譲受人゛であるデジタルエクイップメント社によっ
て製造されたVAX(登録商標)プロセッサである。
CPU40及び50には、これらCPUに対して充分な
メモリサイズの標準的なキャッシュRAMであるキャッ
シュメモリ42及び52が各々組み合わされる。好まし
い実施例においては、キャッシュRAMが4KX64ビ
ツトである。然し。
メモリサイズの標準的なキャッシュRAMであるキャッ
シュメモリ42及び52が各々組み合わされる。好まし
い実施例においては、キャッシュRAMが4KX64ビ
ツトである。然し。
本発明は、キャッシュRAMをもつ必要はない。
CP U 40とキャッシュ42との間のインターフェ
イスとして働くのは、システムサポート・キャッシュ制
御要素44であり、CPU50とキャッシュ52との間
のインターフェイスとして働くのは、システムサポート
・キャッシュ制御要素54である。要素44と54は同
一であり、その各々は対応するキャッシュとCPUとの
間の標準的なインターフェイスをなし、又、インターバ
ルタイマのような従来の周辺装置機能をCPUに与える
、キャッシュバス43及び53は、CPU40及び50
を各々システムサポート・キャッシュ制御モジュール5
2及び42に接続する。
イスとして働くのは、システムサポート・キャッシュ制
御要素44であり、CPU50とキャッシュ52との間
のインターフェイスとして働くのは、システムサポート
・キャッシュ制御要素54である。要素44と54は同
一であり、その各々は対応するキャッシュとCPUとの
間の標準的なインターフェイスをなし、又、インターバ
ルタイマのような従来の周辺装置機能をCPUに与える
、キャッシュバス43及び53は、CPU40及び50
を各々システムサポート・キャッシュ制御モジュール5
2及び42に接続する。
2、メモ曹モジュール
CPU40及び50は、4つまでのメモリモジュール6
0を共有できるのが好ましい、第5図は1つのメモリモ
ジュール60のブロック図であり、そして第6図はモジ
ュール60の特定のメモリ要素を示す詳細図である。
0を共有できるのが好ましい、第5図は1つのメモリモ
ジュール60のブロック図であり、そして第6図はモジ
ュール60の特定のメモリ要素を示す詳細図である。
メモリモジュール60は、−次メモリ制御器70から3
2ビット両方向メモリバス85を経てデータを受け取る
。又、メモリモジュール60は。
2ビット両方向メモリバス85を経てデータを受け取る
。又、メモリモジュール60は。
メモリ制御器7o及び75から各々バス80及び82を
経てアドレス/制御信号も受け取る。バス8o及び82
は、行及び列のアドレス信号と、タイミング及び制御信
号1例えば、RAS (行アドレスストローブ)、CA
S C列アドレスストローブ)、WE(lFき込みイネ
ーブル)及びリフレッシュ信号とを含んでいる。
経てアドレス/制御信号も受け取る。バス8o及び82
は、行及び列のアドレス信号と、タイミング及び制御信
号1例えば、RAS (行アドレスストローブ)、CA
S C列アドレスストローブ)、WE(lFき込みイネ
ーブル)及びリフレッシュ信号とを含んでいる。
第5図に示すように、メモリモジュール60はメモリア
レイ600を含んでいる。このメモリアレイ600は1
行及び列アドレスによってアドレスできる標準的なRA
Mであるのが好ましい。
レイ600を含んでいる。このメモリアレイ600は1
行及び列アドレスによってアドレスできる標準的なRA
Mであるのが好ましい。
好ましい実施例では、メモリアレイ600は、メモリを
8バンクまで含むことができる。
8バンクまで含むことができる。
制御論理回路610は、アドレス及びメモリ制御信号を
伝送しそしてタイミング及び内部制御信号を発生する。
伝送しそしてタイミング及び内部制御信号を発生する。
第6図に詳細に示されたように。
制御論理回路610は、−次制御信号デマルチプレクサ
612と、ミラー制御信号デマルチプレクサ614と、
−次制御信号ドライバ616と、システムタイミング制
御信号発生器618とを備えている。−次制御信号デマ
ルチプレクサ612は、−次ボードアドレス及び−次バ
ンクアドレス信号及び−次RAS、CAS、WE及びリ
フレッシュ信号を一次メモリ制御l170から受け取る
。−次ボードアドレス信号が特定のボードを識別する場
合には、そのボードがアクティブとなり、そのボードの
デマルチプレクサ612は、RAS、CAS、リフレッ
シュ及び3ビツトのバンクアドレス信号から2組の8個
の制御信号を発生する。これら8個の制御信号は、−次
制御信号ドライバ616からの8個のPRAS (−次
RAS)及び8個のPCAS (−次CAS)信号とな
る。ドライバ616は、これらの信号をブーストして種
々のメモリバンクを駆動する。アクティブなメモリボー
ドについては、デマルチプレクサ612は、WE倍信号
デマルチプレクスしてその4つのコピーを形成し、これ
らはドライバ616によってブーストされて4つのPW
E (−次WE)信号が形成される。リフレッシュ動作
中には、全てのボードがアクティブとなる。
612と、ミラー制御信号デマルチプレクサ614と、
−次制御信号ドライバ616と、システムタイミング制
御信号発生器618とを備えている。−次制御信号デマ
ルチプレクサ612は、−次ボードアドレス及び−次バ
ンクアドレス信号及び−次RAS、CAS、WE及びリ
フレッシュ信号を一次メモリ制御l170から受け取る
。−次ボードアドレス信号が特定のボードを識別する場
合には、そのボードがアクティブとなり、そのボードの
デマルチプレクサ612は、RAS、CAS、リフレッ
シュ及び3ビツトのバンクアドレス信号から2組の8個
の制御信号を発生する。これら8個の制御信号は、−次
制御信号ドライバ616からの8個のPRAS (−次
RAS)及び8個のPCAS (−次CAS)信号とな
る。ドライバ616は、これらの信号をブーストして種
々のメモリバンクを駆動する。アクティブなメモリボー
ドについては、デマルチプレクサ612は、WE倍信号
デマルチプレクスしてその4つのコピーを形成し、これ
らはドライバ616によってブーストされて4つのPW
E (−次WE)信号が形成される。リフレッシュ動作
中には、全てのボードがアクティブとなる。
ミラー制御信号デマルチプレクサ614は。
ミラー信号に対して等しく動作する。ミラー信号は別々
のボードに供給されず、エラー検出に使用されるだけで
あるから、ドライバを必要としない。
のボードに供給されず、エラー検出に使用されるだけで
あるから、ドライバを必要としない。
システムタイミング/制御信号発生器618は、4種類
の入力、即ちクロッ信号と、書き込み、読み取り及びリ
フレッシュタイミングのようなメモリサイクル信号と、
当業者に良く知られた幾つかの他のシステム制御信号と
、アドレスビット29とを受け取る。アドレスビット2
9は、アドレス信号がメモリスペース(即ち、メモリー
アレイ600)へのアクセスを識別するか又はI10ス
ペース(■10装置又はシステムレジスタの1つ)への
アクセスを識別するかを決定する。システムタイミング
制御信号発生器618は、以下に述べるメモリモジュー
ル60の他の要素の整合及びタイミングを制御する。
の入力、即ちクロッ信号と、書き込み、読み取り及びリ
フレッシュタイミングのようなメモリサイクル信号と、
当業者に良く知られた幾つかの他のシステム制御信号と
、アドレスビット29とを受け取る。アドレスビット2
9は、アドレス信号がメモリスペース(即ち、メモリー
アレイ600)へのアクセスを識別するか又はI10ス
ペース(■10装置又はシステムレジスタの1つ)への
アクセスを識別するかを決定する。システムタイミング
制御信号発生器618は、以下に述べるメモリモジュー
ル60の他の要素の整合及びタイミングを制御する。
第5図に示された構成エラー論理回路620は、メモリ
モジュール60の動作中に検出されたエラーに関連した
情報を記憶する。特に、比較論理回路630によってエ
ラーが検出された場合には、構成エラー論理回路620
は、その欠陥アドレス及び/又はデータを識別するに必
要な情報を記憶する。然し乍ら、比較論理回路630は
、制御及びアドレス信号をチェックするだけで、メモリ
データ信号はチェックしない。
モジュール60の動作中に検出されたエラーに関連した
情報を記憶する。特に、比較論理回路630によってエ
ラーが検出された場合には、構成エラー論理回路620
は、その欠陥アドレス及び/又はデータを識別するに必
要な情報を記憶する。然し乍ら、比較論理回路630は
、制御及びアドレス信号をチェックするだけで、メモリ
データ信号はチェックしない。
メモリデータ信号はエラー検出コード(EDC)を用い
てチェックされる。好ましい実施例では、メモリ制御器
70及び75によって必要とされるものと同じコードを
使用し、これは、単一ビット修正、二重ビット検出、エ
ラー修正コード(ECC)であるのが好ましい。
てチェックされる。好ましい実施例では、メモリ制御器
70及び75によって必要とされるものと同じコードを
使用し、これは、単一ビット修正、二重ビット検出、エ
ラー修正コード(ECC)であるのが好ましい。
第6図に示されたように、構成エラー論理回路620は
、エラー処理論理回路625及びEEPROM626を
備えている。エラー処理論理回路625は、エラーカウ
ンタと、制御論理回路と。
、エラー処理論理回路625及びEEPROM626を
備えている。エラー処理論理回路625は、エラーカウ
ンタと、制御論理回路と。
4つの記憶レジスタ(1つは一次アドレス用、1つは二
次アドレス用、1つはECC用そして1つはデータワー
ド用)とを備えている。論理回路625は、以下で詳細
に述べる比較論理回路630の出力からエラー信号を発
生する。好ましくは、エラー状態が検出されたときに、
カウンタが増加し、論理回路625のレジスタが一次及
びそのミラーメモリアドレスと、FCCと、それに関連
したデータワードとを記憶する。何等かの形式のNVR
AM(不揮発性RAM) であルE E P ROM6
26は、オフライン診断に対してメモリエラーデータを
記憶する。メモリモジュールに欠陥が生じた後にこのモ
ジュールが取り外されたときには、欠陥の原因を判断す
るためにEEPROM626から記憶されたデータが取
り出される。
次アドレス用、1つはECC用そして1つはデータワー
ド用)とを備えている。論理回路625は、以下で詳細
に述べる比較論理回路630の出力からエラー信号を発
生する。好ましくは、エラー状態が検出されたときに、
カウンタが増加し、論理回路625のレジスタが一次及
びそのミラーメモリアドレスと、FCCと、それに関連
したデータワードとを記憶する。何等かの形式のNVR
AM(不揮発性RAM) であルE E P ROM6
26は、オフライン診断に対してメモリエラーデータを
記憶する。メモリモジュールに欠陥が生じた後にこのモ
ジュールが取り外されたときには、欠陥の原因を判断す
るためにEEPROM626から記憶されたデータが取
り出される。
比較論理回路630は、−次メモリ制御器70からのE
CC1制御及びアドレス信号をミラーメモリ制御器75
からの信号と比較することによりエラー検出を行い、こ
れら信号が互いに等しくないことを検出する。比較論理
回路630は、第6図に詳細に示されており、行及び列
アドレスメモリドライバ632.アドレス比較器634
、制御信号比較器636、ECC信号比較器638゜デ
ータ及びECCトランシーバ640、及びECC発生器
642を備えている。
CC1制御及びアドレス信号をミラーメモリ制御器75
からの信号と比較することによりエラー検出を行い、こ
れら信号が互いに等しくないことを検出する。比較論理
回路630は、第6図に詳細に示されており、行及び列
アドレスメモリドライバ632.アドレス比較器634
、制御信号比較器636、ECC信号比較器638゜デ
ータ及びECCトランシーバ640、及びECC発生器
642を備えている。
行及び列アドレスメモリドライバ632は、11ビツト
の行及び列アドレス信号を受け取って各信号の4つのコ
ピーを発生し、メモリアレイ600の全てのメモリバン
クに対して充分な信号強度を与える。
の行及び列アドレス信号を受け取って各信号の4つのコ
ピーを発生し、メモリアレイ600の全てのメモリバン
クに対して充分な信号強度を与える。
各々の一次行及び列アドレス信号の4つのコピーは、ミ
ラー行及び列アドレス信号と同様に、アドレス比較器6
34へ入力される。メモリモジュール60の好ましい実
施例においては2行及び列の両方のアドレスが11ビツ
トの長さであり、交互のサイクルにバス80及び82を
経て送信される。従って、各メモリアドレスごとに、2
つの比較が順次行われる。
ラー行及び列アドレス信号と同様に、アドレス比較器6
34へ入力される。メモリモジュール60の好ましい実
施例においては2行及び列の両方のアドレスが11ビツ
トの長さであり、交互のサイクルにバス80及び82を
経て送信される。従って、各メモリアドレスごとに、2
つの比較が順次行われる。
アドレス比較器634は、別々の信号に各々対応する1
1個の5人力排他的オアゲート回路を用いて44個の一
次行及び列アドレス信号と11個のミラー行及び列アド
レス信号を同時に比較する。排他的オアゲート回路は、
いずれかの入力が異なる場合にそれらの出力をイネーブ
ルする。同様に、アドレス比較器634は、−次ボード
アドレス信号とミラーボードアドレス信号を比較すると
共に、−次バンクアドレス信号とミラーバンクアドレス
信号を比較する。これら全ての信号は、デマルチプレク
サ612及び614へも入力される。
1個の5人力排他的オアゲート回路を用いて44個の一
次行及び列アドレス信号と11個のミラー行及び列アド
レス信号を同時に比較する。排他的オアゲート回路は、
いずれかの入力が異なる場合にそれらの出力をイネーブ
ルする。同様に、アドレス比較器634は、−次ボード
アドレス信号とミラーボードアドレス信号を比較すると
共に、−次バンクアドレス信号とミラーバンクアドレス
信号を比較する。これら全ての信号は、デマルチプレク
サ612及び614へも入力される。
システムタイミング及び制御信号発生器618は、入力
信号が安定したときに比較を行うようにするためにアド
レス比較器634のタイミングを制御する。比較の結果
は、エラー処理及び制御論理回路625へ入力される。
信号が安定したときに比較を行うようにするためにアド
レス比較器634のタイミングを制御する。比較の結果
は、エラー処理及び制御論理回路625へ入力される。
アドレス比較器634がいずれかの対応する信号が互い
に異なることが分かった場合には、回路625がエラー
を指示し、アドレス/制御エラー信号762をメモリ制
御器70及び80に送ることによって適当な処置をとる
。
に異なることが分かった場合には、回路625がエラー
を指示し、アドレス/制御エラー信号762をメモリ制
御器70及び80に送ることによって適当な処置をとる
。
制御信号比較器636は、アドレス信号比較器634と
同様に動作する。制御信号比較器636は、PRAS信
号とMRAS信号を比較し、PCAS信号とMCAS信
号を比較し、PWE信号とMWE信号を比較しそして一
次リフレッシュ信号とミラーリフレッシュ信号を比較す
る。制御信号比較器636は、アドレス比較器634と
はゾ同様にタイミングどりされ、比較エラーが指示され
たときに、エラー処理及び制御論理回路625はエラー
を指示し、アドレス/制御エラー信号をメモリ制御器7
0及び75に送信する。
同様に動作する。制御信号比較器636は、PRAS信
号とMRAS信号を比較し、PCAS信号とMCAS信
号を比較し、PWE信号とMWE信号を比較しそして一
次リフレッシュ信号とミラーリフレッシュ信号を比較す
る。制御信号比較器636は、アドレス比較器634と
はゾ同様にタイミングどりされ、比較エラーが指示され
たときに、エラー処理及び制御論理回路625はエラー
を指示し、アドレス/制御エラー信号をメモリ制御器7
0及び75に送信する。
ECC比較回路638は、比較器634及び636とは
若干具なった動作をする。書き込み動作の場合、ECC
比較器638は、データ及びECC)−ランシーバ64
0から7ビツトの一次ECCデータを受け取る。トラン
シーバ640はメモリアレイ600に対するデータ及び
ECC信号をバッファする0次いで、ECC比較器63
8は、トランシーバ640からのECC信号と、トラン
シーバ640の出力の32ビット−次データ信号からE
CC発生器642によって形成されたECC信号とを比
較する。
若干具なった動作をする。書き込み動作の場合、ECC
比較器638は、データ及びECC)−ランシーバ64
0から7ビツトの一次ECCデータを受け取る。トラン
シーバ640はメモリアレイ600に対するデータ及び
ECC信号をバッファする0次いで、ECC比較器63
8は、トランシーバ640からのECC信号と、トラン
シーバ640の出力の32ビット−次データ信号からE
CC発生器642によって形成されたECC信号とを比
較する。
又、ECC比較器638は、ミラーメモリ制御器75か
ら受け取ったミラーECC信号と、−次メモリ制御器7
oから受け取った一次制御信号とを比較する。いずれか
のFCC比較によって2つの信号が等しくないことが指
示された場合には、エラー処理及び制御論理回路625
がエラーを指示し、FCCエラー信号752をメモリ制
御器70及び75に送信する。比較器634及び636
の場合と同様に、ECC比較器638は、入力信号が安
定したときに比較が行われるようにタイミングどりされ
る。
ら受け取ったミラーECC信号と、−次メモリ制御器7
oから受け取った一次制御信号とを比較する。いずれか
のFCC比較によって2つの信号が等しくないことが指
示された場合には、エラー処理及び制御論理回路625
がエラーを指示し、FCCエラー信号752をメモリ制
御器70及び75に送信する。比較器634及び636
の場合と同様に、ECC比較器638は、入力信号が安
定したときに比較が行われるようにタイミングどりされ
る。
読み取り動作の場合には、32ビツトデータ及び7ビツ
トECCがメモリアレ、イ600から読み取られる。更
に、ECC発生器642は、ECC比較器638がメモ
リアレイ600からの7ビツトFCCと比較するところ
の32ビツトデータから7ビツトFCCを発生する。又
、ECC比較器638は、入力信号が安定したときに比
較が行われるようにタイミングどりされる。2つの信号
が等しくない場合には、エラー処理及び制御論理回路6
25がエラーを指示し、FCCエラー信号752をメモ
リ制御器70及び75へ送信する。
トECCがメモリアレ、イ600から読み取られる。更
に、ECC発生器642は、ECC比較器638がメモ
リアレイ600からの7ビツトFCCと比較するところ
の32ビツトデータから7ビツトFCCを発生する。又
、ECC比較器638は、入力信号が安定したときに比
較が行われるようにタイミングどりされる。2つの信号
が等しくない場合には、エラー処理及び制御論理回路6
25がエラーを指示し、FCCエラー信号752をメモ
リ制御器70及び75へ送信する。
前記したように、エラー処理論理回路625は、読み取
り動作中に生じる第1FCCエラーの一次及びミラーア
ドレスをセーブする。論理回路625内のカウンタのE
CCエラーカウントは、これが最初に発生する場合に1
にセットされる。
り動作中に生じる第1FCCエラーの一次及びミラーア
ドレスをセーブする。論理回路625内のカウンタのE
CCエラーカウントは、これが最初に発生する場合に1
にセットされる。
その後にECC読み取りエラーが生じると、メモリモジ
ュール60内のECCエラーカウントが増加される。C
PU40及び50は、メモリモジュールに記憶されたア
ドレス及びカウント情報を通常の診断テストの一部分と
して周期的にポーリングする。ポーリングプロセスの一
部分によりこれらレジスタがクリアされ、FCCエラー
のある次のアドレスをトラップできるようにする。CP
U40及び50が修正されたデータをトラップされたア
ドレスに書き込むときには、メモリアレイ600からの
これら「ソフトエラー」が修正される。
ュール60内のECCエラーカウントが増加される。C
PU40及び50は、メモリモジュールに記憶されたア
ドレス及びカウント情報を通常の診断テストの一部分と
して周期的にポーリングする。ポーリングプロセスの一
部分によりこれらレジスタがクリアされ、FCCエラー
のある次のアドレスをトラップできるようにする。CP
U40及び50が修正されたデータをトラップされたア
ドレスに書き込むときには、メモリアレイ600からの
これら「ソフトエラー」が修正される。
3・凶(−+J m旧1肛
前記したように、メモリモジュール60は、メモリへの
データ信号の比較は行わない、−次及びミラーメモリ制
御器70及び75がこのような比較を行う。メモリ制御
器7o及び75は、各々、メモリモジュール60へのC
PU40及び50のアクセスを制御する。−次メモリ制
御器70が第7図に詳細に示されており、ミラーメモリ
制御器75が第8図に詳細に示されている。これらメモ
リ制御器70及び75は第7図及び第8図では若干具な
って示されているが、融通性を得るためにはこれらが同
一であるのが好ましい、これらの図面は説明を簡略化す
るために別々に示されている。
データ信号の比較は行わない、−次及びミラーメモリ制
御器70及び75がこのような比較を行う。メモリ制御
器7o及び75は、各々、メモリモジュール60へのC
PU40及び50のアクセスを制御する。−次メモリ制
御器70が第7図に詳細に示されており、ミラーメモリ
制御器75が第8図に詳細に示されている。これらメモ
リ制御器70及び75は第7図及び第8図では若干具な
って示されているが、融通性を得るためにはこれらが同
一であるのが好ましい、これらの図面は説明を簡略化す
るために別々に示されている。
第7図に示すように、−大制御及びアドレスラインは一
次メモリ制御器70を通して一メモリモジュール60へ
直結されている。メモリ相互接続部80の一次制御信号
は、READ及びWRITEといった必要な全°てのタ
イミング及び内部制御信号を形成するために回路(図示
せず)によって処理され、デコードされる。
次メモリ制御器70を通して一メモリモジュール60へ
直結されている。メモリ相互接続部80の一次制御信号
は、READ及びWRITEといった必要な全°てのタ
イミング及び内部制御信号を形成するために回路(図示
せず)によって処理され、デコードされる。
データライン70は、書き込み動作中に書き込みバッフ
ァ715及び720を経てメモリ相互接続部85へ接続
される。読み取り動作中には、メモリモジュール60か
らメモリ相互接続部85に送られるデータが読み取りバ
ッファ725を通り、ECC発生器730及びECCチ
ェック/修正回路735へ入力される。ECCチェック
/修正回路735の出力は、読み取りバッファ740へ
入力され、その出力はデータライン710へ接続される
。
ァ715及び720を経てメモリ相互接続部85へ接続
される。読み取り動作中には、メモリモジュール60か
らメモリ相互接続部85に送られるデータが読み取りバ
ッファ725を通り、ECC発生器730及びECCチ
ェック/修正回路735へ入力される。ECCチェック
/修正回路735の出力は、読み取りバッファ740へ
入力され、その出力はデータライン710へ接続される
。
ECC発生器730は、メモリモジュール60に書き込
まれるようにデータライン710から受け取ったデータ
に対しECCを発生する。この発生器730からのEC
Cは、書き込みバッファ745を経てメモリモジュール
60へ送られる一次ECC信号である。
まれるようにデータライン710から受け取ったデータ
に対しECCを発生する。この発生器730からのEC
Cは、書き込みバッファ745を経てメモリモジュール
60へ送られる一次ECC信号である。
読み取り動作中にメモリモジュール60から受け取られ
た一次ECC信号は、読み取りバッファ748を経てE
CCチェック/修正回路735へ送られる。ECCチェ
ック/修正回路735は。
た一次ECC信号は、読み取りバッファ748を経てE
CCチェック/修正回路735へ送られる。ECCチェ
ック/修正回路735は。
メモリ相互接続部85から受け取ったデータから発生さ
れたFCCをチェックして、エラーを検出する。又、回
路735は単一ビットエラーを修正し、修正したデータ
を読み取りバッファ740を経て送信する。ECCチェ
ック/修正回路735がエラーを修正できないと判断し
た場合には、修正不能読み取りエラー信号738をエラ
ーラッチ750に送信し、該ラッチはこの信号を記憶す
る。
れたFCCをチェックして、エラーを検出する。又、回
路735は単一ビットエラーを修正し、修正したデータ
を読み取りバッファ740を経て送信する。ECCチェ
ック/修正回路735がエラーを修正できないと判断し
た場合には、修正不能読み取りエラー信号738をエラ
ーラッチ750に送信し、該ラッチはこの信号を記憶す
る。
エラーラッチ750への他の入力は、アンドゲート75
5から受け取ったECCエラー信号758である。アン
ドゲート755は、−次FCCエラー信号752(エラ
ー処理及び制御論理回路625からの)及びWRITE
信号を入力として受け取る。FCCチェック/修正回路
は読み取り動作に対しエラーの検出及び修正、を行うの
で、アンドゲート755は、書き込み動作中にのみ一次
F CC,エラーを指示するように確保する。
5から受け取ったECCエラー信号758である。アン
ドゲート755は、−次FCCエラー信号752(エラ
ー処理及び制御論理回路625からの)及びWRITE
信号を入力として受け取る。FCCチェック/修正回路
は読み取り動作に対しエラーの検出及び修正、を行うの
で、アンドゲート755は、書き込み動作中にのみ一次
F CC,エラーを指示するように確保する。
エラーラッチ750への別の入力は、エラー処理及び制
御論理回路625からの一次アドレス/制御エラー信号
762である。エラーランチ750への残りの入力はミ
ラー比較不一致信号768である。このミラー不一致信
号768は、−次メモリ制御器70及びミラーメモリ制
御器75からメモリモジュール60へ送られた信号が互
いに不一致であることを比較器が検出したときにミラー
メモリ制御器75から受け取られる。
御論理回路625からの一次アドレス/制御エラー信号
762である。エラーランチ750への残りの入力はミ
ラー比較不一致信号768である。このミラー不一致信
号768は、−次メモリ制御器70及びミラーメモリ制
御器75からメモリモジュール60へ送られた信号が互
いに不一致であることを比較器が検出したときにミラー
メモリ制御器75から受け取られる。
エラーラッチ750に記憶される信号は各々データビッ
トとして記憶される。これらのビットはオアゲート76
0へ入力され、該ゲートは、エラーラッチ750のいず
れかのピッ1−がイネーブルされた場合に一次ミラーエ
ラー信号をイネーブルする。
トとして記憶される。これらのビットはオアゲート76
0へ入力され、該ゲートは、エラーラッチ750のいず
れかのピッ1−がイネーブルされた場合に一次ミラーエ
ラー信号をイネーブルする。
ミラーメモリ制御器75が第8図に詳細に示されている
。ミラーアドレス及び制御信号82は。
。ミラーアドレス及び制御信号82は。
それに対応する一次制御信号80が一次メモリ制御器7
0を通過したのと同様にミラーメモリ制御器75に通さ
れてデコードされる。データライ、ン711は書き込み
バッファ716を通して受け取られ、比較器765へ入
力される。これらのデータラインは、又、ECC発生器
731へも入力され、該発生器はミラーECC信号を発
生する。ミラーECC信号は、書き込みバッファ746
によってメモリモジュール60に送られる。
0を通過したのと同様にミラーメモリ制御器75に通さ
れてデコードされる。データライ、ン711は書き込み
バッファ716を通して受け取られ、比較器765へ入
力される。これらのデータラインは、又、ECC発生器
731へも入力され、該発生器はミラーECC信号を発
生する。ミラーECC信号は、書き込みバッファ746
によってメモリモジュール60に送られる。
データライン711は、制御器75が一次制御器として
働く必要がある場合に、書き込みバッファ722を経て
メモリモジュール相互接続部85にも接続される。然し
乍ら、一般に、1組のデータ信号しかメモリモジュール
60に送られず。
働く必要がある場合に、書き込みバッファ722を経て
メモリモジュール相互接続部85にも接続される。然し
乍ら、一般に、1組のデータ信号しかメモリモジュール
60に送られず。
バッフ7722は通常ディスエイプルされる。
データは、読み取り及び書き込みの両方の動作中にメモ
リモジュール60からメモリ相互接続部85を経てメモ
リ制御器75へ受け取られる。
リモジュール60からメモリ相互接続部85を経てメモ
リ制御器75へ受け取られる。
書き込み動作中には、メモリ相互接続部85のデータは
、−次メモリ制御器7oがメモリモジュール60へ送る
ものと同じデータである。−このデータは、書き込みバ
ッファ721を経て比較器765へ受け取られる。IF
き込み動作中に、−次メモリ制御器70からのデータが
ミラーメモリ制御器75からのデータに等しくない場合
には、比較器765がミラー比較不一致信号768をイ
ネーブルし、この信号は、−次メモリ制御170のエラ
ーラッチ750及びミラーメモリ制御器75のエラーラ
ッチ751の両方に入力される。
、−次メモリ制御器7oがメモリモジュール60へ送る
ものと同じデータである。−このデータは、書き込みバ
ッファ721を経て比較器765へ受け取られる。IF
き込み動作中に、−次メモリ制御器70からのデータが
ミラーメモリ制御器75からのデータに等しくない場合
には、比較器765がミラー比較不一致信号768をイ
ネーブルし、この信号は、−次メモリ制御170のエラ
ーラッチ750及びミラーメモリ制御器75のエラーラ
ッチ751の両方に入力される。
読み取り動作中に、メモリモジュール60からのデータ
は相互接続部85から読み取りバッファ726を経て受
け取られ、次いで、ECCチェック/修正回路736へ
入力される。メモリモジュール60から受け取ったミラ
ーECC信号は、読み取りバッファ749を経て受け取
られると共に、ECCチェック/修正回路736にも入
力される6−次メモリ制御器70のECCチェック/修
正回路735と同様に、FCCチェック/修正回路73
6は、読み取りバッファ741を経てデータライン71
1にデータを出力する前に全ての単一ビットエラーを修
正する。FCCチェック/修正回路736がエラーを修
正できない場合には。
は相互接続部85から読み取りバッファ726を経て受
け取られ、次いで、ECCチェック/修正回路736へ
入力される。メモリモジュール60から受け取ったミラ
ーECC信号は、読み取りバッファ749を経て受け取
られると共に、ECCチェック/修正回路736にも入
力される6−次メモリ制御器70のECCチェック/修
正回路735と同様に、FCCチェック/修正回路73
6は、読み取りバッファ741を経てデータライン71
1にデータを出力する前に全ての単一ビットエラーを修
正する。FCCチェック/修正回路736がエラーを修
正できない場合には。
修正不能読み取りエラー信号739をイネーブルし、こ
の信号は一次メモリ制御器70のラッチ750の場合と
同様にエラーラッチ751に記憶される。
の信号は一次メモリ制御器70のラッチ750の場合と
同様にエラーラッチ751に記憶される。
又、エラーラッチ751は、アンドゲート756からの
ECCエラー信号759も記憶し、このアンドゲートは
、メモリモジュール60からのミラーメモリエラー信号
753とWRITE信号とを合成する。更に、エラーラ
ッチは、メモリエラーモジュール60のエラー処理論理
及び制御回路625からのミラーアドレス/M御エラー
信号763も記憶する。エラーラッチ751の出力はオ
アゲート761に入力される。オアゲート761は、エ
ラーラッチ751のいずれかのビットがイネーブルされ
た場合にミラーメモリエラー信号をイネーブルする。
ECCエラー信号759も記憶し、このアンドゲートは
、メモリモジュール60からのミラーメモリエラー信号
753とWRITE信号とを合成する。更に、エラーラ
ッチは、メモリエラーモジュール60のエラー処理論理
及び制御回路625からのミラーアドレス/M御エラー
信号763も記憶する。エラーラッチ751の出力はオ
アゲート761に入力される。オアゲート761は、エ
ラーラッチ751のいずれかのビットがイネーブルされ
た場合にミラーメモリエラー信号をイネーブルする。
処理システム20′は、内部的には二重レールシステム
である。一方のレールは、CPU40と、キャッシュメ
モリ42と、メモリ制御器70と、内部バス46とを備
えている。他方のレールは、CPU50と、キャッシュ
メモリ52と、メモリ制御器75と、内部バス56とを
備えている。
である。一方のレールは、CPU40と、キャッシュメ
モリ42と、メモリ制御器70と、内部バス46とを備
えている。他方のレールは、CPU50と、キャッシュ
メモリ52と、メモリ制御器75と、内部バス56とを
備えている。
然し乍ら、メモリモジュール60は共有リソースである
。従って、メモリモジュール70及び75は、メモリモ
ジュール60に対しては二重レール−単一レールインタ
ーフェイスをなす、従って、本明細書のB節で述べた本
明細書の原理によれば、このインターフェイスにおいて
エラーチェックが与えられる。好ましい実施例において
は、このようなエラーチェックが2つの異なった技術を
含む。
。従って、メモリモジュール70及び75は、メモリモ
ジュール60に対しては二重レール−単一レールインタ
ーフェイスをなす、従って、本明細書のB節で述べた本
明細書の原理によれば、このインターフェイスにおいて
エラーチェックが与えられる。好ましい実施例において
は、このようなエラーチェックが2つの異なった技術を
含む。
先ず第1に、CPU50からメモリ制御器75へ送られ
るデータ信号はメモリモジュール60に書き込まれず、
CPU40からメモリ制御器70を経て送られるデータ
信号と比較される。メモリ制御器75はこの比較を行う
と共に、メモリモジュール60へ送られたデータに対し
てエラーチェックを行う、メモリモジュール60は、メ
モリ制御器70及び75からのアドレス、制御信号及び
ECCを比較し、不一致を検出する。第2のエラーチェ
ック技術は、メモリ制御器70及び75がメモリデータ
からそれ自身のECCを発生することを含む。
るデータ信号はメモリモジュール60に書き込まれず、
CPU40からメモリ制御器70を経て送られるデータ
信号と比較される。メモリ制御器75はこの比較を行う
と共に、メモリモジュール60へ送られたデータに対し
てエラーチェックを行う、メモリモジュール60は、メ
モリ制御器70及び75からのアドレス、制御信号及び
ECCを比較し、不一致を検出する。第2のエラーチェ
ック技術は、メモリ制御器70及び75がメモリデータ
からそれ自身のECCを発生することを含む。
本発明の別の特徴は、単一ビットメモリエラーによって
システム欠陥を生じさせるのではなくてメモリ制御器7
0及び75により単一ビットメモリエラーを修正するこ
とである。この技術は、例えば、アルファ粒子が衝突す
ることにより通常生じる単一ビットメモリエラーを受け
入れる。このようなエラーを修正すると、システム欠陥
時間が減少され、単一の共有のメモリモジュールを使用
できるようにする。エラーの発生及び位置に注目するこ
とにより後で診断を行うことができる。
システム欠陥を生じさせるのではなくてメモリ制御器7
0及び75により単一ビットメモリエラーを修正するこ
とである。この技術は、例えば、アルファ粒子が衝突す
ることにより通常生じる単一ビットメモリエラーを受け
入れる。このようなエラーを修正すると、システム欠陥
時間が減少され、単一の共有のメモリモジュールを使用
できるようにする。エラーの発生及び位置に注目するこ
とにより後で診断を行うことができる。
例えば、所定数以上のこのような修正可能なエラーを受
けるメモリボードを交換することが所望される。
けるメモリボードを交換することが所望される。
メモリモジュール60と、−次及びメモリ制御a70及
び75との間のインターフェイスが第7図及び第8図の
左側部分に一般的に示されている。第9図は、メモリ制
御器70と内部バス46及びクロスリンク90とのイン
ターフェイス回路770を示している。メモリ制御器7
5にも同じインターフェイス回路が含まれる。
び75との間のインターフェイスが第7図及び第8図の
左側部分に一般的に示されている。第9図は、メモリ制
御器70と内部バス46及びクロスリンク90とのイン
ターフェイス回路770を示している。メモリ制御器7
5にも同じインターフェイス回路が含まれる。
インターフェイス回路770はDMAエンジン775に
も接続され、これは、メモリモジュール60への直接メ
モリアクセス経路のためのアドレス及びコマンド信号を
発生する。好ましくは従来設計のものであるDMAエン
ジン775の一般的な動作を詳細に理解することは、本
発明を理解する上で必要ではない。DMAエンジン77
5は、D M A転送のためのアドレスを有する1つの
カウンタと、転送回数の経過を保持するための別のカウ
ンタとを含んでいる。各転送の後に、アドレスカウンタ
は増加されそして転送回数カウンタは減少される。
も接続され、これは、メモリモジュール60への直接メ
モリアクセス経路のためのアドレス及びコマンド信号を
発生する。好ましくは従来設計のものであるDMAエン
ジン775の一般的な動作を詳細に理解することは、本
発明を理解する上で必要ではない。DMAエンジン77
5は、D M A転送のためのアドレスを有する1つの
カウンタと、転送回数の経過を保持するための別のカウ
ンタとを含んでいる。各転送の後に、アドレスカウンタ
は増加されそして転送回数カウンタは減少される。
DMAエンジン775の1つの重要な特徴は、対応する
CPUがDMAエンジン775の動作のだめのアドレス
信号及び制御信号を発生して受信データを適切な位置に
書き込めるようにすることである。従って、I/O又は
周辺ユニットがエラーアドレスを発生することはない。
CPUがDMAエンジン775の動作のだめのアドレス
信号及び制御信号を発生して受信データを適切な位置に
書き込めるようにすることである。従って、I/O又は
周辺ユニットがエラーアドレスを発生することはない。
このようなエラーアドレスは、特にこのアドレスによっ
て工10データがシステム情報又は他のデータの上に書
き込まれるような場合には有害な影響をもたらす。
て工10データがシステム情報又は他のデータの上に書
き込まれるような場合には有害な影響をもたらす。
バッファ786は、CPU40から内部バス46を経て
データを受け取る。バッファ788はメモリ制御器7o
からデータライン710を経てデータを受け取る。バッ
ファ790はクロスリンク90からデータを受け取る。
データを受け取る。バッファ788はメモリ制御器7o
からデータライン710を経てデータを受け取る。バッ
ファ790はクロスリンク90からデータを受け取る。
インターフェイス回路770においては、ドライバ78
0がその作動時に内部バス46及びCPU40へのデー
タ経路を与える。ドライバ780は、CPUがメモリモ
ジュール60を読み取るか又はI/Oを読み取る間に作
動される。ドライバ780への入力を与えるマルチプレ
クサ792は、CPU40がメモリを読み取る場合には
バッファ788からの入力を、或いはCPU40が工1
0装置からデータを読み取る場合にはバッファ790か
らの入力を、内部バス40のデータとして選択する。
0がその作動時に内部バス46及びCPU40へのデー
タ経路を与える。ドライバ780は、CPUがメモリモ
ジュール60を読み取るか又はI/Oを読み取る間に作
動される。ドライバ780への入力を与えるマルチプレ
クサ792は、CPU40がメモリを読み取る場合には
バッファ788からの入力を、或いはCPU40が工1
0装置からデータを読み取る場合にはバッファ790か
らの入力を、内部バス40のデータとして選択する。
ドライバ782は、メモリ制御器70へのデータ経路を
与え、CPUがメモリモジュール60へ書き込みするか
メモリモジュール60へD M A書き込みするか或い
はメモリ再同期(スレーブ)動作をするために作動され
る。メモリ再同期動作については以下で詳細に述べる。
与え、CPUがメモリモジュール60へ書き込みするか
メモリモジュール60へD M A書き込みするか或い
はメモリ再同期(スレーブ)動作をするために作動され
る。メモリ再同期動作については以下で詳細に述べる。
これらの動作は。
メモリモジュール6o及び60″の内容が互いに等しく
セットされるようにするために使用される。
セットされるようにするために使用される。
メモリ再同期動作においては、データを受け取っている
モジュールが「スレーブ」となり、そしてデータを送信
しているモジュールが「マスター」となる、ドライバ7
82へ入力を与えるマルチプレクサ794は、実行され
ている動作がCPUのメモリ書き込みである場合にはバ
ッファ786からの入力を、或いは動作がDMA杏き込
みであるかメモリ再同期(スレーブ)動作である場合に
はバッファ790からの入力をメモリモジュール6Oの
ためのデータとして選択する。
モジュールが「スレーブ」となり、そしてデータを送信
しているモジュールが「マスター」となる、ドライバ7
82へ入力を与えるマルチプレクサ794は、実行され
ている動作がCPUのメモリ書き込みである場合にはバ
ッファ786からの入力を、或いは動作がDMA杏き込
みであるかメモリ再同期(スレーブ)動作である場合に
はバッファ790からの入力をメモリモジュール6Oの
ためのデータとして選択する。
バッファ784はクロスリンク90へのデータ路を与え
、I10装置へ書き込みするかメモリのDMA読み取り
を行うか又はメモリ再同期(マスター)動作を行うよう
に作動される。バッファ784へ入力を与えるマルチプ
レクサ796は、動作がメモリのDMA読み取りである
場合にはバッファ788からの入力を、或いは動作がI
10装置へのCPU書き込みであるか又はメモリ再同期
(マスター)動作である場合にはバッファ786からの
入力をクロスリンク90のためのデータとして選択する
。
、I10装置へ書き込みするかメモリのDMA読み取り
を行うか又はメモリ再同期(マスター)動作を行うよう
に作動される。バッファ784へ入力を与えるマルチプ
レクサ796は、動作がメモリのDMA読み取りである
場合にはバッファ788からの入力を、或いは動作がI
10装置へのCPU書き込みであるか又はメモリ再同期
(マスター)動作である場合にはバッファ786からの
入力をクロスリンク90のためのデータとして選択する
。
マルチプレクサ798及び799は、アドレス及び制御
信号を各々メモリ相互接続部80へ供給する0両方のマ
ルチプレクサ798及び799は、DMA又はメモリ再
同期(スレーブ)動作を伴わないメモリ動作に対しては
バッファ786の出力を、DMA動作に対してはDMA
エンジン775の出力を、或いはメモリ再同期(スレー
ブ)動作に対してはバッファ790の出力を、上記アド
レス及び制御信号のソースとして選択する。
信号を各々メモリ相互接続部80へ供給する0両方のマ
ルチプレクサ798及び799は、DMA又はメモリ再
同期(スレーブ)動作を伴わないメモリ動作に対しては
バッファ786の出力を、DMA動作に対してはDMA
エンジン775の出力を、或いはメモリ再同期(スレー
ブ)動作に対してはバッファ790の出力を、上記アド
レス及び制御信号のソースとして選択する。
4・孟且五旦之之
メモリ再同期、DMA及びI 10動作のためのデータ
はクロスリンク90及び95に通される。
はクロスリンク90及び95に通される。
一般に、クロスリンク90及び95は、CPUモジュー
ル30と、CPUモジュール30′と、工/○モジュー
ル100,110,120と、工/○モジュール100
’ 、110’ 、120″との間の通信を行う、クロ
スリンク90及び95は同じものであるから、クロスリ
ンク90の要素及び動作についてのみ説明する。
ル30と、CPUモジュール30′と、工/○モジュー
ル100,110,120と、工/○モジュール100
’ 、110’ 、120″との間の通信を行う、クロ
スリンク90及び95は同じものであるから、クロスリ
ンク90の要素及び動作についてのみ説明する。
クロスリンク90は、第10図及び第11図に各々示さ
れた並列レジスタ及び直列レジスタを含んでいる。これ
ら面形式のレジスタは、本発明の好ましい実施例ではプ
ロセッサ間通信に使用される0通常の動作中には、プロ
セッサ20と20’が同期され、クロスリンク90/9
5及び90’/95+の並列レジスタによって各々処理
システム20と20’ との間でデータが並列に交換さ
れる。処理システム20及び20′が同期されないとき
には(ブートストラップ中に最も注目すべきことである
)、データが直列レジスタによって交換される。
れた並列レジスタ及び直列レジスタを含んでいる。これ
ら面形式のレジスタは、本発明の好ましい実施例ではプ
ロセッサ間通信に使用される0通常の動作中には、プロ
セッサ20と20’が同期され、クロスリンク90/9
5及び90’/95+の並列レジスタによって各々処理
システム20と20’ との間でデータが並列に交換さ
れる。処理システム20及び20′が同期されないとき
には(ブートストラップ中に最も注目すべきことである
)、データが直列レジスタによって交換される。
第1O図に示された並列レジスタは、クロスリンク診断
通信レジスタ901、セーブ状態レジスタ9031通信
レジスタ906及び状態レジスタ909を備えている。
通信レジスタ901、セーブ状態レジスタ9031通信
レジスタ906及び状態レジスタ909を備えている。
並列レジスタのアドレスはI10スペース内にある。こ
のI10スペース内においてこれらのアドレスはシステ
ムアドレススペース内にあるか又はゾーンアドレススペ
ース内にある。「システムアドレススペース」という用
語は、システム1o全体にわたってアクセスでき、ひい
ては、両プロセッサ2o及び20′によってアクセスで
きるアドレスを意味する。「ゾーンアドレススペース」
という用語は、特定のクロスリンクを含むゾーンのみに
よってアクセスできるアドレスを意味する。
のI10スペース内においてこれらのアドレスはシステ
ムアドレススペース内にあるか又はゾーンアドレススペ
ース内にある。「システムアドレススペース」という用
語は、システム1o全体にわたってアクセスでき、ひい
ては、両プロセッサ2o及び20′によってアクセスで
きるアドレスを意味する。「ゾーンアドレススペース」
という用語は、特定のクロスリンクを含むゾーンのみに
よってアクセスできるアドレスを意味する。
クロスリンクDCR(診断通信レジスタ)901は、ク
ロスリンク90内に存在し、情報を交換すると共にゾー
ン11′からゾーン11内の診断機能を作用させること
のできる能力を有している。クロスリンクDCR,90
1は、次のように構成された32ビツトレジスタである
のが好ましい。
ロスリンク90内に存在し、情報を交換すると共にゾー
ン11′からゾーン11内の診断機能を作用させること
のできる能力を有している。クロスリンクDCR,90
1は、次のように構成された32ビツトレジスタである
のが好ましい。
ビット 皇里
31 受信フラグ
30:24 [指定済み:全てOコ23:16
受信データ 15 送信フラグ 14:8 [指定済み:全てOコア:0
送信データ クロスリンクは、両方のゾーンへの割込みを生じさせる
ことができると共に、他のゾーンによってデータを受け
取ったり当該ゾーンでデータを利用したりできるように
する。DCRは、I10モジュールがロックステップ状
態にあって且つクロスリンクがマスター/スレーブモー
ドにあるときしか使用できない、一方のゾーン、即ちマ
スターゾーンは、他方のゾーン、即ちスレーブゾーンの
l10tjliを制御し、スレーブゾーンのクロスリン
クは通信に使用される。マスターゾーンのクロスリンク
DCRは使用されない。発生される割込みは、スレーブ
ゾーンのCPU及びマスターゾーンのCPUへ至る。各
ゾーンは、データの送信及び受信に対して割込みを使用
するかポーリングを使用するかについてそれ自身の選択
を行う。
受信データ 15 送信フラグ 14:8 [指定済み:全てOコア:0
送信データ クロスリンクは、両方のゾーンへの割込みを生じさせる
ことができると共に、他のゾーンによってデータを受け
取ったり当該ゾーンでデータを利用したりできるように
する。DCRは、I10モジュールがロックステップ状
態にあって且つクロスリンクがマスター/スレーブモー
ドにあるときしか使用できない、一方のゾーン、即ちマ
スターゾーンは、他方のゾーン、即ちスレーブゾーンの
l10tjliを制御し、スレーブゾーンのクロスリン
クは通信に使用される。マスターゾーンのクロスリンク
DCRは使用されない。発生される割込みは、スレーブ
ゾーンのCPU及びマスターゾーンのCPUへ至る。各
ゾーンは、データの送信及び受信に対して割込みを使用
するかポーリングを使用するかについてそれ自身の選択
を行う。
ゾーン11が全てのI10装置を制御する場合には1次
のようなシーケンスを経てゾーン11′に通知する。
のようなシーケンスを経てゾーン11′に通知する。
1、ゾーン11′のクロスリンクDCRにビット23:
16を書き込む。
16を書き込む。
2、割込みをイネーブルする(ゾーン11′の並列状態
レジスタ909) 3、割込みのための待機 4、送信器の空き割込みは、ゾーン11′がゾーン11
′のクロスリンクDCRを読み取ったことを報告する。
レジスタ909) 3、割込みのための待機 4、送信器の空き割込みは、ゾーン11′がゾーン11
′のクロスリンクDCRを読み取ったことを報告する。
5、受イ8器いっばい割込みは、ゾーン11′が応答す
ることを報告する。
ることを報告する。
ゾーン11′は、その直列状態レジスタを用いて、それ
白身の割込みを以下に述べるように設定する。その並列
状態レジスタ909は、クロスリンクがスレーブモード
にセットされたときにはI10装置と共にゾーン11に
与えら籾ているので、使用することができない。
白身の割込みを以下に述べるように設定する。その並列
状態レジスタ909は、クロスリンクがスレーブモード
にセットされたときにはI10装置と共にゾーン11に
与えら籾ているので、使用することができない。
明らかなように、クロスリンクDCHのアドレスは、読
み取り及び書き込みに対しシステム及びゾーンアドレス
スペースの両方になければならない、特に、各ゾーンは
、それ自身のクロスリンクDCR(ゾーンアドレススペ
ース)及び他のゾーンのクロスリンクDCR(システム
アドレススペース)から個々に読み取ることができねば
ならない。同様に、各ゾーンは、それ自身及び他のゾー
ンのDCRに書き込みできねばならない。
み取り及び書き込みに対しシステム及びゾーンアドレス
スペースの両方になければならない、特に、各ゾーンは
、それ自身のクロスリンクDCR(ゾーンアドレススペ
ース)及び他のゾーンのクロスリンクDCR(システム
アドレススペース)から個々に読み取ることができねば
ならない。同様に、各ゾーンは、それ自身及び他のゾー
ンのDCRに書き込みできねばならない。
セーブ状態レジスタ903は、処理システム20を再ブ
ートするための状態情報を含んでいる。
ートするための状態情報を含んでいる。
CPU40及び50は、このような情報をシステムアド
レススペースにおいてセーブ状態レジスタ903に書き
込む。というのは、同期動作中にデータがレジスタ90
3に記憶されるからである。
レススペースにおいてセーブ状態レジスタ903に書き
込む。というのは、同期動作中にデータがレジスタ90
3に記憶されるからである。
同期動作へと再ブートするためには、同じ状態情報をク
ロスリンク90及び95とクロスリンク90′及び95
′とに書き込みことが必要である。
ロスリンク90及び95とクロスリンク90′及び95
′とに書き込みことが必要である。
ブートストラップは非同期な動作であるので、各CPU
40及び50は、それ自身のクロスリンクしかアクセス
しない、従って、状態レジスタ903はゾーンアドレス
スペースから読み取られる。
40及び50は、それ自身のクロスリンクしかアクセス
しない、従って、状態レジスタ903はゾーンアドレス
スペースから読み取られる。
通信レジスタ906は、ゾーン間で交換されるべき独特
のデータを含んでいる。このようなデータは、通常は、
各ゾーンにとって独特のメモリソフトエラーカウントの
ような非同期データである。レジスタ906のデータが
独特であるから。
のデータを含んでいる。このようなデータは、通常は、
各ゾーンにとって独特のメモリソフトエラーカウントの
ような非同期データである。レジスタ906のデータが
独特であるから。
書き込みのための通信レジスタ906のアドレスは、ゾ
ーンアドレススペース内にある。アドレスがシステムス
ペースにある場合には、情報が開方のゾーンにおいて通
信レジスタへ書き込まれ、もはや独特ではなくなる。
ーンアドレススペース内にある。アドレスがシステムス
ペースにある場合には、情報が開方のゾーンにおいて通
信レジスタへ書き込まれ、もはや独特ではなくなる。
然し乍ら、読み取りのための通信レジスタ906のアド
レスはシステムアドレススペース内にある。従って、同
期動作の間には1両方のゾーンが一方のゾーンから通ず
8レジスタを読み取れると同時に他方のゾーンから通信
レジスタを読み取ることができる。
レスはシステムアドレススペース内にある。従って、同
期動作の間には1両方のゾーンが一方のゾーンから通ず
8レジスタを読み取れると同時に他方のゾーンから通信
レジスタを読み取ることができる。
状態レジスタ909は、クロスリンク90に対して多数
の状態ビットを含んでいる。状態レジスタ909は、好
ましくは32ビット長さであり、次のようなビット指定
を有している。
の状態ビットを含んでいる。状態レジスタ909は、好
ましくは32ビット長さであり、次のようなビット指定
を有している。
〈ZΣ 値
31:14 0
:6
4:3 o。
1:0 00
意味
[指定済み]
割込みイネーブル(ビット10−12)をセット
DCRバッファ空き割込みをイネーブルDCR受信割込
みをイネーブル クロック位相エラー割込みをイネーブルDCRバッファ
空きフラグ、DCRが書き込まれるときにはOにセット
そしてDCRが読み取られるときには1にセット。
みをイネーブル クロック位相エラー割込みをイネーブルDCRバッファ
空きフラグ、DCRが書き込まれるときにはOにセット
そしてDCRが読み取られるときには1にセット。
DCR受信いっばいフラグ、全てのDCRが書き込まれ
るときには1にセラトモしてDCRが読み取られるとき
には0にセット。
るときには1にセラトモしてDCRが読み取られるとき
には0にセット。
クロック位相エラービットはクロック位相エラーの際に
セットされそして直列状態レジスタを通してリセットさ
れる 通常のバス動作(リードオンリ) メモリ再同期スレーブ メモリ再同期マスター 二重同期要求 クロスリンクオフ(リードオンリ) クロスリンクオンスレープ 10 クロスリンクオンマスター 11 クロスリンクオン二重 メモリ再同期動作及びクロック位相エラーは、以下で詳
細に説明する.ビット0及び1によって識別されるスレ
ーブ、マスター及び二重モードは、処理システム20と
20’ との間のクロスリンク通信の形式を示している
。
セットされそして直列状態レジスタを通してリセットさ
れる 通常のバス動作(リードオンリ) メモリ再同期スレーブ メモリ再同期マスター 二重同期要求 クロスリンクオフ(リードオンリ) クロスリンクオンスレープ 10 クロスリンクオンマスター 11 クロスリンクオン二重 メモリ再同期動作及びクロック位相エラーは、以下で詳
細に説明する.ビット0及び1によって識別されるスレ
ーブ、マスター及び二重モードは、処理システム20と
20’ との間のクロスリンク通信の形式を示している
。
「クロスリンクオフ」とは、並列クロスリンク910で
20と20′との間の通信が行えないときの状態を意味
する.このモードは,ゾーン間の同期をとらない.「ク
ロスリンクオンスレープ」とは、成るゾーンがそのモジ
ュールを他のゾーンに相互接続するために使用する状態
を意味する。
20と20′との間の通信が行えないときの状態を意味
する.このモードは,ゾーン間の同期をとらない.「ク
ロスリンクオンスレープ」とは、成るゾーンがそのモジ
ュールを他のゾーンに相互接続するために使用する状態
を意味する。
ゾーンAが「クロスリンクオンスレープ」である場合に
は,ゾーンBが「クロスリンクオンマスター」となる、
従ッテ、CPU40’ 及び50’は、モジュールの相
互接続部130及び132と130′及び132′とに
対して制御権を有する.CPU40及び50は、相互接
続部130,132、130′及び132′へアクセス
しない.[クロスリンクオンスレープノ及び「クロスリ
ンクオンマスター」は、モジュール相互接続部間の同期
はとるが.CPU間の同期はとらない。
は,ゾーンBが「クロスリンクオンマスター」となる、
従ッテ、CPU40’ 及び50’は、モジュールの相
互接続部130及び132と130′及び132′とに
対して制御権を有する.CPU40及び50は、相互接
続部130,132、130′及び132′へアクセス
しない.[クロスリンクオンスレープノ及び「クロスリ
ンクオンマスター」は、モジュール相互接続部間の同期
はとるが.CPU間の同期はとらない。
「クロスリンクオン二重」は、両C−PU40及び40
′がモジュール相互接続部130及び130’ を制御
できるようにすると共に、CPU50及び50′が相互
接続部132及び132′を制御できるようにする.「
クロスリンクオン二重」は、CPUの同期をとると共に
I10相互接続部の同期をとる.これらCPUを同期さ
せるには。
′がモジュール相互接続部130及び130’ を制御
できるようにすると共に、CPU50及び50′が相互
接続部132及び132′を制御できるようにする.「
クロスリンクオン二重」は、CPUの同期をとると共に
I10相互接続部の同期をとる.これらCPUを同期さ
せるには。
両ゾーンの全てのメモリレジスタ及びバスサイクルが同
一であることが必要である.通信レジスタ9o6を経て
独特のデータを取り扱わねばならない.モジュール相互
接続部の同期とは,クロスリンク90、95.90’及
び95′が同じ又は同等のバスサイクルでそれらの各々
のモジュール相互接続部130、132、130′及び
132′を駆動することを意味する。
一であることが必要である.通信レジスタ9o6を経て
独特のデータを取り扱わねばならない.モジュール相互
接続部の同期とは,クロスリンク90、95.90’及
び95′が同じ又は同等のバスサイクルでそれらの各々
のモジュール相互接続部130、132、130′及び
132′を駆動することを意味する。
クロスリンク90が「マスターモード」にあるときには
、CPU40及び5oが4つ全部のモジュール相互接続
部130.132.130’ 及び132′を制御する
。CPU40及び5oがクロスリンク90’及び95″
の状態をチェックするために、状態レジスタ909′の
読み取り及び書き込みアドレスがシステムアドレススペ
ース内にある。
、CPU40及び5oが4つ全部のモジュール相互接続
部130.132.130’ 及び132′を制御する
。CPU40及び5oがクロスリンク90’及び95″
の状態をチェックするために、状態レジスタ909′の
読み取り及び書き込みアドレスがシステムアドレススペ
ース内にある。
セーブ状態レジスタ9039通信レジスタ906及び状
態レジスタ909は、全て、これらが単一の並列レジス
タバス910を経て情報を転送できるようにするインタ
ーフェイス回路を含んでいる。並列レジスタバス910
は、クロスリンク90の他部分が並列レジスタと通信で
きるようにする。
態レジスタ909は、全て、これらが単一の並列レジス
タバス910を経て情報を転送できるようにするインタ
ーフェイス回路を含んでいる。並列レジスタバス910
は、クロスリンク90の他部分が並列レジスタと通信で
きるようにする。
直列レジスタが第11図に示されている。全ての直列ク
ロスリンクレジスタは、非同期通信に使用されるので、
ゾーンの特定のスペース内にある。直列クロスリンクレ
ジスタ及び直列クロスリンクの目的は、プロセッサ20
及び20′がロックステップ同期状態(即ち位相固定ク
ロック及び同じメモリ状態)で動作していなくてもこれ
らプロセッサが通信できるようにすることである。
ロスリンクレジスタは、非同期通信に使用されるので、
ゾーンの特定のスペース内にある。直列クロスリンクレ
ジスタ及び直列クロスリンクの目的は、プロセッサ20
及び20′がロックステップ同期状態(即ち位相固定ク
ロック及び同じメモリ状態)で動作していなくてもこれ
らプロセッサが通信できるようにすることである。
直列クロスリンクは、6個のレジスタと1つの制御器と
925を備えている。これらのレジスタには、制御及び
状態レジスタ912、直列クロスリンク要求レジスタ9
14、直列クロスリンク応答レジスタ916、直列クロ
スリンク質問レジスタ918、直列クロスリンク送信レ
ジスタ920及び直列クロスリンク受信レジスタ922
が含まれる。送信レジスタ920は直列クロスリンク送
信ライン921に接続され、受信レジスタ922は直列
クロスリンク受信ライン923に接続される。制御器9
25はこれら直列レジスタの動作を整合する。
925を備えている。これらのレジスタには、制御及び
状態レジスタ912、直列クロスリンク要求レジスタ9
14、直列クロスリンク応答レジスタ916、直列クロ
スリンク質問レジスタ918、直列クロスリンク送信レ
ジスタ920及び直列クロスリンク受信レジスタ922
が含まれる。送信レジスタ920は直列クロスリンク送
信ライン921に接続され、受信レジスタ922は直列
クロスリンク受信ライン923に接続される。制御器9
25はこれら直列レジスタの動作を整合する。
制御及び状態レジスタ912は、制御及び状態フラグと
並列クロスリンクレジスタに記憶された全ての情報のコ
ピーとを含んでいる。制御及び状態レジスタ912の内
容は5次の通りである。
並列クロスリンクレジスタに記憶された全ての情報のコ
ピーとを含んでいる。制御及び状態レジスタ912の内
容は5次の通りである。
My五
31 : 27
21:20
嵩味
指定済み
ゾーンID(読み取りのみ)
クロック位相検出器エラー(読み取り/IFき込み)
(書き込み1はクリア) クロスリンクDCRバッファ空き(読み取りのみ)DC
Hの書き込みによりクリアクロスリンクDCR受信いっ
ばい(読み取りのみ)DCRの読み取りによってクリア
直列送信器ビジー(いずれかのゾーンによって要求され
たアクティビティ) (読み取りのみ) 他のゾーンに対する自動応答(読み取りのみ) このゾーンからのループバック要求の送信このゾーンか
らの状態読み取り要求の送信このゾーンからの質問の送
信 送信バッファ空き 直列応答オーバーフロー(読み取りのみ)クロスリンク
応答レジスタの読み取りによりリセット ゛ 直列応答いっばい(読み取りのみ) クロスリンク応答レジスタの読み取りによりリセット 直列質問オーバーフロー(読み取りのみ)クロスリンク
質問レジスタの読み取りによりリセット 直列質問いっばい(読み取りのみ) クロスリンク質問レジスタの読み取りによりリセット 04:03 01 : 00 ル(読み取り/書き込み) クロック位相エラー割込みのイネーブル(読み取り/書
き込み) 送信完了割込みのイネーブル(読み取り/書き込み) 応答受信割込みのイネーブル(読み取り/書き込み) 質問受信割込みのイネーブル(読み取り/書き込み) 無機能 ループバック要求 状態読み取り要求 CPU質問要求の送信 再同期状態のセット(04:03の作動)(書き込み) 通常のバス動作(読み取り/書き込み)メモリ再同期ス
レーブ メモリ再同期マスター 二重同期要求 クロスリンク状態のセット(01:00の作動) (書
き込み) クロスリンクオフ(読み取り/IFき込み)クロスリン
クオンスレーブ クロスリンクオンマスター クロスリンクオンニ重 クロスリンクDCR受信割込みのイネーブレジスタ91
2及び他の直列レジスタの機能は、直列クロスリンクの
動作の説明から理解することができよう2これら動作の
1つはループバックである。ループバック動作はプロセ
ッサ20′を含むが、このプロセッサを整合せずに行わ
れる。
(書き込み1はクリア) クロスリンクDCRバッファ空き(読み取りのみ)DC
Hの書き込みによりクリアクロスリンクDCR受信いっ
ばい(読み取りのみ)DCRの読み取りによってクリア
直列送信器ビジー(いずれかのゾーンによって要求され
たアクティビティ) (読み取りのみ) 他のゾーンに対する自動応答(読み取りのみ) このゾーンからのループバック要求の送信このゾーンか
らの状態読み取り要求の送信このゾーンからの質問の送
信 送信バッファ空き 直列応答オーバーフロー(読み取りのみ)クロスリンク
応答レジスタの読み取りによりリセット ゛ 直列応答いっばい(読み取りのみ) クロスリンク応答レジスタの読み取りによりリセット 直列質問オーバーフロー(読み取りのみ)クロスリンク
質問レジスタの読み取りによりリセット 直列質問いっばい(読み取りのみ) クロスリンク質問レジスタの読み取りによりリセット 04:03 01 : 00 ル(読み取り/書き込み) クロック位相エラー割込みのイネーブル(読み取り/書
き込み) 送信完了割込みのイネーブル(読み取り/書き込み) 応答受信割込みのイネーブル(読み取り/書き込み) 質問受信割込みのイネーブル(読み取り/書き込み) 無機能 ループバック要求 状態読み取り要求 CPU質問要求の送信 再同期状態のセット(04:03の作動)(書き込み) 通常のバス動作(読み取り/書き込み)メモリ再同期ス
レーブ メモリ再同期マスター 二重同期要求 クロスリンク状態のセット(01:00の作動) (書
き込み) クロスリンクオフ(読み取り/IFき込み)クロスリン
クオンスレーブ クロスリンクオンマスター クロスリンクオンニ重 クロスリンクDCR受信割込みのイネーブレジスタ91
2及び他の直列レジスタの機能は、直列クロスリンクの
動作の説明から理解することができよう2これら動作の
1つはループバックである。ループバック動作はプロセ
ッサ20′を含むが、このプロセッサを整合せずに行わ
れる。
直列の制御及び状態レジスタ912にループバンク要求
フラグをセットすると、直列要求レジスタ914の内容
がゾーン11′のクロスリンク90′(即ち、90’又
は95′)へ送られる。クロスリンク90″はメツセー
ジを直列応答レジスタ916へ返送する。このループバ
ック機能により、クロスリンクケーブルを照合できると
共に、一方のゾーンが他方のゾーンが電力を有すること
を確認することができる。
フラグをセットすると、直列要求レジスタ914の内容
がゾーン11′のクロスリンク90′(即ち、90’又
は95′)へ送られる。クロスリンク90″はメツセー
ジを直列応答レジスタ916へ返送する。このループバ
ック機能により、クロスリンクケーブルを照合できると
共に、一方のゾーンが他方のゾーンが電力を有すること
を確認することができる。
もう1つの動作は状態の読み取りであり、これは、一方
のゾーンのクロスリンクが他方のゾーンのクロスリンク
の状態を読み取れるようにする。
のゾーンのクロスリンクが他方のゾーンのクロスリンク
の状態を読み取れるようにする。
直列の制御及び状態レジスタ912に状態読み取り要求
フラグをセントすると、要求レジスタ914が状態情報
の要求をクロスリンク90′に送信するようにされる。
フラグをセントすると、要求レジスタ914が状態情報
の要求をクロスリンク90′に送信するようにされる。
このメツセージを受け取ると。
クロスリンク90’ はその直列の制御及び状態レジス
タ912′の内容をクロスリンク9Qの直列応答レジス
タ916に送信する。
タ912′の内容をクロスリンク9Qの直列応答レジス
タ916に送信する。
第3の機能は、汎用のクロスリンクデータ転送であるデ
ータ転送機能である。転送されるべきデータ(好ましい
実施例では32ビツト)を直列クロスリンク要求レジス
タ914へ書き込んだ後に、直列の制御及び状態レジス
タ912にCPU質問要求フラグをセットすると、要求
レジスタ914の内容がクロスリンク90’ に送られ
、該クロスリンクはこれらの内容を質問レジスタ918
′に保持する。自動応答は発生されないが、CPO40
′にデータは得られる。CPU40’ による応答は、
クロスリンク9oの直列質問レジスタ918へ送られる
。
ータ転送機能である。転送されるべきデータ(好ましい
実施例では32ビツト)を直列クロスリンク要求レジス
タ914へ書き込んだ後に、直列の制御及び状態レジス
タ912にCPU質問要求フラグをセットすると、要求
レジスタ914の内容がクロスリンク90’ に送られ
、該クロスリンクはこれらの内容を質問レジスタ918
′に保持する。自動応答は発生されないが、CPO40
′にデータは得られる。CPU40’ による応答は、
クロスリンク9oの直列質問レジスタ918へ送られる
。
与えられる最後の機能は、直列割込み及び状態である。
好ましい実施例では、直列のクロスリンクは、次の事象
に基づいて割込みを発生することができる。
に基づいて割込みを発生することができる。
直列要求及び送信の完了;
直列応答の完了(ループバック又は状態応答に対し);
直列質問受信の完了;
診断通信レジスタのデータ利用;
診断通信レジスタのバッファ空き=及びゾーン間クロッ
ク位相エラー 割込みは、1つの共通の割込みベクトルで個々にマスク
される。
ク位相エラー 割込みは、1つの共通の割込みベクトルで個々にマスク
される。
更に、ここに示す実施例では、制御及び状態レジスタ9
12の幾つかの状態ビットが直列リンクの状態及びマシ
ンの再同期状態に関連している。
12の幾つかの状態ビットが直列リンクの状態及びマシ
ンの再同期状態に関連している。
これらのビットは次の通りである。
クロスリンク同期状態;
イネーブルされた割込み;
ベンディングの割込み;及び
受信オーバーフローインジケータ。
クロスリンク90の制御器925が第12図に示されて
いる。制御器925の制御デコーダ930は、以下で詳
細に述べる規定に従って信号A−■を発生する。制御器
925は、ドライバ、バッファ、マルチプレクサ及び遅
延要素を含んでいる。遅延要素は、同期のために追加さ
れる。コンピュータシステム10は高速動作であると共
に密接な同期が要求されるので、適切な動作及び同期を
維持するためにはケーブルの延びのような固有の信号遅
延がクロスリンクによって補償されねばならない0例え
ば、以下で詳細に述べるように、I/Oからの読み取り
中には、各CPUモジュールが別々の処理システム20
及び20′のI10モジュールからデータを受け取る。
いる。制御器925の制御デコーダ930は、以下で詳
細に述べる規定に従って信号A−■を発生する。制御器
925は、ドライバ、バッファ、マルチプレクサ及び遅
延要素を含んでいる。遅延要素は、同期のために追加さ
れる。コンピュータシステム10は高速動作であると共
に密接な同期が要求されるので、適切な動作及び同期を
維持するためにはケーブルの延びのような固有の信号遅
延がクロスリンクによって補償されねばならない0例え
ば、以下で詳細に述べるように、I/Oからの読み取り
中には、各CPUモジュールが別々の処理システム20
及び20′のI10モジュールからデータを受け取る。
別々のシステムからのデータは別々の経路をたどるので
、このような動作により同期の欠陥が生じる。遅延要素
は、同期を保持するために信号遅延及び経路の差を補償
する。第12図に示すように、クロスリンク90の遅延
要素は、マルチプレクサへの入力の速度を下げるのに用
いられる。但し、これはマルチプレクサへの他の入力が
並列クロスリンク通路25から送られるときである。
、このような動作により同期の欠陥が生じる。遅延要素
は、同期を保持するために信号遅延及び経路の差を補償
する。第12図に示すように、クロスリンク90の遅延
要素は、マルチプレクサへの入力の速度を下げるのに用
いられる。但し、これはマルチプレクサへの他の入力が
並列クロスリンク通路25から送られるときである。
制御器925においては、ドライバ933が信号Aによ
ってイネーブルされてデータをメモリ制御器7oへ送信
する。ドライバ936は、信号Bによってイネーブルさ
れて、並列レジスタバス910を経て並列レジスタヘデ
ータを送信する。
ってイネーブルされてデータをメモリ制御器7oへ送信
する。ドライバ936は、信号Bによってイネーブルさ
れて、並列レジスタバス910を経て並列レジスタヘデ
ータを送信する。
ドライバ939は信号Cによってイネーブルされ、モジ
ュールの相互接続部130ヘデータを送信する。ドライ
バ942は信号りによってイネーブルされて並列クロス
リンク通路25ヘデータを送信する。
ュールの相互接続部130ヘデータを送信する。ドライ
バ942は信号りによってイネーブルされて並列クロス
リンク通路25ヘデータを送信する。
制御器925のバッファは、外部で発生したデータを受
信するのに用いられる。バッファ945はメモリ制御器
7oからのデータを受け取りそしてバッファ948はバ
ッファ945の出力に現われるそのデータを直列レジス
タへ送信する。バッファ951は並列クロスリンク通路
25がらデータを受け取る。バッファ957は並列レジ
スタから並列レジスタバス910を経てデータを受け取
る。
信するのに用いられる。バッファ945はメモリ制御器
7oからのデータを受け取りそしてバッファ948はバ
ッファ945の出力に現われるそのデータを直列レジス
タへ送信する。バッファ951は並列クロスリンク通路
25がらデータを受け取る。バッファ957は並列レジ
スタから並列レジスタバス910を経てデータを受け取
る。
各マルチプレクサは、特定の行き先に対して別々のデー
タソースを選択する。マルチプレクサ960は信号Eに
よって制御され、バッファ951から並列クロスリンク
通路25を経てデータを受け取ると共に、遅延要素98
α及びマルチプレクサ963からデータを受け取る。マ
ルチプレクサ960の出力はドライバ933を経てメモ
リ制御器70へ送られる。
タソースを選択する。マルチプレクサ960は信号Eに
よって制御され、バッファ951から並列クロスリンク
通路25を経てデータを受け取ると共に、遅延要素98
α及びマルチプレクサ963からデータを受け取る。マ
ルチプレクサ960の出力はドライバ933を経てメモ
リ制御器70へ送られる。
マルチプレクサ963は信号Fによって制御され、並列
レジスタバス910からバッファ957を経て入力を受
け取り、直列レジスタから入力を受け取りそしてモジュ
ール相互接続部130からバッファ954を経て入力を
受け取る。マルチプレクサ963の出力は、遅延要素9
80を通過した後にマルチプレクサ960へ入力される
。
レジスタバス910からバッファ957を経て入力を受
け取り、直列レジスタから入力を受け取りそしてモジュ
ール相互接続部130からバッファ954を経て入力を
受け取る。マルチプレクサ963の出力は、遅延要素9
80を通過した後にマルチプレクサ960へ入力される
。
マルチプレクサ966は信号Gによって制御され、並列
クロスリンク通路25からバッファ951を経て入力を
受け取ると共に、メモリ制御器70からバッファ945
及び遅延要素985を経て入力を受け取る。マルチプレ
クサ966の出力はドライバ936を経て並列レジスタ
バス910へ送られる。
クロスリンク通路25からバッファ951を経て入力を
受け取ると共に、メモリ制御器70からバッファ945
及び遅延要素985を経て入力を受け取る。マルチプレ
クサ966の出力はドライバ936を経て並列レジスタ
バス910へ送られる。
マルチプレクサ969は信号Hによって制御され、並列
クロスリンク通路25のデータをバッファ951によっ
て受け取ると共に、メモリ制御器70のデータをバッフ
ァ945及び遅延要素985によって受け取る。マルチ
プレクサ969の出力はドライバ939を経て相互接続
部130に送られる。
クロスリンク通路25のデータをバッファ951によっ
て受け取ると共に、メモリ制御器70のデータをバッフ
ァ945及び遅延要素985によって受け取る。マルチ
プレクサ969の出力はドライバ939を経て相互接続
部130に送られる。
マルチプレクサ970は信号■によって制御され、並列
レジスタからバス910及びバッファ957を経て入力
を受け取り、メモリ制御器70からバッファ945を経
て入力を受け取りそしてモジュール相互接続部130か
らバッファ954を経て入力を受け取る。マルチプレク
サ970の出力は、ドライバ942によって並列クロス
リンク通路25へ送られる。
レジスタからバス910及びバッファ957を経て入力
を受け取り、メモリ制御器70からバッファ945を経
て入力を受け取りそしてモジュール相互接続部130か
らバッファ954を経て入力を受け取る。マルチプレク
サ970の出力は、ドライバ942によって並列クロス
リンク通路25へ送られる。
信号A−D及び選択コードE−Iの状態は、実行される
べき動作、クロスリンクモード(即ち。
べき動作、クロスリンクモード(即ち。
二重、マスター又はスレーブ)及びクロスリンクの状態
(オン/オフ)と、クロスリンクが一次レールにあるか
(即ち、−次メモリ制御器70に接続されているか)ミ
ラーレールにあるか(即ち。
(オン/オフ)と、クロスリンクが一次レールにあるか
(即ち、−次メモリ制御器70に接続されているか)ミ
ラーレールにあるか(即ち。
ミラーメモリ制御器75に接続されているか)によって
決まる。
決まる。
一般に、次のような10個の機能を実行することが必要
である。
である。
他のゾーンを読み取る;
他のゾーンを書き込む;
このゾーンの直列レジスタを読み取る;このゾーンの直
列レジスタを書き込む;並列レジスタのゾーンアドレス
を読み取る;並列レジスタのゾーンアドレスを書き込む
;並列レジスタのシステムアドレスを読み取る;並列レ
ジスタのシステムアドレスを書き込む;I/Oを読み取
る;そして I/Oを書き込む。
列レジスタを書き込む;並列レジスタのゾーンアドレス
を読み取る;並列レジスタのゾーンアドレスを書き込む
;並列レジスタのシステムアドレスを読み取る;並列レ
ジスタのシステムアドレスを書き込む;I/Oを読み取
る;そして I/Oを書き込む。
第13A図ないし第13P図は、実行されるべき種々の
機能と、クロスリンクの種々のモード及び状態とに対す
る信号Aないし■の状態を示している。各々の状態及び
機能を説明するのではなく、第13A図ないし第13P
図をいかに用いるかを理解するために2つについてのみ
詳細に説明する。
機能と、クロスリンクの種々のモード及び状態とに対す
る信号Aないし■の状態を示している。各々の状態及び
機能を説明するのではなく、第13A図ないし第13P
図をいかに用いるかを理解するために2つについてのみ
詳細に説明する。
第13A図は、二重モードにあるときのクロスリンク9
0に対する(即ち、ゾーン11の一次レールにおける)
制御信号の状態を示している。
0に対する(即ち、ゾーン11の一次レールにおける)
制御信号の状態を示している。
I10読み取り動作においては、制御信号A及びDが「
オン」であり、B及びCが「オフ」である。
オン」であり、B及びCが「オフ」である。
信号Aはドライバ933をイネーブルしてデータがメモ
リ制御器70へ通過するように確保し、そして信号りは
ドライバ942をイネーブルしてデータが並列クロスリ
ンク通路25を経てクロスリンク90へ通過するように
確保する。メモリ制御器70及び並列クロスリンク通路
25ヘデータを送る際に含まれるマルチプレクサは、信
号E、 F及び工によって各々制御されるマルチプレク
サ960.963及び970である。制御信号Eは、マ
ルチプレクサ963の出力に対応する入力1を選択する
ようにセットされる。制御信号Fは、マルチプレクサ9
63がモジュール相互接続部130からのデータに対応
する入力3を選択するようにセットされる。制御信号I
は、マルチプレクサ970がモジュール相互接続部13
0を選択するようにセットされる。
リ制御器70へ通過するように確保し、そして信号りは
ドライバ942をイネーブルしてデータが並列クロスリ
ンク通路25を経てクロスリンク90へ通過するように
確保する。メモリ制御器70及び並列クロスリンク通路
25ヘデータを送る際に含まれるマルチプレクサは、信
号E、 F及び工によって各々制御されるマルチプレク
サ960.963及び970である。制御信号Eは、マ
ルチプレクサ963の出力に対応する入力1を選択する
ようにセットされる。制御信号Fは、マルチプレクサ9
63がモジュール相互接続部130からのデータに対応
する入力3を選択するようにセットされる。制御信号I
は、マルチプレクサ970がモジュール相互接続部13
0を選択するようにセットされる。
従って、この信号選択状態では、モジュール相互接続部
130からのデータがマルチプレクサ963及び960
とドライバ933とを経てメモリ制御器70へ送られる
。これは、I10読み取りトランザクションのためのデ
ータ経路である。
130からのデータがマルチプレクサ963及び960
とドライバ933とを経てメモリ制御器70へ送られる
。これは、I10読み取りトランザクションのためのデ
ータ経路である。
又、このデータは、マルチプレクサ970及びドライバ
942を経て並列クロスリンク通路25へ送られ、これ
が適当であるのは、クロスリンク90が二重モードにあ
るためである。
942を経て並列クロスリンク通路25へ送られ、これ
が適当であるのは、クロスリンク90が二重モードにあ
るためである。
第13E図は、同じ状態に対する制御信号を示している
が、メモリ制御器90はマスターモードにあり、従って
、クロスリンク90′に信号を送信しない、この状態の
I10読み取り動作は、モジュール相互接続部130か
らのデータがメモリ制御器70へ送られるように確保す
るために同じ信号設定を含む、信号りが「オフ」であり
、■に対する選択信号がないので、並列クロスリンク通
路25を経てメモリ制御器90″へ至るデータ通路はな
く、これは、クロスリンク90がマスターモードにある
ときの動作として適している。
が、メモリ制御器90はマスターモードにあり、従って
、クロスリンク90′に信号を送信しない、この状態の
I10読み取り動作は、モジュール相互接続部130か
らのデータがメモリ制御器70へ送られるように確保す
るために同じ信号設定を含む、信号りが「オフ」であり
、■に対する選択信号がないので、並列クロスリンク通
路25を経てメモリ制御器90″へ至るデータ通路はな
く、これは、クロスリンク90がマスターモードにある
ときの動作として適している。
メモリ制御器90が二重モードにある状態での工/○書
き込み動作の場合には、rオン」になる唯一のドライバ
制御信号が信号Cであり、これはドライバ939をイネ
ーブルしてモジュール相互接続部130ヘデータを通せ
るようにする。それ故、制御する必要のある唯一のマル
チプレクサはマルチプレクサ969であり、第13A図
は、制御信号Hがメモリ制御器70からのデータを選択
することを示している。第13図のクロスリンク95(
二重モードにあるゾーン11のミラーレール)の動作は
、第13B図のクロスリンク90に対する制御信号と若
干異なる。これは、以下で述べるように、I10書き込
み動作中には、各I10モジュールへのデータが両プロ
セッサ20及び20’から送られるからである。
き込み動作の場合には、rオン」になる唯一のドライバ
制御信号が信号Cであり、これはドライバ939をイネ
ーブルしてモジュール相互接続部130ヘデータを通せ
るようにする。それ故、制御する必要のある唯一のマル
チプレクサはマルチプレクサ969であり、第13A図
は、制御信号Hがメモリ制御器70からのデータを選択
することを示している。第13図のクロスリンク95(
二重モードにあるゾーン11のミラーレール)の動作は
、第13B図のクロスリンク90に対する制御信号と若
干異なる。これは、以下で述べるように、I10書き込
み動作中には、各I10モジュールへのデータが両プロ
セッサ20及び20’から送られるからである。
5・見1晟
両方の処理システム2o及び20′が二重モードとして
知られている冗長形態で同じタスクを実行するときには
、CPUモジュール30及び30′が同じ速度で動作を
実行することが重要である。さもなくば、処理システム
同志を再同期させてI/Oとプロセッサ間とのエラーチ
ェックを行うのに多量の処理時間がかシることになる。
知られている冗長形態で同じタスクを実行するときには
、CPUモジュール30及び30′が同じ速度で動作を
実行することが重要である。さもなくば、処理システム
同志を再同期させてI/Oとプロセッサ間とのエラーチ
ェックを行うのに多量の処理時間がかシることになる。
処理システム20及び20’の好ましい実施例において
は、基本的なりロック信号が同期され、互いに位相固定
される。耐欠陥コンピュータシステム10は、処理シス
テム20及び20’へのクロック信号の周波数を制御す
ると共に各処理システムのクロック信号間の位相差を最
小にするためのタイミングシステムを備えている。
は、基本的なりロック信号が同期され、互いに位相固定
される。耐欠陥コンピュータシステム10は、処理シス
テム20及び20’へのクロック信号の周波数を制御す
ると共に各処理システムのクロック信号間の位相差を最
小にするためのタイミングシステムを備えている。
第14図は、処理システム2o及び20′において実施
される本発明のタイミングシステムのブロック図である
。このタイミングシステムは。
される本発明のタイミングシステムのブロック図である
。このタイミングシステムは。
処理システム20のCPUモジュール30に含まれた発
振システム200と、処理システム20′のCPUモジ
ュール30′に含まれた発振システム200′とを備え
ている0発振器200’の要素は、発振器200の要素
と同じであり1両方の発振システムの動作は同じである
。従って、発振器200と200’の動作が異なる場合
を除いて、発振器200の要素及び動作のみについて説
明する。
振システム200と、処理システム20′のCPUモジ
ュール30′に含まれた発振システム200′とを備え
ている0発振器200’の要素は、発振器200の要素
と同じであり1両方の発振システムの動作は同じである
。従って、発振器200と200’の動作が異なる場合
を除いて、発振器200の要素及び動作のみについて説
明する。
第14図に示すように、発振システム200の大部分、
特にデジタル論理回路は、クロスリンク95の内部に存
在するが、その配置は本発明にとって重要ではない0発
振システム200は、電圧制御式のクリスタル発振子(
VCXO)205を備えており、これは、好ましくは6
6.66MHzの基本的な発振信号を発生する。VCX
O205の周波数は、その入力の電圧レベルによって調
整することができる。
特にデジタル論理回路は、クロスリンク95の内部に存
在するが、その配置は本発明にとって重要ではない0発
振システム200は、電圧制御式のクリスタル発振子(
VCXO)205を備えており、これは、好ましくは6
6.66MHzの基本的な発振信号を発生する。VCX
O205の周波数は、その入力の電圧レベルによって調
整することができる。
クロック分配チップ210は、基本的な発振信号を分割
し、好ましくは、全て同じ周波数を有する4つの主たる
クロックを発生する。主CPU40については、クロッ
クがPCLK L及びPCLIK Hであり、これ
らは論理的に互いに逆のものである。ミラーCPU50
については、クロック分配チップ210がクロック信号
MCLKL及びMCLK Hを発生し、これらも論理
的に互いに逆のものである。これらクロック信号のタイ
ミング及び位相関係は、第15図に示されている。好ま
しくは、クロック信号PCLK L、PCLK H
,MCLK L及びMCLK Hの周波数は約33
.33MHzである。又、クロックチップ210は、第
15図に示すように16.16 M Hzの位相固定ル
ープ信号CLKCHも発生する。この位相固定ループ信
号はクロック論理回路220に送られ、該回路はこの信
号をバッファする。
し、好ましくは、全て同じ周波数を有する4つの主たる
クロックを発生する。主CPU40については、クロッ
クがPCLK L及びPCLIK Hであり、これ
らは論理的に互いに逆のものである。ミラーCPU50
については、クロック分配チップ210がクロック信号
MCLKL及びMCLK Hを発生し、これらも論理
的に互いに逆のものである。これらクロック信号のタイ
ミング及び位相関係は、第15図に示されている。好ま
しくは、クロック信号PCLK L、PCLK H
,MCLK L及びMCLK Hの周波数は約33
.33MHzである。又、クロックチップ210は、第
15図に示すように16.16 M Hzの位相固定ル
ープ信号CLKCHも発生する。この位相固定ループ信
号はクロック論理回路220に送られ、該回路はこの信
号をバッファする。
クロック論理バッファ220は、CLKCH信号を同期
とりに用いるために発振器200’に送信する0発振器
200′のクロック論理バッファ220′は、それ自身
のバッファされた位相固定ループ信号CLKC’ H
を発振器200の位相検出器230に送信する。又、位
相検出器230は、クロック論理バッファ220から遅
延要素225を経て、バッファされた位相固定ループ信
号CLKCHを受信する。遅延要素225は。
とりに用いるために発振器200’に送信する0発振器
200′のクロック論理バッファ220′は、それ自身
のバッファされた位相固定ループ信号CLKC’ H
を発振器200の位相検出器230に送信する。又、位
相検出器230は、クロック論理バッファ220から遅
延要素225を経て、バッファされた位相固定ループ信
号CLKCHを受信する。遅延要素225は。
クロック論理バッファ220′からのケーブルの延長に
よる遅延を近似する。
よる遅延を近似する。
位相検出器230は、その入力の位相固定ループ信号を
比較し、2つの出力を発生する。その1つは、位相差信
号235であり、これはループ増幅器240を経てVC
XO205の電圧入力に送られる。この位相差により、
増幅器240は、位相差を補償するようにVCXO20
5の周波数を変更する信号を発生する。
比較し、2つの出力を発生する。その1つは、位相差信
号235であり、これはループ増幅器240を経てVC
XO205の電圧入力に送られる。この位相差により、
増幅器240は、位相差を補償するようにVCXO20
5の周波数を変更する信号を発生する。
位相検出器230の他の出力は、あり得べき同期欠陥を
指示する位相エラー信号236である。
指示する位相エラー信号236である。
第16図は、位相検出器230の詳細な図である0位相
検出器230は、位相比較器230と、アナログ電圧比
較器234とを含んでいる。位相比較器232は、遅延
素子225からのクロック信号(CLKCH)及び発振
器200′からの位相固定ループクロツタ信号(CLK
C’ H)を受け取り、これら信号の位相差を表わす
アナログ電圧レベル235を発生する。
検出器230は、位相比較器230と、アナログ電圧比
較器234とを含んでいる。位相比較器232は、遅延
素子225からのクロック信号(CLKCH)及び発振
器200′からの位相固定ループクロツタ信号(CLK
C’ H)を受け取り、これら信号の位相差を表わす
アナログ電圧レベル235を発生する。
処理システム20がクロック同期の目的でrスレーブ」
となった場合には、スイッチ245が「スレーブ」位i
!(即ち、閉位it)どなり、アナログ電圧レベル23
5は、ループ増幅器240によって増幅された後に、V
CXO205の周波数を制御する0両スイッチ245及
び245″が「マスター」位置にある場合には、処理シ
ステム20及び20’が位相固定されず、非同期で(独
立して)動作する。
となった場合には、スイッチ245が「スレーブ」位i
!(即ち、閉位it)どなり、アナログ電圧レベル23
5は、ループ増幅器240によって増幅された後に、V
CXO205の周波数を制御する0両スイッチ245及
び245″が「マスター」位置にある場合には、処理シ
ステム20及び20’が位相固定されず、非同期で(独
立して)動作する。
アナログ電圧レベル235は、位相の進み及び遅れの許
容範囲を表わす2つの基準電圧V ref 1及びVr
ef2と共に電圧比較器234へ入力される。
容範囲を表わす2つの基準電圧V ref 1及びVr
ef2と共に電圧比較器234へ入力される。
位相差が許容範囲内である場合には、PHASEERR
OR(位相エラー)信号が作用されない。
OR(位相エラー)信号が作用されない。
位相差が許容範囲から外れ、電圧比較器234がVre
flないしVref2の電圧範囲から外れる位相差信号
235を感知した場合には、位相エラー信号が作用され
、クロックデコーダ220を経てクロスリンク95へ送
られる。
flないしVref2の電圧範囲から外れる位相差信号
235を感知した場合には、位相エラー信号が作用され
、クロックデコーダ220を経てクロスリンク95へ送
られる。
第17図は、I10モジュール100の好ましい実施例
を示している。I10モジュール100及び100′は
同一のものであるから、モジュール100についてのみ
説明する。更に、I10モジュール110及び120(
従って、モジュール110′及び120’)はモジュー
ル100と同様であるが、異なったI10装置に接続さ
れているために全く同じ形態をとることはない。
を示している。I10モジュール100及び100′は
同一のものであるから、モジュール100についてのみ
説明する。更に、I10モジュール110及び120(
従って、モジュール110′及び120’)はモジュー
ル100と同様であるが、異なったI10装置に接続さ
れているために全く同じ形態をとることはない。
工/○モジュール100は、二重レールモジュール相互
接続部130及び132によってCPUモジュール30
に接続されている。各々のモジュール相互接続部は、各
々ファイアウオール1゜00及び1010によって受け
入れられる。ファイアウオール10oO及び1010は
、モジュール相互接続部130及び132を経て送信さ
れるデータの一致性をチェックするチェックバス1゜0
5によって相互接続される。このチェックは、CPUモ
ジュール30及び30’のロックステップ同期によって
行ねれ、これは、CPUモジュール3o及び30’から
工/○モジュール100へ書き込まれたデータをファイ
アウオール1000及び1010に同時に得られるよう
にする。
接続部130及び132によってCPUモジュール30
に接続されている。各々のモジュール相互接続部は、各
々ファイアウオール1゜00及び1010によって受け
入れられる。ファイアウオール10oO及び1010は
、モジュール相互接続部130及び132を経て送信さ
れるデータの一致性をチェックするチェックバス1゜0
5によって相互接続される。このチェックは、CPUモ
ジュール30及び30’のロックステップ同期によって
行ねれ、これは、CPUモジュール3o及び30’から
工/○モジュール100へ書き込まれたデータをファイ
アウオール1000及び1010に同時に得られるよう
にする。
第18図は、ファイアウオール1000の要素及び好ま
しい実施例を示している。ファイアウオール1000は
、モジュール相互接続部130への32ビツトバスイン
ターフエイス181oと。
しい実施例を示している。ファイアウオール1000は
、モジュール相互接続部130への32ビツトバスイン
ターフエイス181oと。
第17図に示されたバス102oへ接続するための32
ビツトバスインターフエイス182oとを備えている。
ビツトバスインターフエイス182oとを備えている。
これらのインターフェイス181゜及び1820は、内
部ファイアウオールバス1815によって相互接続され
、該バスはファイアウオール1000の他の要素にも接
続されている。
部ファイアウオールバス1815によって相互接続され
、該バスはファイアウオール1000の他の要素にも接
続されている。
バス1815は、16ビツト巾又は32ビツト巾の並列
バスであるのが好ましい。
バスであるのが好ましい。
又、ファイアウオール1o00は、CPUモジュール3
0とオペレータコンソールとの間でコンソールリンク1
o90に接続されたコンソールサポートレジスタ183
oも備えているのが好ましい、コンソールリンクは、モ
ジュール相互接続部、クロスリンク及びメモリ制御器の
ような通常のデータ経路をバイパスし、コンピュータシ
ステム10の他の部分に欠陥が生じた場合にもオペレー
タはCPUと通信することができる。コンソールサポー
トレジスタ1830は、−時的な記憶レジスタ1832
、受信器1834及び送信器1836を備えているのが
好ましい、レジスタ1832、受信器1834及び送信
器1836の相互接続は、当業者に良く知られた一般的
なものである。
0とオペレータコンソールとの間でコンソールリンク1
o90に接続されたコンソールサポートレジスタ183
oも備えているのが好ましい、コンソールリンクは、モ
ジュール相互接続部、クロスリンク及びメモリ制御器の
ような通常のデータ経路をバイパスし、コンピュータシ
ステム10の他の部分に欠陥が生じた場合にもオペレー
タはCPUと通信することができる。コンソールサポー
トレジスタ1830は、−時的な記憶レジスタ1832
、受信器1834及び送信器1836を備えているのが
好ましい、レジスタ1832、受信器1834及び送信
器1836の相互接続は、当業者に良く知られた一般的
なものである。
ファイアウオール1000は、複数のチェック回路を含
んだファイアウオール比較回路1840も備えている。
んだファイアウオール比較回路1840も備えている。
ファイアウオール比較回路1840は、ファイアウオー
ル1010内の同等の要素に接続される。ファイアウオ
ール比較回路184o内のチェック回路は、モジュール
相互接続部130から受け取ったデータをモジュール相
互接続部132から受け取ったデータと比較する。
ル1010内の同等の要素に接続される。ファイアウオ
ール比較回路184o内のチェック回路は、モジュール
相互接続部130から受け取ったデータをモジュール相
互接続部132から受け取ったデータと比較する。
般に、両方のモジュール相互接続部がCPUモジュール
30から受け入れられるとしても、モジュール相互接続
部130からのデータは一方のゾーンからのものであり
そしてモジュール相互接続部132からのデータは別の
ゾーンがらのものである。ファイアウオール比較回路1
84o内のチェック回路がこれらデータ間の不一致を検
出した場合には、割込み制御回路1880が作動されて
、エラー信号を発生し、これにより、クロスリンク90
及び95はC:PUモジュ /1z30及び30’に欠
陥の検出を通知する。
30から受け入れられるとしても、モジュール相互接続
部130からのデータは一方のゾーンからのものであり
そしてモジュール相互接続部132からのデータは別の
ゾーンがらのものである。ファイアウオール比較回路1
84o内のチェック回路がこれらデータ間の不一致を検
出した場合には、割込み制御回路1880が作動されて
、エラー信号を発生し、これにより、クロスリンク90
及び95はC:PUモジュ /1z30及び30’に欠
陥の検出を通知する。
ファイアウオール比較回路184oは、CPUモジュー
ル30及び30’から受け取ったデータのみをチェック
する。CPUモジュール3o及び30’に送られるデー
タは、共通の発生源からのものであり、従って、チェッ
クを必要としない。
ル30及び30’から受け取ったデータのみをチェック
する。CPUモジュール3o及び30’に送られるデー
タは、共通の発生源からのものであり、従って、チェッ
クを必要としない。
むしろ、I10装置から受け取ったデータで、CPUモ
ジュール30及び30′に送られるべきデータは、CR
C発生器185oによって行われる繰返し冗長チェック
(CRC)のようなエラー検出コード(EDC)によっ
てチェックされる。又。
ジュール30及び30′に送られるべきデータは、CR
C発生器185oによって行われる繰返し冗長チェック
(CRC)のようなエラー検出コード(EDC)によっ
てチェックされる。又。
CRC発生器5oは、内部ファイアウオールバス181
5にも接続される。
5にも接続される。
CRC発生S71850は、I10装置ニょって使用さ
れるものと同じCRCコードを発生し、チェックする。
れるものと同じCRCコードを発生し、チェックする。
I10モジュール100は、2つのEDCを発生するの
が好ましい。その一方は、CRCでもあって、モジュー
ル100が接続されたエサ−ネットパケットネットワー
クのようなネットワークに対するインターフェイスとし
て用いられる。その他方は、第17図のディスクインタ
ーフェイス1072のようなディスクインターフェイス
として用いられる。
が好ましい。その一方は、CRCでもあって、モジュー
ル100が接続されたエサ−ネットパケットネットワー
クのようなネットワークに対するインターフェイスとし
て用いられる。その他方は、第17図のディスクインタ
ーフェイス1072のようなディスクインターフェイス
として用いられる。
モジュール相互接続部は二重であるから、CPUモジュ
ール30と工/○モジュール100との間にはCRCの
機能が必要とされない0例えば、CPUモジュール30
においては、クロスリンク90がモジュール相互接続部
130を経てファイアウオール1000と通信し、そし
てクロスリンク95がモジュール相互接続部132を経
てファイアウオール1010と通信する。
ール30と工/○モジュール100との間にはCRCの
機能が必要とされない0例えば、CPUモジュール30
においては、クロスリンク90がモジュール相互接続部
130を経てファイアウオール1000と通信し、そし
てクロスリンク95がモジュール相互接続部132を経
てファイアウオール1010と通信する。
エサ−ネットネットワーク1082から受け取ったメツ
セージは、第17図に示されたネットワーク制御器10
80により有効CRCに対してチェックされる。CRC
とで完成するデータは、第17図に示されたローカルR
AM1060に書き込まれる。ローカルRAM10.6
0の全てのデータは、D M Aを用いてメモリモジュ
ール60へ転送される。DMA制御器1890は転送の
整合をとり、転送されているCRCエンコードデータの
有効性をチェックするようにCRC発生器185oに指
示する。
セージは、第17図に示されたネットワーク制御器10
80により有効CRCに対してチェックされる。CRC
とで完成するデータは、第17図に示されたローカルR
AM1060に書き込まれる。ローカルRAM10.6
0の全てのデータは、D M Aを用いてメモリモジュ
ール60へ転送される。DMA制御器1890は転送の
整合をとり、転送されているCRCエンコードデータの
有効性をチェックするようにCRC発生器185oに指
示する。
I10装置との殆どのデータ転送は、DMAで行すれる
。データは主メモリと工/○バッファメモリとの間で移
動される。転送されるデータの各論理ブロックは、CR
Cによってカバーされる。
。データは主メモリと工/○バッファメモリとの間で移
動される。転送されるデータの各論理ブロックは、CR
Cによってカバーされる。
エサ−ネットの場合には、論理ブロックがメツセージパ
ケットである。メツセージは、DMAにより、主メモリ
60からファイアウオール1000を通ってローカルR
AM 1060へ転送される。
ケットである。メツセージは、DMAにより、主メモリ
60からファイアウオール1000を通ってローカルR
AM 1060へ転送される。
ファイアウオール1000のCRC発生器1850は、
メツセージに対してCRCを計算する。
メツセージに対してCRCを計算する。
D M A制御器189oは、データ転送に対するCR
C発生器1850の動作を制御する。論理ブロックが転
送されたときには、DMA制御器1890がCRC発生
器1850からの発生されたCRCを読み取り、それを
、ローカルRAMl060に記憶されたデータに加える
。ネットワーク制御器1080は、ローカルRAM10
60からエサ−ネットネットワーク1082ヘデータを
転送すると、CRCをチェックする。CRCコード自体
を除く全てのエサ−ネットパケットは、メモリモジュー
ル60へ転送される。CRCのエラーはCRC発生器1
850によって識別され、割込み制御器1880を介し
て報告される。
C発生器1850の動作を制御する。論理ブロックが転
送されたときには、DMA制御器1890がCRC発生
器1850からの発生されたCRCを読み取り、それを
、ローカルRAMl060に記憶されたデータに加える
。ネットワーク制御器1080は、ローカルRAM10
60からエサ−ネットネットワーク1082ヘデータを
転送すると、CRCをチェックする。CRCコード自体
を除く全てのエサ−ネットパケットは、メモリモジュー
ル60へ転送される。CRCのエラーはCRC発生器1
850によって識別され、割込み制御器1880を介し
て報告される。
ディスクサブシステムとのデータのやり取りは、エサ−
ネットインターフェイスと同様に行われる。CRC発生
器1850は、ディスク制御器1072によって使用さ
れる特定のCRCコードを発生し又はチェックする。こ
れは、工/○モジュール100の場合と同様に単一レー
ルシステムに存在するか又はこれを通して転送されてい
るデータがエラー検出コードによってカバーされるよう
に確保し、これは、データが最終的に通過する通信媒体
と少なくとも同程度の信頼性を有するものであることが
好ましい0種々のI10モジュール、例えば、同期プロ
トコルを取り扱う一モジュールは、適当なプロトコルの
CRCコードを発生してチェックするCRC発生器を有
しているのが好ましい。
ネットインターフェイスと同様に行われる。CRC発生
器1850は、ディスク制御器1072によって使用さ
れる特定のCRCコードを発生し又はチェックする。こ
れは、工/○モジュール100の場合と同様に単一レー
ルシステムに存在するか又はこれを通して転送されてい
るデータがエラー検出コードによってカバーされるよう
に確保し、これは、データが最終的に通過する通信媒体
と少なくとも同程度の信頼性を有するものであることが
好ましい0種々のI10モジュール、例えば、同期プロ
トコルを取り扱う一モジュールは、適当なプロトコルの
CRCコードを発生してチェックするCRC発生器を有
しているのが好ましい。
一般に、DMA制御器1890は、共有のメモリ制御器
1o50及びアドレスされているローカルRAMl06
0に対して特定のDMA動作の一部分を処理する。32
ビツトバス1020は、2つの異なったモードで駆動さ
れる。D M A 設定中には、DMA制御器1890
はバス1020を標準的な非同期マイクロプロセッサバ
スとして使用する。DMA動作が行われるローカルRA
M 1060のアドレスは、共有メモリ制御器105
゜及びD M A制御91890によって供給される。
1o50及びアドレスされているローカルRAMl06
0に対して特定のDMA動作の一部分を処理する。32
ビツトバス1020は、2つの異なったモードで駆動さ
れる。D M A 設定中には、DMA制御器1890
はバス1020を標準的な非同期マイクロプロセッサバ
スとして使用する。DMA動作が行われるローカルRA
M 1060のアドレスは、共有メモリ制御器105
゜及びD M A制御91890によって供給される。
実際のDMA転送中には、DMA制御器1890がバス
102oを同期状態で駆動するようにDMA制御ライン
1895に指示する6共有メモリ制御2”s 1050
は、バス1020の各バスサイクルごとに32ビツトデ
ータワードを転送し、DMA制御器1890は、転送さ
れるべきワードがどれほど残されているかの経過を保持
する。又、共有メモリ制御器1050は、ローカルRA
M1060を制御し、次のDAMアドレスを発生する。
102oを同期状態で駆動するようにDMA制御ライン
1895に指示する6共有メモリ制御2”s 1050
は、バス1020の各バスサイクルごとに32ビツトデ
ータワードを転送し、DMA制御器1890は、転送さ
れるべきワードがどれほど残されているかの経過を保持
する。又、共有メモリ制御器1050は、ローカルRA
M1060を制御し、次のDAMアドレスを発生する。
I 1O−T−ジュー/L/ (100,110,12
o)は、それら自身のローカルRAM 1060に対す
る読み取り/書き込み動作を制御する役目を果たt、C
PUモジュール30は、メモリアレイ60との転送動作
を制御する役目を果たす、メモリ制御器70及び75(
第9図に示す)のDMAエンジン775は、CPUモジ
ュール30に対しDMA動作を指示する。このような労
力の分割によりいずれかのモジュールのDMA論理の欠
陥がゾーン11又は11′の他のモジュールにおけるデ
ータ完全性を低下しないようにする。
o)は、それら自身のローカルRAM 1060に対す
る読み取り/書き込み動作を制御する役目を果たt、C
PUモジュール30は、メモリアレイ60との転送動作
を制御する役目を果たす、メモリ制御器70及び75(
第9図に示す)のDMAエンジン775は、CPUモジ
ュール30に対しDMA動作を指示する。このような労
力の分割によりいずれかのモジュールのDMA論理の欠
陥がゾーン11又は11′の他のモジュールにおけるデ
ータ完全性を低下しないようにする。
又、ファイアウオール1000は、I10モジュール1
00に対し他の重要な機能も実行する。
00に対し他の重要な機能も実行する。
ファイアウオール1000のI10診断制御レジスタ1
86oは、クロスリンク診断IIJ御レジスタ901と
同じ構造を有し、CPU40.50,40′及び50’
と診断マイクロプロセッサ1100との間で通信を行
うことができ、る0診断マイクロプロセッサ1100の
この間接的な接続により。
86oは、クロスリンク診断IIJ御レジスタ901と
同じ構造を有し、CPU40.50,40′及び50’
と診断マイクロプロセッサ1100との間で通信を行
うことができ、る0診断マイクロプロセッサ1100の
この間接的な接続により。
該マイクロプロセッサがコンピュータシステム10の他
のモジュールに影響を及ぼすことが防止される。
のモジュールに影響を及ぼすことが防止される。
トレースRAM1872及びトレースRAM制御器18
70の機能については以下で詳細に述べる。簡単に述べ
ると、欠陥が検出されてCPU及びCPUモジュール3
0及び30′に通知されたときには、コンピユータシス
テム10全体にわたる種々のトレースRAMが以下に述
べる幾つかの機能を実行するようにされる。トレースR
AMとの通信は、トレースバス1095を経て行われる
。トレースRAM制御器1870は、トレースバス10
95からの信号に応答して、トレースRAM1872が
記憶を停止するか又はその内容をトレースバス1095
にダンプするようにさせる。
70の機能については以下で詳細に述べる。簡単に述べ
ると、欠陥が検出されてCPU及びCPUモジュール3
0及び30′に通知されたときには、コンピユータシス
テム10全体にわたる種々のトレースRAMが以下に述
べる幾つかの機能を実行するようにされる。トレースR
AMとの通信は、トレースバス1095を経て行われる
。トレースRAM制御器1870は、トレースバス10
95からの信号に応答して、トレースRAM1872が
記憶を停止するか又はその内容をトレースバス1095
にダンプするようにさせる。
好ましくは32ビツトの並列バスである工10モジュー
ルバス1020は、ファイアウオール1000及び10
10と、l10(−ジューJtzlOOの他の要素とに
接続される。共有メモリ制御器1050も、I10モジ
ュール100の工/○バス1020に接続されている。
ルバス1020は、ファイアウオール1000及び10
10と、l10(−ジューJtzlOOの他の要素とに
接続される。共有メモリ制御器1050も、I10モジ
ュール100の工/○バス1020に接続されている。
共有メモリ制御器1050は、32ビツト+パリテイを
有する共有メモリバス1065によってローカルメモリ
1060に接続されている。好ましくは、ローカルメモ
IJ 1060は、メモリ容量が128KB(7)RA
Mであるが、RAM1060のサイズは任意である。共
有メモリ制御器1050及びローカルRAM1060は
、工/○モジュール100に対するメモリ容量を備えて
いる。
有する共有メモリバス1065によってローカルメモリ
1060に接続されている。好ましくは、ローカルメモ
IJ 1060は、メモリ容量が128KB(7)RA
Mであるが、RAM1060のサイズは任意である。共
有メモリ制御器1050及びローカルRAM1060は
、工/○モジュール100に対するメモリ容量を備えて
いる。
ディスク制御器1070は、第1図のディスク1075
.1075’のようなディスクに対する標準的なインタ
ーフェイスを与える。ディスク1075は、5CSI(
小型コンピュータ標準インターフェイス)バスの実施の
ごとき標準バスインターフェイス1072によってディ
スク制御器1070に接続されるのが好ましい、又、デ
ィスク制御器1070は、ローカルRAM1060を使
用するか又はI10モジュールバス1020と通信する
ために共有メモリ制御器105−0に接続される。
.1075’のようなディスクに対する標準的なインタ
ーフェイスを与える。ディスク1075は、5CSI(
小型コンピュータ標準インターフェイス)バスの実施の
ごとき標準バスインターフェイス1072によってディ
スク制御器1070に接続されるのが好ましい、又、デ
ィスク制御器1070は、ローカルRAM1060を使
用するか又はI10モジュールバス1020と通信する
ために共有メモリ制御器105−0に接続される。
ネットワーク制御器1080は、ネットワークインター
フェイス1082により、エサ−ネットネットワークの
ような標準ネットワークにインターフェイスする。又、
ネットワーク制御器1080は、ローカルRAM106
0及びI10モジュールバス1020の両方に対するイ
ンターフェイスとして働く共有メモリ制御器1050に
も接続される。然し乍ら、I/○モジュールバス102
0のいずれか1つの特定の編成又は構造にする必要はな
い。
フェイス1082により、エサ−ネットネットワークの
ような標準ネットワークにインターフェイスする。又、
ネットワーク制御器1080は、ローカルRAM106
0及びI10モジュールバス1020の両方に対するイ
ンターフェイスとして働く共有メモリ制御器1050に
も接続される。然し乍ら、I/○モジュールバス102
0のいずれか1つの特定の編成又は構造にする必要はな
い。
PCIM(ffi力及び冷却インターフェイスモジュー
ル)サポート要素1030は、I10モジュールバス1
020及びASCIIインターフェイス1o32に接続
される。PCIMサポート要素1030は、処理システ
ム20が電源システム(即ち、バッテリ、レギュレータ
、等)の状態を監視できるようにすると共に、冷却シス
テムがそれらの適切な動作を確保できるようにする。P
CIMサポート要素1030は、成る欠陥又は欠陥のお
それの指示、例えば、バッテリ電圧が許容できないほど
低下したという指示があったときだけメツセージを受け
取るのが好ましい、又、PCIMサポート要素1030
を用いて全ての電力及び冷却サブシステムを濁期的に監
視することもできる。PCIMサポート要素1030及
びI10モジュール100′の同等の要素は、プロセッ
サ20及び20′のサポートシステムが機能不良になっ
た場合に耐欠陥コンピュータシステム10が成るゾーン
を停止できるようにする。
ル)サポート要素1030は、I10モジュールバス1
020及びASCIIインターフェイス1o32に接続
される。PCIMサポート要素1030は、処理システ
ム20が電源システム(即ち、バッテリ、レギュレータ
、等)の状態を監視できるようにすると共に、冷却シス
テムがそれらの適切な動作を確保できるようにする。P
CIMサポート要素1030は、成る欠陥又は欠陥のお
それの指示、例えば、バッテリ電圧が許容できないほど
低下したという指示があったときだけメツセージを受け
取るのが好ましい、又、PCIMサポート要素1030
を用いて全ての電力及び冷却サブシステムを濁期的に監
視することもできる。PCIMサポート要素1030及
びI10モジュール100′の同等の要素は、プロセッ
サ20及び20′のサポートシステムが機能不良になっ
た場合に耐欠陥コンピュータシステム10が成るゾーン
を停止できるようにする。
システムサポート及びコンソール要素1040は、I1
0モジュールバス1020にも接続される。システムサ
ポート及びコンソール要素104oは、ASCIIイン
タ 7zイX1042を介してオペレータコンソールの
インターフェイスを与える。オペレータコンソールは1
年のような成る情報を入力できるだけでなく1診断の目
的にも使用することができる。オペレータコンソールは
、コンソールリンク1o90及び1091を経そしてフ
ァイアウオール1000.及び1010のコンソールサ
ポートレジスタ1830を経てCPUとデータを交換す
る。
0モジュールバス1020にも接続される。システムサ
ポート及びコンソール要素104oは、ASCIIイン
タ 7zイX1042を介してオペレータコンソールの
インターフェイスを与える。オペレータコンソールは1
年のような成る情報を入力できるだけでなく1診断の目
的にも使用することができる。オペレータコンソールは
、コンソールリンク1o90及び1091を経そしてフ
ァイアウオール1000.及び1010のコンソールサ
ポートレジスタ1830を経てCPUとデータを交換す
る。
又、診断マイクロプロセッサ1100は、I10モジュ
ールバス1020にも接続されている。
ールバス1020にも接続されている。
診断マイクロプロセッサ1100の動作については以下
で詳細に述べる。一般に、マイクロプロセッサ1100
は、欠陥が検出されたときにトレースRAM1872の
ようなトレースRA Mからのエラーチェック情報を収
集するのに用いられる。
で詳細に述べる。一般に、マイクロプロセッサ1100
は、欠陥が検出されたときにトレースRAM1872の
ようなトレースRA Mからのエラーチェック情報を収
集するのに用いられる。
このデータは、トレースバス1095及び1096に集
められ、ファイアウオール1000及び1010を各々
通り、モジュールバス1020を経てマイクロプロセッ
サ1100へ送り込まれる。
められ、ファイアウオール1000及び1010を各々
通り、モジュールバス1020を経てマイクロプロセッ
サ1100へ送り込まれる。
C,プロセッサ間及びモジュール間通信1、L二久及及
コンピュータシステム10の要素はそれ自体で耐欠陥シ
ステムを構成しない、正常の動作中に通信を行うことが
できそして欠陥検出及び修正中に動作を行うことのでき
る通信経路及びプロトコルが必要とされる。このような
通信にとって重要なことはクロスリンク通路25である
。クロスリンク通路25は、並列リンク、直列リンク及
び既に述べたクロック信号で構成される。これらは。
ステムを構成しない、正常の動作中に通信を行うことが
できそして欠陥検出及び修正中に動作を行うことのでき
る通信経路及びプロトコルが必要とされる。このような
通信にとって重要なことはクロスリンク通路25である
。クロスリンク通路25は、並列リンク、直列リンク及
び既に述べたクロック信号で構成される。これらは。
第19図に示されている。並列リンクは、2つの同じ組
のデータ及びアドレスライン(16)、制御ライン(7
)、割込みライン(7)及びエラーライン(7)を含ん
でいる。16本のデータ及びアドレスラインと、7本の
制御ラインは、CPUモジュール間で、例えば、モジュ
ール制御接続部130及び132(又は130′及び1
32’)から或いはメモリモジュール60 (60’
”)から交換されるべき情報を含んでいる。
のデータ及びアドレスライン(16)、制御ライン(7
)、割込みライン(7)及びエラーライン(7)を含ん
でいる。16本のデータ及びアドレスラインと、7本の
制御ラインは、CPUモジュール間で、例えば、モジュ
ール制御接続部130及び132(又は130′及び1
32’)から或いはメモリモジュール60 (60’
”)から交換されるべき情報を含んでいる。
7本の割込みラインは、4つの異なった170割込みレ
ベルを表わす4本のラインと、両ゾーンに対するコンソ
ール「ホルト」要求を同期させる1本のラインと、両ゾ
ーンに対するマシンチェックを同期させる1本のライン
と、CPU/メモリ欠陥の発生を他のゾーンに指示する
1本のラインとを備えているのが好ましい。
ベルを表わす4本のラインと、両ゾーンに対するコンソ
ール「ホルト」要求を同期させる1本のラインと、両ゾ
ーンに対するマシンチェックを同期させる1本のライン
と、CPU/メモリ欠陥の発生を他のゾーンに指示する
1本のラインとを備えているのが好ましい。
耐欠陥コンピュータシステム10は−1はとんどの過渡
欠陥が生じても二重レールシステムとして連続的に動作
するように設計されている。I10サブシステム(モジ
ュール100,110,120.100’ 、110’
及び120’)も、過渡欠陥を受けることがあるが、動
作を続けることができる。好ましい実施例においては、
ファイアウオール比較回路1840によってエラーが検
出されると、CPUで指示された動作に対しライン25
を介して同期マシンチェックを行うことが要求される。
欠陥が生じても二重レールシステムとして連続的に動作
するように設計されている。I10サブシステム(モジ
ュール100,110,120.100’ 、110’
及び120’)も、過渡欠陥を受けることがあるが、動
作を続けることができる。好ましい実施例においては、
ファイアウオール比較回路1840によってエラーが検
出されると、CPUで指示された動作に対しライン25
を介して同期マシンチェックを行うことが要求される。
CPU30及び30’のソフトウェアは、欠陥の生じた
動作を再トライする。DMAによって指示された動作の
場合には、同じエラー検出によってライン25を経て同
期割込みが生じ、CPU40.50.40’及び50′
のソフトウェアがDMA動作を再スタートさせる。
動作を再トライする。DMAによって指示された動作の
場合には、同じエラー検出によってライン25を経て同
期割込みが生じ、CPU40.50.40’及び50′
のソフトウェアがDMA動作を再スタートさせる。
幾つかの過渡エラーは直ちに修復されない。
例えば、CPUモジュール30のエラー信号762によ
って指示される制御エラーは、メモリモジュール60に
未知のデータを生じさせる。この状態においては、CP
Uモジュール30は、もはやフェイルセーフシステムの
一部分として確実に機能できないので、除去される。従
って、メモリアレイ60は、CPU30がシステムに再
び加わる前にメモリ再同期動作を受けねばならない、C
PU/メモリ欠陥ラインは、CPU30に欠陥が生じた
ことをCPU30’ に指示する。
って指示される制御エラーは、メモリモジュール60に
未知のデータを生じさせる。この状態においては、CP
Uモジュール30は、もはやフェイルセーフシステムの
一部分として確実に機能できないので、除去される。従
って、メモリアレイ60は、CPU30がシステムに再
び加わる前にメモリ再同期動作を受けねばならない、C
PU/メモリ欠陥ラインは、CPU30に欠陥が生じた
ことをCPU30’ に指示する。
サイクルの状態、バイトマスク、方向及びレディ状態の
組み合わせを表わしている7本の制御ラインは、CPU
モジュール(30及び30′)と工/○モジュールとの
間にハンドシェイクを与える。サイクルの状態は、実行
されているバス動作の形式、即ち、CPUによる工/○
の読み取り、DMA転送、DMA49定又は割込みベク
トル要求を指示する。「バイトマスク」は、ローカルR
AM1060において32ビツトワードのデータの1バ
イト(8ビツト)を修正できるように、16本のデータ
ラインのどれが有効なデータを含んでいるかを指示する
。「方向」は、DMA動作に対しトランシーバ経路の選
択を固定する。DMA転送は所定のソースと行き先との
間−で生じるので、データ経路を選択するのに関連した
時間オーA−ヘッドを、データ転送のごとに支払う必要
はない。
組み合わせを表わしている7本の制御ラインは、CPU
モジュール(30及び30′)と工/○モジュールとの
間にハンドシェイクを与える。サイクルの状態は、実行
されているバス動作の形式、即ち、CPUによる工/○
の読み取り、DMA転送、DMA49定又は割込みベク
トル要求を指示する。「バイトマスク」は、ローカルR
AM1060において32ビツトワードのデータの1バ
イト(8ビツト)を修正できるように、16本のデータ
ラインのどれが有効なデータを含んでいるかを指示する
。「方向」は、DMA動作に対しトランシーバ経路の選
択を固定する。DMA転送は所定のソースと行き先との
間−で生じるので、データ経路を選択するのに関連した
時間オーA−ヘッドを、データ転送のごとに支払う必要
はない。
「レディ」メツセージは、要求された動作の完了を指示
するためにCPUとI10モジュールとの間に送られる
。
するためにCPUとI10モジュールとの間に送られる
。
任意の時間にいずれかの処理システム20又は20’
を作動して制御ラインの状態を読み取ることができる。
を作動して制御ラインの状態を読み取ることができる。
作動したり停止したりすることは処理システム20と2
0’ との間で同期して行われる。
0’ との間で同期して行われる。
直列クロスリンクは、状態読み取り、ループバック、デ
ータ転送、状態の転送割込みに対し。
ータ転送、状態の転送割込みに対し。
直列データ転送を行うために2組の2本のラインを備え
ている。
ている。
交換されるクロック信号は1位相固定クロック信号CL
KCH及びCLKC’ H(遅延)である。
KCH及びCLKC’ H(遅延)である。
第2OA図ないし第20D図は、CPUモジュール30
及び30’と工/○モジュール10゜及び100’の要
素(これらを介して種々の作動中にデータが通過する)
のブロック図である。これら要素の各々については既に
述べた。
及び30’と工/○モジュール10゜及び100’の要
素(これらを介して種々の作動中にデータが通過する)
のブロック図である。これら要素の各々については既に
述べた。
一般に、動作中のデータ経路は対象的である。
例えば、CPUのI10読み取りは、互いにミラー像関
係にある経路を経て工/○モジュール100及び■/○
モジュール100′に対して行われる。このような場合
に、図面は全てのデータ経路を示しているが、その1つ
のみについて詳細に説明する。
係にある経路を経て工/○モジュール100及び■/○
モジュール100′に対して行われる。このような場合
に、図面は全てのデータ経路を示しているが、その1つ
のみについて詳細に説明する。
第20A図は、CPUの工/○読み取り動作用のデータ
通路を示している0例えば、ディスク1075 (1
075’ )又はネットワークからのデータは、共有メ
モリ制御器1050(1050′)を通して転送するた
めにローカルRAM1060(1060’)に記憶され
るものとする。1つの経路については、データがモジュ
ール相互接読部130のファイアウオール1000を経
てクロスリンク90へ送られる。このときには、データ
がメモリ制御器70及びクロスリンク90’まで転送さ
れる。第12図に示すように、クロスリンク9oは、フ
ァイアウオール1000からメモリ制御器70へのデー
タを遅延し、クロスリンク90’へのデータが「捕獲」
に充分な時間を有し且つ処理システム2o及び20’
が同期状態に保たれるようにする1次いで、データは、
クロスリンク90からメモリ制御器70を通りそして内
部バス46を経てCPU40へ送られる。同様に、クロ
スリンク90’へのデータもCPU40’へ送られる。
通路を示している0例えば、ディスク1075 (1
075’ )又はネットワークからのデータは、共有メ
モリ制御器1050(1050′)を通して転送するた
めにローカルRAM1060(1060’)に記憶され
るものとする。1つの経路については、データがモジュ
ール相互接読部130のファイアウオール1000を経
てクロスリンク90へ送られる。このときには、データ
がメモリ制御器70及びクロスリンク90’まで転送さ
れる。第12図に示すように、クロスリンク9oは、フ
ァイアウオール1000からメモリ制御器70へのデー
タを遅延し、クロスリンク90’へのデータが「捕獲」
に充分な時間を有し且つ処理システム2o及び20’
が同期状態に保たれるようにする1次いで、データは、
クロスリンク90からメモリ制御器70を通りそして内
部バス46を経てCPU40へ送られる。同様に、クロ
スリンク90’へのデータもCPU40’へ送られる。
データをCPU50及び50′へ読み込むために同様の
経路がとられる。共有メモリ制御器1050からのデー
タは、ファイアウオール1010を経てクロスリンク9
5へ送られる。このときには、データがクロスリンク9
5′へ送られると共に、クロスリンク95内の遅延ユニ
ットに通される。
経路がとられる。共有メモリ制御器1050からのデー
タは、ファイアウオール1010を経てクロスリンク9
5へ送られる。このときには、データがクロスリンク9
5′へ送られると共に、クロスリンク95内の遅延ユニ
ットに通される。
I 10s置からデータを読み取るときには、1つの読
み取り動作しか必要とされない、「ミラーJCPUのI
10読み取り動作は、処理システム20’のI10装置
から共有メモリ制御器1050’ を経て受け取ったデ
ータ及びI10装置100′のローカルRAMから受け
取ったデータに対して行われる。
み取り動作しか必要とされない、「ミラーJCPUのI
10読み取り動作は、処理システム20’のI10装置
から共有メモリ制御器1050’ を経て受け取ったデ
ータ及びI10装置100′のローカルRAMから受け
取ったデータに対して行われる。
I10モジュール100.110及び120は、各々、
I10モジュール100’ 、110’及び120′と
同様であってそれに対応しているが、対応する■/○モ
ジュールは互いにロックステップ同期状態にない。CP
Uの工/○読み取りに対してメモリ制御器1050’及
びローカルRAM1060’ を使用して、データは先
ずクロスリンク90′及び95′へ送られる。他のデー
タ経路は、メモリ制御器1050からの経路と同等であ
る。データは、クロスリンク90′及び95′からメモ
リ制御器70’及び75′を経て最終的にCPU40’
及び50’へ各々送られる。同時に、データは、各々、
クロスリンク90及び95へ送られ、次いで、遅延要素
を通ることなく、各々、CPU40及び50まで送られ
続ける。
I10モジュール100’ 、110’及び120′と
同様であってそれに対応しているが、対応する■/○モ
ジュールは互いにロックステップ同期状態にない。CP
Uの工/○読み取りに対してメモリ制御器1050’及
びローカルRAM1060’ を使用して、データは先
ずクロスリンク90′及び95′へ送られる。他のデー
タ経路は、メモリ制御器1050からの経路と同等であ
る。データは、クロスリンク90′及び95′からメモ
リ制御器70’及び75′を経て最終的にCPU40’
及び50’へ各々送られる。同時に、データは、各々、
クロスリンク90及び95へ送られ、次いで、遅延要素
を通ることなく、各々、CPU40及び50まで送られ
続ける。
第20B図は、CPUのI10書き込み動作を示してい
る。データは、2つの別々のCPU工/○書き込み動作
において、CPU40.50.40′及び50’ を経
て共有メモリ制御器1050及び1050’とローカル
RAM1060及び1060’ とに転送される。CP
U40によって転送されるデータは、CPUの工/○読
み取り中のデータとは逆方向に同じ経路に沿って送られ
る。
る。データは、2つの別々のCPU工/○書き込み動作
において、CPU40.50.40′及び50’ を経
て共有メモリ制御器1050及び1050’とローカル
RAM1060及び1060’ とに転送される。CP
U40によって転送されるデータは、CPUの工/○読
み取り中のデータとは逆方向に同じ経路に沿って送られ
る。
特に、このようなデータは、メモリバス46、メモリ制
御器70.遅延ユニット985(同期をとれるようにす
るための)、ファイアウオール1000及びメモリ制御
器1050を経て送られる。
御器70.遅延ユニット985(同期をとれるようにす
るための)、ファイアウオール1000及びメモリ制御
器1050を経て送られる。
CPU50’からのデータも、CPU I/○読み取
りの経路を逆方向にたどる。特に、このようなデータは
、内部バス56′、メモリ制御器75′クロスリンク9
5′、クロスリンク95.ファイアウオール1010及
び共有メモリ制御器1050を経て送られる。上記した
ように、ファイアウオール1000及び1010は、I
10書き込み動作中にデータをチェックし、出力の前に
エラーをチェックする。
りの経路を逆方向にたどる。特に、このようなデータは
、内部バス56′、メモリ制御器75′クロスリンク9
5′、クロスリンク95.ファイアウオール1010及
び共有メモリ制御器1050を経て送られる。上記した
ように、ファイアウオール1000及び1010は、I
10書き込み動作中にデータをチェックし、出力の前に
エラーをチェックする。
CPU50及び40’からのデータは、処理システム2
0’のI10装置への次のCPtT I/○書き込み
の際に、対象的な経路を経て共有メモリ制御器1050
’へ送信される。CPU50及び40′からのデータは
、ゾーン間チェックのためにファイアウオール1000
及び1010によって比較される。各ゾーンに対するレ
ール間チェックは、メモリ制御器70.75.70′及
び75′において既に実行されている。
0’のI10装置への次のCPtT I/○書き込み
の際に、対象的な経路を経て共有メモリ制御器1050
’へ送信される。CPU50及び40′からのデータは
、ゾーン間チェックのためにファイアウオール1000
及び1010によって比較される。各ゾーンに対するレ
ール間チェックは、メモリ制御器70.75.70′及
び75′において既に実行されている。
第21C図は、D M A読み取り動作のためのデータ
経路を示している。メモリアレイ6ooからのデータは
、メモリ制御器70及び75とクロスリンク90及び9
5とに同時に送り込まれる。
経路を示している。メモリアレイ6ooからのデータは
、メモリ制御器70及び75とクロスリンク90及び9
5とに同時に送り込まれる。
クロスリンク95は、そのデータを、ファイアウオール
1000及び共有メモリ制御器1050へ送信するまで
遅延する。
1000及び共有メモリ制御器1050へ送信するまで
遅延する。
メモリアレイ600′からのデータは、メモリ制御器7
0′及び75′に同時に通され、次いで、クロスリンク
90’及び95′に通される。
0′及び75′に同時に通され、次いで、クロスリンク
90’及び95′に通される。
クロスリンク95′からのデータは、クロスリンク95
及びファイアウオール1010を−通って共有メモリ制
御器1050へ送られる。
及びファイアウオール1010を−通って共有メモリ制
御器1050へ送られる。
CPUのT/○書き込み動作と同様に、このデータ経路
と、ファイアウオール1000’及び1010’ を通
る対象的な経路は、ゾーン間エラーチェックを与える。
と、ファイアウオール1000’及び1010’ を通
る対象的な経路は、ゾーン間エラーチェックを与える。
レール間エラーチェックは、メモリモジュール70.7
5.70’及び75′において行われる。
5.70’及び75′において行われる。
DMA書き込み動作のためのデータ経路が第21D図に
示されており、これはCPUのI10読み取りの場合と
同様である。特に、共有メモリ制御器1050’ から
のデータは、ファイアウオール1000’、クロスリン
ク90′ (遅延を伴う)及びメモリ制御器70′を経
てメモリアレイ600’へ送られる。同時に、このデー
タは、ファイアウオール1010’、クロスリンク95
′(遅延を伴う)及びメモリ制御器75′に通され。
示されており、これはCPUのI10読み取りの場合と
同様である。特に、共有メモリ制御器1050’ から
のデータは、ファイアウオール1000’、クロスリン
ク90′ (遅延を伴う)及びメモリ制御器70′を経
てメモリアレイ600’へ送られる。同時に、このデー
タは、ファイアウオール1010’、クロスリンク95
′(遅延を伴う)及びメモリ制御器75′に通され。
このときには、レール間エラーチャック中にメモリ制御
器70’ からのデータと比較される。或いは又、CP
UのI10読み取りの場合と同様に、DMA書き込み動
作のデータは、同等の動作中に共有メモリ制御器105
0まで送られてもよい。
器70’ からのデータと比較される。或いは又、CP
UのI10読み取りの場合と同様に、DMA書き込み動
作のデータは、同等の動作中に共有メモリ制御器105
0まで送られてもよい。
又、クロスリンク90′からのデータは、クロスリンク
90及びメモリ制御器70を経てメモリアレイ600へ
通される。クロスリンク95′からのデータは、クロス
リンク95′及びメモリ制御器75′に通され、このと
きには、同時のレール間チェック中にメモリ制御器70
’からのデータと比較される。
90及びメモリ制御器70を経てメモリアレイ600へ
通される。クロスリンク95′からのデータは、クロス
リンク95′及びメモリ制御器75′に通され、このと
きには、同時のレール間チェック中にメモリ制御器70
’からのデータと比較される。
メモリ再同期動作のためのデータ経路が第20E図に示
されている。メモリ再同期動作については第23図に関
連して以下で詳細に述べる。メモリ再同期中のデータ経
路を理解するために、メモリ再同期の一部分であるバル
クメモリコピー機能動作が第21図に示されている。
されている。メモリ再同期動作については第23図に関
連して以下で詳細に述べる。メモリ再同期中のデータ経
路を理解するために、メモリ再同期の一部分であるバル
クメモリコピー機能動作が第21図に示されている。
第21図に示すように、バルクメモリコピー動作の第1
の段階は、クロスリンクをメモリ再同期マスター/スレ
ーブモードにセットして第20E図に示すデータ経路を
形成できるようにすることである(ステップ2100)
、第13I図ないし第13L図は、クロスリンクがスレ
ーブモードにあるときに通信が本質的に一方向であるこ
とを示している。従って、クロスリンクがスレーブモー
ドにある処理システムのメモリにデータを書き込むこと
ができるが、このメモリから情報を読み取ることはでき
ない。更に、第13E図ないし第13H図は、第13I
図ないし第13L図と共に5クロスリンクがマスターモ
ードにある処理システムがそのメモリモジュールに書き
込みを行うたびに、クロスリンクがスレーブモードにあ
る処理システムもその同じデータを書き込む、従って、
クロスリンクがスレーブモードにある処理システムは、
クロスリンクがマスターモードにある処理システムと共
に、そのときまでの情報を記憶するメモリモジュールを
有している。
の段階は、クロスリンクをメモリ再同期マスター/スレ
ーブモードにセットして第20E図に示すデータ経路を
形成できるようにすることである(ステップ2100)
、第13I図ないし第13L図は、クロスリンクがスレ
ーブモードにあるときに通信が本質的に一方向であるこ
とを示している。従って、クロスリンクがスレーブモー
ドにある処理システムのメモリにデータを書き込むこと
ができるが、このメモリから情報を読み取ることはでき
ない。更に、第13E図ないし第13H図は、第13I
図ないし第13L図と共に5クロスリンクがマスターモ
ードにある処理システムがそのメモリモジュールに書き
込みを行うたびに、クロスリンクがスレーブモードにあ
る処理システムもその同じデータを書き込む、従って、
クロスリンクがスレーブモードにある処理システムは、
クロスリンクがマスターモードにある処理システムと共
に、そのときまでの情報を記憶するメモリモジュールを
有している。
次いで、第21図のバルクメモリ転送フローチャートに
示されたように、マスター処理システムは、そのメモリ
モジュールを検査し、そのモジュールの全てのメモリペ
ージを見つける(ステップ2110)、これら全てのペ
ージが既知になると、マスター処理システムのDAMエ
ンジンの待ち行列に入れられる(ステップ2120)、
好ましくは、マスター処理システムのDMAエンジンは
、DMA要求の待ち行列を含み、各要求は、転送の形式
の指示、スタートアドレス、転送されるべき要素の数及
び行き先の指示を含むのが好ましい、スレーブ処理シス
テムへの全てのD M A転送の行き先は、スレーブ処
理システムのメモリモジュールである。
示されたように、マスター処理システムは、そのメモリ
モジュールを検査し、そのモジュールの全てのメモリペ
ージを見つける(ステップ2110)、これら全てのペ
ージが既知になると、マスター処理システムのDAMエ
ンジンの待ち行列に入れられる(ステップ2120)、
好ましくは、マスター処理システムのDMAエンジンは
、DMA要求の待ち行列を含み、各要求は、転送の形式
の指示、スタートアドレス、転送されるべき要素の数及
び行き先の指示を含むのが好ましい、スレーブ処理シス
テムへの全てのD M A転送の行き先は、スレーブ処
理システムのメモリモジュールである。
次いで、メモリ再同期動作により、スレーブ処理システ
ムのDMAエンジンへコマンドを送信しくステップ21
30)そして次のページのDMA転送を開始して完了す
る(ステップ2140)という対話プロセスが開始され
る。スレーブのDMAエンジンへのコマンドは、DMA
転送のサイズ及びスタートアドレスを指示し、スレーブ
処理システムのメモリモジュールがマスターモジュール
と同一・に構成されるよう確保する。これらのステップ
は、全てのマスターメモリの転送が完了する(ステップ
2150)まで繰り返される。
ムのDMAエンジンへコマンドを送信しくステップ21
30)そして次のページのDMA転送を開始して完了す
る(ステップ2140)という対話プロセスが開始され
る。スレーブのDMAエンジンへのコマンドは、DMA
転送のサイズ及びスタートアドレスを指示し、スレーブ
処理システムのメモリモジュールがマスターモジュール
と同一・に構成されるよう確保する。これらのステップ
は、全てのマスターメモリの転送が完了する(ステップ
2150)まで繰り返される。
全てのマスターメモリの転送が完了−すると(ステップ
2150)、マスタープロセッサはそのCPUレジスタ
の全ての内容を後で再ブートストラップ動作に使用する
ためにメモリに記憶する(ステップ2160)、CPU
レジスタの内容がマスターメモリに記憶されることによ
り、それらがスレーブメモリにも記憶される0次いで、
バルクメモリ転送動作が開始されて、再同期プロセスを
開始することができるようにされる。
2150)、マスタープロセッサはそのCPUレジスタ
の全ての内容を後で再ブートストラップ動作に使用する
ためにメモリに記憶する(ステップ2160)、CPU
レジスタの内容がマスターメモリに記憶されることによ
り、それらがスレーブメモリにも記憶される0次いで、
バルクメモリ転送動作が開始されて、再同期プロセスを
開始することができるようにされる。
メモリ再同期動作においては、第20E図のメモリアレ
イ600’、即ち「マスター」からのデータがメモリ制
御器70′及び75′、クロスリンク90’及び95′
、クロスリンク90及び95、並びにメモリ制御器70
及び75を同時に通過し、このときに、レール間エラー
チェックのためにデータが比較される。メモリ制御”i
a 70からのデータは、メモリアレイ600に入れら
れる。
イ600’、即ち「マスター」からのデータがメモリ制
御器70′及び75′、クロスリンク90’及び95′
、クロスリンク90及び95、並びにメモリ制御器70
及び75を同時に通過し、このときに、レール間エラー
チェックのためにデータが比較される。メモリ制御”i
a 70からのデータは、メモリアレイ600に入れら
れる。
メモリ再同期動作を除けば、前記したデータ経路は、全
て、ゾーン11及び11′がロックステップ同期状態に
あるときに生じる。然し乍ら、耐欠陥コンピュータシス
テム10は、プロセッサ20及び20’がロックステッ
プ同期状態にないときの動作も受け入れねばならない、
これら状態の1つは、初期化時の「コールド」ブートス
トラップ動作中に生じる。別の状態は、以下に述べるメ
モリ再同期動作中に生じる。
て、ゾーン11及び11′がロックステップ同期状態に
あるときに生じる。然し乍ら、耐欠陥コンピュータシス
テム10は、プロセッサ20及び20’がロックステッ
プ同期状態にないときの動作も受け入れねばならない、
これら状態の1つは、初期化時の「コールド」ブートス
トラップ動作中に生じる。別の状態は、以下に述べるメ
モリ再同期動作中に生じる。
第22A図ないし第22H図は、CPUモジュール30
及び30’ をロックステップ同期状態にもっていくブ
ートストラップシーケンスを示すフローチャートである
。
及び30’ をロックステップ同期状態にもっていくブ
ートストラップシーケンスを示すフローチャートである
。
一般に、ステップ2228のようなエラー状態において
は、他のゾーンに成る刺激に対する不適当な応答が与え
られる。他のゾーンからの適当な応答を受け取り損なっ
たことに対する応答は。
は、他のゾーンに成る刺激に対する不適当な応答が与え
られる。他のゾーンからの適当な応答を受け取り損なっ
たことに対する応答は。
そのゾーンによって生じたエラーを記録することである
。この情報は、現場のサービス要員によってエラーを分
析するのに使用することができる。
。この情報は、現場のサービス要員によってエラーを分
析するのに使用することができる。
更に、他のゾーンからの適当な応答を受け取り損なった
ことに対する応答は、そのゾーンによって生じたエラー
を記録することである。第22A図ないし第22H図に
おいては、ゾーンが一般にゾーンA及びBと称される。
ことに対する応答は、そのゾーンによって生じたエラー
を記録することである。第22A図ないし第22H図に
おいては、ゾーンが一般にゾーンA及びBと称される。
とうのは、上記した動作が各々のゾーンに適用されるか
らである。
らである。
コールドブートストラップ動作に入ると(ステップ22
00)、クロスリンク通路がオフに切り換えられ、プロ
セッサが通常の動作に対してセットされる(ステップ2
202)、通常の動作とは、CPUがそれらの各々のメ
モリ制御器を直接的に制御する状態を指す0次いで+
CPUは、CPUに配置されたEEPROMからそれ自
身のブートストラップトークンを読み取る(ステップ2
2o4)と共に、他のゾーンのCPUからブートストラ
ップトークンを読み取る(ステップ2206)、両方の
プロセッサは1次いで、ゾーンAからの応答を待機しく
ステップ2208)、ブートストラップ動作の目的でゾ
ーンAが「ブートマスター」となるかどうかを判断する
。もしそうであれば、両方のシステムは、ゾーンBがブ
ートストラップ動作のためのブートマスタとなると考え
ているかどうか判断する(ステップ2212)、もしそ
うであれば、ゾーンBは非ブート状態にセットされ、ブ
ートマスターとならない(ステップ2214)。
00)、クロスリンク通路がオフに切り換えられ、プロ
セッサが通常の動作に対してセットされる(ステップ2
202)、通常の動作とは、CPUがそれらの各々のメ
モリ制御器を直接的に制御する状態を指す0次いで+
CPUは、CPUに配置されたEEPROMからそれ自
身のブートストラップトークンを読み取る(ステップ2
2o4)と共に、他のゾーンのCPUからブートストラ
ップトークンを読み取る(ステップ2206)、両方の
プロセッサは1次いで、ゾーンAからの応答を待機しく
ステップ2208)、ブートストラップ動作の目的でゾ
ーンAが「ブートマスター」となるかどうかを判断する
。もしそうであれば、両方のシステムは、ゾーンBがブ
ートストラップ動作のためのブートマスタとなると考え
ているかどうか判断する(ステップ2212)、もしそ
うであれば、ゾーンBは非ブート状態にセットされ、ブ
ートマスターとならない(ステップ2214)。
ステップ2210の判断の結果としてゾーンAがブート
マスターとならない場合には、雨ゾーンがゾーンBがブ
ートマスターであるかどうか判断する(ステップ221
6)、ゾーンBがブートマスターでない場合には、ゾー
ンAがブートマスターとしてセットされる(ステップ2
218)。
マスターとならない場合には、雨ゾーンがゾーンBがブ
ートマスターであるかどうか判断する(ステップ221
6)、ゾーンBがブートマスターでない場合には、ゾー
ンAがブートマスターとしてセットされる(ステップ2
218)。
ステップ2210−2218が行われてブートマスター
が決定された後に、各ゾーンはブートマスターであるか
どうかそれ自身に尋ねる(ステップ2220)、ブート
マスターとなったゾーンは、第22B図のステップ22
22へ進む、他のゾーンは、第22F図のステップ22
84へ進む。
が決定された後に、各ゾーンはブートマスターであるか
どうかそれ自身に尋ねる(ステップ2220)、ブート
マスターとなったゾーンは、第22B図のステップ22
22へ進む、他のゾーンは、第22F図のステップ22
84へ進む。
第22A図ないし第221−1図のフローチャートの説
明上、ゾーンAがブートマスターであるとする。
明上、ゾーンAがブートマスターであるとする。
ゾーンAは、先ず、そのオペレーティングシステムをブ
ートする。ブートプロセスの一部分には、システム10
に存在する全てのI/’O装置を制御するのに必要なテ
ーブル記述及びルーチンをロードすることが含まれる。
ートする。ブートプロセスの一部分には、システム10
に存在する全てのI/’O装置を制御するのに必要なテ
ーブル記述及びルーチンをロードすることが含まれる。
然し乍ら、ゾーンAのこれらI10装置のみが初期化さ
れ、アプリケーションプログラムに利用できるようにさ
れる。
れ、アプリケーションプログラムに利用できるようにさ
れる。
ブートマスターは、ブートシンプレックス手順に入り(
ステップ2222)、これは、ゾーンAがゾーンBから
のメツセージの受信を待機する(ステップ2224)状
態で開始する。ゾーンBからメツセージを受信すると、
ゾーンAは、ゾーンBがゾーンAと接続する要求をなし
たがどうかの判断をする(ステップ2226)、もしそ
うでなければ、プロセスはエラー状態2228へ入り。
ステップ2222)、これは、ゾーンAがゾーンBから
のメツセージの受信を待機する(ステップ2224)状
態で開始する。ゾーンBからメツセージを受信すると、
ゾーンAは、ゾーンBがゾーンAと接続する要求をなし
たがどうかの判断をする(ステップ2226)、もしそ
うでなければ、プロセスはエラー状態2228へ入り。
ブートストラップ手順が完了され、ゾーンは非同期状態
に保たれる。ゾーンBが接続の要求をなした場合には、
ゾーンAがゾーンBにrイエス」の応答を出しくステッ
プ2230)そしてゾーンAが再びゾーンBの応答を待
機する(ステップ2232)、ゾーンBがI/Oを供給
しない場合には(即ち、ゾーンBがそのI10装置の制
御を保持する場合には)、別のエラー状態に入り(ステ
ップ2236)、ブートストラップ手順が終了される。
に保たれる。ゾーンBが接続の要求をなした場合には、
ゾーンAがゾーンBにrイエス」の応答を出しくステッ
プ2230)そしてゾーンAが再びゾーンBの応答を待
機する(ステップ2232)、ゾーンBがI/Oを供給
しない場合には(即ち、ゾーンBがそのI10装置の制
御を保持する場合には)、別のエラー状態に入り(ステ
ップ2236)、ブートストラップ手順が終了される。
ゾーンBがI/Oを供給する場合には、ゾーンAがゾー
ンBのクロスリンク状態を読み取る(ステップ2238
)、ゾーンBのクロスリンク状態がゾーンBがクロスリ
ンクスレーブであることを指示しない場合には(ステッ
プ2240)、エラー状態に入り(ステップ2242)
そしてブートストラップ手順が再び終了される。
ンBのクロスリンク状態を読み取る(ステップ2238
)、ゾーンBのクロスリンク状態がゾーンBがクロスリ
ンクスレーブであることを指示しない場合には(ステッ
プ2240)、エラー状態に入り(ステップ2242)
そしてブートストラップ手順が再び終了される。
ゾーンBのクロスリンク状態が該ゾーンがクロスリンク
スレーブモードにあることを指示する場合には(ステッ
プ2240)、ゾーンAがそれ自身のクロスリンク状態
を「マスター」にセットする(ステップ2244)、ゾ
ーンBのI10装置が初期化され、アプリケーションプ
ログラムに対して利用できるようにされる。ゾーンAは
ゾーンBからの要求を待機する(ステップ2246)。
スレーブモードにあることを指示する場合には(ステッ
プ2240)、ゾーンAがそれ自身のクロスリンク状態
を「マスター」にセットする(ステップ2244)、ゾ
ーンBのI10装置が初期化され、アプリケーションプ
ログラムに対して利用できるようにされる。ゾーンAは
ゾーンBからの要求を待機する(ステップ2246)。
ゾーンAが再同期要求を受け取らない場合には(ステッ
プ2248)、エラー状態に入り(ステップ2250)
そしてブートストラップ手順が完了される。
プ2248)、エラー状態に入り(ステップ2250)
そしてブートストラップ手順が完了される。
ゾーンAがゾーンBから再同期要求を受け取る場合には
(ステップ2248)、ゾーンAがゾーンBに「イエス
」の応答を与え(ステップ2252)そしてゾーンBか
らの応答を待機する(ステップ2254)、ゾーンAは
、ゾーンBが再同期の準鍔ができるまで待機する(ステ
ップ2256)。
(ステップ2248)、ゾーンAがゾーンBに「イエス
」の応答を与え(ステップ2252)そしてゾーンBか
らの応答を待機する(ステップ2254)、ゾーンAは
、ゾーンBが再同期の準鍔ができるまで待機する(ステ
ップ2256)。
ゾーンBが再同期メモリに対して構成されている場合に
は、そのクロスリンク状態が「クロスリンクオンスレー
プ」及び「再同期スレーブ」となる、再同期スレーブモ
ードは、ゾーンBのCPUをそれらのメモリ制御器から
外すようにロックする。ここで、ゾーンBのメモリ制御
器は、それに関連したクロスリンクから全ての指示を受
け取る。これは、ゾーンBのメモリをゾーンAで制御す
るようにする。ゾーンBが再同期の準備ができた場合に
は、ゾーンAがゾーンBのクロスリンクの状態を再び読
み取り(ステップ2258)そしてゾーンBの状態が該
ゾーンが再同期スレーブモードにあることを指示するか
どうか判断する(ステップ2260)、もしそうでなけ
れば、別のエラー状態に入り(ステップ2262)そし
てブートストラップ手順が終了される。
は、そのクロスリンク状態が「クロスリンクオンスレー
プ」及び「再同期スレーブ」となる、再同期スレーブモ
ードは、ゾーンBのCPUをそれらのメモリ制御器から
外すようにロックする。ここで、ゾーンBのメモリ制御
器は、それに関連したクロスリンクから全ての指示を受
け取る。これは、ゾーンBのメモリをゾーンAで制御す
るようにする。ゾーンBが再同期の準備ができた場合に
は、ゾーンAがゾーンBのクロスリンクの状態を再び読
み取り(ステップ2258)そしてゾーンBの状態が該
ゾーンが再同期スレーブモードにあることを指示するか
どうか判断する(ステップ2260)、もしそうでなけ
れば、別のエラー状態に入り(ステップ2262)そし
てブートストラップ手順が終了される。
ゾーンBのクロスリンク状態が該ゾーンが再同期スレー
ブモードにあることを指示する場合には(ステップ22
60)、ゾーンAがそれ自身の状態を再同期マスターモ
ードにセントしくステップ2264)そしてメモリ転送
の待ち行列を形成する(ステップ2266)、これは、
第21図について述べるバルクメモリ転送である。
ブモードにあることを指示する場合には(ステップ22
60)、ゾーンAがそれ自身の状態を再同期マスターモ
ードにセントしくステップ2264)そしてメモリ転送
の待ち行列を形成する(ステップ2266)、これは、
第21図について述べるバルクメモリ転送である。
次いで、ゾーンAは、DMAがメモリ再同期に対して完
了するまで待機しくステップ2268)。
了するまで待機しくステップ2268)。
そのシステム状態をメモリから読み取り(ステップ22
70)そして再同期の後にゾーンがスター1−するメモ
リ位置である再スタートベクトルをセーブする(ステッ
プ2272)。システム状態は。
70)そして再同期の後にゾーンがスター1−するメモ
リ位置である再スタートベクトルをセーブする(ステッ
プ2272)。システム状態は。
全て、ソフトウェア及びハードウェアの実行を制御する
CPUモジュールのレジスタ常駐情報である。この情報
は、CPUの汎用レジスター、アドレス変換テーブル、
プロセス状態ワード、スタックポインタ、プログラムカ
ウンタ、割込み状態、構成レジスタ及びインターバルタ
イマを含むが、これに限定されるものではない、これら
の値は、メモリアレイ60にセーブされる。メモリ再同
期がまだ有効であるから、値はメモリアレイ60′にも
セーブされる。セーブされた値のメモリアドレスは、ク
ロスリンクのセーブ状態レジスタに書き込まれる。従っ
て、ゾーンAの全ての処理は保留され、キャッシュメモ
リがフラッシュされる。アプリケーション処理を再スタ
ートするのに必要な全ての情報はメモリアレイ60及び
60’ に常駐する。
CPUモジュールのレジスタ常駐情報である。この情報
は、CPUの汎用レジスター、アドレス変換テーブル、
プロセス状態ワード、スタックポインタ、プログラムカ
ウンタ、割込み状態、構成レジスタ及びインターバルタ
イマを含むが、これに限定されるものではない、これら
の値は、メモリアレイ60にセーブされる。メモリ再同
期がまだ有効であるから、値はメモリアレイ60′にも
セーブされる。セーブされた値のメモリアドレスは、ク
ロスリンクのセーブ状態レジスタに書き込まれる。従っ
て、ゾーンAの全ての処理は保留され、キャッシュメモ
リがフラッシュされる。アプリケーション処理を再スタ
ートするのに必要な全ての情報はメモリアレイ60及び
60’ に常駐する。
次いで、ゾーンAは、デユープレックス同期要求をセッ
トしくステップ2274)そしてゾーンBのクロスリン
ク状態を読み取る(ステップ2276)、ゾーンBの状
態が該ゾーンがデュープレックス同期モードにないこと
を指示する場合には、エラー状態に入り(ステップ22
80)そしてブートストラップ手順が終了する。ゾーン
875″:デユープレックス同期モードにある場合には
、ゾーンAがデユープレックス同期要求をセットし、第
22H図のステップ2308で始まる同期動作に入る。
トしくステップ2274)そしてゾーンBのクロスリン
ク状態を読み取る(ステップ2276)、ゾーンBの状
態が該ゾーンがデュープレックス同期モードにないこと
を指示する場合には、エラー状態に入り(ステップ22
80)そしてブートストラップ手順が終了する。ゾーン
875″:デユープレックス同期モードにある場合には
、ゾーンAがデユープレックス同期要求をセットし、第
22H図のステップ2308で始まる同期動作に入る。
ゾーンAの動作と同時に、ゾーンBはブートストラップ
のための別の組のステップを実行する。
のための別の組のステップを実行する。
ブートストラップ技術においてゾーンBがスレーブであ
ると決定された後に、該ゾーンはゾーンAと接続する要
求を発しくステップ2284)そして応答を待機する(
ステップ2286)、ゾーンAの応答がゾーンBに接続
できないという応答である場合には、ゾーンBがコンソ
ール状態に入る。
ると決定された後に、該ゾーンはゾーンAと接続する要
求を発しくステップ2284)そして応答を待機する(
ステップ2286)、ゾーンAの応答がゾーンBに接続
できないという応答である場合には、ゾーンBがコンソ
ール状態に入る。
成る状態のもとでは、1つのゾーンのみと動作すること
が所望される。1つのゾーンはブートできるが、他方の
ゾーンは拡張診断を実行する。
が所望される。1つのゾーンはブートできるが、他方の
ゾーンは拡張診断を実行する。
従って、ゾーンAはゾーンBをブートしないように命令
され、ゾーンBが接続の要求を出したときには、許可が
与えられない。次いで、ゾーンBは、コンソールオペレ
ータからの命令をコンソール状態で待機する。
され、ゾーンBが接続の要求を出したときには、許可が
与えられない。次いで、ゾーンBは、コンソールオペレ
ータからの命令をコンソール状態で待機する。
ゾーンAがゾーンBの接続要求に対してrイエス」の応
答を出した場合には、ゾーンBがその工/○を手放しく
ステップ2290)、そのクロスリンク状態を「スレー
ブ」モードにセットしそして再同期動作を要求する(ス
テップ2294)。
答を出した場合には、ゾーンBがその工/○を手放しく
ステップ2290)、そのクロスリンク状態を「スレー
ブ」モードにセットしそして再同期動作を要求する(ス
テップ2294)。
次いで、ゾーンBはゾーンAからの応答を待機する(ス
テップ2296)。
テップ2296)。
ゾーンBの再同期要求に対するゾーンAの応答が「イエ
ス」でない場合には(ステップ2298)、ゾーンBが
コンソール状態2300に入り。
ス」でない場合には(ステップ2298)、ゾーンBが
コンソール状態2300に入り。
ブートストラップ動作が終了される。ゾーンAがゾーン
Bの再同期要求に対して「イエス」の応答を出した場合
には(ステップ2298)、ゾーンBが「再同期レディ
」メツセージをゾーンAに送り(ステップ2302)そ
してそのクロスリンク状態を「スレーブ」モードにセッ
トする(ステップ2304)、次いで、ゾーンBは、同
期動作に入るまでゾーンAからの再同期を待機する。
Bの再同期要求に対して「イエス」の応答を出した場合
には(ステップ2298)、ゾーンBが「再同期レディ
」メツセージをゾーンAに送り(ステップ2302)そ
してそのクロスリンク状態を「スレーブ」モードにセッ
トする(ステップ2304)、次いで、ゾーンBは、同
期動作に入るまでゾーンAからの再同期を待機する。
ブートストラップルーチンがまだ終了されないか又はコ
ンソール状態に入らない場合には、雨ゾーンがゾーンA
のクロスリンク状態を読み取る(ステップ2308)と
同時に、ゾーンBのクロスリンク状態を読み取る(ステ
ップ2310)。
ンソール状態に入らない場合には、雨ゾーンがゾーンA
のクロスリンク状態を読み取る(ステップ2308)と
同時に、ゾーンBのクロスリンク状態を読み取る(ステ
ップ2310)。
両方のクロスリンク状態が等しい場合には(ステップ2
312)、ブートストラップが完了しそしてブートスト
ラップ手順が終了される。
312)、ブートストラップが完了しそしてブートスト
ラップ手順が終了される。
クロスリンクA及びクロスリンクBの状態が等しくない
場合には、クロスリンクがオフにされ(ステップ231
4)そして両方のプロセッサがブートマスターとなるか
どうか質問する(ステップ2316)、クロスリンク状
態が不一致であることは、2つのゾーンの同期がうまく
とれなかったことを意味する。ブートマスターゾーン(
ゾーンA)は、スレーブゾーン(ゾーンB)の構成テー
ブルから装置を除去し、そして処理を続行する。
場合には、クロスリンクがオフにされ(ステップ231
4)そして両方のプロセッサがブートマスターとなるか
どうか質問する(ステップ2316)、クロスリンク状
態が不一致であることは、2つのゾーンの同期がうまく
とれなかったことを意味する。ブートマスターゾーン(
ゾーンA)は、スレーブゾーン(ゾーンB)の構成テー
ブルから装置を除去し、そして処理を続行する。
ゾーンBは、コンソール状態において、コンソールオペ
レータが更に別の命令を与えるのを待機する。ブートマ
スターであるゾーンについては、ブートストラップルー
チンが終了される(ステップ2316)、他のゾーンに
ついては、コンソール状態に入り(ステップ2318)
、次いで、ブートストラップルーチンが終了される。
レータが更に別の命令を与えるのを待機する。ブートマ
スターであるゾーンについては、ブートストラップルー
チンが終了される(ステップ2316)、他のゾーンに
ついては、コンソール状態に入り(ステップ2318)
、次いで、ブートストラップルーチンが終了される。
3・工とi旦」1υ」1走
メモリ再同期動作は、コールドブートストラップ手順の
間と、以下に述べるように、ゾーンが同期を失うように
させる過渡エラーが検出された後とに使用される。一方
のゾーンは、好ましくは、他方のゾーンの動作を停止さ
せることなく再同期しなければならない、このような再
同期にとって重要なことは、コンピュータシステム10
を完全に停止することなくメモリアレイ600及び60
0″ を互いに等しくセットする技術である。これは、
メモリ再同期によって行われる。
間と、以下に述べるように、ゾーンが同期を失うように
させる過渡エラーが検出された後とに使用される。一方
のゾーンは、好ましくは、他方のゾーンの動作を停止さ
せることなく再同期しなければならない、このような再
同期にとって重要なことは、コンピュータシステム10
を完全に停止することなくメモリアレイ600及び60
0″ を互いに等しくセットする技術である。これは、
メモリ再同期によって行われる。
メモリ再同期のフローチャートが第23図に示されてい
る。メモリ再同期のための一連のシーケンスの多くは、
ブートストラップ動作に用いられたものと同様である。
る。メモリ再同期のための一連のシーケンスの多くは、
ブートストラップ動作に用いられたものと同様である。
これらのシーケンスは、簡単にいえば「ルーチン」と称
され、第22図のブートストラップ動作のフローチャー
トに示された一連のシーケンスに相関される。
され、第22図のブートストラップ動作のフローチャー
トに示された一連のシーケンスに相関される。
メモリがコピーされるゾーンは「マスター」であり、マ
スターメモリのコピーを受け取るゾーンは「スレーブ」
と称する。マスターはクロスリンクマスターでもあり、
スレーブはクロスリンクスレーブでもある。メモリ再同
期の初期化時に。
スターメモリのコピーを受け取るゾーンは「スレーブ」
と称する。マスターはクロスリンクマスターでもあり、
スレーブはクロスリンクスレーブでもある。メモリ再同
期の初期化時に。
マスターのクロスリンクは「クロスリンクオン(マスタ
ー)」モードである。マスターが他のゾーンから再同期
要求を受け取ると(ステップ2320)、マスターは「
イエス」で応答しくステップ2322)そしてスレーブ
からの応答を待機する(ステップ2324)、マスター
は応答を受け取ると、メモリ再同期(マスター)ルーチ
ンに入り(ステップ2326)、これは、第22B図及
び第22C図に示されたステップ2256ないし228
2より成る0次いで、変更されたブートストラップルー
チンである自動ウオーム再スタート手順が開始される。
ー)」モードである。マスターが他のゾーンから再同期
要求を受け取ると(ステップ2320)、マスターは「
イエス」で応答しくステップ2322)そしてスレーブ
からの応答を待機する(ステップ2324)、マスター
は応答を受け取ると、メモリ再同期(マスター)ルーチ
ンに入り(ステップ2326)、これは、第22B図及
び第22C図に示されたステップ2256ないし228
2より成る0次いで、変更されたブートストラップルー
チンである自動ウオーム再スタート手順が開始される。
この手順については以下で述べる。
そのメモリが同期されることを要求しているゾーンで、
スレーブとなるようなゾーンが再同期を所望していると
きには(ステップ2330)、「再同期要求」をマスタ
ーへ送り(ステップ2332)そして応答を待機する(
ステップ2334)。
スレーブとなるようなゾーンが再同期を所望していると
きには(ステップ2330)、「再同期要求」をマスタ
ーへ送り(ステップ2332)そして応答を待機する(
ステップ2334)。
マスターからの応答を受け取ると、メモリ再同期(スレ
ーブ)ルーチンを開始する。これは、第22G図に示す
ブートストラップルーチンのステップ2298ないし2
306で構成される。このルーチンが完了すると、スレ
ーブは自動ウオーム再スタート手順を開始しくステップ
2338)、次いで1両ゾーンはゾーン再同期手順に入
る。
ーブ)ルーチンを開始する。これは、第22G図に示す
ブートストラップルーチンのステップ2298ないし2
306で構成される。このルーチンが完了すると、スレ
ーブは自動ウオーム再スタート手順を開始しくステップ
2338)、次いで1両ゾーンはゾーン再同期手順に入
る。
ゾーン再同期ルーチンは、第22 H図に示すブートス
トラップルーチンのステップ2308−2318より成
る。唯一の相違は、第22H図に示されたステップ23
16において、ゾーンがブートマスターであるかどうか
ではなくてクロスリンクマスターであるかどうかをそれ
自体に尋ねる。
トラップルーチンのステップ2308−2318より成
る。唯一の相違は、第22H図に示されたステップ23
16において、ゾーンがブートマスターであるかどうか
ではなくてクロスリンクマスターであるかどうかをそれ
自体に尋ねる。
4、ウオーム再スタート手順
ウオーム再スタート手順が第24図に示されている。こ
の手順に入ると、最初に尋ねる質問は。
の手順に入ると、最初に尋ねる質問は。
クロスリンクの状態が何であるかである。それが通常動
作、マスター再同期動作又はスレーブ再同期動作である
場合には、ウオーム再同期動作が終了される。
作、マスター再同期動作又はスレーブ再同期動作である
場合には、ウオーム再同期動作が終了される。
クロスリンク状態が「デユーブレックス同期Jである場
合には、CPUが一時的に停止され(ステップ2420
)、次いで、コンソールコードに入って(ステップ24
30)、ブートストラップ動作を完了する。スレーブ状
態レジスタが分析される。スレーブ状態レジスタが0で
ある場合には第22図に示すようにコールドブートスト
ラップを行う必要がある(ステップ2450)、さもな
くば、CPUレジスタは所定のメモリ位置からロードさ
れ、これらはスレーブ状態レジスタの値十4であるのが
好ましい(ステップ2460)、次いで、スレーブ状態
レジスタによって指示された位置へ分岐がなされろ(ス
テップ2470)。この後者の動作によりオペレーティ
ングシステム及び全ての保留されたジミブが再スタート
される。
合には、CPUが一時的に停止され(ステップ2420
)、次いで、コンソールコードに入って(ステップ24
30)、ブートストラップ動作を完了する。スレーブ状
態レジスタが分析される。スレーブ状態レジスタが0で
ある場合には第22図に示すようにコールドブートスト
ラップを行う必要がある(ステップ2450)、さもな
くば、CPUレジスタは所定のメモリ位置からロードさ
れ、これらはスレーブ状態レジスタの値十4であるのが
好ましい(ステップ2460)、次いで、スレーブ状態
レジスタによって指示された位置へ分岐がなされろ(ス
テップ2470)。この後者の動作によりオペレーティ
ングシステム及び全ての保留されたジミブが再スタート
される。
D、欠陥検出、分離及び修理
1、トレースRAM
欠陥検出のための種々の方法は、CPUモジュール30
及び30′とファイアウオール1000及び1010と
の説明において既に述べた。これらの方法は、メモリ制
御器から受け取ったアドレス及び制御信号が同じである
ことをメモリモジュール60及び60′によってチェッ
クすることと、修正不能なメモリデータのエラーをチェ
ックすることとを含む、又、これらの方法は、2つの「
レール」を通過するアドレス、制御及びデータ信号が同
じであることをメモリ制御器の対70/75及び70’
/75’によって比較することも含む、又、ファイア
ウオール1000及び1010は、l108き込み中に
ゾーンからのデータを比較するチエッカを有している。
及び30′とファイアウオール1000及び1010と
の説明において既に述べた。これらの方法は、メモリ制
御器から受け取ったアドレス及び制御信号が同じである
ことをメモリモジュール60及び60′によってチェッ
クすることと、修正不能なメモリデータのエラーをチェ
ックすることとを含む、又、これらの方法は、2つの「
レール」を通過するアドレス、制御及びデータ信号が同
じであることをメモリ制御器の対70/75及び70’
/75’によって比較することも含む、又、ファイア
ウオール1000及び1010は、l108き込み中に
ゾーンからのデータを比較するチエッカを有している。
他の欠陥検出機構も考えられる。
処理システム20及び20’の欠陥停止機能と矛盾しな
いように、処理システムの欠陥検出は、欠陥が制御され
ない状態で他のモジュールへ伝播されないようにする。
いように、処理システムの欠陥検出は、欠陥が制御され
ない状態で他のモジュールへ伝播されないようにする。
然し乍ら、フェイスセーフ機能を実現するためには、コ
ンピュータシステム10は、欠陥の発生源を分離してシ
ステムを修理することができねばならない、欠陥の発生
源を探索するための好ましい技術は、トレースRA M
と称する再循環レジスタを使用しており、これらのRA
Mは処理システム20及び20′のデータ経路全体にわ
たって配置されている。これらのトレースRAMは、そ
れに関連したデータ経路を経て送られる連続するメツセ
ージを記録する。欠陥が生じたときには、欠陥の発生源
を探索するようにメツセージが分析される。
ンピュータシステム10は、欠陥の発生源を分離してシ
ステムを修理することができねばならない、欠陥の発生
源を探索するための好ましい技術は、トレースRA M
と称する再循環レジスタを使用しており、これらのRA
Mは処理システム20及び20′のデータ経路全体にわ
たって配置されている。これらのトレースRAMは、そ
れに関連したデータ経路を経て送られる連続するメツセ
ージを記録する。欠陥が生じたときには、欠陥の発生源
を探索するようにメツセージが分析される。
第25図は、コンピュータシステム10におけるトレー
スRAMの好ましい位置を示すCPUモジュール30及
びI10モジュール100のブロック図である。他の位
置を使用することもできる。処理システム20において
は、トレースRAMが全てのデータ経路に配置されるの
が好ましい。
スRAMの好ましい位置を示すCPUモジュール30及
びI10モジュール100のブロック図である。他の位
置を使用することもできる。処理システム20において
は、トレースRAMが全てのデータ経路に配置されるの
が好ましい。
従って、第25図において、トレースRAM25OO及
び2505は、各々、メモリ制御器70及び75に配置
される。トレースRAM2510.2515及び251
8はクロスリ、ンク90の全てのインターフェイスに配
置され、そしてトレースRAM2520.2525及び
2528はクロスリンク95の全てのインターフェイス
に配置される。トレースRAM1g’72及び1877
は各々ファイアウオール1000及び1010に配置さ
れる。相補的な組のトレースRAMは、処理システム2
0′に配置される。
び2505は、各々、メモリ制御器70及び75に配置
される。トレースRAM2510.2515及び251
8はクロスリ、ンク90の全てのインターフェイスに配
置され、そしてトレースRAM2520.2525及び
2528はクロスリンク95の全てのインターフェイス
に配置される。トレースRAM1g’72及び1877
は各々ファイアウオール1000及び1010に配置さ
れる。相補的な組のトレースRAMは、処理システム2
0′に配置される。
トレースRAMの選択及び配置ははゾ任意であるが、好
ましくは、エラーのソースを正確に識別してエラー源を
識別できるようにするためには各データ経路が少なくと
も1つのトレースRA Mを含んでいなければならない
。
ましくは、エラーのソースを正確に識別してエラー源を
識別できるようにするためには各データ経路が少なくと
も1つのトレースRA Mを含んでいなければならない
。
トレースRAM2600の一例が第26図に示されてい
る。トレースRAM2600は、関連バス経路のN個の
最新のサイクルに転送されたデータを記憶する円形バッ
ファとして編成されるのが好ましい、トレースRAM2
GOOはバクファレジスタ2605を備えており、その
入力はそれに関連したデータ経路からデータを受け取る
ように接続されている。バッファ2000へのロード入
力はアンドゲート2615の出力である。アンドゲート
2615の入力は、データ経路からのクロック信号と、
欠陥が検出されたときに発生されたFREEZE T
RACE RAM信号である。
る。トレースRAM2600は、関連バス経路のN個の
最新のサイクルに転送されたデータを記憶する円形バッ
ファとして編成されるのが好ましい、トレースRAM2
GOOはバクファレジスタ2605を備えており、その
入力はそれに関連したデータ経路からデータを受け取る
ように接続されている。バッファ2000へのロード入
力はアンドゲート2615の出力である。アンドゲート
2615の入力は、データ経路からのクロック信号と、
欠陥が検出されたときに発生されたFREEZE T
RACE RAM信号である。
バッファ2605のアドレス入力は、アンドゲート26
15からカウント信号を受け取るリサイクルカウンタ2
61oに接続されている。
15からカウント信号を受け取るリサイクルカウンタ2
61oに接続されている。
トレースRAM2600のサイズNは、最も遠いメツセ
ージ転送に必要なバスサイクルの全数と、エラー又は欠
陥が生じたときにトレースRAMに制御信号を送信する
に必要とされるサイクルの全数との和によって決定され
る。この制御信号は、トレースRAMがそのデータを凍
結してそれ以上のメツセージの記憶を停止するためのコ
マンドであるのが好ましい。
ージ転送に必要なバスサイクルの全数と、エラー又は欠
陥が生じたときにトレースRAMに制御信号を送信する
に必要とされるサイクルの全数との和によって決定され
る。この制御信号は、トレースRAMがそのデータを凍
結してそれ以上のメツセージの記憶を停止するためのコ
マンドであるのが好ましい。
次いで、トレースRA Mの各々は、それに関連したデ
ータ経路におけるN個の最新のトランザクションのコピ
ーをそのメモリに保持する2例えば、第25図において
、トレースRAM251 Bは、モジュール相互接続部
130におけるN個の最新のトランザクションのコピー
を保持する。
ータ経路におけるN個の最新のトランザクションのコピ
ーをそのメモリに保持する2例えば、第25図において
、トレースRAM251 Bは、モジュール相互接続部
130におけるN個の最新のトランザクションのコピー
を保持する。
2・澗」Lジ之ニー
第27図は、エラー又は欠陥が検出されたときにその発
生源を分離するのに使用される手順を示すフローチャー
トである。エラーは、「内実」な状態を繰り返さない「
間欠的」なものであるか。
生源を分離するのに使用される手順を示すフローチャー
トである。エラーは、「内実」な状態を繰り返さない「
間欠的」なものであるか。
このような状態を繰り返すものである。成る要素によっ
て欠陥が検出されると、エラー信号がそれに関連したク
ロスリンク(即ち、ファイアウオール1000及びメモ
リ制御器70のクロスリンク90)に送られる。クロス
リンクはCPUに割り込むか又はCPUがトラップ状態
に入るようにさせる。
て欠陥が検出されると、エラー信号がそれに関連したク
ロスリンク(即ち、ファイアウオール1000及びメモ
リ制御器70のクロスリンク90)に送られる。クロス
リンクはCPUに割り込むか又はCPUがトラップ状態
に入るようにさせる。
一般に、エラー信号は、ファイアウオール又はメモリ制
御器からのものである場合には1つのサイクルでクロス
リンクへ送られそしてメモリアレイからのものである場
合には2つのサイクルでクロスリンクに送られる。次い
で、クロスリンクの遅延要素は、両ゾーンのCPUがエ
ラー又は欠陥について同時に通知されるように(即ち、
割込み又はトラップによって)確保する。
御器からのものである場合には1つのサイクルでクロス
リンクへ送られそしてメモリアレイからのものである場
合には2つのサイクルでクロスリンクに送られる。次い
で、クロスリンクの遅延要素は、両ゾーンのCPUがエ
ラー又は欠陥について同時に通知されるように(即ち、
割込み又はトラップによって)確保する。
同時に、FREEZE TRACE RAM信号は
、エラーを検出した要素からコンピユータシステム10
全体にわたって伝播する(ステップ2700)、このF
REEZE TRACE RAM信号は、一般に、
そのゾーンのクロスリンクの到達するのに1つ又は2つ
のメモリサイクルを必要とし、他のゾーンのクロスリン
クと、エラーが見つかったゾーンのファイアウオール及
びメモリ制御器とに到達するのに別のサイクルを必要と
し、そして非欠陥ゾーンのファイアウオール及びメモリ
制御器に到達するのに別のクロックサイクルを必要とす
る。
、エラーを検出した要素からコンピユータシステム10
全体にわたって伝播する(ステップ2700)、このF
REEZE TRACE RAM信号は、一般に、
そのゾーンのクロスリンクの到達するのに1つ又は2つ
のメモリサイクルを必要とし、他のゾーンのクロスリン
クと、エラーが見つかったゾーンのファイアウオール及
びメモリ制御器とに到達するのに別のサイクルを必要と
し、そして非欠陥ゾーンのファイアウオール及びメモリ
制御器に到達するのに別のクロックサイクルを必要とす
る。
CPUは、マシンチェックルーチンに入り(ステップ2
702)そしてCPUが既にマシンチェックルーチンに
ある間にエラーが検出されたかどうかを判断することに
より(ステップ2705)トラップ又は割込みを処理す
る。エラーが検出された場合には、そのエラーが内実な
エラーであるとされ、システムは、第28−六回ないし
第28C図に示す内実な欠陥を分離する手順を開始する
。
702)そしてCPUが既にマシンチェックルーチンに
ある間にエラーが検出されたかどうかを判断することに
より(ステップ2705)トラップ又は割込みを処理す
る。エラーが検出された場合には、そのエラーが内実な
エラーであるとされ、システムは、第28−六回ないし
第28C図に示す内実な欠陥を分離する手順を開始する
。
CPUがマシンチェック手順にない場合には。
検出されたエラーが間欠的であるとされる0次いで、C
PUは入力フラグをセットしくステップ2710)、そ
のエラーを分離する手順を開始する。
PUは入力フラグをセットしくステップ2710)、そ
のエラーを分離する手順を開始する。
この入力フラグは5割込みが生じたときにCPUがマシ
ンチェック手順にあるかどうかを判断するためにステッ
プ2705においてテストされるフラグである。
ンチェック手順にあるかどうかを判断するためにステッ
プ2705においてテストされるフラグである。
次いで、全てのトレースRAMデータがトレースRAM
バスを介してその処理システムに関連したファイアウオ
ールに読み込まれる(ステップ2720)、次いで、診
断マイクロプロセッサは、全てのトレースRAMデータ
をロードしくステップ2730)、CPU40.50.
40′及び50′に転送する(ステップ2735)。
バスを介してその処理システムに関連したファイアウオ
ールに読み込まれる(ステップ2720)、次いで、診
断マイクロプロセッサは、全てのトレースRAMデータ
をロードしくステップ2730)、CPU40.50.
40′及び50′に転送する(ステップ2735)。
次いで、各CPUは、エラー信号を送った要素でスター
トしくステップ2740)、要素の欠陥源を分離する。
トしくステップ2740)、要素の欠陥源を分離する。
トレースRAMデータの比較は。
2500/2505.2510/2520.2515/
2525、等のような対向するレール上の同じ位置のト
レースRAMからのデータを比較することによって行わ
れる。対応するメツセージ(即ち、トレースRAMの同
じ深さにあるメツセージ)が比較されて、エラー(即ち
、対応するメツセージ間の不一致)が検出されたかどう
か調べられる。エラー検出器においてトレースRAMが
分析された後に、次のトレースRAMは、欠陥が生じた
動作中にデータがたどった経路を逆にたどる。従って、
CPUの読み取りに対しては、経路がCPUから離れる
方向となる。
2525、等のような対向するレール上の同じ位置のト
レースRAMからのデータを比較することによって行わ
れる。対応するメツセージ(即ち、トレースRAMの同
じ深さにあるメツセージ)が比較されて、エラー(即ち
、対応するメツセージ間の不一致)が検出されたかどう
か調べられる。エラー検出器においてトレースRAMが
分析された後に、次のトレースRAMは、欠陥が生じた
動作中にデータがたどった経路を逆にたどる。従って、
CPUの読み取りに対しては、経路がCPUから離れる
方向となる。
エラー検出ルーチンの最初の段階においては。
CPUモジュール30及び30’の各レールからのトレ
ースRAMデータが比較される(ステップ2750)。
ースRAMデータが比較される(ステップ2750)。
別々のレールにおけるトレースRAM間にエラーがなく
て(ステップ2752)、対応するデータ経路における
トレースRAMデータが等しいことを意味する場合には
、他のデータ経路の存在が決定される(ステップ275
’4)、他のデータ経路が保持される場合には、別の経
路がとられ(ステップ2756)、次の比較が行われる
(ステップ2750以降)。
て(ステップ2752)、対応するデータ経路における
トレースRAMデータが等しいことを意味する場合には
、他のデータ経路の存在が決定される(ステップ275
’4)、他のデータ経路が保持される場合には、別の経
路がとられ(ステップ2756)、次の比較が行われる
(ステップ2750以降)。
他の経路がない場合には、CPUは、チェックされたト
レースRA M対が第1のものであるかどうか判断する
(ステップ2758)、もしそうであれば、例えば、C
PU読み取りの際にファイアウオール1000及び10
10において最初にデータが受け取られたときにエラー
が生じているはずである。この点では単一のデータレー
ルが2つの経路に分割されているので、データは同じは
ずであり、従って、エラー検出器は「カルプリント(g
%人)」であると考えられ、欠陥であると記録される(
ステップ2760)、次いで、入力フラグがクリアされ
(ステップ2762)、これはマシンチェックルーチン
の終了を指示すると共に割込みをクリアし、そしてマシ
ンチェックルーチンが終了となる(ステップ2764)
。
レースRA M対が第1のものであるかどうか判断する
(ステップ2758)、もしそうであれば、例えば、C
PU読み取りの際にファイアウオール1000及び10
10において最初にデータが受け取られたときにエラー
が生じているはずである。この点では単一のデータレー
ルが2つの経路に分割されているので、データは同じは
ずであり、従って、エラー検出器は「カルプリント(g
%人)」であると考えられ、欠陥であると記録される(
ステップ2760)、次いで、入力フラグがクリアされ
(ステップ2762)、これはマシンチェックルーチン
の終了を指示すると共に割込みをクリアし、そしてマシ
ンチェックルーチンが終了となる(ステップ2764)
。
ステップ2754及び2758において他の経路が保持
されないが現在のトレースRAM対がチェックされた最
初の対ではないことが判断された場合には、エラーがそ
の経路において手前のレベルで生じたものと判断される
。というのは、これは、トレースRAMがデータの変更
を発生時に記録した場合であると共にエラーが最初に生
じた場合だからである(ステップ2766)、次いで、
ステップ2762及び2764において、各々、入力フ
ラグがクリアされ、そしてマシンチェックルーチンが終
了される。
されないが現在のトレースRAM対がチェックされた最
初の対ではないことが判断された場合には、エラーがそ
の経路において手前のレベルで生じたものと判断される
。というのは、これは、トレースRAMがデータの変更
を発生時に記録した場合であると共にエラーが最初に生
じた場合だからである(ステップ2766)、次いで、
ステップ2762及び2764において、各々、入力フ
ラグがクリアされ、そしてマシンチェックルーチンが終
了される。
然し乍ら、ステップ2752においてエラーが指示され
た場合には、そのエラーがオペレーションソースである
かどうかについて次の判断がなされる(ステップ277
0)、rオペレーションソース」とは、特定の経路に対
するデータ経路の開始を短く表現したものである。もし
そうでなければ、経路はオペレーションソースに向かっ
て後退され(ステップ2775)、レール間で別の比較
がなされる(ステップ2750以降)、ステップ277
0においてエラーチェックルーチンがそのときオペレー
ションソースであると判断された場合には、各々、その
オペレーションソースが欠陥の位置として記録され(ス
テップ2780)、入力フラグがクリアされ(ステップ
2762)そしてマシンチェックルーチンが終了される
(ステップ2764)。
た場合には、そのエラーがオペレーションソースである
かどうかについて次の判断がなされる(ステップ277
0)、rオペレーションソース」とは、特定の経路に対
するデータ経路の開始を短く表現したものである。もし
そうでなければ、経路はオペレーションソースに向かっ
て後退され(ステップ2775)、レール間で別の比較
がなされる(ステップ2750以降)、ステップ277
0においてエラーチェックルーチンがそのときオペレー
ションソースであると判断された場合には、各々、その
オペレーションソースが欠陥の位置として記録され(ス
テップ2780)、入力フラグがクリアされ(ステップ
2762)そしてマシンチェックルーチンが終了される
(ステップ2764)。
3、五叉X隨
欠陥が内実欠陥であると判断されると(第27図参照)
、第28A図ないし第28C図のフローチャートに示す
ようにこのような内実欠陥を分離する手順が開始される
。内実欠陥処理の第1のステップは、耐欠陥コンピュー
タシステム10をその2つの別々のゾーン11及び11
′に分割することである(ステップ2800)、これは
、全てのクロスリンクをオフに切り換えることによって
行おれる0次いで、各ゾーンの診断マイクロプロセッサ
がそれらゾーンに対するトレースRAMデータを読み取
り(ステップ2805)そしてそのデータをデュアルレ
ールアクセスによってゾーンのCPUに送る(ステップ
2810)、このプロセス中にエラーが検出された場合
には(ステップ2815)、エラー処理中にハードウェ
ア欠陥が生じており、そのゾーンがコンピュータシステ
ム10から除去される(ステップ2820)、欠陥を報
告する試みがなされる(ステップ2825)が、ハード
ウェア欠陥であるためにこれは不可能であり、この手順
はコンソールへと続く、これにより、コンソールオペレ
ータは詳細な診断テストを開始して、内実欠陥を探索す
ることができる。
、第28A図ないし第28C図のフローチャートに示す
ようにこのような内実欠陥を分離する手順が開始される
。内実欠陥処理の第1のステップは、耐欠陥コンピュー
タシステム10をその2つの別々のゾーン11及び11
′に分割することである(ステップ2800)、これは
、全てのクロスリンクをオフに切り換えることによって
行おれる0次いで、各ゾーンの診断マイクロプロセッサ
がそれらゾーンに対するトレースRAMデータを読み取
り(ステップ2805)そしてそのデータをデュアルレ
ールアクセスによってゾーンのCPUに送る(ステップ
2810)、このプロセス中にエラーが検出された場合
には(ステップ2815)、エラー処理中にハードウェ
ア欠陥が生じており、そのゾーンがコンピュータシステ
ム10から除去される(ステップ2820)、欠陥を報
告する試みがなされる(ステップ2825)が、ハード
ウェア欠陥であるためにこれは不可能であり、この手順
はコンソールへと続く、これにより、コンソールオペレ
ータは詳細な診断テストを開始して、内実欠陥を探索す
ることができる。
トレースRAMデータのデュアルレールアクセス中にエ
ラーが検出されない場合には、そのトレースデータが分
析される(ステップ2830)。
ラーが検出されない場合には、そのトレースデータが分
析される(ステップ2830)。
この分析に用いる手順は、過渡エラー分析のステップ2
740−2780に類似している。然し、ゾーンが分割
されていて一方のゾーンでしかエラーが検出されないの
で、手順に相違が生じる。このような場合の手順は、分
析を行っているゾーンではエラーを示さず、クロスリン
クにおいてエラーを示す0分析中にハードウェア欠陥が
検出された場合には、そのゾーンが除去され(ステップ
2820)、報告の試みがなされ(ステッ′ブ2825
)そして手順はコンソールへと続く。
740−2780に類似している。然し、ゾーンが分割
されていて一方のゾーンでしかエラーが検出されないの
で、手順に相違が生じる。このような場合の手順は、分
析を行っているゾーンではエラーを示さず、クロスリン
クにおいてエラーを示す0分析中にハードウェア欠陥が
検出された場合には、そのゾーンが除去され(ステップ
2820)、報告の試みがなされ(ステッ′ブ2825
)そして手順はコンソールへと続く。
トレースRAMデータのゾーン分析によりエラーがある
ことが示された場合には(ステップ2835)、エラー
の位置が検討される(ステップ2840)、エラーがゾ
ーン内にある場合には。
ことが示された場合には(ステップ2835)、エラー
の位置が検討される(ステップ2840)、エラーがゾ
ーン内にある場合には。
欠陥がもはやハード即ち内実でないことが決定されるか
又は多数の欠陥が存在することが分かり。
又は多数の欠陥が存在することが分かり。
過渡欠陥を分離しようと試みる間に生じる過渡欠陥は元
の過渡欠陥を見掛は上内実であるようにする(ステップ
2845)、まれなことであるが。
の過渡欠陥を見掛は上内実であるようにする(ステップ
2845)、まれなことであるが。
このような状態は、エラー処理中にハードウェアの欠陥
が生じた場合にたどるステップに類似した更に別の分析
を必要とし、欠陥を生じたゾーンがシステムから除去さ
れ(ステップ2850)、ニラ−を報告する試みがなさ
れ(ステップ2855)そして内実欠陥手順を終了して
コンソールへ至る。
が生じた場合にたどるステップに類似した更に別の分析
を必要とし、欠陥を生じたゾーンがシステムから除去さ
れ(ステップ2850)、ニラ−を報告する試みがなさ
れ(ステップ2855)そして内実欠陥手順を終了して
コンソールへ至る。
ステップ2840において、クロスリンクに欠陥がある
と決定された場合には、欠陥が実際にはクロスリンク通
路25にあるか又は他のゾーンニアル(ステップ286
0’)。このような場合。
と決定された場合には、欠陥が実際にはクロスリンク通
路25にあるか又は他のゾーンニアル(ステップ286
0’)。このような場合。
第28B図に示すように、そのゾーンは、そのエラー分
析を直列クロスリンクを経て他のゾーンへ送り(ステッ
プ2865)そして他のゾーンが応答するかどうかにつ
いて判断がなされる(ステップ2868)、他のゾーン
からの応答がない場合には(ステップ2870)、他の
ゾーンが不作動であると判断され、欠陥が報告される(
ステップ2870)、次いで、エラー状態がクリアされ
(ステップ2875)、内実欠陥分析ルーチンが完了す
る。
析を直列クロスリンクを経て他のゾーンへ送り(ステッ
プ2865)そして他のゾーンが応答するかどうかにつ
いて判断がなされる(ステップ2868)、他のゾーン
からの応答がない場合には(ステップ2870)、他の
ゾーンが不作動であると判断され、欠陥が報告される(
ステップ2870)、次いで、エラー状態がクリアされ
(ステップ2875)、内実欠陥分析ルーチンが完了す
る。
他のゾーンが応答する場合には、更に別のエラー分析が
行われて、他のゾーンが欠陥状態にあるかどうか又はク
ロスリンクが欠陥状態にあるかどうかの判断がなされる
(ステップ2877)。
行われて、他のゾーンが欠陥状態にあるかどうか又はク
ロスリンクが欠陥状態にあるかどうかの判断がなされる
(ステップ2877)。
ステップ2877の分析によって他のゾーンが欠陥状態
にあると分かった場合には、該他のゾーンに欠陥が生じ
たと報告され(ステップ2879)、エラー状態がクリ
アされ(ステップ2875)そして内実欠陥分析手順が
完了する。
にあると分かった場合には、該他のゾーンに欠陥が生じ
たと報告され(ステップ2879)、エラー状態がクリ
アされ(ステップ2875)そして内実欠陥分析手順が
完了する。
一方、ステップ2877の分析結果がクロスリンクが欠
陥状態にあるというものであった場合には、直列クロス
リンクを介して欠陥のあるクロスリンクを識別する試み
がなされる(ステップ2881)、これは、第28A図
のステップ2835と同様の手順によって行われる。欠
陥のあるクロスリンクが識別されると、欠陥のあるゾー
ンが除去されそして欠陥が報告される(ステップ288
3)。次いで、エラー状態がクリアされ(ステップ28
75)そして内実欠陥の分析手順が完了する。
陥状態にあるというものであった場合には、直列クロス
リンクを介して欠陥のあるクロスリンクを識別する試み
がなされる(ステップ2881)、これは、第28A図
のステップ2835と同様の手順によって行われる。欠
陥のあるクロスリンクが識別されると、欠陥のあるゾー
ンが除去されそして欠陥が報告される(ステップ288
3)。次いで、エラー状態がクリアされ(ステップ28
75)そして内実欠陥の分析手順が完了する。
ステップ2835において、トレースRA Mデータが
分析されそして他のゾーンに欠陥があると判断された場
合には、第28C図の手順をたどる。この手順において
、ゾーンは直列クロスリンクを経てトレースRAMの分
析結果を交換しくステップ2885)そして他のゾーン
が応答しているかどうか判断される(ステップ2887
)、他のゾーンが応答しない場合には、そのゾーンが欠
陥として報告され(ステップ2889)、エラー状態が
クリアされ(ステップ2891)そして内実欠陥の分析
ルーチンが完了する。
分析されそして他のゾーンに欠陥があると判断された場
合には、第28C図の手順をたどる。この手順において
、ゾーンは直列クロスリンクを経てトレースRAMの分
析結果を交換しくステップ2885)そして他のゾーン
が応答しているかどうか判断される(ステップ2887
)、他のゾーンが応答しない場合には、そのゾーンが欠
陥として報告され(ステップ2889)、エラー状態が
クリアされ(ステップ2891)そして内実欠陥の分析
ルーチンが完了する。
応答が受信された場合には(ステップ2887)、第2
8B図のステップ2835のエラー分析に類似したエラ
ー分析が実行される(ステップ2893)、エラー分析
は2つの結論のうちの1つに到達する。その結論が他の
ゾーンが欠陥状態にあるというものである場合には、そ
のゾーンが欠陥として報告される(ステップ2889)
。その結論がクロスリンクが欠陥状態にあるというもの
である場合には、クロスリンク又は他のゾーンが欠陥で
あると報告される(ステップ2895)。
8B図のステップ2835のエラー分析に類似したエラ
ー分析が実行される(ステップ2893)、エラー分析
は2つの結論のうちの1つに到達する。その結論が他の
ゾーンが欠陥状態にあるというものである場合には、そ
のゾーンが欠陥として報告される(ステップ2889)
。その結論がクロスリンクが欠陥状態にあるというもの
である場合には、クロスリンク又は他のゾーンが欠陥で
あると報告される(ステップ2895)。
ステップ2889又は2895の報告の後に、エラー状
態がクリアされ(ステップ2891)そして分析手順が
終了する。
態がクリアされ(ステップ2891)そして分析手順が
終了する。
4.1里
第27図及び第28A図ないし第28C図に示された欠
陥及び内実欠陥分点手順の結果、CPUモジュール(即
ち、CPU/メモリ/メモリ制御器の組み合わせ):ク
ロスリンク:クロスリンク通路25;モジュール相互接
続部;又は工/○モジュール内においてエラー又は欠陥
が探索されたとすることができる。一般に、間欠欠陥が
検出された場合には、耐欠陥コンピュータシステム10
のCPUが間欠欠陥の位置を指示し、増分カウンタが欠
陥要素に対する間欠エラーの数を指示する。要素に対す
るカウントが所定数を越えない限りそれ以上の動作は生
じない、カウントが所定数を越えて1間欠欠陥の生じる
頻度が許容するには高過ぎることを指示する場合、又は
検出された欠陥が内実欠陥である場合には、モジュール
又は要素に欠陥があり、それらを作動不能にして、その
要素を含むモジュールを交換できるまで耐欠陥コンピュ
ータシステム1oが効果的に動作を続けられるようにし
なければならない。
陥及び内実欠陥分点手順の結果、CPUモジュール(即
ち、CPU/メモリ/メモリ制御器の組み合わせ):ク
ロスリンク:クロスリンク通路25;モジュール相互接
続部;又は工/○モジュール内においてエラー又は欠陥
が探索されたとすることができる。一般に、間欠欠陥が
検出された場合には、耐欠陥コンピュータシステム10
のCPUが間欠欠陥の位置を指示し、増分カウンタが欠
陥要素に対する間欠エラーの数を指示する。要素に対す
るカウントが所定数を越えない限りそれ以上の動作は生
じない、カウントが所定数を越えて1間欠欠陥の生じる
頻度が許容するには高過ぎることを指示する場合、又は
検出された欠陥が内実欠陥である場合には、モジュール
又は要素に欠陥があり、それらを作動不能にして、その
要素を含むモジュールを交換できるまで耐欠陥コンピュ
ータシステム1oが効果的に動作を続けられるようにし
なければならない。
CPUモジュールが欠陥であると分かった場合には、そ
のモジュールのクロスリンクを「デユーブレックス」モ
ードから「スレーブJモードに切り換えることによって
そのモジュールを動作不能にしなければならない、「ス
レーブ」モードにおいては、モジュールをそのクロスリ
ンク診断制御レジスタによって他のゾーンのCPUモジ
ュールと通信するしかない。動作不能にされたCPUモ
ジュールはコンソールモジュールに復帰される。
のモジュールのクロスリンクを「デユーブレックス」モ
ードから「スレーブJモードに切り換えることによって
そのモジュールを動作不能にしなければならない、「ス
レーブ」モードにおいては、モジュールをそのクロスリ
ンク診断制御レジスタによって他のゾーンのCPUモジ
ュールと通信するしかない。動作不能にされたCPUモ
ジュールはコンソールモジュールに復帰される。
クロスリンクが欠陥であると分かった場合には、欠陥状
態にあるクロスリンクの部分に基づいて3つの動作のう
ちの1つをとることができる。
態にあるクロスリンクの部分に基づいて3つの動作のう
ちの1つをとることができる。
メモリ制御器に接続されたクロスリンクの部分は、実際
には、それに関連したCPUモジュールから区別するこ
とができない。その部分に欠陥がある場合には、CPU
モジュールを動作不能にしたのと同じ手順を行わねばな
らない。
には、それに関連したCPUモジュールから区別するこ
とができない。その部分に欠陥がある場合には、CPU
モジュールを動作不能にしたのと同じ手順を行わねばな
らない。
モジュール相互接続部に接続されたクロスリンクの部分
は、実質上、モジュール相互接続部と区別することがで
きない。この状態においてクロスリンクを動作不能にす
るプロセスは、モジュール相互接続部を動作不能にする
手順と同じである。
は、実質上、モジュール相互接続部と区別することがで
きない。この状態においてクロスリンクを動作不能にす
るプロセスは、モジュール相互接続部を動作不能にする
手順と同じである。
クロスリンクの一部分は、クロスリンク通路と実質上区
別できないクロスリンク通路25に接続される。この場
合、又は欠陥がクロスリンク通路にある場合には、クロ
スリングをオフに切り換えると共に、欠陥のあるクロス
リンクを含むと考えられるCPUモジュールを動作不能
にすることにより、ゾーンが分割される。然し乍ら、欠
陥の発生源を決定できない場合には、CPUモジュール
3o及び30’の所定の1つが先ず動作不能にされる。
別できないクロスリンク通路25に接続される。この場
合、又は欠陥がクロスリンク通路にある場合には、クロ
スリングをオフに切り換えると共に、欠陥のあるクロス
リンクを含むと考えられるCPUモジュールを動作不能
にすることにより、ゾーンが分割される。然し乍ら、欠
陥の発生源を決定できない場合には、CPUモジュール
3o及び30’の所定の1つが先ず動作不能にされる。
エラーが持続する場合には、他のCPUモジュールが再
ブートされ、予め選択されたモジュールが動作不能にさ
れる。
ブートされ、予め選択されたモジュールが動作不能にさ
れる。
同じ手順を使用して、欠陥のあるI10モジュールや、
モジュール相互接続部や、モジュールインターフェイス
に欠陥の生じたクロスリンクが動作不能にされる。3つ
全ての状態において、欠陥はI10モジュールを伴うト
ランザクション中に生じ、従って、I10モジュールが
動作不能にされる。これは、全てのCPU40.50.
40′及び50″のオペレーティングシステムにそのI
10モジュールの参照記号を除去するように通知するこ
とによって行われる。
モジュール相互接続部や、モジュールインターフェイス
に欠陥の生じたクロスリンクが動作不能にされる。3つ
全ての状態において、欠陥はI10モジュールを伴うト
ランザクション中に生じ、従って、I10モジュールが
動作不能にされる。これは、全てのCPU40.50.
40′及び50″のオペレーティングシステムにそのI
10モジュールの参照記号を除去するように通知するこ
とによって行われる。
クロスリンク又はモジュール相互接続部の欠陥を表わす
欠陥が生じた場合には、それらのモジュールを含むゾー
ンを動作不能にすることができる。これに対する好まし
い解決策は、欠陥が生じたときに通信状態にあるI10
モジューを動作不能に保持することである。モジュール
相互接続部及びクロスリンクの当該部分も、接続された
全てのI10モジュールが動作不能にされたときに実際
上動作不能にされる。工10モジュールをもたないCP
Uモジュールは、大部分の目的に対し実際上動作不能に
される。
欠陥が生じた場合には、それらのモジュールを含むゾー
ンを動作不能にすることができる。これに対する好まし
い解決策は、欠陥が生じたときに通信状態にあるI10
モジューを動作不能に保持することである。モジュール
相互接続部及びクロスリンクの当該部分も、接続された
全てのI10モジュールが動作不能にされたときに実際
上動作不能にされる。工10モジュールをもたないCP
Uモジュールは、大部分の目的に対し実際上動作不能に
される。
亙筑
以上、好ましい実施例について示した本発明は、前記し
た本発明の目的を達成する。本発明の装置及び方法につ
いて種々の修正及び変更がなされることが当業者に明ら
かであろう、従って1本発明は、その広い吹点において
、m記した特定の細部、代表的な方法及び!A青、並び
に解説のための例に限定されない。従って、本発明の一
般的な考え方の精神又は範囲から逸脱せずに上記細部と
は異なったものが考えられる。
た本発明の目的を達成する。本発明の装置及び方法につ
いて種々の修正及び変更がなされることが当業者に明ら
かであろう、従って1本発明は、その広い吹点において
、m記した特定の細部、代表的な方法及び!A青、並び
に解説のための例に限定されない。従って、本発明の一
般的な考え方の精神又は範囲から逸脱せずに上記細部と
は異なったものが考えられる。
第1図は1本発明による耐欠陥コンピュータシステムの
ブロック図、 第2図は、第1図の耐欠陥コンピュータシステムを含む
物理的なハードウェアを示す図、第3図は、第1図の耐
欠陥コンピュータシステムに示されたCPUモジュール
のブロック図。 第4図は、第1図に示されたコンピュータシステムの相
互接続されたCPUモジュール及びI10モジュールの
ブロック図、 第5図は、第1図に示された耐欠陥コンピュータシステ
ムのメモリモジュールを示すブロック図。 第6図は、第S図に示されたメモリモジュールの要素を
示す詳細図、 第7図は、男3図に示されたCPUモジュールの一次メ
モリ制御器を示すブロック図。 第8図は、第3図のCPUモジュールに含まれたミラー
メモリ制御器のブロック図、第9図は、第7図及び第8
図に示されたメモリ制御器のインターフェイス回路を示
す図、第10図は、第3図に示されたCPUモジュール
のクロスリンクの並列レジスタを示す図、第11図は、
第3図に示されたCPUモジュールのクロスリンクの直
列レジスタを示す図、第12図は、第3図に示されたC
PUモジュールのクロスリンクの制御器の要素を示すブ
ロック図、 第13A図ないし第13P図は、第12図に示された制
御器に対する信号の状態を示す表5第14図は、第1図
の耐欠陥コンピュータシステムのためのタイミングシス
テムのためのブロック図。 第15図は、第14図のタイミングシステムによって発
生されたクロックイ3号のタイミング図。 第16図は、第14図に示されたタイミングシステ11
の位相検出器を詳細に示す図、第17図は、第1図のコ
ンピュータシステムのI10モジュールを示すブロック
図、第18図は、第17図に示されたI10モジュール
のファイアウオール要素を詳細に示す図、第19図は、
第1図のコンピュータシステムに対するクロスリンク通
路の要素を詳細に示す図、第2OA図ないし第20E図
は、第1図のコンピュータシステムのデータ流れ線図。 第21図は、第1図のコンピュータシステムによるバル
クメモリ転送のための論理流れ線図、第22A図ないし
第22H図は、第1図のコンピュータシステムのブート
ストラップ動作のための論理流れ線図、 第23図は、第1図のコンピュータシステムのメモリ再
同期動作のための論理流れ線図、第24図は、第1図の
コンピュータシステムのウオーム再スタート手順のため
の論理流れ線図。 第25図は、トレースRAMの配置を含む第1図のコン
ピュータシステムのブロック図、第26図は、トレース
RA Mのブロック図。 第27図は、第1図のコンピュータシステムについて間
欠欠陥を分離するための論理流れ線図。 そして 第28A図ないし第28C図は、第1図のコンピュータ
システムにおいて内実欠陥を分離するための論理流れ線
図である。 図中: 10・・・耐欠陥コンピュータシステム11.11’
・・・ゾーン 12.12′ ・・・キャビネット 13・・・バッテリ 14・・・電力レギュレータ 16・・・冷却ファン 17・・・交流入力20.2
0’ ・・・処理システム 30.30’ ・・・CPtJモジュール40.50
・・・CPU 42.52・・・キャッシュメモリ 43.53・・・キャッシュバス 44.54・・・システムサポー1〜及びキャッシュ制
御器 60・・・メモリモジュール 70、75 80.82 100、1 130.1 600 ・ ・ 610 ・ ・ 612 ・ ・ 614 ・ ・ 616 ・ ・ 618 ・ ・ 620 ・ ・ 625 ・ ・ 626 ・ ・ 630 ・ ・ 632 ・ ・ 634 ・ ・ 636 ・ ・ 638 ・ ・ 640 ・ ・ 642 ・ ・ ・・・−次メモリ制御器 ・・・バス 10.120・・・工10モジュール 32・・・モジュール相互接続部 ・メモリアレイ ・制御論理回路 ・−大制御信号デマルチプレクサ ・ミラー制御信号デマルチプレクサ ・−次制御信号ドライバ ・システムタイミング制御信号発生器 ・構成エラー論理回路 ・エラー処理論理回路 ・E E P ROM ・比較論理回路 ・行及び列アドレスメモリドライバ ・アドレス比較器 ・制御信号比較器 ・ECC信号比較器 ・データ及びECCl−ランシーバ ・ECC発生器 第 A 図 I − 一ンλネテ/列アドレス 第13A、図 テ1ゲレックスぞ一ドの−)χレールソ°−ン11第1
3B、図 テζりbツクスモードのξラーレールソ―ン1第130
.図 テ1−プレッグスモードのミ5−レールソーン11′M
13c、図 %、ゲレックスH−gの一;χし=ルゾーン11′第1
3E図 マスターモードの−次レールゾーン 第13F図 マスター七−ドのミう−レールゾーン 第13H図 マスターモードのミラーレールゾーン 11′帛/3G
、図 マスターも一ドの一次レールゾーン11′第131図 スレーブモードの−次レールソ一ン11第13J図 スレーブも−ドのミラー゛グーン11 第13L、図 ズレ−7も一ドのミラーレールゾーン11′第13に図 スレーフ゛石−ドの−;χレールゾーン1′ 第13M図 CリングJフの−次レールゾーン11 第13N、図 Cリンクオフのミラーレールゾーン 第738図 Cリンクオフのミラーレールゾーンド 第13o、図 Cリンクオフの−ン欠レールゾーン11′第150図 第 図 re12 第2Z図 ノ\゛ルクメモリ転送 第220図 第22F図 第22H図 第24.図 ウオーム再スタート メミ 第23.図 り再同期 第261図 トレースRAM 1bUコ 第288図
ブロック図、 第2図は、第1図の耐欠陥コンピュータシステムを含む
物理的なハードウェアを示す図、第3図は、第1図の耐
欠陥コンピュータシステムに示されたCPUモジュール
のブロック図。 第4図は、第1図に示されたコンピュータシステムの相
互接続されたCPUモジュール及びI10モジュールの
ブロック図、 第5図は、第1図に示された耐欠陥コンピュータシステ
ムのメモリモジュールを示すブロック図。 第6図は、第S図に示されたメモリモジュールの要素を
示す詳細図、 第7図は、男3図に示されたCPUモジュールの一次メ
モリ制御器を示すブロック図。 第8図は、第3図のCPUモジュールに含まれたミラー
メモリ制御器のブロック図、第9図は、第7図及び第8
図に示されたメモリ制御器のインターフェイス回路を示
す図、第10図は、第3図に示されたCPUモジュール
のクロスリンクの並列レジスタを示す図、第11図は、
第3図に示されたCPUモジュールのクロスリンクの直
列レジスタを示す図、第12図は、第3図に示されたC
PUモジュールのクロスリンクの制御器の要素を示すブ
ロック図、 第13A図ないし第13P図は、第12図に示された制
御器に対する信号の状態を示す表5第14図は、第1図
の耐欠陥コンピュータシステムのためのタイミングシス
テムのためのブロック図。 第15図は、第14図のタイミングシステムによって発
生されたクロックイ3号のタイミング図。 第16図は、第14図に示されたタイミングシステ11
の位相検出器を詳細に示す図、第17図は、第1図のコ
ンピュータシステムのI10モジュールを示すブロック
図、第18図は、第17図に示されたI10モジュール
のファイアウオール要素を詳細に示す図、第19図は、
第1図のコンピュータシステムに対するクロスリンク通
路の要素を詳細に示す図、第2OA図ないし第20E図
は、第1図のコンピュータシステムのデータ流れ線図。 第21図は、第1図のコンピュータシステムによるバル
クメモリ転送のための論理流れ線図、第22A図ないし
第22H図は、第1図のコンピュータシステムのブート
ストラップ動作のための論理流れ線図、 第23図は、第1図のコンピュータシステムのメモリ再
同期動作のための論理流れ線図、第24図は、第1図の
コンピュータシステムのウオーム再スタート手順のため
の論理流れ線図。 第25図は、トレースRAMの配置を含む第1図のコン
ピュータシステムのブロック図、第26図は、トレース
RA Mのブロック図。 第27図は、第1図のコンピュータシステムについて間
欠欠陥を分離するための論理流れ線図。 そして 第28A図ないし第28C図は、第1図のコンピュータ
システムにおいて内実欠陥を分離するための論理流れ線
図である。 図中: 10・・・耐欠陥コンピュータシステム11.11’
・・・ゾーン 12.12′ ・・・キャビネット 13・・・バッテリ 14・・・電力レギュレータ 16・・・冷却ファン 17・・・交流入力20.2
0’ ・・・処理システム 30.30’ ・・・CPtJモジュール40.50
・・・CPU 42.52・・・キャッシュメモリ 43.53・・・キャッシュバス 44.54・・・システムサポー1〜及びキャッシュ制
御器 60・・・メモリモジュール 70、75 80.82 100、1 130.1 600 ・ ・ 610 ・ ・ 612 ・ ・ 614 ・ ・ 616 ・ ・ 618 ・ ・ 620 ・ ・ 625 ・ ・ 626 ・ ・ 630 ・ ・ 632 ・ ・ 634 ・ ・ 636 ・ ・ 638 ・ ・ 640 ・ ・ 642 ・ ・ ・・・−次メモリ制御器 ・・・バス 10.120・・・工10モジュール 32・・・モジュール相互接続部 ・メモリアレイ ・制御論理回路 ・−大制御信号デマルチプレクサ ・ミラー制御信号デマルチプレクサ ・−次制御信号ドライバ ・システムタイミング制御信号発生器 ・構成エラー論理回路 ・エラー処理論理回路 ・E E P ROM ・比較論理回路 ・行及び列アドレスメモリドライバ ・アドレス比較器 ・制御信号比較器 ・ECC信号比較器 ・データ及びECCl−ランシーバ ・ECC発生器 第 A 図 I − 一ンλネテ/列アドレス 第13A、図 テ1ゲレックスぞ一ドの−)χレールソ°−ン11第1
3B、図 テζりbツクスモードのξラーレールソ―ン1第130
.図 テ1−プレッグスモードのミ5−レールソーン11′M
13c、図 %、ゲレックスH−gの一;χし=ルゾーン11′第1
3E図 マスターモードの−次レールゾーン 第13F図 マスター七−ドのミう−レールゾーン 第13H図 マスターモードのミラーレールゾーン 11′帛/3G
、図 マスターも一ドの一次レールゾーン11′第131図 スレーブモードの−次レールソ一ン11第13J図 スレーブも−ドのミラー゛グーン11 第13L、図 ズレ−7も一ドのミラーレールゾーン11′第13に図 スレーフ゛石−ドの−;χレールゾーン1′ 第13M図 CリングJフの−次レールゾーン11 第13N、図 Cリンクオフのミラーレールゾーン 第738図 Cリンクオフのミラーレールゾーンド 第13o、図 Cリンクオフの−ン欠レールゾーン11′第150図 第 図 re12 第2Z図 ノ\゛ルクメモリ転送 第220図 第22F図 第22H図 第24.図 ウオーム再スタート メミ 第23.図 り再同期 第261図 トレースRAM 1bUコ 第288図
Claims (5)
- (1)プロセッサ間エラーチェック機能を有するデュア
ルプロセッサのデータ処理システムにおいて、 一連の命令を実行する第1の中央処理ユニットと、 上記第1の中央処理ユニットと独立して及び同期して上
記一連の命令を実行する第2の中央処理ユニットと、 上記第1の中央処理ユニットに接続され、上記第1の中
央処理ユニットに入力されるべきデータを受け取る第1
のデータバスと、 上記第2の中央処理ユニットに接続され、上記第2の中
央処理ユニットに入力されるべきデータを受け取る第2
のデータバスと、 上記第1及び第2のデータバスに接続され、上記第1及
び第2のデータバスを経て送られるデータをチェックす
ると共に、上記データを上記第1及び第2の中央処理ユ
ニットに供給する前にI/O読み取りに対するエラーを
検出するためのエラーチェック手段であって、上記第1
及び第2のデータバスの上記データが等しくないときに
エラーを指示するための比較手段を含んでいるエラーチ
ェック手段と、 上記エラーチェック手段から検出されたエラーに応答し
て、システムを同期状態に保ちながらエラーの原因を分
析するためのエラー分離手段とを具備することを特徴と
するデュアルプロセッサのデータ処理システム。 - (2)上記第1及び第2の中央処理ユニットに接続され
た主メモリユニットを更に具備し、エラーチェック手段
は、第1及び第2の入力バス上の入力データが等しくな
いときにエラーの存在を指示するメモリ制御手段を備え
ている請求項1に記載のデュアルプロセッサのデータ処
理システム。 - (3)上記メモリ制御手段は、 上記第1のデータバスに接続された一次メモリ制御器で
あって、上記第1のデータバスから上記主メモリユニッ
トへデータを転送するための手段を含んだ一次メモリ制
御器と、 上記第2のバスに接続されたミラーメモリ制御器であっ
て、上記第2のデータバスからのデータをエラーチェッ
クの目的で上記第1のデータバスからのデータと比較す
る手段を含んでいるようなミラーメモリ制御器とを備え
ている請求項2に記載のデュアルプロセッサのデータ処
理システム。 - (4)第1の処理システムを具備し、このシステムは、
一連の命令を実行する第1の中央処理ユニットと、該第
1の中央処理ユニットと独立して及び同期して上記一連
の命令を実行する第2の中央処理ユニットと、上記第1
の中央処理ユニットに接続され、上記第1の中央処理ユ
ニットに入力されるべきデータを受け取る第1のデータ
バスと、上記第2の中央処理ユニットに接続され、上記
第2の中央処理ユニットに入力されるべきデータを受け
取る第2のデータバスと、上記第1及び第2のデータバ
スに接続され、上記第1及び第2のデータバスを経て送
られたデータをチェックすると共に、上記第1及び第2
の中央処理ユニットに上記データを供給する前にI/O
の読み取りに対するエラーを検出するための第1のエラ
ーチェック手段であって、上記第1及び第2データバス
上の上記データが等しくないときにエラーを指示する第
1比較手段を備えているような第1のエラーチェック手
段とを備えており、そして更に、 上記第1の処理システムと実質的に同期して作動する第
2の処理システムを具備し、この第2の処理システムは
、上記一連の命令を実行する第3の中央処理ユニットと
、該第3の中央処理ユニットと独立して及び同期して上
記一連の命令を実行する第4の中央処理ユニットと、上
記第3の中央処理ユニットに接続され、上記第3の中央
処理ユニットに入力されるべきデータを受け取る第3の
データバスと、上記第4の中央処理ユニットに接続され
、上記第4の中央処理ユニットに入力されるべきデータ
を受け取る第4のデータバスと、上記第3及び第4のデ
ータバスに接続され、上記第3及び第4のデータバスを
経て送られたデータをチェックすると共に、上記第3及
び第4の中央処理ユニットに上記データを供給する前に
I/Oの読み取りに対するエラーを検出するための第2
のエラーチェック手段であって、上記第3及び第4デー
タバス上の上記データが等しくないときにエラーを指示
する第2比較手段を備えているような第2のエラーチェ
ック手段とを備えており、そして更に、上記第1と第2
の処理システム間に接続されたクロスリンク通信手段で
あって、上記第1と第2の処理システム間に両方向性の
同期通信を与えるクロスリンク通信手段を備えたことを
特徴とする耐欠陥コンピュータシステム。 - (5)上記第1又は第2のエラーチェック手段から検出
されたエラーに応答して、上記第1及び第2の処理シス
テムを同期状態に保ちながらエラーの原因を分析するエ
ラー分離手段を備えた請求項4に記載のデュアルプロセ
ッサのコンピュータシステム。
Applications Claiming Priority (2)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| US9317987A | 1987-09-04 | 1987-09-04 | |
| US093179 | 1987-09-04 |
Related Parent Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP63222172A Division JPH01152543A (ja) | 1987-09-04 | 1988-09-05 | 欠陥分離及び修理機能を有する耐欠陥コンピュータシステム |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| JPH02118872A true JPH02118872A (ja) | 1990-05-07 |
Family
ID=22237590
Family Applications (2)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP63222172A Pending JPH01152543A (ja) | 1987-09-04 | 1988-09-05 | 欠陥分離及び修理機能を有する耐欠陥コンピュータシステム |
| JP1220114A Pending JPH02118872A (ja) | 1987-09-04 | 1989-08-25 | I/oの読み取りに対するエラーチェック機能を有したデュアルレールプロセッサ |
Family Applications Before (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| JP63222172A Pending JPH01152543A (ja) | 1987-09-04 | 1988-09-05 | 欠陥分離及び修理機能を有する耐欠陥コンピュータシステム |
Country Status (5)
| Country | Link |
|---|---|
| US (1) | US5099485A (ja) |
| EP (1) | EP0306244B1 (ja) |
| JP (2) | JPH01152543A (ja) |
| CA (1) | CA1311849C (ja) |
| DE (1) | DE3854026D1 (ja) |
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH02111612A (ja) * | 1988-10-20 | 1990-04-24 | Sumitomo Electric Ind Ltd | 粒状ダイヤモンドの合成方法 |
Families Citing this family (88)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| US5185877A (en) * | 1987-09-04 | 1993-02-09 | Digital Equipment Corporation | Protocol for transfer of DMA data |
| KR930007185B1 (ko) * | 1989-01-13 | 1993-07-31 | 가부시키가이샤 도시바 | 레지스터뱅크회로 |
| US5148537A (en) * | 1989-05-02 | 1992-09-15 | Belsan Jay S | Method and apparatus for effecting an intra-cache data transfer |
| US5163138A (en) * | 1989-08-01 | 1992-11-10 | Digital Equipment Corporation | Protocol for read write transfers via switching logic by transmitting and retransmitting an address |
| ATE139632T1 (de) * | 1989-08-01 | 1996-07-15 | Digital Equipment Corp | Verfahren zur softwarefehlerbehandlung |
| US5251227A (en) * | 1989-08-01 | 1993-10-05 | Digital Equipment Corporation | Targeted resets in a data processor including a trace memory to store transactions |
| US5068780A (en) * | 1989-08-01 | 1991-11-26 | Digital Equipment Corporation | Method and apparatus for controlling initiation of bootstrap loading of an operating system in a computer system having first and second discrete computing zones |
| US5068851A (en) * | 1989-08-01 | 1991-11-26 | Digital Equipment Corporation | Apparatus and method for documenting faults in computing modules |
| DE69032865T2 (de) * | 1989-08-01 | 1999-08-05 | Digital Equipment Corp., Maynard, Mass. | Gezielte Rücksetzungen in einem Datenprozessor |
| FR2658934B1 (fr) * | 1990-02-28 | 1992-04-30 | Bull Sa | Architecture de systeme et utilisation de cette architecture dans un procede de remplacement de cartes. |
| US5544347A (en) | 1990-09-24 | 1996-08-06 | Emc Corporation | Data storage system controlled remote data mirroring with respectively maintained data indices |
| US5278969A (en) * | 1991-08-02 | 1994-01-11 | At&T Bell Laboratories | Queue-length monitoring arrangement for detecting consistency between duplicate memories |
| US5361267A (en) * | 1992-04-24 | 1994-11-01 | Digital Equipment Corporation | Scheme for error handling in a computer system |
| US5751932A (en) * | 1992-12-17 | 1998-05-12 | Tandem Computers Incorporated | Fail-fast, fail-functional, fault-tolerant multiprocessor system |
| US5838894A (en) | 1992-12-17 | 1998-11-17 | Tandem Computers Incorporated | Logical, fail-functional, dual central processor units formed from three processor units |
| US5640530A (en) * | 1992-12-17 | 1997-06-17 | International Business Machines Corporation | Use of configuration registers to control access to multiple caches and nonvolatile stores |
| JPH06274354A (ja) * | 1993-03-12 | 1994-09-30 | Internatl Business Mach Corp <Ibm> | 破壊的なハードウェア動作を制御する方法及びシステム |
| US5963962A (en) | 1995-05-31 | 1999-10-05 | Network Appliance, Inc. | Write anywhere file-system layout |
| US7174352B2 (en) | 1993-06-03 | 2007-02-06 | Network Appliance, Inc. | File system image transfer |
| US6138126A (en) | 1995-05-31 | 2000-10-24 | Network Appliance, Inc. | Method for allocating files in a file system integrated with a raid disk sub-system |
| US5604863A (en) * | 1993-11-01 | 1997-02-18 | International Business Machines Corporation | Method for coordinating executing programs in a data processing system |
| EP0731945B1 (en) * | 1993-12-01 | 2000-05-17 | Marathon Technologies Corporation | Fault resilient/fault tolerant computing |
| JP2790034B2 (ja) * | 1994-03-28 | 1998-08-27 | 日本電気株式会社 | 非運用系メモリ更新方式 |
| US6141769A (en) | 1996-05-16 | 2000-10-31 | Resilience Corporation | Triple modular redundant computer system and associated method |
| US5901327A (en) * | 1996-05-28 | 1999-05-04 | Emc Corporation | Bundling of write data from channel commands in a command chain for transmission over a data link between data storage systems for remote data mirroring |
| US6052797A (en) * | 1996-05-28 | 2000-04-18 | Emc Corporation | Remotely mirrored data storage system with a count indicative of data consistency |
| US5790397A (en) * | 1996-09-17 | 1998-08-04 | Marathon Technologies Corporation | Fault resilient/fault tolerant computing |
| US5787485A (en) * | 1996-09-17 | 1998-07-28 | Marathon Technologies Corporation | Producing a mirrored copy using reference labels |
| US5815571A (en) * | 1996-10-28 | 1998-09-29 | Finley; Phillip Scott | Computer system with secured data paths and method of protection |
| US5805606A (en) * | 1997-03-13 | 1998-09-08 | International Business Machines Corporation | Cache module fault isolation techniques |
| US6085288A (en) * | 1997-04-14 | 2000-07-04 | International Business Machines Corporation | Dual cache directories with respective queue independently executing its content and allowing staggered write operations |
| US5867511A (en) * | 1997-04-14 | 1999-02-02 | International Business Machines Corporation | Method for high-speed recoverable directory access |
| US6023746A (en) * | 1997-04-14 | 2000-02-08 | International Business Machines Corporation | Dual associative-cache directories allowing simultaneous read operation using two buses with multiplexors, address tags, memory block control signals, single clock cycle operation and error correction |
| US6006311A (en) * | 1997-04-14 | 1999-12-21 | Internatinal Business Machines Corporation | Dynamic updating of repair mask used for cache defect avoidance |
| US5943686A (en) * | 1997-04-14 | 1999-08-24 | International Business Machines Corporation | Multiple cache directories for non-arbitration concurrent accessing of a cache memory |
| FR2767001B1 (fr) * | 1997-07-31 | 1999-08-27 | Bull Sa | Procede de purge des tampons de liaisons series a haut debit et dispositif de mise en oeuvre du procede |
| JPH11143729A (ja) * | 1997-11-07 | 1999-05-28 | Nec Corp | フォールトトレラントコンピュータ |
| US6516351B2 (en) | 1997-12-05 | 2003-02-04 | Network Appliance, Inc. | Enforcing uniform file-locking for diverse file-locking protocols |
| US6202090B1 (en) * | 1997-12-11 | 2001-03-13 | Cisco Technology, Inc. | Apparatus and method for downloading core file in a network device |
| US7389442B1 (en) | 1997-12-26 | 2008-06-17 | Samsung Electronics Co., Ltd. | Apparatus and method for self diagnosis, repair, removal by reversion of computer problems from desktop and recovery from booting or loading of operating system errors by removable media |
| US6457130B2 (en) * | 1998-03-03 | 2002-09-24 | Network Appliance, Inc. | File access control in a multi-protocol file server |
| US6023737A (en) * | 1998-04-24 | 2000-02-08 | International Business Machines Corporation | Multi-stage pipelined data coalescing for improved frequency operation |
| US7096358B2 (en) * | 1998-05-07 | 2006-08-22 | Maz Technologies, Inc. | Encrypting file system |
| US6279011B1 (en) | 1998-06-19 | 2001-08-21 | Network Appliance, Inc. | Backup and restore for heterogeneous file server environment |
| US6574591B1 (en) | 1998-07-31 | 2003-06-03 | Network Appliance, Inc. | File systems image transfer between dissimilar file systems |
| US6119244A (en) | 1998-08-25 | 2000-09-12 | Network Appliance, Inc. | Coordinating persistent status information with multiple file servers |
| US7013305B2 (en) | 2001-10-01 | 2006-03-14 | International Business Machines Corporation | Managing the state of coupling facility structures, detecting by one or more systems coupled to the coupling facility, the suspended state of the duplexed command, detecting being independent of message exchange |
| US6351829B1 (en) * | 1998-10-28 | 2002-02-26 | Honeywell Inc | System and method for distinguishing a device failure from an inter-device communication failure |
| US6343984B1 (en) | 1998-11-30 | 2002-02-05 | Network Appliance, Inc. | Laminar flow duct cooling system |
| US6457015B1 (en) | 1999-05-07 | 2002-09-24 | Network Appliance, Inc. | Adaptive and generalized status monitor |
| US6961749B1 (en) | 1999-08-25 | 2005-11-01 | Network Appliance, Inc. | Scalable file server with highly available pairs |
| US6615374B1 (en) * | 1999-08-30 | 2003-09-02 | Intel Corporation | First and next error identification for integrated circuit devices |
| FR2803057B1 (fr) * | 1999-12-22 | 2002-11-29 | Centre Nat Etd Spatiales | Systeme informatique tolerant aux erreurs transitoires et procede de gestion dans un tel systeme |
| US6691249B1 (en) | 2000-03-22 | 2004-02-10 | Agilent Technologies, Inc. | Probabilistic diagnosis, in particular for embedded and remote applications |
| US6820213B1 (en) | 2000-04-13 | 2004-11-16 | Stratus Technologies Bermuda, Ltd. | Fault-tolerant computer system with voter delay buffer |
| US6633996B1 (en) | 2000-04-13 | 2003-10-14 | Stratus Technologies Bermuda Ltd. | Fault-tolerant maintenance bus architecture |
| US6708283B1 (en) | 2000-04-13 | 2004-03-16 | Stratus Technologies, Bermuda Ltd. | System and method for operating a system with redundant peripheral bus controllers |
| AU2001293360A1 (en) * | 2000-04-13 | 2001-10-30 | Stratus Technologies International, S.A.R.L. | Method and system for upgrading fault-tolerant systems |
| US6691257B1 (en) | 2000-04-13 | 2004-02-10 | Stratus Technologies Bermuda Ltd. | Fault-tolerant maintenance bus protocol and method for using the same |
| US6973517B1 (en) | 2000-08-31 | 2005-12-06 | Hewlett-Packard Development Company, L.P. | Partition formation using microprocessors in a multiprocessor computer system |
| US6745347B1 (en) | 2000-09-27 | 2004-06-01 | International Business Machines Corporation | System, method and program for determining the availability of interfaces to a device from information provided by the device |
| US6850997B1 (en) | 2000-09-27 | 2005-02-01 | International Business Machines Corporation | System, method, and program for determining the availability of paths to a device |
| US6748557B1 (en) | 2000-09-27 | 2004-06-08 | International Buisness Machines Corporation | System, method, and program for determining the availability of interfaces to a control unit |
| US7065672B2 (en) * | 2001-03-28 | 2006-06-20 | Stratus Technologies Bermuda Ltd. | Apparatus and methods for fault-tolerant computing using a switching fabric |
| US6728898B2 (en) | 2002-03-06 | 2004-04-27 | Marathon Technologies Corporation | Producing a mirrored copy using incremental-divergence |
| US7024586B2 (en) | 2002-06-24 | 2006-04-04 | Network Appliance, Inc. | Using file system information in raid data reconstruction and migration |
| US7197664B2 (en) * | 2002-10-28 | 2007-03-27 | Intel Corporation | Stateless redundancy in a network device |
| US7100151B2 (en) * | 2002-11-22 | 2006-08-29 | Texas Instruments Incorporated | Recovery from corruption using event offset format in data trace |
| US7251744B1 (en) * | 2004-01-21 | 2007-07-31 | Advanced Micro Devices Inc. | Memory check architecture and method for a multiprocessor computer system |
| US7409585B2 (en) | 2004-01-30 | 2008-08-05 | Dell Products L.P. | Automatic media repair after read failure due to media error |
| US7343529B1 (en) | 2004-04-30 | 2008-03-11 | Network Appliance, Inc. | Automatic error and corrective action reporting system for a network storage appliance |
| US7624305B2 (en) * | 2004-11-18 | 2009-11-24 | International Business Machines Corporation | Failure isolation in a communication system |
| JP2006178636A (ja) * | 2004-12-21 | 2006-07-06 | Nec Corp | フォールトトレラントコンピュータ、およびその制御方法 |
| US7496787B2 (en) * | 2004-12-27 | 2009-02-24 | Stratus Technologies Bermuda Ltd. | Systems and methods for checkpointing |
| US20070028144A1 (en) * | 2005-07-29 | 2007-02-01 | Stratus Technologies Bermuda Ltd. | Systems and methods for checkpointing |
| US20070038891A1 (en) * | 2005-08-12 | 2007-02-15 | Stratus Technologies Bermuda Ltd. | Hardware checkpointing system |
| US20070233821A1 (en) * | 2006-03-31 | 2007-10-04 | Douglas Sullivan | Managing system availability |
| JP5299281B2 (ja) * | 2007-09-25 | 2013-09-25 | 富士通株式会社 | 情報処理装置及び制御方法 |
| WO2014055064A1 (en) | 2012-10-02 | 2014-04-10 | Hewlett-Packard Development Company, L.P. | Security shield assembly |
| US8918893B2 (en) | 2012-10-29 | 2014-12-23 | Hewlett-Packard Development Company, L.P. | Managing a fault condition by a security module |
| US9251002B2 (en) | 2013-01-15 | 2016-02-02 | Stratus Technologies Bermuda Ltd. | System and method for writing checkpointing data |
| EP3090345B1 (en) | 2013-12-30 | 2017-11-08 | Stratus Technologies Bermuda Ltd. | Method of delaying checkpoints by inspecting network packets |
| WO2015102875A1 (en) | 2013-12-30 | 2015-07-09 | Stratus Technologies Bermuda Ltd. | Checkpointing systems and methods of using data forwarding |
| EP3090344B1 (en) | 2013-12-30 | 2018-07-18 | Stratus Technologies Bermuda Ltd. | Dynamic checkpointing systems and methods |
| US10838815B2 (en) | 2018-09-19 | 2020-11-17 | Dell Products L.P. | Fault tolerant and diagnostic boot |
| US11044141B2 (en) * | 2019-07-09 | 2021-06-22 | Phillip N Hughes | High density, high availability compute system |
| CN112751688B (zh) * | 2019-10-30 | 2023-08-01 | 中兴通讯股份有限公司 | 一种otn设备的流控处理方法、电子设备及存储介质 |
| CN112130521B (zh) * | 2020-09-22 | 2021-04-20 | 郑州嘉晨电器有限公司 | 一种用于工程机械安全操控的控制装置 |
Family Cites Families (25)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| AT285689B (de) * | 1968-03-29 | 1970-11-10 | Siemens Ag | Zentralgesteuerte Vermittlungsanlage der Fernmelde-, insbesondere Fernsprechtechnik |
| US3665173A (en) * | 1968-09-03 | 1972-05-23 | Ibm | Triple modular redundancy/sparing |
| DE2012068A1 (de) * | 1970-03-13 | 1971-09-23 | Siemens Ag | Anordnung zur Suche nach Fehlern an elektronischen Schaltungen |
| FR2182259A5 (ja) * | 1972-04-24 | 1973-12-07 | Cii | |
| US4099241A (en) * | 1973-10-30 | 1978-07-04 | Telefonaktiebolaget L M Ericsson | Apparatus for facilitating a cooperation between an executive computer and a reserve computer |
| US4031372A (en) * | 1973-11-06 | 1977-06-21 | Westinghouse Electric Corporation | System for manually or automatically transferring control between computers without power generation disturbance in an electric power plant or steam turbine operated by a multiple computer control system |
| IT1014277B (it) * | 1974-06-03 | 1977-04-20 | Cselt Centro Studi Lab Telecom | Sistema di controllo di elaboratori di processo operanti in parallelo |
| US4228496A (en) * | 1976-09-07 | 1980-10-14 | Tandem Computers Incorporated | Multiprocessor system |
| US4099234A (en) * | 1976-11-15 | 1978-07-04 | Honeywell Information Systems Inc. | Input/output processing system utilizing locked processors |
| US4141066A (en) * | 1977-09-13 | 1979-02-20 | Honeywell Inc. | Process control system with backup process controller |
| US4153318A (en) * | 1977-10-17 | 1979-05-08 | Square D Company | Bus stab for panelboard assembly |
| GB2019622B (en) * | 1978-04-14 | 1982-04-07 | Lucas Industries Ltd | Digital computing apparatus |
| US4200226A (en) * | 1978-07-12 | 1980-04-29 | Euteco S.P.A. | Parallel multiprocessing system for an industrial plant |
| JPS55106976A (en) * | 1979-02-02 | 1980-08-16 | Hitachi Ltd | Controller for elevator |
| US4245344A (en) * | 1979-04-02 | 1981-01-13 | Rockwell International Corporation | Processing system with dual buses |
| US4253147A (en) * | 1979-04-09 | 1981-02-24 | Rockwell International Corporation | Memory unit with pipelined cycle of operations |
| US4428044A (en) * | 1979-09-20 | 1984-01-24 | Bell Telephone Laboratories, Incorporated | Peripheral unit controller |
| DE3003291C2 (de) * | 1980-01-30 | 1983-02-24 | Siemens AG, 1000 Berlin und 8000 München | Zweikanalige Datenverarbeitungsanordnung für Eisenbahnsicherungszwecke |
| US4330826A (en) * | 1980-02-05 | 1982-05-18 | The Bendix Corporation | Synchronizer and synchronization system for a multiple computer system |
| JPS56110162A (en) * | 1980-02-06 | 1981-09-01 | Hitachi Ltd | Stage tracer |
| US4371754A (en) * | 1980-11-19 | 1983-02-01 | Rockwell International Corporation | Automatic fault recovery system for a multiple processor telecommunications switching control |
| US4486826A (en) * | 1981-10-01 | 1984-12-04 | Stratus Computer, Inc. | Computer peripheral control apparatus |
| US4541094A (en) * | 1983-03-21 | 1985-09-10 | Sequoia Systems, Inc. | Self-checking computer circuitry |
| US4610013A (en) * | 1983-11-08 | 1986-09-02 | Avco Corporation | Remote multiplexer terminal with redundant central processor units |
| US4751702A (en) * | 1986-02-10 | 1988-06-14 | International Business Machines Corporation | Improving availability of a restartable staged storage data base system that uses logging facilities |
-
1988
- 1988-08-26 DE DE3854026T patent/DE3854026D1/de not_active Expired - Lifetime
- 1988-08-26 EP EP88307964A patent/EP0306244B1/en not_active Expired - Lifetime
- 1988-09-02 CA CA000576421A patent/CA1311849C/en not_active Expired - Lifetime
- 1988-09-05 JP JP63222172A patent/JPH01152543A/ja active Pending
-
1989
- 1989-05-25 US US07/357,626 patent/US5099485A/en not_active Expired - Lifetime
- 1989-08-25 JP JP1220114A patent/JPH02118872A/ja active Pending
Cited By (1)
| Publication number | Priority date | Publication date | Assignee | Title |
|---|---|---|---|---|
| JPH02111612A (ja) * | 1988-10-20 | 1990-04-24 | Sumitomo Electric Ind Ltd | 粒状ダイヤモンドの合成方法 |
Also Published As
| Publication number | Publication date |
|---|---|
| EP0306244A2 (en) | 1989-03-08 |
| US5099485A (en) | 1992-03-24 |
| CA1311849C (en) | 1992-12-22 |
| EP0306244B1 (en) | 1995-06-21 |
| DE3854026D1 (de) | 1995-07-27 |
| EP0306244A3 (en) | 1991-04-10 |
| JPH01152543A (ja) | 1989-06-15 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| US4907228A (en) | Dual-rail processor with error checking at single rail interfaces | |
| US5005174A (en) | Dual zone, fault tolerant computer system with error checking in I/O writes | |
| EP0306244B1 (en) | Fault tolerant computer system with fault isolation | |
| US5249187A (en) | Dual rail processors with error checking on I/O reads | |
| US4916704A (en) | Interface of non-fault tolerant components to fault tolerant system | |
| US5153881A (en) | Method of handling errors in software | |
| US5068851A (en) | Apparatus and method for documenting faults in computing modules | |
| US5291494A (en) | Method of handling errors in software | |
| US5251227A (en) | Targeted resets in a data processor including a trace memory to store transactions | |
| US5065312A (en) | Method of converting unique data to system data | |
| JPH03232045A (ja) | Dmaデータ転送のためのプロトコル | |
| US5048022A (en) | Memory device with transfer of ECC signals on time division multiplexed bidirectional lines | |
| EP0415552B1 (en) | Protocol for read and write transfers | |
| EP0411805B1 (en) | Bulk memory transfer during resync | |
| EP0416732B1 (en) | Targeted resets in a data processor | |
| EP0415547A2 (en) | Method of handling nonexistent memory errors |