JPH02206849A - 統計データ格納方式 - Google Patents

統計データ格納方式

Info

Publication number
JPH02206849A
JPH02206849A JP1027983A JP2798389A JPH02206849A JP H02206849 A JPH02206849 A JP H02206849A JP 1027983 A JP1027983 A JP 1027983A JP 2798389 A JP2798389 A JP 2798389A JP H02206849 A JPH02206849 A JP H02206849A
Authority
JP
Japan
Prior art keywords
statistical
statistical data
format
value
record
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Pending
Application number
JP1027983A
Other languages
English (en)
Inventor
Junichi Ueno
上野 順一
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
NEC Corp
Original Assignee
NEC Corp
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by NEC Corp filed Critical NEC Corp
Priority to JP1027983A priority Critical patent/JPH02206849A/ja
Publication of JPH02206849A publication Critical patent/JPH02206849A/ja
Pending legal-status Critical Current

Links

Landscapes

  • Information Retrieval, Db Structures And Fs Structures Therefor (AREA)

Abstract

(57)【要約】本公報は電子出願前の出願データであるた
め要約のデータは記録されません。

Description

【発明の詳細な説明】 〔産業上の利用分野〕 本発明は統計データ格納方式に関し、特に中央省庁・地
方自治体の統計データベースや民間企業の経営管理デー
タベースに収録される統計データを圧縮して格納するた
めの統計データ格納方式に関する。
〔従来の技術〕
統計データは年度、地域、性別1年齢階級等の分類語の
組によって定まるキー値に、人工1年間所得などの統計
値を対応付けたデータであり、論理的には第3図に示す
ようなキー項目の統計項目の並びで構成されたレコード
形式で表現される。
しかし、すべての統計項目が有効値であるとは限らない
ため、従来は第4図に示すように、無効値と有効値を識
別する識別項目を各統計項目の直前に付加したレコード
形式で格納し、無効値と有効値のゼロを識別する方法が
採られていた。
〔発明が解決しようとする課題〕
多数の統計項目を含む統計データに対しては従来の記録
形式では、無効値と有効値を識別する項目が追加される
ためにレコードサイズが大きくなり、格納スペースの使
用効率が劣化するという問題があった。
〔課題を解決するための手段〕
本発明の統計データ格納方式は、統計データを、分類語
の組によって定まるキー項目のフィールドと、該キー項
目の値に対応する第に番目の統計値が無効値か有効値か
に従って第にビットをOか1で表現するビットマツプの
フィールドと、該ビットマツプ中最後に1が現れる位置
を第mビットとするとき第1番目の統計値から第m番目
の統計値までをm個の文字列として連接した可変長文字
列のフィールドとで構成されるレコード形式を有してい
る。
〔作用〕
説明の便宜上従来の統計データ格納方式で使用されるレ
コード形式を形式R9本発明の統計データ格納方式で使
用される第2図のレコード形式を形式Tと呼ぶことにす
る。本発明の構成によると、統計データ格納においては
、メインメモリ上に展開された形式Rの統計データレコ
ードを形式Tの統計データレコードに圧縮してデータベ
ースに収録し、逆に統計データ検索においてはデータベ
ースに収録された形式Tの統計データレコードを形式R
の統計データレコードに伸長する。
〔実施例〕
次に本発明の実施例について図面を参照して説明する。
第1図は本発明の一実施例を示すブロック図である0本
発明の一実施例は統計データを、分類語の組によって定
まるキー項目のフィールド21と、該キー項目の値に対
応する第に番目の統計値が無効値か有効値かに従って第
にビットをOか1で表現するビットマツプのフィールド
22と、該ビットマツプ中最後に1が現れる位置を第m
ビットとするとき第1番目の統計値から第m番目の統計
値までをm個の文字列として連接した可変長文字列のフ
ィールド23とで構成されるレコード形式で格納される
方式で、メインメモリ101上に展開された形式Rの統
計データレコード11はデータ圧縮手段1により圧縮手
順(i)で形式Tの統計データレコードに圧縮されてデ
ータ格納手段3によりデータベース13に格納される。
またデータベース13に形式Tで収録されている統計デ
ータレコードはデータ検索手段4によりメインメモリ1
01上に読み込まれてデータ伸長手段2により伸長手順
(ii)で形式Rの統計データレコードに伸長される。
ここで、各統計値を表現するビ・ント長はLとする。
(i)圧縮手順 形式Rで表現された統計データレコード11の各識別項
目の値を順次、形式Tの統計データレコードのビットマ
ツプに変換するとともに、最後の有効値の位置mを決定
する。次いで、形式Rの統計データレコード11の第1
の統計値から第mの統計値までを順次連接して文字列を
構成し、この文字列を形式Tの統計データレコード12
の可変長文字列フィールドにセットする。
(it)復元手順 形式Tの統計データレコードのビットマツプと可変長文
字列フィールドを参照し、順次、形式Rの統計データレ
コードの統計値の識別項目の値を復元する。このとき、
形式Rの統計データレコードの統計値の復元方法は形式
Tの統計データレコードのビットマツプの第にビットが
1か0かに従って、以下の様に処理が異なる。
(a)第にビットが1のとき 形式Tの統計ビットレコードの可変長文字列フィールド
の第(k−1)*L+1ビットから第に*Lビットまで
のビット列を形式Rの統計データレコードの第に番目の
統計値として復元する。
(b)第にビットがOのとき 形式Tの統計データレコードのビットマツプの第に+1
ビツトから最後のビットまですべてOのときは、形式R
の統計データレコードの第に番目の統計項目の値は無効
値として復元する。一方、形式Tの統計データレコード
のビットマツプの第に+1ビツト以降に1が存在すれば
、可変長文字列フィールドの第(k−1)*L+1ビッ
トから第に*Lビットまでのビット列を形式Rの統計デ
ータレコード第に番目の統計値として復元する。
〔発明の効果〕
以上に詳細に説明したように、本発明による統計データ
記録方式によれば、無効値とゼロを識別するとともに小
さなレコードサイズで統計データを記録することが可能
となる。特に、無効値の発生確率の小さい順に統計項目
を配列することにより、可変長文字列フィールドの平均
長は小さくなるなめ格納効率が大幅に改善される。この
傾向は統計データレコードに含まれる統計項目の数が多
いほど顕著になる。
された統計データ、12・・・本発明の統計データ格納
方式のレコード形式で表現された統計データ、13・・
・データベース、101・・・メインメモリ。

Claims (1)

    【特許請求の範囲】
  1. 統計データを、分類語の組によって定まるキー項目のフ
    ィールドと、該キー項目の値に対応する第k番目の統計
    値が無効値か有効値かに従つて第kビットを0か1で表
    現するビットマップのフィールドと、該ビットマップ中
    最後に1が現れる位置を第mビットとするとき第1番目
    の統計値から第m番目の統計値までをm個の文字列とし
    て連接した可変長文字列のフィールドとで構成されるレ
    コード形式で格納することを特徴とする統計データ格納
    方式。
JP1027983A 1989-02-06 1989-02-06 統計データ格納方式 Pending JPH02206849A (ja)

Priority Applications (1)

Application Number Priority Date Filing Date Title
JP1027983A JPH02206849A (ja) 1989-02-06 1989-02-06 統計データ格納方式

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP1027983A JPH02206849A (ja) 1989-02-06 1989-02-06 統計データ格納方式

Publications (1)

Publication Number Publication Date
JPH02206849A true JPH02206849A (ja) 1990-08-16

Family

ID=12236086

Family Applications (1)

Application Number Title Priority Date Filing Date
JP1027983A Pending JPH02206849A (ja) 1989-02-06 1989-02-06 統計データ格納方式

Country Status (1)

Country Link
JP (1) JPH02206849A (ja)

Citations (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPS6022255A (ja) * 1983-07-15 1985-02-04 Fujitsu Ltd 可変型レコ−ドの制御方式

Patent Citations (1)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPS6022255A (ja) * 1983-07-15 1985-02-04 Fujitsu Ltd 可変型レコ−ドの制御方式

Similar Documents

Publication Publication Date Title
JP4774145B2 (ja) 構造化文書圧縮装置および構造化文書復元装置並びに構造化文書処理システム
US7783855B2 (en) Keymap order compression
JP5377318B2 (ja) 個別にアクセス可能なデータユニットの格納管理
US8051252B2 (en) Method and apparatus for detecting the presence of subblocks in a reduced-redundancy storage system
US6006232A (en) System and method for multirecord compression in a relational database
US5561421A (en) Access method data compression with system-built generic dictionaries
US6216125B1 (en) Coarse indexes for a data warehouse
KR101725172B1 (ko) 개별적으로 액세스 가능한 데이터 유닛의 스토리지 관리 방법
CN111291235A (zh) 一种基于时序数据库的元数据存储方法及装置
EP1866776B1 (en) Method for detecting the presence of subblocks in a reduced-redundancy storage system
CN111930751A (zh) 一种时序数据的存储方法及装置
CN112214493B (zh) 一种历史记录存储方法、装置、电子设备以及存储介质
JPH02206849A (ja) 統計データ格納方式
US8918374B1 (en) Compression of relational table data files
CN109271463B (zh) 一种恢复MySQL数据库的innodb压缩数据的方法
Fraenkel et al. Combinatorial compression and partitioning of large dictionaries
KR20080026772A (ko) Lempel-Ziv 압축 방법의 복원 속도를 보완한압축 방법
Ng et al. Incremental mining of association patterns on compressed data
JPS6394366A (ja) 英語文書圧縮装置
CN116483886A (zh) 结合kv存储引擎和时序存储引擎查询olap的方法
JPS61278932A (ja) デ−タ追加処理方法
JPH0363736A (ja) 半導体プロセスデータ蓄積システム
JPS62131348A (ja) マルチインデツクスフアイルアクセス方式
JPS5827240A (ja) フアイル記憶方式
CN119201866A (zh) 一种大容量文件实施压缩读取方法