DE69029962T2 - Apparat zum Formatieren eines Dokumentes - Google Patents

Apparat zum Formatieren eines Dokumentes

Info

Publication number
DE69029962T2
DE69029962T2 DE69029962T DE69029962T DE69029962T2 DE 69029962 T2 DE69029962 T2 DE 69029962T2 DE 69029962 T DE69029962 T DE 69029962T DE 69029962 T DE69029962 T DE 69029962T DE 69029962 T2 DE69029962 T2 DE 69029962T2
Authority
DE
Germany
Prior art keywords
text
document
information
text data
page
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Expired - Fee Related
Application number
DE69029962T
Other languages
English (en)
Other versions
DE69029962D1 (de
Inventor
Mika Fukui
Isamu Iwai
Koji Yamaguchi
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
Toshiba Corp
Original Assignee
Toshiba Corp
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by Toshiba Corp filed Critical Toshiba Corp
Publication of DE69029962D1 publication Critical patent/DE69029962D1/de
Application granted granted Critical
Publication of DE69029962T2 publication Critical patent/DE69029962T2/de
Anticipated expiration legal-status Critical
Expired - Fee Related legal-status Critical Current

Links

Classifications

    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06F—ELECTRIC DIGITAL DATA PROCESSING
    • G06F40/00—Handling natural language data
    • G06F40/10—Text processing
    • G06F40/103—Formatting, i.e. changing of presentation of documents

Landscapes

  • Engineering & Computer Science (AREA)
  • Theoretical Computer Science (AREA)
  • Health & Medical Sciences (AREA)
  • Artificial Intelligence (AREA)
  • Audiology, Speech & Language Pathology (AREA)
  • Computational Linguistics (AREA)
  • General Health & Medical Sciences (AREA)
  • Physics & Mathematics (AREA)
  • General Engineering & Computer Science (AREA)
  • General Physics & Mathematics (AREA)
  • Document Processing Apparatus (AREA)

Description

  • Die vorliegende Erfindung bezieht sich auf eine Vorrichtung zum Formatieren eines Dokuments, um ein Dokument entsprechend einem gewünschten Nutzerformat anzuordnen.
  • In jüngster Zeit sind in Büros "Desk Top Publishing Systems" (DTP) (Redigiersysteme in der Form von Tischgeräten) zur Anwendung gekommen. Das DTP gestattet, viele verschiedene Seitengrößen, Textrahmenstellen, und Zeichenmerkmale als Layoutfunktionen und druckt Dokumente hoher Qualität.
  • Wenn das DTP bei Beginn der Herstellung eines Dokuments verwendet wird, dann muß der Nutzer viele Arten an Layoutfunktionen festlegen. Beispielsweise werden, Wie in Fig. 1 gezeigt, Menüposten geordnet angezeigt, und der Nutzer wählt gewünschte Posten nacheinander. Auf der linken Seite von Fig. 1 sind Dokumenttyp- Posten zuerst angezeigt. Wenn der Nutzer eine Abhandlung als seinen gewünschten Dokumenttyp wählt, dann werden Textdatenposten einer Abhandlung so angezeigt, Wie in der Mitte von Fig. 1 gezeigt.
  • Die Textdaten einer Abhandlung sind der Titel, Verfasser, Ort, Kapitelüberschrift, Kapitelabsatz, Abschnittsüberschrift, Abschnittsabsatz und so weiter. Wenn der Nutzer die Überschrift wählt, dann werden Eigenschaftsposten für die Überschrift so angezeigt, Wie in der rechten oberen Seite von Fig. 1 gezeigt. Dies sind Zeichenart, Zeichengräße und die Zeichenposition, welche notwendig für die zu schaffende Überschrift sind. Der Nutzer könnte dann die Zeichenart GOTISCH als Zeichenart, 18 Punkte als Zeichengröße und zentriert als Zeichenposition wählen. Dann werden die Textdatenelemente Wieder so auf dem Bildschirm ausgegeben, Wie in der Mitte von Fig. 1 gezeigt. Wenn der Nutzer Verfasser wählt, dann werden Zeicheneigenschaftselemente für Verfasser so ausgegeben, Wie auf der rechten unteren Seite von Fig. 1 gezeigt. Dann wählt der Nutzer jedes gewünschte Element in derselben Art und Weise. Auf diese Weise legt der Nutzer alle Zeicheneigenschaften aller Textdaten für eine Abhandlung fest. Weil jedoch der Nutzer das gewünschte Format nur mit Hilfe von Menüelementen festlegt, kann er das formatierte Dokumentenbild nicht sehen. Darüberhinaus muß er, wenn ihm später das formatierte Dokument nicht gefällt, dieses redigieren. Zu diesem Zeitpunkt wird ein kleines Redigierfenster auf der Seite des formatierten Dokuments auf dem Bildschirm ausgegeben, und der Nutzer ändert das formatierte Dokument unter Benutzung des Fensters. Jedoch wird dieses geänderte Format nicht für eine Verwendung bei der nächsten Erzeugung des Dokuments gesichert. Kurz gesagt, die unter Verwendung des Redigierfensters vorgenommene Änderung wird nicht abgespeichert. Deshalb wird das vom Nutzer gewünschte endgültige Format nicht auf das nächste eingegebene Dokument angewendet. Um dieses endgültige Format nach der Änderung abzuspeichern, werden Wieder Menüelemente ausgegeben, und der Nutzer muß Elemente genauso festlegen, Wie bei der Durchführung der Änderung. Diese zweite Festlegung von Menüelementen ist mühsam für den Nutzer.
  • Die Communication of the ACM, Band 28, Nr. 9, September 1985, New York, USA, 5. 942 - 960, K.GUTKNECHT "Concept of the Text Editor LARA" offenbart ein Text-Redigiersystem, bei welchem eine Maus verwendet wird, um Menükarten zu wählen, die mit Formatierhandlungen verbunden sind oder, genauer gesagt, der Zuordnung von Attributwerten zum gewählten Text. Die Menü-Eintragungen entsprechen den Attributen der jeweiligen Selektionsebene (d.h. der Satz von Attributen und folglich die Menüeintragungen werden durch den Selektionspegel bestimmt). Wenn ein Attribut über das Menü gewählt worden ist, dann muß ein Parameterwert spezifiziert werden, wobei ein Weg, dies zu tun, das Eintippen einer Nummer oder eines Zeichengrößennamens ist. Wenn nur die Taste RETURN gedrückt wird, dann wird ein entsprechender Standardwert zugeordnet. Hier jedoch führt LARA ein zweites Verfahren der Spezifizierung von Parameternamen ein: das heißt, statt des Drückens einer Zeichentaste wird die P-Taste an einer Textstelle innerhalb irgendeines Dokumentenfensters auf dem Bildschirm eingera stet, der Attributwert wird aus dem Text genommen.
  • EP-A2-0 324 445 offenbart eine Vorrichtung zum Formatieren eines Dokumentes mit einem Eingabemittel, das es einem Nutzer gestattet, Dokumentendaten einzugeben, die ein zu formatierendes Dokument repräsentieren, das eine Überschrift hat; und Mittel zum Formatieren des Dokumentes; Mittel zum Identifizieren eines Themenfeldes, zu welchem das Dokument gehört, durch Suchen eines Schlüsselwortes, das das Themenfeld kennzeichnet; und wobei das Formatiermittel das Dokument in einer aus einer Vielzahl von Formattypen formatiert, die in Übereinstimmung mit dem identifizierten Themenfeld vorgeschrieben sind.
  • EP-A2-0 328 900 offenbart ein Verfahren für das Redigieren eines Dokuments, das in der Lage ist, ein in zufriedenstellender Weise gut geordnetes Layout automatisch zu erzeugen. Dieses Verfahren besteht aus folgenden Schritten: (a) Herausziehen von Zeichengrößen, die verschiedene Elemente des Dokumentes kennzeichnen; (b) Ableiten von Beziehungen unter den verschiedenen Elementen des Dokumentes in Übereinstimmung mit den charakteristischen Größen; (c) Festlegen des Layout der verschiedenen Elemente des Dokumentes in Übereinstimmung mit den Beziehungen; und (d) das Verarbeiten des Dokumentes in Ubereinstimmung mit dem Layout.
  • Demgemäß ist es eine Aufgabe der vorliegenden Erfindung, für eine Vorrichtung zum Formatieren von Dokumenten zu sorgen, welche es dem Nutzer gestattet, das Format, welches dargestellt Wird, leicht zu verstehen.
  • Es ist eine weitere Aufgabe der vorliegenden Erfindung, für eine Vorrichtung zum Formatieren von Dokumenten zu sorgen, welche nicht erfordert, daß der Nutzer die Layout-Funktion durch Menüpositionen festlegt.
  • Es ist eine weitere Aufgabe der vorliegenden Erfindung, für eine Vorrichtung zum Formatieren von Dokumenten zu sorgen, welche ein geändertes Format abspeichert und es für das nächste eingegebene Dokument nutzt.
  • Dementsprechend sorgt die vorliegende Erfindung für eine Vorrichtung zum Formatieren von Dokumenten für das automatische Herausziehen der Layout-Strukturinformation aus einem formatierten Dokument, um ein unformatiertes Dokument zu redigieren, mit:
  • Eingabemitteln zum Eingeben des unformatierten Dokumentes, das eine Anzahl von Textdaten enthält;
  • Textdaten-Analysemitteln zum Bestimmen der logischen Eigenschaften jeder Textdaten des unformatierten Dokuments;
  • Formatinformations-Speichermitteln zum Speichern des formatierten Dokumentes, die eine Anzahl von Textdaten mit Layoutstruktur-Information und den logischen Eigenschaften von jeden Textdaten hat, wobei die Layoutstruktur-Information Seiteninformation, Textrahmeninformation und die Zeicheneigenschaften von jeden Textdaten umfaßt und wobei die Seiteninformation, die Textrahmeninformation und die Zeicheneigenschaft von jeden Textdaten in festgelegter Reihenfolge als Datenstruktur des formatierten Dokumentes angeordnet sind;
  • Formatinformations-GeW1nnungsmitteln zum GeW1nnen der Seiteninformation, der Textrahmeninformation, der logischen Eigenschaft und der Zeicheneigenschaft von jeden Textdaten aus dem formatierten Dokument gemäß der festgelegten Reihenfolge; und
  • Formatinformations-Anwendungsmitteln zum Erzeugen mehrerer Textrahmen, die in der Seite enthalten sind, gemäß der Seiteninformation und der Textrahmeninformation zum Anordnen jeder Textdaten des unformatierten Dokumentes in den Textrahmen gemäß der Textrahmeninformation und der logischen Eigenschaften jeder Textdaten des unformatierten Dokumentes und zum Bearbeiten jeder Textdaten, die in dem Textrahmen angeordnet sind, gemäß der Zeicheneigenschaft entsprechend den logischen Eigenschaften jeder Textdaten des unformatierten Dokumentes.
  • Eine Ausführungsform der vorliegenden Erfindung wird jetzt unter Bezugnahme auf die beigefügten Zeichnungen beschrieben, diese zeigen in
  • Fig. 1 ein Beispiel für eine Ausgabeübertragung durch Menüwahl entsprechend dem Stand der Technik;
  • Fig. 2 ein Schema der Vorrichtung zum Formatieren eines Dokumentes der vorliegenden Erfindung;
  • Fig. 3 eine Situation eines Formataufbringens entsprechend der vorliegenden Erfindung;
  • Fig. 4A und 4B gespeicherte Daten eines formatierten Dokumentes und erweiterte formatierte Daten;
  • Fig. 5 ein Flußbild des Verfahrens zum Herausziehen des Formats aus einem vorformatierten Dokument entsprechend der vorliegenden Erfindung;
  • Fig. 6A, 6B und 6D die Datenstruktur der Layoutinformation und der logischen Eigenschaftsinformation entsprechend der vorliegenden Erfindung;
  • Fig. 7A und 7B ein Eingabedokument und dessen logischen Eigenschaftsinformation;
  • Fig. 8 ein formatiertes Eingabedokument entsprechend der vorliegenden Erfindung.
  • Beschreibung der bevorzugten Ausführungsformen
  • Fig. 2 zeigt ein Schema einer Vorrichtung zum Formatieren eines Dokumentes entsprechend der vorliegenden Erfindung. Diese Vorrichtung besteht aus einem Eingabeabschnitt 1, einem Textdaten- Analyseabschnitt 2, einem Speicherabschnitt für das formatierte Dokument 3, einem Formatinformations-Extraktionsabschnitt 4, einem Formationformations-Speicherabschnitt 5, einem Formatinformations-Anwendungsabschnitt 6, einen Ausgabedaten-Erzeugungsabschnitt 7 und einem Ausgabeabschnitt 8.
  • Der Eingabeabschnitt 1 ist ein Mittel für die Eingabe von Dokumentendaten, die aus einem Zeichencode und verschiedenen Operationskommandos bestehen. Beispielweise ist der Eingabeabschnitt 1 eine Tastatur oder eine Tabelle.
  • Der Textdaten-Analyseabschnitt 2 ist ein Mittel zum Herausziehen einer logischen Eigenschaft aus den jeweiligen Textdaten durch den Eingabeabschnitt 1, und er gibt die jeweiligen Textdaten und die entsprechenden logischen Eigenschaftsinformationen als Ausgang ab. (Textdaten sind Überschrift, Name des Verfassers, Ort, Kapitelüberschrift, Kapitelabsatz, Abschnittsüberschrift, Abschnittsabsatz und so weiter. Sie bilden das Dokument). Kurz gesagt, der Textdaten-Analyseabschnitt 2 analysiert alle Textdaten unter Verwendung der Regeln für die Dokumenten-Strukturanalyse. Diese Analysetechnik wird in USP 4813010 offenbart.
  • Der Speicherabschnitt für das formatierte Dokument 3 speichert ein vorformatiertes Dokument ab, welches durch diese Vorrichtung erzeugt und durch den letzten Nutzer redigiert worden ist. Mit anderen Worten, das abgespeicherte Dokument hat ein Format, welches von dem Nutzer beim letzten Mal verwendet worden ist. Dieser Abschnitt 3 ist zum Beispiel eine Magnetplatteneinheit oder eine optische Platteneinheit.
  • Der Formatinformations-Extraktionsabschnitt 4 zieht Formatinformationen, welche die Layoutstruktur und die entsprechende logische Eigenschaft sind, aus dem in dem Dokumenten-Speicherabschnitt 3 gespeicherten vorformatierten Dokument heraus. Kurz gesagt, verschiedene Layoutstrukturen (Seitengröße, Textrahmengröße, Zeicheneigenschaft) und logische Eigenschaften aller Textdaten sind aus den vorformatierten Dokument herausgezogen. Die herausgezogene Formatinformation wird im Formatinformations- Speicherabschnitt 5 abgespeichert.
  • Der Formationformations-Anwendungsabschnitt 6 vergleicht die logische Eigenschaft des Eingangsdokumentes mit der logischen Eigenschaft des vorformatierten Dokumentes. Dann sendet für die Textdaten eines Eingabedokumentes, dessen logische Eigenschaft an die logische Eigenschaft des vorformatierten Dokumentes angepaßt ist, dieser Abschnitt 6 die Textdaten und die logische Eigenschaft des vorformatierten Dokumentes an den Ausgangsdaten- Erzeugungsabschnitt 7.
  • Der Ausgangsdaten-Erzeugungsabschnitt 7 empfängt die entsprechende Seitengröße und Textrahmengröße aus dem Formatinformations-Speicherabschnitt 5. Dann bringt der Abschnitt 7 Seitenbereich und Textrahmenbereich in den Seitenbereich in seinem Speicher. Und alle Textdaten, welche aus dem Abschnitt 6 abgegeben werden, werden entsprechend der Zeicheneigenschaft innerhalb des Textrahmenbereichs angeordnet und redigiert.
  • Der Ausgabeabschnitt 8 ist ein Bildschirmgerät für die Ausgabe des formatierten Dokumentes im Verhältnis zu den Ausgabedaten aus dem Ausgabedaten-Erzeugungsabschnitt 7.
  • Fig. 3 zeigt eine Situation einer Formatanwendung. Unter Verwendung von Fig. 3 wird die vorliegende Erfindung Wie folgt detailliert erklärt. Bei Fig. 3 entspricht die Vorrichtung zum Formatieren eines Dokuments 10 allen Abschnitten (von Abschnitt 1 bis zu Abschnitt 8) in Fig. 8. Zuerst wird das neue Dokument A in die Vorrichtung 10 durch den Eingabeabschnitt 1 eingegeben. Wie vorstehend beschrieben, werden die Textdaten (jeder Satz) des Dokumentes A mit Hilfe des Zeilenvorschubscodes herausgezogen. Und die logische Eigenschaft der jeweiligen Textdaten wird entsprechend der Dokumentenstruktur-Analyseregel bestimmt. Andererseits wird ein vorformatiertes Dokument in dem Dokumenten- Speicherabschnitt 3 abgespeichert. Wenn viele Typen an vorformatierten Dokumenten in Abschnitt 3 gespeichert sind, dann wählt der Nutzer den gewünschten Typ eines vorformatierten Dokumentes über den Eingabeabschnitt 1. Das gewählte formatierte Dokument M wird an den Formatinformations-Extraktionsabschnitt 4 in der Vorrichtung 10 geschickt. Fig. 4A zeigt eine abgespeicherte Datenstruktur eines formatierten Dokumentes.
  • Die Bedeutung der Symbole in Fig. 4A ist Wie folgt:
  • Entsprechend den vorstehend angeführten Regeln 1 - 8 extrahiert der Formatinformations-Extraktionsabschnitt 4 Layoutstruktur und logische Eigenschaft, die in dem formatierten Dokument enthalten sind. Fig. 48 zeigt das erweiterte formatierte Dokument auf dem Bildschirm entsprechend den abgespeicherten Daten in Fig. 4A. Kurz gesagt, der Formatinformations-Extraktionsabschnitt 4 ist in der Lage, Layoutstruktur und logische Eigenschaft aus den abgespeicherten Daten selbst zu extrahieren, ohne sie zu erweitern.
  • Fig. 5 zeigt ein Flußbild des durch Abschnitt 4 verwendeten Extraktionsprozesses. Zuerst extrahiert der Abschnitt 4 zum Vergleich mit dem empfangenen formatierten Dokument (Schritt S1) die erste Seitengröße unter Verwendung der vorstehend angeführten Extraktionsregel 1 (Schritt S2). Dann wird die extrahierte Seitengröße (PX1, PY1) mit Seitennummer 1 in dem Formatinformations-Speicherabschnitt 5 abgespeichert (Schritt S3). Zweitens extrahiert zum Vergleich mit der bei Schritt S2 extrahierten Seite der Abschnitt 4 die erste Textrahmengröße unter Verwendung der vorstehend erwähnten Extraktionsregel 2 (Schritt S4). Und es Wird die Verbindungsinformation (NULL) unter Verwendung von Extraktionsregel 3 und 4 extrahiert. Dann werden der extrahierte Startpunkt (FX1-1), FY1-1), die Breite (XW1-1, YW1-1) und die Verbindungsinformation zur nächsten Textrahmennummer E1-1 in dem Formationformations-Speicherabschnitt 5 gespeichert (Schritt S5). Drittens findet, Wieder im Vergleich mit dem bei Schritt S4 extrahierten Textrahmen, der Abschnitt 4 die ersten Textdaten "DTP SYSTEM" unter Verwendung der Extraktionsregeln 7 und 8. Und der Abschnitt 4 extrahiert logische Eigenschaft und Zeicheneigenschaft unter Verwendung der Extraktionsregeln 5 und 6 (Schritt S6). Dann werden die extrahierte logische Eigenschaft (TITEL) (Überschrift) und Zeicheneigenschaft (GOTISCH, 18, Mitte) in dem Formatinformations-Speicherabschnitt abgespeichert (Schritt S7). Danach findet, Wieder im Vergleich mit dem Textrahmen E1-1, der Abschnitt 4 die zweiten Textdaten "ISAMU IWAI" unter Verwendung der Extraktionsregeln 7 und 8. Und es werden die logische Eigenschaft (AUTHOR) (Verfasser) und die Zeicheneigenschaft (GOTISCH, 18, Mitte) extrahiert. Dieser Extraktionsprozeß (Schritt S6) wird für alle Textdaten im Textrahmen E1-1 Wiederholt (Schritt S8). Danach werden im Vergleich mit Seite 1 die zweite Textrahmengröße (FX1-2, FY1-2), (XW1-2, YW1-2) und die Verbindungsinformation (E1-3) unter Verwendung der Extraktionsregeln 2, 3 und 4 extrahiert. Und, Wieder im Vergleich mit dem Textrahmen E1-2, es werden logische Eigenschaft und Zeicheneigenschaft für alle Textdaten in derselben Weise extrahiert. Dieser Extraktionsprozeß (Schritt 4 - Schritt 6) wird für alle Textrahmen bei Seite 1 Wiederholt (Schritt 9). Schließlich wird, wieder im Vergleich mit dem empfangenen formatierten Dokument, die Größe der zweiten Seite unter Verwendung von Extraktionsregel 1 extrahiert. (Die zweite Seite wird in Fig. 4A und 4B nicht gezeigt). Im Vergleich mit der zweiten Seite werden alle Textrahmen der Reihe nach extrahiert. Dann werden alle logischen Eigenschaften und Zeicheneigenschaften in jedem Textrahmen der Reihe nach extrahiert. Dieser Extraktionsprozeß (Schritt 2 - Schritt 6) wird für alle Seiten bei dem formatierten Dokument Wiederholt.
  • Fig. 6A, 6B und 6C zeigen die Datenstruktur von Layoutstruktur und logischer Eigenschaft, die in dem Formatinformations-Speicherabschnitt 5 abgespeichert ist. In Fig. 6A werden Seitengröße und Textrahmennummer entsprechend der Seitennummer gezeigt. In Fig. 6B werden Textrahrnengröße (Startpunkt, Breite, Verbindung) und logische Eigenschaft entsprechend der Textrahmennummer gezeigt. An dieser Stelle sind die Textrahmen E1-2, E1-3, E2-1 und E2-2 verbunden. Kurz gesagt, Textdaten, deren logische Eigenschaft Kapitel oder Abschnitt ist, sind in den vorstehend erwähnten 4 Textrahmen entsprechend ihrem Inhaltsvolumen angeordnet. Und das Verbindungskennzeichen (*) entsprechend Textrahmen E2-2 bedeutet die Verbindung mit der nächsten Seite. Mit anderen Worten, Fig. 6A und 6B zeigen nur zwei Seiten (P1, P2), aber entsprechend dem Volumen des neuen Eingabedokumentes passiert es, daß eine dritte Seite (P3) gebildet und das Eingabedokument in Seite P1, P2 und P3 untergebracht wird.
  • In Fig. 6C werden die logische Eigenschaft und deren Zeicheneigenschaft (Zeichenart, Zeichengröße, Stellung oder Attribut) gezeigt. Bei Fig. 6A und 6B verkettet die Textrahmennummer Seitengröße mit Textrahmengröße. Bei Fig. 6B und 6C verkettet die Textrahmengröße mit der Zeicheneigenschaft.
  • In Fig. 3 speichert Wieder der Formatinformations-Speicherabschnitt 5 in der Einrichtung 10 Layoutstruktur und logische Eigenschaft so, Wie in Fig. 6A, 6B und 6C gezeigt. Andererseits sendet Textdatenanalyseabschnitt 2 Eingangs-Textdaten und deren logische Eigenschaft an den Formatinformations-Anwendungsab schnitt 6. Demgemäß vergleicht der Formatinformations-Anwendungsabschnitt 6 die logische Eigenschaft mit der in dem Formatinformations-Speicherabschnitt 5 abgespeicherten logischen Eigenschaft. Wie bei Eingabetextdaten, deren logische Eigenschaft mit der abgespeicherten logischen Eigenschaft übereinstimmt, werden Eingabetextdaten und Zeicheneigenschaft, die übereinstimmenden abgespeicherten logischen Eigenschaften entsprechen (wie in Fig. 6C gezeigt), zum Ausgangsdaten-Erzeugungsabschnitt 7 in der Vorrichtung 10 gesandt. Der Ausgangsdaten-Erzeugungsabschnitt 7 empfängt eine entsprechende Seitengröße und Textrahmengröße (wie in Fig. 6A und 6C gezeigt) von dem Formatinformations-Speicherabschnitt 5. Dieser Abschnitt 7 formiert Seitenbereich und Textrahmenbereich in dem Ausgabespeicher (dies ist nicht veranschaulicht). Dann werden die Ausgabetextdaten in dem Textrahmen entsprechend ihrer logischen Eigenschaft angeordnet. Und die Eingabetextdaten werden in Übereinstimmung mit der entsprechenden Zeicheneigenschaft angeordnet. Wenn ein Nutzer nicht mit dem von der Vorrichtung 10 formatierten Dokument einverstanden ist, dann redigiert er es in Übereinstimmung mit seinem gewünschten Format. In Fig. 3 ist es das formatierte Dokument Ma, welches vorn Nutzer redigiert worden ist. Das formatierte Dokument Ma wird anstelle von M in dem Speicherabschnitt 3 für formatierte Dokumente in der Vorrichtung 10 abgespeichert. Kurz gesagt, das letzte von dem Nutzer gewünschte Format wird im Abschnitt 3 gespeichert. Dann wendet, wenn das neue Dokument B eingegeben wird, die Vorrichtung 10 das formatierte Dokument Ma (welches das letzte Format für den Nutzer enthält) für neue Dokumentendaten B an. Deshalb werden die neuen Dokumentendaten B entsprechend dem letzten gewünschten Format angeordnet. Wenn jedoch der Nutzer mit dem neuen formatierten Dokument für die neuen Dokumentendaten B nicht einverstanden ist, dann redigiert er es. In Fig. 3 ist es das formatierte Dokument Mb. Das formatierte Dokument Mb wird anstelle von Ma im Speicherabschnitt 3 abgespeichert. Auf diese Weise wird nacheinander das letzte vom Nutzer gewünschte Dokumentenformat gespeichert.
  • Nun soll unter Verwendung von Fig. 7A, 7B und 8 der Anpassungsprozeß zwischen logischen Eigenschaften des eingegebenen Dokumentes und logischen Eigenschaften des abgespeicherten Dokumentes erklärt werden.
  • Fig. 7A zeigt ein Beispiel für das eingegebene Dokument, und Fig. 7B zeigt die logische Eigenschaft des eingegebenen Dokumentes. Der Formatinformations-Anwendungsabschnitt 6 sucht dieselbe logische Eigenschaft in dem Formatinformations-Speicherabschnitt 5, wie die logische Eigenschaft des eingegebenen Dokumentes. Die logische Eigenschaft der ersten Textdaten beim eingegebenen Dokument ist "Überschrift". Deshalb sucht der Abschnitt 6 "Überschrift" beim Vergleich mit logischen Eigenschaften in dem Speicherabschnitt 5, Wie in Fig. 6C gezeigt. In Fig. 6C ist die erste logische Eigenschaft "Überschrift" passend, und deren Zeicheneigenschaft (gotisch, 18, Mitte) wird Wieder hervorgebracht. Dann werden die ersten Textdaten "DOCUMENT FORMATTING SYSTEM" und Zeicheneigenschaft (gotisch, 18, Mitte) zum Ausgangsdaten-Erzeugungsabschnitt 7 gesandt. Danach ist die logische Eigenschaft der zweiten Textdaten beim eingegebenen Dokument "Verfasser". Deshalb sucht Abschnitt 6 "Verfasser" beim Vergleich mit logischen Eigenschaften in dem Speicherabschnitt 5. Bei Fig. 6C paßt die zweite logische Eigenschaft "Verfasser", und es wird deren Zeicheneigenschaft (gotisch, 14, Mitte) wieder hervorgebracht. Dann werden die zweiten Textdaten "ISAMU IWAI" und deren Zeicheneigenschaft (gotisch, 14, Mitte) zum Ausgangsdaten-Erzeugungsabschnitt 7 gesandt. Auf diese Weise werden alle jeweils eingegebenen Textdaten und deren entsprechende Zeicheneigenschaft zu Abschnitt 7 gesandt. Fig. 8 zeigt die formatierte Ausgabe der Daten des eingegebenen Dokumentes. Entsprechend der logischen Eigenschaften in Fig. 6C sind die Daten des eingegebenen Dokumentes im vom Nutzer begünstigten Format angeordnet.

Claims (9)

1. Dokumentformatiervorrichtung zum automatischen Gewinnen von Layoutstruktur-Information aus einem formatierten Dokument, um ein unformatiertes Dokument zu bearbeiten, mit:
Eingabemitteln (1) zum Eingeben des unformatierten Dokumentes, das eine Anzahl von Textdaten enthält;
Textdaten-Analysemitteln (2) zum Bestuninen der logischen Eigenschaften jeder Textdaten des unformatierten Dokumentes;
Formatinformations-Speichermitteln (3) zum Speichern des formatierten Dokumentes, die eine Anzahl von Textdaten mit Layoutstruktur-Information und den logischen Eigenschaften von jeden Textdaten hat, wobei die Layoutstruktur-Information Seiteninformation, Textrahmeninf ormation und die Zeicheneigenschaften von jeden Textdaten umfaßt und wobei die Seiteninformation, die Textrahmeninformation und die Zeicheneigenschaft von jeden Textdaten in festgelegter Reihenfolge als Datenstruktur des formatierten Dokumentes angeordnet sind;
Formatinformations-Gewinnungsmitteln (4) zum Gewinnen der Seiteninformation, der Textrahmeninformation und der Zeicheneigenschaft von jeden Textdaten aus dem formatierten Dokument gemäß der festgelegten Reihenfolge; und
Formatinformations-Anwendungsmitteln (6) zum Erzeugen mehrerer Textrahmen, die in der Seite enthalten sind, gemäß der Seiteninformation und der Textrahmeninformation zum Anordnen jeder Textdaten des unformatierten Dokumentes in den Textrahmen gemäß der Textrahmeninformation und der logischen Eigenschaft jeder Textdaten des unformatierten Dokumentes, und zum Bearbeiten jeder Textdaten, die in dem Textrahmen angeordnet sind, gemäß der Zeicheneigenschaft entsprechend der logischen Eigenschaften jeder Textdaten des unformatierten Dokumentes.
2. Dokumentformatiervorrichtung nach Anspruch 1, wobei die Seiteninformation Seitengröße und Textrahmennummer umfaßt, deren Textdaten in der Seite durch eine Seitennummer aufgenommen sind, und wobei die Textrahmeninformation die Textrahmengröße und die logische Eigenschaft der Textdaten umfaßt, die in dem Textrahmen in dem Element der Textrahmennummer enthalten sind.
3. Dokumentformatiervorrichtung nach Anspruch 2, wobei die Zeicheneigenschaft den Style, die Schriftart und die Position von jeden Textdaten des formatierten Dokumentes in dem Element der logischen Eigenschaften umfaßt.
Dokumentformatiervorrichtung nach Anspruch 1, wobei die logische Eigenschaft Titel, Autor, Ort, Kapitelüberschrift, Kapitelabsatz, Abschnittsüberschrift und Abschnittsabsatz sind.
5. Dokumentformatiervorrichtung nach Anspruch 1, wobei das Formatinformations-Gewinnungsmittel (4) zuerst die Seiteninf ormation, danach die Textrahmeninformation, die in der Seite enthalten sind, und als drittes die logische Eigenschaft und die zeicheneigenschaft jeder Textdaten, die in dem Textrahmen enthalten sind, aus der Datenstruktur des formatierten Dokumentes gewinnt und die obige Gewinnungsverarbeitung der Reihe nach für die Seiten Wiederholt.
6. Dokumentformatiervorrichtung nach Anspruch 3, weiterhin mit Formatinformations-Speichermitteln (5) zum Speichern der Seiteninformation, der Textrahmeninf ormation, der logischen Eigenschaft und der Zeicheneigenschaft, wobei die Textrahmennummer der Seiteninformationen der Textrahmennummer der Textrahmeninformationen entspricht und wobei die logische Eigenschaften der Textrahrneninformationen den logischen Eigenschaft der zeicheneigenschaften entspricht.
7. Dokumentformatiervorrichtung nach Anspruch 6, wobei das Formatinformations-Anwendungsmittel (6) Seiten gemäß der Seitengröße und mehrere Textrahmen in der Seite gemäß der Textrahmengröße erzeugt, in denen die Textrahmennummer der mehreren Textrahmen mit der Textrahmennummer der Seite korrespondiert.
8. Dokumentformatiervorrichtung nach Anspruch 7, wobei das Formatinformations-Anwendungsmittel (6) mehrere Textdaten des unformatierten Dokumentes in dem Textrahmen anordnet, in denen die logische Eigenschaft des Textrahmens der logischen Eigenschaft der Mehrzahl von Textdaten entspricht, und Zeichen der Mehrzahl von Textdaten gemäß der Zeicheneigenschaft bearbeitet, in denen die logische Eigenschaft der Zeicheneigenschaft der logischen Eigenschaft der Mehrzahl von Textdaten entspricht.
9. Dokumentformatiervorrichtung nach Anspruch 1, wobei das formatierte Dokument vorher von dem Formatinformations-Anwendungsmittel (6) bearbeitet und dann in dem Formatinformations-Speichermittel (3) abgespeichert wurde.
DE69029962T 1989-12-14 1990-12-13 Apparat zum Formatieren eines Dokumentes Expired - Fee Related DE69029962T2 (de)

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
JP01322642A JP3076348B2 (ja) 1989-12-14 1989-12-14 文書整形装置及び文書整形方法

Publications (2)

Publication Number Publication Date
DE69029962D1 DE69029962D1 (de) 1997-03-27
DE69029962T2 true DE69029962T2 (de) 1997-06-05

Family

ID=18145983

Family Applications (1)

Application Number Title Priority Date Filing Date
DE69029962T Expired - Fee Related DE69029962T2 (de) 1989-12-14 1990-12-13 Apparat zum Formatieren eines Dokumentes

Country Status (3)

Country Link
EP (1) EP0433073B1 (de)
JP (1) JP3076348B2 (de)
DE (1) DE69029962T2 (de)

Families Citing this family (4)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
EP1126379A1 (de) * 2000-02-16 2001-08-22 Sun Microsystems, Inc. Umwandlung von direkt zugeordneten Dokumentformatkennzeichen
US6950987B1 (en) * 2001-05-09 2005-09-27 Simdesk Technologies, Inc. Remote document management system
US9411781B2 (en) * 2006-01-18 2016-08-09 Adobe Systems Incorporated Rule-based structural expression of text and formatting attributes in documents
CN104899184B (zh) * 2014-03-04 2019-10-15 腾讯科技(深圳)有限公司 文字处理方法、装置及系统

Family Cites Families (3)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
JPH077410B2 (ja) * 1986-03-29 1995-01-30 株式会社東芝 文書レイアウト方法
JPH0776958B2 (ja) * 1988-01-11 1995-08-16 株式会社東芝 文書整形装置
JPH01205265A (ja) * 1988-02-12 1989-08-17 Toshiba Corp 文書整形装置

Also Published As

Publication number Publication date
EP0433073A2 (de) 1991-06-19
DE69029962D1 (de) 1997-03-27
EP0433073A3 (en) 1993-04-21
JP3076348B2 (ja) 2000-08-14
EP0433073B1 (de) 1997-02-19
JPH03185559A (ja) 1991-08-13

Similar Documents

Publication Publication Date Title
DE69227889T2 (de) Druckersystem für Strichcode
DE3853788T2 (de) Dokumentbildungssystem mit benannten Formaten und Schriftarten.
DE69026885T2 (de) Dynamische Selektion von Datenformaten für rekursiv geschachtelte logische Elemente
DE69737884T2 (de) Textprozessor
DE3850595T2 (de) Dokumentverarbeitungssystem.
DE69126805T2 (de) Datenformatumwandlung
DE69724557T2 (de) Dokumentenanalyse
DE69933404T2 (de) System und Verfahren zum gemeinsamen Benutzen von Fonts und Speichermedium für das Programm zum Ausführen des Verfahrens
DE69427848T2 (de) Unterstützungssystem zur Herstellung von Wörterbüchern
DE3485893T2 (de) Verfahren und einrichtung zum automatischen erhalten von zeichenzwischenraeumen waehrend der satzaufbereitung.
DE68923569T2 (de) Verfahren und Apparat zum Formatieren eines Dokumentes.
DE19627472A1 (de) Datenbanksystem
EP1353276A2 (de) Drucken mit variablen Daten unter Verwendung einer dynamischen Ausschiessvorlage
DE68924606T2 (de) Dokumentenbildverarbeitungsgerät.
DE69405622T2 (de) Vorrichtung zur Anpassung einer Benutzerschnittstelle
DE10105941A1 (de) System und Verfahren zum automatischen Zuweisen eines Dateinamens zu einem gescannten Dokument
DE10162418A1 (de) System zur Verarbeitung strukturierter Dokumente, damit sie sich zur Ablieferung über Netzwerke eignen
DE60310881T2 (de) Methode und Benutzerschnittstelle für das Bilden einer Darstellung von Daten mit Meta-morphing
DE69628735T2 (de) Bildverarbeitungsgerät und programmspeichermedium
DE69207184T2 (de) Vorrichtung und verfahren zum automatisierten seitenlayout von text undgraphischen elementen
DE69430413T2 (de) Verfahren und Vorrichtung zur Lösung von Termen einer numerischen Folge
DE10158419A1 (de) Verfahren zum digitalen Drucken von zusammengesetzten Dokumenten
DE69131921T2 (de) Dokumentverarbeitungsverfahren und -gerät
DE602005002835T2 (de) Verfahren zur Identifizierung von redundantem Text in elektronischen Dokumenten
DE10011664A1 (de) Dokumentenanalysesystem und Verfahren zum Analysieren von Dokumenten

Legal Events

Date Code Title Description
8364 No opposition during term of opposition
8320 Willingness to grant licences declared (paragraph 23)
8339 Ceased/non-payment of the annual fee