NO790023L - Fremgangsmaate hvorved det anvendes et digital-computer-system for oversettelse mellom naturlige spraak - Google Patents
Fremgangsmaate hvorved det anvendes et digital-computer-system for oversettelse mellom naturlige spraakInfo
- Publication number
- NO790023L NO790023L NO790023A NO790023A NO790023L NO 790023 L NO790023 L NO 790023L NO 790023 A NO790023 A NO 790023A NO 790023 A NO790023 A NO 790023A NO 790023 L NO790023 L NO 790023L
- Authority
- NO
- Norway
- Prior art keywords
- word
- words
- expression
- source
- sentence
- Prior art date
Links
Landscapes
- Machine Translation (AREA)
Description
Foreliggende oppfinnelse vedrorer en fremgangsmåte for bruk av
en digital computer for oversettelse mellom naturlige språk.
Det er gjort forsok på å bruke digitale computere for oversettelse fra et språk til et annet, dvs. fra et kildespråk til et målspråko Oversettelses-systemene omfatter et programmerbart computersystem sammen med et program for gjennomforing av oversettelsen. De benyttede fremgangsmåter var teoretiske. Den teoretiske språkrnetode for syntaktisk analyse har ikke vært aksep-tabel, fordi den går ut fra lingvistiske antagelser, i stedet for å vurdere den programmerbare digitale computers muligheter og gå los på oversettelsen fra computeren som utgangspunkt.
Ideen orn maskinell oversettelse ble unnfanget av Warren Weaver
og A.D. Booth i 1946. Det er siden gjort en rekke forsok på å finne frem til et maskinelt oversettelsessystem og sette det i drift. Projektene ble rettet mot utvikling av lingvistiske teo-rier som omslutter hele det naturlige språk, for så å gå til computeren med det. Denne fremgangsmåte har uunngåelig sviktet, fordi menneskesinnet ikke kan omslutte et språk i sin helhet.
Her folger et kort resymé av metodene og teorien som ligger til grunn for kjente metoder: "General Analysis Technique" - GAT - (Institute of Languages and Linguistics Machine Translation Research Center, Washington DC, juni 1959, av Peter Torna, redigert av J„A. Mayne) brukte et lingvistisk orientert computerkodesystem. Ad hoc losninger ble innfiort og hele systemet ble begrenset i et hult, begrenset, s. mul at ed Linguistic Coinputcrsystetn" (SLC), .«skrevet i oktai-spiråk og var ikke åpent: for ytterligere forbedringer. Fulcrumteori-metoden ble utviklet fra 1959 til 1967 av Bunker-Ramo Corporation, USA, og rettet seg mot losning av problemene som forekom i en begrenset russisk tekst med en forholdsvis li-ten ordbok. Det ble ikke gjort forsok på å innfore opplosning av ord med flere betydninger; i stedet ble flere betydninger trykt i det utmatede resultat, atskilt med streker.
Et syntaks-system ble utviklet av National Bureau of Standards og Massachusetts Institute of Technology i 1960-1964. Denne metode sviktet, fordi den bare tok hensyn til en begrenset vei til setningen. Dette system ble aldri realisert i storre skala, men bare brukt innenfor et begrenset, eksperimentelt felt.
Transformerende grammatikk var en annen metode. Men denne viste seg fullstendig uforenelig med de krav som stilles av computer-oversettelse. Det er bare utviklet små, eksperimentelle syste-mer på grunnlag av denne teori, og de måtte avbrytes, for noen oversettelse av betydning ble produsert.
Sammenlignet med det som er kjent på området,går foreliggende oppfinnelse ut på å muliggjore noyaktig, hurtig, nesten omgåen-de oversettelse av store tekstmengder fra et kildespråk, d„vs. et naturlig språk, til et annet språk, det s.k. mål-språk„
I stedet for et naturlig språk kan et kunstig språk, som f.eks. Esperanto brukes som kilde- eller mål-språk.
For oppnåelse av dette mål består oppfinnelsen av en fremgangsmåte ved bruk av et programmerbart, digitalt computersystem, hvor de involverte trinn omfatter
a) omdanning av en kildetekst som skal oversettes fra synlige tegn til computer-forståelige, binærkodede signaler; b) lagring av den omdannede kildetekst som skal oversettes,i en hovedlagringsenhet for computersysternet; c) avsoking' og sammenligning av de omdannede kildetekstord med ordboker av kildespråkord, lagret i, en lagringsenhet og for
hvert kildetekstord som det blir funnet; et sidestykke til, lagring i et kartotek i hovedlagringsenheten av hvert ord
og (sic) i tilknytning til hvert slikt ord, lagring av kodet informasjon, utledet fra ordboken, til bruk ved oversettelsen av ordet, hvorved den kodede informasjon omfatter lagringsenhets-forskyvningsaddresseledd til en lagringsenhet i computersystemet, hvor grammatikk og målspråk-oversettelser for ordet er lagret;
d) analysering av de omdannede kildetekstord i ordkatoteket,
en fullstendig setning av gangen, og omdanning av denne til
en setning i målspråket ved bruk av den kodede informasjon og omfattende folgende trinn
1) bruk av lagringsenhets-forskyvningsaddresseledd for oppnåelse av målspråkoversettelsene for ord fra en lagringsenhet og 2) omordning av målspråkoversettelsen til korrekt mål-språksekvens, e) omdanning av målspråksekvensen fra computerforståelige, binærkodede signaler tilbake til synlige tegn,
f) utskrivning på målspråket.
Fremgangsmåten omfatter på en fordelaktig måte et trinn, hvor
en spesiell underrutine for oppslagningsprosessen i ordbok avsoker en liste av ord (leksikal liste) for bestemmelse av.hvilke ord som krever innforing av en spesiell leksikal underrutine i ordbok-kartoteket og et separat leksikalt kontrollprogramm analyserer ordene i kildespråkets setning etter de tilfelle, hvor bare resultatene av den syntaktiske/semantiske analyse av setningen eller tilhorigheten av et ord i en grammatikalsk eller semantisk klasse kan bestemme om en leksikal under-rutine må
tas i bruk på tidspunktet for oversettelsen av et spesielt ord
eller uttrykk, for bestemmelse av meningen av dette ord eller uttrykk ved undersøkelse av de syntaktiske relasjoner som er blitt etablert for nevnte ord eller uttrykk og bruk av syntaktiske og/ eller semantiske regler som gjelder bare det ord eller den ord-klasse ordet horer til.
Det er med fordel sorget for en fremgangsmåte for losning av semantiske flertydigheter, hvor hvert ord i stammeordboken (enkelt-ord) er tildelt et enestående begrenset semantisk (LS) tall,
og de spesialiserte fler-ord uttrykk av LS sammensetningsordbo-ken (LS-uttrykk) som er sammensatt av LS tallhenvisningen for de enkelte ord i stammeordboken, deretter automatisk grupperes til en ordbok-opptegnelse etter uttrykkets hovedord, hvorved det foreligger en for hvert enestående hovedord, hvorpå opptegnelsen siden avsokes for hver gang hovedordet forekommer i den setning som skal oversettes, for bestemmelse om det eksisterer et sidestykke av umiddelbart foregående eller etterfolgende ord i teksten og noen av uttrykkene i opptegnelsen, hvorved den lengste form for sidestykke eller uttrykket ; med hoyest prioritet brukes for å bestemme den spesielle mening med denne ordgruppe, som skiller seg fra summen av meningen, av de enkelte ord; en det mengde av et LS uttrykk er det betingede begrensede semantiske (CLS) uytrykk, som tillater innbefatning av alle definerbare syntaktiske og semantiske regler, likesom enkle programmerings-instrukser som kan benyttes for å forandre den informasjon som er lagret i bits og bytes av setningsanalyseområdetp i selve LS uttrykket (dvs. i ordboken), slik at'ordboks-uttrykket bare
er gjengitt med sitt sidestykke, når de syntaktiske og/eller semantiske betingelser uttrykt i regelen/reglene tilsvares'av ordet/ordene i teksten, hvorved dette faktum bare kan bestemmes etter en fullstendig syntaktisk og semantisk analyse av setningen utfort av de lingvistiske analyseprogrammer.
Ved fremgangsmåten kan alle kildespråkord med fordel forsynes
med semantiske kategorikoder i et variabelt lengdeformat, som deretter utsporres av kildespråk-analyseprogrammene, de leksikale rutiner og CLS ordbok-oppslagningsrutinene som hjelp for losning av semantiske flertydigheter; disse koder er uttrykt i en hierarkisk systematikk (sett av tre-strukturer) på en slik måte at kodingen av en kategori som eksisterer på et lavere nivå av et semantisk tre genererer automatisk koding av de passende koder på hoyere nivå' av selve systemet.
Oppfinnelsen omfatter en fremgangsmåte for drift av en digital computer for oversettelse fra et naturlig kl.ldespråk, f...eks. russisk, til et naturlig målspråk, f.eks. engelsk. Fremgangsmåten omfatter tre faser. Odbok-oppslagningsfasen fastsetter målspråkets betydning av hvert ord eller uttrykk i kildeteksten. Denne ordbok-oppslagningsfase tilfbyer grammatikalske koder og målspråk-ekvivalenter til hvert ord og uttrykk i kildespråket. Den syntaktiske analysefase identifiserer syntaktisk informasjon på basis av den grammatikalske informasjon sorn er foyd til ordene og uttrykkene og utnytter også boyningen av ordet og ordet3 stil-ling i kildeteksten. Syntesefasen tar betydningen og den syntaktiske informasjon av alle ord i en setning i kildeteksten og former en setning i målspråket.
Spesielt begynner fremgangsmåten ved at kildeteksten mates inn
i lagringsenheten for en computer. Hvert kildetekstord blir deretter omdannet i et forvandlet kildetekstord. Det forvandlede kildetekstord består av kildetekstordet og kodet informasjon.
Den kodede informasjon kan omfatte et lagringsenhets-addresse-ledd som gir atkomst til en lagringsenhets-plass som inneholder syntaktisk informasjon og oversettelse for kildetekstordet. De forvandlede kildetekstord som utledes av en kildetekst-setning syntetiseres deretter til en målspråkoversettelse av setningen. Syntesen etablerer korrekt både ordets betydning og ordets stil-ling i målspråkets setning.
Et viktig aspekt av- oppfinnelsen er den separate behandling som gis hoyfrekvente ord i motsetning til lavfrekvente ord. For å maksimere den effektive kapasitet av kjernelagringsenheten for computeren, bærer de lavfrekvente ord sin oversettelsesinforma-sjon med seg, mens hvert hoyfrekvent ord bærer et lagringsenhets-forskyvningsaddresseledd, som gir enkel adgang til dets overset-telsesinf ormas jon som er lagret i kjernelagringsenheten. Slik blir oversettelsesinformasjonen for ofte brukte ord holdt på et lett. tilgjengelig sted i computeren, i stedet for sammen med hver forekomst av ordet, slik det gjores for lavfrekvente ord.
Mens den ovenfor gitte beskrivelse avbilder en menneskelig ana-logi av hvordan oppfinnelsen funksjonerer, skal bemerkes at den faktiske drift av prosessen med computeren er helt forskjellig. Fra det oyeblikk kildeteksten orndarjnes til maskin-lesbare inngangsdata, inntil det tidspunkt, da de maskin-lesbare utgangs-data omdannes til en vanlig lesbar oversettelsestekst, gjennom-føres prosessen under styring av et computerprogram. Mens det er beleilig å beskrive programmets trinn, som om de ble utfort av en menneskelig oversetter, skjer i realiteten intet slikt. Computeren utforer tvert om en rekke automatiske, abstrakte, mate-matiske operasjoner med de abstrakte verdier som er lagret i computerens lagringsenhet. Programmet funksjonerer uavhengig av betydningen eller vekten av de data som det arbeider med. Det forhold at programmet er utformet i et programmeringsspråk på hoyt nivå, som tilsynelatende lar programmet gi signifikans til maskinoperasjonen, endrer ikke det faktum at maskinen faktisk gjennomforer en rekke abstrakte trinn, som intet har å gjore med oversettelse mellom naturlige språk. Hvis en annen slags informasjon ble matet inn i computeren, kunne programmet som benyttes .ifolge oppfinnelsen, muligens utfore en funksjon som er fullstendig annerledes enn oversettelse.
Oppfinnelsen omfatter også den prosess ved hvilken informasjon trekkes ut fra computeren, inklusive utskrivning av informasjonen, dvs. det trinn som omdanner målspråksekvensen fra computerles-bare binærkodede signaler tilbake til synlige tegn.
Det er en stor fordel at ethvert kildespråk ved hjelp av foreliggende oppfinnelse kan oversettes til et målspråk ved bruk av den foreslåtte fremgangsmåte og ved bruk av samme utstyr, ganske enkelt ved at de språkavhengige deler av utstyret, som ordboker og lingvistiske programmer som inneholder alle syntaktiske og semantiske regler for begge språk skiftes ut.
En annen fordel ved fremgangsmåten ifolge oppfinnelsen er den konsekvente oversettelse, dvs. et bestemt uttrykk oversettes fra kildespråket til målspråket med samme kontekst; skifter konteks - ten, vil oppfinnelsen folgelig fore til at uttrykkets betydning skifter med ovennevnte konsekvens. Det er også en fordel at alle syntaktiske og semantiske trekk ved kildespråket gjenkjennes og reflekteres i målspråket.
Spesielle utforelseseksempler av oppfinne!sen skal nå "beskrives under henvisning til tegningene,hvor
fig. 1 illustrerer oversettelsesbehandlingen,
fig. 2 viser et skjema for ordbokoppslagningen og fig. 3 viser et skjematisk sammendrag av programmer.
Som vist i fig. 1 mates tekster inn i oversettelsessystemet enten on-line, via en terminal eller off-line, via tast-til pla-te, eller tast-til-båndanordninger. (Innmating via punchkort er også mulig.) Den innmatede tekst og oversettelses-ordbokene og programmene fins på platekartotek som er tilgjengelige for computeren som utforer oversettelsen. Resultatene skrives deretter ut i det onskede format på skriveren etter
at skriveren har tatt hensyn til eventuelle formatkoder i den innmatede tekst.
Etter-redigering av den utmatede tekst og eventuelt resulteren-de ordbok-ajourfbring kan, om onsket, finne sted via on-line gjensidig påvirkbar terminal (eller kan utfores off-line av etter-redaktorer og ordbok-koder).
Diagrammer og tabeller som må inngå i samme form i det oversatte utgangsmateriale, kan opptas i teksten via en fotokompo-sisjonsanordning.
Fig. 2 illustrerer det program som mater inngangsteksten i computerens lagringsenhet (LØADTXT), identifiserer de høyfrekvente ord og uttrykkene i teksten og gir hvert ord i teksten et eget serienummer. Det tilfoyer umiddelbart en oversettelse til uttrykkene og sikrer at informasjonen for alle hoyfrekvente ord er umiddelbart tilgjengelig i computerens kjernelagringsenhet under oversettelsesprosessen. De gjenstående (lavfrekvente) ord sorteres deretter i alfabetisk orden for å lette hoved-ordbokoppslagningen (MDL). Hoved-ordbokoppslagningen gir hvert lav-frekvent ord den nodvendige grammatikalske informasjon likesom en kryss-henvisning til opptegnelsen av begrensede fler-ord semantiske (LS ) sammensetninger som inneholder det ordet. Etter hoved-ordbok-oppslagning gjen-sorteres alle. ord i teksten i deres opprinnelige rekkefolge.
Ifolge fig. 3 styrer programmet INITCALL den faktiske overset-telsesprosess. Det anroper forst programmet GETSENTN, som etablerer et setningsanalyseområde i computerens lagringsenhet, bestående av 160 bytes informasjon med fast lengde for hvert ord, med kryssreferanser til ytterligere informasjonsområder med informasjon av variabel lengde»
Forst inneholder setningsanalyseområdet bare ordbok-informasjonen for hvert ord. Under oversettelsesprosessen, tilfoyes ytterligere informasjon av kildespråk-analyseprogrammene (betegnet som "tilpasninger"), som loser syntaktiske og semantiske flertydigheter, etablerer setningsgrenser, beskriver grunnleggende, syntaktiske relasjoner mellom ord, identifiserer subjekt/predikat-forhold og analyserer eventuelle preposisjoners funksjon.
Begrenset semantisk (LS) og betinget begrenset semantisk (CLS) ordbok-oppslagning finner sted på passende steder i analysen, hvorved betinget begrenset semantisk oppslagning bare er mulig etter at hele setningen er blitt analysert.
De gjenstående fire trinn, som syntetiserer målspråket på grunnlag av den totale informasjon i setningsanalyseområdet, er: oversettelse av preposisjoner, losning av ord-spesifikke pro-blemer ved hjelp av leksikale rutiner, den egentlige syntese av målspråkordene og omredigeringen av setningen til korrekt ord-rekkefolge i målspråket.
Siste trinn i oversettelsesprosessen er utskriving av det oversatte utgangsmateriale ved program TRPRINT.
Claims (1)
1. Fremgangsmåte for oversettelse mellom naturlige kilde-og målspråk ved bruk av et programmerbart, digitalt computersystem,karakterisert vedfolgende trinn: a) en kildetekst som skal oversettes omdannes fra synlige tegn til computer-forståelige, binære kodesignaler; b) lagring av den omdannede kildetekst som skal oversettes;i computersystemets hovedlagringsenhet; c) avsoking og sammenligning av omdannede kildetekstord med ordboker for kildetekstord, lagret i en lagringsenhet og lagring av hvert kildetekstord for hvilket et sidestykke er funnet, i et kartotek i hovedlagringsenheten og (sic)i' tilknytning til hvert slikt ord, kodet informasjon utledet fra ordboken til bruk ved oversettelsen av hvert slikt ord, hvorved den kodede informasjon omfatter lagringsenhet-forskyvningsadresseledd til en lagringsenhet i computersystemet, hvor grammatikk og målspråkoversettelser for ordet er lagret; d) analysering av de omdannede kildetekstord i ordkatoteket, en fullstendig setning av gangen, og omdanning av samme til en setning i målspråket ved bruk av den kodede informasjon og inklusive folgende trinn: 1) utnyttelse av lagringsenhets-forskyvningsadresseleddene for oppnåelse av målspråk-oversettelsene av ord fra lagringsenheten og 2) omredigering av målspråkoversettelsen til den korrekte ordrekkefolge i målspråket; f) utskrivning i målspråket.
2„ Fremgangsmåte som angitt i krav 1,karakterisert vedfolgende trinn: lagring av en ordbok for høyfrekvente kildeord og tilordnede forskyvningsadresseledd, hvorved forskyvningsadresseleddene identifiserer lagringsstedet for grammatikk- og betydningsin-formasjon om kildeordene; lagring av en ordbok for lavfrekvente kildeord i tilknytning til grammatikk-kodebetydninger for hvert ord; et stammeord fra kildespråket sammen med forskyvningsledd identifiserer derved stedet for målspråk- grammatikk-koder^og betydninger; sammenligning av kildespråktekstens ord med de hoyfrekvente ordbokord og etter registrering av likeverd med et ord, lagring av ordet og tilordnet forskyvningsadresseledd sammen i et hoyfrekvens-kartotek; og sammenligning av kildetekstord med de lavfrekvente ordbokord og ved registrering av likhet, lagring av ordet og tilordnede grammatikk-kodebetydninger i et lavfrekvens-kartotek.
3. Fremgangsmåte som angitt i krav 2,karakterisert vedat andre og etterfolgende uttrykks-ord, hvis slike fins, i et kildespråk-uttrykk er lagret i minst en ordbok i lagringsenheten;
hoyfrekvens-ordboken omfatter de forsté ord i uttrykk på kildespråket og i tilknytning til disse adresseledd til andre og et-terfølgende ord i samme uttrykk, som er anbrakt i uttrykks-ordboken, hvorved forste ord og eventuelle etterfolgende ord i et uttrykk har en tilordnet målspråkbetydning lagret i tilknytning til dem; og
under sammenligning med hoyfrekvens-ordboken a) registrering av de ord som er like og er forste ord i et uttrykk; b) utnyttelse av forskyvningsadresseleddene for lokalisering av det eller de ytterligere ord i samme uttrykk, som er anbrakt i samme uttrykks-ordbok; c) sammenligning av' de lokaliserte ytterligere ord i uttrykket med ordene i kildeteksten som folger forste uttrykks-ord for å finne likhet; og d) etter registrering av slik likhet, lagring av forste uttrykks-ord sammen med målspråkets betydning i hoyfrekvens-kartoteket; e) lagring av hvert av andre og etterfolgende uttrykks-ord sammen med et uttrykks-merke i hoyfrekvens-kartoteket, hvorved ut-trykksmerket angir at ordet ikke er forste ord i uttrykket; f) lagring av forste ord i et uttrykk sammen med et merke i hoyfrekvens-kartoteket, hvorved merket angir at ordet er forste ord i et uttrykk; g) under analysering sutvelgelse av målspråkets betydning i tilknytning til et forste uttrykks-ord som oversettelsen av forste og etterfolgende uttrykks-ord.
i
4. Fremgangsmåte som angitt i krav 1, som omfatter lagring av en angivelse i tilknytning til ordene i lavfrekvens-kartoteket om ordene er hovedord og/eller ord som inngår i begrensede semantiske forbindelser;
hvorved slike forbindelser som er lagret i atskilte kartotek, er lagret inneholdende begrensede semantiske tall for hvert hovedord, idet de begrensede semantiske tall angir alle deltagende ord, hvorved de begrensede semantiske tall for deltagende ord er tilknyttet hovedordene i samme rekkefolge som de deltagende ord danner uttrykksforbindelser med hovedordet;karakterisert vedat informasjon under avsokning og sammenligning med ordbokene vedheftes hovedordet ved-rbrende alle sammensatte uttrykk i hvilke hovedordet kan virke som nokkelord i en forbindelse, hvorved den tilfoyde informasjon inneholder enten rekker av begrensede semantiske tall eller en adresse til en hjelpelagringsenhet, hvor slik informasjon er lokalisert, og omfattende de ytterligere trinn at de begrensede semantiske tall som angir en emne-feltkode . til kildeteksten bringes inn i en hovedlagringsenhet fra hjelpelagringsenheten under analyseringen av ordkartoteket, hvis samme sammensatte uttrykk i kildespråket, angitt av de begrensede semantiske tall, har forskjellige målspråk-betydninger, deretter valg av den korrekte betydning av uttrykket, avhengig av emne-feltkoden, hvor oversettelsen finner sted.
5. Fremgangsmåte som angitt i krav 1,karakterisert vedat analysetrinnet omfatter analysering av kildeteksten og plassering av kildespråksetningen i et bestemt område, reservert for dette formål i computer-lagringsenheten, hvorved analysen beveges fra begynnelsen til slutten og fra slutten til begynnelsen av kildespråk-setningen, og angir merker for spesielle relasjoner av setningskonteksten, og at merkene settes ved rutiner i computer-programmet som tilveiebringes som respons på forskjellige språkledd blant ordene; under analysen lagres informasjon til bruk for erindring fra en kildetekst-setning til neste, for å muliggjore oversettelse av de ord som krever styrelse fra foregående setning; under analysen gjores også semantiske og syntaktiske tilpasninger ved at hver kildesetning er tilfoyd kodet informasjon, hvorved tilpasningene gjores fra be gynnelsen til slutten eller fra slutten til begynnelsen, avhengig av kodene som er tilfoyd til de individuelle ord, og av kildespråkets egenart; og under avsokningen, sammenligningen og lagringen blir deler av språkkoder tilfoyd til kildetekstord, slik at de tilfoyde deler av språkkoder brukes under analysen for fordeling til en onsket rutine ved at verdien av språkdelen legges til en fast adresse for gjennomfbring av en analyse; at comuputeren under analysering av kildespråkets ord holder seg a jour med tidligere inntrufne situasjoner ved innstilling av en rekke lagringsenhetsbrytere; hver gang en ny språkdel inntreffer, blir en rekke tidligere innstilte brytere selektivt slått av, mens en. eller flere ytterligere brytere selektivt slås på, hvorved det er en rutine for utsporring av bryterne i en bestemt rekkefolge; under analyse blir hvert ord i setningen også forsynt med bestemt, kodet informasjon om det horer med til en hoved-eller bisetning, det tilfoyes en rutine for å avsoke kildeordene i en slik setning etter predikat(er) og subjekt(er), senere,under analysen blir predikat(er) og subjekt(er) i kildespråket avsokt ved rutiner og tilsvarende merket med koder, hvorved predikat(ene) og subjekt(ene) avsokes av rutinene etter innskutte setninger, som det derved tas hensyn til, idet rutinene bestemmer om det er sporsmål om funksjonen av et komma eller en konjunksjon er å begynne en ny setning, og utforer separat avsokning etter predi-kat (er) og subjekt(er) og avgjor sporsmålet som resultat av denne analyse,hvert kildeord i setningen er forsynt med merker som ut-trykker uavhengighetsrelasjonen mellom alle ord i setningen; samtidig tilfoyes den syntaktiske funksjon til hvert ord i en setning, idet den syntaktiske funskjon uttrykkes i komprimert formved bruk av kodede bits ("bis"), hvorved den syntaktiske analyse fortsetter inntil hvert ord i setningen er tillagt minst en funksjon.
6. Fremgangsmåte som angitt i krav 1,karakterisert vedat en ordbok av emneglossarinformasjon er lagret og inneholder forskjellige målspråkbetydninger for et kildeord i overensstemmelse med forskjellige tekniske emner, inklusive en programrutine i trinnet for undersokelse av hver kildesetning under analysen og for å velge betydninger fra emneord-boken som svarer til det tekniske emne setningen omhandler.
7. Fremgangsmåte som angitt i krav 1,karakterisert vedat kildespråksetningene analyseres i heararkisk rekkefolge, "hvorved en forste tilpasning loser grunnleggende flertydigheter, en andre, etterfolgende tilpasning etablerer primær, syntaktisk gjensidig sammenheng og en tredje, etterføl-gende tilpasning ekspanderer disse gjensidige sammenhenger og avgrenser fraser og setninger, en fjerde, etterfolgende predikat-subjekt-tilpasning avsoker i hierarkisk rekkefolge etter predika-ter og subjekter og loser de gjenstående setningsskille-flertydigheter, og en femte, etterfølgende tilpasning sikrer at hvert ords funksjon i setningen er korrekt registrert*
8„ Fremgangsmåte som angitt i krav 1,karakterisert vedat de syntaktiske hovedtilpasninger anroper ge-neraliserte underrutiner for bestemmelse og koding av syntaktiske relasjoner, og underrutinene anroper i sin tur selektivt mindre underrutiner for utforelse av grunnleggende oppgaver.
9. Fremgangsmåte som angitt i krav' 1,karakterisert vedat et separat program bestemmer og analyserer preposisjonene i kildespråket og bestemmer deres iboende betydning, hvorved betydningen av en preposisjon enten bestemmes av ord som styrer preposisjonen eller av ord som fungerer som preposisjonen, hvorved kodet informasjon for oversettelse av en eller flere preposisjoner foyes til ordene fra ordbokene.
10. Fremgangsmåte som angitt i krav 1,karakterisert vedde trinn at hvert ord analyseres under flere tilpasninger av hver setning, hvorved det tilfoyes koder, vurde-ring av alle koder som tidligere tilpasninger tilføyde til et
ord og tilfoyelse av målspråk-syntesekoder til betydningen som kodefunksjonen har i setningen, plassering av ordet i en form som svarer til målspråket avhengig av analysen og vurderingen av al-le relevante koder som er tilfoyd til ordet, hvorved de oversatte ord formes etter analysering i et utskrivningsområde i en rekkefolge som bestemmes av forholdene mellom kilde- og målspråkene, som tidligere satt opp av tallene som ble gitt etter hvert ord og overforing av oversettelsen, når utskrivningsområdet er fylt, enten direkte eller til en skriver eller til en midlertidig
a hjelpelagringsenhet.
11. Fremgangsmåte som angitt i krav 1,karakterisert vedat den omfatter et trinn, hvor en spesiell under-rutine av ordbok-oppslagningsprosessen avsoker en ordliste (leksikal liste) for å bestemme hvilke ord som krever innforing av en spesiell leksikal underrutine i ordbokskartoteket og hvor et separat leksikalt kontrollprogram analyserer ordene i kildespråkets setning etter de tilfelle, hvor bare resultatene av den syntaktiske/semantiske analyse av setningen eller forekomsten av et ord i en grammatikalsk eller semantisk kategori kan bestemme, om en leksikal underrutine må anropes på tidspunktet for oversettelsen av et bestemt ord eller uttrykk for bestemmelse av betydningen av ordet eller uttrykket ved undersokelse av de syntaktiske relasjoner som er etablert for ordet/uttrykket og utnyttelse av syntaktiske og/eller semantiske regler som bare gjelder dette ord eller den ord-kategori det horer til.
12. Fremgangsmåte som angitt i krav 1 for losning av semantiske flertydigheter,karakterisert vedat hvert ord -i stamme (enkeltord)-ordboken tilfoyes et eget, begrenset, semantisk (LS) tall, hvorpå de spesialiserte fler-ord-uttrykk i LS sammensetningsordbok (LS-uttrykk), sorn er sammensatt av LS tall som representerer de enkelte ord i stammeordboken, automatisk grupperes til en ordbok-angivelse ifolge uttrykkets hovedord, hvorav det foreligger en for hvert enkelt hovedord, hvorpå angivelsene avsdkes- hver gang hovedordet forekommer i setningen som skal oversettes, for bestemmelse om det foreligger likhet mellom en gruppe etter hverandre folgende ord i teksten og et av uttrykkene i angivelsene, hvorved den lengste overensstemmelse eller uttrykket med hoyest prioritet benyttes for bestemmelse av den spesialiserte betydning av nevnte ord-gruppe, som atskiller seg fra summen av betydningene av de enkelte ordj en delmengde av et LS uttrykk er det betingede, begrensede, semantiske (CLS) uttrykk som tillater inkludering av alle bestembare syntaktiske og semantiske regler, likesom enkle programmerings-instrukser,
som kan brukes til å forandre den informasjon som er lagret i bits og bytes i setningsanalyseområdet, i selve LS uttrykket (dvs. i ordboken), slik at ordboks-uttrykket bare tilsvares, når de syntaktiske og/eller semantiske betingelser som er uttrykt, i regelen/reglene er tilfredsstilt ved ordet/ordene i teksten, hvorved dette forhold bare kan bestemmes etter en fullstendig syntaktisk og semantisk analyse av setningen, utfort av de lingvistiske analyseprogrammer.
13»Fremgangsmåte som angitt i krav 1,karakterisert vedat alle kildespråkord kan forsynes med semantiske kategorikoder i et variabelt lengdeformat, som deretter utsporres av kildespråk-analyseprogrammene, de leksikale rutiner og CLS ordbok-oppslagningsrutinene til hjelp ved losning av semantiske flertydigheter; disse koder er uttrykt i en hierarktisk systematikk (sett av tre-strukturer) på en slik måte at kodingen av en kategori som eksisterer på et lavere nivå av et semantisk tre genererer automatisk koding av de passende koder av hoyere nivå av selve systemet,,
14. Fremgangsmåte som angitt i krav 1,karakterisert vedat den omfatter analysering av en rekke ord i folge i kildespråket innenfor fraser og setninger i relasjon til målspråk-ordsekvensen, hvorved målspråk-ordsekvensen uttrykkes symbolsk ved tilfoyde tall og at oversettelsen skrives ut under hensyntagen til hvert kildeord.
Applications Claiming Priority (1)
| Application Number | Priority Date | Filing Date | Title |
|---|---|---|---|
| US06/176,672 US4706212A (en) | 1971-08-31 | 1971-08-31 | Method using a programmed digital computer system for translation between natural languages |
Publications (1)
| Publication Number | Publication Date |
|---|---|
| NO790023L true NO790023L (no) | 1980-07-07 |
Family
ID=22645355
Family Applications (1)
| Application Number | Title | Priority Date | Filing Date |
|---|---|---|---|
| NO790023A NO790023L (no) | 1971-08-31 | 1979-01-04 | Fremgangsmaate hvorved det anvendes et digital-computer-system for oversettelse mellom naturlige spraak |
Country Status (9)
| Country | Link |
|---|---|
| BR (1) | BR7900395A (no) |
| DD (1) | DD143667A5 (no) |
| DK (1) | DK5679A (no) |
| ES (1) | ES476944A1 (no) |
| FI (1) | FI790036A7 (no) |
| IL (1) | IL56396A0 (no) |
| IT (1) | IT7919669A0 (no) |
| NO (1) | NO790023L (no) |
| PT (1) | PT69059A (no) |
-
1979
- 1979-01-04 NO NO790023A patent/NO790023L/no unknown
- 1979-01-05 DK DK5679A patent/DK5679A/da not_active Application Discontinuation
- 1979-01-05 FI FI790036A patent/FI790036A7/fi not_active Application Discontinuation
- 1979-01-08 IL IL56396A patent/IL56396A0/xx unknown
- 1979-01-10 PT PT6905979A patent/PT69059A/pt unknown
- 1979-01-17 ES ES476944A patent/ES476944A1/es not_active Expired
- 1979-01-22 BR BR7900395A patent/BR7900395A/pt unknown
- 1979-01-26 IT IT7919669A patent/IT7919669A0/it unknown
- 1979-03-09 DD DD79211497A patent/DD143667A5/de unknown
Also Published As
| Publication number | Publication date |
|---|---|
| ES476944A1 (es) | 1979-07-16 |
| IL56396A0 (en) | 1979-03-12 |
| IT7919669A0 (it) | 1979-01-26 |
| PT69059A (en) | 1979-02-01 |
| FI790036A7 (fi) | 1980-07-06 |
| DD143667A5 (de) | 1980-09-03 |
| DK5679A (da) | 1980-07-06 |
| BR7900395A (pt) | 1980-09-09 |
Similar Documents
| Publication | Publication Date | Title |
|---|---|---|
| EP0012777A1 (en) | Method using a programmed digital computer system for translation between natural languages | |
| EP1111514B1 (en) | Phrase translation method and system | |
| US7707026B2 (en) | Multilingual translation memory, translation method, and translation program | |
| EP0686286B1 (en) | Text input transliteration system | |
| US5005127A (en) | System including means to translate only selected portions of an input sentence and means to translate selected portions according to distinct rules | |
| US5136504A (en) | Machine translation system for output of kana/kanji characters corresponding to input character keys | |
| JPH03185561A (ja) | 欧文単語入力方法 | |
| JPS6211932A (ja) | 情報検索方法 | |
| US5608623A (en) | Special cooccurrence processing method and apparatus | |
| Hughes et al. | Automatic extraction of tagset mappings from parallel-annotated corpora | |
| NO790023L (no) | Fremgangsmaate hvorved det anvendes et digital-computer-system for oversettelse mellom naturlige spraak | |
| NO319431B1 (no) | Fremgangsmate og anordning for oversettelse av informasjon | |
| Macklovitch | Two types of translation memory | |
| Rapp | A Part-of-Speech-Based Search Algorithm for Translation Memories. | |
| JP2006024114A (ja) | 機械翻訳装置および機械翻訳コンピュータプログラム | |
| Hurskainen | SALAMA | |
| JP2994080B2 (ja) | 訳語選択方式 | |
| Ekbal et al. | Named entity transliteration | |
| Hurskainen | Linguistics cannot be omitted in machine translation | |
| Samantaray | Example based machine translation approach for Indian languages | |
| Briskilal et al. | Multilingual PDF Translation using IndicTrans2 | |
| Mathews et al. | German sentence recognition. | |
| JPH04209068A (ja) | データベース検索方法 | |
| Quah | Computer-Aided Translation Tools and Resources | |
| KR19990071163A (ko) | 연어 정보를 이용한 원시언어의 목적언어로의언어번역장치 및방법 |