SAMPA - SAMPA

Den sampa ( SAMPA ) er en computer-læsbar lydskrift hjælp 7-bit printable ASCII karakterer, baseret på internationale fonetiske alfabet (IPA).

Det blev oprindeligt udviklet i slutningen af ​​1980'erne til seks europæiske sprog af EF ESPRIT's program for forskning og udvikling af informationsteknologi. Så mange symboler som muligt er blevet overtaget fra IPA; hvor dette ikke er muligt, bruges andre tilgængelige tegn, f.eks. [ @] for schwa (IPA [ə] ), [ 2] for vokallyden, der findes på fransk deux (IPA [ø] ), og [ 9] for vokallyden findes på fransk neuf (IPA [œ] ).

I dag, officielt, er SAMPA blevet udviklet til alle lyde fra følgende sprog:

Tegnene [ "s{mp@] repræsenterer udtalen af ​​navnet SAMPA på engelsk, med det oprindelige symbol ["], der angiver primær stress. Ligesom IPA er SAMPA normalt omsluttet af firkantede parenteser eller skråstreger , som ikke er en del af det korrekte alfabet og blot angiver, at det er fonetisk i modsætning til almindelig tekst.

Funktioner

SAMPA blev udviklet i slutningen af ​​1980'erne i Europa -Kommissionen -finansierede ESPRIT -projekt 2589 "Speech Assessment Methods" (SAM) -derfra "SAM fonetisk alfabet" -for at lette udveksling af e -maildata og beregning af transskriptioner inden for fonetik og taleteknologi.

SAMPA er en delvis kodning af IPA . Den første version af SAMPA var foreningen af ​​sæt fonemkoder for dansk, hollandsk, engelsk, fransk, tysk og italiensk; senere versioner udvidede SAMPA til at dække andre europæiske sprog. Da SAMPA er baseret på fonembeholdninger, er hver SAMPA -tabel kun gyldig på det sprog, den blev oprettet til. For at gøre denne IPA- kodningsteknik universelt anvendelig, blev X-SAMPA oprettet, som giver en enkelt tabel uden sprogspecifikke forskelle.

SAMPA blev udtænkt som et hack for at omgå tekstkodningers manglende evne til at repræsentere IPA -symboler. Når Unicode- understøttelse af IPA-symboler bliver mere udbredt, falder derfor behovet for et separat, computerlæsbart system til repræsentation af IPA i ASCII. Tekstinput er imidlertid afhængig af specifikke tastaturkodninger eller inputenheder. Af denne grund er SAMPA og X-SAMPA stadig meget udbredt i beregningsfonetik og i taleteknologi.

Se også

Referencer

  • Ranchhod, Elisabeth & J. Mamede, Nuno (2002). Fremskridt inden for behandling af naturligt sprog: Tredje internationale konference, PorTAL 2002, Faro, Portugal, 23. – 26. Juni 2002. Proceedings ( Forelæsningsnotater i datalogi ) . (1. udgave). Springer. ISBN  3-540-43829-7 .
  • L. DeMiller, Anna & Rettig, James (2000). Sprogvidenskab: En guide til referencelitteraturen (2. udgave). Biblioteker Ubegrænset. ISBN  1-56308-619-0 .
  • Lamberts, Koen & Goldstone, Rob (2004). Handbook of Cognition . Sage Publications Ltd. ISBN  0-7619-7277-3 .

eksterne links