SAMPA - SAMPA
Den sampa ( SAMPA ) er en computer-læsbar lydskrift hjælp 7-bit printable ASCII karakterer, baseret på internationale fonetiske alfabet (IPA).
Det blev oprindeligt udviklet i slutningen af 1980'erne til seks europæiske sprog af EF ESPRIT's program for forskning og udvikling af informationsteknologi. Så mange symboler som muligt er blevet overtaget fra IPA; hvor dette ikke er muligt, bruges andre tilgængelige tegn, f.eks. [ @] for schwa (IPA [ə] ), [ 2] for vokallyden, der findes på fransk deux (IPA [ø] ), og [ 9] for vokallyden findes på fransk neuf (IPA [œ] ).
I dag, officielt, er SAMPA blevet udviklet til alle lyde fra følgende sprog:
Tegnene [ "s{mp@] repræsenterer udtalen af navnet SAMPA på engelsk, med det oprindelige symbol ["], der angiver primær stress. Ligesom IPA er SAMPA normalt omsluttet af firkantede parenteser eller skråstreger , som ikke er en del af det korrekte alfabet og blot angiver, at det er fonetisk i modsætning til almindelig tekst.
Funktioner
SAMPA blev udviklet i slutningen af 1980'erne i Europa -Kommissionen -finansierede ESPRIT -projekt 2589 "Speech Assessment Methods" (SAM) -derfra "SAM fonetisk alfabet" -for at lette udveksling af e -maildata og beregning af transskriptioner inden for fonetik og taleteknologi.
SAMPA er en delvis kodning af IPA . Den første version af SAMPA var foreningen af sæt fonemkoder for dansk, hollandsk, engelsk, fransk, tysk og italiensk; senere versioner udvidede SAMPA til at dække andre europæiske sprog. Da SAMPA er baseret på fonembeholdninger, er hver SAMPA -tabel kun gyldig på det sprog, den blev oprettet til. For at gøre denne IPA- kodningsteknik universelt anvendelig, blev X-SAMPA oprettet, som giver en enkelt tabel uden sprogspecifikke forskelle.
SAMPA blev udtænkt som et hack for at omgå tekstkodningers manglende evne til at repræsentere IPA -symboler. Når Unicode- understøttelse af IPA-symboler bliver mere udbredt, falder derfor behovet for et separat, computerlæsbart system til repræsentation af IPA i ASCII. Tekstinput er imidlertid afhængig af specifikke tastaturkodninger eller inputenheder. Af denne grund er SAMPA og X-SAMPA stadig meget udbredt i beregningsfonetik og i taleteknologi.
Se også
- Sammenligning af ASCII -kodninger for det internationale fonetiske alfabet
- SAMPA -diagram
- SAMPA -diagram til engelsk , en kortfattet version
- X-SAMPA , en sproguafhængig notation, der ligner SAMPA, men dækker hele IPA-repertoiret
- BABEL Tale Corpus
Referencer
- Ranchhod, Elisabeth & J. Mamede, Nuno (2002). Fremskridt inden for behandling af naturligt sprog: Tredje internationale konference, PorTAL 2002, Faro, Portugal, 23. – 26. Juni 2002. Proceedings ( Forelæsningsnotater i datalogi ) . (1. udgave). Springer. ISBN 3-540-43829-7 .
- L. DeMiller, Anna & Rettig, James (2000). Sprogvidenskab: En guide til referencelitteraturen (2. udgave). Biblioteker Ubegrænset. ISBN 1-56308-619-0 .
- Lamberts, Koen & Goldstone, Rob (2004). Handbook of Cognition . Sage Publications Ltd. ISBN 0-7619-7277-3 .
eksterne links
- SAMPA computer læsbart fonetisk alfabet
- Fonemisk notation af engelsk i SAMPA
- SAMPA for skotter
- Konverter fra (tysk) skriftlig tekst til SAMPA og IPA (Ajax-applikation)
- IPA-SAMPA-konverter og IPA-SAMPA-diagram