Bogata reprezentacja Język - Rich Representation Language
Rich Przedstawicielstwo języka , często skracane jako RRL , to animacja komputerowa język specjalnie zaprojektowany w celu ułatwienia interakcji dwóch lub więcej postaci animowanych. Wysiłek badawczy finansowany przez Komisję Europejską w ramach NECA Projektu . NECA (Środowisko netto ucieleśnione emocjonalnych konwersacyjny pełnomocnicy) ramy, w których RRL został opracowany nie był zorientowany w kierunku animacji filmów, ale stworzenie inteligentnych „wirtualnych bohaterów”, które oddziałują w wirtualnym świecie i prowadzić rozmowy z emocjonalnej treści, w połączeniu z odpowiednie mimiki .
RRL był pionierski wysiłek badawczy, który wpłynął na projektowanie innych językach, takich jak gracza Markup Language które rozszerzonych części konstrukcji RRL. Konstrukcja język specjalnie przeznaczone do zmniejszenia szkoleń potrzebnych do modelowania interakcji wielu znaków w wirtualnym świecie i automatycznie generuje większość animacji twarzy , jak również szkieletowych animacji w oparciu o treść rozmów. Ze względu na współzależność niewerbalnej komponentów, takich jak rysy twarzy na wypowiadanych słowach, animacja nie jest możliwe w języku bez uwzględnienia kontekstu sceny , w których animacja ma miejsce - na przykład gniew w stosunku do radości.
Zawartość
Zagadnienia projektowe język
Domena składa wniosek o RRL scen z dwoma lub więcej znaków wirtualnych. Reprezentacja tych scen wymaga wielu rodzajów informacji, takich jak postawy ciała , mimiki , zawartość semantyczną i znaczenie rozmów, itd. Wyzwaniem jest to, że projekt często informacje z jednego rodzaju jest zależny od innego rodzaju informacji, np postawa ciała, wyraz twarzy i semantyczna treść rozmowy muszą koordynować. Przykładem jest to, że w gniewnym rozmowy, semantyka rozmowie dyktować postawy ciała i mimiki w odrębny od którego różni się od radosnej rozmowy. Stąd wszelkie polecenia w języku do kontroli mimiki musi z natury zależy od kontekstu rozmowy.
Różne rodzaje informacji, wykorzystywanych w RRL wymagają różnych form ekspresji w języku, na przykład gdy semantycznej informacje są reprezentowane przez gramatyk składnik mimika wymaga manipulacji graficznej pierwotnych.
Kluczowym celem w projektowaniu RRL była łatwość rozwoju, aby budowa sceny i interakcji dostępny dla użytkowników bez zaawansowanej wiedzy programowania. Ponadto, projekt ma na celu umożliwić przyrostowego rozwoju w postaci naturalnej, dzięki czemu sceny mogłyby być częściowo prototyp, a następnie rafinowany do bardziej naturalnego wyglądu renderingu, np poprzez późniejszym dodatkiem miga lub oddychaniu.
opis sceny
Zapożyczając terminologię teatralny, każda sesja interakcja między syntetycznych znaków w RRL nazywa się scenę . Opis sceny określa treść, czas i emocjonalnych cech stosowanych w obrębie sceny. Specyficzny moduł nazywany logiczne afektywne oblicza emocjonalne prymitywów zaangażowanych w scenie, w tym rodzaj i intensywność emocji, a także ich przyczyn. Afektywne logiczny wykorzystuje wymiary emocji , takie jak natężenie i asertywnoœci.
Chociaż XML jest używany jako format reprezentacji podstawa, sceny opisane są na wyższym poziomie w obrębie ram obiektowego. W tym kontekście węzłów (np obiekty) są połączone za pomocą strzałek lub linki. Na przykład scena jest węzeł górny poziom, który jest powiązany z innymi. Scena może mieć trzy konkretne środki Atrybuty: / Ludzie, którzy biorą udział w tej scenie, przedstawienie dyskursu, który stanowi podstawę do rozmów i historii, która rejestruje relacje czasowe między różnymi działaniami.
Opisy sceny są doprowadzane do modułu generowania języka naturalnego, który wytwarza odpowiednie kary. Generowanie strumienia naturalnego w rozmowie wymaga wysokiego stopnia reprezentacyjnych moc dla elementów emocjonalnych. RRL wykorzystuje system reprezentacji dyskusja oparciu standardowego sposobu odpowiedników i warunków . Afektywnej logiczne dostarcza odpowiednich informacji, aby wybrać słowa i struktury, które odpowiadają konkretnych zdań.
synteza mowy i Emotive markery
Składnik syntezy mowy jest bardzo zależna od semantycznej informacji i zachowanie modułu przypisania gest. Komponent synteza mowy musi działać zanim system przydziału gest, ponieważ zawiera informacje o taktowaniu dla wypowiadanych słów i emocjonalne wykrzykniki . Po interpretacji tekstu języka naturalnego być wypowiedziane, to składnik dodaje prozodycznych struktury takie jak rytm, stresu i intonacji.
Elementy mowy, raz wzbogacone ze stresem, intonację i markerów emocjonalne są przekazywane do systemu przydziału gest. RRL obsługuje trzy odrębne aspekty zarządzania emocjami. Po pierwsze, konkretne tagi emocje mogą być dostarczone do scen i konkretnych zdań. Szereg konkretnych poleceń obsługuje wyświetlania szeroki wachlarz emocji w twarzach animowanych postaci.
Po drugie, nie są wbudowane mechanizmy wyrównywania specyficzne rysy twarzy do emocjonalnych postaw ciała. Po trzecie, konkretne wykrzykniki Emotive takie jak westchnienia, ziewa, chichotów, itp mogą być przeplatane zasięgu działania, aby zwiększyć wiarygodność wypowiedzi postaci.
Przypisanie gest i ruchy ciała
W RRL gest termin ten jest używany w sensie ogólnym i odnosi się do mimiki, postawy ciała i odpowiednie gesty. Trzy poziomy danych są przetwarzane w przypisania gestu
- Przyporządkowanie poszczególnych gestów w scenie do poszczególnych modułów, np „ skręcić biorąc ” są obsługiwane w module generowania języka naturalnego.
- Udoskonalenie i opracowanie przyporządkowania gest po syntezie pierwszego stopnia mowy, na przykład dodanie migać i oddychania rozmowy.
- Interfejs zewnętrznych modułów, które zajmują tynk odtwarzacza specyficzne takie jak MPEG-4 do twarzy parametrów animacji (FAPS).
System przypisanie gest ma specyficzne typy gestów, takich jak ruchy ciała (np wzruszając ramionami jak obojętność vs wiszące ramiona smutku), ruchów charakterystycznych (gesty, które sygnałem konferencyjnym tak / nie), ikony (np naśladując telefon za pomocą palców), deictic (wskazując gesty), kontrast (np z jednej strony, ale z drugiej strony), rysy twarzy (np uniósł brwi, marszcząc brwi, zaskoczenie lub wzrok).