Polityka audio i głosów
Zasady używania audio, syntetycznych głosów, mikrofonu i zgody użytkownika.
Audio w kursie ma pomagać w rytmie, słuchaniu i wymowie. Alpha musi jasno odróżniać nagrania wzorcowe, syntetyczne głosy, self-check i ewentualne funkcje mikrofonu. Trzeba też oddzielić audio kursu dla ucznia od próbek castingowych głosów.
Syntetyczne audio
Część audio może być syntetyczna i może powstać przez ElevenLabs. Audio kursu widoczne dla ucznia nie jest jeszcze produkcyjnie gotowe: manifesty v0.2 mają stan planned_not_generated, dopóki plik nie zostanie wygenerowany, zahashowany, opisany w receipcie i sprawdzony. Jeśli używany jest głos syntetyczny, tester powinien wiedzieć, że nie zawsze słyszy nagranie człowieka.
Próbki castingowe
Publiczne próbki castingowe już istnieją w public/casting/elevenlabs/audio i są opisane w public/casting/casting-data.json. To syntetyczne próbki ElevenLabs wyłącznie do castingu i porównywania kandydatów głosowych. Te próbki nie są zatwierdzonym audio kursu, nie są produkcyjną wymową dla ucznia i nie zastępują manifestów kursowych.
Metadane castingu używają głównie głosów katalogowych premade albo professional z oznaczeniem zgody jako niewymaganej dla głosu katalogowego. Warianty wrażliwe na podobieństwo, osobę realną albo głos Jadzi muszą pozostać zablokowane, jeśli brakuje zgody i praw. Każda próbka, nawet jeśli jest publicznie dostępna jako audition-only, wymaga native QA przed użyciem w lekcji albo ćwiczeniu wymowy.
Głos realnej osoby nie może być klonowany, trenowany ani publikowany bez zgody, prawa do użycia głosu i nie-sekretnego śladu tej zgody w manifeście. Jeżeli zgoda albo licencja jest niejasna, audio ma zostać zablokowane.
Mikrofon i nagrania testera
MVP nie nagrywa ani nie przechowuje głosu testera bez wyraźnej informacji, zgody i wskazania celu. Jeżeli późniejsza wersja doda mikrofon, musi opisać, czy nagranie zostaje lokalnie, czy trafia do serwera, kto je przetwarza i kiedy jest usuwane.
Brak automatycznego wyroku
Ćwiczenia wymowy mogą dawać wskazówki, ale Alpha nie powinna karać testera za wymowę na podstawie czarnej skrzynki. Brak punktacji automatycznej albo self-check ma być nazwany w UI.
Review i dostępność
Audio koreańskie wymaga native review jakości i wymowy przed odtworzeniem uczniowi. Pilot może użyć near-native review tylko jako tymczasowej bramki operatora, a wymowa dla ucznia nadal potrzebuje kontroli koreańskiej. Kurs powinien mieć tryb użycia bez audio albo z tekstową alternatywą tam, gdzie audio nie jest dostępne.

