WHISPER

Kto mówi?

Osoba w rozmowie na żywo korzysta ze słuchawki do wsparcia językowego

WHISPER to projekt wsparcia językowego na żywo przez AI dla rozmów między ludźmi, którzy nie mają wspólnego języka.

Cel praktyczny jest prosty: pomóc człowiekowi zrozumieć rozmówcę i odpowiedzieć w języku, którego prawie albo wcale nie zna, pozostając widocznym, słyszalnym i odpowiedzialnym uczestnikiem rozmowy.

Maszyna może dostarczyć język. Człowiek nie powinien zniknąć z rozmowy.

01

Problem

Tłumaczenie może już uczynić zdanie zrozumiałym. Nie oznacza to jeszcze, że rozmowa jest naprawdę twoja.

W rozmowie na żywo nie ma czasu zatrzymać drugiej osoby, otworzyć aplikacji, odbudować kontekstu i wrócić z idealnym zdaniem. Znaczenie, czas, ton i obecność społeczna działają jednocześnie.

Co mogę naturalnie powiedzieć tej osobie właśnie teraz?

Wąski model WHISPER: rozmówca mówi → system interpretuje ograniczony kontekst → proponuje jedną krótką odpowiedź → użytkownik mówi sam.

Projekt jest powiązany z Voiceprint, ale nie jest tym samym. Voiceprint pyta, co musi przetrwać, gdy tekst przechodzi przez język i maszynę. WHISPER przenosi to pytanie do żywego spotkania.

02

Pięć kontraktów pomocy

TRANSLATE ME — człowiek wie już, co chce powiedzieć; AI dokonuje możliwie minimalnego transferu.

LIVE TRANSCREATION — AI przenosi znaczenie, intencję i styl do naturalnej wypowiedzi w języku docelowym.

HELP ME SAY IT — człowiek podaje sens, AI pomaga sformułować naturalne zdanie.

SUGGEST A REPLY — AI proponuje odpowiedź; człowiek decyduje, czy rzeczywiście jest ona jego.

WHISPER — ograniczony kontekst na żywo służy do zaproponowania jednej krótkiej odpowiedzi do natychmiastowego powtórzenia.

To różne poziomy władzy maszyny, a nie wymienne funkcje.

03

Autorstwo i sprawczość

Główne pytanie nie brzmi, czy AI potrafi tłumaczyć. Chodzi o to, co dzieje się z autorstwem, kiedy sam język jest częściowo dostarczany przez maszynę.

Człowiek może nadal mówić własnym głosem i być obecny własnym ciałem, mimo że sformułowanie przyszło z zewnątrz.

W którym momencie pomoc językowa staje się delegowanym autorstwem?

Dlatego opóźnienie, niezrozumienie, zaufanie, wieloznaczność, zależność i poczucie autorstwa są częścią badania.

04

Słuchanie bez stałego nadzoru

Prawdziwa rozmowa nie może zależeć od przycisku nagrywania naciśniętego dopiero po rozpoczęciu wypowiedzi rozmówcy.

Aktualne wymaganie to ciągłe słuchanie tylko wewnątrz jawnie rozpoczętej, ograniczonej sesji — na przykład jednej jazdy taksówką, jednego spotkania lub jednej interakcji usługowej.

ciągłość wewnątrz jawnej sesji ≠ stałe nasłuchiwanie otoczenia

System musi jeszcze nauczyć się, kiedy milczeć, czyja mowa jest istotna, czy odpowiedź jest potrzebna i jak bezpiecznie zawodzić w niejasnej sytuacji.

05

Aktualny status

WHISPER jest aktywnym projektem badawczym i prototypowym, a nie gotowym produktem.

Prace zaczynają się od codziennej komunikacji o niskiej stawce i kontrolowanych testów własnych. Polski jest użyteczną bazą, ponieważ częściowe rozumienie pozwala zauważać błędy. Prawdziwie nieznany język będzie później czystszym testem działania systemu.

Nie ogłaszamy obecnie żadnego stosu technicznego jako ostatecznego ani nie deklarujemy dowiedzionej latencji, dokładności czy użyteczności przed realnymi testami.

Najpierw prototyp. Potem błędy i dowody. Zachować ludzką sprawczość. Dopiero potem definiować WHISPER.

— mark of presence