WHISPER

¿Quién habla?

Una persona en una conversación en vivo usa un auricular para apoyo lingüístico

WHISPER es un proyecto de apoyo lingüístico en vivo para conversaciones entre personas que no comparten un idioma común.

El objetivo práctico es sencillo: ayudar a una persona a entender a su interlocutor y responder en un idioma que conoce poco o nada, manteniéndose como participante visible, audible y responsable.

La máquina puede aportar el lenguaje. La persona no debe desaparecer de la conversación.

01

El problema

La traducción ya puede hacer comprensible una frase. Eso no convierte automáticamente la conversación en tuya.

En una conversación real, significado, tiempo, tono y presencia social actúan a la vez.

¿Qué puedo decirle de forma natural a esta persona ahora mismo?

Modelo estrecho: el interlocutor habla → el sistema interpreta un contexto limitado → propone una respuesta corta → el usuario habla por sí mismo.

WHISPER está relacionado con Voiceprint, pero no es lo mismo: Voiceprint pregunta qué debe sobrevivir cuando un texto atraviesa idiomas y máquinas; WHISPER lleva esa pregunta al encuentro social en vivo.

02

Cinco contratos de ayuda

TRANSLATE ME — la persona ya sabe qué quiere decir; la IA lo transfiere con autoridad mínima.

LIVE TRANSCREATION — la IA transfiere significado, intención y estilo a un habla natural en el idioma de destino.

HELP ME SAY IT — la persona aporta el sentido; la IA ayuda a formular.

SUGGEST A REPLY — la IA propone una respuesta y la persona decide si realmente es suya. WHISPER usa contexto vivo limitado para una respuesta breve e inmediata.

Son distintos grados de autoridad de la máquina, no funciones intercambiables.

03

Autoría y agencia

La cuestión principal no es si la IA sabe traducir, sino qué sucede con la autoría cuando el propio lenguaje es suministrado parcialmente por una máquina.

Una persona puede seguir usando su propia voz y cuerpo aunque la formulación llegue de fuera.

¿En qué momento la ayuda lingüística se convierte en autoría delegada?

Por eso latencia, malentendidos, confianza, ambigüedad, dependencia y autoría percibida forman parte de la investigación.

04

Escuchar sin vigilancia permanente

Una conversación real no puede depender de pulsar grabar después de que la otra persona ya haya empezado a hablar.

El requisito actual es escucha continua solo dentro de una sesión limitada iniciada explícitamente: por ejemplo, un trayecto en taxi, una reunión o una interacción de servicio.

continuo dentro de una sesión explícita ≠ escucha ambiental permanente

El sistema aún debe aprender cuándo callar, qué voz importa, si hace falta responder y cómo fallar de forma segura cuando la situación no está clara.

05

Estado actual

WHISPER es un proyecto activo de investigación y prototipado, no un producto terminado.

El trabajo comienza con comunicación cotidiana de bajo riesgo y pruebas controladas. El polaco sirve como referencia útil porque la comprensión parcial ayuda a detectar errores; un idioma realmente desconocido ofrecerá después una prueba más limpia.

Primero el prototipo. Después los fallos y la evidencia. Preservar la agencia humana.

No se presenta ninguna pila técnica como definitiva ni se afirman resultados de latencia, precisión o utilidad antes de pruebas reales.

— mark of presence