Proyecto 03 Voz · Inglés y español · Fuentes visibles

Prototipo funcional

Pregunta por voz. Comprueba la fuente. Después, escucha la respuesta verificada.

Graba hasta 15 segundos o empieza con un ejemplo escrito. LinguaVoice muestra la transcripción y el idioma detectado, consulta fuentes aprobadas y mantiene la respuesta visible antes de que decidas crear su versión hablada. Si las fuentes no permiten responder, lo indica sin inventar.

Probar el ejemplo guiado
  • 15 slímite estricto
  • Efímerosin almacenamiento propio
  • Con citaso se abstiene
ENTRADA / AUDIO EN DIRECTO SALIDA / VOZ CON FUENTES

PREGUNTA

RESPUESTA

EN English ES Español FR Français

Una pregunta. Un rastro de evidencia. El mismo idioma en la respuesta.

01 / Sistema en directo

Un recorrido de voz guiado

Una pregunta, desde la entrada hasta la respuesta hablada.

¿Es tu primera vez? Ejecuta el ejemplo sin usar el micrófono. La página te mostrará qué ha ocurrido, qué debes hacer después y qué fuente respalda la respuesta.

Empieza con el ejemplo guiado, graba una pregunta breve o escribe la tuya.
  1. 1 Pregunta o usa el ejemplo En curso
  2. 2 Revisa el texto y el idioma Pendiente
  3. 3 Comprueba la respuesta y la fuente Pendiente
  4. 4 Pulsa Reproducir Pendiente
¿Es tu primera vez?

Ejecuta una pregunta segura en español. No necesitas permiso para usar el micrófono.

Entrada de voz 00:00 / 00:15

Procesamiento puntual y explícito. Al pulsar grabar, aceptas enviar hasta 15 segundos de audio a OpenAI a través de la API del proyecto para transcribirlo. Esta demo no conserva el audio de forma intencionada; no incluyas información confidencial, regulada o sensible.

o escribe la pregunta

Hasta 500 caracteres. Pulsa Control/Command + Intro para enviar. OpenAI procesa la pregunta mediante la API del proyecto para seleccionar fuentes aprobadas; no incluyas información privada ni sensible.

0 / 500

O carga primero una pregunta para revisarla

Salida verificada Visible antes de reproducir

Última pregunta

La transcripción de voz o la pregunta escrita aparecerán aquí.
Idioma pendiente

La respuesta aparecerá aquí con el estado de su evidencia. La voz solo empieza después de que la protección del navegador haya comprobado la respuesta visible.

Paso 4 · Versión hablada

Pulsa Reproducir para enviar a OpenAI exactamente la respuesta breve que ves arriba y crear una voz generada por IA. El audio solo se solicita al hacer clic y esta demo no lo almacena.

02 / Problema

Por qué existe esta interfaz

La voz es cómoda. Las respuestas imposibles de verificar no.

Un bot de voz convencional puede sonar seguro antes de que la persona tenga una forma de comprobar la respuesta. Ese orden no sirve para información de atención al cliente, procedimientos operativos ni conocimiento interno.

LinguaVoice muestra primero la transcripción, la respuesta y las citas. La voz es la última capa de entrega, no un sustituto de la evidencia.

03 / Arquitectura

Un recorrido breve y comprobable

Cuatro etapas. Dos salidas estrictas.

Tanto el tiempo de grabación como la calidad de la evidencia pueden detener el flujo antes de que una respuesta insegura llegue a la voz.

  1. 01

    Capturar

    El permiso empieza con un clic explícito. La grabación del navegador se corta a los 15 segundos y las pistas se cierran de inmediato.

    Audio binario · temporal
  2. 02

    Transcribir

    La API devuelve la transcripción y los metadatos del idioma. Puedes revisar o corregir ambos antes de iniciar la recuperación.

    Texto + metadatos de idioma
  3. 03

    Recuperar

    La pregunta se contrasta con la base de conocimiento del proyecto. El estado de respaldo, las citas y la abstención se devuelven juntos.

    Respuesta · respaldo · citas
  4. 04

    Reproducir

    Solo una acción explícita de Reproducir puede canjear un permiso de corta duración por el audio del texto exacto que ya aparece verificado en pantalla.

    MP3 bajo demanda · permiso de un solo uso

04 / Protecciones

Diseñado para respuestas acotadas

Negarse a inventar es una función.

Cada capa tiene una tarea limitada, un estado visible y una ruta de recuperación.

G1

Puerta de evidencia

Una respuesta solo se muestra como fundamentada cuando la API la marca como respaldada, devuelve citas y no activa la abstención.

G2

Abstención determinista

Si falta cualquier señal de evidencia, el navegador sustituye el texto recibido por una respuesta fija de «evidencia insuficiente».

G3

Renderizado seguro

El texto de la API se inserta como texto, nunca como código ejecutable. Los enlaces de las citas solo aceptan destinos HTTP o HTTPS del mismo sitio.

G4

Audio efímero

No se usa almacenamiento del navegador. Los fragmentos de grabación se eliminan tras transcribirlos; el audio generado solo permanece en la página abierta y su URL temporal se revoca al sustituirlo o cerrar.

G5

Estado comprensible

El permiso, la grabación, la transcripción, la recuperación y la voz se anuncian en una región de estado sin ocultar los controles.

G6

El texto siempre está disponible

Denegar el permiso, no disponer de micrófono o un fallo de voz nunca bloquean la pregunta escrita ni la respuesta visible.

05 / Matriz de pruebas

Distintos perfiles, la misma ruta segura

Escenarios de aceptación integrados en la interfaz.

Estos escenarios describen el comportamiento observable esperado, no métricas ocultas ni afirmaciones de rendimiento.

Perfil / condiciónAcciónResultado esperado
Primera visitaPulsa grabar sin haber dado permiso.El aviso del navegador aparece después del clic; la interfaz explica antes el límite de 15 segundos y la política de almacenamiento.
Micrófono denegadoBloquea o descarta el permiso.Un mensaje recuperable dirige al campo de texto; no hace falta recargar la página.
Pregunta sin respaldoPregunta por información ausente de las fuentes.El navegador muestra una abstención fija en lugar de texto generado sin respaldo. Solo se reproduce si después se pulsa Reproducir.
Persona multilingüeHabla en un idioma reconocido por la transcripción.La transcripción y el idioma se pueden revisar antes de recuperar información. Inglés y español usan fuentes aprobadas; francés, alemán, italiano y portugués devuelven límites seguros fijos, y un idioma no reconocido exige selección manual.
Uso solo con tecladoRecorre los controles de grabación, texto, idioma y reproducción con el tabulador.Los controles nativos conservan foco visible, etiquetas descriptivas y una activación predecible.
Movimiento reducidoActiva la preferencia de movimiento reducido del sistema operativo.La cabecera pasa a una composición estática; la demo funcional no cambia.
Red lenta o sin conexiónUna solicitud falla o agota el tiempo de espera.La última pregunta escrita se puede reintentar desde la memoria de la página; la voz puede volver a grabarse sin conservar audio anterior.
Texto hostil de la APIUna respuesta contiene marcado o una cita con un esquema no web.El contenido se muestra como texto inerte y los esquemas de enlace inseguros no se convierten en enlaces.

06 / Resultado

Lo bastante rápido para conversar.
Lo bastante estricto para trabajar.

LinguaVoice es un patrón reutilizable para recepciones bilingües, asistentes de procedimientos internos y soporte para equipos de campo: voz en los extremos y evidencia en el centro.

Hablar sobre un asistente de voz con fuentes