Saltar al contenido
Validación Yoodli
Análisis de audiencias digitales · Validación en fase de circulación

Un espejo analítico para comunicar mejor

Validamos Yoodli: AI Communication Coach con nueve profesionales de 30 a 45 años. Explora la usabilidad, la experiencia de uso y las recomendaciones clave para llevar esta herramienta de inteligencia artificial a entornos laborales.

Ir a los resultados
  • 84,4puntaje SUS medio (0–100)
  • 89%por encima del umbral de 75
  • 9profesionales evaluados
Pantalla de ingreso de Yoodli: acceso con Google, Microsoft o correo, junto a un micrófono sobre fondo azul oscuro
El producto evaluado

Yoodli: un entrenador de comunicación con visión artificial y voz

Una plataforma web de microaprendizaje que analiza en tiempo real el contacto visual, el ritmo del habla, las pausas y las muletillas, y entrega un reporte con transcripción sincronizada al video.

Producto
Yoodli: AI Communication Coach
Autores
Varun Puri y Esha Joshi, desarrollado en el Allen Institute for AI (AI2), Seattle.
Tipo
Web app de microaprendizaje asistido por inteligencia artificial y visión por computador.
Objetivo
Desarrollar habilidades de comunicación verbal y no verbal con ejercicios interactivos, simulaciones de entrevistas y minijuegos de oratoria, con retroalimentación privada.
Audiencia
Profesionales de 30 a 45 años en etapas intermedias y avanzadas de carrera.
Dispositivos
Chrome, Edge y Safari con cámara 720p y micrófono. En móvil: consulta asincrónica de reportes y métricas.
Contacto visualPalabras por minutoMuletillasTranscripción sincronizadaGráficos de radarMinijuegos de 60 s
Panel «Mi aprendizaje» de Yoodli con cuatro juegos de agilidad mental: búsqueda de muletillas, cuente una historia, sin relleno y metáfora
«Mi aprendizaje»: juegos de agilidad mental de 60 segundos, como improvisar metáforas o hablar sin muletillas. Clic para ampliar.

Así se ve en el computadorRecorre las pantallas que los participantes usaron durante la prueba.

Y en el celularLa versión móvil se orienta a consultar reportes; la práctica en vivo está pensada para pantallas de computador.

Inicio de Yoodli en el celular con simulaciones pregrabadas

Inicio y simulaciones recomendadas

Biblioteca de juegos de roles de Yoodli en el celular

Biblioteca de juegos de roles desliza

Reporte compartido de un ensayo con video y transcripción en el celular

Reporte con video y transcripción

Método · enfoque mixto

Evaluar un producto vivo, en los puestos de trabajo reales

Al estar en circulación, Yoodli se evaluó tal como funciona hoy: con la latencia, los navegadores y los periféricos reales de cada participante, sin escenarios de laboratorio.

1

Efectividad técnica de las tareas

Calibración de cámara y micrófono, grabación y consulta de resultados: ¿el procesamiento audiovisual en tiempo real funciona en equipos reales?

Funcionalidad · Navegabilidad

2

Medición estandarizada: escala SUS

Cuestionario de 10 ítems con respuestas de 1 a 5, aplicado tras la interacción. Se convierte en un puntaje de 0 a 100.

Brooke (1996) · Bangor et al. (2008)

3

Comprensión subjetiva del discurso

Pensamiento en voz alta durante las tareas y entrevista semiestructurada de cierre sobre diseño, contenido, confianza algorítmica y privacidad.

Muñoz Jiménez (2023) · Martínez Guzmán y Chávez Maza (2016)

Una sesión de unos 30 minutosCada participante recorrió tres momentos, registrados en audio para su transcripción y codificación temática.

1

Consentimiento y encuadre técnico

Autorización para el tratamiento académico de voz y datos; verificación de conectividad y periféricos.

2

Tareas con pensamiento en voz alta

Simulaciones de entrevistas y minijuegos de elocución, verbalizando impresiones, expectativas y dudas.

3

Entrevista de cierre + SUS

Cinco dimensiones de análisis y medición estandarizada de usabilidad al finalizar.

La muestra: nueve profesionalesLa guía proponía un mínimo de 6 usuarios; se amplió a 9. Toca un participante en la sección de resultados para ver su detalle.

9participantes
36,4años en promedio (rango 30–44)
6·3mujeres · hombres
30 minde duración por sesión

Género

Nivel educativo

Qué se evaluóMatriz de seis características de la experiencia interactiva.

FuncionalidadNavegabilidadDiseño visual y sonoroEstructura del contenidoExperiencia de usuarioUsabilidad
Resultados cuantitativos

Una respuesta sobresaliente en usabilidad

La escala SUS convierte diez afirmaciones en un puntaje de 0 a 100. Explora los datos: pasa el cursor o toca cada barra, fila y celda.

84,4sobre 100 · escala SUSBueno · umbral de Excelente

Supera con holgura la meta de 75 puntos

La media muestral (n = 9) es 84,4, con desviación estándar de 11,7 e intervalo de confianza del 95 % entre 75,4 y 93,4. Cinco participantes puntuaron en rango Excelente, tres en Bueno y uno en Marginal.

89%8 de 9 alcanzó o superó los 75 puntos
+13puntos con cámara web operativa (88,8 vs 75,8)
87,5mediana del puntaje SUS
97,5puntaje más alto (mínimo: 60,0)

Puntaje SUS por participante

Toca una barra para ver el perfil y las respuestas de cada persona.

Ver como tabla

¿Quién puntuó más?

SUS medio por segmento. La barra fina muestra el rango mínimo–máximo dentro del grupo.

La línea vertical marca la meta de 75 puntos; la línea inferior de cada barra muestra el mínimo y el máximo del grupo. Los subgrupos tienen entre 2 y 6 casos: las diferencias son descriptivas y no implican causalidad.

Ver como tabla

Los diez ítems de la escala

Mayor aprobación: el ítem 7 (colegas aprenderían rápido, 4,78/5) y el 5 (funciones bien integradas, 4,67). Mayor margen de mejora: la facilidad de uso (ítem 3, 3,67) y el deseo de uso frecuente (ítem 1, 4,11).

Ver como tabla

Funcionalidad técnica en equipos reales

Detección de periféricos, precisión de la transcripción y alertas en tiempo real.

100%9 de 9

Micrófono reconocido

Éxito total, sin configuraciones técnicas complejas.

66,7%6 de 9

Cámara web activada

U2 y U3 con fallas de hardware; U4, bloqueo por permisos del navegador.

U1U2U3U4U5U6U7U8U9
3 de 3 no percibieron las alertas (33 % de la muestra)

Alertas en tiempo real

U7, U8 y U9 no las vieron; falta verificar si dependen de la versión gratuita o del ejercicio.

Fidelidad de la transcripción estimada por U1–U6: 90 % a 98 %

U7, U8 y U9 la calificaron como muy precisa, incluidas pausas, puntuación y tildes. Único error reportado: un apellido propio.

Matriz de respuestas SUS

Cada celda es la respuesta bruta (1–5). El color indica cuánto aporta al puntaje: más oscuro, mejor. En los ítems marcados con (−) responder «1» es lo deseable.

Aporta pocoAporta mucho

Resultados esperados vs. resultados obtenidos

Metas planteadas antes de la validación.

Usabilidad percibida: SUS ≥ 75/100

Media de 84,4 y ocho de nueve participantes por encima del umbral.

Cumplida

Finalización autónoma de tareas > 85 %

Solo pudo aproximarse por la activación de periféricos: micrófono 100 %, cámara 66,7 %.

Parcial

Interpretar 3 métricas en menos de 60 s

La lectura de analíticas no fue cronometrada en los instrumentos aplicados.

No medida
Análisis cualitativo

Lo que dijeron los profesionales

Las entrevistas se codificaron en 62 unidades de significado según su polaridad: comentarios positivos, negativos y observaciones de mejora.

Balance de polaridad

62 unidades en total. Toca un segmento para filtrar los testimonios más abajo.

Distribución por participante

Cada barra suma el 100 % de las unidades de ese grupo.

Ver como tabla

Lo que más valoraron

  • Exactitud de la transcripción textual.
  • Sobriedad estética de la interfaz.
  • Seguridad psicológica de practicar en privado, sin temor al juicio social.

Fricciones prioritarias

  • Ausencia de menús en español.
  • Falta de semaforización en los gráficos de radar.
  • Voces sintéticas de los agentes de IA.

Oportunidades emergentes

  • Alertas en tiempo real más visibles.
  • Escenarios con contexto latinoamericano.
  • Garantías de confidencialidad para uso corporativo.
8 de 9

Un asistente preparatorio de alto valor, no un reemplazo humano

Ocho participantes coincidieron en que la retroalimentación algorítmica complementa, pero no sustituye, la empatía y el juicio de un mentor o evaluador humano. U7 no se pronunció sobre la sustitución.

Voces de los participantesCitas textuales de las entrevistas, clasificadas por polaridad y dimensión evaluada.

Conclusiones y recomendaciones

Un microentrenador asertivo, listo para hablar español

Yoodli se consolida como una herramienta de alto impacto para la preparación ejecutiva. Para escalar en organizaciones hispanohablantes, estos son los ajustes que proponemos.

Cinco ajustes prioritariosLos que más pesaron en la valoración de los participantes.

Cuatro ajustes complementariosSurgieron al ampliar la muestra con U7, U8 y U9.

Alineación con el objetivo del producto¿Cumple Yoodli su promesa de «retroalimentación privada en tiempo real»?

Seguridad psicológica para la práctica deliberada

La práctica privada eliminó el temor al juicio; U7, U8 y U9 la describieron como cómoda y sin sensación de vigilancia.

Sólida

Conciencia metacognitiva del discurso

Las muletillas y el ritmo visualizados permitieron detectar patrones inconscientes de elocución.

Sólida

Complementariedad, no reemplazo humano

Ocho de nueve participantes la ven como preparación previa a la interacción con personas.

Sólida

Retroalimentación en tiempo real

U7, U8 y U9 no percibieron las alertas: el valor provino sobre todo del reporte posterior. Es el punto de menor alineación.

Parcial

Limitaciones del estudio

Hardware y navegador

En 3 de 9 participantes (33 %) la cámara no pudo activarse, lo que anuló el diagnóstico de contacto visual.

Barrera lingüística

Los menús vienen en inglés; traducirlos con el navegador desconfiguró términos y generó demoras.

Métricas sin contexto

Los gráficos de radar muestran porcentajes absolutos, sin indicar el promedio esperado para cada rol.

Alertas no verificadas

No se comprobó si su ausencia obedece a la versión gratuita, a la configuración o a su baja visibilidad.

Tamaño y composición de la muestra

Con n = 9 (6 mujeres y 3 hombres, predominio de perfiles de comunicación y gestión) los resultados son descriptivos y no generalizables; el intervalo de confianza del SUS es amplio.

Cierre
La inteligencia artificial no vino a transformar lo que decimos, sino a darnos un espejo analítico para descubrir cómo lo decimos.

Trabajo de Andrea Monsegny y Carlos Zuluaga
Módulo Análisis de audiencias digitales · Validación de un producto digital en fase de circulación

Referencias bibliográficas
  • Bangor, A., Kortum, P. T. y Miller, J. T. (2008). An empirical evaluation of the System Usability Scale. International Journal of Human-Computer Interaction, 24(6), 574–594. https://doi.org/10.1080/10447310802205776
  • Bermejo Berros, J. (2013). Metodología multidimensional en la indagación del fenómeno complejo del entretenimiento hipermedia. En M. Vicente, T. González, M. Contreras y P. Contreras (Coords.), Investigar la comunicación hoy (pp. 709–724). Universidad de Valladolid.
  • Brooke, J. (1996). SUS: A “quick and dirty” usability scale. En P. W. Jordan et al. (Eds.), Usability evaluation in industry (pp. 189–194). Taylor & Francis.
  • Martínez Guzmán, M. D. y Chávez Maza, D. (2016). Diseño de la Metodología para Validación de la Plataforma Tecnológica REA para la Formación en el Trabajo. Etic@net, 16(2), 282–303. https://doi.org/10.30827/eticanet.v16i2.11925
  • Muñoz Jiménez, A. (2023). Metodología para el estudio de la recepción de contenidos multimedia. Communication & Methods, 5(1), 9–25. https://doi.org/10.35951/v5i1.178
  • Nielsen, J. (1993). Usability engineering. Morgan Kaufmann.
  • Nielsen, J. (1994). 10 Usability heuristics for user interface design. Nielsen Norman Group.
  • Nielsen, J. y Pernice, K. (2010). Eyetracking web usability. New Riders.