Synthesia, la plataforma de formación corporativa conocida por sus vídeos con avatares de IA, acaba de dar un giro que interesa a cualquier builder: ha lanzado AI Roleplay Sessions, un entorno donde los empleados practican conversaciones reales de trabajo con avatares que responden, puntúan y devuelven analíticas de rendimiento. Según TechCrunch, el objetivo es que las empresas puedan por fin "medir la efectividad de la formación" en lugar de limitarse a reproducir vídeos pasivos.
El dato más relevante para nosotros no es el producto en sí, sino lo que revela: la formación corporativa está pasando del contenido estático a la práctica conversacional evaluada por IA. Y eso es exactamente lo que un builder hispanohablante puede construir hoy con Claude API por una fracción del coste de una plataforma cerrada. En este artículo analizamos qué ha cambiado, qué significa para quien construye con IA y cómo montar un prototipo de coach conversacional en euros y pesos reales.
¿Qué ha cambiado con AI Roleplay Sessions?
Hasta ahora Synthesia era, esencialmente, un generador de vídeos formativos: escribías un guion y un avatar lo narraba. El salto a coaching en vivo introduce tres capacidades nuevas según la fuente original:
- Interacción bidireccional: el empleado habla con un avatar que responde en tiempo real, simulando a un cliente difícil, un candidato o un compañero.
- Scoring automático: la IA puntúa la conversación según criterios definidos (empatía, claridad, manejo de objeciones).
- Analíticas de efectividad: paneles que permiten a RR. HH. medir la mejora a lo largo del tiempo.
El cambio de fondo es filosófico: se pasa de "consumir formación" a "demostrar competencia". Desde nuestra experiencia probando asistentes conversacionales con Claude API, ese scoring cualitativo —evaluar una conversación abierta, no un test de opción múltiple— es precisamente donde los modelos de lenguaje grandes brillan frente a las herramientas de e-learning tradicionales.
¿Qué significa para los builders?
La noticia confirma una oportunidad de mercado: no necesitas ser Synthesia para vender formación conversacional. El núcleo del producto —simular un interlocutor y evaluar la respuesta— se resuelve con un LLM bien orquestado. Un agente de roleplay con Claude puede asumir un personaje, mantener contexto durante toda la sesión y devolver una rúbrica estructurada al final.
Un ejemplo mínimo de la lógica de evaluación con Claude:
import anthropic\nmsg = anthropic.Anthropic().messages.create(\n model="claude-sonnet-4-5",\n max_tokens=1024,\n system="Eres un cliente enfadado. Al final, puntúa 1-10 la empatía del vendedor y justifica.",\n messages=[{"role":"user","content":transcripcion_sesion}]\n)\nprint(msg.content[0].text)Frente a alternativas como GPT-4o o Gemini, Claude destaca en dos cosas útiles para este caso: mantiene un rol coherente durante turnos largos y sigue instrucciones de formato (devolver un JSON con puntuaciones) con muy pocos errores. Para los builders hispanohablantes esto significa que puedes ofrecer a una empresa un simulador de ventas o de atención al cliente en español neutro, entrenado con sus propios guiones, sin depender de una plataforma que factura por asiento.
Si quieres profundizar en esta arquitectura, es justo el tipo de proyecto en el que aprender a construir sobre la API de Claude marca la diferencia entre un prototipo de fin de semana y algo vendible.
¿Cuánto cuesta y está disponible en España y LATAM?
Synthesia opera con planes empresariales de precio bajo demanda, lo que en la práctica excluye a pymes y freelances hispanohablantes. Aquí está la ventaja de construir tu propia solución: el coste variable es el de la API.
Claude Sonnet 4.5, el modelo recomendado para agentes conversacionales, cuesta 3 USD por millón de tokens de entrada y 15 USD por millón de salida. Al cambio actual, eso equivale a unos 2,8 € de entrada y 14 € de salida por millón de tokens; alrededor de 12.000 COP o 55 MXN por millón de tokens de entrada. Una sesión de roleplay de 15 minutos rara vez supera unos pocos miles de tokens, así que el coste por práctica queda en céntimos.
Sobre disponibilidad: Claude API está accesible en España y toda Latinoamérica vía console.anthropic.com, además de Amazon Bedrock y Google Vertex AI, lo que facilita el cumplimiento de residencia de datos en la UE. El límite de contexto de Claude Sonnet 4.5 es de 200.000 tokens, más que suficiente para mantener el historial completo de una sesión de coaching y su rúbrica. Una limitación a tener en cuenta: la voz y el avatar visual no vienen incluidos, tendrías que integrar un servicio de TTS y vídeo aparte si quieres replicar la experiencia audiovisual de Synthesia.
¿Cómo empezar a construir un coach conversacional?
Pasos accionables para un builder que quiera validar la idea esta semana:
- 1. Define la rúbrica primero. Antes del código, decide qué se evalúa (3-5 criterios). Esto va en el
system prompt. - 2. Separa dos roles. Una llamada para que Claude interprete al interlocutor y otra, al cierre, para que evalúe la transcripción. No mezcles actuación y juicio en el mismo turno.
- 3. Estructura la salida. Pide a Claude un JSON con puntuación y feedback para alimentar tus analíticas sin parsear texto libre.
- 4. Añade memoria de sesión. Guarda cada interacción para mostrar progreso, el verdadero valor que RR. HH. quiere ver.
La documentación oficial de Anthropic (docs.anthropic.com) cubre el uso de tool use y salidas estructuradas, claves para el paso 3. Para builders que además quieran orquestar estas piezas con datos internos de la empresa, dar el salto hacia agentes e integraciones con protocolos como MCP es el camino natural.
Conclusión
El lanzamiento de AI Roleplay Sessions de Synthesia no es solo una noticia de producto: es una señal de mercado. La formación corporativa se está midiendo por competencia demostrada, no por horas de vídeo consumidas, y ese es un hueco enorme para builders hispanohablantes que hoy pueden ofrecer con Claude API un simulador en español a coste de céntimos por sesión. Mientras las plataformas cerradas facturan por asiento y en inglés, un desarrollador en Bogotá, Madrid o Ciudad de México puede vender una solución adaptada al acento, la cultura y los guiones de venta locales. El coaching conversacional con IA acaba de dejar de ser exclusivo de las grandes plataformas. Comparte este artículo si te fue útil.



