Okidoki.chat: Un Año Construyendo una Plataforma de Conversión con IA
De un MVP de 3 semanas a agentes de texto, voz, video y WhatsApp que agendan reuniones reales para 213+ negocios

Dónde Partió
Okidoki.chat se lanzó como un MVP de 3 semanas: un widget de chat RAG rápido con respuestas bajo 200ms, modo de voz y videollamadas. Demostró el concepto — las respuestas específicas de cada marca podían sentirse instantáneas en vez de "lentas como IA" — y consiguió los primeros clientes de pago.
Pero esta es la parte honesta: la velocidad no es una ventaja competitiva sostenible, y no es un producto. Un widget que responde bien preguntas es un demo. Por lo que los negocios pagan de verdad es por resultados — leads calificados, reuniones agendadas, menos tiempo perdido con curiosos.
El último año de trabajo ha sido cerrar esa brecha. Este artículo es sobre lo que eso costó.
Qué Es Hoy
Okidoki.chat hoy es una plataforma de conversión con IA: atiende a los visitantes del sitio por texto, voz, video con avatar en tiempo real o WhatsApp, responde desde el conocimiento propio del negocio, califica al lead y agenda la reunión — automáticamente, 24/7.
Lo que se construyó entre el MVP y ahora:
- Cuatro canales, un cerebro — el mismo agente de IA y base de conocimiento sirven chat de texto, conversaciones de voz (30+ voces), video cara a cara con avatares realistas (20+) y WhatsApp
- Agendamiento inteligente — el agente califica visitantes y agenda directo en calendarios reales, con reuniones de video integradas (HD, pantalla compartida, transcripción automática y resúmenes con IA)
- AI Page Copilot — el agente puede interactuar con la propia página: llenar formularios, navegar, guiar al visitante
- Handoff humano — cuando un visitante necesita a una persona, el equipo recibe notificación instantánea (push, web, email) y puede tomar la conversación desde el dashboard o la app móvil Operator, con todo el contexto
- Inteligencia de leads — perfiles automáticos de visitantes, historial de engagement y perfilamiento ICP
- Workspaces multi-tenant — equipos, múltiples widgets por cuenta, marca blanca, landing pages generadas con IA y sitios inmersivos 3D
- Una API
ask()— para que el mismo cerebro alimente integraciones más allá del widget
En vivo: okidoki.chat↗ — y corriendo en producción en este mismo sitio, ahora.
Los Problemas Difíciles
El problema difícil del MVP era la latencia del RAG. Los problemas difíciles de la plataforma fueron otros — y cada uno tomó más tiempo que toda la construcción original:
1. Un cerebro, cuatro canales. El texto tolera una pausa de 500ms; una conversación de voz no. Hacer que la misma base de conocimiento y lógica de agente se sintiera nativa en chat, en una sesión de voz en vivo (Gemini Live), en un avatar de video con lipsync y dentro del modelo de mensajería de WhatsApp exigió repensar el pipeline por canal manteniendo una sola fuente de verdad.
2. Avatares en tiempo real que no rompan la confianza. Un agente de video que se pega o falla es peor que no tener video. Lograr que el renderizado del avatar, el habla y el manejo de interrupciones se sintieran como una persona requirió un presupuesto de latencia agresivo en cada salto.
3. El handoff es un producto, no una funcionalidad. El momento en que la IA entrega la conversación a un humano es donde se ganan o pierden los negocios. Eso significó notificaciones que de verdad llegan (push, web, email), una app móvil para responder desde cualquier parte, y entregar contexto, no solo una transcripción.
4. Conocimiento que se mantiene vigente. Los negocios cambian sus sitios y documentos constantemente. La ingesta tuvo que volverse continua — crawling del sitio, procesamiento de documentos y re-indexación programada — para que las respuestas nunca queden desactualizadas.
5. Multi-tenancy y confiabilidad. 213+ negocios significa SLAs reales: 99.9% de uptime, cumplimiento GDPR, aislamiento por tenant, medición de uso por plan. Poco glamoroso, invisible, y donde realmente se fue la mayor parte del año de ingeniería.
Arquitectura
La filosofía de rendimiento original sobrevivió y escaló: hacer el trabajo pesado antes de que llegue la pregunta.
- Procesamiento RAG en build — el contenido se indexa cuando cambia, no en cada consulta
- Redis — embeddings procesados y patrones de consulta frecuentes cerca del edge
- Groq para inferencia de baja latencia, modelos más pesados donde importa la precisión
- Vercel Edge Functions — sin cold starts, despliegue global
- Gemini Live para voz en tiempo real, Daily.co para video WebRTC, AssemblyAI para transcripción
Lo Que Me Enseñó un Año en Producción
La velocidad es una ventaja inicial, no una propuesta de valor. Construirlo en 3 semanas sirvió para validar — y es irrelevante para explicar por qué los clientes se quedan. Se quedan porque las reuniones aparecen en su calendario. Dejé de vender "construido rápido" y empecé a medir reuniones agendadas.
El MVP es el 10% del producto. Todo lo que hace que Okidoki valga entre $149 y $999 al mes — handoff, WhatsApp, perfiles de leads, confiabilidad, la app móvil — llegó después del lanzamiento, guiado por observar a negocios reales usarlo y fallar en momentos específicos.
La retención vive en las partes aburridas. Nadie se va por el anuncio de una funcionalidad que falta; se van por una notificación perdida o una respuesta desactualizada. La ingesta continua y un handoff a prueba de balas hicieron más por la retención que cualquier capacidad vistosa.
El dogfooding se acumula. Este sitio corre Okidoki, y mis propios leads de consultoría son calificados y agendados por él. Cada aspereza que siento como usuario se convierte en el fix de la semana siguiente.
Pruébalo Tú Mismo
Este sitio usa Okidoki.chat en producción. Abre el widget (abajo a la derecha) para:
- Hacer preguntas sobre mi experiencia — las respuestas salen de mi propio contenido
- Probar el modo de voz
- Dejar que te agende una reunión conmigo, de principio a fin
¿Construyendo un producto de IA más allá del demo? Ese camino — de prototipo a plataforma — es exactamente en lo que ayudo a los equipos. Hablemos.