Disponible para mandatos de Head of Engineering, Technical Lead y arquitecto fundador

Quito el riesgo de plataforma
del escritorio del CEO.

Technical Product Lead · Solutions Architect · Head of Systems & Data Engineering. Doce años convirtiendo sistemas frágiles, aislados y sin cumplimiento en infraestructura por la que nadie tiene que volver a preocuparse — a una fracción de lo que cobra el cloud gestionado por operarla.

< 500ms
Time-to-first-byte de voz-IA, arquitecturado
20×
Menor costo de infraestructura que el equivalente gestionado
5.000+
Usuarios concurrentes en un clúster HA propio
0
PII en texto plano en reposo, por arquitectura
Cómo trabajo

Tres decisiones que definen el trabajo.

Las decisiones que cuestan menos en el momento suelen ser las que más se pagan después. Estas son tres que tomé de otra manera — y por qué importan a escala.

Síntesis en streaming, oración por oración
en lugar de  procesar la respuesta completa del LLM primero

El pipeline ingenuo — detectar, transcribir, pensar, hablar — hace esperar al usuario entre tres y seis segundos antes de escuchar algo. HTTP/2 multiplexado y síntesis por oración llevan el time-to-first-byte a menos de 500 ms. La arquitectura es la ventaja competitiva, no el modelo.

Cifrado de sobre a nivel de aplicación
en lugar de  separación de nivel de infraestructura

Con un presupuesto limitado no puedes comprar un nivel de datos segregado. Sí puedes cifrar cada campo PII con una clave emitida por KMS antes de que toque el disco. Cero texto plano en reposo no es una casilla de cumplimiento — detiene a un atacante incluso después de comprometer el servidor de base de datos.

Clúster HA propio, entornos idénticos
en lugar de  cloud gestionado con multiplicador de staging

Aurora Multi-AZ, Kubernetes, stacks de observabilidad gestionados — esos servicios no se venden al costo. Un clúster de cómputo sin estado con backups WAL-G y un CDN empresarial entrega la misma resiliencia por $1.900/mes donde el equivalente gestionado cobra $38.000.

Prueba de trabajo

Los números, en contexto.

Dos sistemas en producción hoy. Metodología completa y arquitectura en la página del caso técnico.

Una pregunta
para empezar.

Cuéntame la forma del problema — el objetivo de latencia, el requisito de cumplimiento, la arquitectura que nadie quiere tocar, o la factura de infraestructura que llegó el mes pasado. Leo cada mensaje y respondo personalmente, normalmente en un día.