Julian Augusto Cortes Gomez

Julian Augusto Cortes Gomez

AI Engineer · Data Scientist · Data Engineer

Msc. Visual Analytics & Big Data | Esp. Inteligencia Artificial

Llevo agentes de IA y pipelines de datos a producción. 8+ años construyendo sistemas RAG, agentes de voz y texto, y la infraestructura que los sostiene — hoy como AI Team Lead en InsightPlay.ai.

Voice Agent Orchestrator

Plataforma de orquestación de agentes de voz LLM-agnóstica, escalable para millones de llamadas concurrentes

Orquestación Escalable de Agentes de Voz

Plataforma de orquestación diseñada para gestionar millones de llamadas de voz concurrentes con agentes de IA. A diferencia de soluciones acopladas a un solo proveedor, esta arquitectura es LLM-agnóstica, permitiendo intercambiar entre OpenAI, Anthropic, Google, modelos open-source u otros proveedores sin cambios en el código. El sistema incluye toda la infraestructura de AI necesaria: routing inteligente, balanceo de carga, failover automático y optimización de costos por proveedor.

La plataforma integra servicios completos de analítica de llamadas en tiempo real: análisis de sentimiento, detección de tópicos, scoring de calidad e inteligencia conversacional a escala. Además, incluye un sistema avanzado de gestión de prompts con versionamiento, A/B testing y tracking de rendimiento across diferentes LLMs, garantizando la mejor experiencia de usuario posible.

Infraestructura AI Completa

Routing multi-proveedor de LLMs (OpenAI, Anthropic, Google, open-source) con failover automático, optimización de costos y selección basada en latencia para cada tipo de interacción.

Analítica de Llamadas

Dashboard de analítica en tiempo real con análisis de sentimiento, detección de tópicos, scoring de calidad e inteligencia conversacional a escala masiva.

Gestión de Prompts

Sistema dinámico de gestión de prompts con versionamiento, A/B testing, y tracking de rendimiento a través de diferentes proveedores de LLM.

Arquitectura Escalable

Arquitectura basada en microservicios con Kubernetes, diseñada para escalado horizontal y manejo de millones de sesiones de voz concurrentes con latencia sub-segundo.

Abstracción Multi-Proveedor

Capa de abstracción agnóstica al proveedor que permite cambiar seamlessly entre LLMs sin modificar código, con contratos de API unificados y adaptadores pluggables.

Monitoreo en Tiempo Real

Stack de observabilidad completo con distributed tracing, métricas personalizadas, alerting y monitoreo de cumplimiento de SLAs para operación enterprise.

Kubernetes Python FastAPI Redis Kafka Multi-LLM WebRTC Prometheus Grafana Docker Terraform

¿Hablamos?

Abierto a roles de AI Engineer, liderazgo de Data & IA y consultoría. La vía más rápida es LinkedIn.