Julian Augusto Cortes Gomez

Julian Augusto Cortes Gomez

AI Engineer · Data Scientist · Data Engineer

Msc. Visual Analytics & Big Data | Esp. Inteligencia Artificial

Llevo agentes de IA y pipelines de datos a producción. 8+ años construyendo sistemas RAG, agentes de voz y texto, y la infraestructura que los sostiene — hoy como AI Team Lead en InsightPlay.ai.

AI Text Agents — Meta Platform

Agentes conversacionales multimodales sobre WhatsApp, Messenger e Instagram, construidos como Meta Tech Provider

Agentes Multimodales sobre la Plataforma de Meta

Plataforma de agentes de texto desplegada directamente sobre los canales de Meta —WhatsApp Business, Messenger e Instagram— con el flujo completo de Meta Tech Provider levantado desde cero: verificación del negocio, embedded signup, alta de números, gestión del ciclo de vida de los tokens y recepción de webhooks. Ser Tech Provider significa que cada cliente se da de alta solo, sin intervención manual y sin compartir credenciales.

Sobre ese canal corre un sistema RAG completo y multimodal: el agente entiende texto, imágenes y notas de voz, y responde con contexto recuperado de una base de conocimiento que se alimenta de documentos, de web scraping y de datos en vivo consultados en el momento de la conversación. La recuperación combina búsqueda vectorial en Pinecone con PageIndex para razonar sobre la estructura jerárquica de documentos largos, donde el chunking plano se queda corto.

Meta Tech Provider Flow (desde cero)

Onboarding completo como proveedor tecnológico de Meta: embedded signup, verificación de negocio, solicitud y revisión de permisos, registro de números y rotación de tokens de larga duración. Cada cliente se activa sin intervención manual.

Gestión de la Meta API

Integración con WhatsApp Cloud API y Graph API: plantillas de mensaje y su aprobación, ventana de servicio de 24 horas, rate limits por número, reintentos con backoff y webhooks idempotentes para no duplicar respuestas ante reenvíos.

RAG Completo

Pipeline de extremo a extremo: ingesta, chunking consciente de la estructura, embeddings, búsqueda híbrida, reranking y generación con citación de la fuente. El agente responde con fundamento verificable en vez de improvisar.

Multimodal: Audio, Imagen y Texto

Las notas de voz se transcriben y entran al mismo pipeline de recuperación; las imágenes se interpretan con modelos de visión (facturas, fotos de producto, capturas). Un solo agente atiende los tres tipos de entrada sin cambiar de flujo.

Pinecone

Base de datos vectorial con namespaces por cliente, lo que aísla el conocimiento de cada tenant en la misma infraestructura y mantiene la latencia de búsqueda estable a medida que crece el corpus.

PageIndex

Indexación jerárquica para documentos largos: en lugar de trocear el texto y perder el contexto del capítulo, el sistema navega la estructura del documento para localizar la sección correcta antes de leerla.

RAG desde Web Scraping

Crawler que convierte sitios públicos en conocimiento consultable, con detección de cambios para reindexar solo lo que se modificó y no reprocesar el sitio completo en cada corrida.

Live Data

Herramientas que consultan sistemas en tiempo real durante la conversación —inventario, precios, estado de un pedido— para los datos que caducan y no pueden vivir en un índice precalculado.

Meta Cloud API WhatsApp Business Graph API Python FastAPI Pinecone PageIndex RAG Multimodal LLMs Speech-to-Text Web Scraping Webhooks Redis Docker

¿Hablamos?

Abierto a roles de AI Engineer, liderazgo de Data & IA y consultoría. La vía más rápida es LinkedIn.