Llevo años trabajando con Carlos. Cuando me preguntan por consultores de IA en LATAM, lo recomiendo sin dudarlo.

Integro IA en tu negocio sin romper lo que ya funciona. Diagnóstico, agentes y features. Para founders y CTOs LATAM.







Ocho años de backend en Go más consultoría hands-on de IA para SaaS en LATAM. Del diagnóstico inicial a features de IA corriendo en tu producto — precio fijo por scope, USD, pago por hitos. Sin agencia, sin slides.
Reservar llamada gratisAuditoría de tus procesos y producto para encontrar dónde la IA genera mayor ROI. Entregables: mapa de prioridades, roadmap de implementación, estimación de costos.
Automatización de flujos con LLMs y agentes — n8n, LangGraph, Claude/OpenAI APIs. Integrado con tu stack: Slack, HubSpot, WhatsApp Business, bases de datos.

Construyo features de IA dentro de tu producto: RAG sobre tu data, copilots, búsqueda semántica, generación. Arquitectura, economía de tokens y observabilidad incluidas.
Estandarizo cómo tu equipo de devs usa Claude Code y otras herramientas de IA. Plugins custom, prompts compartidos, dashboard de ROI. 5 semanas del caos a la velocidad medible.
Con una trayectoria de proyectos exitosos, mi portfolio muestra pensamiento estratégico, ejecución cuidada y diseño con propósito. Cada solución está pensada para abordar los objetivos únicos del cliente, entregando resultados medibles y valor a largo plazo.



Feedback real de founders, CTOs y compañeros de equipo.
Llevo años trabajando con Carlos. Cuando me preguntan por consultores de IA en LATAM, lo recomiendo sin dudarlo.

Conozco a Carlos desde 2020 cuando trabajamos juntos en Manzana Verde. Cuando llegó el momento de meter IA al producto, no dudamos en traerlo como consultor.

Escribe el código que entrega y deja a mi equipo en condición de mantenerlo. Sin intermediarios, sin promesas vagas.

Automatizó procesos clave con IA y el impacto en horas ahorradas fue inmediato. Precio fijo, sin sorpresas, y un consultor que piensa como founder.

Desde la primera llamada te dice qué se puede hacer, qué no, y cuánto cuesta. Sin slides, sin rodeos.

Empezamos con un diagnóstico de IA y terminamos implementando dos features dentro del producto. Desde el día uno trabajó con nuestro repo, no con un PowerPoint.

Orgulloso de trabajar con clientes en múltiples empresas y aportar su feedback positivo, sugerencias y soporte.

Hermes Agent v0.20.0 “herald” salió el 3 de agosto de 2026 con 3,650 commits, 1,400 PRs y 1,200 issues cerrados. El release se organiza alrededor de cuatro capacidades que definen el rol del agente: habla (voz conversacional con streaming TTS, barge-in y wake words on-device), lleva el mensaje a otros agentes (A2A v1.0), anuncia eventos a tus sistemas (webhooks firmados con HMAC) y cita sus fuentes (grounded citations con fact-checking). Más una plataforma de desktop con artifacts y plugin SDK, una ola de comandos CLI power-user, y tools que se auto-recuperan. Acá está la guía curada de lo que cambia para founders y equipos SaaS, con los comandos nuevos que importan para tu workflow.
Leer más →
Sí, podés correr un modelo MoE de 2 billones de parámetros en una workstation sin GPU dedicada: cargás solo los expertos activos en RAM y streameás el resto desde NVMe bajo demanda. Esta guía explica cómo funciona el offloading de expertos, qué SSD y RAM necesitás, cómo la cuantización 4-bit lo hace viable, latencia real con llama.cpp, y los tradeoffs honestos frente a una API.
Leer más →
Mixture of Experts (MoE) es la arquitectura que permite que modelos como Kimi K2 (1T parámetros totales, 32B activos) o Qwen3-30B-A3B (30.5B totales, 3.3B activos) paguen solo una fracción del cómputo por token sin sacrificar capacidad. Explicación pedagógica: expertos, router, parámetros totales frente a activos, por qué escala, y los tradeoffs reales de entrenamiento e inferencia que tenés que conocer antes de elegir un MoE para tu SaaS.
Leer más →Reservá una llamada gratis de 30 minutos. Sea el siguiente paso o no, te vas con un roadmap más claro.
Reserva llamada gratis (30 min)