AI Agent Engineer (Python/GCP/LLM) — MCP & Claude · Remoto Colombia
Indexed description
¿Te motiva construir agentes de IA que de verdad ejecutan —no demos, sino agentes en producción que consultan datos, llaman herramientas vía MCP y automatizan decisiones sobre GCP? ¿Con modelos frontier (Claude) y una plataforma greenfield? Esto es para ti.
Deacero, uno de los principales grupos industriales de México y líder en la fabricación de acero (+70 años de trayectoria), está construyendo su capa de agentes de IA: agentes que operan sobre un motor de pricing en tiempo real y sobre los sistemas de la compañía, exponiendo datos y capacidades de forma segura vía Model Context Protocol (MCP). Buscamos un(a) AI Agent Engineer para construir esos agentes desde cero. 100% remoto desde Colombia, con foco en el ecosistema tech de Medellín.
Sobre el rol
Serás quien construye la capa agéntica en producción: agentes LLM (Claude y modelos frontier) que razonan, recuperan contexto y ejecutan acciones a través de herramientas. Diseñas los servidores y tools MCP que conectan a los agentes con las APIs de datos, el ERP y los servicios internos —con guardrails, evals y mínimo privilegio. Trabajas codo a codo con el equipo de Data/Arquitectura y con Producto. Tu impacto es 100% técnico.
Qué harás
- Diseñar y construir agentes LLM en producción (Claude / modelos frontier) con tool calling, orquestación y manejo de errores robusto.
- Implementar servidores y herramientas MCP (Model Context Protocol) que exponen datos y capacidades de sistemas internos a los agentes de forma segura y auditable.
- Construir pipelines RAG: retrieval, embeddings, vector search, chunking y memoria de agentes.
- Definir evals y métricas de calidad (LLM-as-judge, golden sets, regresión de prompts) para iterar con datos, no con intuición.
- Desplegar sobre GCP: Cloud Run, Pub/Sub, Vertex AI / endpoints de modelos; observabilidad y control de costos de tokens.
- Integrar con APIs REST de datos y sistemas empresariales (ERP) aplicando IAM de mínimo privilegio y guardrails de seguridad.
- Iterar sobre prompts, herramientas y arquitectura de agentes con foco en confiabilidad y latencia.
Qué buscamos
Imprescindible:
- 3+ años en ingeniería de software o ML; Python sólido.
- Experiencia construyendo con LLMs en producción: prompting, tool/function calling y RAG (no solo POCs).
- Diseño de APIs REST, código asíncrono y despliegue en cloud (GCP preferido).
- Manejo de embeddings / vector databases y patrones de retrieval.
- Git, CI/CD y testing; criterio de ingeniería para llevar prototipos a producción.
- Español avanzado e inglés técnico (la mayor parte del ecosistema de agentes está en inglés).
- Autonomía en equipo remoto distribuido y comunicación clara.
Suma puntos (deseable):
- Model Context Protocol (MCP) y el ecosistema de Anthropic / Claude.
- Frameworks de agentes (LangGraph, LlamaIndex) usados con criterio, no por dependencia.
- Vertex AI, BigQuery, Cloud Run, Pub/Sub, Datastream.
- Evals y observabilidad de LLMs (Langfuse, LangSmith, promptfoo o similares).
- Experiencia en pricing, decisioning o dominios transaccionales de alta escala.
- Fine-tuning, structured output, o seguridad de agentes (prompt injection, sandboxing de tools).
Qué ofrecemos
- Trabajo 100% remoto desde Colombia (ideal si estás en Medellín), con autonomía real.
- Una plataforma agéntica greenfield: la diseñas desde cero, con modelos frontier y sin deuda técnica.
- Stack moderno de verdad: Python, GCP, Vertex AI, MCP/Claude, RAG, vector search.
- Empresa sólida con +70 años de trayectoria y una transformación digital ambiciosa.
- Compensación competitiva.
¿Listo para poner agentes de IA a trabajar de verdad en una de las industrias más grandes de México? Postúlate hoy. Valoramos la diversidad y construimos un equipo inclusivo: si cumples los imprescindibles, queremos conocerte.
Create a free Caio profile to unlock more results and save your role and location preferences.
Unlock free search