Agentes de IA
Introduccion a los agentes de IA: la guia definitiva para poner orden
9 min de lecturaAmichai Shekel
Guia de introduccion a los agentes de IA: que es un agente y en que se diferencia de un chat, el bucle del agente, contexto, habilidades, conectores y MCP, cuatro entornos de trabajo (Claude Code, Codex, Cursor, Antigravity), precios, permisos y un ejercicio para construir tu primer agente.
La palabra agente (Agent) esta en todas partes hoy en dia. En Instagram, en TikTok, en cada conferencia de tecnologia, en cada publicacion de Google, Microsoft, Nvidia o Meta. Y cualquiera que intente entrar en este mundo recibe principalmente caos: que es un agente, en que se diferencia de un chat, que es una habilidad, que es un conector y por que todo el mundo habla de esto de repente. Esta guia es el resumen escrito del encuentro 29 del club AI Master, introduccion a los agentes de IA. Su proposito es unico: poner orden. Al terminar de leer sabras que es un agente, de que partes esta compuesto, como funciona, en que entornos se opera, cuanto cuesta y como construir tu primer proceso automatico sin escribir una sola linea de codigo.
La conclusion desde el principio: trabajar hoy solo con un chat es como tener un motor sin automovil. El chat responde, el agente ejecuta. Y cualquiera que trabaje con conocimiento, en un negocio o como empleado, ya puede transferir al agente procesos completos que hace manualmente una y otra vez.
El problema: nosotros somos la conexion entre las aplicaciones
La evolucion, en poco tiempo
Entonces, que es realmente un agente?
La diferencia en una linea
- Chat: explica, redacta, sugiere y luego espera tu siguiente solicitud. Ping-pong interminable.
- Agente: lee la situacion, planifica, activa herramientas, realiza acciones en el mundo digital.
- El chat no toma la iniciativa. El agente no se detiene hasta que la tarea que definiste se completa.
- El chat genera texto. El agente genera un resultado: un archivo, un correo enviado, una reunion programada, un video subido.
La analogia que pone orden: el mundo de los agentes como una cocina
El diccionario completo
- Entorno de trabajo = La cocina. El lugar donde el agente vive y opera (Claude Code, Codex, Cursor, Antigravity).
- El agente = El chef. Es quien ejecuta realmente.
- Modelo de lenguaje = El cerebro del chef. Se puede reemplazar, y cada agente puede recibir un cerebro diferente.
- La tarea = El plato ordenado. Tu mensaje o prompt = El pedido del cliente.
- Documentos y datos = Los ingredientes. Todo lo que le proporcionas como contexto.
- Habilidades = El libro de recetas. Instrucciones de trabajo fijas que extrae cada vez de nuevo.
- Conectores (MCP) = Los electrodomesticos de la cocina y el acceso al refrigerador y al supermercado. Sus manos y pies.
- Memoria = Su cuaderno de recetas personal, un archivo donde esta escrito quien eres y como trabajas.
- El resultado = La comida lista.
Este es el punto mas importante de esta guia. El agente no es mas inteligente que el chat porque su modelo sea mejor. Es mas poderoso porque se le ha dado un entorno: archivos, memoria, habilidades, herramientas y permisos. Exactamente el mismo modelo, en dos entornos diferentes, produce dos resultados completamente distintos.
Un agente es un sistema, no un modelo
El bucle del agente: como funciona en la practica
Las cinco etapas del bucle
- Lee la situacion · Recopila informacion sobre el estado actual, que sabe y que le falta.
- Planifica · Decide cual es el siguiente paso y construye un plan de accion.
- Activa · Utiliza una herramienta y realiza una accion real.
- Verifica · Compara el resultado con el objetivo que definiste.
- Continua o se detiene · Regresa al bucle si no ha terminado, y finaliza cuando la tarea esta completa.
Cuando sabe el agente que ha terminado
Los cuatro entornos de trabajo donde se operan agentes
Cuanto cuesta
- Claude · 20 dolares al mes como minimo, plan Max a partir de 100 dolares.
- Codex · 20 dolares al mes, incluido en la suscripcion de ChatGPT. Planes Pro de 100 o 200 dolares.
- Cursor · 20 dolares al mes, 40 dolares por usuario en equipos.
- Antigravity · Version gratuita con cuotas diarias.
No pierdas tiempo con la pregunta de que herramienta es la mejor. La respuesta cambia todos los meses. Lo que no cambia son los principios de trabajo: contexto, habilidades, conectores, agentes y permisos. Quien entiende estos cinco se mueve entre herramientas sin problema.
Los cinco componentes que lo determinan todo
1. Contexto · Quien soy y que es importante para mi
2. Habilidades · Como quiero que se realice el trabajo
El club AI Master te abre la puerta: encuentro en vivo cada semana, grabaciones y comunidad. 47 shekels al mes, cancela en cualquier momento.
Hay aqui una nueva capacidad que vale la pena conocer: grabar habilidad (Record Skill) en Claude. Abres una grabacion de pantalla y microfono, realizas el proceso una vez de principio a fin, y al finalizar el agente resume por si mismo todos los pasos y los empaqueta como una habilidad. A veces incluso te dira que no es necesario hacer clic en todos los botones porque existe un conector que lo hace directamente.
3. Conectores · Que se le permite tocar al agente
La diferencia entre API y MCP confunde a mucha gente, asi que en breve: la API es el sistema donde residen las herramientas mismas (por ejemplo, Google AI Studio, que contiene los modelos de imagen y video de Google), y alli tambien se encuentran el pago y la clave de acceso. El MCP es el puente que conecta tu entorno de trabajo con esa API. Se conecta una sola vez, y a partir de ese momento el agente puede utilizar estas capacidades dentro de tu flujo de trabajo.
4. Agentes y subagentes · Quien ejecuta cada parte
5. Permisos y evidencia · Cuando se puede confiar en el
Reglas de confianza para un nuevo agente
- Comienza con permisos de solo lectura, sin cambios y sin eliminaciones.
- Cada correo o publicacion pasa a traves de un borrador que tu apruebas.
- Limita el acceso: no todas las capacidades de cada herramienta, solo lo requerido para la tarea.
- En la primera etapa otorga solo acciones reversibles. Un error no debe ser una catastrofe.
- Pide evidencia: captura de pantalla, el archivo creado, registro de acciones completo.
- Deja siempre a un humano en el bucle. Especialmente al comenzar.
Trata a un nuevo agente como a un nuevo empleado: el primer dia no se le da acceso a la cuenta bancaria. Se comienza con tareas que no ponen en riesgo nada y se amplian las autoridades a medida que demuestra su valia.
Como se ve cuando funciona
Como elegir el primer proceso
Seis señales de que un proceso es adecuado para un agente
- El proceso se repite con frecuencia, al menos una vez a semana.
- Esta construido con pasos claros que se pueden explicar a una persona sentada a tu lado.
- Consume tiempo real.
- Requiere pasar entre varias sistemas.
- Se puede verificar el resultado visualmente.
- Un error en el no es catastrofico.
Tu ejercicio · Cinco minutos
Prompt listo para construir el primer agente
Quiero construir un primer agente que ejecute para mi un proceso repetitivo en mi trabajo. El proceso es: [Describa el proceso en una frase]. Hazme una pregunta a la vez y al final arma un documento de habilidad ordenado. Estas son las preguntas por las que quiero que pasemos: 1. Cual es el resultado deseado y como se ve un producto exitoso. 2. Que informacion y contexto necesita el agente de mi parte. 3. Que herramientas y conectores se deben usar. 4. Que tiene permitido ejecutar de forma independiente. 5. Que tiene estrictamente prohibido ejecutar bajo ninguna circunstancia. 6. Cuando debe detenerse y pedirme aprobacion. 7. Que me demostrara que la tarea se ha completado (Definition of Done). Al final del proceso escribeme la habilidad como un archivo MD ordenado, con etapas de trabajo, controles de calidad y lista de permisos.
Invierte estos cinco minutos en un solo proceso. Es mucho mejor que intentar construir todo un sistema el primer dia. Un proceso pequeño que funciona te da capacidad, ahorra tokens y genera apetito para el siguiente proceso.
Hacia dónde se dirige
No construya otro bot. Construya una nueva forma de trabajo
Los cinco pasos en resumen
- Elija un proceso que se repita.
- Dle contexto: quién es usted, cómo trabaja.
- Defina una skill: cómo se realiza el proceso correctamente.
- Conecte un conector a las herramientas pertinentes.
- Defina qué se considera un éxito y verifíquelo.
Preguntas frecuentes sobre agentes de IA
Un modelo de lenguaje es el cerebro, responde preguntas. Un agente es un sistema completo que recibe un objetivo y lo ejecuta: planifica, opera herramientas, se autoevalúa y continúa hasta que la tarea se completa. Exactamente el mismo modelo, dentro de un entorno equipado, produce un resultado completamente diferente.
No. En entornos como Claude Code y Codex, el agente escribe el código por usted. Usted describe lo que quiere en lenguaje natural y él lo ejecuta. El conocimiento necesario es sobre procesos de trabajo, no sobre programación.
MCP es el puente que conecta el entorno de trabajo con una herramienta externa. API es el sistema donde reside la herramienta en sí, y allí también se encuentran el pago y la clave de acceso. Se conecta el entorno de trabajo a través de MCP a la API, y a partir de ese momento el agente puede utilizar las capacidades de dicha herramienta.
Sí. Un agente puede activar subagentes e incluso gestionar un equipo entero, donde cada agente tiene su propio rol, archivos, herramientas y modelo de lenguaje. Se le puede dar al agente principal un modelo inteligente y costoso, y a los subagentes modelos económicos y rápidos.
Una skill es un archivo de instrucciones que le explica al agente cómo realizar un proceso determinado una y otra vez: etapas, plantillas, ejemplos y controles de calidad. Se puede escribir junto con el agente, descargar una lista para usar de la red, o grabar el proceso una vez y dejar que el agente lo empaquete solo.
No hay una respuesta fija y cambia cada mes. Si tiene una suscripción a ChatGPT, comience con Codex sin costo adicional. Si quiere el entorno que inició todo, Claude Code. Los principios son idénticos en todas las herramientas, por lo que la transición entre ellas es sencilla.
Sí, si se trabaja correctamente. Comience con permisos de solo lectura, solicite un borrador antes de cada envío, asigne únicamente acciones reversibles y pida pruebas y registros de actividad. No empiece con información financiera o médica sensible.
Si hasta hoy sentía que este mundo era una gran ensalada, ese era exactamente el objetivo de la guía: descomponerlo en partes. Ahora solo queda elegir un proceso y darle una tarea a su primer agente. Comience pequeño, pruebe y expanda.
Preguntas frecuentes
Cuál es la diferencia entre un modelo de lenguaje y un agente?
Un modelo de lenguaje es el cerebro, responde preguntas. Un agente es un sistema completo que recibe un objetivo y lo ejecuta: planifica, opera herramientas, se autoevalúa y continúa hasta que la tarea se completa. Exactamente el mismo modelo, dentro de un entorno equipado, produce un resultado completamente diferente.
Es necesario saber escribir código para trabajar con agentes?
No. En entornos como Claude Code y Codex, el agente escribe el código por usted. Usted describe lo que quiere en lenguaje natural y él lo ejecuta. El conocimiento necesario es sobre procesos de trabajo, no sobre programación.
Cuál es la diferencia entre una API y MCP?
MCP es el puente que conecta el entorno de trabajo con una herramienta externa. API es el sistema donde reside la herramienta en sí, y allí también se encuentran el pago y la clave de acceso. Se conecta el entorno de trabajo a través de MCP a la API, y a partir de ese momento el agente puede utilizar las capacidades de dicha herramienta.
Puede un agente activar otros agentes?
Sí. Un agente puede activar subagentes e incluso gestionar un equipo entero, donde cada agente tiene su propio rol, archivos, herramientas y modelo de lenguaje. Se le puede dar al agente principal un modelo inteligente y costoso, y a los subagentes modelos económicos y rápidos.
Qué es una skill y cómo se crea una?
Una skill es un archivo de instrucciones que le explica al agente cómo realizar un proceso determinado una y otra vez: etapas, plantillas, ejemplos y controles de calidad. Se puede escribir junto con el agente, descargar una lista para usar de la red, o grabar el proceso una vez y dejar que el agente lo empaquete solo.
Qué entorno es el más recomendado para empezar?
No hay una respuesta fija y cambia cada mes. Si tiene una suscripción a ChatGPT, comience con Codex sin costo adicional. Si quiere el entorno que inició todo, Claude Code. Los principios son idénticos en todas las herramientas, por lo que la transición entre ellas es sencilla.
Es seguro darle a un agente acceso a mis sistemas?
Sí, si se trabaja correctamente. Comience con permisos de solo lectura, solicite un borrador antes de cada envío, asigne únicamente acciones reversibles y pida pruebas y registros de actividad. No empiece con información financiera o médica sensible.


