Escribir tu propio servidor MCP: menos magia de la que crees
El Model Context Protocol se volvió el estándar para conectar herramientas a los LLMs. Montar un servidor propio es sorprendentemente sencillo. Qué expone y cómo diseñarlo.
Tag
15 artículos con este tag.
El Model Context Protocol se volvió el estándar para conectar herramientas a los LLMs. Montar un servidor propio es sorprendentemente sencillo. Qué expone y cómo diseñarlo.
Un modelo se evalúa por respuesta. Un agente se evalúa por trayectoria: los pasos, las herramientas, el estado final. Cómo montar evals para sistemas que actúan.
Los modelos actuales piden varias herramientas a la vez en un solo turno. Suena menor, pero cambia por completo la latencia y el diseño de tus agentes.
Después de dos años de demos espectaculares, el discurso de los agentes autónomos empieza a chocar con la realidad de producción. Una reflexión sobre la brecha.
Los LLMs olvidan todo al terminar cada conversación. Varias aproximaciones intentan resolver esto con resultados muy dispares. Estado del arte y qué funciona en producción.
OpenAI relanzó Codex como un agente de código asíncrono que puede trabajar en tareas largas sin supervisión. Qué puede hacer, cuáles son sus límites, y cómo encaja con otras herramientas.
GitHub Copilot Workspace prometió transformar cómo trabajamos con issues. Después de un año en disponibilidad general, evaluamos qué funciona y cuál es el caso de uso real.
LangGraph es el framework más maduro para agentes con estado. Construimos un agente que busca información, la evalúa, y decide si necesita más investigación antes de responder.
Los agentes de IA llevan dos años prometiendo automatizar el trabajo. Revisión honesta de dónde estamos: qué casos de uso funcionan en producción y cuáles siguen siendo demos.
Gemini 2.0 Flash y Pro cambian el enfoque de Google: menos competir en benchmarks generales, más habilitar flujos de trabajo agénticos con capacidades nativas de audio y video.
Operator es la apuesta de OpenAI por agentes que interactúan con sitios web reales. Evaluamos qué puede hacer, dónde falla, y si realmente cambia la forma en que usamos internet.
Tool use permite que Claude invoque funciones definidas por ti para obtener información externa o ejecutar acciones. Implementación completa con TypeScript, manejo del ciclo de herramientas y patrones de error.
El concepto de agente de IA existe desde hace años, pero las implementaciones prácticas que realmente funcionan son pocas. Repasamos los patrones que están dando resultados y los antipatrones más comunes.
MCP define cómo los modelos de lenguaje se conectan con fuentes de datos, herramientas externas y sistemas. Anthropic lo publicó como estándar abierto y varios proveedores lo están adoptando.
GitHub presentó Copilot Workspace como el siguiente paso después del autocompletado: un entorno donde describes una tarea en lenguaje natural y el modelo propone, explica y ejecuta los cambios en tu repositorio.