Escribir tu propio servidor MCP: menos magia de la que crees
El Model Context Protocol se volvió el estándar para conectar herramientas a los LLMs. Montar un servidor propio es sorprendentemente sencillo. Qué expone y cómo diseñarlo.
Categoría
23 artículos en esta categoría.
El Model Context Protocol se volvió el estándar para conectar herramientas a los LLMs. Montar un servidor propio es sorprendentemente sencillo. Qué expone y cómo diseñarlo.
Tu retriever trae documentos aproximadamente relevantes. Un reranker los reordena por relevancia real antes de pasarlos al modelo. Cómo y por qué añadirlo.
Los modelos ahora garantizan salida conforme a un JSON Schema. Se acabó el regex sobre respuestas rotas. Qué cambia para el dev y dónde sigue fallando.
Desplegar un LLM sin observabilidad es volar a ciegas. Cómo instrumentar tus llamadas con estándares abiertos para saber qué pasa cuando algo falla.
Montar un RAG es fácil. Saber si funciona es lo difícil. Un tutorial práctico para instrumentar la evaluación antes de que el sistema esté en producción.
Los sistemas con múltiples agentes de IA coordinándose son complejos de operar. Después de varios deployments, estos son los patrones arquitectónicos que sobreviven al contacto con producción.
JSON mode y structured outputs son solo el principio. Patrones avanzados para extraer datos complejos, manejar casos edge, y construir pipelines de extracción robustos en producción.
LangGraph es el framework más maduro para agentes con estado. Construimos un agente que busca información, la evalúa, y decide si necesita más investigación antes de responder.
Si ya usas PostgreSQL, pgvector te da búsqueda vectorial sin añadir otra base de datos. Tutorial de setup, indexación, y cuándo tiene sentido versus una base de datos vectorial dedicada.
Después de implementar Extended Thinking en varios proyectos, compilamos los patrones que funcionan y los errores que más se cometen al integrarlo en aplicaciones de producción.
Ejecutar modelos grandes en hardware modesto requiere cuantización. Comparamos los formatos más usados con resultados concretos de calidad y velocidad.
El reranking es el paso más fácil de olvidar en un pipeline RAG y el que más mejora los resultados. ColBERT ofrece la mejor relación calidad-velocidad. Tutorial completo.
El Model Context Protocol de Anthropic permite a los LLMs conectarse con herramientas externas. Construimos un servidor MCP funcional paso a paso con TypeScript.
Ollama en tu laptop funciona bien para desarrollo. Para un servidor compartido con varios usuarios o para integrarlo en una aplicación, hay configuración extra necesaria. Esta guía cubre el setup completo.
Los streams transforman la experiencia de usuario al mostrar texto mientras se genera. Guía de implementación en el backend (Node.js) y frontend (React) usando Server-Sent Events con OpenAI y Anthropic.
Tool use permite que Claude invoque funciones definidas por ti para obtener información externa o ejecutar acciones. Implementación completa con TypeScript, manejo del ciclo de herramientas y patrones de error.
Tutorial completo: interfaz de chat con streaming, historial de mensajes, cambio de modelo y manejo de errores. Usando el Vercel AI SDK con Next.js 14 App Router y TypeScript.
Cada base de datos vectorial tiene un caso de uso donde brilla. Comparamos las opciones principales en rendimiento, facilidad de uso, coste y cuándo tiene sentido each una para un proyecto real.
OpenAI permite hacer fine-tuning de GPT-4o Mini con tus propios datos. Guía completa: preparación del dataset, formato JSONL, llamada a la API y evaluación del resultado.
El caching de Anthropic permite reutilizar contexto largo entre llamadas. Guía de implementación con TypeScript para system prompts, documentos de referencia y herramientas definidas.
Tutorial completo para construir recuperación aumentada generativa. Cargamos documentos, generamos embeddings, indexamos en Chroma y construimos la cadena de QA. Con variantes para escalar a producción.
Con Structured Outputs, GPT-4o puede garantizar que su salida se ajuste exactamente a un schema JSON. Cómo implementarlo, cuándo usarlo y qué diferencia hay con el modo JSON anterior.
Guía práctica para usar la API de Claude desde TypeScript o Python. Cuenta, instalación, primera llamada, streaming y manejo de errores. Todo lo que necesitas para empezar.