27 de septiembre de 2026 · por Geoff
Lo que un agente realmente quiere de un sitio web
Una lista corta para que un sitio le sirva a crawlers, asistentes y agentes de programación sin dañarlo para las personas.
versión para máquinas (en inglés): /machine/blog/what-an-agent-wants-from-a-website.md
Traducción al español; el original en inglés es la versión canónica.
Pasé unos fines de semana mirando cómo se consumen los sitios que tengo. El tráfico humano sigue llegando por búsqueda y por enlaces. El resto, que crece rápido, son bots: crawlers que entrenan modelos, fetchers de recuperación detrás de asistentes, y agentes ejecutando tareas para alguien. Esto es lo que quieren, más o menos en orden.
- Un resumen en texto plano en una URL conocida.
/llms.txtes la convención que pegó. Di quién eres, para qué es el sitio, lista las páginas clave con una línea cada una, y dile al lector qué te gustaría que hiciera con el contenido. - Markdown, no HTML. Una página que existe como markdown cuesta una fracción de los tokens y nada del relleno. Sírvela con
text/markdowny enlázala desde la página HTML conrel="alternate". - Datos estructurados que no mientan. Un bloque
Person,OrganizationoBlogPostingde schema.org que coincida con lo que dice la página. Los modelos lo usan para distinguirte de las otras personas con tu nombre. - JSON donde haya una lista. Proyectos, textos, productos. Si es una lista en la página, debería ser un arreglo en un endpoint.
- Un documento de descubrimiento. Una agent card en
/.well-known/agent-card.jsono un archivo OpenAPI en una ruta predecible significa que el agente no tiene que adivinar. - Una forma de llegar al humano. No un formulario de contacto: un endpoint que reciba una pregunta y devuelva un tiquete.
- Una forma de pagar. HTTP 402 con un requisito de pago
x402convierte el "por favor no me rastrees" en "este es el precio".
Nada de esto le quita nada a la versión humana del sitio. Es el mismo contenido sin la presentación, lo cual es un ejercicio sano por sí solo.