🤖 Diagnostico LLMO
LLMO (Large Language Model Optimization) — diagnóstico para la era de la búsqueda con IA. Verifica la presencia de llms.txt, el estado de permisos de los principales rastreadores de IA (GPTBot / ClaudeBot / Google-Extended, etc.) y los datos estructurados — todo de una vez.
📖 Qué te dice este diagnóstico
Este diagnóstico revisa si existe /llms.txt y cómo está estructurado, qué dice tu robots.txt sobre los rastreadores de IA (GPTBot, ClaudeBot, PerplexityBot, Google-Extended, CCBot y otros) y si hay datos estructurados. Nadie puede medir si ChatGPT o un buscador con IA citará tu página, porque no existe nada equivalente a una API de posiciones. Lo único que puedes confirmar aquí es la condición previa: que seas legible por máquinas y que no estés bloqueando el acceso.
| Elemento | Qué significa | Cómo corregirlo |
|---|---|---|
| Sin llms.txt | llms.txt es una propuesta de 2024. Ningún LLM lo exige hoy y no hay una relación causal confirmada entre tenerlo y ser citado. Piénsalo como entregar en Markdown un mapa legible por máquinas de tu sitio. Que falte no es un defecto. | Si decides añadirlo, pon en /llms.txt un H1 con el nombre del sitio, después un párrafo de resumen y debajo un encabezado ## Sección por área con una lista de enlaces y descripciones de una línea, todo en Markdown. En la práctica es una página de mapa del sitio escrita en Markdown plano; no hace falta ningún generador. |
| Bloqueo de todos los rastreadores de IA | Cada user-agent significa algo distinto. Denegar Google-Extended sólo te excluye de usos como AI Overviews y no afecta al posicionamiento normal, porque el rastreo lo sigue haciendo Googlebot. Bloquear GPTBot o ClaudeBot, en cambio, renuncia al tráfico de referencia que devuelven esos productos. |
Para separar no me entrenes de cítame, deniega sólo los bots de entrenamiento como CCBot y GPTBot y permite los que descargan en el momento de responder. El cumplimiento es voluntario, así que si necesitas un bloqueo real, rechaza el user-agent en el servidor. |
| Sin datos estructurados | Un LLM también lee tu texto, pero el JSON-LD de schema.org es la única forma de afirmar sin ambigüedad que esto es un artículo, quién lo escribió y cuándo se actualizó. Si la fecha y el autor no existen como estructura en ninguna parte, se pierden al resumir o se asocian a otro número. | Añade Article (o BlogPosting), Organization y BreadcrumbList como JSON-LD. Lo decisivo es generar el marcado y el HTML visible a partir de los mismos datos; si los escribes por separado, uno quedará obsoleto. Cometimos justo ese error con nuestro propio FAQ y lo rehicimos para que un único array produzca ambos. |
Todavía no hay un manual establecido para LLMO. Lo que hoy funciona con seguridad es (1) que el cuerpo del texto se lea sin JavaScript, (2) que la jerarquía de encabezados coincida con el contenido y (3) que exista información de primera mano que no esté en otra parte, casi la misma lista que para los buscadores. Trata las tres como más prioritarias que añadir un llms.txt.