AI Readable
← Todas las entradas

Cómo conseguir que la IA te cite: tres detalles técnicos que casi todos pasan por alto

Los rastreadores ven el HTML inicial, no la página renderizada. Esa única diferencia decide si tu contenido llega a citarse.

Un motor generativo no es un buscador. Un buscador devuelve diez enlaces azules y deja que la persona decida cuál abrir; un motor generativo devuelve una respuesta. Tu sitio o aparece citado en ella, o da igual que no exista.

Los tres fallos más frecuentes

1. robots.txt no permite a los rastreadores de IA

La mayoría de los robots.txt se escribieron hace años pensando solo en Googlebot. GPTBot, ClaudeBot y PerplexityBot respetan robots.txt: si no los permites explícitamente, no vendrán.

User-agent: GPTBot
Allow: /

User-agent: ClaudeBot
Allow: /

2. El contenido crítico se renderiza en el cliente

Los rastreadores ven el HTML inicial. Si el cuerpo de tu artículo llega por un fetch dentro de useEffect y se inyecta en el DOM, lo que ven es un cascarón vacío. Aquí el renderizado en servidor no es una optimización de rendimiento: es la condición para ser visible siquiera.

3. No hay llms.txt

Es una convención reciente: colocar un llms.txt en la raíz del sitio con las páginas que quieres que te citen, en Markdown. No es obligatorio, pero cuesta casi nada y declara sin rodeos cuál es tu sustancia.

Cómo comprobarlo

El método más directo es visitar tu propio sitio como lo haría un rastreador:

curl -A "GPTBot" https://your-site.com/ | head -50

Mira lo que vuelve. Si es un montón de etiquetas <script> rodeando un <div id="root"> vacío, ya has encontrado el problema.