Cómo conseguir que la IA te cite: tres detalles técnicos que casi todos pasan por alto
Los rastreadores ven el HTML inicial, no la página renderizada. Esa única diferencia decide si tu contenido llega a citarse.
Un motor generativo no es un buscador. Un buscador devuelve diez enlaces azules y deja que la persona decida cuál abrir; un motor generativo devuelve una respuesta. Tu sitio o aparece citado en ella, o da igual que no exista.
Los tres fallos más frecuentes
1. robots.txt no permite a los rastreadores de IA
La mayoría de los robots.txt se escribieron hace años pensando solo en Googlebot. GPTBot, ClaudeBot y PerplexityBot respetan robots.txt: si no los permites explícitamente, no vendrán.
User-agent: GPTBot
Allow: /
User-agent: ClaudeBot
Allow: /
2. El contenido crítico se renderiza en el cliente
Los rastreadores ven el HTML inicial. Si el cuerpo de tu artículo llega por un fetch dentro de useEffect y se inyecta en el DOM, lo que ven es un cascarón vacío. Aquí el renderizado en servidor no es una optimización de rendimiento: es la condición para ser visible siquiera.
3. No hay llms.txt
Es una convención reciente: colocar un llms.txt en la raíz del sitio con las páginas que quieres que te citen, en Markdown. No es obligatorio, pero cuesta casi nada y declara sin rodeos cuál es tu sustancia.
Cómo comprobarlo
El método más directo es visitar tu propio sitio como lo haría un rastreador:
curl -A "GPTBot" https://your-site.com/ | head -50
Mira lo que vuelve. Si es un montón de etiquetas <script> rodeando un <div id="root"> vacío, ya has encontrado el problema.