/ artículos

llms.txt, schema y entidades: el checklist técnico para la visibilidad en búsqueda con IA

Los dos artículos anteriores explicaron por qué importa la visibilidad en IA. Este es el cómo, en específico la capa técnica, porque ahí es donde la mayoría de los sitios de negocios locales falla en silencio. Tu sitio puede verse hermoso para una persona y ser casi ilegible para los sistemas que hoy deciden a quién recomiendan.

Este es el checklist que corremos en cada sitio que construimos o auditamos. No es secreto. Aun así, la mayoría de tus competidores no lo va a hacer.

1. Datos estructurados (marcado schema)

El schema es código, normalmente JSON-LD en el encabezado de tu página, que declara datos sobre tu negocio en un formato que las máquinas leen directo en lugar de adivinarlo de tu redacción. Para un negocio local, el mínimo viable es:

LocalBusiness (o un subtipo específico como AutoRepair, Dentist, Plumber): nombre, dirección, teléfono, coordenadas, horarios, rango de precios y las zonas que atiendes. Esta es la versión legible por máquina de tu identidad, y debe coincidir con tu Perfil de Negocio de Google exactamente: misma ortografía, mismo número de local, mismo formato de teléfono.

Service para cada servicio principal que ofreces, cada uno en su propia página. Una sola página que lista todo lo que haces es una página compitiendo por todo y ganando nada.

FAQPage donde sea que respondas preguntas reales. Este pesa mucho más de lo que aparenta para la visibilidad en IA, porque le estás entregando literalmente a la máquina pares de pregunta y respuesta ya formateados, justo la forma del contenido que está tratando de generar.

Organization que amarre tu sitio con tus otras presencias: Perfil de Negocio de Google, redes sociales, directorios. La propiedad sameAs es como le dices a las máquinas "todos estos perfiles dispersos son una sola entidad".

Valida todo en validator.schema.org. Un schema roto es peor que ninguno: le señala descuido a sistemas construidos para detectar exactamente eso.

2. llms.txt

El robots.txt le ha dicho a los rastreadores cómo comportarse desde los noventa. El llms.txt es su hermano más nuevo: un archivo en markdown simple en tusitio.com/llms.txt que le da a los sistemas de IA un mapa curado de tu sitio, qué eres, qué contienen tus páginas clave y qué vale la pena leer primero.

¿Es un factor de posicionamiento garantizado? No, y desconfía de quien diga que sí; el estándar es joven y la adopción entre las empresas de IA es despareja. Pero cuesta veinte minutos, varios rastreadores de IA ya lo consultan, y obliga a un ejercicio genuinamente útil: escribir un resumen de una página, en lenguaje claro, de tu negocio, que una máquina pueda tragarse entero. Publicamos uno en cada construcción. El nuestro está en brenro.com/llms.txt por si quieres un ejemplo vivo del que copiar el formato.

3. Consistencia de entidad

Los buscadores y los sistemas de IA en realidad no indexan sitios web, modelan entidades: este negocio, en este lugar, ofreciendo estos servicios, relacionado con estas otras entidades. Tu trabajo es hacer que tu entidad no tenga ambigüedad.

Eso significa que tu nombre, dirección y teléfono sean idénticos carácter por carácter en tu sitio, tu Perfil de Negocio de Google, Apple Maps, Bing Places, Yelp y los directorios que importan en tu zona (para nosotros en el valle, eso incluye los de la cámara de comercio). Significa un solo nombre canónico del negocio, no tres variantes. Significa que tu página de nosotros diga con claridad qué haces y dónde, en oraciones, porque la comprensión de entidad se construye con texto, no con buenas vibras.

Si tu negocio alguna vez se mudó, cambió de marca o cambió de números, da por hecho que existen fichas fantasma y sal a cazarlas. Los datos contradictorios no solo dejan de ayudar: bajan activamente la confianza de la máquina en todo lo demás que declaras.

4. Acceso para rastreadores de IA en específico

Revisa tu robots.txt y cualquier regla de firewall contra los agentes reales de IA: GPTBot, ClaudeBot, PerplexityBot, Google-Extended y compañía. Muchos sitios los bloquean sin saberlo (algunos plugins de seguridad los bloquean por defecto) y después se preguntan por qué no existen en las respuestas de IA. Bloquear rastreadores de IA es una decisión legítima para un medio que protege su contenido. Para un negocio local que quiere que lo recomienden, es dispararle al mensajero.

También: si tu sitio arma todo su contenido con JavaScript, algunos rastreadores de IA ven una página en blanco. El HTML estático o renderizado en el servidor ya no es solo una decisión de rendimiento; es una decisión de visibilidad.

5. Contenido con forma de respuesta

La estructura técnica carga el contenido; no lo reemplaza. Cada página de servicio necesita responder las preguntas que la gente de verdad hace, rangos de costo, tiempos, proceso, "cómo sé si necesito esto", en oraciones completas y citables cerca de la parte de arriba de la página. Los textos de marketing que le quedarían a cualquier negocio de tu industria son, para una IA, indistinguibles del silencio.


Ese es el checklist. Nada de esto es glamoroso. Todo se acumula y, ahorita, en la mayoría de los mercados locales, completar esta lista te pone más o menos en el uno por ciento superior de negocios listos para IA en tu categoría, porque el otro noventa y nueve por ciento no ha empezado.


Preguntas que nos hacen sobre la parte técnica

¿Necesito un desarrollador para esto? Para el schema y el llms.txt, en general no: las plataformas modernas y sus plugins pueden manejar datos estructurados básicos, y el llms.txt es un archivo de texto. Por lo que de verdad le pagas a un profesional es por la corrección (schema validado, sin conflictos) y por lo completo (capas de Service y FAQPage, limpieza de entidad), que es donde normalmente se quedan cortas las implementaciones caseras.

¿Cuál es el punto de mayor impacto de esta lista? Para la mayoría de los negocios locales: marcado FAQPage envuelto alrededor de respuestas genuinamente buenas, encima de un LocalBusiness limpio. Ataca el problema de visibilidad por los dos lados a la vez, estructura legible por máquina y contenido citable.

¿Cómo sé si los rastreadores de IA pueden ver mi sitio? Revisa tu robots.txt en busca de bloqueos a GPTBot, ClaudeBot y PerplexityBot, y después revisa los registros de tu servidor o tus analíticas en busca de visitas de esos agentes. Ninguna visita durante varias semanas normalmente significa un bloqueo o un problema de renderizado que vale la pena investigar.

¿Las empresas de IA de verdad usan llms.txt? La adopción es real pero parcial: algunos rastreadores lo consultan, otros todavía no. Lo tratamos como los negocios inteligentes trataron al schema en sus primeros días: baratísimo, plausiblemente valioso, y mucho mejor tenerlo puesto antes de que importe en todos lados que después.

/ volver al camino