Teckel AI · Guía
¿Qué es un AI website? Guía auditable del sitio agent-ready
Actualizado: 20 de septiembre de 2026 · Por Teckel AI
Un AI website no es un sitio hecho con inteligencia artificial: es un sitio preparado para reducir barreras de rastreo, extracción, identidad, acciones y medición para sistemas automatizados, sin abandonar la experiencia humana. Esa preparación no garantiza que una plataforma lo encuentre, cite o recomiende. También se le llama sitio agent-ready.
La confusión viene de los builders. Wix, Durable u Hostinger te generan un sitio con IA en minutos, y eso resuelve quién lo construye. Un AI website resuelve el problema opuesto: cómo verificar qué contenido reciben y pueden extraer distintos sistemas automatizados. El tráfico automatizado mezcla buscadores, seguridad, entrenamiento y otros bots; no equivale por sí solo a agentes de IA ni describe el tráfico de tu sitio. Esta guía define la categoría, te enseña las cuatro capas del estándar, te abre 60 días del registro de servidor de este dominio con los 18 agentes de IA que lo leyeron, te da cinco pruebas para auditar tu sitio hoy mismo y te dice qué cuesta arreglarlo.
¿Un sitio hecho con IA no es lo mismo que un AI website?
No, y ahí está el malentendido que más caro les sale a las empresas. Los builders con IA optimizan la producción: plantillas, textos generados, un sitio visible en una tarde. El resultado se ve bien en tu navegador, que ejecuta JavaScript en una pantalla. Los crawlers y agentes pueden recibir y procesar el sitio de forma distinta. Google puede procesar JavaScript y las capacidades de otras plataformas varían; servir el contenido esencial en el HTML recibido reduce dependencias y permite auditar mejor la extracción.
Un AI website se diseña para ese visitante sin abandonar al humano. La pregunta de compra cambió: ya no es solo "¿cómo se ve mi sitio?", ahora es "¿puede un agente de IA extraer mi propuesta de valor, mis precios y mi contacto sin ayuda?". Si la respuesta es no, existe una barrera que conviene medir; no demuestra invisibilidad universal ni que otra empresa vaya a ser citada.
¿Qué hace que un sitio sea agent-ready? Las 4 capas
En Teckel AI formalizamos esto como el estándar AI Website: cuatro capas que se auditan por separado. Un sitio es agent-ready cuando cumple las cuatro.
| Capa | Pregunta que responde | Qué incluye |
|---|---|---|
| 1. Descubrible | ¿Los agentes te encuentran? | Controles de rastreo explícitos, sitemap.xml actualizado, canonical y datos estructurados válidos. llms.txt es documentación opcional, no un factor de ranking demostrado. |
| 2. Legible | ¿Pueden leerte sin ejecutar nada? | Todo el contenido en el HTML servido (estático o server-rendered), respuestas directas al inicio, jerarquía clara de encabezados. |
| 3. Operable | ¿Pueden hacer algo en tu sitio? | Acciones que un agente puede ejecutar: formularios simples, endpoints documentados, hasta un servidor MCP que expone tu catálogo o tus reservas. |
| 4. Reportado | ¿Te enteras de lo que pasó? | Medición del tráfico de agentes: qué bots te leen, qué páginas consultan, con reportes y alertas al dueño del negocio. |
Estas capas son criterios de diseño y auditoría, no factores de ranking garantizados. Su efecto se debe evaluar por cambio controlado, conservando el baseline, las respuestas crudas, las citas y los logs del servidor.
¿Qué tan grande es el tráfico de agentes de IA? 60 días medidos en este sitio
No existe una cifra universal, y los reportes de proveedores mezclan bots de búsqueda, seguridad, entrenamiento y acciones iniciadas por usuarios. Así que en vez de citarte un porcentaje global de la web, te ponemos el nuestro con el universo completo a la vista: el registro de solicitudes al servidor de teckel-ai.com entre el 21 de julio y el 19 de septiembre de 2026, 60 días corridos, clasificado por user agent. Es un solo dominio y una sola muestra, y más abajo te decimos exactamente dónde falla el método.
En esos 60 días entraron 18 agentes de IA distintos con 1,759 solicitudes:
| Agente | Tipo | Solicitudes | Rutas distintas |
|---|---|---|---|
| OAI-SearchBot (OpenAI) | Búsqueda | 355 | 70 |
| ClaudeBot (Anthropic) | Entrenamiento | 316 | 69 |
| ChatGPT-User | Acción de usuario | 248 | 66 |
| GPTBot (OpenAI) | Entrenamiento | 184 | 57 |
| PerplexityBot | Búsqueda | 179 | 56 |
| Amazonbot | Entrenamiento | 138 | 55 |
| Meta-ExternalAgent | Entrenamiento | 115 | 56 |
| GoogleOther | Entrenamiento | 91 | 47 |
| Claude-User | Acción de usuario | 45 | 18 |
| Bytespider (ByteDance) | Entrenamiento | 36 | 36 |
| CCBot (Common Crawl) | Entrenamiento | 14 | 12 |
| Google-Extended | Entrenamiento | 10 | 10 |
| Mistral | Acción de usuario | 8 | 7 |
| Perplexity-User | Acción de usuario | 6 | 6 |
| Cohere | Entrenamiento | 5 | 5 |
| DuckAssistBot | Búsqueda | 4 | 4 |
| Claude-SearchBot | Búsqueda | 4 | 4 |
| YouBot | Búsqueda | 1 | 1 |
Tres lecturas que sí se sostienen con estos números, y ninguna necesita un benchmark ajeno:
- Los agentes de IA pidieron más páginas que los buscadores clásicos. Googlebot, Bingbot, Applebot y DuckDuckBot suman 1,565 solicitudes en la misma ventana. Los 18 agentes de IA suman 1,759, un 12% más. No significa que traigan más visitas: significa que ya son la mayoría de las lecturas de máquina de este sitio.
- 307 de esas 1,759 solicitudes son de acción de usuario. Es el 17%, y es la categoría que de verdad importa comercialmente: ChatGPT-User, Claude-User, Perplexity-User y Mistral solo aparecen cuando una persona, en ese momento, le pidió a un asistente que abriera tu sitio. No es entrenamiento, es alguien evaluándote.
- La lista de agentes crece sola. Cinco de los 18 no existían en el registro en julio y aparecieron por primera vez en septiembre: DuckAssistBot y Mistral el 7, Perplexity-User el 9, Cohere y YouBot el 11. Si construyes para la lista de hoy, en dos meses te faltan cinco.
Para calibrar el tamaño real: en los mismos 60 días hubo 18,553 solicitudes humanas. O sea una solicitud de agente de IA por cada diez y media de persona. El tráfico de agentes no reemplazó al humano, se sumó.
Y cuatro advertencias de método que valen para nuestros números y para los de cualquiera:
- La automatización no equivale a tráfico de IA. Un porcentaje global de bots no describe por sí solo la audiencia de tu sitio.
- El soporte de JavaScript varía. Google puede procesarlo y otros crawlers o agentes tienen capacidades distintas. Servir contenido esencial en HTML reduce una dependencia.
- Rastreo, cita y referral son eventos distintos. Una solicitud del servidor no demuestra que el contenido haya sido citado ni que una persona haya visitado el sitio.
- La conversión se mide en tu propio embudo. Un benchmark de proveedor no sustituye sesiones, leads, oportunidades, contratos, facturas y pagos enlazados.
Lo que más leen no son tus artículos: tres archivos se llevan el 46%
Cuando desglosas esas 1,759 solicitudes por ruta, el resultado incomoda a cualquiera que esté invirtiendo solo en contenido. Las tres rutas más leídas por agentes de IA no son artículos:
| Ruta | Solicitudes de IA | Agentes distintos |
|---|---|---|
| /robots.txt | 409 | 8 |
| / (portada) | 206 | 11 |
| /sitemap.xml | 186 | 5 |
| /en (portada en inglés) | 61 | 7 |
| /en/ai-websites | 30 | 7 |
| /ai-websites | 27 | 9 |
| /en/ai-courses | 22 | 8 |
| /quienes-somos | 20 | 9 |
| /cursos-ai | 19 | 9 |
| /consultoria-ia | 19 | 8 |
Robots.txt, portada y sitemap suman 801 solicitudes, el 45.5% de todo el tráfico de agentes de IA del sitio. La página más leída por máquinas no es una página: es un archivo de texto de reglas. Parte de eso es estructural y hay que decirlo, porque robots.txt se pide al abrir cada sesión de rastreo y por diseño va a ganar cualquier comparación de volumen. Pero la consecuencia práctica no cambia: si esos tres archivos están mal, el agente ya decidió algo sobre tu sitio antes de leer una sola línea de tu copy.
El dato que va contra nuestra propia práctica: llms.txt recibió 3 solicitudes de agentes de IA en 60 días, las tres de GPTBot y las tres el mismo día, el 11 de agosto. Robots.txt recibió 409. Son 136 veces más. El archivo llms.txt tuvo, de hecho, más lecturas humanas (85) que de máquina, que es lo que uno esperaría de auditores y curiosos, no de motores. Nosotros mantenemos llms.txt y lo vamos a seguir manteniendo porque cuesta veinte minutos y no estorba, pero con estos datos no aguanta que te lo vendan como palanca de visibilidad. Si alguien te cotiza AEO y lo primero que te ofrece es un llms.txt, pídele su propia medición.
¿Cuánto tarda un agente de IA en leer una página nueva? 12 páginas medidas
Esta es la pregunta que rompe casi todos los reportes de agencia, porque medir al día siguiente de publicar no mide tu contenido: mide la cola del rastreo. Estas son las 12 páginas que publicamos entre el 3 de agosto y el 18 de septiembre de 2026, con la fecha de la primera lectura de un agente de IA en el log del servidor:
| Página | Publicada | Primera lectura de IA | Días | Primer agente |
|---|---|---|---|---|
| /mejores-consultoras-ia-mexico-2026 | 3 ago | 6 ago | 3 | ClaudeBot |
| /mejores-consultoras-ia-latinoamerica-2026 | 22 ago | 25 ago | 3 | GoogleOther |
| /en/ai-website-vs-normal-website | 26 ago | 3 sep | 8 | Amazonbot |
| /en/how-much-does-ai-implementation-cost | 31 ago | 3 sep | 3 | Amazonbot |
| /en/how-to-get-chatgpt-to-recommend-your-business | 2 sep | 7 sep | 5 | GoogleOther |
| /en/how-much-does-an-ai-sdr-cost | 4 sep | 10 sep | 6 | Amazonbot |
| /en/about-teckel-ai | 6 sep | 7 sep | 1 | GPTBot |
| /cuanto-cuesta-un-agente-de-ia-mexico | 7 sep | 10 sep | 3 | PerplexityBot |
| /chatgpt-fichas-google-maps-mexico | 9 sep | 10 sep | 1 | PerplexityBot |
| /consultoria-ia-mexico | 15 sep | 19 sep | 4 | GoogleOther |
| /en/ai-consulting-mexico | 16 sep | 19 sep | 3 | GoogleOther |
| /en/how-much-does-an-ai-website-cost | 18 sep | 19 sep | 1 | GoogleOther |
La mediana es de 3 días y el rango va de 1 a 8. Ninguna página esperó más de ocho días, y ninguna fue leída el mismo día de publicarse. El primer lector tampoco es siempre el mismo motor: GoogleOther llegó primero en 5 de las 12, Amazonbot en 3, PerplexityBot en 2, ClaudeBot y GPTBot en una cada uno. Ojo con eso: el rastreador que primero te encuentra no suele ser el del motor donde quieres aparecer.
La consecuencia operativa es simple. Si publicas hoy y mides mañana, estás midiendo la cola del rastreo y vas a concluir que tu contenido no sirve. Y el número no es transferible tal cual a tu sitio: son 12 páginas de un solo dominio que tiene sitemap al día, HTML estático y un aviso automático a los motores en cada publicación. Sin eso, lo razonable es esperar más, no menos.
El user agent miente: 64 pedidos de credenciales firmados como GPTBot y ClaudeBot
Todo lo anterior se clasifica por user agent, que es lo que hace cualquier reporte de tráfico agéntico del mercado, y ese método tiene un piso de error que casi nadie publica. Este es el nuestro, medido en la misma ventana de 60 días.
Hubo 64 solicitudes a rutas de credenciales que no existen en este sitio, firmadas por 14 de los 18
agentes de IA, desde 49 direcciones IP distintas. Las rutas pedidas incluyen
/aws/credentials, /.azure/credentials, /.gcloud/credentials,
/terraform.tfstate, /terraform.tfvars, /serverless.yml,
/config/credentials.yml.enc, /@fs/app/rootkey.csv y varios intentos de escape de
directorio hacia /proc/self/environ. Los user agents declarados incluyen GPTBot, OAI-SearchBot,
ChatGPT-User, ClaudeBot, Claude-User, Claude-SearchBot, PerplexityBot, Google-Extended, Amazonbot,
Meta-ExternalAgent, CCBot, Bytespider, Mistral y Perplexity-User.
Corrección del 20 de septiembre de 2026: esta guía publicó el 19 de septiembre la cifra de 14
solicitudes y 10 agentes. Era correcta pero incompleta, porque contaba solo las rutas bajo /@fs/ y
.env. Al ampliar la consulta a todo el conjunto de rutas de credenciales y de infraestructura como
código, la cifra real de la misma ventana es 64. Se corrige aquí en vez de dejarla como estaba, que es lo que
exige publicar tu propio margen de error.
Ningún rastreador legítimo pide un archivo de llaves de AWS. Lo que estás viendo es un escáner de vulnerabilidades poniéndose el nombre de un crawler de IA para pasar filtros. Son 64 de 1,759 solicitudes, el 3.6%, así que no mueve las conclusiones de arriba, pero sí fija el piso de confianza del método: el user agent es una cadena de texto que cualquiera escribe, y una tabla de tráfico agéntico sin verificación de origen es una tabla de lo que los visitantes dijeron ser.
Esto es exactamente lo que separa la capa 3 del estándar, la operable, de las otras tres. Descubrible, legible y
reportado se pueden abrir a todo el mundo. Operable no: si vas a dejar que un agente consulte inventario,
cotice o agende, la puerta no se abre por nombre, se abre por identidad verificada. Los dos operadores más
grandes publican sus rangos de IP justo para eso. OpenAI los lista en
openai.com/gptbot.json, openai.com/searchbot.json y
openai.com/chatgpt-user.json. Anthropic los lista en claude.com/crawling/bots.json, y
su documentación de soporte lo dice sin rodeos: "If a crawler has a source IP address on this list, it
indicates that the crawler is coming from Anthropic". Verificado contra la fuente el 19 de septiembre de 2026.
¿Qué dice la investigación revisada sobre lo que mueve la visibilidad?
Hay un trabajo académico que vale la pena conocer antes de contratar a nadie: GEO: Generative Engine Optimization, de Pranjal Aggarwal, Vishvak Murahari, Tanmay Rajpurohit, Ashwin Kalyan, Karthik Narasimhan y Ameet Deshpande, presentado en KDD 2024. Los autores lo definen como "the first novel paradigm to aid content creators in improving their content visibility in generative engine responses", y su resultado principal, textual, es que "GEO can boost visibility by up to 40% in generative engine responses".
Dos cosas que el paper sí sostiene y que coinciden con lo que este sitio hace: las tácticas que más movieron la visibilidad en sus pruebas fueron citar a expertos con su frase textual y respaldar afirmaciones con estadísticas de fuente nombrada. No fue meter más palabras clave.
Y la advertencia honesta, que el propio paper deja clara: ese 40% está medido en su banco de pruebas contra un motor generativo construido por ellos, no en tu sitio ni dentro de ChatGPT comercial. Sirve como dirección de trabajo, no como promesa de resultado. Si alguien te ofrece ese 40% como garantía, te está vendiendo un número de laboratorio como si fuera un contrato.
¿Cómo saber si tu sitio ya es agent-ready? Cinco pruebas para hoy
No necesitas a nadie técnico para las cinco. Diez minutos y sales de la duda:
- 1. Revisa la respuesta HTML. Abre "Ver código fuente" o usa
curl tudominio.com. Busca el texto principal. Si depende del renderizado, anótalo como una barrera potencial, no como prueba de invisibilidad universal. - 2. Revisa tu robots.txt. Abre tudominio.com/robots.txt y busca las reglas aplicables a los agentes que quieres medir. Un bloqueo puede impedir el rastreo de ese agente, pero permitirlo no garantiza una cita ni una recomendación.
- 3. Busca tu sitemap. Abre tudominio.com/sitemap.xml y confirma que esté al día. Si existe llms.txt, trátalo como documentación complementaria; no hay evidencia pública suficiente para presentarlo como factor de ranking.
- 4. Pregúntale a la IA por tu empresa. Abre ChatGPT o Perplexity y escribe "¿qué hace [tu empresa]?". Registra si te describe bien, te confunde con otra entidad, omite datos o presenta afirmaciones sin respaldo. La observación no demuestra por sí sola la causa.
- 5. Revisa los logs del servidor. La analítica del navegador no cubre todas las solicitudes automatizadas. Los logs aportan una señal complementaria, pero un user-agent por sí solo no demuestra identidad, intención ni una recomendación.
Si encuentras dos o más barreras, prioriza una auditoría técnica. El diagnóstico final requiere observar varios agentes y distinguir elegibilidad, extracción, cita y recomendación.
¿Cuánto cuesta un AI website?
En Teckel AI los AI Websites parten de $2,500 USD e incluyen las cuatro capas del estándar: sitio descubrible, legible, operable y reportado. Esas capas mejoran la preparación técnica, pero no garantizan visibilidad, citas ni ventas. Si primero quieres saber dónde está parado tu sitio actual, el diagnóstico inicial es sin costo.
teckel-ai.com es la demo viva
Este sitio aplica lo que describe, y por eso cada número de esta guía sale de su propio registro de servidor y no de un reporte ajeno. Cada página se sirve como HTML estático con datos estructurados, y guardamos cada solicitud con su user agent, su ruta y su hora. De ahí salen las 1,759 solicitudes de agentes de IA, la mediana de 3 días hasta la primera lectura y las 64 solicitudes falsificadas que te mostramos arriba. Esa última cifra es la que mejor explica el límite del método: los hits pueden falsificarse y no prueban una cita, una recomendación, una visita humana ni un resultado comercial. La medición útil conserva esas capas por separado y publica su propio margen de error, que es lo que acabamos de hacer.
Pide tu diagnóstico sin costoO escríbenos directo por WhatsApp: +52 55 3216 1578 · george@teckel-ai.com
Preguntas frecuentes
¿Qué es un AI website?
Un AI website es un sitio preparado para reducir barreras de rastreo, extracción, identidad, acciones y medición para sistemas automatizados, sin abandonar la experiencia humana. Esa preparación no garantiza que una plataforma lo encuentre, cite o recomiende. También se le llama sitio agent-ready.
¿Un sitio hecho con Wix, Durable u otro builder de IA es un AI website?
No necesariamente. Los builders resuelven cómo se construye el sitio. Un sitio preparado para AI Discovery busca que el contenido sea elegible, extraíble y atribuible por distintos motores. Ninguna tecnología, dato estructurado o archivo garantiza que un answer engine lo cite.
¿Qué significa que un sitio sea agent-ready?
Que reduce barreras técnicas para distintos agentes: controles de rastreo explícitos, sitemap actualizado, HTML extraíble, identidad consistente, acciones documentadas y medición del tráfico del servidor. llms.txt puede servir como documentación complementaria, pero no es un factor de ranking demostrado.
¿Cómo sé si mi sitio es invisible para la IA?
No hay una sola prueba. Revisa el HTML recibido, robots.txt, códigos HTTP, canonical, sitemap y logs del servidor, y repite consultas controladas en varios motores. Google puede procesar JavaScript, mientras que las capacidades de otros agentes varían; por eso la conclusión debe basarse en observaciones, no en una regla absoluta.
¿Tengo que rehacer mi sitio desde cero para volverlo agent-ready?
No siempre. Primero hay que auditar qué contenido recibe cada agente, qué bloqueos existen y qué evidencia falta. Servir contenido esencial en HTML suele reducir dependencia del renderizado, pero el cambio adecuado depende de la plataforma y no garantiza citas ni recomendaciones.
¿Cuánto cuesta un AI website?
En Teckel AI los AI Websites parten de $2,500 USD e incluyen las cuatro capas del estándar: descubrible, legible, operable y reportado. El diagnóstico inicial de tu sitio actual es sin costo.
¿Cuánto tarda un crawler de IA en leer una página nueva?
En teckel-ai.com, medido sobre 12 páginas publicadas entre el 3 de agosto y el 18 de septiembre de 2026, la mediana fue de 3 días y el rango de 1 a 8 días. Ninguna se leyó el mismo día de publicarse. El primer lector fue GoogleOther en 5 de las 12 páginas, Amazonbot en 3, PerplexityBot en 2, ClaudeBot y GPTBot en una cada uno. Es un solo dominio con sitemap al día, HTML estático y aviso automático a los motores; un sitio sin eso suele esperar más.
¿Sirve de algo el archivo llms.txt?
Como documentación complementaria puede servir. Como palanca de visibilidad no hay evidencia pública suficiente. En 60 días de registro de este sitio, llms.txt recibió 3 solicitudes de agentes de IA, las tres de GPTBot y el mismo día, frente a 409 solicitudes de robots.txt. Son 136 veces menos. Mantenerlo cuesta poco, pero si una propuesta de AEO empieza por ahí, pide la medición que la respalde.
¿Cómo verifico que un bot que dice ser GPTBot realmente lo sea?
Por la IP de origen, no por el user agent, que es una cadena de texto que cualquiera escribe. OpenAI publica sus rangos en openai.com/gptbot.json, openai.com/searchbot.json y openai.com/chatgpt-user.json, y Anthropic en claude.com/crawling/bots.json. En 60 días este sitio recibió 64 solicitudes a rutas de credenciales firmadas por 14 de los 18 agentes de IA que registramos, entre ellos GPTBot, ClaudeBot y PerplexityBot, desde 49 IP distintas; ningún rastreador legítimo pide un archivo de llaves de AWS.
Para profundizar: agencia de IA vs consultora de IA, cuál necesita tu empresa, qué hace nuestra consultoría de IA aplicada y los mejores cursos de IA del mundo.
Volver al inicio