Cómo la IA de Google decide quién aparece (y qué hicimos para aparecer)
¿Cómo elige la IA de Google qué sitios citar?
No por el ranking tradicional: análisis del sector muestran que solo cerca de un tercio de las fuentes citadas en los AI Overviews está entre los diez primeros resultados orgánicos. La IA necesita poder leer la página, encontrar estructura extraíble (preguntas, respuestas directas, listas, FAQ en el HTML), señales de confianza (autor, credenciales, fuentes) y un fragmento que responda literalmente la pregunta.
Durante veinte años la regla era una: aparecer en la primera página de Google. La IA rompió esa regla sin avisar. Hoy, cuando alguien pregunta algo y Google responde con un resumen generado por IA, las fuentes que aparecen ahí se eligen con otra lógica. Análisis del sector muestran que solo un tercio de las páginas citadas en los AI Overviews está entre los diez primeros resultados orgánicos, y casi la mitad ni siquiera está entre los cincuenta. Es decir: se puede ser citado sin rankear, y rankear sin ser citado. Esta semana Google dio un paso más en esa dirección, y nosotros pasamos la semana auditando nuestro propio blog para entender el juego desde adentro. Este artículo es lo que aprendimos.
Qué cambió esta semana
Google lanzó un botón de "fuentes preferidas" que cualquier sitio puede incrustar en sus propias páginas. El lector hace clic, y desde ahí Google muestra ese sitio con más frecuencia en noticias, en los AI Overviews y en el AI Mode. Más de 600 mil fuentes ya fueron marcadas por usuarios desde que la función apareció dentro del buscador. Lee lo que esto significa: Google está admitiendo que la elección de fuentes por la IA necesita una señal humana directa, porque el ranking tradicional no está dando abasto.
Qué dice Google que pesa (y qué no dice)
La guía oficial de Google para aparecer en las funciones de IA es, a propósito, poco específica: contenido hecho para personas, bien estructurado, con experiencia y autoridad demostrables (el famoso E-E-A-T), y ninguna marcación especial. No existe un "schema de AI Overview" ni una etiqueta mágica. Lo que existe, observando lo que la IA efectivamente cita, son cuatro puertas que tu página debe atravesar en secuencia:
- Acceso. La IA tiene que poder leer la página. Parece obvio, y es donde la mayoría falla sin saberlo.
- Estructura. Títulos en forma de pregunta, respuestas directas en los primeros párrafos, listas, tablas, preguntas frecuentes visibles en el HTML. La IA extrae fragmentos, no lee artículos; un fragmento que no se sostiene solo no se cita.
- Confianza. Quién escribió, con qué credencial, citando qué fuentes. La IA descuenta afirmaciones sin autor y números sin origen.
- Respuesta. La pregunta del usuario necesita una respuesta literal, completa y corta en algún lugar de la página. Si la respuesta está diluida en tres párrafos, la IA encuentra otra página donde está en uno.

Qué descubrimos auditando nuestro propio blog
Corrimos una auditoría completa de GEO (Generative Engine Optimization, la optimización para motores generativos) en el blog de Data Lover. La nota inicial fue 51 de 100, y el motivo principal fue vergonzoso de tan simple: nuestro robots.txt invitaba explícitamente a los robots de ChatGPT, Claude y Perplexity a leer el sitio, y una regla por defecto de Cloudflare, nuestra capa de protección, estaba bloqueando exactamente a esos robots con error 403. Todo el trabajo de contenido era invisible para la mitad de las IAs. Un clic en el panel lo resolvió. La primera puerta estaba cerrada y no lo sabíamos.
El resto de la lista es lo que recomendamos a cualquier empresa, porque nos equivocamos en casi todo antes de corregir:
- Preguntas frecuentes escondidas. Nuestro FAQ tenía la primera respuesta visible y las otras cuatro solo aparecían al hacer clic. Para una IA que lee el HTML, el 80% del FAQ no existía. Ahora todas las respuestas van en el código, colapsadas solo visualmente.
- Números sin fuente. Artículos sobre salarios y consumo de energía decían "los estudios indican" sin enlazar ningún estudio. Lo cambiamos por fuentes nombradas y enlazadas: Robert Half, State of Data, Epoch AI, la revista Science.
- Autor sin entidad. La firma era texto suelto. Creamos una página de autor con credenciales, foto y perfiles, y conectamos todo con datos estructurados (Person, BlogPosting, FAQPage).
- Respuesta rápida arriba. Cada artículo ahora abre con una pregunta y una respuesta de 40 a 60 palabras, el formato exacto que los resúmenes de IA recortan.
- llms.txt. Un archivo de texto en la raíz del sitio (estándar abierto) que presenta el sitio y las páginas principales a los modelos de IA, como el robots.txt hace con los buscadores.
Checklist para tu empresa
- Prueba el acceso hoy: pídele a ChatGPT o a Perplexity que resuma una página de tu sitio. Si no puede, nada más importa.
- Una pregunta, una respuesta: para cada página importante, escribe la pregunta que haría el cliente y respóndela en un párrafo arriba.
- Muestra quién habla: autor con nombre, cargo y página propia; empresa con dirección, teléfono y perfiles consistentes.
- Cita lo que afirmas: todo número con fuente enlazada.
- Datos que solo tú tienes: investigación propia, casos reales, precios practicados. Es el único contenido que la IA no encuentra en otro lado y necesita citarte para usar.
- Activa el botón de fuentes preferidas y pide a tus clientes que hagan clic: es señal humana directa para Google.
La búsqueda tradicional premiaba a quien rankeaba. La búsqueda con IA premia a quien responde, con prueba y con nombre. Es más trabajo, pero es un juego más honesto: esta vez, la página pequeña con la respuesta correcta le gana a la página grande con la respuesta vaga. Empezamos a jugar esta semana; el marcador lo contamos en un mes.
Preguntas frecuentes
No por el ranking tradicional: análisis del sector muestran que solo cerca de un tercio de las fuentes citadas en los AI Overviews está entre los diez primeros resultados orgánicos. La IA necesita poder leer la página, encontrar estructura extraíble (preguntas, respuestas directas, listas, FAQ en el HTML), señales de confianza (autor, credenciales, fuentes) y un fragmento que responda literalmente la pregunta.
Un botón que los sitios pueden incrustar en sus propias páginas; cuando el lector hace clic, Google muestra ese sitio con más frecuencia en noticias, en los AI Overviews y en el AI Mode. Más de 600 mil fuentes ya fueron marcadas por usuarios desde que la función llegó al buscador.
No. Google afirma que no hay schema ni etiqueta específica para las funciones de IA. Los datos estructurados (Article, FAQPage, Person) ayudan a la IA a entender la página, pero lo que pesa es contenido hecho para personas, bien estructurado y con experiencia y autoridad demostrables.
Es la optimización de contenido para ser leído, entendido y citado por motores generativos como ChatGPT, Claude, Perplexity y los AI Overviews de Google. Incluye liberar el acceso de los robots de IA, estructurar respuestas directas, exponer los FAQ en el HTML, citar fuentes, tener un autor identificable y publicar un archivo llms.txt.
Bloquear a los robots de IA sin saberlo: reglas de protección por defecto (como las de Cloudflare) pueden devolver error 403 a los crawlers de ChatGPT, Claude y Perplexity aunque el robots.txt los autorice. Fue exactamente lo que encontramos en la auditoría de nuestro blog, y un clic en el panel lo resolvió.

Ejecutivo de datos e IA con más de 20 años construyendo tecnología que mueve negocios. Microsoft Certified Trainer, con formación ejecutiva en MIT Sloan. Al frente de Data Lover, forma profesionales y lidera proyectos de IA en empresas.
Ver perfil y todos los artículos →

