---
title: "Contenido citable por IA: qué demuestra el paper GEO de Princeton"
description: "El paper GEO de Princeton midió qué gana citas de la IA: fuentes, citas textuales y estadísticas subieron la cuota de respuesta un 30-40%. Evidencia y límites."
lang: es
canonical: https://upgradepro.eu/es/blog/citable-content
published: 2026-07-16
tags: ["GEO", "contenidos"]
---

# Contenido citable por IA: qué demuestra el paper GEO de Princeton

> El paper GEO de Princeton midió qué gana citas de la IA: fuentes, citas textuales y estadísticas subieron la cuota de respuesta un 30-40%. Evidencia y límites.

Contenido citable por IA es aquel que un motor generativo puede extraer, verificar y atribuir: una respuesta directa en las primeras líneas, estadísticas ligadas a fuentes con nombre, citas textuales de expertos identificables y encabezados que calcan las preguntas reales del usuario. El efecto se mide. El paper GEO de Princeton encontró que optimizar el contenido puede aumentar la visibilidad en las respuestas de los motores generativos hasta un 40%, mientras que el truco clásico del keyword stuffing no aporta casi nada.

## ¿Qué hace que un contenido sea citable cuando el buscador es una IA?

Una cita en una respuesta de IA es el enlace o la atribución que ChatGPT, Perplexity o Google AI Overviews adjunta a una afirmación concreta de su respuesta. Ganarse esas atribuciones es el objetivo entero de la [optimización para motores generativos](/es/blog/what-is-geo).

Los motores generativos no muestran diez enlaces azules. Componen una respuesta y acreditan a un puñado de páginas, así que la unidad de competición ya no es la página: es el pasaje extraíble y verificable. Tu párrafo compite por ser la frase que el modelo cita. Eso cambia lo que significa escribir bien: primero la respuesta, la evidencia pegada al lado y las entidades por su nombre.

La evidencia que sigue viene de un experimento con revisión por pares, varios estudios de citación y de keywords a gran escala publicados por vendors, la documentación oficial de Google y un contrapunto académico. Cada número está copiado exactamente como se publicó.

## ¿Qué midió realmente el experimento GEO de Princeton?

El paper "GEO: Generative Engine Optimization" (Pranjal Aggarwal, Vishvak Murahari et al., Princeton University e IIT Delhi, aceptado en KDD 2024) fue un experimento controlado sobre qué hace que un motor generativo cite una página. Su abstract afirma que la optimización puede aumentar la visibilidad hasta un 40% en las respuestas de los motores generativos ([arXiv 2311.09735](https://arxiv.org/abs/2311.09735), junio de 2024).

El equipo construyó GEO-bench, un benchmark de 10.000 consultas de varios dominios (8.000 de entrenamiento, 1.000 de validación, 1.000 de test), y midió el Position-Adjusted Word Count: una métrica que pondera cuánto de la respuesta del motor sale de tu página según dónde aparece. Se probaron nueve tácticas de redacción frente a contenido sin optimizar.

Antes de las tácticas conviene un matiz: los porcentajes del paper describen cuota de la respuesta de la IA, no tráfico. Quien te revenda ese 40% como una promesa de tráfico se está pasando de frenada. En UpgradePro cada cifra así llevaría una etiqueta MEDIDO, CALCULADO o SUPUESTO — esta es medida, sobre esa métrica concreta.

## ¿Qué tácticas consiguen más citas en los motores de IA?

Ganaron tres tácticas, y las tres suman verificabilidad. Según la [sección de resultados](https://arxiv.org/html/2311.09735v3) del paper (junio de 2024), los métodos con mejor rendimiento —Cite Sources, Quotation Addition y Statistics Addition— lograron una mejora relativa del 30-40% en la métrica Position-Adjusted Word Count frente al contenido sin optimizar.

| Táctica | En qué consiste | Efecto medido | Funciona mejor en |
|---|---|---|---|
| Citar fuentes | Enlazar cada afirmación factual a fuentes primarias verificables | Grupo top: 30-40% de mejora relativa | Preguntas factuales, Law & Government |
| Añadir citas textuales | Incluir citas breves y atribuidas de voces con autoridad | Lo mejor en real: 22% de mejora en Perplexity.ai | People & Society, Explanation, History |
| Añadir estadísticas | Sustituir afirmaciones vagas por cifras con origen | Grupo top: 30-40% de mejora relativa | Law & Government, Debate, Opinion |
| Keyword stuffing | Repetir las palabras clave objetivo en el texto | Poca o ninguna mejora; por debajo del baseline en las tablas del paper | Nada — una inercia del SEO de siempre |

Dos hallazgos merecen énfasis. El primero: en la prueba en el mundo real sobre Perplexity.ai ("GEO in the wild"), Quotation Addition fue la táctica más eficaz de todas, con un 22% de mejora en Position-Adjusted Word Count. El segundo: el keyword stuffing —el reflejo de una década de SEO barato— ofreció poca o ninguna mejora y se quedó por debajo del baseline sin optimizar.

El efecto también varía según el dominio, como muestra la tabla: las estadísticas rinden más en temas de debate y opinión, citar fuentes en preguntas factuales, y las citas textuales en contenidos de personas, historia y explicación.

## ¿Por qué estas tácticas favorecen a las webs pequeñas?

El hallazgo del que menos se habla es un efecto igualador: cuando las páginas peor posicionadas añadieron citas de fuentes, la visibilidad se redistribuyó a costa del que mandaba ([paper GEO, sección 5.2](https://arxiv.org/html/2311.09735v3), junio de 2024):

> "…a substantial 115.1% increase in visibility for websites ranked fifth in SERP, while on average, the visibility of the top-ranked website decreased by 30.3%."
> — Paper GEO, sección 5.2, junio de 2024

En la búsqueda clásica, la posición cinco es donde los clics se van a morir. En las respuestas de IA, una página bien documentada en posición cinco puede ganarle la cita al líder del mercado. Para una pyme que nunca va a superar en presupuesto de enlaces al incumbente, esta es la rendija práctica.

## ¿Cómo estructurar una página para que los motores de IA la extraigan?

La estructura decide si tu evidencia llega a encontrarse. Un estudio de Kevin Indig sobre 1,2 millones de respuestas de IA y 18.012 citas verificadas de ChatGPT, recogido por [Search Engine Land](https://searchengineland.com/chatgpt-citations-content-study-469483) (febrero de 2026), encontró tres patrones:

- El 44,2% de las citas salen del primer 30% del contenido de la página, el 31,1% del tramo medio y el 24,7% del final. Adelanta tus conclusiones.
- El 78,4% de las citas ligadas a preguntas estaban vinculadas a encabezados H2 — estructura pregunta-respuesta, tipo FAQ.
- El contenido más citado tiene alta densidad de entidades (20,6% de nombres propios frente al 5-8% habitual) y lenguaje definitorio ("X es…"), y el estilo claro le gana a la densidad académica.

La guía oficial de Google apunta en la misma dirección, sin misticismo. Su [guía de optimización para las funciones de IA](https://developers.google.com/search/docs/fundamentals/ai-optimization-guide) (actualizada el 10 de julio de 2026) afirma que no hay requisitos técnicos adicionales más allá de ser indexable y apto para snippet, recomienda párrafos, secciones y encabezados claros — y dice explícitamente que puedes ignorar el "chunking", que Google ignora los archivos llms.txt y que el structured data no es un requisito para sus funciones de IA. El structured data [sigue valiendo la pena por otros motivos](/es/blog/structured-data-ai), pero no es la entrada.

> "Creating content that people find unique, compelling, and useful will likely influence your website's presence in generative AI search more than any other suggestions."
> — Google Search Central, guía de optimización para las funciones de IA, julio de 2026

## ¿La frescura influye en que los motores de IA te citen?

Para la mayoría de los asistentes sí, con una gran excepción. [Ahrefs](https://ahrefs.com/blog/do-ai-assistants-prefer-to-cite-fresh-content/) analizó 16,975 millones de citas de asistentes de IA (Ryan Law, julio de 2025) y encontró que el contenido citado por asistentes de IA es de media un 25,7% más reciente que el de los resultados orgánicos de Google: 1.064 días desde la publicación frente a 1.432.

El sesgo no es uniforme. ChatGPT es el motor más volcado en lo reciente: cita contenido de 958 días de media. Google AI Overviews es el que menos sesgo muestra, con 1.432 días — idéntico al orgánico.

Lectura práctica: las fechas de publicación visibles y las actualizaciones de verdad rinden sobre todo en ChatGPT. AI Overviews se comporta como el Google de siempre, donde la frescura por sí sola mueve poco.

## ¿Pesan más las menciones de marca que los backlinks?

Para la visibilidad en IA, los datos de correlación dicen que sí. Un [estudio de Ahrefs sobre 75.000 marcas](https://ahrefs.com/blog/ai-overview-brand-correlation/) (Louise Linehan y Xibeijia Guan, mayo de 2025) encontró que las menciones de una marca en la web son el factor que más correlaciona con la visibilidad en AI Overviews, con 0,664 — muy por encima de los backlinks (0,218), los dominios de referencia (0,295) y el Domain Rating (0,326). Que hablen de ti en sitios de terceros pesa más que el perfil de enlaces que el SEO lleva dos décadas puliendo.

Los perfiles de fuentes también cambian según el motor. Según el análisis de patrones de citación publicado por Profound, vendor de tracking (2025), Wikipedia es la fuente más citada por ChatGPT, con un 7,8% del total de citas, mientras que Reddit lidera en Google AI Overviews y Perplexity. Estar presente en varias plataformas de terceros bate a apostarlo todo a una — desmenuzamos la mecánica en [cómo eligen los motores de IA lo que citan](/es/blog/how-ai-engines-cite).

## ¿Qué consultas disparan una respuesta de IA?

Escribir de forma citable solo paga donde las respuestas de IA aparecen de verdad. El estudio de Semrush sobre más de 10 millones de keywords ([actualización de diciembre de 2025](https://www.semrush.com/blog/semrush-ai-overviews-study/)) siguió los AI Overviews de Google durante 2025: su presencia creció del 6,49% de las consultas en enero a un pico del 24,61% en julio. La cuota de consultas activadoras que eran informativas cayó del 91,3% en enero al 57,1% en octubre, mientras las comerciales crecían del 8,15% al 18,57%. Y casi el 60% de las keywords que activan un AI Overview tienen 100 o menos búsquedas mensuales.

Un análisis anterior de Semrush sobre 200.000 keywords informó de que el 57,9% de las consultas con formato de pregunta (quién, qué, por qué, cómo) activaban un AI Overview. La superficie a conquistar es long tail y con forma de pregunta — justo lo que las páginas de especialidad de una pyme pueden cubrir y un portal genérico no.

## ¿Siempre funcionan las tácticas GEO?

No, y el aviso más serio viene de la academia, no de los vendors. C-SEO Bench (Puerto, Gubri et al., Parameter Lab, TU Darmstadt y NAVER AI Lab, junio de 2025) probó nueve métodos de SEO conversacional en seis dominios y llegó a una conclusión sobria:

> "…most current C-SEO methods are largely ineffective … traditional SEO strategies, those that improve retrieval ranking, remain essential."
> — C-SEO Bench ([arXiv 2506.11097](https://arxiv.org/html/2506.11097v1)), junio de 2025

Los dos papers son reconciliables. Las tácticas GEO mejoran cuánta respuesta te llevas una vez que tu página ya está dentro del conjunto de recuperación del modelo. Si tu página nunca entra en ese conjunto —porque no posiciona, no es indexable o no es apta para snippet—, ninguna táctica de redacción te salva. Por eso nuestro [método](/es/method) empieza por una auditoría baseline: primero medir el retrieval, después optimizar la extracción, y volver a medir.

## ¿Qué puede hacer tu empresa esta semana?

Una checklist que una pyme puede ejecutar sin comprar ninguna herramienta:

1. Enumera las diez preguntas que tus clientes hacen de verdad. Convierte cada una en un H2 con sus mismas palabras.
2. Responde cada H2 en sus dos primeras frases y luego desarrolla. El lenguaje definitorio funciona: "X es…".
3. Sube las conclusiones clave al primer 30% de cada página importante — de ahí salen el 44,2% de las citas de ChatGPT.
4. Añade dos o tres estadísticas por página clave: cifra, fuente, fecha y enlace inline a la fuente primaria.
5. Añade una cita textual breve de un experto con nombre o de una fuente primaria, con atribución — la táctica que ganó en Perplexity.
6. Cita fuentes verificables para las afirmaciones factuales. Enlaza el estudio original, no el blog que lo recicla.
7. Nombra entidades: productos, empresas, normas, lugares. Fuera pronombres vagos y relleno.
8. Muestra las fechas de publicación y actualización, y refresca de verdad las páginas rancias — ChatGPT es el que más premia lo reciente.
9. Persigue menciones en terceros (prensa sectorial, directorios del sector, páginas de partners): correlación 0,664 frente al 0,218 de los backlinks.
10. Mantén intacta la base SEO: indexable, apta para snippet, posicionando en el long tail. Olvida el llms.txt para Google — Google dice que lo ignora.

Hay una disciplina que lo cose todo: etiqueta cada número que publiques como medido, calculado o supuesto, para que tus lectores —y las máquinas— distingan la evidencia del adorno. Si quieres un baseline antes/después de dónde te citan hoy los motores de IA, eso es exactamente lo que mide nuestro [servicio de visibilidad en IA](/es/services/ai-visibility).

## Preguntas frecuentes

### ¿Qué demostró exactamente el paper GEO de Princeton?

Que optimizar el contenido puede aumentar su visibilidad en las respuestas de los motores generativos hasta un 40%. El equipo probó nueve tácticas sobre GEO-bench, un benchmark de 10.000 consultas; las tres ganadoras fueron citar fuentes, añadir citas textuales de expertos y añadir estadísticas, con una mejora relativa del 30-40% en la métrica Position-Adjusted Word Count. El paper, de Aggarwal, Murahari et al., fue aceptado en KDD 2024.

### ¿Qué tácticas mejoran más las citas en motores de IA?

Según el experimento de Princeton: citar fuentes verificables, incluir citas textuales de fuentes con autoridad y añadir estadísticas con un origen claro. Las tres suman verificabilidad al texto. En la prueba real sobre Perplexity.ai, añadir citas textuales fue la táctica más eficaz, con un 22% de mejora en Position-Adjusted Word Count —una métrica de cuota de respuesta, no de tráfico ni de clics—, y el efecto de cada táctica varía según el dominio.

### ¿Sirve el keyword stuffing para salir en las respuestas de IA?

No. El mismo estudio encontró que rellenar el texto de palabras clave ofrece poca o ninguna mejora en los motores generativos, y en las tablas del paper queda por debajo del contenido sin optimizar. La guía oficial de Google va en la misma línea: no hacen falta trucos. Google ignora los archivos llms.txt, dice que puedes olvidarte del chunking y aclara que el structured data no es un requisito para sus funciones de IA.

### ¿Dónde conviene colocar la respuesta dentro de la página?

Arriba. El estudio de Kevin Indig sobre 18.012 citas verificadas de ChatGPT encontró que el 44,2% de las citas salen del primer 30% de la página, y que el 78,4% de las citas ligadas a preguntas estaban vinculadas a encabezados H2 en formato pregunta-respuesta. Empieza por la respuesta directa, usa encabezados que calquen la pregunta del usuario y prefiere una estructura de briefing a la narrativa larga.

### ¿La frescura del contenido influye en que la IA te cite?

Depende del motor. Ahrefs analizó casi 17 millones de citas: el contenido citado por asistentes de IA es de media un 25,7% más reciente que el de los resultados orgánicos, y ChatGPT es el más sesgado hacia lo nuevo, con 958 días de media. Google AI Overviews es el que menos sesgo de frescura muestra —1.432 días de media, igual que el orgánico—, así que las fechas visibles y las actualizaciones reales rinden sobre todo en ChatGPT.

### ¿Puede una pyme competir con marcas grandes en las respuestas de IA?

Ahí es donde más margen hay. El paper GEO encontró un efecto igualador: citar fuentes aumentó un 115,1% la visibilidad de los sitios en la posición cinco de los resultados, mientras el primero perdía de media un 30,3%. El límite, según C-SEO Bench, es el retrieval: el SEO tradicional sigue siendo la base y las tácticas GEO se aplican encima.

## Fuentes

Cada afirmación de este artículo enlaza a la fuente de la que procede, con su fecha de publicación.

- [Aggarwal et al., GEO: Generative Engine Optimization (arXiv 2311.09735, abstract)](https://arxiv.org/abs/2311.09735) — 2024-06-28
- [Aggarwal et al., GEO paper texto completo (arXiv 2311.09735, HTML v3)](https://arxiv.org/html/2311.09735v3) — 2024-06-28
- [Puerto, Gubri et al., C-SEO Bench: Does Conversational SEO Work? (arXiv 2506.11097)](https://arxiv.org/html/2506.11097v1) — 2025-06-12
- [Google Search Central — Guía de optimización para las funciones de IA](https://developers.google.com/search/docs/fundamentals/ai-optimization-guide) — 2026-07-10
- [Ahrefs (Ryan Law) — Do AI Assistants Prefer to Cite Fresh Content?](https://ahrefs.com/blog/do-ai-assistants-prefer-to-cite-fresh-content/) — 2025-07-28
- [Ahrefs (Linehan, Guan) — AI Overview Brand Correlation Study](https://ahrefs.com/blog/ai-overview-brand-correlation/) — 2025-05-26
- [Search Engine Land (Danny Goodwin) — Estudio de citas de ChatGPT de Kevin Indig](https://searchengineland.com/chatgpt-citations-content-study-469483) — 2026-02-18
- [Semrush AI Overviews Study (actualización 2025)](https://www.semrush.com/blog/semrush-ai-overviews-study/) — 2025-12-15
- [Semrush — We Studied 200,000 AI Overviews](https://www.semrush.com/blog/ai-overviews-study/) — 2024
- [Profound — AI Platform Citation Patterns](https://www.tryprofound.com/blog/ai-platform-citation-patterns) — 2025
