Las cuatro capas
Primero el acceso de los rastreadores: robots.txt tiene que permitir a los agentes que importan, entre ellos GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended y CCBot, y el contenido tiene que sobrevivir con JavaScript desactivado, porque varios de esos agentes no lo ejecutan.
La segunda es la extractabilidad. Un pasaje que responde a la pregunta en su primera frase y se sostiene solo, sin necesitar los tres párrafos anteriores, es la unidad que un modelo puede llevarse. Las tablas, los glosarios y los bloques de preguntas frecuentes son los formatos que mejor aguantan la extracción.
La tercera es el consenso externo, y es la que un sitio no puede arreglar solo: lo que dicen de la entidad las fuentes independientes. Wikidata, plataformas de reseñas, prensa sectorial, foros. Un modelo que encuentra una descripción en tu web y nada en ningún otro sitio no tiene motivo para repetirla.
La cuarta es el formato citable: datos estructurados que coinciden con el contenido visible, fechas que el lector puede ver, cifras con fuente.
En qué se diferencia del SEO
El SEO clásico optimiza la posición en una lista ordenada de enlaces. El GEO optimiza para ser el pasaje que un modelo cita dentro de una respuesta donde no se muestra ninguna lista. La base técnica se solapa casi por completo, las prioridades y las métricas no.
Sobre la medición
Hoy no existe ninguna API pública que dé una cuota de voz fiable dentro de las respuestas de los modelos. La medición es prompting manual periódico de un conjunto fijo de preguntas, registrado en el tiempo para que la tendencia signifique algo. Un proveedor que da un porcentaje exacto de visibilidad está dando una estimación, y conviene pedirle el método.