Claude introduce un doble filtro al leer páginas web y cambia el SEO para IA

Un supuesto system prompt filtrado de Claude Opus 5.5 apunta a un cambio relevante en la forma en que el asistente procesa páginas web: el contenido recuperado mediante WebFetch se convierte primero a Markdown y después pasa por un modelo pequeño y rápido que responde a una instrucción concreta de Opus. El modelo principal recibiría así el resultado de esa extracción, en lugar de la página completa.

Las claves del nuevo sistema de lectura de Claude en 20 segundos

  • Un prompt filtrado describe WebFetch como una cadena de extracción a Markdown seguida de un modelo pequeño.
  • Opus recibiría la respuesta relevante de ese modelo, no necesariamente todo el contenido original.
  • Claude ya utiliza búsqueda web y WebFetch para consultar información actual y páginas concretas.
  • La investigación de Claude realiza búsquedas sucesivas en las que cada resultado puede condicionar el siguiente.
  • Para SEO, la cuestión pasa a ser también qué información consigue extraer y considerar relevante el modelo intermedio.

La información procede de un repositorio público que recopila supuestos system prompts de distintos modelos y herramientas de IA. El documento atribuido a Claude Opus 5.5 incluye una definición de WebFetch que indica que recupera una URL, convierte la página a Markdown y responde a una instrucción mediante un modelo pequeño y rápido. La existencia del archivo permite analizar su contenido, pero no constituye por sí sola una confirmación oficial de Anthropic sobre todos los detalles de su arquitectura interna.

La diferencia tiene interés para quienes trabajan en posicionamiento en buscadores y, cada vez más, en visibilidad dentro de respuestas generadas por inteligencia artificial. Hasta ahora, una explicación habitual del proceso era que un modelo recibía el contenido recuperado de una página y lo utilizaba como contexto para responder. El flujo descrito en el supuesto prompt introduce una capa intermedia: primero se transforma la página y después otro modelo decide qué información resulta útil para la instrucción recibida.

Eso crea dos puntos en los que un contenido puede perder información. El primero está en la extracción de HTML a Markdown. El segundo aparece cuando el modelo pequeño interpreta ese Markdown y selecciona lo que considera relevante para responder a la petición.

Claude ya reconoce que WebFetch recupera el contenido de las páginas

Hay un elemento que sí está documentado oficialmente por Anthropic. Su Centro de ayuda explica que Claude puede recuperar directamente el contenido de una página cuando el usuario proporciona una URL y que esta función, denominada web fetch, permite analizar el contenido completo de artículos, publicaciones y otras páginas web. Para cuentas gratuitas, Anthropic señala expresamente que un artículo largo proporcionado mediante un enlace puede recuperarse completo en la ventana de contexto.

Ese punto introduce un matiz importante respecto a la interpretación del supuesto leak. La documentación pública de Anthropic describe el resultado funcional de WebFetch, pero no confirma que el modelo grande reciba siempre o en todos los casos exactamente la misma representación interna que recibe la herramienta. Tampoco confirma públicamente que Opus 5.5 utilice un modelo pequeño como paso intermedio en cada recuperación.

El documento filtrado, en cambio, sí describe explícitamente ese modelo intermedio. Además, el repositorio contiene prompts de Claude Code anteriores en los que WebFetch aparece definido de una forma prácticamente idéntica, como una herramienta que convierte la URL a Markdown y utiliza un modelo pequeño y rápido para contestar a la instrucción. Eso refuerza la hipótesis de que el comportamiento descrito para Opus 5.5 podría proceder de una arquitectura ya utilizada en otros productos de Anthropic, aunque no demuestra por sí mismo cómo funciona cada modalidad de Claude.

Para los editores web, la distinción importa. Una página puede estar perfectamente accesible para un sistema de recuperación y, aun así, no aportar todos sus elementos al modelo que finalmente redacta la respuesta. Un contenido que depende de una tabla compleja, de información repartida por varias partes del documento o de señales que desaparecen durante la conversión podría tener un tratamiento diferente al de un texto estructurado de forma directa.

La búsqueda de Claude también funciona de forma más agencial

El supuesto prompt contiene otro cambio interesante relacionado con la búsqueda. Frente a instrucciones más detalladas de versiones anteriores, el sistema atribuido a Opus 5.5 simplifica el criterio para decidir cuándo buscar información externa. El documento señala que debe recurrirse a la web para cuestiones que describen el estado actual del mundo, como cargos, precios, normas vigentes o clasificaciones.

Esta orientación encaja parcialmente con la documentación pública de Anthropic. Su Centro de ayuda explica que Claude utiliza búsqueda web para preguntas que necesitan información actual y que procesa varias fuentes antes de construir la respuesta. También señala que el usuario puede solicitar varias fuentes para que Claude recopile y sintetice información.

La función Research va un paso más allá. Anthropic explica que Claude realiza múltiples búsquedas que se construyen unas sobre otras y que el sistema decide qué investigar a continuación a partir de los resultados obtenidos. La compañía describe este funcionamiento como una investigación agencial que explora diferentes ángulos de una cuestión.

Ese comportamiento tiene una consecuencia directa para el contenido que aspira a aparecer en respuestas de IA. Una página no compite únicamente por aparecer en un resultado de búsqueda. También necesita ofrecer información que pueda ser recuperada, interpretada y utilizada en el siguiente paso de la investigación.

El supuesto prompt también describe diferencias entre las herramientas. WebSearch devuelve resultados con títulos y URLs, mientras que WebFetch recupera el contenido de una dirección concreta. El documento atribuido a Opus 5.5 incluye además filtros de dominios permitidos y bloqueados. En la documentación oficial de Anthropic, tanto WebSearch como WebFetch aparecen como herramientas diferenciadas y con parámetros para restringir dominios.

El SEO para IA pasa de la indexación a la extracción

La consecuencia más interesante no es que desaparezca el SEO tradicional, sino que aparece otra capa de optimización. Una página puede estar bien indexada y ser visible para una búsqueda, pero todavía necesita presentar la información de forma que las herramientas de IA puedan recuperarla y utilizarla correctamente.

Esto favorece contenidos con respuestas explícitas, estructura semántica clara, títulos descriptivos, datos fácilmente identificables y una relación directa entre cada afirmación y su contexto. También reduce el valor de esconder información importante detrás de elementos que una extracción simplificada pueda perder.

La cuestión afecta especialmente a medios digitales, documentación técnica, páginas de producto, comparativas y contenidos que buscan responder preguntas concretas. Si un modelo intermedio resume o selecciona información antes de que llegue al modelo principal, la calidad de esa primera interpretación puede determinar qué parte de una página acaba formando parte de la respuesta.

Pero conviene separar la evidencia de la hipótesis. Anthropic confirma públicamente que Claude dispone de búsqueda web, que puede recuperar directamente páginas mediante WebFetch y que Research encadena búsquedas para investigar una cuestión. El detalle concreto de que Opus 5.5 utilice un modelo pequeño para procesar el Markdown antes de recibir la información procede del prompt publicado en el repositorio de filtraciones y no aparece confirmado de forma explícita en la documentación pública consultada.

Por eso, hablar de un “doble filtro” resulta útil como descripción de la hipótesis planteada por el leak, pero no como una especificación oficial de Anthropic. Si el comportamiento descrito termina siendo representativo de Claude en producción, la optimización para buscadores de IA tendrá que prestar tanta atención a la capacidad de extracción y síntesis como a la visibilidad de una URL.

Anthropic, además, reconoce que utiliza diferentes robots para recopilar contenido público destinado al desarrollo de modelos, para las búsquedas y para recuperar páginas cuando los usuarios se lo solicitan. Entre ellos figura Claude-User, utilizado cuando una persona pide a Claude acceder a sitios web.

El cambio de fondo está en que la visibilidad dentro de un asistente no depende de una única operación. Hay una cadena que puede comenzar con una consulta, continuar con una búsqueda, seleccionar una URL, recuperar su contenido, transformarlo y extraer información antes de generar la respuesta. Para quienes publican en la web, entender esa cadena puede acabar siendo tan importante como conocer cómo funcionan los buscadores tradicionales.

Preguntas frecuentes

¿Claude Opus 5.5 utiliza un modelo pequeño para leer páginas web?

Un supuesto system prompt filtrado atribuido a Opus 5.5 describe WebFetch de esa manera. Anthropic confirma oficialmente la existencia de WebFetch, pero no ha confirmado públicamente todos los detalles internos descritos en ese leak.

¿Qué es WebFetch en Claude?

Es la función que permite a Claude recuperar directamente el contenido de una página web a partir de una URL y analizarlo. Anthropic indica que puede utilizarse para artículos, publicaciones y otras páginas.

¿Qué cambia esto para el SEO?

Introduce una posible capa adicional entre la página publicada y el modelo que genera la respuesta. Si el flujo descrito por el leak se confirma, la estructura y claridad del contenido también influirían en qué información consigue recuperar y utilizar Claude.

¿Claude Research realiza varias búsquedas?

Sí. Anthropic explica que Research realiza múltiples búsquedas que se construyen unas sobre otras y que Claude decide qué investigar a continuación a partir de los resultados obtenidos.

Gracias Natzir por compartir en LinkedIN.