Com treballem amb IA
SEO tècnic
Una web pot carregar perfectament per a una persona i, alhora, estar parcialment tancada per a Google, ChatGPT, Perplexity, Claude o altres sistemes de descobriment. Aquest checklist explica què cal revisar abans de culpar el contingut.
SEO tècnic:
Com treballem amb IA / SEO tècnic
29 juliol 2026 · 12 min de lectura
Una web pot carregar perfectament per a una persona i, alhora, estar parcialment tancada per a Google, ChatGPT, Perplexity, Claude o altres sistemes de descobriment. Aquest checklist explica què cal revisar abans de culpar el contingut.
Punts clau
Molts equips comproven una pàgina obrint-la al navegador. Si carrega, assumeixen que tot va bé. Per a SEO i visibilitat ia això no basta. Un rastrejador pot rebre una resposta diferent per user agent, ubicació, IP, freqüència o regla de seguretat.
El cas habitual és una pàgina de servei que torna 200 a un visitant normal però 403 o 429 a Google-Extended, gptbot, OAI-SearchBot, perplexitybot o claudebot. En aquest cas el primer problema no és el copy: és l’accés.
Google descriu robots.txt com una manera d’indicar quines URLs poden rastrejar els crawlers i de gestionar càrrega de servidor. No s’ha d’utilitzar com a mecanisme de privacitat ni com a substitut de noindex.
Per a visibilitat ia, la decisió pràctica és separar cercadors generals, bots de cerca o resposta d’IA i bots d’entrenament. Alguns pot convenir permetre’ls i altres limitar-los, però la decisió ha de ser intencionada.
Els codis HTTP són senyals bàsiques d’accessibilitat. Un 200 entrega contingut. Un 301 pot consolidar una migració. Un 404 o 410 comunica absència. Un 403 indica bloqueig. Un 429 indica massa peticions. Un 5xx indica fallada de servidor.
L’auditoria ha de provar aquests codis amb diversos user agents. Validar només amb navegador deixa fora molts problemes perquè la fallada sol aparèixer quan la petició sembla d’un crawler.
Cloudflare permet regles personalitzades, challenges, rate limiting i excepcions. Són eines útils, però una configuració agressiva pot fer que una web publicada sigui gairebé invisible per als rastrejadors.
La resposta correcta no sol ser permetre tots els bots a tot arreu. És millor protegir login, formularis, APIs internes i paràmetres abusables, mantenint accessibles les pàgines públiques importants.
El sitemap no força la indexació, però ajuda al descobriment i comunica URLs modificades. És important quan el contingut és nou, multilingüe o encara no té molts enllaços interns.
Canonical i hreflang completen l’estructura. Canonical apunta a la versió preferida. Hreflang connecta versions equivalents en castellà, anglès i català perquè no competeixin sense context.
No tots els bots IA tenen el mateix objectiu. OpenAI separa crawlers per a cerca, entrenament i peticions iniciades per usuaris. Anthropic documenta agents diferents. Perplexity documenta el seu rastrejador per a resultats de cerca.
Si una empresa vol visibilitat en assistents, bloquejar tot el que tingui relació amb IA pot ser contraproduent. Si necessita limitar l’ús de contingut, permetre-ho tot sense política també pot ser mala decisió.
Abans de donar per acabada una landing, servei o article, cal passar un checklist tècnic mínim. Evita que el contingut existeixi només per a usuaris que ja coneixen la URL.
La revisió s’ha de fer a producció perquè els problemes reals solen venir de CDN, WAF, cache, redireccions, SSL o regles del hosting.
La sortida útil no és una llista enorme d’errors. És una decisió per URL: indexar, redirigir, eliminar amb 410, mantenir bloquejada o millorar.
Per a visibilitat ia, les pàgines prioritàries són les que expliquen què fa l’empresa, a qui serveix, on treballa i per què és fiable.