No és màgia: cada IA cerca d'una manera diferent
Quan algú li pregunta a ChatGPT, Claude, Perplexity o Grok "quines empreses fan X a Barcelona?", fa la sensació que la IA simplement "ho sap". En realitat, darrere de cada resposta hi ha un mecanisme de recuperació d'informació molt concret, amb el seu propi rastrejador web, el seu propi índex i les seves pròpies regles sobre quin contingut prioritza. Entendre aquestes diferències és la base de qualsevol estratègia real de visibilitat en IA — el contrari és endevinar.
ChatGPT
OpenAI combina diverses fonts: per a la funció de cerca en temps real, ChatGPT es recolza en l'índex de Bing; a més, OpenAI opera els seus propis rastrejadors — GPTBot (per entrenar models), OAI-SearchBot (per indexar contingut de cara a la funció de cerca) i ChatGPT-User (quan el mateix usuari li demana a ChatGPT que navegui una pàgina en directe). Si algun d'aquests user-agents està bloquejat al teu robots.txt, ChatGPT no pot citar-te ni en resultats de cerca ni en respostes en directe.
Claude
Anthropic separa clarament entrenament i ús en temps real: ClaudeBot rastreja la web per a entrenament, mentre que l'eina de cerca web que fa servir Claude en conversa combina un motor de cerca amb capacitat de navegar pàgines concretes quan la pregunta ho requereix. Claude tendeix a prioritzar fonts amb estructura clara i contingut fàcil d'extreure — d'aquí que el marcatge de dades estructurades (schema.org) i una jerarquia de capçaleres neta influeixin directament en si et cita o no.
Perplexity
Perplexity és, dels quatre, el que més s'assembla a un motor de cerca tradicional: amb PerplexityBot rastreja la web de manera contínua i executa una cerca en viu a cada consulta, no només quan cal. Com vam cobrir en una anàlisi anterior, Perplexity afavoreix de manera molt marcada el contingut recent (els articles de menys de 30 dies reben fins a 3,2 vegades més cites) i es recolza fortament en Reddit com a font. És el motor on el frescor del contingut importa més que en cap altre.
Grok
Grok (xAI) té una arquitectura de recuperació diferent de les altres: combina un rastrejador web estàndard amb accés privilegiat al flux de dades en temps real de X (Twitter). A més de la seva cerca web, Grok té una eina de "X Search" separada, i el seu mode DeepSearch executa investigació en diversos passos — formula subpreguntes, cerca, avalua resultats i itera abans de respondre. El resultat és que Grok cita tant pàgines web com publicacions de X, amb un pes cap a la conversa en temps real que cap altre motor té.
El fil comú entre els quatre: tots depenen que la teva web sigui rastrejable (robots.txt que no els bloquegi), tingui dades estructurades completes, i —cada cop més— parli el llenguatge tècnic que aquests sistemes esperen: un fitxer llms.txt, negociació de contingut en markdown, i pàgines d'error que no enganyin l'agent fent-li creure que tot existeix.
Eines per comprovar si la teva web està a punt
Ja no cal endevinar. Hi ha eines gratuïtes, algunes molt recents, que analitzen la teva web específicament des de la perspectiva d'un agent d'IA:
- Is Agentic — llançada per Vercel a finals d'agost de 2026, fa servir el motor d'auditoria d'Ora per donar una puntuació sobre 100 basada en més de 100 comprovacions: si les teves pàgines d'error són reals, si el teu contingut és accessible sense dependre de JavaScript, si tens dades estructurades completes, si un agent pot emplenar els teus formularis, i més. Només cal introduir el domini.
- Google PageSpeed Insights — a més de les mètriques de rendiment i SEO habituals, ara inclou una puntuació d'"Agentic Browsing" específica sobre si un agent automatitzat pot navegar la teva web correctament.
- acceptmarkdown.com — comprova si la teva web respon correctament quan un agent demana el contingut en format markdown (capçalera
Accept: text/markdown), cada cop més habitual entre agents d'IA per estalviar tokens. - Google Rich Results Test i el validador de schema.org — per comprovar que les teves dades estructurades (Organization, FAQPage, Article) estan completes i sense errors de sintaxi.
- Comprovació manual de
llms.txt— simplement visitaeldominituva.com/llms.txt. Si dona 404, cap agent té un resum llegible de qui ets i a què et dediques.
El nostre propi cas: què vam trobar en auditar-nos
Vam passar dataversesolutions.net per Is Agentic i vam començar amb un 77 sobre 100. Els problemes no eren de contingut, eren tècnics i molt concrets:
- Les rutes que no existien retornaven un 404 correcte pel que fa al codi d'estat, però amb la pàgina d'error genèrica de l'hosting — sense enllaços de recuperació ni contingut útil perquè un agent sabés on anar.
- No responíem amb markdown quan un agent ho demanava explícitament via capçalera
Accept. - Les nostres dades estructurades tenien buits: faltava un bloc
ContactPointcomplet i un tipusOrganizationexplícit que un validador estricte pogués reconèixer sense ambigüitat. - No teníem pàgines d'"about" ni "contact" com a URL pròpies — només àncores dins de la home, invisibles per a un agent que comprova aquestes rutes de manera directa.
Vam corregir els quatre punts: pàgina d'error amb contingut real i negociació markdown, dades estructurades completes, i pàgines de confiança dedicades. El resultat, verificat amb escanejos en viu repetits: per sobre de 90 sobre 100.
Què fer aquesta setmana
- Passa el teu domini per Is Agentic. Triga menys d'un minut i et dona una llista prioritzada de què corregir primer.
- Comprova el teu
robots.txt. Verifica que no bloqueja GPTBot, ClaudeBot, PerplexityBot ni Google-Extended. - Prova una URL que no existeix. Si la teva web retorna un 200 amb l'app carregada igualment, qualsevol agent assumeix que totes les rutes existeixen.
- Revisa si tens
llms.txt. Si no en tens, és dels canvis més ràpids d'implementar amb més impacte. - Valida les teves dades estructurades amb el Rich Results Test de Google.
Conclusió
Cada IA cerca de manera diferent, però totes comparteixen una exigència mínima: que la teva web sigui tècnicament llegible per a un agent, no només per a un humà amb navegador. Això ja no és una capa opcional de SEO avançat — és la base sobre la qual es construeix qualsevol estratègia real de visibilitat en motors d'IA.
A Dataverse Solutions auditem i corregim aquests punts tècnics perquè la teva web sigui trobable tant per Google com pels agents d'IA que cada cop més decideixen a qui recomanen.