O Google e a IA conseguem ler textos em imagens? Guia prático para otimizar infográficos no WordPress para SEO e GEO

Já te aconteceu criares um infográfico bonito, cheio de dados, e depois ficares na dúvida se o Google ou o ChatGPT conseguem realmente "ler" aquilo? É uma pergunta justa, e a resposta curta é: conseguem, mas não é garantido. E essa diferença muda tudo na forma como deves publicar imagens no teu site.

Neste guia vamos desmontar a confusão entre "o Google consegue ler" e "o Google indexa como texto". Depois, mostro-te um passo a passo concreto para otimizar infográficos no WordPress, de forma a que tanto os motores de busca como os motores generativos (ChatGPT, Gemini, Perplexity, AI Overviews) consigam usar o teu conteúdo.

A ideia é simples: no fim, vais saber decidir quando usar texto dentro de uma imagem e quando precisas de texto real em HTML. E vais ter uma checklist para aplicar hoje mesmo.

TL;DR O Google e os LLMs conseguem ler texto em imagens (OCR + visão multimodal), mas não é garantido nem sistemático. Texto "preso" num PNG ou JPG é menos recuperável e menos citável do que texto em HTML. O alt é o canal textual mais fiável de uma imagem, mas é curto e não substitui conteúdo. Infográficos são o pior caso: muito texto, zero HTML. A solução é duplicar o essencial em HTML (tabela, lista ou transcrição). No WordPress, o core já trata de alt, srcset, sizes e loading. Não faz OCR nem extrai texto de infográficos. A Semly ajuda a auditar e estruturar isto (schema, llms.txt, alt text) para SEO e GEO.

Como otimizar infográficos no WordPress: o que o Google e a IA realmente leem

Vamos começar pelo básico, porque aqui está a maior confusão de todas.

OCR é extração de caracteres. É a tecnologia que "vê" letras numa imagem e transforma-as em texto. Compreensão multimodal é outra coisa: é a capacidade de interpretar imagem, texto e contexto em conjunto, percebendo o significado. Um modelo multimodal pode olhar para o teu infográfico e entender a mensagem sem que esse texto entre no índice textual da página.

E é aqui que está o ponto crítico: conseguir não é o mesmo que fazer sistematicamente. O Google confirma que usa algoritmos de visão computacional, mas não promete indexar o texto embutido como se fosse texto normal. Ou seja, não podes contar com isso.

O sinal textual mais fiável de uma imagem continua a ser o alt. O próprio Google diz que é o atributo mais importante para dar metadados a uma imagem. Mas é curto, e não substitui conteúdo.

Resposta rápida O Google consegue detetar texto dentro de imagens através de visão computacional, mas não há garantia de que esse texto seja indexado como conteúdo da página. Para SEO e GEO, o caminho seguro é ter sempre o essencial também em HTML.

E os infográficos? São o pior caso possível. Têm muito texto, muita informação e zero HTML. Se tudo o que importa está dentro do PNG, estás a apostar numa capacidade que ninguém te garante.

Texto em imagem vs. texto HTML: a decisão central

Critério Texto dentro da imagem Texto em HTML
Indexação como texto Não garantida Sim
Recuperável por LLMs Pouco fiável Sim
Citável por motores generativos Improvável Sim
Acessível a leitores de ecrã Só via alt Sim
Pesquisável na página Não Sim
Traduzível automaticamente Não Sim

A regra é simples: se está na imagem e é importante, tem de estar também em HTML.

Passo 1 — Diagnosticar: o que está preso na sua imagem

Antes de mexer em código, olha para cada infográfico e pergunta: o que é que aqui dentro não existe em texto na página?

Verifica sempre estes elementos:

  • Título do infográfico
  • Eixos e legendas de gráficos
  • Números e percentagens
  • Rótulos e categorias
  • Conclusões ou destaques
  • Notas de rodapé e fontes

Se algum destes pontos só existe dentro da imagem, é uma lacuna. Tudo o que é essencial tem de ter um equivalente textual na página.

Mini-checklist de diagnóstico:

  • O infográfico tem informação que não existe em texto?
  • Consigo resumir a mensagem principal numa frase?
  • Os dados principais estão numa tabela ou lista em HTML?
  • Alguém que não veja a imagem entende a informação?

Passo 2 — Escrever o alt text certo (e a legenda)

O alt é o canal textual mais fiável de uma imagem. Mas tem regras.

Escreve um alt descritivo e curto, sem repetir palavras-chave à força. Para infográficos complexos, usa um alt curto que resuma a ideia e coloca o equivalente textual completo na página.

Mau exemplo: alt="infográfico otimizar infográficos WordPress SEO GEO imagens texto"

Bom exemplo: alt="Infográfico com os seis passos para tornar infográficos legíveis por motores de busca e IA"

Além do alt, usa uma legenda visível. A legenda resume a mensagem e aparece para todos os leitores, não só para os motores. É uma segunda oportunidade de dar contexto textual à imagem.

Lembra-te: o alt não substitui o conteúdo. Ele ajuda a desambiguar a imagem, mas não carrega os dados.

Passo 3 — Duplicar o essencial em HTML (tabela, lista ou transcrição)

Este é o passo que resolve o problema de verdade.

Pega nos dados do infográfico e transforma-os em algo que os motores consigam ler: uma tabela HTML, uma lista ou uma transcrição em texto. Coloca isso junto ao infográfico, não escondido no fundo da página.

Porquê? Porque texto em HTML é recuperável e citável. Os motores generativos sintetizam respostas a partir de fontes textuais. Se o teu conteúdo só existe dentro de um JPG, é, por definição, menos recuperável.

Exemplo de estrutura simples:

  • Título: Passos para otimizar infográficos
  • Passo 1: Diagnosticar o que está preso na imagem
  • Passo 2: Escrever alt e legenda
  • Passo 3: Duplicar o essencial em HTML

A regra mantém-se: se está na imagem e é importante, tem de estar em HTML. Não precisas de repetir tudo, mas precisas de repetir o que importa.

Passo 4 — Usar SVG com texto real quando fizer sentido

Se estás a criar um infográfico de raiz, considera o SVG.

O SVG permite texto selecionável e pesquisável, porque o texto continua a ser texto, não pixels. Para <svg> inline, usa o elemento <title> como alternativa textual. O Google suporta SVG entre os formatos de imagem que consegue processar.

PNG/JPG vs. SVG:

  • PNG/JPG: texto rasterizado, não selecionável, não pesquisável, depende de OCR
  • SVG: texto real, selecionável, pesquisável, mais leve em muitos casos

Quando não usar SVG? Quando o design é demasiado complexo ou quando a ferramenta que usas não exporta bem. Nesse caso, mantém a duplicação em HTML. O SVG é uma vantagem, não uma obrigação.

Passo 5 — Marcar com dados estruturados (ImageObject) e sitemap de imagens

Os dados estruturados ajudam os motores a perceber do que se trata a imagem. Para infográficos, o tipo certo é o ImageObject.

{
  "@context": "https://schema.org",
  "@type": "ImageObject",
  "contentUrl": "https://oseusite.pt/wp-content/uploads/infografico.png",
  "caption": "Seis passos para otimizar infográficos no WordPress",
  "description": "Infográfico com o processo de diagnóstico, alt text, duplicação em HTML, SVG, schema e verificação.",
  "embeddedTextCaption": "Diagnosticar, escrever alt, duplicar em HTML, usar SVG, marcar com schema, verificar."
}

A propriedade embeddedTextCaption serve para declarar texto que está embutido na imagem. É a forma mais próxima de dizer aos motores o que está lá dentro.

Duas regras de ouro: o markup tem de corresponder ao conteúdo visível, e o alt continua a ser necessário. O schema não substitui nada, complementa.

Quanto ao sitemap de imagens, usa a tag <image:loc> para indicar o URL da imagem. Isto ajuda o Google a descobri-la e a associá-la à página certa.

Passo 6 — Verificar no WordPress e no Search Console

Agora vamos confirmar que está tudo bem implementado.

O core do WordPress já faz bastante trabalho por ti. A função wp_get_attachment_image() gera o <img> com alt, srcset, sizes, loading e decoding. O alt vem do campo de texto alternativo que preenches na biblioteca de media. Se estiver vazio, o atributo fica vazio.

Atenção ao lazy loading. Bem implementado, é ótimo. Mal implementado, pode esconder conteúdo de crawlers. O Google tem documentação dedicada a corrigir conteúdo com lazy loading, por isso vale a pena testar.

Checklist final de verificação:

  • Todas as imagens têm alt preenchido e descritivo
  • O alt não está vazio nem cheio de palavras-chave repetidas
  • O infográfico tem equivalente textual em HTML na página
  • O schema ImageObject corresponde ao conteúdo visível
  • O sitemap de imagens inclui as imagens principais
  • O lazy loading não esconde conteúdo essencial
  • Validei o schema e o sitemap no Search Console

Se quiseres ir mais longe, o agente Leon da Semly audita o teu schema.org, o llms.txt e o robots.txt, e mostra-te onde estão as lacunas que afetam a tua visibilidade em IA. É uma forma prática de transformar este trabalho técnico em resultados.

Erros comuns e como corrigir

Estes são os tropeços que vejo com mais frequência. Se algum te soar familiar, não te preocupes, tem solução.

  • Confiar só no texto dentro da imagem. Correção: duplica o essencial em HTML.
  • alt vazio ou com keyword stuffing. Correção: descreve a imagem em linguagem natural, sem repetir palavras-chave.
  • Infográfico sem equivalente em HTML. Correção: adiciona tabela, lista ou transcrição junto à imagem.
  • Lazy loading a esconder conteúdo de crawlers. Correção: testa e ajusta a implementação.
  • Schema que não corresponde ao conteúdo visível. Correção: alinha o markup com o que o utilizador vê.

O que fazer a seguir

Depois de resolveres os infográficos, replica o processo nas páginas principais do teu site. As páginas de produto, as categorias e as landing pages são as que mais beneficiam de conteúdo textual recuperável.

Mede a tua visibilidade antes e depois. Vê se a tua marca começa a aparecer em respostas de IA, se as fontes citadas mudam, se ganhas presença onde antes não estavas. Para perceberes como fazer isso de forma estruturada, vale a pena ver como fazer o ChatGPT recomendar os teus serviços.

Se isto começar a parecer demasiado trabalho manual, é sinal de que faz sentido uma abordagem mais estruturada. É aí que entra a Semly: com integração WordPress e WooCommerce, a plataforma ajuda-te a perceber se a tua marca é recomendada por modelos de IA e a apontar as lacunas de conteúdo e presença digital que estão a travar essa visibilidade. Em vez de adivinhares, passas a ter dados. Se tens uma loja online, há um guia de GEO para e-commerce que aprofunda exatamente esta parte.

Vale a pena investir em GEO? Se o teu público procura respostas em assistentes de IA, sim. E começar pelas imagens é um bom sítio, porque é onde muitos sites perdem conteúdo sem se aperceberem.

Mini-dicionário

  • OCR: tecnologia que extrai caracteres de uma imagem e os transforma em texto.
  • Multimodal: capacidade de um modelo interpretar imagem, texto e contexto em conjunto.
  • GEO: otimização para motores generativos, ou seja, para que a tua marca seja citada por IA.
  • AEO: otimização para motores de resposta, focada em aparecer em respostas diretas.
  • Alt text: texto alternativo de uma imagem, o canal textual mais fiável para motores.
  • ImageObject: tipo de dados estruturados que descreve uma imagem para os motores.

FAQ

O Google lê texto em imagens? Consegue detetar texto através de visão computacional, mas não há garantia de que o indexe como texto da página. Por isso, o seguro é ter o conteúdo também em HTML.

O alt text substitui o conteúdo de um infográfico? Não. O alt ajuda a descrever a imagem, mas é curto. Para infográficos complexos, precisas de um equivalente textual completo na página.

SVG é melhor do que PNG para SEO? Em geral, sim, porque o texto continua a ser texto selecionável e pesquisável. Se o SVG não for viável, mantém a duplicação em HTML.

Preciso de um sitemap de imagens? Ajuda o Google a descobrir e associar as tuas imagens às páginas certas. É especialmente útil em sites com muitas imagens, como lojas online.

Sources

Verifique se vê sua marca

Digite o seu site para receber um relatório gratuito de Visibilidade em IA