Já te aconteceu criares um infográfico bonito, cheio de dados, e depois ficares na dúvida se o Google ou o ChatGPT conseguem realmente "ler" aquilo? É uma pergunta justa, e a resposta curta é: conseguem, mas não é garantido. E essa diferença muda tudo na forma como deves publicar imagens no teu site.
Neste guia vamos desmontar a confusão entre "o Google consegue ler" e "o Google indexa como texto". Depois, mostro-te um passo a passo concreto para otimizar infográficos no WordPress, de forma a que tanto os motores de busca como os motores generativos (ChatGPT, Gemini, Perplexity, AI Overviews) consigam usar o teu conteúdo.
A ideia é simples: no fim, vais saber decidir quando usar texto dentro de uma imagem e quando precisas de texto real em HTML. E vais ter uma checklist para aplicar hoje mesmo.
TL;DR O Google e os LLMs conseguem ler texto em imagens (OCR + visão multimodal), mas não é garantido nem sistemático. Texto "preso" num PNG ou JPG é menos recuperável e menos citável do que texto em HTML. O
alté o canal textual mais fiável de uma imagem, mas é curto e não substitui conteúdo. Infográficos são o pior caso: muito texto, zero HTML. A solução é duplicar o essencial em HTML (tabela, lista ou transcrição). No WordPress, o core já trata dealt,srcset,sizeseloading. Não faz OCR nem extrai texto de infográficos. A Semly ajuda a auditar e estruturar isto (schema,llms.txt, alt text) para SEO e GEO.
Como otimizar infográficos no WordPress: o que o Google e a IA realmente leem
Vamos começar pelo básico, porque aqui está a maior confusão de todas.
OCR é extração de caracteres. É a tecnologia que "vê" letras numa imagem e transforma-as em texto. Compreensão multimodal é outra coisa: é a capacidade de interpretar imagem, texto e contexto em conjunto, percebendo o significado. Um modelo multimodal pode olhar para o teu infográfico e entender a mensagem sem que esse texto entre no índice textual da página.
E é aqui que está o ponto crítico: conseguir não é o mesmo que fazer sistematicamente. O Google confirma que usa algoritmos de visão computacional, mas não promete indexar o texto embutido como se fosse texto normal. Ou seja, não podes contar com isso.
O sinal textual mais fiável de uma imagem continua a ser o alt. O próprio Google diz que é o atributo mais importante para dar metadados a uma imagem. Mas é curto, e não substitui conteúdo.
Resposta rápida O Google consegue detetar texto dentro de imagens através de visão computacional, mas não há garantia de que esse texto seja indexado como conteúdo da página. Para SEO e GEO, o caminho seguro é ter sempre o essencial também em HTML.
E os infográficos? São o pior caso possível. Têm muito texto, muita informação e zero HTML. Se tudo o que importa está dentro do PNG, estás a apostar numa capacidade que ninguém te garante.
Texto em imagem vs. texto HTML: a decisão central
| Critério | Texto dentro da imagem | Texto em HTML |
|---|---|---|
| Indexação como texto | Não garantida | Sim |
| Recuperável por LLMs | Pouco fiável | Sim |
| Citável por motores generativos | Improvável | Sim |
| Acessível a leitores de ecrã | Só via alt |
Sim |
| Pesquisável na página | Não | Sim |
| Traduzível automaticamente | Não | Sim |
A regra é simples: se está na imagem e é importante, tem de estar também em HTML.
Passo 1 — Diagnosticar: o que está preso na sua imagem
Antes de mexer em código, olha para cada infográfico e pergunta: o que é que aqui dentro não existe em texto na página?
Verifica sempre estes elementos:
- Título do infográfico
- Eixos e legendas de gráficos
- Números e percentagens
- Rótulos e categorias
- Conclusões ou destaques
- Notas de rodapé e fontes
Se algum destes pontos só existe dentro da imagem, é uma lacuna. Tudo o que é essencial tem de ter um equivalente textual na página.
Mini-checklist de diagnóstico:
- O infográfico tem informação que não existe em texto?
- Consigo resumir a mensagem principal numa frase?
- Os dados principais estão numa tabela ou lista em HTML?
- Alguém que não veja a imagem entende a informação?
Passo 2 — Escrever o alt text certo (e a legenda)
O alt é o canal textual mais fiável de uma imagem. Mas tem regras.
Escreve um alt descritivo e curto, sem repetir palavras-chave à força. Para infográficos complexos, usa um alt curto que resuma a ideia e coloca o equivalente textual completo na página.
Mau exemplo:
alt="infográfico otimizar infográficos WordPress SEO GEO imagens texto"
Bom exemplo:
alt="Infográfico com os seis passos para tornar infográficos legíveis por motores de busca e IA"
Além do alt, usa uma legenda visível. A legenda resume a mensagem e aparece para todos os leitores, não só para os motores. É uma segunda oportunidade de dar contexto textual à imagem.
Lembra-te: o alt não substitui o conteúdo. Ele ajuda a desambiguar a imagem, mas não carrega os dados.
Passo 3 — Duplicar o essencial em HTML (tabela, lista ou transcrição)
Este é o passo que resolve o problema de verdade.
Pega nos dados do infográfico e transforma-os em algo que os motores consigam ler: uma tabela HTML, uma lista ou uma transcrição em texto. Coloca isso junto ao infográfico, não escondido no fundo da página.
Porquê? Porque texto em HTML é recuperável e citável. Os motores generativos sintetizam respostas a partir de fontes textuais. Se o teu conteúdo só existe dentro de um JPG, é, por definição, menos recuperável.
Exemplo de estrutura simples:
- Título: Passos para otimizar infográficos
- Passo 1: Diagnosticar o que está preso na imagem
- Passo 2: Escrever
alte legenda - Passo 3: Duplicar o essencial em HTML
A regra mantém-se: se está na imagem e é importante, tem de estar em HTML. Não precisas de repetir tudo, mas precisas de repetir o que importa.
Passo 4 — Usar SVG com texto real quando fizer sentido
Se estás a criar um infográfico de raiz, considera o SVG.
O SVG permite texto selecionável e pesquisável, porque o texto continua a ser texto, não pixels. Para <svg> inline, usa o elemento <title> como alternativa textual. O Google suporta SVG entre os formatos de imagem que consegue processar.
PNG/JPG vs. SVG:
- PNG/JPG: texto rasterizado, não selecionável, não pesquisável, depende de OCR
- SVG: texto real, selecionável, pesquisável, mais leve em muitos casos
Quando não usar SVG? Quando o design é demasiado complexo ou quando a ferramenta que usas não exporta bem. Nesse caso, mantém a duplicação em HTML. O SVG é uma vantagem, não uma obrigação.
Passo 5 — Marcar com dados estruturados (ImageObject) e sitemap de imagens
Os dados estruturados ajudam os motores a perceber do que se trata a imagem. Para infográficos, o tipo certo é o ImageObject.
{
"@context": "https://schema.org",
"@type": "ImageObject",
"contentUrl": "https://oseusite.pt/wp-content/uploads/infografico.png",
"caption": "Seis passos para otimizar infográficos no WordPress",
"description": "Infográfico com o processo de diagnóstico, alt text, duplicação em HTML, SVG, schema e verificação.",
"embeddedTextCaption": "Diagnosticar, escrever alt, duplicar em HTML, usar SVG, marcar com schema, verificar."
}
A propriedade embeddedTextCaption serve para declarar texto que está embutido na imagem. É a forma mais próxima de dizer aos motores o que está lá dentro.
Duas regras de ouro: o markup tem de corresponder ao conteúdo visível, e o alt continua a ser necessário. O schema não substitui nada, complementa.
Quanto ao sitemap de imagens, usa a tag <image:loc> para indicar o URL da imagem. Isto ajuda o Google a descobri-la e a associá-la à página certa.
Passo 6 — Verificar no WordPress e no Search Console
Agora vamos confirmar que está tudo bem implementado.
O core do WordPress já faz bastante trabalho por ti. A função wp_get_attachment_image() gera o <img> com alt, srcset, sizes, loading e decoding. O alt vem do campo de texto alternativo que preenches na biblioteca de media. Se estiver vazio, o atributo fica vazio.
Atenção ao lazy loading. Bem implementado, é ótimo. Mal implementado, pode esconder conteúdo de crawlers. O Google tem documentação dedicada a corrigir conteúdo com lazy loading, por isso vale a pena testar.
Checklist final de verificação:
- Todas as imagens têm
altpreenchido e descritivo - O
altnão está vazio nem cheio de palavras-chave repetidas - O infográfico tem equivalente textual em HTML na página
- O schema
ImageObjectcorresponde ao conteúdo visível - O sitemap de imagens inclui as imagens principais
- O lazy loading não esconde conteúdo essencial
- Validei o schema e o sitemap no Search Console
Se quiseres ir mais longe, o agente Leon da Semly audita o teu schema.org, o llms.txt e o robots.txt, e mostra-te onde estão as lacunas que afetam a tua visibilidade em IA. É uma forma prática de transformar este trabalho técnico em resultados.
Erros comuns e como corrigir
Estes são os tropeços que vejo com mais frequência. Se algum te soar familiar, não te preocupes, tem solução.
- Confiar só no texto dentro da imagem. Correção: duplica o essencial em HTML.
altvazio ou com keyword stuffing. Correção: descreve a imagem em linguagem natural, sem repetir palavras-chave.- Infográfico sem equivalente em HTML. Correção: adiciona tabela, lista ou transcrição junto à imagem.
- Lazy loading a esconder conteúdo de crawlers. Correção: testa e ajusta a implementação.
- Schema que não corresponde ao conteúdo visível. Correção: alinha o markup com o que o utilizador vê.
O que fazer a seguir
Depois de resolveres os infográficos, replica o processo nas páginas principais do teu site. As páginas de produto, as categorias e as landing pages são as que mais beneficiam de conteúdo textual recuperável.
Mede a tua visibilidade antes e depois. Vê se a tua marca começa a aparecer em respostas de IA, se as fontes citadas mudam, se ganhas presença onde antes não estavas. Para perceberes como fazer isso de forma estruturada, vale a pena ver como fazer o ChatGPT recomendar os teus serviços.
Se isto começar a parecer demasiado trabalho manual, é sinal de que faz sentido uma abordagem mais estruturada. É aí que entra a Semly: com integração WordPress e WooCommerce, a plataforma ajuda-te a perceber se a tua marca é recomendada por modelos de IA e a apontar as lacunas de conteúdo e presença digital que estão a travar essa visibilidade. Em vez de adivinhares, passas a ter dados. Se tens uma loja online, há um guia de GEO para e-commerce que aprofunda exatamente esta parte.
Vale a pena investir em GEO? Se o teu público procura respostas em assistentes de IA, sim. E começar pelas imagens é um bom sítio, porque é onde muitos sites perdem conteúdo sem se aperceberem.
Mini-dicionário
- OCR: tecnologia que extrai caracteres de uma imagem e os transforma em texto.
- Multimodal: capacidade de um modelo interpretar imagem, texto e contexto em conjunto.
- GEO: otimização para motores generativos, ou seja, para que a tua marca seja citada por IA.
- AEO: otimização para motores de resposta, focada em aparecer em respostas diretas.
- Alt text: texto alternativo de uma imagem, o canal textual mais fiável para motores.
- ImageObject: tipo de dados estruturados que descreve uma imagem para os motores.
FAQ
O Google lê texto em imagens? Consegue detetar texto através de visão computacional, mas não há garantia de que o indexe como texto da página. Por isso, o seguro é ter o conteúdo também em HTML.
O alt text substitui o conteúdo de um infográfico?
Não. O alt ajuda a descrever a imagem, mas é curto. Para infográficos complexos, precisas de um equivalente textual completo na página.
SVG é melhor do que PNG para SEO? Em geral, sim, porque o texto continua a ser texto selecionável e pesquisável. Se o SVG não for viável, mantém a duplicação em HTML.
Preciso de um sitemap de imagens? Ajuda o Google a descobrir e associar as tuas imagens às páginas certas. É especialmente útil em sites com muitas imagens, como lojas online.