Inteligência Artificial

Como produzir sites com IA sem quebrar o SEO?

Como criar sites com IA usando Lovable, v0, Bolt e Framer sem perder indexação. Os 7 pontos de falha de SEO e o protocolo de verificação antes de publicar. 

Retrato de Marco Antonio Claro SantosPor Marco Antonio Claro Santos · Fundador e estrategista de SEO B2B da MarkSaint.

Como produzir sites com IA sem quebrar o SEO?

Produzir um site com IA deixou de ser demonstração e virou rotina. O ciclo de um projeto institucional caiu de semanas para dias, e a parte visual costuma sair melhor do que o cliente esperava.

O que quase nunca sai pronto é a camada que decide se o site vai existir para um buscador. As ferramentas otimizam para o que o usuário vê no navegador, e o buscador vê outra coisa. Este artigo trata dos sete pontos onde o SEO quebra nesse tipo de projeto, e do protocolo de verificação que se roda antes de publicar.

Como as ferramentas de IA constroem um site?

A maioria gera uma aplicação React ou Next.js a partir de um prompt, monta os componentes, aplica um sistema de estilo e publica em uma infraestrutura própria. O código sai funcional e o conteúdo é montado no navegador, não entregue pronto pelo servidor.

As categorias de ferramenta

Geradores de aplicação por prompt. Lovable, v0 e Bolt partem de descrição em linguagem natural e devolvem código. Dão controle total sobre o resultado e exigem entender o que foi gerado.

Construtores visuais com IA. Framer e Webflow usam IA dentro de um editor visual. Menos controle sobre o código, mais previsibilidade de saída.

Assistentes de código em projeto existente. Claude Code, Cursor e similares trabalham sobre um repositório que já existe, o que dá o melhor controle de SEO porque o projeto tem arquitetura definida.

Onde cada uma costuma falhar

Geradores por prompt falham em renderização e em metadados, porque o prompt raramente pede isso. Construtores visuais falham em controle fino de diretivas e schema. Assistentes em repositório falham pouco quando a base já é sólida.

Por que site feito com IA não indexa?

Porque o conteúdo é montado no cliente e o HTML inicial chega vazio. O Google documenta esse padrão como app shell model, descrito como o caso em que "the initial HTML does not contain the actual content and Google needs to execute JavaScript".

As três fases do processamento

O Googlebot trata JavaScript em crawling, rendering e indexing, e as três são filas separadas. Segundo a documentação, "Googlebot queues pages for both crawling and rendering", e na fase de renderização "a headless Chromium renders the page and executes the JavaScript."

A consequência prática: renderização não é imediata nem garantida. Uma página que depende dela entra numa fila e pode demorar. Se a renderização falha por erro de script, recurso bloqueado ou tempo excedido, o índice fica com o HTML vazio.

O que os outros sistemas fazem

Pior. Sistemas de IA extraem conteúdo HTML visível durante a recuperação, e a maioria dos rastreadores de LLM não executa JavaScript. Um site que depende de renderização pode estar visível no Google e invisível para ChatGPT, Perplexity e afins.

O teste de 30 segundos

Abra o site, desabilite JavaScript no navegador e recarregue. O que sobrar é aproximadamente o que a maior parte dos sistemas vê.

Se sobrar uma tela em branco, o projeto tem um problema estrutural, não um ajuste pendente.

Quais são os erros ao criar sites com IA?

1. Renderização no cliente sem alternativa

O mais grave e o mais comum. A correção depende da stack: em Next.js, usar renderização no servidor ou geração estática nas rotas de conteúdo; em Vite ou React puro, adicionar pré-renderização no build.

A documentação do Google reforça o ponto mesmo sabendo processar JavaScript: "server-side or pre-rendering is still a great idea because it makes your website faster" — e acrescenta que nem todos os bots executam JavaScript.

2. Links que não são elementos <a>

Ferramenta de IA gera navegação com onClick e roteamento programático com frequência. A documentação é inequívoca: "Google can only discover your links if they are <a> HTML elements."

Link sem <a href> não é seguido. Seções inteiras ficam órfãs.

O Screaming Frog tem o filtro "Pages With Uncrawlable Internal Outlinks" desde a versão 24.0, que encontra exatamente isso.

3. Metadados genéricos ou repetidos

Title e meta description saem iguais em todas as rotas, ou com o texto padrão do framework. Em aplicação de página única, muitas vezes nem mudam quando o usuário troca de rota.

Cada rota precisa de title e description próprios, gerados no servidor.

4. Roteamento que produz 404 suave

Aplicação de página única com roteamento no cliente costuma devolver status 200 para URL inexistente, com uma mensagem de erro na tela. O Google trata isso como soft 404, e a documentação lista o problema como recorrente em SPAs.

A correção é devolver status HTTP correto para rota inválida.

5. Ausência de sitemap e robots.txt

Ferramenta de IA raramente gera os dois. Sem sitemap, a descoberta depende só de link interno; sem robots.txt intencional, você não decide quem rastreia.

6. Imagens sem alt e sem dimensão

Afeta acessibilidade, Core Web Vitals e a leitura de contexto. O recurso de prompt de IA do Screaming Frog resolve alt text em escala, o que torna viável um site com centenas de imagens.

7. Conteúdo de preenchimento gerado no mesmo prompt

O ponto que mais custa a médio prazo, tratado na seção seguinte.

Conteúdo gerado por IA é penalizado pelo Google?

Não pela origem. A posição oficial, de Danny Sullivan e Chris Nelson, da equipe de qualidade de busca: "Our focus on the quality of content, rather than how content is produced, is a useful guide that has helped us deliver reliable, high quality results to users for years."

O que viola política é usar automação ou IA "to produce content for the primary purpose of manipulating search rankings".

A política que se aplica

Scaled content abuse, definida como "when many pages are generated for the primary purpose of manipulating search rankings and not helping users". A definição vale igualmente para produção por IA e por humanos.

O que mudou nas diretrizes de avaliadores

Em janeiro de 2025, a seção 4.6.6 das diretrizes de avaliadores de qualidade passou a tratar conteúdo gerado automaticamente ou por IA com "little to no effort, little to no originality, and little to no added value". E acrescenta: "such pages should be rated Lowest, even if the page assigns credit for the content to another source."

Declarar que o conteúdo é de IA não protege. O que conta é esforço, originalidade e valor agregado.

O enquadramento prático

Usar IA para estruturar, revisar, traduzir e acelerar é trabalho normal. Publicar quarenta páginas de serviço geradas no mesmo prompt, com o mesmo esqueleto e sem informação que só a empresa tem, é o padrão que a política descreve.

O Google também pede transparência sobre o processo de produção, principalmente sobre automação e uso de IA, dentro do enquadramento de quem, como e por quê.

Qual o protocolo antes de publicar?

Doze verificações, em ordem. A maioria leva minutos.

Renderização e estrutura

1. Desabilitar JavaScript e conferir se o conteúdo principal permanece.

2. Ver o código-fonte e confirmar que o texto está no HTML, não só no bundle.

3. Rodar a URL Inspection Tool do Google Search Console e ver o HTML renderizado.

4. Conferir que toda navegação usa <a href>.

Metadados e diretivas

5. Title e meta description únicos por rota.

6. Canonical presente e apontando para a própria URL.

7. Confirmar ausência de noindex herdado do ambiente de desenvolvimento. Este é o erro mais frequente e mais caro de publicação.

8. robots.txt e sitemap publicados e acessíveis.

Comportamento

9. URL inexistente devolvendo 404 de verdade.

10. Redirecionamentos de versões antigas, se houver migração.

Conteúdo

11. Cada página responde a uma necessidade real, com informação que a empresa tem e o concorrente não.

12. Crawl completo no Screaming Frog em modo JavaScript, comparado com o modo Text Only.

O item que mais aparece em auditoria

O número 7. noindex esquecido em produção depois de o ambiente de homologação ir ao ar é campeão de incidência em site novo, gerado por IA ou não.

Como dividir o trabalho entre IA e pessoa?

A separação que funciona.

O que a IA faz bem

Estrutura de componentes, layout responsivo, variações de copy para teste, alt text em escala, geração de dados estruturados a partir de conteúdo existente, tradução, revisão de consistência, e a primeira versão de qualquer coisa.

O que continua sendo da pessoa

A arquitetura de informação. Quais páginas existem, o que cada uma resolve, como se conectam. Decisão de negócio, não de código.

O conteúdo que vale. Dado de operação, número de campo, exceção do mercado, caso documentado. É o que a concorrência não copia e o que a IA não inventa.

As decisões técnicas de indexação. Renderização, diretiva, canonical, redirecionamento.

A verificação. Todo item do protocolo acima.

O erro de processo mais comum

Pedir site e conteúdo no mesmo prompt. Sai um site bonito com quarenta páginas que dizem o mesmo que qualquer concorrente — exatamente o perfil que a seção 4.6.6 descreve.

Gerar a estrutura com IA e preencher com material próprio dá mais trabalho e é a diferença entre um site que existe e um site que funciona.

Como configurar SEO em projeto Next.js gerado por IA?

Next.js é a saída mais comum de Lovable, v0 e Bolt. Cinco ajustes cobrem quase todo o problema.

1. Escolher a estratégia de renderização por rota

Páginas de conteúdo — home, serviços, blog, categorias — devem ser estáticas ou renderizadas no servidor. Painéis autenticados podem ficar no cliente sem prejuízo, porque não são para indexar.

O erro comum é a ferramenta marcar tudo como componente de cliente por padrão.

2. Gerar metadados por rota

A API de metadata do Next.js permite definir title, description, canonical e Open Graph por rota, gerados no servidor. Rota com conteúdo variável exige a versão que recebe parâmetros.

3. Usar o componente de link do framework

O componente de navegação do Next.js gera elemento <a> com href real. Navegação montada com onClick e roteamento programático não gera link rastreável.

4. Publicar sitemap e robots

O framework tem convenções de arquivo para os dois. É configuração de minutos e quase sempre ausente no que a IA entrega.

5. Devolver 404 de verdade

A rota de página não encontrada precisa responder com status 404, não com 200 e uma mensagem na tela.

A verificação final

Rodar curl -s https://dominio/pagina | grep "<h1" e confirmar que o conteúdo aparece no HTML entregue pelo servidor. Se não aparecer, nenhum dos outros ajustes importa.

Quais dados estruturados incluir em site novo?

Sem exagero, e sempre correspondendo ao texto visível — requisito que o Google pede explicitamente.

O conjunto que se justifica

Organization, com nome, logo, endereço e sameAs apontando para os perfis oficiais. É o tipo que ajuda a desambiguar a entidade da empresa.

WebSite, com o nome do site e a URL canônica.

BreadcrumbList, quando existe hierarquia de navegação.

Article ou BlogPosting nas páginas de conteúdo, com autor identificado e datas de publicação e atualização.

LocalBusiness, para negócio com atendimento físico.

Product e Offer, para e-commerce.

O que não incluir

Tipos que descrevem algo que a página não tem. Marcação de avaliação sem avaliação real na página é violação de política, não criatividade.

A ressalva sobre IA

Dados estruturados não aumentam citação em sistemas de IA. Teste controlado da Ahrefs com 1.885 páginas mediu efeito negativo em AI Overviews e efeito indistinguível de zero em AI Mode e ChatGPT.

Marque por rich results e por desambiguação de entidade, não esperando citação.

Perguntas frequentes

Site feito com Lovable ou v0 ranqueia?

Ranqueia se o conteúdo estiver no HTML, os links forem <a href>, os metadados forem únicos por rota e existir conteúdo com valor. A ferramenta não decide isso; a configuração decide.

Preciso migrar para Next.js?

Não necessariamente. Precisa de conteúdo renderizado no servidor ou pré-renderizado. Next.js é um caminho comum, não o único.

Devo declarar que usei IA?

O Google pede transparência sobre o processo de produção. Declarar não penaliza e não protege conteúdo fraco.

Quantas páginas posso publicar de uma vez?

Não existe limite numérico. Existe critério: cada página precisa justificar a própria existência para um leitor.

A IA pode escrever os dados estruturados?

Pode, e é bom uso. A regra que o Google pede continua valendo: dados estruturados precisam corresponder ao texto visível.

Como sei se meu site gerado por IA está indexado?

Relatório de cobertura do Search Console, mais uma busca por site: no domínio. Se as páginas não aparecem depois de semanas, volte ao item 1 do protocolo.

Produzir site com IA encurtou a parte que já era rápida e não resolveu a parte que sempre foi decisiva. O gargalo mudou de lugar: deixou de ser montar a página e passou a ser garantir que ela existe para quem precisa encontrá-la.

A MarkSaint roda esse protocolo de verificação antes de qualquer publicação. Peça seu diagnóstico gratuito e receba a checagem completa de indexabilidade do seu site, com o que está invisível para buscador e para sistemas de IA.

Fontes