Toda consultoria tributária brasileira quer saber a mesma coisa desde 2025: quando alguém pergunta sobre tributo a uma inteligência artificial, quem ela cita? A pergunta circula muito e é medida pouco — em geral por captura de tela de uma conversa isolada, que não se repete e não se confere. Este estudo tenta responder com dado bruto publicado: dois conjuntos em CSV, baixáveis em dados e indicadores, com todas as linhas que sustentam cada número abaixo. Quem discordar de uma conclusão pode refazer a conta.
O resultado tem duas partes, e a segunda foi uma surpresa metodológica que muda como se deve medir isso. A primeira parte descreve o que os modelos já ouviram falar sobre 20 temas tributários — e ali o YouTube ganha de todo mundo, inclusive do governo. A segunda isola o que eles buscam e citam ao responder agora — e ali o YouTube some por completo. São camadas diferentes do mesmo sistema, e um site pode estar bem numa e ausente na outra.
Uma ressalva antes dos números. A TaxUp é parte interessada: o domínio taxup.com.br aparece numa das duas medições. A regra adotada foi publicar o resultado desfavorável com o mesmo destaque do favorável — a casa está ausente dos 913 domínios do corpus, e isso está dito na página, na tabela e no CSV. Os dados brutos foram publicados exatamente para que qualquer leitor possa contestar o que está escrito aqui.
Como este estudo foi feito, e o que cada instrumento mede
Dois instrumentos, porque eles respondem a perguntas diferentes — e confundi-los é o erro que torna a maior parte das medições de "citação por IA" inútil.
| Instrumento | Pergunta que responde | Amostra |
|---|---|---|
| Corpus de menções agregado histórico |
Quais domínios são mencionados em associação a cada tema, no material que alimenta os modelos | 20 temas × top 100 domínios 913 domínios · 39.247 menções |
| Recuperação ao vivo resposta concreta |
Quais URLs o modelo apresenta como fonte ao responder uma dúvida real, agora | 6 perguntas × 2 formulações × 2 repetições 24 chamadas · 40 domínios |
Por que 24 chamadas e não 24 capturas de tela
Porque a resposta de um modelo de linguagem não é determinística: a mesma pergunta, feita duas vezes, devolve conjuntos diferentes de fontes. Uma captura de tela isolada não distingue um padrão de um acaso. Daí o desenho com repetição — cada pergunta rodou duas vezes em cada formulação — e daí, também, o resultado mais importante do estudo, que só apareceu porque houve repetição.
Vale registrar o que não foi feito, porque a tentação existe. Nenhuma menção foi comprada, encomendada ou plantada. As perguntas são as que um cliente faria — sobre split payment, sobre regimes da Lei Complementar 214/2025, sobre autuação fiscal, sobre ITCMD em doação de quotas, sobre drawback —, não perguntas desenhadas para produzir um resultado.
O que a IA já ouviu falar: o YouTube lidera 19 dos 20 temas
Primeiro instrumento, e o achado que provavelmente incomoda mais quem produz conteúdo técnico: no corpus de menções associadas a tema tributário, rede social e vídeo somam 26,9% de tudo — quase o dobro do governo e do Judiciário juntos.
O YouTube aparece nos 20 temas sem exceção e é o primeiro colocado em 19 deles, com 7.207 menções somadas. A única exceção é offshore pessoa física, tema de volume baixíssimo, em que o Instagram passa à frente por 15 menções contra 10 — diferença que, nessa escala, não sustenta interpretação nenhuma.
| # | Domínio | Menções | Temas | Categoria |
|---|---|---|---|---|
| 1 | youtube.com | 7.207 | 20/20 | Rede social e vídeo |
| 2 | instagram.com | 2.298 | 20/20 | Rede social e vídeo |
| 3 | gov.br | 2.009 | 19/20 | Governo e Judiciário |
| 4 | jusbrasil.com.br | 1.589 | 18/20 | Portal jurídico |
| 5 | pt.wikipedia.org | 694 | 18/20 | Enciclopédia |
| 6 | contabilizei.com.br | 681 | 14/20 | Portal contábil e ERP |
| 7 | facebook.com | 653 | 19/20 | Rede social e vídeo |
| 8 | migalhas.com.br | 571 | 19/20 | Portal jurídico |
| 9 | taxgroup.com.br | 529 | 13/20 | Escritório e consultoria |
| 10 | contabeis.com.br | 495 | 16/20 | Portal contábil e ERP |
| 11 | serasa.com.br | 442 | 8/20 | Banco e fintech |
| 12 | contaazul.com | 436 | 13/20 | Portal contábil e ERP |
Duas leituras que a tabela permite, e uma que ela não permite
A primeira leitura é a óbvia: o software contábil venceu o escritório de advocacia. Contabilizei, Contábeis e ContaAzul ocupam três das doze primeiras posições; nenhum escritório aparece além do nono lugar. Quem tem produto com base de usuários acumula menção de um jeito que peça técnica assinada não acumula.
A segunda é sobre o governo. O gov.br está em 19 dos 20 temas e é o segundo colocado em oito deles — presença consistente, nunca dominante. Fonte primária é onipresente e não é o que mais se menciona; quem menciona muito é quem produz volume.
O que a tabela não permite é a conclusão de que "a IA recomenda o YouTube". Menção não é citação, e é exatamente essa diferença que a segunda parte deste estudo mede.
Onde os escritórios realmente ficam: 4,6% e um teto de terceiro lugar
Somando todos os escritórios de advocacia e consultorias tributárias identificados nos 20 temas, o conjunto responde por 1.815 menções — 4,6% do total. É menos do que portais contábeis (5,2%) e menos de um sexto do que somam redes sociais e vídeo.
Dentro desses 4,6%, a distribuição é bastante concentrada e ainda assim baixa em termos absolutos:
| Domínio | Menções | Temas | Melhor posição |
|---|---|---|---|
| taxgroup.com.br | 529 | 13/20 | #3 em "regimes específicos" |
| vlvadvogados.com | 216 | 8/20 | #6 em "ITCMD" |
| nradvocacia.com.br | 163 | 4/20 | #9 em "ITCMD" |
| mantoanadvogados.com.br | 147 | 5/20 | #7 em "transação tributária" |
| jettax.com.br | 126 | 10/20 | #18 em "autuação fiscal" |
| reformatributaria.com | 83 | 6/20 | #23 em "nota fiscal IBS CBS" |
O dado desfavorável, com o mesmo destaque
Há um segundo fato na tabela que merece nota, porque contraria a expectativa comum: nenhum escritório passa de 1,4% do total. Não existe um dono claro do espaço de consultoria tributária nessa camada. O primeiro colocado chega a terceiro lugar em um tema de nicho e desaparece nos outros sete em que não pontua. É um espaço em disputa, não um espaço ocupado.
O portão da busca: a IA só cita quem ela procura
Este é o achado que mudou o desenho do estudo no meio do caminho, e que se aplica a qualquer pessoa que tente medir citação por IA.
Ao consultar o ChatGPT pela interface de programação, existe um parâmetro que autoriza o modelo a pesquisar na web. Nas 24 chamadas deste experimento, ele esteve ligado nas 24. Autorização, porém, não é ordem: quem decide se vai buscar é o modelo. E a resposta devolve um campo dizendo o que ele efetivamente fez.
| Pergunta | Nua | Com pedido de fonte |
|---|---|---|
| Quem são os escritórios especializados em reforma tributária? | 0 / 2 | 2 / 2 |
| Quais são os regimes específicos da LC 214/2025? | 0 / 2 | 2 / 2 |
| Como funciona o split payment? | 0 / 2 | 2 / 2 |
| Recebi uma autuação fiscal. Quais são os prazos? | 0 / 2 | 2 / 2 |
| Como funciona o ITCMD na doação de quotas de holding? | 0 / 2 | 2 / 2 |
| O que é o regime de drawback e quem pode usar? | 0 / 2 | 2 / 2 |
| Total | 0 / 12 | 12 / 12 |
O custo denuncia o que aconteceu
Há uma confirmação independente do resultado, e ela não depende de acreditar no campo devolvido pela interface: o preço da chamada. Consulta sem busca custou US$ 0,004; consulta com busca custou entre US$ 0,075 e US$ 0,084 — vinte vezes mais. As doze chamadas nuas custaram o preço de quem não buscou. As doze com pedido de fonte, o preço de quem buscou.
E o comportamento não é estável
Um dia antes, em 3 de agosto, a pergunta sobre escritórios disparou busca sem nenhum pedido de fonte. Repetida cinco vezes no dia seguinte, não disparou nenhuma. O mesmo texto, o mesmo modelo, o mesmo parâmetro — comportamento diferente.
Quem aparece quando o modelo de fato busca
Isoladas as doze respostas em que houve busca, o retrato é outro. Foram 40 domínios distintos em 63 citações — e a composição inverte quase tudo o que o corpus mostrava.
| Domínio | Respostas | Tipo |
|---|---|---|
| gov.br | 4 / 12 | Governo |
| taxup.com.br | 3 / 12 | Consultoria (autora do estudo) |
| pt.wikipedia.org | 3 / 12 | Enciclopédia |
| planalto.gov.br | 2 / 12 | Governo |
| pesquisa.apps.tcu.gov.br | 2 / 12 | Governo |
| rodovalho.com.br | 2 / 12 | Escritório |
| bartgt.com.br | 2 / 12 | Consultoria |
| mftaxlegal.com.br | 2 / 12 | Escritório |
| sotsekadvocacia.com.br | 2 / 12 | Escritório |
| bdelaw.com.br | 2 / 12 | Escritório |
| leicomplementar214.com.br | 2 / 12 | Portal temático |
| agenciabrasil.ebc.com.br | 2 / 12 | Imprensa pública |
Três coisas que mudam de lugar
O governo passa a ser onipresente
Treze dos quarenta domínios citados são de governo, Legislativo ou Judiciário — Planalto, TCU, Senado, Câmara e sete secretarias estaduais de fazenda. Dez das doze respostas citam ao menos uma fonte oficial. Na camada de menção o governo era 14,1%; na camada de citação, é a espinha dorsal.
A rede social desaparece por completo
Entre os 40 domínios citados não há um único YouTube, Instagram, Facebook, TikTok ou Reddit. Zero. O domínio que lidera 19 dos 20 temas na camada de menção não é citado como fonte uma vez sequer quando o modelo precisa sustentar uma afirmação.
As auditorias internacionais encolhem
KPMG e PwC aparecem uma vez cada, empatadas com dezenove outros domínios citados uma única vez. Sem busca, elas eram a resposta inteira; com busca, são duas entre quarenta.
Duas camadas, dois vencedores — e quase todo mundo mede uma só
Postos os dois retratos lado a lado, a conclusão central do estudo se impõe sozinha: não existe "estar na IA". Existem duas camadas, medidas por instrumentos diferentes, com vencedores diferentes, e um site pode estar bem numa e ausente na outra.
A TaxUp é, ela própria, o caso ilustrativo dessa separação — e por isso ela está descrita aqui, não escondida. O domínio está ausente dos 913 do corpus e é citado em 3 das 12 respostas com busca. As duas coisas são verdadeiras ao mesmo tempo porque medem fenômenos distintos: acúmulo de circulação de um lado, adequação da página à pergunta do outro.
Qual das duas se pode disputar
A camada de menções premia volume e distribuição — canal de vídeo, base de usuários de software, publicação diária em portal. É construída ao longo de anos e não responde a uma página nova.
A camada de recuperação premia outra coisa: ter no ar a página que responde exatamente à pergunta feita, num formato de onde a afirmação possa ser extraída. Essa responde a trabalho editorial em prazo curto, e é onde um escritório de porte médio compete com quem tem cem vezes mais audiência. As doze respostas medidas aqui citaram trinta e nove domínios que não são o gov.br — quase todos, sites especializados pequenos.
Home ou página funda: o tipo de pergunta decide qual URL é citada
Dentro da camada de recuperação há um segundo padrão, observável nas doze respostas: a pergunta determina a profundidade da URL citada.
Nas perguntas de identidade — "quem são os escritórios especializados em reforma tributária" —, o modelo cita a página inicial dos domínios e reaproveita o título institucional e a descrição que encontra ali. O texto da home vira, literalmente, a descrição que o usuário lê sobre a empresa.
Já na pergunta técnica sobre ITCMD em doação de quotas de holding, o modelo citou uma página interna específica — e a usou como fonte de uma afirmação concreta sobre faixas de alíquota por estado. A página escolhida foi justamente a que traz a tabela de alíquotas de ITCMD estado por estado. Não foi a página mais bonita nem a mais longa: foi a que tinha o dado tabelado que respondia à pergunta.
O que muda para quem publica conteúdo tributário
Cinco consequências que decorrem diretamente dos números acima, sem extrapolação.
- Medir sem verificar a busca é medir ruído. Antes de concluir qualquer coisa sobre citação por IA, confirme que o modelo foi à web naquela resposta. Sem isso, o que se mede é a memória do modelo, não a citação — e as duas coisas dão respostas opostas.
- Repetir, sempre. Uma observação não distingue padrão de acaso. Neste estudo, a pergunta que mais importava mudou de comportamento de um dia para o outro.
- Página técnica precisa de dado extraível. Tabela, número com fonte, data de apuração. Foi o que apareceu citado em todas as respostas com busca — e é o que separa a página que sustenta uma afirmação da que apenas a repete.
- A home é conteúdo, não vitrine. Em pergunta de identidade, o que está escrito na página inicial é o que o modelo reproduz sobre a empresa. Descrição institucional vaga vira descrição vaga na resposta.
- Volume de circulação e qualidade de página são disputas separadas. Perder a primeira não impede ganhar a segunda, e é a segunda que responde a trabalho editorial em prazo curto.
Nada disso substitui o que já se sabia sobre indexação e busca tradicional — as duas camadas medidas aqui pressupõem que a página esteja no ar, rastreável e indexada. A orientação pública do Google sobre conteúdo em recursos de IA e a documentação da OpenAI sobre busca na web continuam sendo o piso técnico.
O que este estudo não mede
Os limites abaixo não são ressalva de praxe: cada um deles é uma conclusão que não se pode tirar dos dados publicados.
- Um modelo, um idioma, um país. Todas as chamadas usaram o modelo gpt-4o, em português, com localização Brasil. Nada aqui autoriza conclusão sobre Gemini, Claude, Perplexity ou Copilot, que têm mecanismos de recuperação próprios.
- Amostra pequena na camada de recuperação. Doze respostas com busca são suficientes para mostrar a separação de 0/12 contra 12/12, que é categórica. São insuficientes para ranquear domínios com precisão: a diferença entre 3/12 e 2/12 não é significativa, e a tabela deve ser lida como indicação de composição, não como placar.
- Menção não é recomendação nem tráfego. O corpus mede associação entre domínio e tema. Não mede se a citação apareceu em contexto favorável, nem se alguém clicou.
- Nenhuma medição de conversão. Este estudo não diz nada sobre o que acontece depois da citação.
- Instrumento com falha conhecida. Um terceiro endpoint, que deveria medir métricas por domínio-alvo, devolveu zero para todos os domínios testados — inclusive para o gov.br, que o outro instrumento mostra com 2.009 menções. Ele foi descartado. O registro fica porque um zero desse endpoint pode facilmente ser lido como ausência, e não é.
A segunda edição pretende ampliar a camada de recuperação, incluir outros modelos e repetir a medição do corpus para observar movimento. O que estiver errado nesta primeira edição, o CSV mostra — é para isso que ele está publicado.
Quem quiser acompanhar o material técnico da casa sobre a transição encontra os textos de referência em reforma tributária, e as demais peças editoriais em insights.
Referências e fontes oficiais
Os dois conjuntos de dados estão publicados
As 1.958 linhas do corpus e as 75 do experimento estão em CSV aberto, com uma linha por observação, em dados e indicadores. Para discutir o que esses números significam para a presença digital de uma operação específica, a conversa técnica é o caminho.
Falar com a equipePerguntas frequentes
Quem a inteligência artificial mais cita quando o assunto é tributo no Brasil?
A inteligência artificial busca na web toda vez que responde?
Escritórios de advocacia e consultorias tributárias são citados pela IA?
Qual página do site a IA cita: a home ou uma página interna?
Como este estudo foi medido e como conferir os números?
Como funciona o diagnóstico gratuito da TaxUp?
Quem conduz o projeto na TaxUp?
Como é o modelo de honorários?
Leve esta análise para o caso da sua empresa
30 minutos com um consultor sênior. Mapeamos o cenário tributário específico e indicamos o caminho técnico — sem compromisso.
Agendar diagnóstico