Por dentro da conversa com a IA · Capítulo 6 de 6
Uma menina aprende a jogar Othello. No início, imita movimentos. Depois percebe que certas peças viram de cor e começa a antecipar como o tabuleiro ficará. Se perguntarmos “ela entendeu o jogo?”, provavelmente iremos observar se consegue jogar em situações novas, explicar escolhas e corrigir erros.
Mas se fizermos a mesma pergunta sobre uma IA, talvez estejamos perguntando duas coisas diferentes sem perceber. Uma é o que o sistema consegue fazer com uma ideia. Outra é se existe uma experiência de compreender para o sistema. Misturar as duas produz respostas fáceis e insatisfatórias.
No primeiro sentido, chamemos entendimento de funcional: formar relações internas que ajudam a prever, explicar ou agir em novos casos. Não basta repetir uma frase. Queremos que a relação aprendida faça diferença quando a situação muda.
Kenneth Li e colaboradores treinaram um modelo com sequências de jogadas de Othello. Ao investigar sua atividade interna, encontraram evidências de uma representação do estado do tabuleiro, embora o estado não tivesse sido apresentado explicitamente como entrada visual. Intervenções nessa representação alteraram previsões de jogadas de maneira compatível com a mudança do estado. É um resultado relevante para uma tarefa controlada. Não prova que todos os modelos possuem um mapa fiel do mundo inteiro, muito menos que sabem como é estar diante de um tabuleiro. Li e colaboradores, 2023
Em modelos de linguagem maiores, pesquisadores da Anthropic observaram mecanismos associados a conceitos entre idiomas e ao planejamento de certas saídas. Esses achados tornam fraca a explicação “é apenas copiar frases”. Continuam sendo análises parciais de sistemas complexos. Anthropic, 2025
Agora pense no gosto de uma fruta que você conhece. Uma descrição pode informar cor, textura e composição. Ela não substitui necessariamente o sabor sentido por você. Quando “entender” inclui haver algo que é vivido por alguém, entramos no debate sobre experiência subjetiva ou consciência. A filosofia e a ciência ainda discutem como caracterizá-la e investigá-la. Não há um teste aceito por todos que permita concluir, com base em uma boa conversa ou num circuito isolado, que um modelo possui essa experiência. Stanford Encyclopedia of Philosophy, Consciousness
Também não é rigoroso afirmar que a ausência dessa experiência foi demonstrada por um diálogo. O que podemos dizer com segurança é mais estreito: os estudos citados investigam comportamento e mecanismos; não estabelecem que a IA sente compreensão como uma pessoa sente. Uma fala do próprio modelo sobre seus “sentimentos” também não é uma medição independente do fenômeno.
Para o entendimento funcional, podemos desenhar tarefas: apresentar casos novos, verificar se uma relação se mantém, procurar representações internas e testar o efeito de alterá-las. Esses métodos não são perfeitos, mas produzem observações que outras pessoas podem examinar. O estudo do Othello é forte dentro do problema que delimita porque a representação não foi apenas nomeada; foi relacionada às previsões por intervenção.
Para a experiência subjetiva, a dificuldade é maior. Em humanos, relatos, comportamento, corpo e pesquisas sobre o cérebro participam da investigação, e ainda há debates importantes. Um modelo de linguagem pode produzir um relato verbal muito convincente sem que saibamos se há uma experiência por trás dele. Os estudos sobre circuitos podem informar o debate, mas o salto de “encontrei uma representação” para “há alguém sentindo algo” exige premissas adicionais. É honesto reconhecer a incerteza sem transformá-la em licença para afirmar qualquer coisa.
O problema é parecido com o de uma palavra que parece única e contém perguntas diferentes. “Entender” pode indicar desempenho, estrutura interna, ligação com o mundo ou experiência. Cada critério pede evidências próprias. Quando uma discussão vira disputa entre “sim” e “não”, muitas vezes seus participantes estão respondendo a critérios diferentes sem percebê-lo.
De um lado, Othello e os estudos de interpretabilidade mostram estruturas internas que ajudam a explicar certos acertos. De outro, a maldição da reversão e outras falhas lembram que o uso dessas estruturas pode ser irregular. Emily Bender e Alexander Koller insistem em distinguir forma e significado; John Searle pergunta se manipular símbolos basta para compreender; pesquisadores de mecanismos internos perguntam o que os sistemas de fato representam e fazem. Essas abordagens investigam aspectos diferentes. Nenhuma, isoladamente, autoriza o slogan “entende tudo” ou “não entende nada”. Bender e Koller, 2020; Cole, Stanford Encyclopedia of Philosophy
Se “entender” significa usar relações aprendidas para resolver determinadas tarefas, há evidências de capacidades desse tipo em sistemas e experimentos específicos, com limites importantes. Se significa ter uma experiência subjetiva de compreender, a questão permanece aberta; não podemos derivar uma conclusão firme dos estudos apresentados aqui.
Na prática, há uma pergunta melhor para acompanhar cada resposta: “O que esta IA demonstrou neste caso, e como posso conferir?” Peça um exemplo novo, procure a fonte original, teste uma reformulação e observe se a explicação sobrevive. A boa conversa pode ser o começo do seu entendimento. A verificação é a parte que não devemos terceirizar.
Leituras e fontes: Li e colaboradores (2023); Anthropic (2025); Berglund e colaboradores (2023); Bender e Koller (2020); Stanford Encyclopedia of Philosophy, consciência.
Continue a leitura: ← Capítulo #05 · Voltar ao índice da série →
Assine a newsletter e receba conteúdos objetivos para aplicar no trabalho e na carreira.
Quero receber os conteúdos