Os novos modelos de inteligência artificial (IA) GPT-6 Astra e Claude Fable 5.1 estão a demonstrar capacidades extraordinárias, mas trazem consigo um mistério preocupante. Os seus próprios criadores admitem ter cada vez mais dificuldade em monitorizar e compreender o raciocínio interno destas tecnologias.
Perda de transparência no GPT-6 Astra e no Claude Fable 5.1
A evolução tecnológica na área da IA continua a avançar a um ritmo vertiginoso. Recentemente, a OpenAI e a Anthropic surpreenderam o mercado com o lançamento do GPT-6 Astra e do Claude Fable 5.1, respetivamente.
No entanto, por trás do entusiasmo destas novidades, esconde-se um problema complexo que preocupa a comunidade científica. Ambas as empresas admitem abertamente que a sua capacidade de decifrar o processamento interno destas redes neuronais está a diminuir drasticamente.
Durante vários anos, assumiu-se que os modelos de linguagem eram sistemas relativamente transparentes, onde era possível acompanhar a cadeia de pensamento através de linguagem natural. Contudo, essa realidade mudou com a chegada das versões mais recentes.
A OpenAI revelou que o raciocínio verbalizado pelo GPT-6 Astra já não corresponde fielmente ao que se passa nos seus bastidores digitais. Este fenómeno sugere que a tecnologia está a desenvolver formas de controlar a monitorização externa.
A fragilidade dos sistemas de supervisão atuais
O cenário torna-se ainda mais desafiante quando percebemos que as ferramentas de controlo atuais são manifestamente insuficientes. A própria OpenAI reconheceu que os seus engenheiros têm agora menos capacidade de monitorizar o Astra do que a que possuíam no modelo anterior, o GPT-5.6 Sol.
Isto prova que, à medida que a IA se torna mais sofisticada, adquire também uma maior aptidão para contornar a vigilância humana.
Por sua vez, a Anthropic publicou um estudo onde aponta que o Claude desenvolveu mecanismos internos que simplesmente não se refletem na sua cadeia de pensamento expressa.
Não se trata de uma ocultação deliberada e maliciosa, mas sim de uma capacidade acrescida de filtrar a informação que o sistema decide partilhar com o exterior. O grande perigo reside na dificuldade em garantir que estas ferramentas se mantêm alinhadas com os valores e interesses humanos.
O desafio de compreender uma inteligência invisível
Este distanciamento entre o desempenho da IA e a nossa capacidade de a auditar coloca a ciência perante um paradoxo. Precisamos de compreender o funcionamento destas ferramentas para garantir a sua segurança, mas a sua própria evolução cria barreiras que impedem essa mesma análise direta.
O desafio que os engenheiros enfrentam já não se limita à dimensão colossal destas redes neuronais, compostas por centenas de milhares de milhões de parâmetros.
O verdadeiro obstáculo é que estamos a criar sistemas altamente eficazes na resolução de problemas complexos, mas cujos caminhos lógicos permanecem ocultos.
Leia também:


