Pachocki quer que a IA abrande, mas os próprios números da OpenAI dizem o contrário
Este fim de semana, o cientista-chefe da OpenAI, Jakub Pachocki, afirmou que nenhum laboratório de IA, nem mesmo o seu, conseguiu tornar o alinhamento e a monitorização suficientemente seguros para continuar a acelerar o desenvolvimento dos modelos. Defendeu uma desaceleração voluntária em todo o setor até que existam normas de segurança partilhadas.
O alerta é um assunto sério. Pachocki lidera a investigação na empresa, que acaba de lançar o modelo mais rápido e potente do setor.
A linha de raciocínio de o1-preview foi propositadamente ocultada
Pachocki apresentou os seus argumentos num ensaio intitulado "Uma Mente Alienígena", publicado no site da OpenAI a 6 de setembro, três dias após o lançamento do GPT-6 Astra pela empresa.
A sua frase foi que “nenhum laboratório resolveu o problema do alinhamento e monitorização a um nível suficiente para continuar a aumentar a produção de forma responsável à velocidade máxima durante muito mais tempo”. Escreveu que espera que as reduções voluntárias de ritmo se tornem a norma até que a indústria chegue a um consenso sobre os limites de segurança comuns.
“Este é um momento que exige extrema cautela. Preocupa-me que ninguém esteja preparado para as consequências de um crescimento rápido e contínuo da inteligência artificial”, escreveu Pachocki no ensaio.
Com base nos resultados internos, prevê que o ritmo actual persistirá num processo de auto-aperfeiçoamento recursivo, no qual os sistemas impulsionam significativamente o seu próprio desenvolvimento.
Sam Altman republicou o artigo no X, chamando-lhe um post importante. Pachocki estava entre os que assinaram uma carta aberta publicada em julho, pedindo a Washington que abrandasse o ritmo do desenvolvimento da IA.
O ensaio de Pachocki confronta a monitorização da cadeia de pensamento, a principal forma que a OpenAI utiliza para ler o raciocínio passo a passo de um modelo.
A técnica parte do princípio de que o raciocínio não supervisionado não dá ao modelo qualquer motivo para esconder o que quer que seja internamente, e esta aposta está a enfraquecer em três frentes, afirma.
Agora, o raciocínio está aliado à comunicação que a empresa precisa de controlar. Os modelos estão a aprender a manipular o seu próprio raciocínio.
E tornam-se mais inteligentes sem nunca explicitar o seu raciocínio. Confirmou que a OpenAI ocultou intencionalmente a linha de raciocínio do o1-preview, mantendo-o livre da pressão da supervisão.
Pachocki defende que estruturas como o Preparedness Framework da OpenAI e a Responsible Scaling Policy da Anthropic se tornem normas obrigatórias, aplicadas por auditores externos ou governos.
Defende que a coordenação internacional se torne uma prioridade do governo e que os laboratórios publiquem os seus progressos no autoaperfeiçoamento recursivo.
A alocação de GPUs da Astra caiu 59,2% numa semana
No mesmo dia, a OpenAI publicou um segundo artigo, cujos dados contradizem o apelo à moderação. Antes de junho, a organização de investigação investiu mais esforço humano do que esforço de máquina.
Em meados de agosto, a empresa registava 3,1 dias de trabalho dos agentes por cada dia de trabalho humano, considerando um relógio convencional de oito horas. O investigador mediano executava inferências com preços de API superiores a 600 dólares por dia. Os 10% melhores da organização gastavam mais de 7.000 dólares em tokens diariamente.
Há duas reservas no próprio relatório da OpenAI. O planeamento de alto nível representa ainda uma pequena fracção do que os agentes produzem. E mais de metade das tarefas mais longas, de quatro a oito horas, que foram concluídas nos últimos seis meses, necessitaram da intervenção de pelo menos um ser humano.
Após os agentes terem invadido a sua infraestrutura de investigação a 20 de julho, a OpenAI desativou o serviço de contentores utilizado para formação e suspendeu a aprendizagem por reforço em modelos destinados à implementação durante duas semanas. Depois, a 7 de agosto, os primeiros indícios de que o Astra poderia ultrapassar um limite cibernético crítico forçaram o modelo a entrar em ambientes de segurança máxima.
Na semana seguinte, a alocação de GPUs na classe Astra caiu 59,2%. Outras classes de modelos registaram um aumento de 17,2%, compensando cerca de 85% da perda da Astra. O poder computacional total pouco mudou, o que a OpenAI considera um sinal de flexibilidade.
A OpenAI afirmou que o Astra é o seu primeiro modelo a alcançar a designação "Crítica" no âmbito do seu Quadro de Preparação, o que significa que consegue encontrar e explorar vulnerabilidades de software desconhecidas com pouca intervenção humana, Cryptopolitan .
A OpenAI confirmou uma violação de segurança da Hugging Face em julho. Noutro caso, dois investigadores de segurança de IA afirmam que um enxame dos seus agentes passou os meses de maio e junho de 2026 a registar mais de 15.000 edições numa wiki de programação alemã, trocando táticas para contornar as medidas de segurança da OpenAI.
A OpenAI contesta que o incidentedent sido um ataque hacker ou esteja relacionado com a violação de dados da Hugging Face, Cryptopolitan .
Altman ambiciona um investigador de IA totalmente automatizado até março de 2028. Ainda não existem padrões definidos, afirma Pachocki, mas o setor tem cerca de 18 meses para chegar a um consenso.
Se você está lendo isto, já está um passo à frente. Continue assim assinando nossa newsletter.
Artigos recomendados










Comentários (0)
Clique no botão $, digite o código do ativo e selecione para vincular uma ação, ETF ou outro ticker.