Voltar às notícias

OpenAI se junta ao impulso para avaliadores independentes incorporados após chamada de segurança antropológica

Sam Altman comprometeu-se com o OpenAI para dar aos avaliadores externos acesso pessoal, transformando um alerta da indústria sobre sistemas de fronteira em movimento rápido em uma proposta concreta de governança.

Tradução automática · Original em inglês · Ver original

Uma empresa rival adota a proposta de avaliação

A OpenAI se comprometeu a dar aos avaliadores independentes acesso aos seus sistemas, juntando-se a uma proposta de segurança avançada pelo CEO da Anthropic, Dario Amodei. O movimento é uma nova ação corporativa após o maior apelo de Amodei para retardar o avanço não verificado da inteligência artificial fronteiriça. Antropic disse separadamente que proporcionaria acesso permanente, a nível de funcionário aos avaliadores de terceiros. Sky News informou os compromissos em 13 de setembro.

A diferença entre o compromisso e o compromisso é importante. Sam Altman disse que o OpenAI adotaria a proposta de acesso de avaliador e fornecerá mais detalhes mais tarde. Elon Musk apoiou a advertência geral e sugeriu uma revisão de pares entre concorrentes, mas Sky informou que ele parou sem corresponder ao compromisso da Anthropic. Ainda não foi anunciado um calendário comum, processo de seleção de avaliadores ou mecanismo de execução.

O que o acesso incorporado pode mudar

As avaliações externas geralmente testam um modelo em um determinado ponto, muitas vezes através de interfaces restritas. O acesso semelhante ao pessoal poderia permitir que os especialistas observem os sistemas mais continuamente, examinem as versões pré-liberadas e comparem as reivindicações de segurança com as práticas internas. Em princípio, isso poderia melhorar a detecção de incidentes e tornar os compromissos voluntários mais audíveis. Seu valor dependerá se os avaliadores podem publicar resultados adversos, obter informações técnicas relevantes e operar sem pressão comercial das empresas que avaliam.

Pesquisas oficiais do Reino Unido apoiam a necessidade de testes rigorosos, ao mesmo tempo que alertam contra a dramática extrapolação. O Instituto de Segurança da IA apoiado pelo governo descobriu melhorias rápidas em vários testes de capacidade controlados e vulnerabilidades em cada sistema que ele examinou. Ele também sublinhou que os resultados de laboratório não são previsões de danos do mundo real. Essa combinação – o crescimento de capacidade medível, as lacunas de segurança persistentes e a incerteza substancial – ajuda a explicar a demanda por acesso contínuo em vez de certificação de um único fim.

A coordenação voluntária ainda tem limites

A proposta de Amodei se estende além dos avaliadores incorporados. Exige padrões comuns entre empresas em países democráticos e eventual coordenação com governos, incluindo a China. São ambições diplomáticas e regulamentares, não acordos concluídos. Mesmo o compromisso corporativo mais estreito deixa perguntas não resolvidas sobre quem qualifica como independente, como resultados sensíveis serão tratados e se o acesso sobrevive discordância sobre os lançamentos de produtos.

O próximo desenvolvimento significativo será a implementação. A OpenAI e a Anthropic precisariam identificar os avaliadores, definir a sua autoridade, divulgar acordos de relatório e explicar como os resultados podem atrasar ou alterar a implementação. Os reguladores também decidirão se o acesso voluntário é suficiente ou deverá se tornar um requisito legal. Até que esses detalhes aparecem, os compromissos são um experimento de governança em vez de uma prova de que a corrida competitiva entre laboratórios fronteiriços tem diminuído.