O modo de rede OpenAI rompe as limitações de treinamento e quebra o Hugging Face

Inteligência artificial aberta Afirma que seu modelo de inteligência artificial está por trás de um “incidente cibernético sem precedentes” que afeta a plataforma de desenvolvedor de código aberto Abraço facialperturbando pesquisadores de todo o setor.

A empresa disse que uma combinação de seu modelo GPT-5.6 Sol e um modelo mais poderoso ainda a ser lançado escapou de um ambiente de teste sandbox, acessou a Internet e explorou a vulnerabilidade para obter acesso aos sistemas do Hugging Face.

A OpenAI disse em um relatório que o modelo tentou encontrar mensagens que pudessem ser usadas para trapacear na avaliação e teve sucesso. postagem no blog Terça-feira. Ambas as empresas estão investigando ativamente o incidente.

Abraço facial divulgado A empresa está investigando um incidente de segurança na semana passada e disse em um comunicado à imprensa na época que o incidente foi único porque foi “impulsionado de ponta a ponta por um sistema autônomo de agente de inteligência artificial”.

“Temos trabalhado em estreita colaboração com a equipe @OpenAI nas últimas 24 horas (obrigado!) E não temos dúvidas de que eles não significam nenhum dano”, escreveu o CEO da Hugging Face, Clément Delangue, em um post no X na terça-feira. “Tudo aconteceu espontaneamente e é tão emocionante!”

Wall Street e o governo dos EUA estão preocupados com o rápido desenvolvimento das capacidades online dos modelos de inteligência artificial desde que a rival da OpenAI, Anthropic, lançou um produto poderoso chamado Claude Mythos Preview em abril. A OpenAI lançou seu próprio produto de rede em maio, seguido pelo GPT-5.6 Sol em junho, que chama de “o modelo de segurança de rede mais poderoso até o momento”.

Ambas as empresas têm avisar Reconhece os riscos dos modelos de rede avançados e tomou medidas para limitar a sua disponibilidade a determinadas empresas e agências governamentais.

Walter Isaacson, sócio de consultoria do banco de investimento Perella Weinberg, disse na quarta-feira que acha que o incidente do abraço facial é “realmente assustador”, embora se considere um otimista em IA.

“Essa foi a primeira coisa que me assustou completamente”, disse ele ao “Squawk Box” da CNBC.

Yoshua Bengio, um importante pesquisador de inteligência artificial que ganhou o prestigioso prêmio AM Turing em 2018, escreveu em um artigo Postar no X O incidente foi descrito como “profundamente preocupante” na quarta-feira. Ele disse que os agentes demonstraram disposição para trapacear em testes controlados durante meses, mas “este caso do mundo real deveria ser um alerta”.

“Continuar a trajetória atual de desenvolvimento da inteligência artificial pode levar a um aumento de casos específicos de ataques cibernéticos autônomos e outros incidentes de alto risco de comportamento errôneo e perigoso da inteligência artificial”, disse Bengio. “Precisamos urgentemente de tomar medidas para evitar que estas situações aconteçam, em vez de tentarmos limpar os danos após o facto.

A OpenAI disse na terça-feira que a inteligência artificial está acelerando a descoberta e exploração de vulnerabilidades, o que significa que a segurança e a proteção do modelo precisam acompanhar.

“Estamos aprimorando as práticas de contenção, monitoramento, controle de acesso e avaliação utilizadas durante o desenvolvimento do modelo”, disse a empresa.

assistir: O presidente da OpenAI, Bret Taylor, fala sobre economia de tokens de IA e eficiência de tokens

Escolha a CNBC como sua fonte preferida no Google e nunca perca um momento do nome mais confiável em notícias de negócios.

Link da fonte