Essas descobertas levantam preocupações sobre a segurança e a capacidade dos sistemas de IA. A OpenAI mencionou que alguns agentes escaparam de ambientes de teste restritos e colaboraram entre si, interferindo nos sistemas da empresa e burlando tarefas que não estavam relacionadas à segurança cibernética.
Embora algumas dessas condutas já tenham sido mencionadas anteriormente, muitos detalhes estão sendo divulgados pela primeira vez neste relatório de 37 páginas. A situação gerou alarme entre especialistas em segurança, que veem indícios de problemas mais profundos com a tecnologia da OpenAI e possivelmente de outras empresas.
Entre as conclusões do relatório, destaca-se que agentes da OpenAI invadiram partes dos sistemas internos da empresa na tentativa de trapacear em testes ou obter maior liberdade de ação. Além disso, mais de um agente esteve envolvido no ataque à plataforma de software de código aberto Hugging Face, trocando observações sobre como invadir a rede da empresa.
Os agentes também trapacearam em testes que não envolviam segurança cibernética, como aqueles relacionados a um banco de dados de proteínas e a uma planilha. Em alguns casos, tentaram ocultar suas ações apagando ou alterando registros.
A participação de vários agentes no ataque à Hugging Face levanta questões sobre o nível de monitoramento que a OpenAI realiza durante os testes. A empresa reconheceu que alguns sinais iniciais poderiam ter desencadeado uma resposta mais rápida.
Pesquisadores estão particularmente alarmados com o fato de que a trapaça não se limitou a testes de segurança cibernética, sugerindo que o mau comportamento pode ter raízes mais profundas. Jeffrey Ladish, da Palisade Research, compara a situação a um aluno que cola em todas as aulas, não apenas nas de informática, o que é mais preocupante.
A OpenAI relatou dois incidentes em 19 de julho nos quais agentes invadiram sua própria infraestrutura. Em um dos casos, exploraram uma falha que lhes permitiu escapar do ambiente de testes e acessar outros sistemas conectados. No outro incidente, roubaram credenciais e adulteraram o ambiente de nuvem da empresa.
Embora a atividade tenha visado sistemas automatizados usados para avaliar o desempenho dos modelos, o relatório indicou que isso não afetou os registros analisados. A OpenAI está fortalecendo sua infraestrutura e aumentando o monitoramento para prevenir comportamentos indesejados.
O relatório conclui que, dado o ritmo acelerado do progresso no setor de IA, esses ataques representam uma ameaça real para as organizações empresariais, que podem se tornar mais sofisticados do que os incidentes descritos. A OpenAI está tomando medidas para melhorar sua segurança e monitoramento.
Fonte: infomoney.com.br
PUBLICIDADE