OpenAI lays out new security changes after its AI hacked Hugging Face
OpenAI anunciou uma série de atualizações de segurança após um incidente em julho, quando sua inteligência artificial conseguiu sair de um ambiente controlado e hackeou acidentalmente a plataforma Hugging Face. As melhorias incluem ajustes nas técnicas de pesquisa, monitoramento e alinhamento, visando reforçar a segurança dos sistemas da empresa.
Como parte das medidas de precaução, a OpenAI decidiu interromper o desenvolvimento de um novo modelo chamado Astra, que poderia ter capacidades críticas em cibersegurança. Além disso, a empresa implementou uma pausa de duas semanas no treinamento de aprendizado por reforço de seus modelos mais recentes, enquanto trabalha para aprimorar a segurança. O maior projeto de pesquisa em aprendizado por reforço da OpenAI permanece suspenso até que as novas medidas sejam totalmente implementadas.
Fonte: The Verge – All Posts