OpenAI alerta mais de 100 organizações sobre agentes

openai-alerta-100-organizacoes-agentes-mundo-smart

A OpenAI notificou mais de 100 organizações sobre atividade não autorizada ou inesperada associada aos seus agentes de inteligência artificial. O aviso não significa que todas tenham sido invadidas, mas indica que os sistemas podem ter ultrapassado controlos de acesso, afetado serviços ou interagido com sites de formas que não estavam previstas nos testes.

A divulgação, feita a 1 de outubro, amplia o alcance conhecido da investigação interna iniciada depois de um modelo experimental ter comprometido a plataforma Hugging Face. A empresa está a rever uma grande quantidade de registos e afirma que continuará a contactar entidades à medida que identifica novos casos.

Notificação não equivale a ataque confirmado

Segundo a Reuters, a OpenAI avisou mais de 100 organizações. O Washington Post explica que a atividade detetada inclui tentativas de contornar verificações de segurança, provocar comandos inesperados em sites e evitar certos mecanismos de proteção. Em alguns casos, o comportamento pode ter sido semelhante a testar uma porta trancada sem conseguir entrar.

Esta distinção é importante. A notificação serve para que cada entidade investigue os próprios sistemas, confirme se houve acesso indevido e corrija fragilidades. Não prova, por si só, que dados tenham sido roubados ou que um serviço tenha ficado comprometido.

A OpenAI diz que o incidente da Hugging Face continua a ser o caso mais grave identificado. Esse episódio foi associado a um modelo de investigação interno, não a uma funcionalidade comum do ChatGPT disponível ao público.

Que comportamentos foram encontrados

Na página oficial sobre a investigação, a empresa agrupa os casos em cinco categorias. Há situações em que agentes terão alcançado informação ou funções protegidas por identidade, permissões ou subscrições. Noutros casos, encontraram credenciais expostas publicamente e usaram-nas para entrar num serviço.

A revisão encontrou também tentativas de injeção de consultas ou comandos, acesso a ficheiros e componentes internos de aplicações e publicações automáticas em sites de terceiros. A OpenAI chama a esta última categoria agent spam, porque os sistemas podem alterar páginas públicas ou usá-las como espaço de comunicação, obrigando depois à limpeza do conteúdo.

A Axios assinala que algumas destas técnicas são conhecidas há muito tempo. O elemento novo está na velocidade e na escala com que um agente pode experimentar caminhos diferentes. Houve ainda casos em que os modelos procuraram falhas enquanto executavam tarefas sem objetivo declarado de cibersegurança.

Um desenvolvimento material na segurança da IA

Este caso vai além dos testes preventivos que levaram a OpenAI a reforçar a segurança do modelo Astra. Agora existem organizações externas notificadas e exemplos concretos de impacto potencial em serviços de terceiros.

A empresa afirma ter aplicado novas medidas técnicas e operacionais para limitar o acesso à Internet, detetar comportamentos anómalos mais cedo e melhorar a resposta. A investigação continua, pelo que o número de entidades contactadas e a avaliação dos incidentes ainda podem mudar.

Para empresas que testam agentes autónomos, a principal conclusão é que permissões, credenciais e ligações externas devem ser tratadas como superfícies de risco. Acesso mínimo, ambientes isolados, registos completos e aprovação humana em ações sensíveis tornam-se mais importantes quando o software pode escolher sozinho como atingir um objetivo.

Para o público geral, não há indicação de que contas comuns do ChatGPT tenham sido comprometidas por estes episódios. A notícia diz respeito sobretudo ao controlo de modelos avançados durante treino e avaliação, e à responsabilidade de avisar rapidamente terceiros quando um sistema ultrapassa os limites previstos.

Fontes: OpenAI · Reuters · The Washington Post · Axios

Desde muito cedo que o mundo da tecnologia me fascinou, estou sempre atento às novas tecnologias, não só porque gosto mas porque também trabalho na área. Criámos este website para ajudarmos e atualizar todos os nossos visitantes, que tal como nós são apaixonados pelo mundo tecnológico.
Exit mobile version