OCTOPUS: AI NEWSplantão automático
Nota urgente

Aliança cria diretrizes SAFE para segurança de IA

Grupo com 120 organizacoes propõe normas para proteger sistemas de IA baseados em agentes e promover troca de dados sobre incidentes de segurança.

04 de ago., 21:24 1 fonte · 1 país Mercado
Servidores em ambiente de data center escuro simbolizando infraestrutura de tecnologia. Foto: Christina Morillo / Pexels

A Open Secure AI Alliance anunciou o desenvolvimento das diretrizes SAFE (Shared AI Findings Exchange) para reforçar a cibersegurança em sistemas de inteligência artificial baseados em agentes. A iniciativa, que conta com a colaboração da Linux Foundation, busca padronizar o registro e a análise de incidentes, envolvendo uma rede atual de mais de 120 organizações.

Foco na colaboração e transparência

O framework SAFE propõe um mecanismo para o compartilhamento de informações sobre falhas e quase-acidentes de segurança entre empresas. O objetivo é identificar padrões de falhas em mecanismos de controle e converter experiências individuais em defesas coletivas. As diretrizes sugerem a notificação dos afetados e a publicação de recomendações operacionais baseadas em evidências para mitigar riscos sistêmicos.

O desenvolvimento das normas ocorre paralelamente à conferência Black Hat, em Las Vegas. A Open Secure AI Alliance inclui empresas como NVIDIA, Cisco, CrowdStrike, Hugging Face e Red Hat, que atuam na criação de ferramentas abertas e verificáveis para toda a pilha de segurança de IA.

Ferramentas para agentes de IA

Além das diretrizes, o grupo destaca que um agente de IA exige camadas adicionais de proteção, indo além da simples varredura de vulnerabilidades. A NVIDIA, por exemplo, contribui com tecnologias como a OpenShell Runtime, que estabelece controles de acesso e privacidade no nível do agente, e modelos que utilizam pesos e métodos de treinamento abertos.

A estrutura de defesa também contempla habilidades de agentes verificadas e assinadas criptograficamente, catalogadas contra riscos como injeção de comandos (prompt injection) e envenenamento de ferramentas. Esta abordagem visa permitir que os defensores monitorem a origem e a integridade de cada instrução executada pelos sistemas autônomos.

O que ainda não foi divulgado

Apurado em 1 fontes

NVIDIA Blog (Alemanha) · NVIDIA Blog (Alemanha)

Matéria do plantão automático do OCTOPUS: escrita minutos após a notícia cruzar o radar, apurada no texto das melhores fontes, e atualizada sozinha conforme novas redações publicam. A contagem de fontes acima é viva.