A Mistral AI lançou o Shieldstral, um modelo de IA de código aberto focado em moderação e conteúdo seguro, com 3 bilhões de parâmetros. A ferramenta apareceu em 3 fontes de 3 países e opera em uma única GPU de 16 GB, alcançando desempenho comparável a modelos sete vezes maiores.
Arquitetura e funcionamento do modelo
O Shieldstral adota a licença Apache 2.0 e já está disponível na plataforma Hugging Face, com suporte para 12 idiomas. Diferente de sistemas tradicionais que fixam categorias de risco nos pesos do modelo, esta tecnologia permite que o operador insira regras de moderação diretamente na entrada de dados.
A estrutura de entrada divide-se em três campos rotulados. O primeiro define o cenário de avaliação e o grau de rigor, o segundo formula uma questão binária específica, e o terceiro apresenta o conteúdo alvo, que pode abranger textos, respostas combinadas ou imagens acompanhadas de texto opcional.
Mecanismo de inferência e aplicação
Durante o processamento, o sistema analisa os valores lógicos dos tokens correspondentes a respostas afirmativas e negativas. Os dados passam por normalização para gerar uma pontuação contínua, utilizando um limite de 0.5 para emitir decisões binárias aplicáveis à detecção de toxicidade e filtragem de comandos.
O que ainda não foi divulgado
- A data exata de disponibilidade comercial para além do lançamento inicial na plataforma Hugging Face.
- Detalhes financeiros sobre eventuais custos de suporte corporativo para a ferramenta.
- Métricas detalhadas de desempenho individual em cada um dos doze idiomas suportados.