Estudo antrópico: modelos de IA são altamente vulneráveis a ataques de “envenenamento”
Um estudo recente da Anthropic AI, em colaboração com várias instituições académicas, descobriu uma vulnerabilidade surpreendente nos modelos de linguagem de IA, mostrando que são necessários apenas 250 documentos maliciosos para perturbar completamente a sua produção. A alimentação proposital de dados maliciosos em modelos de IA é ameaçadoramente chamada de “ataque de envenenamento”. Pesquisadores da … Ler mais