Os usuários do Claude encontraram maneiras de contornar as salvaguardas para a pesquisa de armas biológicas


A Anthropic disse que interrompeu várias tentativas de cientistas este ano de usar sua tecnologia para pesquisas que poderiam ajudar a desenvolver armas biológicas, já que os especialistas temem cada vez mais a ameaça que a IA representa para a segurança pública.
A startup deu cinco exemplos de ocasiões em que os atores “contornaram os controles” e fizeram outros esforços para “ofuscar” o propósito de suas pesquisas para evitar as salvaguardas. Os casos envolveram alguns usuários em países que proíbem o acesso aos seus modelos, que incluem Rússia, China e Irã.
“Esperamos que, ao compartilhar esses exemplos, possamos iniciar um diálogo dentro da indústria de IA e com os governos sobre os riscos biológicos emergentes e a melhor forma de combatê-los”, disse a Anthropic em um relatório sobre os esforços para usar seus modelos para atividades maliciosas.
Leia o artigo completo
Comentários






