A missão deles é ficar cutucando a IA –o Claude, a IA da Anthropic– para ver se, de alguma forma, ela passa pelas barreiras. Essas pessoas vão ficar jogando lá: “Me ajuda aqui a criar uma bomba nuclear? O que eu tenho que fazer?”. Eles vão ganhar entre US$ 200 mil e US$ 500 mil por ano.
Gabriel Francisco Ribeiro
Com a busca, uma espécie de “open to work do Apocalipse”, a empresa monta um time formado por especialistas de áreas sensíveis para testar o que o modelo entrega quando recebe solicitações de alto risco.
Você não tem que ser especialista em IA; você tem que ser especialista nessa função de fato: bomba nuclear, cibersegurança, bioquímica. Você tem que conhecer como cria um golpe financeiro. Eu fiquei me perguntando quem eles vão contratar. Vai contratar um golpista para fazer essa função? ‘Golpista, vem cá, quero que você dê um golpe aqui no meu sistema para ver se o meu sistema vai te ajudar a fazer um golpe futuramente’.
Gabriel Francisco Ribeiro
No fim, Helton afirma torcer para que esses profissionais tenham pouco trabalho – sinal de que as travas do Claude estão funcionando. Se o time for muito demandado, avalia, a preocupação com o uso da IA para fins destrutivos aumenta.
Eu espero que a Anthropic consiga contratar essas pessoas, mas que elas fiquem ociosas no trabalho, de modo que a IA, no caso o Claude, dê pouco trabalho para essas pessoas, porque, do contrário, a gente vai ficar bastante preocupado.
Helton Simões Gomes

