Para Jack Clark, os detalhes sobre um ‘botão de desligamento’ devem fazer parte da ‘discussão política’ em torno da IA Kevin Dietsch/Getty Images via BBC Um dos cofundadores de uma das maiores empresas de IA do mundo afirmou que um “botão de desligamento” da inteligência artificial, que possa ser verificado de forma independente, talvez seja...
Tag: Anthropic
CEO da Anthropic defende desacelerar IA sem parar progresso
O CEO propõe um plano em três etapas para “desacelerar a fronteira” sem parar o desenvolvimento. A ideia é garantir tempo para alinhar modelos, reforçar barreiras e permitir que avaliadores independentes verifiquem se as práticas de segurança estão sendo seguidas. Três etapas para “marcar o passo” 1) Adoção de avaliadores externos dentro das empresas. Amodei...
Anthropic: como Claude foi manipulado para armas, espionagem e golpes
As tentativas incluíram esforços para obter a ajuda do Claude na elaboração de um pedido de subsídio para financiar pesquisas sobre a modificação do vírus da chikungunya em um local onde a Anthropic não oferece seus serviços. Em outro caso, também em um local onde a empresa não opera, o que exige que os usuários...
Anthropic: Emirados usaram IA contra especialistas da ONU sobre Sudão
A guerra entre o exército sudanês e os paramilitares das Forças de Apoio Rápido (FAR), iniciada em 2023, deixou mais de 200.000 mortos, segundo trabalhadores humanitários, e mais de 12 milhões de sudaneses deslocados, no que a ONU considera a mais grave crise humanitária do mundo. Os Emirados Árabes Unidos foram acusados em reiteradas ocasiões...
Anthropic corta esforços de pesquisa de armas biológicas, ataques russos e uso indevido do Claude pela China
Após detectar o uso indevido, a empresa baniu as contas envolvidas nessas pesquisas e incorporou suas descobertas aos processos de proteção, fiscalização e inteligência de ameaças de seus modelos de ponta, afirmou a companhia norte-americana. A Anthropic não identificou as instituições, os países onde estão sediadas nem os agentes biológicos e técnicas de pesquisa específicos...
Relatório da Anthropic: Claude e riscos de espionagem e bioterror
*Segundo a empresa, houve tentativas de usar o Claude em sete frentes de dano: ataques cibernéticos, operações de influência (propaganda), vigilância, golpes e fraudes, uso biológico, desenvolvimento de armas convencionais e “destilação” (quando alguém tenta extrair conhecimento de um modelo para treinar outro). Abaixo alguns itens que a Anthropic destacou que barrou: Cinco casos de...
Anthropic corta campanhas de IA russas e chinesas direcionadas ao Claude
A Anthropic informou ter frustrado o que descreveu como ataques de sete laboratórios sediados na China durante esse período. Entre os laboratórios citados pela Anthropic estão a gigante da tecnologia Alibaba, Moonshot, DeepSeek e Xiaomi. Operadores ligados à Alibaba conduziram o que a Anthropic chamou de maior ataque de “destilação ilícita”, supostamente com o objetivo...
Anthropic bloqueia uso de IA em pesquisas ligadas a armas biológicas
Documento também aponta uso do Claude para propaganda apresentada como se fosse jornalismo independente. Segundo a empresa, veículos estatais russos teriam gerado textos com alegações fabricadas, incluindo afirmações sobre uma eleição na Moldávia. Anthropic diz ter identificado ainda tentativas de usar o chatbot para desenvolver software voltado a armas convencionais. A empresa relata pedidos relacionados...
Claude: Anthropic reforça segurança após falhas em testes
Organizações que avaliarem modelos de pré-lançamento com proteções reduzidas terão de seguir novas exigências. As medidas incluem isolamento total da rede, verificação prévia de vulnerabilidades, limites claros para cada modelo e monitoramento de seu raciocínio, ações e tráfego de rede. As regras não valem para clientes que usam modelos com as proteções padrão, como o...
Anthropic retoma testes externos de segurança após ataques de Claude
A Anthropic classificou os incidentes envolvendo o Claude como uma “falha de segurança operacional”, afirmando que eles ocorreram devido a erros em um ambiente de avaliação de terceiros. A empresa suspendeu as avaliações externas dos modelos e interrompeu brevemente os testes internos enquanto implementava novas medidas de segurança. Na segunda-feira, a Anthropic informou que retomou...








