Tag: Claude

Início Claude
Após dono do Claude pedir freio no desenvolvimento de IA, Trump minimiza riscos, China vê ameaças e UE pede segurança
Post

Após dono do Claude pedir freio no desenvolvimento de IA, Trump minimiza riscos, China vê ameaças e UE pede segurança

O CEO da Anthropic, Dario Amodei, pediu, no sábado (12), que empresas desacelerem o desenvolvimento de seus modelos de IA. Reuters O debate sobre o avanço da inteligência artificial voltou a ganhar destaque nesta semana após o CEO da Anthropic, Dario Amodei, defender, em um artigo publicado no sábado (12), que as empresas desacelerem o...

Anthropic: como Claude foi manipulado para armas, espionagem e golpes
Post

Anthropic: como Claude foi manipulado para armas, espionagem e golpes

As tentativas incluíram esforços para obter a ajuda do Claude na elaboração de um pedido de subsídio para financiar pesquisas sobre a modificação do vírus da chikungunya em um local onde a Anthropic não oferece seus serviços. Em outro caso, também em um local onde a empresa não opera, o que exige que os usuários...

Anthropic corta esforços de pesquisa de armas biológicas, ataques russos e uso indevido do Claude pela China
Post

Anthropic corta esforços de pesquisa de armas biológicas, ataques russos e uso indevido do Claude pela China

Após detectar o uso indevido, a empresa baniu as contas envolvidas nessas pesquisas e incorporou suas descobertas ‌aos processos de proteção, fiscalização e inteligência de ameaças de seus modelos de ponta, afirmou a companhia norte-americana. A Anthropic não identificou as instituições, os países onde estão sediadas nem os agentes biológicos e técnicas de pesquisa específicos...

Relatório da Anthropic: Claude e riscos de espionagem e bioterror
Post

Relatório da Anthropic: Claude e riscos de espionagem e bioterror

*Segundo a empresa, houve tentativas de usar o Claude em sete frentes de dano: ataques cibernéticos, operações de influência (propaganda), vigilância, golpes e fraudes, uso biológico, desenvolvimento de armas convencionais e “destilação” (quando alguém tenta extrair conhecimento de um modelo para treinar outro). Abaixo alguns itens que a Anthropic destacou que barrou: Cinco casos de...

Anthropic corta campanhas de IA russas e chinesas direcionadas ao Claude
Post

Anthropic corta campanhas de IA russas e chinesas direcionadas ao Claude

A Anthropic informou ter frustrado o que descreveu como ataques de sete laboratórios sediados na China durante esse período. Entre os laboratórios citados pela Anthropic estão a gigante da tecnologia Alibaba, Moonshot, DeepSeek e Xiaomi. Operadores ligados à Alibaba conduziram o que a Anthropic chamou de maior ataque de “destilação ilícita”, supostamente com o objetivo...

Claude: Anthropic reforça segurança após falhas em testes
Post

Claude: Anthropic reforça segurança após falhas em testes

Organizações que avaliarem modelos de pré-lançamento com proteções reduzidas terão de seguir novas exigências. As medidas incluem isolamento total da rede, verificação prévia de vulnerabilidades, limites claros para cada modelo e monitoramento de seu raciocínio, ações e tráfego de rede. As regras não valem para clientes que usam modelos com as proteções padrão, como o...

Anthropic retoma testes externos de segurança após ataques de Claude
Post

Anthropic retoma testes externos de segurança após ataques de Claude

A Anthropic classificou os incidentes envolvendo o Claude como uma “falha de segurança operacional”, afirmando que eles ocorreram devido a erros ‌em um ambiente de avaliação de terceiros. ‌A empresa ​suspendeu as avaliações externas dos modelos e interrompeu brevemente os testes internos enquanto implementava novas medidas de segurança. Na segunda-feira, a Anthropic informou que retomou...

Claude: código remove marca d?água após anúncio da Anthropic
Post

Claude: código remove marca d?água após anúncio da Anthropic

A regra da União Europeia exige que conteúdo sintético seja identificável por máquina. As normas determinam que empresas que oferecem modelos de IA rotulem áudio, imagem, vídeo ou texto gerados artificialmente, sob risco de multas de até 3% do faturamento anual. Marca-d’água do Claude seria invisível ao leitor e baseada em padrões de linguagem. A...

Anthropic detalha marca d’água em textos do Claude
Post

Anthropic detalha marca d’água em textos do Claude

O método escolhido é o SynthID-Text, abordagem descrita pela equipe do Google DeepMind em 2024, e a companhia planeja lançar uma API para detecção. “Identificar esses padrões é fundamentalmente diferente de checar uma marca d’água”, afirmou a empresa em publicação, ao diferenciar o sistema de ferramentas que tentam “adivinhar” uso de IA por traços de...