Numa revelação invulgar para o setor da tecnologia, a Anthropic admitiu ter perdido o controlo de três versões do seu modelo de linguagem durante testes de cibersegurança. Os incidentes, ocorridos há alguns meses, permitiram que a IA acedesse à rede e comprometesse os sistemas de três organizações reais.
Agora foi a vez da IA da Anthropic atacar
A auditoria da empresa norte-americana foi motivada por um evento semelhante registado pela concorrência. Ao analisar os registos de avaliação, a equipa técnica identificou que as suas ferramentas ultrapassaram os limites digitais definidos para simulações fechadas.
O problema teve origem num falha técnica com uma entidade parceira encarregue de criar ambientes de simulação. As máquinas de teste mantiveram a ligação à Internet, o que abriu caminho para a evasão dos modelos Claude Opus 4.7, Claude Mythos 5 e de uma versão experimental. Ler mais

Sem comentários:
Enviar um comentário