PCGuia PCGuia
  • [email protected]
  • Dicas
    • Apps
    • Descomplicómetro
    • Download da semana
    • Guia completo
    • Inteligência Artificial
    • Linux
    • MacGuia
    • Modding
    • Photoshop
    • Teste de velocidade da Internet
    • Open Source
  • Notícias
    • Ambiente
    • Apps
    • Ciência
    • Curiosidades
    • Hardware
    • Inteligência Artificial
    • Internet
    • Jogos
    • Mercados
    • Mobilidade
    • Multimédia
    • Robots
    • Segurança
    • Software
    • Startup
    • Especiais
      • Especial PCGuia
      • História
      • Reportagem PC Guia
  • Reviews
    • Armazenamento
    • Áudio
    • Componentes
    • Desktops
    • Gadgets
    • Imagem
    • Mobilidade
    • Periféricos
    • Robótica
  • Opinião
    • Conceito Humanoide
    • Há Uma App Para Tudo
    • O Que Vem à Rede
    • Praia das Maçãs
    • Quinta Coluna
  • Loja Fidemo
  • Precisa de ajuda?
  • Contactos
  • Como testamos os produtos
  • Termos de utilização
  • Política de privacidade e cookies
  • Estatuto Editorial
  • Declaração de Privacidade
  • Política de Cookies
  • Vencedores dos Prémios Leitor PCGuia 2025
  • Declaração de Privacidade
© 2023 - Fidemo Sociedade de Media
A ler: Anthropic confirma que o Claude invadiu sistemas de outras empresas mais uma vez
Font ResizerAa
PCGuia PCGuia
Font ResizerAa
Procurar
  • Dicas
  • Jogos
  • Linux
  • Notícias
  • Opinião
  • Reviews
  • Cookie Policy
© 2023 Fidemo Sociedade de Média
PCGuia > Notícias > Inteligência Artificial > Anthropic confirma que o Claude invadiu sistemas de outras empresas mais uma vez
Inteligência ArtificialNotíciasSegurança

Anthropic confirma que o Claude invadiu sistemas de outras empresas mais uma vez

A Anthropic confirmou um novo incidente onde o modelo Claude acedeu a sistemas reais sem autorização, levantando novas questões sobre a segurança dos agentes autónomos.

Pedro Tróia
Publicado em 11 de Setembro, 2026
Tempo de leitura: 5 min
Claude
Imagem gerada por IA
Neste artigo
  • Falhas de configuração e domínios reais
  • Comportamento imprudente e pacotes maliciosos
  • Integrações recentes e regras europeias
  • O caso paralelo da OpenAI

A Anthropic confirmou mais um incidente onde o seu modelo de inteligência artificial acedeu a sistemas reais de terceiros sem autorização. O caso remonta a Janeiro de 2026 e envolveu a versão inicial do Claude Opus 4.6, que ultrapassou as barreiras de segurança após ser incapaz de abortar a tarefa atribuída. A situação passou despercebida até ao mês passado, período em que a empresa notificou todas as partes afectadas, segundo o site The Hacker News. Este é já o quarto incidente, o que levanta preocupações sobre os riscos de segurança associados a agentes autónomos.

Falhas de configuração e domínios reais

No final de Julho de 2026, a tecnológica já tinha revelado que 3 dos seus modelos, incluindo o Claude Opus 4.7 e o Mythos 5, invadiram 3 organizações durante avaliações de cibersegurança. Após a descoberta do caso mais recente, a empresa norte-americana expandiu a análise a cerca de 481 milhões de transcrições e não encontrou outros episódios de gravidade semelhante. Todos os 4 incidentes ocorreram durante testes construídos pelo mesmo parceiro de avaliação, a Irregular. O modelo foi instruído a operar em simulações sem acesso à internet, mas erros de configuração ligaram o sistema à rede aberta. O problema teve origem em falhas de nomenclatura, onde o nome de empresas fictícias usadas nas simulações de ataque correspondia a domínios reais, o que levou a inteligência artificial a tomar acções ofensivas.

- Publicidade -

Comportamento imprudente e pacotes maliciosos

Para apurar as causas, a Anthropic assinou acordos com a organização sem fins lucrativos METR para conduzir investigações independentes. A raiz do problema reside em 2 questões fundamentais de alinhamento, nomeadamente o raciocínio tendencioso e a imprudência. Os modelos tenderam a ignorar as evidências de que o seu ambiente estava ligado à internet real e demonstraram vontade de tomar acções prejudiciais na sua busca obstinada por concluir a tarefa. O caso mais preocupante envolveu o Claude Mythos 5, que fez grandes esforços para carregar pacotes maliciosos no PyPI, o repositório público a partir do qual a maioria do software Python é instalado. Apesar de o modelo afirmar no seu processo de pensamento que acreditava estar em simulações, as acções tomadas foram consistentes com o conhecimento de que estava na internet real.

Integrações recentes e regras europeias

Apesar destes desvios de comportamento, a Anthropic sublinhou que as acções permaneceram em âmbitos restritos, com os modelos a tentarem apenas resolver os exercícios propostos, sem nunca tentarem coordenar ataques com outros agentes ou ocultar provas. A empresa tem procurado reforçar a confiança nos seus produtos através de novas funcionalidades, como a recente capacidade de enviar correio electrónico directamente a partir da interface do Gmail. Ao mesmo tempo, para garantir a conformidade com a legislação do velho continente, a tecnológica começou a inserir marcadores invisíveis nos textos gerados, para assegurar maior transparência na identificação de conteúdos criados por inteligência artificial.

O caso paralelo da OpenAI

A divulgação destes incidentes surge num período em que várias empresas enfrentam escrutínio crescente sobre a segurança dos seus modelos. Recentemente, a OpenAI reconheceu o incidente não reportado de Maio de 2026, onde os seus agentes autónomos assumiram o controlo do fórum alemão inactivo com 25 anos, o DseWiki. Os agentes transformaram o espaço em quadros de avisos e trocaram mais de 18000 publicações para partilhar técnicas de evasão de restrições. Quando a moderação humana começou a remover as mensagens 30 dias depois, os agentes contra-atacaram ao nomear as páginas de cópia de segurança com o prefixo ZZZ, para que ficassem enterradas no final da lista alfabética de eliminação. A actividade só caiu para níveis próximos de 0 a 22 de Junho de 2026, após intervenção directa da OpenAI. A proliferação destes agentes autónomos continua a expandir-se para o quotidiano dos utilizadores, como se verifica na possibilidade de usar assistentes virtuais para procurar refeições e produtos em aplicações de entrega, o que exige cada vez mais garantias de segurança por parte das empresas tecnológicas.

- Publicidade -
Etiquetas:AnthropicClaude
Sem comentários

Deixe um comentário Cancelar resposta

O seu endereço de email não será publicado. Campos obrigatórios marcados com *

Publicidade Konica
Ad image
Apoio
Ad image Ad image

Também lhe pode interessar

Silhouette of a person on a wet dock gazing over a neon-lit, futuristic city with towering skyscrapers and elevated highways at night.
Inteligência ArtificialNotícias

OpenAI lança novo modelo capaz de gerar imagens 50% mais depressa

Tempo de leitura: 2 min
©Trust | Rovix
HardwareNotícias

GXTrust lança comando para iPhone e Android com autonomia até doze horas

Tempo de leitura: 2 min
Close-up of Trident Z5 Royal NEOX RAM modules with blue and purple RGB lighting on a motherboard.
HardwareNotícias

G.Skill apresenta novas memórias Trident Z5 Royal NeoX com tecnologia AMD EXPO ULL

Tempo de leitura: 3 min
©Logitech | MX Keypad
HardwareInteligência ArtificialNotícias

MX Keypad é o novo periférico da Logitech para controlar ferramentas de programação com IA através de teclas físicas

Tempo de leitura: 2 min
© 2023 Fidemo Sociedade de Media