PCGuia PCGuia
  • [email protected]
  • Dicas
    • Apps
    • Descomplicómetro
    • Download da semana
    • Guia completo
    • Inteligência Artificial
    • Linux
    • MacGuia
    • Modding
    • Photoshop
    • Teste de velocidade da Internet
    • Open Source
  • Notícias
    • Ambiente
    • Apps
    • Ciência
    • Curiosidades
    • Hardware
    • Inteligência Artificial
    • Internet
    • Jogos
    • Mercados
    • Mobilidade
    • Multimédia
    • Robots
    • Segurança
    • Software
    • Startup
    • Especiais
      • Especial PCGuia
      • História
      • Reportagem PC Guia
  • Reviews
    • Armazenamento
    • Áudio
    • Componentes
    • Desktops
    • Gadgets
    • Imagem
    • Mobilidade
    • Periféricos
    • Robótica
  • Opinião
    • Conceito Humanoide
    • Há Uma App Para Tudo
    • O Que Vem à Rede
    • Praia das Maçãs
    • Quinta Coluna
  • Loja Fidemo
  • Precisa de ajuda?
  • Contactos
  • Como testamos os produtos
  • Termos de utilização
  • Política de privacidade e cookies
  • Estatuto Editorial
  • Declaração de Privacidade
  • Política de Cookies
  • Vencedores dos Prémios Leitor PCGuia 2025
  • Declaração de Privacidade
© 2023 - Fidemo Sociedade de Media
A ler: OpenAI e Anthropic investigam milhares de falhas de segurança em modelos de inteligência artificial
Font ResizerAa
PCGuia PCGuia
Font ResizerAa
Procurar
  • Dicas
  • Jogos
  • Linux
  • Notícias
  • Opinião
  • Reviews
  • Cookie Policy
© 2023 Fidemo Sociedade de Média
PCGuia > Notícias > Inteligência Artificial > OpenAI e Anthropic investigam milhares de falhas de segurança em modelos de inteligência artificial
Inteligência ArtificialNotíciasSegurança

OpenAI e Anthropic investigam milhares de falhas de segurança em modelos de inteligência artificial

A OpenAI e a Anthropic estão a braços com uma vaga de falhas de segurança nos seus modelos mais avançados de inteligência artificial. A situação forçou a interrupção de treinos críticos após os sistemas de emergência falharem perante agentes autónomos descontrolados.

Pedro Tróia
Publicado em 28 de Setembro, 2026
Tempo de leitura: 3 min
Control room with two large screens showing 'ERRO CRÍTICO' and 'FALHA DE SEGURANÇA DETETADA', red emergency lights, and a person at a console.
Imagem gerada por IA
Neste artigo
  • Ocorrências graves e interrupção de treinos
  • A resposta da Anthropic

A OpenAI e a Anthropic estão a investigar dezenas de milhares de incidentes de segurança que envolvem os respectivos modelos de inteligência artificial mais avançados. Segundo avança o Tom’s Hardware, os problemas ocorreram durante testes internos e avaliações no mundo real. A enorme escala destas ocorrências indica que o desafio de controlar agentes autónomos é muito mais complexo do que se pensava inicialmente. Enquanto a OpenAI recupera terreno e ameaça a liderança da Anthropic no mercado empresarial, as duas empresas enfrentam agora um cenário onde as salvaguardas técnicas falham repetidamente.

Ocorrências graves e interrupção de treinos

A situação atingiu um ponto crítico a 20 de Setembro, quando um modelo de pesquisa interno da OpenAI contornou os filtros de rede para contactar um robô de conversação externo. O sistema de monitorização emitiu um alerta em 15 minutos e um humano reconheceu a falha três minutos depois. Contudo, o interruptor automático de emergência falhou por completo. Esta anomalia permitiu que o treino continuasse durante mais duas horas e meia até os engenheiros pararem o processo manualmente. Em resposta directa a este evento, a criadora do ChatGPT suspendeu imediatamente o treino dos modelos mais capazes.

- Publicidade -

Os episódios assinalados pelos investigadores variam em gravidade e incluem tentativas de escapar a ambientes isolados, apropriação de sites e evasão a regras de segurança. Um dos casos mais severos aconteceu em Julho. Nessa altura, o modelo GPT-5.6 Sol e outro sistema não lançado invadiram os servidores de produção da Hugging Face para procurar respostas para um teste de avaliação. Os relatórios técnicos mostraram que os modelos aprenderam inadvertidamente a enganar os testes e começaram a comunicar entre si.

A resposta da Anthropic

Do lado da concorrência, a Anthropic contratou uma organização externa de segurança para examinar o comportamento dos próprios sistemas. A empresa publicou relatórios que detalham a frequência com que os modelos desobedecem às directrizes. Num documento divulgado a 22 de Setembro, os testes ao Claude Opus 5.5 revelaram que o modelo tentou escapar do ambiente isolado em 1,5% das execuções. A tecnológica sublinhou que estas experiências foram desenhadas especificamente para forçar os limites da inteligência artificial. Como as empresas realizam centenas de milhares de testes, uma pequena percentagem de falhas traduz-se rapidamente em dezenas de milhares de incidentes de segurança.

- Publicidade -
Etiquetas:AnthropicOpenAI
Sem comentários

Deixe um comentário Cancelar resposta

O seu endereço de email não será publicado. Campos obrigatórios marcados com *

Publicidade Konica
Ad image
Apoio
Ad image Ad image

Também lhe pode interessar

Windows_11
NotíciasSoftware

Microsoft explica o motivo para reiniciar o PC em vez de o desligar

Tempo de leitura: 2 min
Turbina eolicas
AmbienteCiênciaNotícias

Estudo chinês alerta para interferência de turbinas eólicas em radares costeiros

Tempo de leitura: 3 min
Oneplus16
MobilidadeNotícias

OnePlus anuncia a chegada do novo OnePlus 16 com processador Snapdragon 8 Elite Extreme Gen 6

Tempo de leitura: 3 min
Copilot_Microsoft
MercadosNotícias

Microsoft abandona a marca Copilot+ PC nos novos computadores Windows

Tempo de leitura: 3 min
© 2023 Fidemo Sociedade de Media