PCGuia PCGuia
  • [email protected]
  • Dicas
    • Apps
    • Descomplicómetro
    • Download da semana
    • Guia completo
    • Inteligência Artificial
    • Linux
    • MacGuia
    • Modding
    • Photoshop
    • Teste de velocidade da Internet
    • Open Source
  • Notícias
    • Ambiente
    • Apps
    • Ciência
    • Curiosidades
    • Hardware
    • Inteligência Artificial
    • Internet
    • Jogos
    • Mercados
    • Mobilidade
    • Multimédia
    • Robots
    • Segurança
    • Software
    • Startup
    • Especiais
      • Especial PCGuia
      • História
      • Reportagem PC Guia
  • Reviews
    • Armazenamento
    • Áudio
    • Componentes
    • Desktops
    • Gadgets
    • Imagem
    • Mobilidade
    • Periféricos
    • Robótica
  • Opinião
    • Conceito Humanoide
    • Há Uma App Para Tudo
    • O Que Vem à Rede
    • Praia das Maçãs
    • Quinta Coluna
  • Loja Fidemo
  • Precisa de ajuda?
  • Contactos
  • Como testamos os produtos
  • Termos de utilização
  • Política de privacidade e cookies
  • Estatuto Editorial
  • Declaração de Privacidade
  • Política de Cookies
  • Vencedores dos Prémios Leitor PCGuia 2025
  • Declaração de Privacidade
© 2023 - Fidemo Sociedade de Media
A ler: Meta apanhada a “enganar” um site de benchmarks com modelos de IA que não correspondem à realidade?
Font ResizerAa
PCGuia PCGuia
Font ResizerAa
Procurar
  • Dicas
  • Jogos
  • Linux
  • Notícias
  • Opinião
  • Reviews
  • Cookie Policy
© 2023 Fidemo Sociedade de Média
PCGuia > Notícias > Inteligência Artificial > Meta apanhada a “enganar” um site de benchmarks com modelos de IA que não correspondem à realidade?
Inteligência ArtificialNotícias

Meta apanhada a “enganar” um site de benchmarks com modelos de IA que não correspondem à realidade?

À primeira vista, o Maverick parecia uma séria ameaça aos modelos das suas concorrentes, mas... há um problema.

Ricardo Durand
Publicado em 8 de Abril, 2025
Tempo de leitura: 3 min
©Meta | Llama 4
©Meta

A Meta lançou, nos últimos, dias, dois novos modelos de IA de gama “média”: os Llama 4 Scout e Maverick. Ambos foram submetidos aos benchmarks do site LMArena, um plataforma que que compara resultados de diferentes modelos, cabendo aos utilizadores decidir quais são os melhores.

Na sequência dos 1417 pontos que o Llama 4 Maverick conseguiu no teste ELO (originalmente criado para avaliar a capacidade de jogadores de xadrez, tendo mais tarde passado a ser usado em eSports), a Meta apontou, em comunicado, que isto o colocava acima do ChatGPT 4o e logo abaixo do Gemini 2.5 Pro.

- Publicidade -

Desta forma, o Maverick assumia-se como uma séria ameaça aos modelos das suas concorrentes, mas… há um problema. A documentação da Meta sobre esta IA mostra, nas chamadas “letras pequeninas” que a versão testada na LMArena não é a mesma que está disponível ao público, acusaram vários especialistas em IA, no X.

Desta forma, não terá as mesmas capacidades que uma chamada “versão comercial”, uma vez que foi reforçada apenas para ter um bom desempenho nos testes.

De acordo esta documentação, a Meta diz que submeteu uma «versão experimental de chat» do Maverick «especificamente optimizada para conversação», noticiou o TechCrunch, o que levou a uma reacção dura do LMArena: «A interpretação da Meta da nossa política não corresponde ao que esperamos dos fornecedores de modelos»

- Publicidade -

Os responsáveis do site acusam mesmo a empresa de Mark Zuckerberg de falta de transparência: «A Meta deveria ter deixado mais claro que o ‘Llama-4-Maverick-03-26-Experimental’ era um modelo personalizado para estes benchmarks». Na sequência desta polémica, o LMArena decidiu «actualizar as políticas de classificação para reforçar o compromisso com avaliações justas e reproduzíveis» com o objectivo de que este tipo de confusões «não volte a acontecer».

Da parte da Meta, há uma reacção de Ahmad Al-Dahle, vice-presidente de IA generativa, no X : «Simplesmente, não é verdade, nunca faríamos isso». O responsável esclareceu ainda que alguns utilizadores podem estar a a ter «experiências inconsistentes» com o Maverick pelo facto de nem todas as funcionalidades disponíveis quando os modelos são partilhados online,

«Uma vez que lançamos os modelos assim que ficaram prontos, esperamos que sejam necessários vários dias para que todas as implementações públicas sejam ligadas, disse Al-Dahle, que prometeu que a Meta vai «continuar a trabalhar na correcção de erros».

- Publicidade -
Etiquetas:inteligência artificial
Publicidade Konica
Ad image
Apoio
Ad image Ad image

Também lhe pode interessar

OpenAI_2
Inteligência ArtificialNotíciasSegurança

OpenAI bloqueia 15.000 utilizadores por tentarem extrair dados secretos de inteligência artificia

Tempo de leitura: 3 min
Cloudflare
InternetNotíciasSegurança

Cloudflare apresenta autoridade de certificação gratuita para toda a Internet

Tempo de leitura: 2 min
Huawei-Mate-90_1
MobilidadeNotícias

Huawei apresenta na China a gama Mate 90 com novos processadores Kirin

Tempo de leitura: 3 min
California
Inteligência ArtificialNotícias

Califórnia proíbe despedimentos ditados em exclusivo pela inteligência artificial

Tempo de leitura: 3 min
© 2023 Fidemo Sociedade de Media