Site Local

Portal de notícias de tecnologia

Meta atualiza regras de segurança para seus modelos mais avançados e promete comitê de IA no conselho

Versão 2.1 do framework cria salvaguardas durante o treino e trata de pesos abertos; ONG aponta que critérios numéricos de risco cibernético foram retirados.

Meta atualiza regras de segurança para seus modelos mais avançados e promete comitê de IA no conselho

A Meta publicou em 2 de outubro de 2026 uma nova versão das regras que diz seguir para treinar, avaliar e lançar seus modelos de IA mais avançados. A versão 2.1 do Meta Superintelligence Scaling Framework, antes chamado Advanced AI Scaling Framework, passa a exigir salvaguardas também durante o treinamento e detalha os riscos de lançar modelos com pesos abertos, segundo o blog da Meta Superintelligence Labs e o documento do framework. A empresa também promete criar, “nos próximos meses”, um comitê de IA no conselho de administração.

Segurança antes mesmo do lançamento

A principal novidade é tratar o risco de um modelo escapar do controle ainda na fase de treino. A Meta diz que, antes de cada treinamento por reforço, vai avaliar se o modelo pode comprometer o ambiente em que roda. Se puder, três medidas passam a ser obrigatórias: ambientes isolados (sandboxes) checados contra vulnerabilidades, registro em tempo real das saídas do modelo, inclusive a cadeia de raciocínio, em sistemas que impedem alteração posterior, e monitores automáticos capazes de interromper o treino se detectarem mau comportamento grave ou tentativa de fuga.

Sobre pesos abertos, a Meta reconhece que quem tem os pesos pode contornar recusas do modelo ou retreiná-lo para tirar as travas, e diz que vai considerar esse uso posterior nas avaliações de risco. A empresa reafirma que lançar modelos abertos faz parte de sua estratégia.

Ligação com o acordo da Casa Branca

A Meta afirma que a atualização reflete os compromissos assumidos na Casa Branca na mesma semana. Segundo o AI.info, trata-se do acordo de 29 de setembro assinado por Mark Zuckerberg e por líderes de Google, Anthropic, OpenAI, xAI e Nvidia, que prevê controles internos, uma equipe interna independente, auditoria externa e comitê independente no conselho. O comitê da Meta, porém, ainda não existe: a empresa não divulgou membros, regras de funcionamento nem data.

O que a Meta não destacou

A ONG americana The Midas Project, que monitora políticas de segurança de empresas de IA, publicou uma comparação entre as versões e apontou mudanças que não constam do resumo da Meta. Segundo a organização, o framework deixou de exigir que os testes de risco busquem a capacidade máxima do modelo, inclusive com versões sem travas. Também trocou um critério numérico para risco cibernético, de 75% de acerto em desafios simples, por um padrão indefinido de “desempenho suficientemente alto”, e retirou a regra que segurava provisoriamente o lançamento de um modelo que cruzasse esse limite. A redação conferiu no documento da versão 2.1 que o critério numérico não aparece mais e que a nova expressão é a usada. O registro de mudanças do próprio documento cita apenas a troca de nome, os pesos abertos, a nova categoria de perda de controle e ajustes de terminologia.

Para quem usa ou avalia modelos da Meta, a atualização torna mais específicas as regras de treino, mas é uma política voluntária, definida e aplicada pela própria empresa, sem verificação independente de que as medidas funcionem na prática.

Fontes

Imagem destacada: ilustração gerada por computador, sem valor documental.

Deixe comentário

Seu endereço de e-mail não será publicado. Os campos necessários são marcados com *.

Fique por dentro

As principais notícias de tecnologia, todos os dias

Siga o portal nas redes sociais e acompanhe IA, cibersegurança, cloud, hardware e o mercado de tecnologia em primeira mão.