Meta atualiza regras de segurança para seus modelos mais avançados e promete comitê de IA no conselho
Versão 2.1 do framework cria salvaguardas durante o treino e trata de pesos abertos; ONG aponta que critérios numéricos de risco cibernético foram retirados.
A Meta publicou em 2 de outubro de 2026 uma nova versão das regras que diz seguir para treinar, avaliar e lançar seus modelos de IA mais avançados. A versão 2.1 do Meta Superintelligence Scaling Framework, antes chamado Advanced AI Scaling Framework, passa a exigir salvaguardas também durante o treinamento e detalha os riscos de lançar modelos com pesos abertos, segundo o blog da Meta Superintelligence Labs e o documento do framework. A empresa também promete criar, “nos próximos meses”, um comitê de IA no conselho de administração.
Segurança antes mesmo do lançamento
A principal novidade é tratar o risco de um modelo escapar do controle ainda na fase de treino. A Meta diz que, antes de cada treinamento por reforço, vai avaliar se o modelo pode comprometer o ambiente em que roda. Se puder, três medidas passam a ser obrigatórias: ambientes isolados (sandboxes) checados contra vulnerabilidades, registro em tempo real das saídas do modelo, inclusive a cadeia de raciocínio, em sistemas que impedem alteração posterior, e monitores automáticos capazes de interromper o treino se detectarem mau comportamento grave ou tentativa de fuga.
Sobre pesos abertos, a Meta reconhece que quem tem os pesos pode contornar recusas do modelo ou retreiná-lo para tirar as travas, e diz que vai considerar esse uso posterior nas avaliações de risco. A empresa reafirma que lançar modelos abertos faz parte de sua estratégia.
Ligação com o acordo da Casa Branca
A Meta afirma que a atualização reflete os compromissos assumidos na Casa Branca na mesma semana. Segundo o AI.info, trata-se do acordo de 29 de setembro assinado por Mark Zuckerberg e por líderes de Google, Anthropic, OpenAI, xAI e Nvidia, que prevê controles internos, uma equipe interna independente, auditoria externa e comitê independente no conselho. O comitê da Meta, porém, ainda não existe: a empresa não divulgou membros, regras de funcionamento nem data.
O que a Meta não destacou
A ONG americana The Midas Project, que monitora políticas de segurança de empresas de IA, publicou uma comparação entre as versões e apontou mudanças que não constam do resumo da Meta. Segundo a organização, o framework deixou de exigir que os testes de risco busquem a capacidade máxima do modelo, inclusive com versões sem travas. Também trocou um critério numérico para risco cibernético, de 75% de acerto em desafios simples, por um padrão indefinido de “desempenho suficientemente alto”, e retirou a regra que segurava provisoriamente o lançamento de um modelo que cruzasse esse limite. A redação conferiu no documento da versão 2.1 que o critério numérico não aparece mais e que a nova expressão é a usada. O registro de mudanças do próprio documento cita apenas a troca de nome, os pesos abertos, a nova categoria de perda de controle e ajustes de terminologia.
Para quem usa ou avalia modelos da Meta, a atualização torna mais específicas as regras de treino, mas é uma política voluntária, definida e aplicada pela própria empresa, sem verificação independente de que as medidas funcionem na prática.
Fontes
- Meta AI Research — Developing Capable Models Responsibly (02/10/2026)
- Meta — Meta Superintelligence Scaling Framework, versão 2.1 (PDF) (10/2026)
- The Midas Project (Watchtower) — Meta, Moderate Change on Oct 02, 2026 (02/10/2026)
- AI.info — Meta Adds Training-Time Safeguards to Its AI Release Framework (03/10/2026)
Imagem destacada: ilustração gerada por computador, sem valor documental.


