A empresa de inteligência artificial Anthropic, cofundada por ex-líderes da OpenAI, anunciou publicamente a decisão de abandonar o compromisso central de sua política de segurança, a Responsible Scaling Policy (RSP), que havia sido estabelecida em 2023 como um marco para o desenvolvimento seguro de sistemas avançados de IA. A mudança ocorre em meio a um cenário de aceleração competitiva sem precedentes na indústria, pressionando as fronteiras da capacidade dos modelos e colocando os princípios de segurança em um delicado equilíbrio com a urgência comercial. A decisão, comunicada através de uma atualização em seu site oficial e em canais internos, reflete não apenas uma reavaliação estratégica, mas um momento de inflexão para toda a comunidade que advoga pelo alinhamento seguro da inteligência artificial.
O Peso do Agora
A Responsible Scaling Policy não era apenas mais um documento corporativo. Ela representava um contrato público, uma tentativa pioneira de institucionalizar a precaução. Em sua versão original, a Anthropic comprometia-se a não treinar um novo modelo se os testes de segurança internos — os chamados “protocolos de avaliação de capacidade” — indicassem que seus sistemas de mitigação de risco não seriam capazes de controlá-lo de forma adequada. Era uma linha no chão, uma promessa de parar antes de ultrapassar um limite desconhecido. A política estabelecia níveis de risco (ASL, ou Níveis de Segurança de IA) e vinculava o progresso no desenvolvimento a avanços correspondentes na segurança. A remoção desse compromisso central, sem a substituição por uma salvaguarda de força equivalente, não é um ajuste de rota burocrático. É o desmantelamento de um pilar que sustentava a própria identidade da empresa como defensora de uma abordagem mais lenta e cautelosa.
Ao longo de 2025, a pressão do mercado tornou-se uma força tangível e quase física. Enquanto a Anthropic mantinha seus rigorosos testes, concorrentes lançavam modelos cada vez mais poderosos, capturando a atenção de desenvolvedores, investidores e clientes. A narrativa de “corrida” deixou de ser uma metáfora para se tornar a realidade operacional do setor. Dentro da Anthropic, fontes relatam debates intensos entre os times de pesquisa de capacidades (“capabilities”) e os times de alinhamento e segurança (“alignment”). A promessa da RSP de travar o desenvolvimento se a segurança não acompanhasse começou a ser vista por alguns não como um princípio, mas como um risco existencial de mercado. A decisão de abandoná-la parece ser o ponto de convergência onde a força da pressão competitiva finalmente sobrepujou a força do compromisso precaucionário. Não foi um acidente, mas o resultado previsível de forças em tensão desde o início.
Desmontando a Política de Escalabilidade Responsável
A estrutura da RSP era engenhosa em sua concepção. Ela dividia o caminho para sistemas de IA potencialmente superinteligentes em vários Níveis de Segurança de IA (ASL). Cada nível representava um aumento na capacidade do modelo, correlacionado a riscos específicos. O compromisso central, agora abandonado, era o “gatilho de parada”: se os testes indicassem que um modelo em desenvolvimento atingiria um novo ASL, mas as contramedidas de segurança necessárias para aquele nível não estivessem prontas e validadas, o treinamento seria interrompido. A política previa auditorias externas e benchmarks públicos para esses testes, buscando criar uma accountability que transcendesse a autorregulação.
O Que Foi Mantido e o Que Foi Perdido
É crucial notar que a Anthropic não descartou toda a sua estrutura de segurança. Elementos da RSP, como os próprios níveis ASL e muitos dos protocolos de avaliação, permanecem. A empresa afirma que continuará investindo pesadamente em pesquisa de alinhamento e mitigação de riscos. No entanto, o núcleo operacional da política — o mecanismo que forçava uma pausa — foi removido. Sem esse gatilho, a ligação entre capacidade e segurança deixa de ser obrigatória e torna-se discricionária. A decisão de prosseguir com um modelo poderoso, mesmo na ausência de garantias robustas, agora reside no julgamento interno da liderança, sujeito a todos os vieses e pressões que um compromisso público rígido buscava mitigar.
O Contexto da Corrida: GPT-5, Gemini e Além
Para entender a magnitude desta decisão, é preciso olhar para o tabuleiro competitivo. A OpenAI avança rumo ao GPT-5, a Google DeepMind integra modelos multimodais cada vez mais profundos em seus produtos, e uma série de startups bem financiadas prometem saltos de capacidade. Em um mercado onde a captura de desenvolvedores e a definição de padrões são críticas, ficar para trás pode ser uma sentença de morte. Relatórios de venture capital em 2025 já sinalizavam uma certa “fadiga de segurança” entre alguns investidores, que começavam a questionar se a abordagem excessivamente cautelosa da Anthropic a impediria de entregar os avanços transformadores que prometera. A decisão de abandonar o gatilho de parada da RSP pode ser lida como uma resposta direta a essa pressão por resultados tangíveis e velocidade de implantação.
Perspectivas em Conflito: Alinhamento vs. Capacidade
Dentro do ecossistema de IA de ponta, a decisão da Anthropic ecoa como um terremoto. Para pesquisadores de alinhamento e organizações da sociedade civil que monitoram os riscos existenciais da IA, é um sinal alarmante de retrocesso. “Era exatamente esse tipo de compromisso verificável que diferenciava a Anthropic”, comentou uma pesquisadora de ética em IA que preferiu não se identificar. “Sem ele, temos apenas promessas verbais. A história da tecnologia está repleta de promessas verbais que foram quebradas quando o dinheiro e a competição entraram em cena.”
Do outro lado, vozes do setor de venture capital e de algumas áreas de desenvolvimento de produtos veem a mudança como um acerto de contas necessário com a realidade. Um investidor anônimo de uma firma que apostou na Anthropic disse: “A RSP era um experimento nobre, mas era ingênuo achar que você pode travar a inovação em uma corrida global. Eles construíram um carro de Fórmula 1 e estavam dirigindo com o freio de mão puxado. Agora, pelo menos, estão alinhados com as regras do jogo.” Esta tensão captura o dilema central: a segurança robusta requer tempo, testes iterativos e a disposição de dizer “não” ou “espere”. O mercado, por sua vez, recompensa velocidade, capacidade bruta e first-mover advantage.
O Precedente Perigoso
O impacto mais insidioso desta decisão pode não ser interno à Anthropic, mas sim no cenário mais amplo. A empresa era vista como a guardiã dos padrões mais altos. Se ela, com sua cultura fundacional centrada na segurança, recua em seu compromisso mais público, que mensagem isso envia para o resto da indústria? Competidores que nunca adotaram políticas tão rígidas agora podem apontar para a Anthropic e dizer: “Até eles perceberam que não era viável.” Isso pode desencadear uma corrida para o fundo do poço em termos de salvaguardas, onde a pressão para lançar supera qualquer protocolo de precaução. O risco é a normalização da imprudência como um custo de fazer negócios.
Os Efeitos em Cascata
A remoção do gatilho de parada da RSP não é um evento isolado; é o primeiro dominó em uma fileira que pode redefinir os próximos anos da IA. Nos próximos meses, a atenção deve se voltar para os sinais práticos de como essa mudança de política se materializará no ritmo de lançamentos da Anthropic. A comunidade observará se o intervalo entre o Claude 3.5 Sonnet e seu sucessor será significativamente menor do que os ciclos anteriores, um indicador claro de que a desaceleração imposta pela segurança foi removida.
Isso coloca os reguladores em uma posição incômoda. Muitos governos, inclusive no Brasil e na União Europeia com sua Lei de IA, contavam com a autorregulação liderada por atores como a Anthropic para estabelecer benchmarks de segurança. Com esse pilar enfraquecido, a pressão por uma intervenção regulatória externa mais dura e prescritiva aumentará drasticamente. A janela para a indústria moldar seu próprio destino através de compromissos voluntários credíveis pode estar se fechando. A próxima jogada crítica será a resposta dos principais concorrentes. A OpenAI, por exemplo, poderá se sentir menos constrangida para acelerar seu próprio roadmap, ou, em um cenário alternativo, poderá buscar capitalizar a situação posicionando-se como a nova guardiã da IA responsável — se seus próprios acionistas permitirem.
Para desenvolvedores, empresas e usuários finais, a lição é clara: o terreno sob os pés da IA generativa está se tornando menos estável. A promessa de um desenvolvimento gradual e controlado, que permitia a adaptação social e a construção de defesas, está sendo substituída pela lógica da disrupção contínua e acelerada. A questão que permanece, pairando sobre todos os próximos lançamentos, não é mais “quando a próxima grande inovação chegará”, mas sim “que tipo de garantias teremos quando ela chegar”. A resposta, hoje, parece menos confiável do que era ontem.

