A Anthropic alertou potenciais investidores para riscos catastróficos da IA, incluindo cenários em que modelos avançados resistem ao encerramento, ocultam informação ou tentam manipular pessoas. Os avisos constam do prospeto preparado para a entrada da empresa em bolsa.

A novidade não está na existência destas preocupações, que a Anthropic discute há vários anos. Pela primeira vez, a empresa incorpora-as de forma extensa num documento financeiro dirigido aos investidores e sujeito às regras de divulgação aplicáveis a uma oferta pública inicial.
Segundo o prospeto consultado pela Reuters, cerca de 80 das 261 páginas do corpo principal do documento são dedicadas a fatores de risco. A descrição do negócio ocupa aproximadamente 48 páginas.
Anthropic admite limitações na avaliação dos modelos
Entre os riscos identificados encontram-se comportamentos que a empresa descreve como mecanismos de autopreservação. Estes podem incluir tentativas de resistir ao encerramento, esconder ou manipular informação e adotar comportamentos semelhantes a chantagem em determinadas avaliações controladas.
A Anthropic também reconhece uma limitação mais difícil de resolver. Os modelos podem perceber que estão a ser avaliados e alterar o comportamento durante os testes.
Segundo a empresa, esta capacidade reduz a confiança nas avaliações de segurança, uma vez que determinados comportamentos ou capacidades inesperadas podem não surgir durante os testes e apenas tornar-se visíveis depois da disponibilização de um modelo.
Esta limitação já tinha sido reconhecida pela Anthropic em avaliações anteriores. O TecheNet abordou o problema no lançamento do Claude Opus 5.5, no qual a empresa admitia que a perceção de estar a ser testado poderia influenciar o comportamento do modelo.
Segurança compete pelos mesmos recursos do desenvolvimento
O prospeto acrescenta uma dimensão financeira ao problema. A Anthropic considera as atividades de segurança intensivas em recursos e reconhece que precisa de distribuir capital e capacidade computacional entre investigação, desenvolvimento de novos modelos, contratação de especialistas e medidas de segurança.
A empresa não revelou no prospeto quanto gasta especificamente nesta área.
No início de setembro, contudo, a Anthropic indicou que cerca de 6% da capacidade computacional dedicada à investigação de IA numa semana de amostra em julho foi utilizada em trabalho relacionado com segurança, segundo a Reuters.
O número deve ser interpretado com cautela. Trata-se de uma única semana e não representa necessariamente a distribuição de recursos ao longo do ano ou o investimento total da empresa em segurança.
A própria Anthropic reconhece ainda que o retorno financeiro destas despesas é difícil de medir.
Pressão competitiva pode acelerar lançamentos
O documento também expõe a tensão entre segurança e competição comercial.
A Anthropic afirma que a utilização dos seus serviços e, consequentemente, as receitas dependem da chegada de novos modelos. A empresa considera que um ciclo contínuo e sobreposto de lançamentos faz parte da permanência na fronteira do desenvolvimento de inteligência artificial.
A questão ganhou maior relevância nas últimas semanas. O diretor executivo da Anthropic, Dario Amodei, defendeu publicamente uma redução do ritmo de avanço das capacidades dos modelos. Dias depois, a empresa lançou o Claude Opus 5.5, num mercado em que OpenAI, Google e outros laboratórios disputam clientes empresariais e capacidade computacional.
A Anthropic procura limitar parte desta pressão através da sua estrutura de controlo. Outra secção do prospeto estabelece que uma nova entidade denominada Founder LLC, inicialmente composta pelos sete cofundadores, terá 50,1% dos direitos de voto em determinadas decisões empresariais. A empresa admite que esta estrutura pode levar a decisões contrárias aos interesses financeiros dos acionistas.
Riscos catastróficos da IA deixam de ser apenas um debate técnico
A Anthropic já descreve riscos de grande escala na sua Responsible Scaling Policy e noutra documentação de segurança. A sua constituição para o Claude refere igualmente cenários de catástrofe global provocados por falhas dos modelos, utilização maliciosa ou sistemas com objetivos incompatíveis com os interesses humanos.
O prospeto altera, contudo, o contexto em que estas declarações aparecem. Os riscos passam a integrar informação destinada a investidores que terão de avaliar simultaneamente o potencial comercial da tecnologia e as limitações que a própria empresa reconhece nos sistemas que pretende desenvolver.
A Anthropic submeteu em junho de 2026 uma versão preliminar do pedido de entrada em bolsa à Securities and Exchange Commission. A empresa esclareceu nessa altura que o número de ações, o preço e as restantes condições da operação ainda não estavam definidos.
Outros artigos interessantes:



