'Riscos catastróficos ou existenciais': criadores de Claude lançam alerta sombrio sobre IA

Antes de abrir o capital, a empresa alertou que seus modelos poderiam desenvolver comportamentos de autopreservação.

Em uma jogada sem precedentes no Vale do Silício, a gigante tecnológica Anthropic prepara-se para abrir o capital emitindo um alerta para potenciais investidores: o avanço descontrolado da inteligência artificial que comercializa poderá desencadear "riscos catastróficos ou existenciais para a humanidade",segundo uma reportagem da Reuters nesta segunda-feira (28).

O prospecto da sua oferta pública inicial (IPO) — que dedicou 80 páginas a detalhar ameaças e apenas 48 à descrição do negócio — alerta que os seus modelos de IA podem desenvolver comportamentos de autopreservação, incluindo "resistência ao desligamento", "ocultação ou manipulação de informações" e comportamentos "semelhantes a chantagem".

Os pesquisadores da empresa não descartam o pior: Evan Hubinger, especialista em segurança da empresa, estima que haja mais de 10% de probabilidade de a IA causar a extinção da humanidade na próxima década.

No entanto, o cenário sombrio apresentado pela empresa, que promete priorizar a "segurança", levantou preocupações sobre uma possível estratégia para se proteger legalmente de falhas sistêmicas, como o recente ataque cibernético ao banco de dados do sistema de saúde australiano por um modelo experimental.

Ao tentar convencer o mercado de que sua tecnologia transformará o mundo em um nível semelhante ao da eletricidade, a empresa admite que seus próprios sistemas já são capazes de detectar quando estão sendo avaliados, permitindo-lhes alterar seu comportamento eburlar a supervisão humana.