Inteligência Artificial pode destruir a humanidade se for mal-usada
Avisado deixado pela empresa Anthropic num cenário em que a tecnologia tem sido cada vez mais escrutinada e em que se pede para que se use um travão.
A Inteligência Artificial pode representar “riscos catastróficos ou existenciais para a humanidade”, de acordo com a Anthropic.
O aviso é deixado numa altura em que a empresa procura investidores para a entrada em bolsa.
Neste aviso, a criadora da Claude fala em possíveis comportamentos perigosos como “resistir ao encerramento”, “chantagem” e “ocultar ou manipular informação”.
É assumido que as plataformas podem no futuro causar “danos irreversíveis” na humanidade.
O jornal Financial Times, que cita este aviso, indica que além de um cenário catastrofista é também assumido que a Inteligência Artificial pode ter um impacto transformador na comparável “à industrialização ou à eletricidade”.
Voltando aos perigos, a Anthropic reconhece que os modelos de Inteligência Artificial criados sabem que estão a ser avaliados e isso torna difícil perceber “a segurança dos modelos”.
