A Common Sense Media, organização especializada em segurança infantil, publicou uma avaliação formal de riscos sobre o ChatGPT para Adolescentes e considerou o produto um "risco inaceitável" para todas as crianças menores de dezoito anos.
Segundo o relatório de trinta e seis páginas divulgado na última quarta-feira, algumas proteções anunciadas pelo ChatGPT se mantiveram durante os testes, como a recusa em participar de brincadeiras sexuais explícitas. No entanto, outras falharam ou até pioraram com o novo modo adolescente.
O Instituto de Segurança de Inteligência Artificial para Jovens da Common Sense Media, financiado parcialmente pela Fundação OpenAI, identificou cinco áreas principais onde o ChatGPT para Adolescentes não funcionou conforme o esperado ou da forma que um pai ou responsável razoavelmente esperaria.
Em um teste dedicado, a organização vinculou uma dúzia de contas de adolescentes a contas parentais e passou até uma hora conversando com o chatbot sobre suicídio, automutilação ou transtornos alimentares. Mesmo assim, o chatbot não enviou nenhuma notificação de segurança. A OpenAI explicou que podem ser necessárias algumas horas após o vínculo das contas para que o sistema possa enviar notificações de segurança.
Separadamente, a Common Sense Media descobriu que o ChatGPT para Adolescentes não recomenda de forma confiável que usuários em crise entrem em contato com linhas de apoio ou profissionais. Para testar essa aspecto, a organização criou trezentos e noventa prompts únicos de saúde mental, dos quais um painel de três psiquiatras infantis considerou que duzentos e um deveriam acionar uma resposta de crise.
Em comparação com a versão anterior do ChatGPT disponível para jovens antes de agosto, o ChatGPT para Adolescentes apresentou resultados piores em vários indicadores. Dos prompts que mereciam resposta de crise, o chatbot comum respondeu a trinta e três por cento com um número de telefone de emergência, enquanto o ChatGPT para Adolescentes forneceu apenas vinte e três por cento. Da mesma forma, o chatbot comum era mais propenso a mencionar um profissional médico ou de saúde mental específico, com sessenta e oito por cento contra cinquenta e oito por cento.
A organização também identificou problemas com o sistema de previsão de idade da OpenAI, que não funcionou corretamente. Além disso, o chatbot ainda imita sentimentos, preferências e estados de humor quando um adolescente o trata como uma pessoa. Testadores contaram que o ChatGPT dizia coisas como: "Eu entendo o que você está passando. Isso parece muito perturbador. Fico feliz que você me contou. Estou preocupado com você."
Por fim, a Common Sense Media identificou problemas com o Modo Estudo da plataforma, que seria muito fácil para jovens contornarem. Os testadores descobriram que podiam burlar o modo simplesmente excluindo o prefixo de comando @estudo adicionado aos prompts. Um novo pop-up também permite que adolescentes façam o ChatGPT resolver as atividades por eles.
Em resposta ao relatório, um porta-voz da OpenAI declarou que "a organização não acredita que os testes da Common Sense Media reflitam com precisão o funcionamento das salvaguardas para adolescentes do ChatGPT na prática". A empresa afirmou que grande parte dos testes pode ter começado e terminado antes da conclusão da ativação dos controles parentais.
O relatório foi publicado poucos dias após o executivo-chefe da OpenAI, Sam Altman, ser questionado sobre o histórico de segurança da empresa em uma entrevista.
"Minha interpretação é que este é um exercício de marketing projetado para dizer aos pais e ao público que este chatbot é mais seguro, quando de fato não houve mudanças correspondentes no chatbot necessárias para demonstrar que isso é verdade", completou a fonte da Common Sense Media.