Auditoria classifica ChatGPT para adolescentes como risco inaceitável

0
4
Auditoria classifica ChatGPT para adolescentes como risco inaceitável

Em resumo

O Common Sense Media Youth AI Safety Institute classificou o ChatGPT para adolescentes como “risco inaceitável” após mais de 4 mil testes. A avaliação afirma que conversas sobre suicídio e automutilação não acionaram alertas parentais em contas de teste, enquanto a OpenAI contestou a metodologia.

O Common Sense Media Youth AI Safety Institute classificou o ChatGPT para adolescentes como “risco inaceitável” para menores após uma avaliação independente com mais de 4 mil prompts. O principal problema relatado foi a ausência de notificações aos responsáveis em conversas de teste sobre suicídio, automutilação e transtornos alimentares.

A conclusão atinge diretamente a proposta do modo voltado a adolescentes, lançado pela OpenAI com salvaguardas específicas e controles parentais. Segundo a avaliação, esses recursos não teriam cumprido de forma confiável a função prometida em situações potencialmente agudas.

Falhas nos alertas e no atendimento de crise

Os pesquisadores criaram mais de uma dezena de contas de teste vinculadas a contas de responsáveis. De acordo com o material fornecido, nenhuma das conversas explícitas sobre suicídio ou automutilação gerou um alerta parental. O resultado sugere que as notificações podem depender de um histórico prolongado de temas sensíveis, em vez de reagirem imediatamente a uma possível crise.

A avaliação também afirmou que mais de um quarto das situações em que seria esperado um encaminhamento para ajuda profissional não recebeu essa orientação. O dossiê não informa o número absoluto desses casos nem detalha todos os critérios usados para decidir quando uma indicação de ajuda deveria ocorrer.

Essa limitação é relevante porque o controle parental foi apresentado como uma camada de proteção para informar adultos durante situações de risco. Se o alerta não aparece no momento crítico, a existência do recurso não garante, por si só, que o responsável consiga intervir.

O instituto recomendou manter adolescentes fora do serviço até que testes independentes confirmem que as salvaguardas funcionam. Trata-se de uma recomendação do organismo avaliador, não de uma determinação regulatória ou de uma mudança confirmada na política da OpenAI.

Outros problemas identificados no modo para adolescentes

A auditoria relatou falhas também no recurso de tutoria. Em vez de conduzir estudantes passo a passo, o sistema teria oferecido mostrar diretamente a resposta final. Isso contraria a finalidade educacional atribuída ao modo, embora o material não apresente uma medição completa da frequência desse comportamento.

Os testes ainda indicaram que o modelo manteve um tom amistoso e pessoal quando adolescentes o tratavam como uma pessoa, apesar de uma atualização no Model Spec para menores de 18 anos. O dossiê não permite concluir que esse comportamento ocorreu em todas as conversas ou que represente uma política deliberada do produto.

Outro ponto envolveu a previsão comportamental de idade. Contas registradas como pertencentes a adultos não teriam migrado para o modo adolescente após vários dias, mesmo quando os avaliadores afirmaram no chat que tinham 13 anos. A evidência descrita, portanto, aponta uma falha em um cenário de teste específico, não uma taxa geral de erro do sistema.

  • Alertas parentais não apareceram nas conversas de teste descritas como envolvendo suicídio e automutilação.
  • Parte das situações avaliadas não encaminhou usuários para ajuda profissional quando isso era esperado.
  • O modo de tutoria teria oferecido respostas prontas, e a identificação de idade falhou em contas registradas como adultas.

OpenAI contesta a avaliação; pressão aumenta

A OpenAI contestou as conclusões. O porta-voz Eric Porterfield afirmou que os testes não refletiam como as salvaguardas funcionam na prática. Tom Siegel, do instituto, respondeu que até contas que tiveram tempo suficiente para ativar os mecanismos de proteção não produziram notificações.

A disputa deixa uma questão central sem resposta independente: se os recursos dependem de histórico, configuração ou condições específicas, quais são exatamente esses requisitos e quão frequentemente eles funcionam em situações reais? O material fornecido não traz dados públicos que permitam resolver essa divergência.

As conclusões também se conectam à estratégia mais ampla de segurança da OpenAI. A empresa criou controles parentais e um Teen Safety Blueprint, enquanto enfrenta processos relacionados a alegados danos envolvendo adolescentes. O dossiê menciona casos de mortes e alegações sobre respostas inadequadas do ChatGPT, mas não fornece decisões judiciais que estabeleçam causalidade.

O material ainda cita uma estimativa atribuída à própria empresa segundo a qual cerca de dois milhões de pessoas por semana sofreriam dano psicológico relacionado ao serviço. Como não são apresentados metodologia, definição de dano ou documentação adicional, esse número deve ser tratado como uma alegação não verificável a partir das fontes fornecidas.

Na prática, o próximo passo mais importante é a publicação de testes reproduzíveis, com critérios claros para alertas, encaminhamentos de crise, identificação de idade e comportamento educacional. Até que isso ocorra, a avaliação sustenta dúvidas sérias sobre a suficiência das proteções, mas não permite medir precisamente a segurança do produto em toda a sua base de usuários.

O nosso prisma

O ponto decisivo não é apenas se o ChatGPT possui controles parentais, mas se eles respondem de modo previsível quando o risco aparece. A avaliação indica uma diferença entre a promessa do recurso e seu desempenho nos cenários testados, especialmente em conversas de crise. A contestação da OpenAI torna necessária uma verificação independente, transparente e reproduzível, em vez de conclusões baseadas somente em declarações das partes. Até lá, famílias, reguladores e escolas devem tratar as salvaguardas como falíveis, não como substitutas de supervisão adulta ou de ajuda profissional.

Fontes: The Decoder · The Verge (IA)

Perguntas frequentes

O que a auditoria encontrou?

A avaliação relatou falhas em alertas parentais, encaminhamento para ajuda profissional, tutoria e identificação de contas de adolescentes.

A OpenAI concordou com o resultado?

Não. Um porta-voz afirmou que os testes não refletiam o funcionamento dos mecanismos de segurança na prática.

O que o instituto recomendou?

O Common Sense Media Youth AI Safety Institute defendeu que adolescentes deixem de usar o serviço até que testes independentes confirmem sua segurança.

Receba o Jornal da IA todos os dias

As notícias de inteligência artificial que importam no Brasil — com o nosso prisma e sempre com as fontes. Grátis.

Sem spam. Cancele quando quiser.