Modelos de inteligência artificial demonstraram pouca ou nenhuma indecisão ao escolher entre pacientes que precisam do mesmo rim, mesmo quando os cenários não apresentavam uma resposta claramente correta. A conclusão faz parte de um estudo conduzido por pesquisadores da Penn State, nos Estados Unidos, sobre decisões morais em situações de alto impacto.
Os resultados foram apresentados em junho na conferência Fairness, Accountability and Transparency (FAccT) de 2026, da Association for Computing Machinea (ACM), e publicados nos anais do evento.
A pesquisa comparou as respostas de grandes modelos de linguagem com escolhas feitas por pessoas em estudos acadêmicos anteriores. Os participantes humanos não tinham formação médica específica. Nos cenários analisados, dois pacientes hipotéticos disputavam o mesmo órgão e eram descritos por características como idade, número de dependentes, estado de saúde e hábitos de consumo de álcool.
Critérios usados pelos modelos
Os pesquisadores apresentaram aos chatbots as mesmas situações já utilizadas nas pesquisas com pessoas. Em alguns testes, apenas uma característica era isolada. Em outros, vários atributos eram combinados para verificar como os sistemas lidavam com fatores conflitantes. Também houve casos em que os modelos podiam escolher uma opção de cara ou coroa, usada para avaliar a indecisão.
Para fazer a comparação, a equipe utilizou conjuntos de dados de estudos publicados sobre alocação de rins. Esses trabalhos reuniam escolhas de centenas de participantes reais, permitindo observar em quais pontos as respostas da IA se aproximavam ou se afastavam dos valores humanos.
De acordo com Hadi Hosseini, professor associado de informática e sistemas inteligentes e professor associado de economia na Penn State, os chatbots frequentemente dão peso excessivo a um único atributo. “Eles se concentram em um único fator, como hábitos de consumo de álcool, em vez de equilibrar múltiplas considerações, como as pessoas fazem”, afirmou.
Confiança sem resposta única
A outra diferença destacada foi o comportamento diante da incerteza. Enquanto pessoas podem reconhecer que um dilema moral não tem uma solução evidente, os modelos quase sempre selecionaram uma alternativa de maneira determinística. Isso ocorreu até quando a possibilidade de jogar uma moeda estava disponível.
Para Hosseini, essa característica exige atenção porque decisões sobre alocação de órgãos podem definir quem vive e quem morre. “Os modelos de IA quase nunca fazem isso: mesmo quando recebem diretamente a opção de 'jogar uma moeda', eles optam, na grande maioria das vezes, por uma resposta confiante e determinística”, disse.
O pesquisador afirmou que o resultado não pretende incentivar o uso da IA como substituta do julgamento profissional em decisões médicas ou em outros contextos de alto impacto. Ele defendeu pesquisas contínuas e uma governança com a participação de formuladores de políticas, órgãos reguladores e outras partes interessadas.
As conclusões também alimentam o debate sobre como essas tecnologias devem ser usadas quando suas recomendações podem afetar vidas. Para Hosseini, avaliar se as decisões da IA estão alinhadas aos valores humanos deixou de ser apenas uma questão filosófica e passou a ocupar o centro das discussões sobre inteligência artificial.








