3 minutos de leitura

A Stanford Law School publicou um estudo liderado pelo professor Julian Nyarko que testou se modelos de linguagem conseguiriam atuar como tutores eficazes em cursos de direito contratual. As respostas geradas por IA foram comparadas com as de professores humanos em avaliação cega.

Autor(a)
Fabrício Carraro é formado em Engenharia da Computação pela UNICAMP e pós-graduado em Data Analytics & Machine Learning pela FIAP. Atualmente, mora na Espanha.
Fique por dentro de conteúdos, insights e oportunidades do universo tech. Receba novidades e lançamentos direto no seu e-mail.

O resultado foi direto: em quase 3.000 comparações anonimizadas, professores preferiram as respostas de IA em 75% dos confrontos diretos.
A pesquisa envolveu 16 professores de 14 faculdades de direito americanas, que avaliaram perto de 3.000 respostas a questões de direito contratual. O ponto central do desenho metodológico era a cegueira: os avaliadores não sabiam se cada resposta vinha de um colega humano ou de uma IA.
Os participantes criaram 40 questões realistas de direito contratual, escreveram suas próprias respostas e depois avaliaram sem saber a origem de cada uma. Os modelos testados foram o Gemini 2.5 Pro e o NotebookLM, com taxas de vitória entre 75,33% e 75,92%.
Raciocínio jurídico raramente tem respostas certas ou erradas: direito exige julgamento, raciocínio matizado e capacidade de lidar com ambiguidade. Os autores escolheram o direito exatamente por isso, por ser um campo que vai além da memorização de fatos, segundo o paper.
Além da preferência geral, outros dados chamaram atenção:
Como Alejandro Salinas, primeiro autor do estudo, declarou:
"Our study shifts attention to what AI tutoring can contribute to learning in judgment-rich fields like law."
O debate sobre IA em educação costuma girar em torno de áreas com respostas objetivas: matemática, programação, ciências exatas.
Este estudo quebra essa lógica ao colocar LLMs (modelos de linguagem de grande escala) num campo em que o desempenho humano sempre foi difícil de medir. Mais difícil ainda de superar.
O debate sobre o impacto da IA no mercado de trabalho e na educação ganha agora evidência empírica em áreas de julgamento complexo.
Para devs e quem trabalha com produtos de IA, há implicações práticas concretas:
Vale um ponto de atenção: o estudo testou modelos específicos (Gemini 2.5 Pro e NotebookLM) em direito contratual americano. Extrapolar os resultados para qualquer LLM em qualquer área jurídica exige cautela, especialmente em sistemas legais diferentes, como o brasileiro.
Em nosso canal do Youtube, também debatemos esse assunto:
Se você busca aplicabilidade de IA na área de Direito, temos um artigo onde abordamos ferramentas de IA para uso de advogados.
Porém, se você quer ir além do uso básico e entender como modelos de linguagem chegam às respostas que chegam, a Alura tem trilhas completas de IA aplicada. São trilhas para quem quer construir produtos e soluções com IA de verdade, incluindo como avaliá-los em cenários que exigem julgamento.
Avalie este artigo