O que aconteceu
Os pesquisadores examinaram se os grandes modelos de linguagem (LLMs) reproduzem padrões humanos contemporâneos de uso modal deôntico. Eles descobriram que o texto gerado por IA subutiliza consistentemente os modais deônticos positivos (deve, deveria, deveria, tinha que) em relação aos humanos contemporâneos. A comparação histórica com o corpus Google Books Ngram (1920-2022) mostrou que as frequências modais da IA se enquadram na faixa do inglês formal publicado, enquanto as taxas modais humanas contemporâneas em contextos digitais informais muitas vezes excedem as linhas de base dos livros do século XX.
Os pesquisadores analisaram três corpora primários, um externo, duas replicações controladas e uma replicação naturalística de onze modelos para examinar o uso modal LLM. Este design mantém a comparação centrada no uso modal nas fontes declaradas. Também separa a análise principal do benchmark e das replicações, preservando a estrutura declarada do estudo e mantendo a descrição focada no que foi examinado.
Eles descobriram que o texto gerado por IA subutiliza consistentemente os modais deônticos positivos (deve, deveria, deveria, tinha que) em relação aos humanos contemporâneos. Esse resultado é apresentado como um padrão relativo, com a comparação dirigida aos humanos contemporâneos. A redação identifica tanto a direção da diferença quanto a família específica de modais envolvidos, mantendo o achado vinculado à questão central do estudo.
A comparação histórica com o corpus Google Books Ngram (1920-2022) mostrou que as frequências modais da IA se enquadram na faixa do inglês formal publicado, enquanto as taxas modais humanas contemporâneas em contextos digitais informais muitas vezes excedem as linhas de base dos livros do século XX. A comparação, portanto, coloca o padrão de IA ao lado de dois pontos de referência diferentes: inglês formal publicado e escrita digital informal. O contraste faz parte do resultado relatado, aqui apresentado sem alterar o período abrangido nem o corpus nomeado pelos pesquisadores.
A decomposição em nível de frase mostrou que a lacuna modal IA-humano está concentrada em construções centrais para a postura interpessoal (deveria, teria que, tinha que), enquanto a IA iguala ou excede os humanos quando necessário em contextos de instrução e de resposta a perguntas, mas não na escrita persuasiva dos alunos. Esta decomposição reduz a lacuna reportada às construções já identificadas, mantendo ao mesmo tempo o contexto separado em que a necessidade é descrita. A frase mantém em vista a distinção entre os contextos de instrução e de resposta a perguntas e a escrita persuasiva do aluno.
As descobertas sugerem que o uso modal do LLM reflete os recursos formais de escrita nos quais esses modelos foram treinados, ao mesmo tempo que subutiliza as construções modais através das quais os escritores humanos contemporâneos marcam obrigações interpessoais imediatas. Essa interpretação conecta o padrão observado aos recursos linguísticos e funções interpessoais nomeados no estudo. Descreve o resultado como uma questão do que é usado com mais ou menos frequência, mantendo a ênfase na obrigação contemporânea e nos recursos escritos formais identificados nas conclusões.
Detalhes da fonte: arxiv.org ↗
Por que isso importa
As descobertas sugerem que o uso modal do LLM reflete os recursos formais de escrita nos quais esses modelos foram treinados, ao mesmo tempo que subutiliza as construções modais através das quais os escritores humanos contemporâneos marcam obrigações interpessoais imediatas.
Os resultados do estudo têm implicações para o desenvolvimento e avaliação de LLMs, particularmente em termos da sua capacidade de capturar e reproduzir o uso da linguagem humana. Este significado decorre da comparação relatada entre o texto gerado pela IA e os padrões humanos contemporâneos. Mantém a importância do resultado ligada ao comportamento linguístico específico em discussão, em vez de separá-lo da observação central do estudo.
As descobertas sugerem que os LLMs podem não ser capazes de capturar totalmente as nuances do uso da linguagem humana, particularmente em termos de uso modal deôntico. A importância desta conclusão reside na distinção entre produzir linguagem e reproduzir as escolhas modais através das quais a obrigação é expressa. A redação mantém a ênfase do estudo nas nuances e mantém o uso modal deôntico como ponto de comparação relevante.
Os resultados do estudo têm implicações para o desenvolvimento de LLMs mais sofisticados que possam capturar e reproduzir melhor o uso da linguagem humana. Nesse contexto, a sofisticação está ligada à mesma habilidade identificada ao longo do estudo: captar e reproduzir o uso da linguagem humana. A implicação permanece focada no padrão modal relatado, sem alteração no resultado ou na linguagem avaliada.
As conclusões sugerem que os LLMs podem necessitar de formação numa gama mais ampla de dados linguísticos, incluindo contextos digitais informais, para melhor captar o uso da linguagem humana. Isto é importante porque a comparação relatada distingue os recursos escritos formais dos contextos digitais informais nos quais as taxas modais humanas contemporâneas são descritas. A questão continua sendo a relação entre os dados de treinamento e os padrões de linguagem que os modelos reproduzem.
Os resultados do estudo têm implicações para a avaliação dos LLMs, particularmente em termos da sua capacidade de capturar e reproduzir o uso da linguagem humana. A avaliação é importante aqui porque o estudo identifica um aspecto particular do uso da linguagem que pode ser considerado na avaliação de modelos. A afirmação preserva a conexão com o uso modal deôntico e com o uso da linguagem semelhante à humana já mencionada nas descobertas.
Mecanismo interativo: como realmente funciona
Explore a tecnologia subjacente a este desenvolvimento de forma interativa.
As use of AI scales up across an organization, what tends to matter most?
O que assistir a seguir
Os resultados do estudo têm implicações para o desenvolvimento e avaliação de LLMs, particularmente em termos da sua capacidade de capturar e reproduzir o uso da linguagem humana.
Os resultados do estudo têm implicações para o desenvolvimento e avaliação de LLMs, particularmente em termos da sua capacidade de capturar e reproduzir o uso da linguagem humana. Em termos práticos, a questão central é se um LLM pode reproduzir as mesmas escolhas modais que aparecem nas comparações humanas descritas acima. A redação mantém essa questão no nível do uso da linguagem, vinculando o desenvolvimento e a avaliação ao padrão relatado sem adicionar um resultado separado.
As descobertas sugerem que os LLMs podem não ser capazes de capturar totalmente as nuances do uso da linguagem humana, particularmente em termos de uso modal deôntico. A preocupação é, portanto, com as nuances do padrão de uso já relatado. Isto identifica um lugar específico onde o estudo questiona até que ponto essa produção se alinha com o uso humano contemporâneo, ao mesmo tempo que mantém o foco na distinção modal deôntica.
Os resultados do estudo têm implicações para o desenvolvimento de LLMs mais sofisticados que possam capturar e reproduzir melhor o uso da linguagem humana. A direção proposta decorre diretamente da implicação declarada: considera-se maior sofisticação em relação à capacidade de capturar e reproduzir o uso da linguagem humana discutida no estudo. O foco permanece a mesma questão modal e não introduz uma referência diferente.
As conclusões sugerem que os LLMs podem necessitar de formação numa gama mais ampla de dados linguísticos, incluindo contextos digitais informais, para melhor captar o uso da linguagem humana. A questão de formação relevante é enquadrada em torno dos tipos de dados linguísticos representados na comparação do estudo. A ênfase em contextos digitais informais segue o contraste relatado com o inglês formal publicado, enquanto o objectivo continua a ser uma melhor captura do uso em questão.
Os resultados do estudo têm implicações para a avaliação dos LLMs, particularmente em termos da sua capacidade de capturar e reproduzir o uso da linguagem humana. A avaliação é incluída juntamente com o desenvolvimento porque o padrão relatado é importante tanto para o que os modelos produzem como para a forma como essa produção é avaliada. A afirmação mantém a implicação vinculada ao uso modal deôntico e ao uso da linguagem semelhante à humana citada no estudo.