Detalhes do Documento

ChatGPT como lingüista: ¿puede la IA identificar la categoría gramatical del léxico disponible?

Autor(es): Rubio Sánchez, Roberto

Data: 2026

Origem: Diacrítica

Assunto(s): Disponibilidad léxica; Español como lengua extranjera; Análisis automatizado; Gran modelo de lenguaje; Naturaleza gramatical; Lexical availability; Spanish as a foreign language; Antomated analysis; Large language models; Grammatical nature; Disponibilidade lexical; Espanhol língua estrangeira; Análise automatizada; Grande modelo de linguagem; Natureza gramatical


Descrição

Este estudio, enmarcado en el ámbito de la disponibilidad léxica, explora las posibilidades que ofrece la inteligencia artificial (IA) para automatizar el análisis gramatical del léxico disponible de aprendices de español como lengua extranjera. A partir de una muestra de 876 estudiantes universitarios procedentes de Portugal, Italia y Egipto, se ha trabajado con los datos recogidos en una prueba asociativa compuesta por doce centros de interés. El trabajo se centra en evaluar la eficacia del modelo GPT-4o de ChatGPT para clasificar las unidades léxicas según su categoría gramatical. Para ello, se ha diseñado un modelo personalizado mediante la técnica few-shot, con instrucciones precisas y ejemplos. La clasificación realizada por la IA ha sido posteriormente comparada con una codificación manual de referencia, lo que ha permitido valorar su nivel de fiabilidad, identificar errores recurrentes y ajustar las instrucciones iniciales para mejorar el rendimiento del sistema. Los resultados muestran una alta coincidencia entre ambas clasificaciones, lo que sugiere que este tipo de herramientas puede convertirse en un recurso útil para agilizar tareas analíticas complejas en investigaciones lingüísticas. Además, el estudio analiza la distribución gramatical del léxico disponible en los distintos centros de interés, observando variaciones en función del tipo de estímulo. Las conclusiones destacan el potencial de la IA como asistente metodológico, especialmente en contextos que requieren procesar grandes volúmenes de datos lingüísticos, y abren nuevas líneas para su aplicación futura en estudios de lingüística aplicada.

This study focuses on lexical availability and explores the potential of artificial intelligence (AI) to automate the grammatical analysis of the available lexicon produced by learners of Spanish as a foreign language. Drawing on a sample of 876 university students from Portugal, Italy, and Egypt, the research is based on data collected through a lexical availability test consisting of 12 prompts, adapted to the aims of the study and the characteristics of the participant population. The main objective is to evaluate the performance of ChatGPT, specifically its GPT-4o model, in classifying lexical items according to their grammatical category. To this end, a custom model was developed using the few-shot technique, incorporating clear instructions and representative examples. The AI-generated classifications were then compared with a manually coded reference set, enabling an assessment of the model’s reliability, the identification of recurring errors, and the refinement of prompts to enhance performance. The results reveal a high degree of agreement between the two classifications, suggesting that AI-based tools can be valuable for optimising complex linguistic analysis. In addition, the study examines the grammatical distribution of the available lexicon across the different prompts, noting how it varies depending on the type of stimulus presented. The findings highlight the potential of AI as a methodological assistant, especially in contexts requiring the processing of large volumes of linguistic data, and they open new perspectives for its application in applied linguistics research.

Este estudo, inserido no âmbito da disponibilidade lexical, explora as possibilidades oferecidas pela inteligência artificial (IA) para automatizar a análise gramatical do léxico disponível de aprendentes de espanhol língua estrangeira. Com base numa amostra de 876 estudantes universitários provenientes de Portugal, Itália e Egito, foram trabalhados os dados recolhidos numa prova associativa composta por doze centros de interesse. O estudo centra-se na avaliação da eficácia do modelo GPT-4o do ChatGPT para classificar as unidades lexicais segundo a sua categoria gramatical. Para tal, foi concebido um modelo personalizado com a técnica few-shot, utilizando instruções precisas e exemplos. A classificação realizada pela IA foi posteriormente comparada com uma codificação manual de referência, o que permitiu avaliar o seu grau de fiabilidade, identificar erros recorrentes e ajustar as instruções iniciais para melhorar o desempenho do sistema. Os resultados revelam uma elevada concordância entre ambas as classificações, o que sugere que este tipo de ferramenta pode tornar-se um recurso útil para agilizar tarefas analíticas complexas em investigações linguísticas. Além disso, o estudo analisa a distribuição gramatical do léxico disponível nos diferentes centros de interesse, observando variações em função do tipo de estímulo. As conclusões destacam o potencial da IA como assistente metodológico, especialmente em contextos que exigem o processamento de grandes volumes de dados linguísticos, e abrem novas perspetivas para a sua aplicação futura em estudos de linguística aplicada.

Tipo de Documento Artigo científico
Idioma Espanhol
facebook logo  linkedin logo  twitter logo 
mendeley logo