要約
GPT(生成事前トレーニングトランス)などの人工知能(AI)生成言語モデルとChatGPTなどのツールの導入により、テキストの生成方法を変えることができる革命がトリガーされました。
たとえば、これには多くの意味があります。AIに生成されたテキストがテキストのかなりの部分になるため、これは読者の言語能力と新しいAIツールのトレーニングにも影響しますか?
それは言語の進化に影響しますか?
言語の1つの特定の側面に焦点を当てる:単語。
ChatGPTなどのツールの使用は、使用される語彙や語彙の豊かさを増加または削減しますか?
これは、AIに生成されたコンテンツに含まれていないものがますます人気が低くなり、最終的に失われる可能性があるため、言葉に影響を与えます。
この作業では、同じタスクを実行するときに、ChatGptと人間の語彙と語彙の豊かさの最初の比較を実行します。
さらに詳しくは、ChatGptと人間が回答したさまざまな種類の質問に対する回答を含む2つのデータセット、およびChatGPTが文と質問を言い換える3番目のデータセットが使用されます。
分析は、ChatGptが人間よりも異なる単語が少なく、語彙の豊かさが低い傾向があることを示しています。
これらの結果は非常に予備的なものであり、追加のデータセットとCHATGPT構成を評価して、より一般的な結論を抽出する必要があります。
したがって、CHATGPTおよびより広く生成されたAIツールの使用が、さまざまなタイプのテキストや言語の語彙と語彙の豊かさにどのように影響するかを理解するために、さらなる研究が必要です。
要約(オリジナル)
The introduction of Artificial Intelligence (AI) generative language models such as GPT (Generative Pre-trained Transformer) and tools such as ChatGPT has triggered a revolution that can transform how text is generated. This has many implications, for example, as AI-generated text becomes a significant fraction of the text, would this have an effect on the language capabilities of readers and also on the training of newer AI tools? Would it affect the evolution of languages? Focusing on one specific aspect of the language: words; will the use of tools such as ChatGPT increase or reduce the vocabulary used or the lexical richness? This has implications for words, as those not included in AI-generated content will tend to be less and less popular and may eventually be lost. In this work, we perform an initial comparison of the vocabulary and lexical richness of ChatGPT and humans when performing the same tasks. In more detail, two datasets containing the answers to different types of questions answered by ChatGPT and humans, and a third dataset in which ChatGPT paraphrases sentences and questions are used. The analysis shows that ChatGPT tends to use fewer distinct words and lower lexical richness than humans. These results are very preliminary and additional datasets and ChatGPT configurations have to be evaluated to extract more general conclusions. Therefore, further research is needed to understand how the use of ChatGPT and more broadly generative AI tools will affect the vocabulary and lexical richness in different types of text and languages.
arxiv情報
著者 | Pedro Reviriego,Javier Conde,Elena Merino-Gómez,Gonzalo Martínez,José Alberto Hernández |
発行日 | 2025-03-14 16:19:46+00:00 |
arxivサイト | arxiv_id(pdf) |
提供元, 利用サービス
arxiv.jp, Google