-
Notifications
You must be signed in to change notification settings - Fork 0
Expand file tree
/
Copy pathwords.html
More file actions
234 lines (234 loc) · 74.1 KB
/
Copy pathwords.html
File metadata and controls
234 lines (234 loc) · 74.1 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
120
121
122
123
124
125
126
127
128
129
130
131
132
133
134
135
136
137
138
139
140
141
142
143
144
145
146
147
148
149
150
151
152
153
154
155
156
157
158
159
160
161
162
163
164
165
166
167
168
169
170
171
172
173
174
175
176
177
178
179
180
181
182
183
184
185
186
187
188
189
190
191
192
193
194
195
196
197
198
199
200
201
202
203
204
205
206
207
208
209
210
211
212
213
214
215
216
217
218
219
220
221
222
223
224
225
226
227
228
229
230
231
232
233
234
<!DOCTYPE html>
<html lang="en">
<head>
<meta charset="utf-8">
<meta name="viewport" content="width=device-width, initial-scale=1">
<title>Words AI Overuses, by Language | AI Word Explorer</title>
<meta name="description" content="The words GPT-4.1 mini produces far more than a matched human baseline in news text — top 20 per language by Log Prevalence Ratio, across 34 languages. A measurement of model output.">
<link rel="canonical" href="https://www.aiwordexplorer.com/words.html">
<link rel="icon" href="/favicon.ico">
<style>*{box-sizing:border-box}body{font-family:-apple-system,Segoe UI,Roboto,Helvetica,Arial,sans-serif;color:#0f172a;margin:0;line-height:1.55;background:#fff}.wrap{max-width:920px;margin:0 auto;padding:0 20px}header{background:#f8fafc;border-bottom:1px solid #e2e8f0;padding:26px 0 30px}header nav,footer{font-size:14px;color:#475569}header nav a,footer a,.toc a{color:#1e3a8a;text-decoration:none}header nav a:hover,footer a:hover,.toc a:hover{text-decoration:underline}h1{font-size:30px;margin:14px 0 10px;color:#1e3a8a}.intro{color:#475569;font-size:16px;max-width:780px;margin:0}.note{color:#94a3b8;font-size:13px;max-width:780px;margin:10px 0 0}.note a{color:#64748b}.toc{padding:16px 0;border-bottom:1px solid #e2e8f0;display:flex;flex-wrap:wrap;gap:6px 14px;font-size:14px}main{padding:8px 0 40px}section{padding:20px 0;border-bottom:1px solid #e2e8f0}section h2{font-size:20px;margin:0 0 2px;color:#0f172a}section h2 .en{color:#475569;font-weight:400;font-size:15px;margin-left:8px}.native{font-weight:600;color:#1e3a8a;margin:2px 0 4px}.desc{color:#475569;font-size:14px;margin:0 0 12px;max-width:820px}ul.words{list-style:none;margin:0;padding:0;display:grid;grid-template-columns:repeat(auto-fill,minmax(190px,1fr));gap:4px 18px}ul.words li{display:flex;justify-content:space-between;border-bottom:1px dotted #e2e8f0;padding:3px 0}ul.words .word{font-weight:600}ul.words .ratio{color:#475569;font-variant-numeric:tabular-nums}footer{padding:22px 0;color:#475569;font-size:14px;border-top:1px solid #e2e8f0}</style>
<script type="application/ld+json">{"@context": "https://schema.org", "@type": "CollectionPage", "name": "Words AI overuses, by language", "url": "https://www.aiwordexplorer.com/words.html", "isPartOf": {"@type": "WebSite", "name": "AI Word Explorer", "url": "https://www.aiwordexplorer.com/"}, "dateModified": "2026-05-31", "about": "Words overused by GPT-4.1 mini relative to a matched human baseline across 34 languages", "author": {"@type": "Person", "name": "Thomas Stephan Juzek", "url": "https://ai.fsu.edu/research/thomas-stephan-juzek"}, "citation": "https://arxiv.org/abs/2605.25358"}</script>
</head>
<body>
<!-- words.html is generated by build_data.py. Native-language phrasings are DRAFT, pending linguistic review before publish. -->
<header><div class="wrap">
<nav><a href="index.html">Explorer</a> · <a href="about.html">About & Method</a> · <a href="https://github.com/fsu-nlp/lexa-index">GitHub</a></nav>
<h1>Words AI overuses, by language</h1>
<p class="intro">The words <strong>GPT-4.1 mini</strong> produces far more often than a matched human baseline in news text — the top 20 per language, ranked by Log Prevalence Ratio (LPR). The figure after each word is how many times more frequent it is in the model’s text than in human text. This describes the <em>model’s output</em>, not how people write or speak. See the <a href="about.html">method and caveats</a>; data from <a href="https://arxiv.org/abs/2605.25358">AI-Associated Lexical Shifts Across 34 Languages</a> (arXiv:2605.25358).</p>
<p class="note">This page is auto-generated for search and AI indexing — the interactive <a href="index.html">Explorer</a> is the main experience. The native-language headings are machine-assisted and may contain errors.</p>
</div></header>
<div class="wrap">
<nav class="toc" aria-label="Languages"><a href="#en">English</a> <a href="#af">Afrikaans</a> <a href="#ar">العربية</a> <a href="#bg">Български</a> <a href="#zh">中文</a> <a href="#hr">Hrvatski</a> <a href="#cs">Čeština</a> <a href="#nl">Nederlands</a> <a href="#et">Eesti</a> <a href="#fi">Suomi</a> <a href="#fr">Français</a> <a href="#de">Deutsch</a> <a href="#el">Ελληνικά</a> <a href="#hi">हिन्दी</a> <a href="#is">Íslenska</a> <a href="#id">Bahasa Indonesia</a> <a href="#it">Italiano</a> <a href="#ja">日本語</a> <a href="#kk">Қазақша</a> <a href="#ko">한국어</a> <a href="#ky">Кыргызча</a> <a href="#lv">Latviešu</a> <a href="#lt">Lietuvių</a> <a href="#mr">मराठी</a> <a href="#fa">فارسی</a> <a href="#pl">Polski</a> <a href="#pt">Português</a> <a href="#ro">Română</a> <a href="#ru">Русский</a> <a href="#sr">Српски</a> <a href="#es">Español</a> <a href="#ta">தமிழ்</a> <a href="#tr">Türkçe</a> <a href="#uk">Українська</a></nav>
<main>
<section id="en" lang="en">
<h2>English <span class="en">English</span></h2>
<p class="native">Words AI overuses</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in English news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">additionally</span><span class="ratio">843.0×</span></li><li><span class="word">emphasize</span><span class="ratio">314.0×</span></li><li><span class="word">revolutionize</span><span class="ratio">119.0×</span></li><li><span class="word">captivated</span><span class="ratio">63.0×</span></li><li><span class="word">revitalize</span><span class="ratio">89.0×</span></li><li><span class="word">resilience</span><span class="ratio">44.9×</span></li><li><span class="word">dedication</span><span class="ratio">44.0×</span></li><li><span class="word">importance</span><span class="ratio">39.2×</span></li><li><span class="word">personalize</span><span class="ratio">49.7×</span></li><li><span class="word">renforcer</span><span class="ratio">73.0×</span></li><li><span class="word">attribute</span><span class="ratio">37.4×</span></li><li><span class="word">foster</span><span class="ratio">35.5×</span></li><li><span class="word">transparency</span><span class="ratio">33.7×</span></li><li><span class="word">conservationist</span><span class="ratio">63.0×</span></li><li><span class="word">delve</span><span class="ratio">34.5×</span></li><li><span class="word">alike</span><span class="ratio">32.5×</span></li><li><span class="word">teamwork</span><span class="ratio">39.0×</span></li><li><span class="word">symbolize</span><span class="ratio">39.0×</span></li><li><span class="word">unwavering</span><span class="ratio">31.9×</span></li><li><span class="word">streamlin</span><span class="ratio">55.0×</span></li></ul>
</section>
<section id="af" lang="af">
<h2>Afrikaans <span class="en">Afrikaans</span></h2>
<p class="native">Woorde wat KI te veel gebruik</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Afrikaans news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">'n</span><span class="ratio">2905.4×</span></li><li><span class="word">gesondheidsowerhede</span><span class="ratio">911.0×</span></li><li><span class="word">verder</span><span class="ratio">783.0×</span></li><li><span class="word">beklemtoon</span><span class="ratio">214.5×</span></li><li><span class="word">lewenskwaliteit</span><span class="ratio">171.0×</span></li><li><span class="word">strenger</span><span class="ratio">171.0×</span></li><li><span class="word">infrastruktuurprojek</span><span class="ratio">99.7×</span></li><li><span class="word">ëskalmeer</span><span class="ratio">147.0×</span></li><li><span class="word">ooggetuie</span><span class="ratio">75.0×</span></li><li><span class="word">kontroversie</span><span class="ratio">139.0×</span></li><li><span class="word">organisator</span><span class="ratio">137.0×</span></li><li><span class="word">fokter</span><span class="ratio">125.0×</span></li><li><span class="word">gesondheidsriglyne</span><span class="ratio">79.7×</span></li><li><span class="word">infrastruktuurontwikkeling</span><span class="ratio">93.0×</span></li><li><span class="word">belangrikheid</span><span class="ratio">45.0×</span></li><li><span class="word">samehorigheid</span><span class="ratio">42.7×</span></li><li><span class="word">top</span><span class="ratio">77.0×</span></li><li><span class="word">dinamiek</span><span class="ratio">75.0×</span></li><li><span class="word">verantwoordelikes</span><span class="ratio">75.0×</span></li><li><span class="word">vaardigheidsontwikkeling</span><span class="ratio">71.0×</span></li></ul>
</section>
<section id="ar" lang="ar">
<h2>العربية <span class="en">Arabic</span></h2>
<p class="native">الكلمات التي يفرط الذكاء الاصطناعي في استخدامها</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Arabic news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">فَقق</span><span class="ratio">40.2×</span></li><li><span class="word">مُشَارَكَة</span><span class="ratio">45.0×</span></li><li><span class="word">شَدَّد</span><span class="ratio">21.5×</span></li><li><span class="word">نِبرَاس</span><span class="ratio">41.0×</span></li><li><span class="word">مُحَفَّز</span><span class="ratio">21.8×</span></li><li><span class="word">أَكَّد</span><span class="ratio">18.9×</span></li><li><span class="word">ملتزمون</span><span class="ratio">17.9×</span></li><li><span class="word">تَفَانِي</span><span class="ratio">20.3×</span></li><li><span class="word">تَعزِيز</span><span class="ratio">15.1×</span></li><li><span class="word">أَضَاف</span><span class="ratio">14.9×</span></li><li><span class="word">أَضفَى</span><span class="ratio">15.7×</span></li><li><span class="word">يوضح</span><span class="ratio">14.5×</span></li><li><span class="word">ضَمَان</span><span class="ratio">14.1×</span></li><li><span class="word">كَثَب</span><span class="ratio">14.3×</span></li><li><span class="word">تَحسِين</span><span class="ratio">13.7×</span></li><li><span class="word">بَنَّاء</span><span class="ratio">13.9×</span></li><li><span class="word">تَكتِيكِيّ</span><span class="ratio">13.8×</span></li><li><span class="word">معاصرة</span><span class="ratio">15.8×</span></li><li><span class="word">أَهَمِّيَّة</span><span class="ratio">13.1×</span></li><li><span class="word">مُشَوَّق</span><span class="ratio">14.7×</span></li></ul>
</section>
<section id="bg" lang="bg">
<h2>Български <span class="en">Bulgarian</span></h2>
<p class="native">Думи, които ИИ използва прекомерно</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Bulgarian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">важен</span><span class="ratio">2231.0×</span></li><li><span class="word">gàçëè÷íèòе</span><span class="ratio">305.0×</span></li><li><span class="word">особено</span><span class="ratio">149.0×</span></li><li><span class="word">техен</span><span class="ratio">145.0×</span></li><li><span class="word">кправедлив</span><span class="ratio">105.0×</span></li><li><span class="word">свидетелски</span><span class="ratio">69.7×</span></li><li><span class="word">подчертавам</span><span class="ratio">50.6×</span></li><li><span class="word">gàçïðîññòрíí</span><span class="ratio">97.0×</span></li><li><span class="word">нестабилност</span><span class="ratio">51.2×</span></li><li><span class="word">протестиращ</span><span class="ratio">83.0×</span></li><li><span class="word">îòëè÷à</span><span class="ratio">83.0×</span></li><li><span class="word">неизправност</span><span class="ratio">48.2×</span></li><li><span class="word">îòíîâîðè</span><span class="ratio">73.0×</span></li><li><span class="word">отчетност</span><span class="ratio">38.6×</span></li><li><span class="word">прозрачност</span><span class="ratio">35.7×</span></li><li><span class="word">свежест</span><span class="ratio">69.0×</span></li><li><span class="word">предупреждавам</span><span class="ratio">35.2×</span></li><li><span class="word">усилено</span><span class="ratio">36.2×</span></li><li><span class="word">призовавам</span><span class="ratio">32.5×</span></li><li><span class="word">ñåçîíè</span><span class="ratio">63.0×</span></li></ul>
</section>
<section id="zh" lang="zh">
<h2>中文 <span class="en">Chinese</span></h2>
<p class="native">AI 过度使用的词语</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Chinese news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">多变</span><span class="ratio">126.3×</span></li><li><span class="word">加快</span><span class="ratio">71.7×</span></li><li><span class="word">此外</span><span class="ratio">50.6×</span></li><li><span class="word">每当</span><span class="ratio">81.0×</span></li><li><span class="word">兴起</span><span class="ratio">75.0×</span></li><li><span class="word">率有</span><span class="ratio">69.0×</span></li><li><span class="word">大对</span><span class="ratio">67.0×</span></li><li><span class="word">加大对</span><span class="ratio">61.0×</span></li><li><span class="word">不仅</span><span class="ratio">29.6×</span></li><li><span class="word">近年</span><span class="ratio">29.6×</span></li><li><span class="word">业内</span><span class="ratio">28.8×</span></li><li><span class="word">一举</span><span class="ratio">33.7×</span></li><li><span class="word">指出</span><span class="ratio">24.5×</span></li><li><span class="word">细腻</span><span class="ratio">27.6×</span></li><li><span class="word">不便</span><span class="ratio">45.0×</span></li><li><span class="word">应加</span><span class="ratio">29.0×</span></li><li><span class="word">力求</span><span class="ratio">22.2×</span></li><li><span class="word">不留</span><span class="ratio">41.0×</span></li><li><span class="word">势有</span><span class="ratio">41.0×</span></li><li><span class="word">笔触</span><span class="ratio">41.0×</span></li></ul>
</section>
<section id="hr" lang="hr">
<h2>Hrvatski <span class="en">Croatian</span></h2>
<p class="native">Riječi koje AI prečesto koristi</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Croatian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">borbenost</span><span class="ratio">273.7×</span></li><li><span class="word">predanost</span><span class="ratio">82.9×</span></li><li><span class="word">transparentnost</span><span class="ratio">51.5×</span></li><li><span class="word">kontroverza</span><span class="ratio">51.4×</span></li><li><span class="word">složenost</span><span class="ratio">52.6×</span></li><li><span class="word">preciznost</span><span class="ratio">46.7×</span></li><li><span class="word">meteorolozi</span><span class="ratio">79.0×</span></li><li><span class="word">napet</span><span class="ratio">41.4×</span></li><li><span class="word">polarizacija</span><span class="ratio">71.0×</span></li><li><span class="word">emphasized</span><span class="ratio">67.0×</span></li><li><span class="word">fokusirati</span><span class="ratio">65.0×</span></li><li><span class="word">nesporazuma</span><span class="ratio">65.0×</span></li><li><span class="word">važnost</span><span class="ratio">33.1×</span></li><li><span class="word">svestranost</span><span class="ratio">39.7×</span></li><li><span class="word">autentičnosti</span><span class="ratio">32.5×</span></li><li><span class="word">točnost</span><span class="ratio">57.0×</span></li><li><span class="word">informirati</span><span class="ratio">37.7×</span></li><li><span class="word">timski</span><span class="ratio">30.4×</span></li><li><span class="word">šarm</span><span class="ratio">53.0×</span></li><li><span class="word">napetija</span><span class="ratio">53.0×</span></li></ul>
</section>
<section id="cs" lang="cs">
<h2>Čeština <span class="en">Czech</span></h2>
<p class="native">Slova nadužívaná umělou inteligencí</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Czech news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">transparentnost</span><span class="ratio">83.4×</span></li><li><span class="word">zdůraznit</span><span class="ratio">42.7×</span></li><li><span class="word">napínavý</span><span class="ratio">44.6×</span></li><li><span class="word">zdůrazňovat</span><span class="ratio">37.3×</span></li><li><span class="word">minimalizovat</span><span class="ratio">36.1×</span></li><li><span class="word">minimalizace</span><span class="ratio">45.0×</span></li><li><span class="word">inovativní</span><span class="ratio">33.2×</span></li><li><span class="word">kontroverze</span><span class="ratio">37.0×</span></li><li><span class="word">zlepšený</span><span class="ratio">61.0×</span></li><li><span class="word">nejasnost</span><span class="ratio">35.0×</span></li><li><span class="word">preciznost</span><span class="ratio">55.0×</span></li><li><span class="word">pečlivý</span><span class="ratio">29.4×</span></li><li><span class="word">uspěchaný</span><span class="ratio">33.7×</span></li><li><span class="word">konstruktivní</span><span class="ratio">28.7×</span></li><li><span class="word">porozumění</span><span class="ratio">26.5×</span></li><li><span class="word">geopolitický</span><span class="ratio">28.4×</span></li><li><span class="word">povodně</span><span class="ratio">49.0×</span></li><li><span class="word">mistrně</span><span class="ratio">47.0×</span></li><li><span class="word">zlepšující</span><span class="ratio">47.0×</span></li><li><span class="word">bojovnost</span><span class="ratio">27.0×</span></li></ul>
</section>
<section id="nl" lang="nl">
<h2>Nederlands <span class="en">Dutch</span></h2>
<p class="native">Woorden die AI te vaak gebruikt</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Dutch news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">critici</span><span class="ratio">481.0×</span></li><li><span class="word">fans</span><span class="ratio">225.0×</span></li><li><span class="word">doorzetting_vermogen</span><span class="ratio">145.0×</span></li><li><span class="word">precisie</span><span class="ratio">189.0×</span></li><li><span class="word">daarnaast</span><span class="ratio">90.6×</span></li><li><span class="word">transparantie</span><span class="ratio">93.4×</span></li><li><span class="word">gezondheidsinstantie</span><span class="ratio">159.0×</span></li><li><span class="word">artsen</span><span class="ratio">153.0×</span></li><li><span class="word">veerkracht</span><span class="ratio">96.3×</span></li><li><span class="word">nauwlettend</span><span class="ratio">79.3×</span></li><li><span class="word">benadrukten</span><span class="ratio">63.4×</span></li><li><span class="word">vastberadenheid</span><span class="ratio">71.7×</span></li><li><span class="word">beveiliging_maatregel</span><span class="ratio">105.0×</span></li><li><span class="word">consistentie</span><span class="ratio">103.0×</span></li><li><span class="word">technologisch</span><span class="ratio">53.8×</span></li><li><span class="word">toelevering_keten</span><span class="ratio">89.0×</span></li><li><span class="word">verstevigen</span><span class="ratio">47.7×</span></li><li><span class="word">gezondheid_autoriteit</span><span class="ratio">47.4×</span></li><li><span class="word">intensiveren</span><span class="ratio">83.0×</span></li><li><span class="word">tegen_partij</span><span class="ratio">53.7×</span></li></ul>
</section>
<section id="et" lang="et">
<h2>Eesti <span class="en">Estonian</span></h2>
<p class="native">Sõnad, mida tehisintellekt liialt kasutab</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Estonian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">võitlus_vaim</span><span class="ratio">205.0×</span></li><li><span class="word">sihi_kindlus</span><span class="ratio">111.7×</span></li><li><span class="word">tervise_ametnik</span><span class="ratio">117.0×</span></li><li><span class="word">rõhutama</span><span class="ratio">58.1×</span></li><li><span class="word">digitaal_tehnoloogia</span><span class="ratio">111.0×</span></li><li><span class="word">mängustiil</span><span class="ratio">111.0×</span></li><li><span class="word">ründe_mäng</span><span class="ratio">107.0×</span></li><li><span class="word">saade</span><span class="ratio">103.0×</span></li><li><span class="word">ennetus_meede</span><span class="ratio">61.8×</span></li><li><span class="word">mängu_stiil</span><span class="ratio">101.0×</span></li><li><span class="word">ilmastiku_tingimus</span><span class="ratio">66.3×</span></li><li><span class="word">kohanemis_võime</span><span class="ratio">99.0×</span></li><li><span class="word">süga=vamalt</span><span class="ratio">65.7×</span></li><li><span class="word">mitme_kihiline</span><span class="ratio">93.0×</span></li><li><span class="word">tervise_ohutus_nõue</span><span class="ratio">73.0×</span></li><li><span class="word">tugevdama</span><span class="ratio">37.1×</span></li><li><span class="word">hügi_eeni_nõue</span><span class="ratio">40.6×</span></li><li><span class="word">meeskonna_vaim</span><span class="ratio">48.3×</span></li><li><span class="word">võtme_tähtsus</span><span class="ratio">39.5×</span></li><li><span class="word">õiglase=m</span><span class="ratio">67.0×</span></li></ul>
</section>
<section id="fi" lang="fi">
<h2>Suomi <span class="en">Finnish</span></h2>
<p class="native">Sanat, joita tekoäly käyttää liikaa</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Finnish news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">ympäristö#ystävällinen</span><span class="ratio">213.0×</span></li><li><span class="word">peli#tyyli</span><span class="ratio">193.0×</span></li><li><span class="word">korostaa</span><span class="ratio">89.6×</span></li><li><span class="word">pelin#luku#taito</span><span class="ratio">165.0×</span></li><li><span class="word">omistautuminen</span><span class="ratio">135.0×</span></li><li><span class="word">pelastus#viran#omainen</span><span class="ratio">129.0×</span></li><li><span class="word">joukkue#henki</span><span class="ratio">127.0×</span></li><li><span class="word">avain#asema</span><span class="ratio">64.2×</span></li><li><span class="word">turvallisuus#toimi</span><span class="ratio">91.0×</span></li><li><span class="word">lisäksi</span><span class="ratio">45.6×</span></li><li><span class="word">symboloida</span><span class="ratio">89.0×</span></li><li><span class="word">moni#puolinen</span><span class="ratio">49.6×</span></li><li><span class="word">kaupunki#ajo</span><span class="ratio">85.0×</span></li><li><span class="word">energia#tehokas</span><span class="ratio">81.0×</span></li><li><span class="word">korkealla</span><span class="ratio">79.0×</span></li><li><span class="word">lisä#selvitys</span><span class="ratio">79.0×</span></li><li><span class="word">viljely#menetelmä</span><span class="ratio">73.0×</span></li><li><span class="word">rauhallisuus</span><span class="ratio">71.0×</span></li><li><span class="word">energia#tehokkuus</span><span class="ratio">40.1×</span></li><li><span class="word">sitkeys</span><span class="ratio">45.7×</span></li></ul>
</section>
<section id="fr" lang="fr">
<h2>Français <span class="en">French</span></h2>
<p class="native">Mots que l'IA surutilise</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in French news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">captiver</span><span class="ratio">279.0×</span></li><li><span class="word">géopolitique</span><span class="ratio">61.2×</span></li><li><span class="word">habilement</span><span class="ratio">56.3×</span></li><li><span class="word">accru</span><span class="ratio">69.0×</span></li><li><span class="word">palpable</span><span class="ratio">37.0×</span></li><li><span class="word">poignant</span><span class="ratio">43.0×</span></li><li><span class="word">persistant</span><span class="ratio">30.8×</span></li><li><span class="word">engouement</span><span class="ratio">35.0×</span></li><li><span class="word">cependant</span><span class="ratio">29.6×</span></li><li><span class="word">innovant</span><span class="ratio">28.2×</span></li><li><span class="word">croissant</span><span class="ratio">27.3×</span></li><li><span class="word">crucial</span><span class="ratio">26.7×</span></li><li><span class="word">importance</span><span class="ratio">26.1×</span></li><li><span class="word">impartialité</span><span class="ratio">49.0×</span></li><li><span class="word">renforcer</span><span class="ratio">25.0×</span></li><li><span class="word">grandissant</span><span class="ratio">28.6×</span></li><li><span class="word">vigilance</span><span class="ratio">24.3×</span></li><li><span class="word">mêler</span><span class="ratio">24.2×</span></li><li><span class="word">post-pandémie</span><span class="ratio">31.0×</span></li><li><span class="word">accru</span><span class="ratio">30.3×</span></li></ul>
</section>
<section id="de" lang="de">
<h2>Deutsch <span class="en">German</span></h2>
<p class="native">Wörter, die KI zu oft benutzt</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in German news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">modernst</span><span class="ratio">173.0×</span></li><li><span class="word">präzisen</span><span class="ratio">91.7×</span></li><li><span class="word">praxisnah</span><span class="ratio">123.0×</span></li><li><span class="word">tiefgründig</span><span class="ratio">64.3×</span></li><li><span class="word">kampfgeist</span><span class="ratio">93.0×</span></li><li><span class="word">lieferkettenproblem</span><span class="ratio">93.0×</span></li><li><span class="word">anbaumethode</span><span class="ratio">89.0×</span></li><li><span class="word">eingängig</span><span class="ratio">85.0×</span></li><li><span class="word">umweltbelastung</span><span class="ratio">83.0×</span></li><li><span class="word">beeindruckend</span><span class="ratio">42.4×</span></li><li><span class="word">umweltauflage</span><span class="ratio">77.0×</span></li><li><span class="word">musikszene</span><span class="ratio">73.0×</span></li><li><span class="word">nahegelegenes</span><span class="ratio">73.0×</span></li><li><span class="word">energiepreis</span><span class="ratio">43.8×</span></li><li><span class="word">transparenz</span><span class="ratio">36.3×</span></li><li><span class="word">energiekrise</span><span class="ratio">67.0×</span></li><li><span class="word">großaufgebot</span><span class="ratio">67.0×</span></li><li><span class="word">vielversprechend</span><span class="ratio">39.0×</span></li><li><span class="word">innovativ</span><span class="ratio">32.0×</span></li><li><span class="word">unfallursache</span><span class="ratio">61.0×</span></li></ul>
</section>
<section id="el" lang="el">
<h2>Ελληνικά <span class="en">Greek</span></h2>
<p class="native">Λέξεις που υπερχρησιμοποιεί η ΤΝ</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Greek news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">αυστηρής</span><span class="ratio">87.0×</span></li><li><span class="word">ζωντάνι</span><span class="ratio">79.0×</span></li><li><span class="word">εντατικά</span><span class="ratio">41.9×</span></li><li><span class="word">διαλευκάνω</span><span class="ratio">43.4×</span></li><li><span class="word">στενός</span><span class="ratio">36.9×</span></li><li><span class="word">παράλληλα</span><span class="ratio">35.9×</span></li><li><span class="word">συνέργης</span><span class="ratio">67.0×</span></li><li><span class="word">πλατφορμός</span><span class="ratio">65.0×</span></li><li><span class="word">καλούμαι</span><span class="ratio">33.0×</span></li><li><span class="word">ayrıca</span><span class="ratio">35.0×</span></li><li><span class="word">επαρκός</span><span class="ratio">31.9×</span></li><li><span class="word">αφοσίωση</span><span class="ratio">27.4×</span></li><li><span class="word">κυμαινόμενος</span><span class="ratio">49.0×</span></li><li><span class="word">επιπλέον</span><span class="ratio">24.1×</span></li><li><span class="word">αντίπαλης</span><span class="ratio">30.3×</span></li><li><span class="word">αρτιότητα</span><span class="ratio">45.0×</span></li><li><span class="word">λογοδοσία</span><span class="ratio">24.8×</span></li><li><span class="word">παρευρισκομένος</span><span class="ratio">43.0×</span></li><li><span class="word">εντείνεται</span><span class="ratio">22.0×</span></li><li><span class="word">διαφάνεια</span><span class="ratio">21.6×</span></li></ul>
</section>
<section id="hi" lang="hi">
<h2>हिन्दी <span class="en">Hindi</span></h2>
<p class="native">शब्द जो AI बहुत ज़्यादा इस्तेमाल करता है</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Hindi news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">बचें।ना</span><span class="ratio">219.0×</span></li><li><span class="word">कीं।ना</span><span class="ratio">101.0×</span></li><li><span class="word">भीड़-भाड़</span><span class="ratio">51.0×</span></li><li><span class="word">पर्यावरणीय</span><span class="ratio">79.0×</span></li><li><span class="word">उपयोगकर्ता</span><span class="ratio">49.0×</span></li><li><span class="word">कूड़ा-करकट</span><span class="ratio">42.3×</span></li><li><span class="word">हस्तशिल्प</span><span class="ratio">63.0×</span></li><li><span class="word">प्रस्तु</span><span class="ratio">59.0×</span></li><li><span class="word">स्थिरता</span><span class="ratio">29.2×</span></li><li><span class="word">नदी-नाला</span><span class="ratio">53.0×</span></li><li><span class="word">समयबद्धता</span><span class="ratio">53.0×</span></li><li><span class="word">उर्वरता</span><span class="ratio">53.0×</span></li><li><span class="word">अप्रिय</span><span class="ratio">27.8×</span></li><li><span class="word">भजन-कीर्तन</span><span class="ratio">33.0×</span></li><li><span class="word">दूरदराज</span><span class="ratio">29.0×</span></li><li><span class="word">कूड़ा-कचरा</span><span class="ratio">47.0×</span></li><li><span class="word">नजदीकी</span><span class="ratio">23.4×</span></li><li><span class="word">पारदर्शी</span><span class="ratio">23.9×</span></li><li><span class="word">समावेश</span><span class="ratio">43.0×</span></li><li><span class="word">विश्लेषक</span><span class="ratio">25.4×</span></li></ul>
</section>
<section id="is" lang="is">
<h2>Íslenska <span class="en">Icelandic</span></h2>
<p class="native">Orð sem gervigreind ofnotar</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Icelandic news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">markm</span><span class="ratio">815.0×</span></li><li><span class="word">"það</span><span class="ratio">703.0×</span></li><li><span class="word">íbúar</span><span class="ratio">385.0×</span></li><li><span class="word">samkvæmt</span><span class="ratio">196.3×</span></li><li><span class="word">sóttvarnarráðstafa</span><span class="ratio">137.0×</span></li><li><span class="word">heilbrigðisyfirvöld</span><span class="ratio">102.4×</span></li><li><span class="word">leikskilningur</span><span class="ratio">177.0×</span></li><li><span class="word">hvið</span><span class="ratio">92.3×</span></li><li><span class="word">baráttuvil</span><span class="ratio">110.3×</span></li><li><span class="word">grannt</span><span class="ratio">75.8×</span></li><li><span class="word">lokatalur</span><span class="ratio">123.0×</span></li><li><span class="word">þrautseigja</span><span class="ratio">62.7×</span></li><li><span class="word">einbeiting</span><span class="ratio">57.0×</span></li><li><span class="word">baráttuandi</span><span class="ratio">68.3×</span></li><li><span class="word">neyðarþjónustur</span><span class="ratio">95.0×</span></li><li><span class="word">tafarlaus</span><span class="ratio">51.0×</span></li><li><span class="word">markvisst</span><span class="ratio">87.0×</span></li><li><span class="word">stjórinn</span><span class="ratio">87.0×</span></li><li><span class="word">samheldni</span><span class="ratio">45.6×</span></li><li><span class="word">sköpunargáfa</span><span class="ratio">56.3×</span></li></ul>
</section>
<section id="id" lang="id">
<h2>Bahasa Indonesia <span class="en">Indonesian</span></h2>
<p class="native">Kata-kata yang terlalu sering dipakai AI</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Indonesian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">pihak</span><span class="ratio">2387.0×</span></li><li><span class="word">namun</span><span class="ratio">303.9×</span></li><li><span class="word">pentangkapan</span><span class="ratio">557.0×</span></li><li><span class="word">gol</span><span class="ratio">136.3×</span></li><li><span class="word">meskipun</span><span class="ratio">185.0×</span></li><li><span class="word">kenaikan</span><span class="ratio">181.0×</span></li><li><span class="word">korsleting</span><span class="ratio">173.0×</span></li><li><span class="word">suasana</span><span class="ratio">139.0×</span></li><li><span class="word">selain</span><span class="ratio">63.8×</span></li><li><span class="word">impresif</span><span class="ratio">123.0×</span></li><li><span class="word">sekitar</span><span class="ratio">49.4×</span></li><li><span class="word">operandi</span><span class="ratio">79.0×</span></li><li><span class="word">padahal</span><span class="ratio">79.0×</span></li><li><span class="word">situasi</span><span class="ratio">77.0×</span></li><li><span class="word">menurut</span><span class="ratio">50.3×</span></li><li><span class="word">penlatihan</span><span class="ratio">75.0×</span></li><li><span class="word">konflik</span><span class="ratio">49.7×</span></li><li><span class="word">tegas</span><span class="ratio">36.7×</span></li><li><span class="word">ketegangan</span><span class="ratio">69.0×</span></li><li><span class="word">sana</span><span class="ratio">69.0×</span></li></ul>
</section>
<section id="it" lang="it">
<h2>Italiano <span class="en">Italian</span></h2>
<p class="native">Parole che l'IA usa troppo</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Italian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">wfullscreen></span><span class="ratio">167.0×</span></li><li><span class="word">palpabile</span><span class="ratio">143.0×</span></li><li><span class="word">permangere</span><span class="ratio">69.0×</span></li><li><span class="word">attentamente</span><span class="ratio">54.5×</span></li><li><span class="word">intensificare</span><span class="ratio">45.4×</span></li><li><span class="word">inoltre</span><span class="ratio">43.2×</span></li><li><span class="word">fonti</span><span class="ratio">77.0×</span></li><li><span class="word">tuttavia</span><span class="ratio">39.3×</span></li><li><span class="word">determinazione</span><span class="ratio">35.4×</span></li><li><span class="word">accendere</span><span class="ratio">35.0×</span></li><li><span class="word">contrastante</span><span class="ratio">33.9×</span></li><li><span class="word">post-pandemia</span><span class="ratio">40.3×</span></li><li><span class="word">avvincente</span><span class="ratio">37.7×</span></li><li><span class="word">adottare</span><span class="ratio">32.6×</span></li><li><span class="word">altalenante</span><span class="ratio">53.0×</span></li><li><span class="word">1.245</span><span class="ratio">53.0×</span></li><li><span class="word">visibilmente</span><span class="ratio">35.0×</span></li><li><span class="word">intensamente</span><span class="ratio">33.0×</span></li><li><span class="word">raccolto</span><span class="ratio">27.9×</span></li><li><span class="word">dedizione</span><span class="ratio">25.6×</span></li></ul>
</section>
<section id="ja" lang="ja">
<h2>日本語 <span class="en">Japanese</span></h2>
<p class="native">AIが多用する言葉</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Japanese news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">例えば</span><span class="ratio">62.7×</span></li><li><span class="word">然し</span><span class="ratio">60.6×</span></li><li><span class="word">特に</span><span class="ratio">53.0×</span></li><li><span class="word">喧騒</span><span class="ratio">71.0×</span></li><li><span class="word">一方</span><span class="ratio">40.7×</span></li><li><span class="word">若年</span><span class="ratio">32.1×</span></li><li><span class="word">軽度</span><span class="ratio">59.0×</span></li><li><span class="word">訪れる</span><span class="ratio">37.0×</span></li><li><span class="word">手指消</span><span class="ratio">33.7×</span></li><li><span class="word">分断</span><span class="ratio">47.0×</span></li><li><span class="word">折々</span><span class="ratio">41.0×</span></li><li><span class="word">志向</span><span class="ratio">22.3×</span></li><li><span class="word">単なる</span><span class="ratio">21.2×</span></li><li><span class="word">急務</span><span class="ratio">20.8×</span></li><li><span class="word">更に</span><span class="ratio">17.5×</span></li><li><span class="word">メート</span><span class="ratio">18.2×</span></li><li><span class="word">又</span><span class="ratio">17.0×</span></li><li><span class="word">巧み</span><span class="ratio">16.4×</span></li><li><span class="word">独特</span><span class="ratio">15.7×</span></li><li><span class="word">台頭</span><span class="ratio">18.2×</span></li></ul>
</section>
<section id="kk" lang="kk">
<h2>Қазақша <span class="en">Kazakh</span></h2>
<p class="native">Жасанды интеллект жиі қолданатын сөздер</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Kazakh news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">сонымен</span><span class="ratio">3197.0×</span></li><li><span class="word">сонымен</span><span class="ratio">542.9×</span></li><li><span class="word">қатар</span><span class="ratio">83.8×</span></li><li><span class="word">вакцинациялау</span><span class="ratio">85.9×</span></li><li><span class="word">биылғы</span><span class="ratio">145.0×</span></li><li><span class="word">мұндай</span><span class="ratio">115.0×</span></li><li><span class="word">қатар</span><span class="ratio">57.4×</span></li><li><span class="word">сондықтан</span><span class="ratio">59.9×</span></li><li><span class="word">жанкүйер</span><span class="ratio">101.0×</span></li><li><span class="word">метеоролог</span><span class="ratio">99.0×</span></li><li><span class="word">тренинг</span><span class="ratio">44.9×</span></li><li><span class="word">әильм</span><span class="ratio">83.0×</span></li><li><span class="word">жақсартыл</span><span class="ratio">54.3×</span></li><li><span class="word">бұл</span><span class="ratio">79.0×</span></li><li><span class="word">толерантылық</span><span class="ratio">79.0×</span></li><li><span class="word">эмоционалдық</span><span class="ratio">71.0×</span></li><li><span class="word">дйымдастыруыл</span><span class="ratio">63.0×</span></li><li><span class="word">бағытталған</span><span class="ratio">32.2×</span></li><li><span class="word">қатаң</span><span class="ratio">30.5×</span></li><li><span class="word">рухт</span><span class="ratio">31.3×</span></li></ul>
</section>
<section id="ko" lang="ko">
<h2>한국어 <span class="en">Korean</span></h2>
<p class="native">AI가 자주 쓰는 단어</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Korean news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">한편</span><span class="ratio">1851.0×</span></li><li><span class="word">또한</span><span class="ratio">517.1×</span></li><li><span class="word">단기+적+이+ㄴ</span><span class="ratio">531.0×</span></li><li><span class="word">마련+되+었+으며</span><span class="ratio">235.0×</span></li><li><span class="word">전문가+들+은</span><span class="ratio">112.8×</span></li><li><span class="word">필수+적+이+며</span><span class="ratio">213.0×</span></li><li><span class="word">개성+과</span><span class="ratio">209.0×</span></li><li><span class="word">준수+하+ㄹ</span><span class="ratio">201.0×</span></li><li><span class="word">접종률+을</span><span class="ratio">131.0×</span></li><li><span class="word">이에</span><span class="ratio">117.0×</span></li><li><span class="word">하지만</span><span class="ratio">113.7×</span></li><li><span class="word">당부+하+며</span><span class="ratio">161.0×</span></li><li><span class="word">국민+들+께서+는</span><span class="ratio">159.0×</span></li><li><span class="word">주민+들+과+의</span><span class="ratio">151.0×</span></li><li><span class="word">부인+하+며</span><span class="ratio">149.0×</span></li><li><span class="word">모니터링+하+며</span><span class="ratio">98.3×</span></li><li><span class="word">당국+은</span><span class="ratio">73.1×</span></li><li><span class="word">계획+이+ㅁ+을</span><span class="ratio">91.0×</span></li><li><span class="word">주+었+으며</span><span class="ratio">135.0×</span></li><li><span class="word">방문객+들+에게</span><span class="ratio">135.0×</span></li></ul>
</section>
<section id="ky" lang="ky">
<h2>Кыргызча <span class="en">Kyrgyz</span></h2>
<p class="native">Жасалма интеллект көп колдонгон сөздөр</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Kyrgyz news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">мындан</span><span class="ratio">7401.0×</span></li><li><span class="word">ошондой</span><span class="ratio">907.2×</span></li><li><span class="word">ошондук</span><span class="ratio">867.0×</span></li><li><span class="word">анын</span><span class="ratio">469.0×</span></li><li><span class="word">министрлик</span><span class="ratio">447.0×</span></li><li><span class="word">айтым</span><span class="ratio">413.0×</span></li><li><span class="word">айрыкча</span><span class="ratio">399.0×</span></li><li><span class="word">алар</span><span class="ratio">147.9×</span></li><li><span class="word">иш-чара</span><span class="ratio">255.0×</span></li><li><span class="word">тышкар</span><span class="ratio">120.0×</span></li><li><span class="word">сунушташ</span><span class="ratio">219.0×</span></li><li><span class="word">процесс</span><span class="ratio">199.0×</span></li><li><span class="word">күнөөсүздүк</span><span class="ratio">195.0×</span></li><li><span class="word">аймак</span><span class="ratio">179.0×</span></li><li><span class="word">митинг</span><span class="ratio">117.7×</span></li><li><span class="word">анын</span><span class="ratio">103.4×</span></li><li><span class="word">вакцинацияла</span><span class="ratio">163.0×</span></li><li><span class="word">окуя</span><span class="ratio">105.7×</span></li><li><span class="word">бирок</span><span class="ratio">93.0×</span></li><li><span class="word">фермерлер</span><span class="ratio">153.0×</span></li></ul>
</section>
<section id="lv" lang="lv">
<h2>Latviešu <span class="en">Latvian</span></h2>
<p class="native">Vārdi, ko MI lieto pārāk bieži</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Latvian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">interaktīva</span><span class="ratio">185.0×</span></li><li><span class="word">caurspīdīgums</span><span class="ratio">55.9×</span></li><li><span class="word">rūpīgs</span><span class="ratio">47.2×</span></li><li><span class="word">spraigs</span><span class="ratio">52.6×</span></li><li><span class="word">raksturoties</span><span class="ratio">81.0×</span></li><li><span class="word">neatlaidība</span><span class="ratio">37.6×</span></li><li><span class="word">piesātinājums</span><span class="ratio">61.0×</span></li><li><span class="word">ilgtspējība</span><span class="ratio">35.8×</span></li><li><span class="word">dzīvīgums</span><span class="ratio">53.0×</span></li><li><span class="word">veiklība</span><span class="ratio">32.3×</span></li><li><span class="word">daudzslāņains</span><span class="ratio">30.3×</span></li><li><span class="word">radošumu</span><span class="ratio">23.7×</span></li><li><span class="word">solīties</span><span class="ratio">22.3×</span></li><li><span class="word">saprašanās</span><span class="ratio">26.3×</span></li><li><span class="word">elastība</span><span class="ratio">21.0×</span></li><li><span class="word">precizitāte</span><span class="ratio">19.3×</span></li><li><span class="word">gadagājuma</span><span class="ratio">21.0×</span></li><li><span class="word">centība</span><span class="ratio">24.3×</span></li><li><span class="word">svarīgi</span><span class="ratio">18.0×</span></li><li><span class="word">energoefektīviem</span><span class="ratio">23.0×</span></li></ul>
</section>
<section id="lt" lang="lt">
<h2>Lietuvių <span class="en">Lithuanian</span></h2>
<p class="native">Žodžiai, kuriuos DI vartoja per dažnai</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Lithuanian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">tas</span><span class="ratio">699.0×</span></li><li><span class="word">abi</span><span class="ratio">433.0×</span></li><li><span class="word">neignoruoti</span><span class="ratio">217.0×</span></li><li><span class="word">ramia</span><span class="ratio">93.0×</span></li><li><span class="word">be</span><span class="ratio">44.3×</span></li><li><span class="word">efektyvas</span><span class="ratio">45.4×</span></li><li><span class="word">neatsargti</span><span class="ratio">79.0×</span></li><li><span class="word">tvara</span><span class="ratio">39.9×</span></li><li><span class="word">apisti</span><span class="ratio">40.1×</span></li><li><span class="word">to</span><span class="ratio">34.1×</span></li><li><span class="word">atkaklumas</span><span class="ratio">38.4×</span></li><li><span class="word">verslai</span><span class="ratio">65.0×</span></li><li><span class="word">šaltiniai</span><span class="ratio">65.0×</span></li><li><span class="word">skubė</span><span class="ratio">39.0×</span></li><li><span class="word">bendruomeniškumas</span><span class="ratio">36.7×</span></li><li><span class="word">medikai</span><span class="ratio">61.0×</span></li><li><span class="word">universalumas</span><span class="ratio">39.0×</span></li><li><span class="word">informuotumas</span><span class="ratio">37.7×</span></li><li><span class="word">tas</span><span class="ratio">53.0×</span></li><li><span class="word">stiprinti</span><span class="ratio">27.1×</span></li></ul>
</section>
<section id="mr" lang="mr">
<h2>मराठी <span class="en">Marathi</span></h2>
<p class="native">AI जास्त वापरत असलेले शब्द</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Marathi news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">तसेच</span><span class="ratio">2305.0×</span></li><li><span class="word">तसेच</span><span class="ratio">1757.0×</span></li><li><span class="word">तसेच</span><span class="ratio">1637.0×</span></li><li><span class="word">याशिवाय</span><span class="ratio">863.0×</span></li><li><span class="word">याशिवाय</span><span class="ratio">491.0×</span></li><li><span class="word">जीवनमान</span><span class="ratio">411.0×</span></li><li><span class="word">त्वरित</span><span class="ratio">353.0×</span></li><li><span class="word">त्वरित</span><span class="ratio">195.0×</span></li><li><span class="word">एकात्मता</span><span class="ratio">291.0×</span></li><li><span class="word">एकात्मे</span><span class="ratio">223.0×</span></li><li><span class="word">याशिवाय</span><span class="ratio">209.0×</span></li><li><span class="word">धैर्य</span><span class="ratio">205.0×</span></li><li><span class="word">यामुळे</span><span class="ratio">95.2×</span></li><li><span class="word">एकात्मते</span><span class="ratio">181.0×</span></li><li><span class="word">विभाग</span><span class="ratio">179.0×</span></li><li><span class="word">त्वरणे</span><span class="ratio">161.0×</span></li><li><span class="word">तज्ञा</span><span class="ratio">87.8×</span></li><li><span class="word">बचावकार्य</span><span class="ratio">137.0×</span></li><li><span class="word">सुनिश्चित</span><span class="ratio">77.8×</span></li><li><span class="word">विविध</span><span class="ratio">73.3×</span></li></ul>
</section>
<section id="fa" lang="fa">
<h2>فارسی <span class="en">Persian</span></h2>
<p class="native">واژههایی که هوش مصنوعی زیاد به کار میبرد</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Persian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">بینالمللی</span><span class="ratio">4005.0×</span></li><li><span class="word">بهرهگیری</span><span class="ratio">1577.0×</span></li><li><span class="word">برنامهریزی</span><span class="ratio">1030.3×</span></li><li><span class="word">ویژ</span><span class="ratio">1537.0×</span></li><li><span class="word">سرمایهگذاری</span><span class="ratio">1327.0×</span></li><li><span class="word">دانشآموز</span><span class="ratio">1033.0×</span></li><li><span class="word">بهرهوری</span><span class="ratio">963.0×</span></li><li><span class="word">شدهاند</span><span class="ratio">617.0×</span></li><li><span class="word">گسترد</span><span class="ratio">901.0×</span></li><li><span class="word">بهرهبرداری</span><span class="ratio">897.0×</span></li><li><span class="word">پیشبینی</span><span class="ratio">819.0×</span></li><li><span class="word">زمینهساز</span><span class="ratio">703.0×</span></li><li><span class="word">راهحل</span><span class="ratio">671.0×</span></li><li><span class="word">تصمیمگیری</span><span class="ratio">637.0×</span></li><li><span class="word">نشاندهنده</span><span class="ratio">407.7×</span></li><li><span class="word">زیستمحیطی</span><span class="ratio">529.0×</span></li><li><span class="word">اطلاعرسانی</span><span class="ratio">509.0×</span></li><li><span class="word">سرمایهگذار</span><span class="ratio">495.0×</span></li><li><span class="word">شرکتکننده</span><span class="ratio">481.0×</span></li><li><span class="word">فاصلهگذاری</span><span class="ratio">479.0×</span></li></ul>
</section>
<section id="pl" lang="pl">
<h2>Polski <span class="en">Polish</span></h2>
<p class="native">Słowa nadużywane przez AI</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Polish news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">transparentność</span><span class="ratio">215.4×</span></li><li><span class="word">omówienie</span><span class="ratio">171.0×</span></li><li><span class="word">emocjonująco</span><span class="ratio">169.0×</span></li><li><span class="word">intensyfikować</span><span class="ratio">105.0×</span></li><li><span class="word">fani</span><span class="ratio">71.0×</span></li><li><span class="word">rosnący</span><span class="ratio">35.3×</span></li><li><span class="word">autentyczność</span><span class="ratio">38.2×</span></li><li><span class="word">xyz</span><span class="ratio">63.0×</span></li><li><span class="word">ponadto</span><span class="ratio">32.5×</span></li><li><span class="word">wszechstronność</span><span class="ratio">36.2×</span></li><li><span class="word">zadysponować</span><span class="ratio">57.0×</span></li><li><span class="word">zrewolucjonizować</span><span class="ratio">57.0×</span></li><li><span class="word">wytrzymałość</span><span class="ratio">37.7×</span></li><li><span class="word">charakteryzować</span><span class="ratio">29.8×</span></li><li><span class="word">determinacja</span><span class="ratio">28.7×</span></li><li><span class="word">elegancja</span><span class="ratio">53.0×</span></li><li><span class="word">usprawnić</span><span class="ratio">28.3×</span></li><li><span class="word">krytyk</span><span class="ratio">27.3×</span></li><li><span class="word">minimalizacja</span><span class="ratio">33.0×</span></li><li><span class="word">zdyskredytować</span><span class="ratio">49.0×</span></li></ul>
</section>
<section id="pt" lang="pt">
<h2>Português <span class="en">Portuguese</span></h2>
<p class="native">Palavras que a IA usa em excesso</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Portuguese news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">organizações</span><span class="ratio">507.0×</span></li><li><span class="word">testemunhas</span><span class="ratio">337.0×</span></li><li><span class="word">acalorado</span><span class="ratio">89.0×</span></li><li><span class="word">amigos</span><span class="ratio">119.0×</span></li><li><span class="word">ao</span><span class="ratio">113.0×</span></li><li><span class="word">contagiante</span><span class="ratio">93.0×</span></li><li><span class="word">mistura</span><span class="ratio">43.4×</span></li><li><span class="word">investimentos</span><span class="ratio">65.0×</span></li><li><span class="word">envolvente</span><span class="ratio">42.3×</span></li><li><span class="word">imersivo</span><span class="ratio">61.0×</span></li><li><span class="word">visar</span><span class="ratio">28.9×</span></li><li><span class="word">interativo</span><span class="ratio">35.7×</span></li><li><span class="word">importância</span><span class="ratio">25.8×</span></li><li><span class="word">revolucionar</span><span class="ratio">27.3×</span></li><li><span class="word">rigoroso</span><span class="ratio">23.9×</span></li><li><span class="word">harmonioso</span><span class="ratio">45.0×</span></li><li><span class="word">fortaleçar</span><span class="ratio">45.0×</span></li><li><span class="word">juntos</span><span class="ratio">45.0×</span></li><li><span class="word">destacar</span><span class="ratio">22.9×</span></li><li><span class="word">vibrante</span><span class="ratio">27.0×</span></li></ul>
</section>
<section id="ro" lang="ro">
<h2>Română <span class="en">Romanian</span></h2>
<p class="native">Cuvinte suprautilizate de IA</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Romanian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">prompt</span><span class="ratio">103.8×</span></li><li><span class="word">transparență</span><span class="ratio">56.0×</span></li><li><span class="word">importanță</span><span class="ratio">47.0×</span></li><li><span class="word">variabil</span><span class="ratio">91.0×</span></li><li><span class="word">electrizant</span><span class="ratio">91.0×</span></li><li><span class="word">esențial</span><span class="ratio">45.1×</span></li><li><span class="word">intensifica</span><span class="ratio">43.1×</span></li><li><span class="word">inovație</span><span class="ratio">42.3×</span></li><li><span class="word">prevenție</span><span class="ratio">38.1×</span></li><li><span class="word">captiva</span><span class="ratio">47.0×</span></li><li><span class="word">reticență</span><span class="ratio">69.0×</span></li><li><span class="word">dedicare</span><span class="ratio">41.0×</span></li><li><span class="word">artista</span><span class="ratio">67.0×</span></li><li><span class="word">lozincă</span><span class="ratio">65.0×</span></li><li><span class="word">evidenția</span><span class="ratio">34.9×</span></li><li><span class="word">ignore</span><span class="ratio">59.0×</span></li><li><span class="word">strictețe</span><span class="ratio">32.1×</span></li><li><span class="word">strâns</span><span class="ratio">31.7×</span></li><li><span class="word">meni</span><span class="ratio">28.4×</span></li><li><span class="word">resimga</span><span class="ratio">51.0×</span></li></ul>
</section>
<section id="ru" lang="ru">
<h2>Русский <span class="en">Russian</span></h2>
<p class="native">Слова, которые ИИ использует слишком часто</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Russian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">напряжённость</span><span class="ratio">275.0×</span></li><li><span class="word">уделить</span><span class="ratio">107.4×</span></li><li><span class="word">отдалить</span><span class="ratio">179.0×</span></li><li><span class="word">оснатить</span><span class="ratio">105.0×</span></li><li><span class="word">опрашивать</span><span class="ratio">105.0×</span></li><li><span class="word">упрощение</span><span class="ratio">57.0×</span></li><li><span class="word">важность</span><span class="ratio">47.0×</span></li><li><span class="word">улучить</span><span class="ratio">91.0×</span></li><li><span class="word">экспериментировать</span><span class="ratio">91.0×</span></li><li><span class="word">внедрять</span><span class="ratio">48.5×</span></li><li><span class="word">режиссёр</span><span class="ratio">85.0×</span></li><li><span class="word">прозрачность</span><span class="ratio">42.6×</span></li><li><span class="word">обеспокоенность</span><span class="ratio">39.0×</span></li><li><span class="word">минимизировать</span><span class="ratio">37.2×</span></li><li><span class="word">слаженный</span><span class="ratio">46.3×</span></li><li><span class="word">вооруженный</span><span class="ratio">65.0×</span></li><li><span class="word">уделять</span><span class="ratio">33.1×</span></li><li><span class="word">сдержанность</span><span class="ratio">39.0×</span></li><li><span class="word">метеоролог</span><span class="ratio">57.0×</span></li><li><span class="word">резонанс</span><span class="ratio">30.1×</span></li></ul>
</section>
<section id="sr" lang="sr">
<h2>Српски <span class="en">Serbian</span></h2>
<p class="native">Речи које вештачка интелигенција прекомерно користи</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Serbian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">апелују</span><span class="ratio">1001.0×</span></li><li><span class="word">истовреееo</span><span class="ratio">649.0×</span></li><li><span class="word">тренер</span><span class="ratio">501.0×</span></li><li><span class="word">међутим</span><span class="ratio">272.1×</span></li><li><span class="word">организатоииии</span><span class="ratio">465.0×</span></li><li><span class="word">представниииии</span><span class="ratio">331.0×</span></li><li><span class="word">упорност</span><span class="ratio">323.0×</span></li><li><span class="word">грађани</span><span class="ratio">303.0×</span></li><li><span class="word">istakao</span><span class="ratio">275.0×</span></li><li><span class="word">изузетну</span><span class="ratio">183.0×</span></li><li><span class="word">упозоравају</span><span class="ratio">149.6×</span></li><li><span class="word">способност</span><span class="ratio">159.7×</span></li><li><span class="word">стручњаци</span><span class="ratio">124.8×</span></li><li><span class="word">стављен</span><span class="ratio">231.0×</span></li><li><span class="word">најавилiti</span><span class="ratio">221.0×</span></li><li><span class="word">истичу</span><span class="ratio">114.2×</span></li><li><span class="word">праћење</span><span class="ratio">213.0×</span></li><li><span class="word">унапређењу</span><span class="ratio">122.6×</span></li><li><span class="word">транспарентност</span><span class="ratio">134.3×</span></li><li><span class="word">борбеност</span><span class="ratio">128.3×</span></li></ul>
</section>
<section id="es" lang="es">
<h2>Español <span class="en">Spanish</span></h2>
<p class="native">Palabras que la IA usa en exceso</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Spanish news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">testigos</span><span class="ratio">293.0×</span></li><li><span class="word">organizaciones</span><span class="ratio">247.0×</span></li><li><span class="word">experto</span><span class="ratio">131.4×</span></li><li><span class="word">imborrable</span><span class="ratio">137.0×</span></li><li><span class="word">estudios</span><span class="ratio">119.0×</span></li><li><span class="word">analistas</span><span class="ratio">83.0×</span></li><li><span class="word">mientras</span><span class="ratio">83.0×</span></li><li><span class="word">equipos</span><span class="ratio">73.0×</span></li><li><span class="word">implementado</span><span class="ratio">38.6×</span></li><li><span class="word">implementación</span><span class="ratio">35.8×</span></li><li><span class="word">antes</span><span class="ratio">37.8×</span></li><li><span class="word">multidisciplinario</span><span class="ratio">57.0×</span></li><li><span class="word">fortalecer</span><span class="ratio">28.7×</span></li><li><span class="word">solidez</span><span class="ratio">37.0×</span></li><li><span class="word">reinserción</span><span class="ratio">55.0×</span></li><li><span class="word">entrelazar</span><span class="ratio">36.3×</span></li><li><span class="word">empresas</span><span class="ratio">53.0×</span></li><li><span class="word">significativo</span><span class="ratio">26.7×</span></li><li><span class="word">intensificar</span><span class="ratio">25.2×</span></li><li><span class="word">importancia</span><span class="ratio">24.5×</span></li></ul>
</section>
<section id="ta" lang="ta">
<h2>தமிழ் <span class="en">Tamil</span></h2>
<p class="native">AI அதிகம் பயன்படுத்தும் சொற்கள்</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Tamil news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">கடைபிடி</span><span class="ratio">170.1×</span></li><li><span class="word">மேம்படு</span><span class="ratio">168.3×</span></li><li><span class="word">சச்சில்</span><span class="ratio">229.0×</span></li><li><span class="word">ஒருமித்தம்</span><span class="ratio">219.0×</span></li><li><span class="word">தீவிரப்படுத்படு</span><span class="ratio">171.0×</span></li><li><span class="word">இதனால்</span><span class="ratio">77.4×</span></li><li><span class="word">சுற்றுப்புற</span><span class="ratio">90.2×</span></li><li><span class="word">மேம்பட்டு</span><span class="ratio">133.0×</span></li><li><span class="word">ஆமா</span><span class="ratio">88.3×</span></li><li><span class="word">நோக்கத்துடன்</span><span class="ratio">74.1×</span></li><li><span class="word">முனை</span><span class="ratio">129.0×</span></li><li><span class="word">அலங்க்கி</span><span class="ratio">125.0×</span></li><li><span class="word">வேதபாடல்</span><span class="ratio">125.0×</span></li><li><span class="word">உள்நிலை</span><span class="ratio">121.0×</span></li><li><span class="word">ஆன்மிக</span><span class="ratio">58.4×</span></li><li><span class="word">பொதுமகர்</span><span class="ratio">111.0×</span></li><li><span class="word">சாந்தி</span><span class="ratio">73.0×</span></li><li><span class="word">நலனுக்காக</span><span class="ratio">63.0×</span></li><li><span class="word">பாதுகாப்பையும்</span><span class="ratio">103.0×</span></li><li><span class="word">நலனு</span><span class="ratio">101.0×</span></li></ul>
</section>
<section id="tr" lang="tr">
<h2>Türkçe <span class="en">Turkish</span></h2>
<p class="native">Yapay zekânın aşırı kullandığı kelimeler</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Turkish news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">çarpma</span><span class="ratio">67.0×</span></li><li><span class="word">ce</span><span class="ratio">31.1×</span></li><li><span class="word">ayrıca</span><span class="ratio">27.1×</span></li><li><span class="word">derinleme</span><span class="ratio">51.0×</span></li><li><span class="word">salim</span><span class="ratio">47.0×</span></li><li><span class="word">dalgalanma</span><span class="ratio">23.9×</span></li><li><span class="word">derinleme</span><span class="ratio">45.0×</span></li><li><span class="word">sürdürüleke</span><span class="ratio">43.0×</span></li><li><span class="word">toparlanma</span><span class="ratio">26.3×</span></li><li><span class="word">yetkili</span><span class="ratio">19.4×</span></li><li><span class="word">arayüz</span><span class="ratio">25.0×</span></li><li><span class="word">disiplinli</span><span class="ratio">17.8×</span></li><li><span class="word">semine</span><span class="ratio">18.1×</span></li><li><span class="word">minim</span><span class="ratio">17.5×</span></li><li><span class="word">özellikle</span><span class="ratio">16.2×</span></li><li><span class="word">harmanla</span><span class="ratio">17.7×</span></li><li><span class="word">derinleş</span><span class="ratio">16.0×</span></li><li><span class="word">zedele</span><span class="ratio">16.1×</span></li><li><span class="word">bağla</span><span class="ratio">18.3×</span></li><li><span class="word">derinleme</span><span class="ratio">18.3×</span></li></ul>
</section>
<section id="uk" lang="uk">
<h2>Українська <span class="en">Ukrainian</span></h2>
<p class="native">Слова, які ШІ вживає надто часто</p>
<p class="desc">The words GPT-4.1 mini produces most disproportionately versus a matched human baseline in Ukrainian news text — top 20 by Log Prevalence Ratio; the figure is how many times more frequent each word is in the model’s text.</p>
<ul class="words"><li><span class="word">вчені</span><span class="ratio">971.0×</span></li><li><span class="word">важливість</span><span class="ratio">88.8×</span></li><li><span class="word">водночас</span><span class="ratio">67.9×</span></li><li><span class="word">впровадити</span><span class="ratio">68.1×</span></li><li><span class="word">своєчасний</span><span class="ratio">61.0×</span></li><li><span class="word">злагоджений</span><span class="ratio">109.0×</span></li><li><span class="word">впровадження</span><span class="ratio">54.2×</span></li><li><span class="word">зволікати</span><span class="ratio">53.0×</span></li><li><span class="word">взаємоповига</span><span class="ratio">77.0×</span></li><li><span class="word">заморожування</span><span class="ratio">51.0×</span></li><li><span class="word">наголошувати</span><span class="ratio">33.3×</span></li><li><span class="word">незламність</span><span class="ratio">65.0×</span></li><li><span class="word">приділений</span><span class="ratio">43.0×</span></li><li><span class="word">прозорість</span><span class="ratio">32.2×</span></li><li><span class="word">обороноздатність</span><span class="ratio">31.0×</span></li><li><span class="word">зростаючий</span><span class="ratio">30.4×</span></li><li><span class="word">важливо</span><span class="ratio">29.3×</span></li><li><span class="word">відвага</span><span class="ratio">57.0×</span></li><li><span class="word">резонанс</span><span class="ratio">29.2×</span></li><li><span class="word">активній</span><span class="ratio">36.3×</span></li></ul>
</section>
</main>
<footer><p>© 2026 <a href="https://tjuzek.com/">TSJ</a> · <a href="https://creativecommons.org/publicdomain/zero/1.0/">CC0 1.0</a> (no warranty) · built with Gemini and <a href="https://www.anthropic.com/product/claude-code">Claude Code</a></p><p><a href="index.html">Explorer</a> · <a href="about.html">About</a> · Last updated: 2026-05-31 · 34 languages</p></footer>
</div>
<!-- GoatCounter: private, cookieless visitor analytics (invisible to visitors) -->
<script data-goatcounter="https://aiwordexplorer.goatcounter.com/count" async src="//gc.zgo.at/count.js"></script>
</body>
</html>