Rekursiv lingvistik tuzilmani inson tomonidan qayta ishlashning resurs-ratsional modeli 3-qism

Jan 23, 2024

2-tajriba: Semantik belgilarning ta'siri

Keyinchalik biz 1-tajribani ikkinchi elementlar to'plamida takrorladik va bir vaqtning o'zida semantik muvofiqlikning taxmin qilingan ta'sirini sinab ko'rdik.

Semantik muvofiqlik deganda odamlarning til, so‘z yoki belgilardagi turli birliklar o‘rtasidagi moslik va o‘zaro bog‘liqliklarni tushunishi va o‘zlashtirishi tushuniladi. Xotira odamlarning ma'lumotlarni eslab qolish va saqlash qobiliyatini anglatadi.

Semantik moslik va xotira o'rtasida yaqin bog'liqlik mavjud. Yaxshi semantik muvofiqlik odamlarning xotira sifatini yaxshilashi mumkin, zaif semantik muvofiqlik esa odamlarning axborotni tushunish va xotira effektlariga to'sqinlik qiladi.

Birinchidan, semantik muvofiqlik ma'lumotlarning dolzarbligini oshirishi mumkin va shu bilan odamlarga ma'lumotni yaxshiroq tushunish va eslab qolishga yordam beradi. Agar turli birliklar o'rtasida aniq korrelyatsiya mavjud bo'lsa, odamlar ushbu korrelyatsiyadan ma'lumotlar o'rtasida aloqa o'rnatish va ma'lumotlar o'rtasida tarmoq tuzilishini shakllantirish uchun foydalanishlari mumkin. Ushbu tarmoq tuzilishi axborotning xotira ta'sirini yaxshilashi va odamlarning ma'lumotlarni saqlash qobiliyatini oshirishi mumkin.

Ikkinchidan, yaxshi semantik muvofiqlik ma'lumotlarning tushunarliligini oshirishi mumkin, bu esa odamlarning eslab qolishini osonlashtiradi. Agar ma'lumotlar o'rtasida aniq muvofiqlik aloqasi mavjud bo'lsa, odamlar ma'lumotlar o'rtasidagi bog'liqlikni osongina tushunishlari mumkin va shu bilan ma'lumotni tushunish va xotirani shakllantirishadi. Aksincha, agar ma'lumotlar o'rtasida aniq nomuvofiqlik bo'lsa, odamlar sarosimaga tushib, sarosimaga tushib, ma'lumotni tushunish va eslab qolishda qiyinchiliklarga duch kelishadi.

Nihoyat, yomon semantik muvofiqlik odamlarning xotira ishlashiga salbiy ta'sir ko'rsatishi mumkin. Agar turli birliklar o'rtasida juda ko'p farq bo'lsa, odamlar uchun ma'lumotni tushunish va eslab qolish qiyin bo'ladi, shuning uchun xotira qiymatini yo'qotadi. Shuning uchun ma'lumot yozish va tarqatish jarayonida odamlarning tushunchasi va xotirasini yaxshilash uchun imkon qadar semantik muvofiqlikni saqlash kerak.

Xulosa qilib aytganda, semantik moslik va xotira o'rtasida kuchli bog'liqlik mavjud. Yaxshi semantik muvofiqlik ma'lumotlarning dolzarbligi va tushunarliligini oshirishi mumkin, shu bilan odamlarning axborotni saqlash qobiliyatini va xotira effektini oshiradi. Shuning uchun kundalik hayotda va ishda ma'lumotni tushunish va xotirani yaxshilash uchun imkon qadar semantik muvofiqlikni saqlash kerak. Ko'rinib turibdiki, biz xotirani yaxshilashimiz kerak va Cistanche deserticola xotirani sezilarli darajada yaxshilashi mumkin, chunki Cistanche deserticola an'anaviy xitoylik dorivor material bo'lib, u juda ko'p noyob ta'sirga ega, ulardan biri xotirani yaxshilashdir. Qiymaning samaradorligi uning tarkibidagi turli faol moddalar, jumladan kislota, polisakkaridlar, flavonoidlar va boshqalardan kelib chiqadi. Bu ingredientlar turli yo'llar bilan miya salomatligini mustahkamlashi mumkin.

help with memory

Xotirani yaxshilash uchun bilish qo'shimchalarini bosing

1-tajribadan olingan ikkita manipulyatsiyadan tashqari, TWO va THREE sharoitlarida biz ikkinchidan oxirgi fe’l iborasini qo‘shimcha ravishda o‘zgartirdik: MUVOFIQ holatda birinchi ot ishonchli mavzu edi (masalan, “bemorni bezovta qildi”); MUQOSS bo‘lmagan holatda, u emas edi (masalan, “bemorni davolagan”). MUVOFIQ holatda “the report by...” kabi noveridikal versiyalar yuqoriroq apriori ehtimollikka ega bo‘lib, oxirgi fe’lni bashorat qilishlari kerak. kamroq aniq. Biz 42 ta rag'batlantiruvchi elementni yaratdik.

3B-rasmda ushbu elementlar uchun resurs-ratsional model va oldingi nazariyalardan bashorat qilingan. 1-tajribadan olingan effektlarga qo'shimcha ravishda, model MUVOFIQ holatda, ayniqsa, UCHTA ichida yuqori qiyinchilikni bashorat qiladi. Ajablanadigan nazariya ham, DLT ham muvofiqlikning hech qanday ta'sirini bashorat qilmaydi.

Biz 200 ta ishtirokchidan oʻqish vaqti haqidagi maʼlumotlarni yigʻdik, jumladan, IKKI va UCHTA shartlarda ham MOʻYoSH va MUVOFIQ boʻlmagan variantlar. Boshqa barcha jihatlarda tajriba va ma'lumotlar tahlili 1-tajriba bilan bir xil edi. O'qish vaqtlari 3B-rasmda ko'rsatilgan.

1-tajriba natijalari takrorlandi: Birinchidan, o'qish vaqtlari IKKIDA (=0.29, 95% CrI [0.24, 0.35], P( < 0) ​​< 0.0001; dastlabki oʻqish vaqtlari: 337 ms, 95% CrI [267, 411] ms).

Ikkinchidan, o'rnatish tarafkashligi va "o'sha"-bandining mavjudligi o'rtasida o'zaro ta'sir bor edi (=−0.06, 95% CrI [−0.1{ {9}}, −0,024],P( > 0)=0.0007). 1-tajribada bo'lgani kabi, o'rnatish ta'sirining ta'siri BIR shartda ijobiy bo'ldi ("fakt" va "hisobot" o'rtasidagi farq: 193 ms, 95% CrI [37, 357] ms), IKKI va UCHTA shartlar bo'yicha manfiy (farq " fakt" va "hisobot": −105 ms, 95% CrI [−194, −18]ms).

Uchinchidan, model bashoratlariga muvofiq, MUVOFIQ holatda o‘qish vaqtlari MUVOFIQ shartga qaraganda yuqoriroq bo‘lgan ( {0}}.083, 95% CrI [0.031, 0,136 ],P( < 0)=0.0014; xom oʻqish vaqtlarida taʼsir: 96 ms, 95% CrI[36, 156] ms). Qo'shimcha tahlillar uchun SI ilovasining S3 bo'limiga qarang.

E'tibor bering, o'rnatish tarafkashligi va moslik ta'siri IKKI shartga qaraganda UCHTA shartda son jihatdan kattaroqdir; meta-tahlil shuni ko'rsatadiki, bu farqlar o'qish vaqtlarida ham, model parametrlari maydonining qismlarida ham statistik ma'noga ega (SI ilovasi, S2.1 va S6.6 bo'limlari).

MUVOFIQ va MOQSIZLIK o'rtasidagi o'rnatish moyilligining nishabidagi raqamli farqlar statistik ma'noga ega emas edi (SI ilovasi, S23-rasm) va ikkita eksperiment o'rtasidagi model bashoratlarining kesishishidagi raqamli farqlar (SI Ilovasi, S6-rasm).

Oldingi o'qish vaqtini o'rganish natijalarini birlashtirish uchun SI ilovasining S6 bo'limiga qarang (jami n=501). Ikkita reyting tadqiqotida (jami n=335; SI ilovasi, S5 bo'limi) tushunmovchilikni kiritishning ta'sirini yana takrorladik.

Tajriba 3: Ishlab chiqarishni o'rganish

Hozircha biz o'qish vaqtlari bo'yicha model bashoratlarini tasdiqladik. O'qish vaqtlari bo'yicha o'lchanadigan qiyinchilik odamlarning kutganlari buzilganligini ko'rsatadi, lekin insoniy kutishlar nima ekanligini bevosita bildirmaydi.

Insoniy kutishlarning ikkinchi sinovini ta'minlash uchun biz ishlab chiqarish paradigmasiga murojaat qildik - Cloze tugallanishi (40,41) - bu muqaddimadan keyin darhol kutilayotgan so'zlarni baholash uchun til tadqiqotlarida ishlatilgan. Biz bu usuldan ko'p qavatli tuzilmalarning murakkabligini baholash va murakkab muqaddimadan keyin odamlar qancha fe'l kutishini o'lchash uchun foydalanamiz.*

Biz ishtirokchilardan “The report that the doctor who the diplomat...” shaklidagi kontekstlarni toʻliq jumlaga toʻldirishlarini soʻradik. hayratlanarli" yoki kamroq fe'llar bilan grammatik bo'lmagan versiyalar, masalan, "...ishonchsiz edi hayratlanarli". Resurs-ratsional lossy-consurprisal prognoziga ko'ra, bunday grammatik bo'lmagan to'ldirishlar darajasi yuqori bo'lgan ismlar uchun past bo'lishi kerak (masalan, "fakt"), chunki bu nomukammal xotira tasvirlaridan haqiqiy kontekstni tiklashni osonlashtiradi (4A-rasm). Mavjud kutish va xotiraga asoslangan modellar grammatik to'ldirish tezligi o'rnatish tarafkashligiga bog'liqligini bashorat qilmaydi.

improve cognitive function

Biz 80 ishtirokchini jalb qildik. 4-rasmda to'liq bo'lmagan tugallanishlar tezligi (uchtadan kam fe'l) ko'rsatilgan. Bashorat qilinganidek, grammatik bo'lmagan javoblar tezligiga o'rnatishning ta'siri bor edi (=−0.32, 95% CrI[−0.60, −0,05 ], P( > 0)=0.0123) sinovdan-sinovda logistika aralash effektlar tahlilida.

Biz ushbu tadqiqotni yana ikkita tilda (ispan va nemis), shu jumladan bitta (nemis) tilda takrorladik, bu erda markazga joylashtirish qiyinligi ingliz tiliga qaraganda ancha zaifdir (42).

ways to improve your memory

Ispan tilida biz bir vaqtning o'zida boshqa sintaktik konfiguratsiyaga umumlashtirishni sinovdan o'tkazgan holda, kamroq tabiiy mavzu-boshlang'ich ob'ekt nisbiy bo'laklaridan qochish uchun mavzu nisbiy bo'laklarini (el hechode que el director que, "rejissyor kim") maqsad qilib oldik. Nemis tilida biz o'rnatilgan tuzilmalarni (masalan, Klaus hat erzahlt, ¨dass die Behauptung, dass der Student, den der Professor, "Klaus aytdiki, talaba professor bo'ladi"), chunki ular qiyinchilikni yaqinroq darajaga ko'tarishi ma'lum. Ingliz tili (35).

Biz har bir tilda 60 ishtirokchini jalb qildik. Ikkala tilda ham kiritish tezligining ta'siri salbiy deb baholandi, taxminiy ta'sir o'lchamlari ingliz tilidagi natija bilan solishtirilsa (ispancha:=−0.23, 95% CrI [−{{7] }}.34, −0.12], P( > 0)< 0.0003; German: β = −0.28, 95% CrI [−0.56, −0.03], P(β > 0) = 0.01738). These results suggest that the-previously undocumented-effect of embedding bias on human expectations holds across different languages, even when they vary in the overall difficulty of center embeddings.

Munozara

Biz zamonaviy mashinani o'rganish usullaridan foydalangan holda o'zboshimchalik bilan kiritishgacha o'lchagan resurs-ratsional bashorat sifatida inson tilini qayta ishlash modelini taqdim etdik. Inson sintaktik qayta ishlash bo'yicha xotira va kutishga asoslangan istiqbollarni uyg'unlashtirishga qaratilgan ushbu model nafaqat to'g'ri bo'lgan o'sha ustuvor nazariyalarning bashoratlarini tiklaydi, balki xotira cheklovlari va ehtimollik taxminlari o'rtasidagi ilgari hujjatlashtirilmagan o'zaro ta'sirlarni bashorat qiladi, biz buni insonning rekursivni qayta ishlash jarayonini tekshirgan uchta xatti-harakatlar tajribasida tasdiqladik. tuzilmalar.

Bizning natijalarimiz shuni ko'rsatadiki, mavjud xotiraga asoslangan modellarning (5, 7, 36) negizi bo'lgan uzoq lingvistik bog'liqliklarni integratsiya qilishning yaxshi hujjatlashtirilgan qiyinligi ehtimollik taxminlari bilan sezilarli darajada modulyatsiyalangan: BIR va UCHTA shartlar o'rtasidagi taqqoslash shuni ko'rsatadiki, bunday Mahalliy bo'lmagan sintaktik tuzilma yuqori apriori ehtimolga ega bo'lsa, mahalliylik effektlari zaiflashishi yoki hatto bekor qilinishi mumkin, bu bashorat tabiiy ravishda biz taklif qilayotgan xotira va kutishga asoslangan istiqbollarni birlashtirishdan kelib chiqadi.

Bizning ishimiz psixolingvistik adabiyotdan olingan effektlarning uchta mashhur oilasini bitta tajribada va bitta modelda hujjatlashtiradi: mahalliylik effektlari (uchta qiyinchilikning kuchayishi), bashorat qilish effektlari (BIR shartda joylashtirish ta'siri) va semantik interferentsiya effektlari (semantik muvofiqlik ta'siri). ).

Ushbu oilaviy ta'sirlarni yagona nazariy davolashga katta qiziqish bor edi; Bizning ishimiz bitta model qanday qilib o'zaro ta'sir qilishini, batafsil tavsiflashi mumkinligini ko'rsatadi. Tajribalarimiz maqsad qilib qo'ymagan hodisalarning bir guruhi o'xshashlikka asoslangan aralashuvdir (43, 44). Ushbu modellashtirish ramkasi bilan ham hisobga olinishi mumkinmi yoki yo'qligini tekshirish kelajakdagi tadqiqotlar uchun qiziqarli muammodir.

Bizning resurs-ratsional modelimiz rasmiy ravishda o'zgarmas domenlar modellari bilan bog'liq. Klassik ish shuni ko'rsatdiki, saqlanish ehtimolini oqilona tahlil qilish inson xotirasining asosiy xususiyatlarini hisobga olishi mumkin (28, 29). Oxirgi ishlar (45-48) ba'zi sohalarda inson xotirasining ratsional modellarini rasmiylashtirdi, masalan, vizual ish xotirasi, tezlikni buzish nazariyasi, resurs cheklovlari ostida yuqori aniqlikdagi kodlashlarni keltirib chiqaradigan axborot-nazariy asos.

Tezlik-buzilish nazariyasi va bizning modelimiz o'rtasidagi asosiy farq shundaki, iqtisod o'lchovi bu erda mavjud bo'lgan so'zlarning ulushidir, bu esa tezlikni buzish nazariyasida kodlangan bitlar sonidir. Jumlani tushunishda qo'llaniladigan tezlik-buzilish nazariyasi o'tmishdagi kontekstning to'liq siqilgan "ma'nosi" tasviriga olib keladi. Bunday to'liq siqilgan tasvirlar bizning tajribalarimizda kuzatilgan qiyinchilik naqshlariga olib kelmaydi (batafsil ma'lumot uchun SI ilovasi, S8 bo'limiga qarang).

Boshqa tomondan, bizning modelimiz soddalashtirishdir, chunki u so'nggi kontekstni so'zlar ketma-ketligi sifatida modellashtiradi, bunda alohida so'zlar unutilgan, ammo ma'no xotirasi saqlanib qoladigan uzoqroq kontekstning xotira tasvirlari rolini kam baholaydi. Mashinadagi keyingi yutuqlar o'rganish resursni oqilona optimallashtirishdan xotira tasvirlarining yanada murakkab formatini chiqarishga imkon berishi mumkin.

Kompyuter fanida rekursiv tuzilma odatda stekga asoslangan ma'lumotlar tuzilmalari yordamida qayta ishlanadi. Shunga mos ravishda, inson sintaktik qayta ishlashning dastlabki modellari stek hajmi yoki bir vaqtning o'zida xotirada saqlanishi mumkin bo'lgan tugunlar soni bilan chegaralangan (2, 24).

Bunday modellar chuqurroq joylashtirishni qiyinroq deb taxmin qiladilar, ammo bu qiyinchilik statistik yoki semantik belgilar bilan modulyatsiya qilinishini bashorat qilmaydi. Stekga asoslangan arxitekturadan farqli o'laroq, bizning nazariyamiz rekursiv tuzilmani o'rnatishda ehtimollik belgilariga katta rol o'ynaydi. Shu nuqtai nazardan, u odamlar steklar kabi ma'lumotlar tuzilmalarini saqlamaydilar va buning o'rniga assotsiativ belgilarga asoslangan qidirishdan foydalangan holda sintaktik tuzilmalarni o'rnatadilar (5, 7, 49, 50). Assotsiativ qidiruv modellari. Hozirgi vaqtda amalga oshirilganidek (7) bizning modelimiz tomonidan bashorat qilingan va tajribalarimizda kuzatilgan o'ziga xos qiyinchilik naqshlarini hisobga olmaydi. Shunga qaramay, biz o'z nazariyamizni ushbu adabiyotdagi g'oyalarga mos deb bilamiz.

Bizning nazariyamiz bashoratlarni mavjud xotiraga asoslangan modellarga mos keladigan hisoblash darajasidagi modelni taqdim etadi, ammo bu modellardan farqli o'laroq, tilning boy statistik tuzilishiga oqilona moslashtirilgan bo'lib, xotira cheklovlari ehtimollik taxminlari bilan qanday o'zaro ta'sir qilishini taxmin qilish imkonini beradi. Bizning natijalarimiz shuni ko'rsatadiki, assotsiativ qidiruv modellarining ehtimolli versiyalarini aniqlash, bu erda tasvirlangan resurs-ratsional modelning algoritmik darajasida amalga oshirilishi psixolingvistik tadqiqotlar uchun qiziqarli muammodir. Qayta tiklashga asoslangan xotira modellari uchun natijalarimizning ta'siri haqida ko'proq bilish uchun SI ilovasining S7.2 bo'limiga qarang.

Biz taklif qilayotgan kutish va xotiraga asoslangan modellarni birlashtirish, nomukammal ishchi xotira tasvirlari til statistikasi bilimlaridan baʼzan notoʻgʻri foydalanish bilan ham oqilona qayta tiklanadi degan gʻoyaga asoslanadi. masalan, 51–55-raqamlar) uzoq muddatli xotiradan olingan bilimlar yordamida buzilgan qisqa muddatli xotirani tiklaydigan jarayon. Bu so'zlar ro'yxati uchun xotiraga (masalan, 52-55-raqamlar) va yaqinda sintaktik naqshlar xotirasiga qo'llanilgan (56). Bizning modelimiz resurslarning ratsionalligi bilan cheklangan Bayes xulosasiga asoslangan bunday jarayonlarning hisobini taqdim etadi. Ishchi xotira xotiraning o'ziga xos komponenti sifatida emas, balki qayta ishlash va uzoq muddatli xotiraning o'zaro ta'siridan kelib chiqadigan model sifatida ham ko'rib chiqiladigan modellar mavjud (57, 58). Bunday modellar uchun bizning natijalarimiz uzoq muddatli bilimlar qayta ishlashni qanday ma'lum qilishiga oid ma'lumotlarni taqdim etadi. .

Bizning tajribalarimiz ehtimollik taxminlarining xotira cheklovlari bilan qanday o'zaro ta'sirini tekshirish uchun sintaktik tuzilmalarning statistik korrelyatsiyalaridan foydalanadi. Bu oldingi ishda kutishga asoslangan modellarda ba'zi o'xshashliklarga ega bo'lib, ular animatsiya va nisbiy band turi o'rtasidagi korrelyatsiyani, mavjud xotiraga asoslangan hisoblar tomonidan hisobga olinmaydigan usullarda ta'sirni qayta ishlashni ko'rsatdi (masalan, 59–61-sonli havolalar). Bizning ishimiz xotira cheklovlari va ehtimollik kutish o'rtasidagi o'zaro ta'sirning amalga oshirilgan nazariyasini ifodalash orqali ushbu ish yo'nalishini kengaytiradi.

Bizning modelimiz bepul d parametriga ega, o'rtacha saqlangan so'zlar soni. Biz bashorat qilishda va ularni odamlarning o'qish vaqtlari bilan taqqoslashda yagona qiymatni qabul qildik. Uni individual sub'ektlar uchun moslashtirish va uning individual farqlarning belgilangan o'lchovlari bilan aloqasini tushunish kelajakdagi tadqiqotlar uchun qiziqarli muammodir.

Inson sintaktik qayta ishlashning konnektsionistik modellari (8, 62-64) neyron tarmoq tasvirlaridan kelib chiqadigan taxminlardan foydalangan holda insonning qayta ishlash jarayonini tasvirlashga qaratilgan va xotira cheklovlari va ehtimollik kutishlari bilan bog'liq tomodel effektlar taklif qilingan. Biroq, GPT-2 tomonidan hisoblangan oddiy syurpriz va resurs-ratsional yo'qotilgan kontekstdagi hayratlanarli o'rtasidagi farqlar, ulanish modellarida insonga o'xshash xotira cheklovlari avtomatik ravishda paydo bo'lishi shart emasligini ko'rsatadi.

Biz resurs-ratsional tilni qayta ishlash modelini tabiiy tilning boy statistik tuzilishiga qanday kengaytirish mumkinligini ko'rsatdik. Mashinani o'rganishga asoslangan usulimiz tabiiy inputstatistika va inson bilishining boshqa sohalarida murakkab ratsional modellarni o'rnatish uchun eshikni ochishi mumkin.

Bizning modelimizning umumiyligi shunga o'xshash hodisalar tildan tashqarida ham mavjud bo'lishi mumkinligini ko'rsatadi: Agar odamlar bir vaqtning o'zida barcha qismlari ishtirok etishi uchun juda murakkab bo'lgan ma'lumotlarni qayta ishlasa, qayta ishlashga o'xshash kirishlarning statistik tuzilishi ta'sir qilishi kerak.

improve brain

Materiallar va usullar

Otlar. Penn Treebank (65), English Web Treebank (66), AnCoRA Treebank (67) ispancha va HDT Treebank (68) nemis tilidan foydalanib, jumlali to‘ldiruvchini qabul qila oladigan otlarni to‘pladik. Inglizcha Vikipediya (2,3 milliard so‘z), nemischa Vikipediya (800 million so‘z) va ispancha Vikipediya (500 million so‘z) yordamida “NOUN”dan keyin “o‘sha” so‘zi paydo bo‘lishi ehtimolini taxmin qildik. Tafsilotlar uchun SI ilovasining S11 bo'limiga qarang. Biz inglizcha hisob-kitoblarni yana ikkita yirik amerikacha va ingliz ingliz tilidan foydalangan holda tasdiqladik (SI ilovasi, S10.1 bo'limi).

Model. Resurs-ratsional yo'qolgan-kontekst syurprizligi saqlanish ehtimoli th={qw, i: i, w} oilasi bilan belgilanadi, bu erda w so'zlarning diapazoni andi=1, ..., N, bu erda N=20 - ko‘rib chiqilgan maksimal kontekst uzunligi, tajribada paydo bo‘ladigan barcha kontekstlarni joylashtirish uchun yetarli uzunlikdir. Biz qw parametrini belgilaymiz, men saqlab qolish uchun o‘tgan so‘zning o‘ziga xosligi va oraliq so‘zlar sonini birlashtirgan neyron tarmoqdan foydalanaman. ehtimollik (SI ilovasi, S1.1 bo'limi). th modeli p(c|c) ehtimolini va shuning uchun posterior p(c|c) ni keltirib chiqaradi. Olingan keyingi keyingi so'z uchun o'rtacha keyingi so'zni minimallashtirish uchun tanlangan p(w|c):

improve working memory

O'qish vaqtini o'rganish uchun eksperimental sozlash. Barcha tadqiqotlar uchun eksperimental protokol Stenford universitetining institutsional tekshiruv kengashi tomonidan tasdiqlangan. Barcha ishtirokchilardan xabardor qilingan rozilik olindi.

Har bir ishtirokchiga 10 ta tanqidiy sinov taqdim etildi. Ikkala eksperimentda ikkita sinov BIR, to'rtta sinov esa IKKI va UCHTAdan bo'lgan. 2-tajribada, IKKI va UCHTA sinovlarning yarmi MUVOS (MOQSIZ) holatda edi. Vazifa davomida markazga joylashtirishga statistik moslashuvning har qanday ta'sirini kamaytirish uchun biz kam sonli muhim sinovlarni tanladik.

Statistik aniqlikni maksimal darajaga ko'tarish uchun biz o'rnatish tarafdorligi juda yuqori bo'lgan 15 ta otni va juda kam joylashish moyilligiga ega 15 ta otni tanladik (SI ilovasi, S36-rasm). Har bir ishtirokchi uchun biz yuqori o'rnatish tarafdori bo'lgan beshta ot va past qiymatga ega beshta otni tanladik va ularni 10 ta tanqidiy sinovga moslashtirdik. Har bir ishtirokchi uchun biz 56 ta toʻldirgichdan iborat boʻlgan 30 ta toʻldiruvchidan namuna oldik (42).

Taxminlarning buzilishi (masalan, "fakt noto'g'ri edi") tufayli semantik anomaliyalarni olib tashlash uchun biz otlarni olib keladigan (masalan, "fakt"), noaniq neytral (masalan, "da'vo") va noaniq salbiy (masalan, "da'vo") deb tasnifladik. ayblov") otlar va ushbu uchta sinfning har biriga muvofiqligi uchun tasniflangan narsalar (SI ilovasi, S11 bo'limi). Har bir ishtirokchi uchun biz 10 ta otni semantik jihatdan mos bo'lgan narsalarga moslashtirdik.

Labirint vazifasini bajarish uchun biz Gulordava tili modelidan (69) foydalanib, chalg‘ituvchilarni avtomatik ravishda yaratdik (39): bu chalg‘ituvchilar chastota va uzunlik bo‘yicha maqsadli so‘z bilan mos keladigan kontekst ehtimoli juda past. -2-tajribadagi (IN)COMPATIBLE sharoitida oxirgi fe'l ibora. Xususan, chalg'ituvchilar barcha shartlar bo'yicha tanqidiy so'zga mos keldi.

Ishtirokchilar xatoga yo'l qo'yganlarida (ya'ni chalg'ituvchini tanlaganlarida), ularga joriy so'zni qaytadan sinab ko'rish taklif qilindi (70). Bunday sinovlarda reaktsiya vaqtlari chiqarib tashlandi; bu tanlov xulosalarga ta'sir qilmadi (SI ilovasi, S3.6 bo'limi).

Har bir mavzu uchun sinovlar tasodifiy tartibda taqdim etildi, shunda ikkita tanqidiy sinov qo'shni bo'lmaydi. Prolific akademik platformasida ishga qabul qilingan ishtirokchilar o'rtacha 13 daqiqa vaqt olishdi va 2,20 funt sterling (≈3 USD) olishdi.

O'qish vaqtlari uchun ma'lumotlarni tahlil qilish. Biz sinovlarni 1) noto'g'ri javob bilan, 2) so'zlarning 20% ​​dan ko'prog'ida xato qilgan ishtirokchilardan va 3) barcha o'qish vaqtlarining 99% dan past yoki undan ko'pini chiqarib tashladik. 1-shartga chidamlilik uchun SI ilovasining S3.6-boʻlimiga qarang va 3-shartning mustahkamligi uchun SI ilovasining S3.7-boʻlimiga qarang. Keyin biz Stan-da (71) tatbiq etilgan yakuniy soʻzlashuvli Bayes aralash effektlari modellarida log-transformatsiya qilingan oʻqish vaqtlarini tahlil qildik. qo'llardan foydalanish (72). Oldingi tanlovlarning oldingi va mustahkamligi uchun SI ilovasining S3.3 bo'limiga qarang. Biz qarama-qarshilik sifatida "o'sha"-bandi (BIRga qarshi IKKI/UCH), chuqurlik (ikkiga qarshi IKKI/UCH) va moslik manipulyatsiyasi (MOYLASHMAS va MOQSIZLIK) mavjudligi bilan kontrast kodlashdan foydalandik. O'rnatish tarafkashligi markazlashtirildi va barcha vakuumsiz ikkilik o'zaro ta'sirlar sobit effektlar sifatida qo'shildi (SI ilovasi, S3.2 bo'limi).

Tasodifiy effektlar sifatida elementlar, otlar va ishtirokchilarni kiritish, eksperimental dizayn bilan oqlangan maksimal tasodifiy effektlar strukturasini kiritdik. Xom o'qish vaqtlari (millisekundlar) ta'sirini baholash uchun biz avval har ikkala holatda ham (masalan, MUVOS va MO'YSUS) o'qish vaqtini prognozlangan jurnalni hisoblab chiqdik, so'ngra ikkalasini ko'paytirish orqali millisekundlarga aylantirdik va farqni hisobladik (SI ilovasi, S3.4 bo'limiga qarang). batafsil ma'lumot uchun). 3-rasmda biz "fakt" yoki "hisobot" ga mos keladigan noto'g'ri ismlar uchun barcha sharoitlarda taxmin qilingan o'qish vaqtining orqa o'rtacha qiymatini chizamiz. Xato chiziqlari posterior SD ni ifodalaydi.

Ishlab chiqarishni o'rganish uchun tafsilotlar. Biz “Senator diplomat bo'lgan XXX” shaklidagi 28 ta elementni tuzdik va har birida juda yuqori yoki juda past bo'lgan 6 tadan 12 ta ot tanladik. Har bir ishtirokchi uchun biz tasodifiy elementlar va otlarni birlashtirdik. 12 ta tanqidiy sinov 27 ta plomba bilan tasodifiy tartibda taqdim etildi. Alingvist har bir to'ldirish uchun fe'l iboralarning to'g'ri soni (uchta) ishlab chiqarilganmi yoki yo'qligini qo'lda izohlab beradi. Annotator otning kimligini ko'r edi.

Ispan va nemis tillarida biz har bir ishtirokchi uchun 6 ta baland va 6 ta past oʻrinli nomlarni tanlab oldik. Ingliz tilidagi versiyada bo'lgani kabi, biz har bir ishtirokchi uchun 12 ta ism bilan tasodifiy 12 ta elementni moslashtirdik. To'ldiruvchilar ingliz tajribasidan tarjima qilingan.

Nemis tilida biz yana 12 ta matritsali jumlalar tuzdik (masalan, “Klaus shunday dedi”) va ularni tasodifiy ravishda har bir ishtirokchi uchun ob’ektlar va otlar bilan moslashtirdik. Biz Bayescha sinovdan-sinov logistik aralash effektlar tahlilini o‘tkazdik. , va otlar, elementlar, ishtirokchilar va (nemis tilida) matritsali jumlalarning tasodifiy ta'siri. Tafsilotlar uchun SI ilovasining S4 bo'limiga qarang.

Ma'lumotlar, materiallar va dasturiy ta'minot mavjudligi. O'rnatilgan saqlash ehtimoli va model bashoratlari Zenodo (https://zenodo.org/record/6602698) (73), (https://zenodo.org/record/6988696) (74) da saqlangan. Anonim o'qish vaqtlari, til ishlab chiqarish ma'lumotlari va manba kodi GitLab (https://gitlab.com/ m-hahn/resource-rational-surprisal) (75) da saqlangan.

MAQDAT. Biz qo'lyozmani yaxshilashga yordam bergan konstruktiv fikr-mulohazalari uchun muharrir va sharhlovchilarga minnatdorchilik bildiramiz. Shuningdek, biz Judit Degen, Tivalayo Eisape, Xailin Xao, Jennifer Xu, Den Jurafskiy, PengQian, Kori Sheyn, Shravan Vasishth, Tom Vasov, Ethan Uilkoks va 2020-yilgi CUNY konferentsiyasidagi tinglovchilarga foydali munozara va fikrlar uchun minnatdormiz.

improve memory


Malumot

1. N. Chomskiy, Sintaktik tuzilmalar (Mouton, Gaaga, 1957).

2. GA Miller, N. Chomsky, "Til foydalanuvchilarining so'nggi modellari" Matematik psixologiya qo'llanmasida, RD Luce, RR Bush, G. Galanter, Eds. (John Wiley, 1963), 269-321-betlar.

3. L. Frazier, Tabiiy tilni tahlil qilishda "Sintaktik murakkablik": Psixologik, hisoblash va nazariy istiqbollar, DR Dowty, L. Karttunen, AM Zwicky, Eds. (Kembrij universiteti nashriyoti, Nyu-York, 1985), 129–189-betlar.
4. E. Gibson, lingvistik murakkablik: sintaktik bog'liqliklarning joylashuvi. Idrok 68, 1–76 (1998).

5. B. Makelri, S. Foraker, L. Dayer, gapni tushunishga bo‘ysunuvchi xotira tuzilmalari.J. Mem.Lang. 48, 67–91 (2003).

6. W. Tabor, B. Galantucci, DC Richardson, Effects of only local sintaktic coherence on the jumlalarni qayta ishlash.J. Mem. Lang. 50, 355–370 (2004).

7. RL Lewis, S. Vasishth, malakali xotira olish sifatida jumlalarni qayta ishlashning faollashtirishga asoslangan modeli. Cogn. Sci. 29, 375–419 (2005).

8. MH Christiansen, MC MacDonald, Gaplarni qayta ishlashda rekursiyaga foydalanishga asoslangan yondashuv.Lang. O'rganing. 59, 126–161 (2009).

9. J. Hale, (2001) Hisoblash tilshunosligi assotsiatsiyasi Shimoliy Amerika bo'limining ikkinchi yig'ilishida "Psixolingvistik model sifatida probabilistik erta tahlilchi", NAACL 2001, L. Levin, K. Knight, Eds. (Hisoblash tilshunosligi assotsiatsiyasi, Stroudsburg, PA), 1-8-betlar.

10. R. Levi, Kutishga asoslangan sintaktik tushunish. Idrok 106, 1126–1177 (2008).

11. K. Rayner, AD Xo'sh, O'qishdagi ko'z harakatlariga kontekstli cheklovlarning ta'siri: Qo'shimcha tekshirish. Psixon. Buqa. Vahiy 3, 504–509 (1996).

12. A. Staub, Leksik bashoratlilikning o'qishda ko'z harakatlariga ta'siri: Tanqidiy sharh va nazariy sharh.Lang. Tilshunos. Kompas 9, 311–327 (2015).


For more information:1950477648nn@gmail.com



Sizga ham yoqishi mumkin