
„Tworzenie systemu poetyckiego: rozwój współczesnego polskiego języka poetyckiego (1795–1918)” – kwota dofinansowania: 545 340 zł.
Jej projekt łączy przetwarzanie języka naturalnego, lingwistykę korpusową i modelowanie ilościowe, traktując dziewiętnastowieczną poezję jako materiał do analizy komputerowej na dużą skalę.
Podstawą badań będzie cyfrowy korpus tekstów poetyckich, wzbogacony o ustrukturyzowane metadane i poddany anotacji morfosyntaktycznej dostosowanej do historycznej polszczyzny. W analizie wykorzystane zostaną metody stylometryczne, miary bogactwa i dyspersji leksykalnej oraz ilościowa analiza wersyfikacji, realizowane z użyciem narzędzi rozwijanych w CLARIN-PL (m.in. WebSty, LEM, CompCorp), a także autorskich procedur w R i Pythonie. Osobnym komponentem jest modelowanie relacyjne, integrujące cechy językowe z danymi historyczno-społecznymi.
Częścią projektu jest trzymiesięczny staż badawczy w Instytucie Literatury Czeskiej Czeskiej Akademii Nauk w Pradze, jednym z czołowych europejskich ośrodków komputerowej analizy wiersza. Efektem prac będą nie tylko publikacje naukowe, ale też otwarte, ponownie wykorzystywalne zasoby cyfrowe: korpus z metadanymi, udokumentowane skrypty analityczne i procedury zapewniające powtarzalność badań.
Projekt wpisuje się w profil Politechniki Wrocławskiej jako ośrodka technologii językowych i wzmacnia obecność uczelni w europejskiej sieci CLARIN ERIC.



