Eteneminen omalla vastuulla
Lähdekriittinen laskennallinen näkökulma sähköisiin kansanrunoaineistoihin
DOI:
https://doi.org/10.30666/elore.126008Nyckelord:
kansanrunous, digitaaliset ihmistieteet, arkistot, aineistot, metadata, itämerensuomalaiset kielet, runonlauluAbstract
Historiallisista, Suomen ja Viron kansallisvaltioiden syntyyn liittyvistä syistä johtuen itämerensuomalaista runolaulua (viroksi regilaul) eli niin kutsuttua kalevalamittaista kansanrunoutta on tallennettu, arkistoitu, järjestetty ja digitoitukin poikkeuksellisen paljon. Virolaisessa ERAB-korpuksessa ja suomalaisissa SKVR- ja JR-korpuksissa on tällä hetkellä 283 206 pääosin runolauluun liittyvää tekstiä viron (sis. seto), karjalan, lyydin, inkeroisen, vatjan ja suomen kielillä.
Tässä artikkelissa analysoimme näiden korpusten määrällisiä perusominaisuuksia. Luomme ensin yleiskuvaa aineistojen järjestely- ja digitointihistoriasta ja kerromme, miten olemme FILTER-hankkeessa käsitelleet sähköisiä korpuksia. Sitten tarkastelemme aineiston ja tallennushistorian luonteeseen liittyviä määrällisiä perusominaisuuksia ja lopuksi työn aikana paljastuneita aineiston ja sen metatietojen ongelmakohtia, joista on hyvä olla tietoinen myös laadullista tutkimusta tehtäessä.
Itämerensuomalaisen runolaulun sähköisessä muodossa oleva lähdeaineisto ei ole tasaista, kaikilta osiltaan systemaattista tai kattavaa, ja siinä on yllättäviäkin historian eri vaiheissa syntyneitä painotuksia ja ongelmia. Monet näistä ovat tiedossa aiemman tutkimuksen pohjalta, mutta laskennalliset menetelmät luovat aineistoon myös uusia näkökulmia. Samaan aikaan aineiston ongelmat vääristävät helposti erilaisia laskentoja, visualisointeja ja tulkintoja. Onkin tärkeää, että tutkijat myös sähköisiä välineitä käyttäessään lukevat yksittäisiä tekstejä, suhtautuvat aineiston metatietoihin varauksella ja osaavat tarvittaessa hakeutua alkuperäisten muistiinpanojen tai laajemman arkistoaineiston pariin.
##submission.downloads##
Publicerad
Referera så här
Nummer
Sektion
Licens
Tidskriften följer den så kallade "diamantmodellen" för öppen publicering: tidskriften tar inte ut några avgifter från författarna, och de publicerade texterna är omedelbart fritt tillgängliga på vetenskapstidskrifternas Journal.fi-plattform. Genom att skicka in en artikel till Elore för publicering godkänner författaren från och med september 2024 att verket publiceras under licensen CC BY 4.0. Enligt licensen får andra kopiera, sprida, distribuera och visa det upphovsrättsskyddade verket och eventuella bearbetade versioner av det, under förutsättning att de anger licensen, den ursprungliga publikationen (länk eller referens) och författaren som originalupphovsperson. Alla gjorda ändringar måste anges.
Upphovsrätten till texterna förblir hos författarna, och parallellpublicering är tillåtet. Detta gäller även texter som publicerats före september 2024. Publiceringsinformationen från Elore ska synas i parallellpubliceringen.
Användningslicensen för metadata till publicerade artiklar är Creative Commons CC0 1.0 Universal.