1 |
Slovenščina 2.0: Language Technologies and Digital Humanities
|
|
|
|
In: Slovenščina 2.0: Empirične, aplikativne in interdisciplinarne raziskave, Vol 9, Iss 1 (2021) (2021)
|
|
BASE
|
|
Show details
|
|
2 |
Citiranje jezikovnih podatkov v slovenskih znanstvenih objavah v obdobju 2013–2019
|
|
|
|
In: Slovenščina 2.0: Empirične, aplikativne in interdisciplinarne raziskave, Vol 8, Iss 1 (2020) (2020)
|
|
BASE
|
|
Show details
|
|
3 |
JANES v0.4: Korpus slovenskih spletnih uporabniških vsebin
|
|
|
|
In: Slovenščina 2.0: Empirične, aplikativne in interdisciplinarne raziskave, Vol 4, Iss 2 (2016) (2016)
|
|
BASE
|
|
Show details
|
|
4 |
JANES v0.4: Corpus of Slovene User-Generated Content
|
|
|
|
In: Slovenščina 2.0: Empirične, aplikativne in interdisciplinarne raziskave, Vol 4, Iss 2, Pp 67-99 (2016) (2016)
|
|
BASE
|
|
Show details
|
|
5 |
Omogočanje dostopa do korpusov slovenskih spletnih besedil v luči pravnih omejitev
|
|
|
|
In: Slovenščina 2.0: Empirične, aplikativne in interdisciplinarne raziskave, Vol 4, Iss 2 (2016) (2016)
|
|
Abstract:
Spletna besedila postajajo vse bolj relevanten vir informacij, korpuse tovrstnih besedil pa potrebujemo pri korpusnojezikoslovnih raziskavah in razvoju jezikovnih tehnologij za sodobno slovenščino. Čeprav so spletna besedila neposredno dostopna in je njihov zajem preprostejši od tiskanih, je izdelava takšnih korpusov še vedno zapletena, draga in zamudna. Ključno je, da poskrbimo, da se podobni podatki ne zbirajo večkrat, zato je nujno omogočiti njihovo čim večjo dostopnost čim širši raziskovalni skupnosti in zainteresirani javnosti. Tehničnih in prostorskih ovir za to sicer ni, vendar pri gradnji korpusa naletimo na številne omejitve v okviru zaščite avtorskih pravic, varstva osebnih podatkov in pogojev uporabe ponudnikov spletnih storitev. V prispevku predstavljamo pravno in dejansko stanje na teh področjih, opravimo pregled sorodnih tujih in domačih praks ter na primeru korpusa spletne slovenščine Janes predlagamo vrsto ukrepov, ki do največje možne mere omogočajo prosto in odprto razširjanje korpusov spletne slovenščine.
|
|
Keyword:
avtorske pravice; diseminacija korpusov; P1-1091; Philology. Linguistics; prosti in odprti dostop; spletna besedila; varstvo osebnih podatkov
|
|
URL: https://doaj.org/article/0af5bc0e93fd49e9ab3325fc4e14505c https://doi.org/10.4312/slo2.0.2016.2.189-219
|
|
BASE
|
|
Hide details
|
|
6 |
sloWCrowd: A crowdsourcing tool for lexicographic tasks
|
|
|
|
In: http://www.lrec-conf.org/proceedings/lrec2014/pdf/1106_Paper.pdf
|
|
BASE
|
|
Show details
|
|
7 |
Department of Knowledge Technologies
|
|
|
|
In: http://nl.ijs.si/et/Bib/LREC06/lrec06-slownet-150.pdf
|
|
BASE
|
|
Show details
|
|
8 |
Lexicon construction and corpus annotation of historical language with the CoBaLT editor
|
|
|
|
In: http://www.aclweb.org/anthology/W/W12/W12-1001.pdf
|
|
BASE
|
|
Show details
|
|
9 |
Department of Knowledge Technologies
|
|
|
|
In: http://lojze.lugos.si/~darja/papers/gwa06-slownet.pdf
|
|
BASE
|
|
Show details
|
|
|
|