New AI-generated corpora! 🎂
AI Brown lets you compare AI vs. human-written English texts. AI Koditex does the same for Czech. Both have ~15 models from different companies, so you can also compare how different models write.
Czech National Corpus turns 30 today! Here are some pictures from its beginnings.
And don't forget to visit https://t.co/Rsi4HJT0oQ to grab a balloon while you can.
Our collaborative paper with @laura_janda, @FidlerMako et al. "The case for case in Putin's speeches" is out and available as OA. https://t.co/68XeugPOD8
You can ban the word "war" but you cannot control the grammar - that's the starting point of our analysis of Putin's pre-war speeches where we first applied the concept of keyness to Russian morphology (keymorph analysis).
Our latest OA paper with @FidlerMako on Czech desinfo portals is out in @scandoslavica: From News to Disinformation: Unpacking a Parasitic Discursive Practice of Czech Pro-Kremlin Media https://t.co/O9tzFWYFi6
@cestinavpraxi @lingvojazyce Pokud v kodifikaci nenacházíte něco, co je v jazyce dobře doloženo, je zjevně něco špatně s těmi příručkami, nikoli s jazykem. Váš výklad ale naznačuje opak.
Argumentovat tím, že mluvíte pouze o spis. češtině, je taky problematické, když spisovnost odvozujete pouze od kodifikace.
@cestinavpraxi @lingvojazyce Nepravdivé (prokazatelně) je třeba tvrzení, že druhak neexistuje. Existuje a je poměrně dostatečně doložené (https://t.co/yfRsXwdRtT). O tom, že hodnotit jazykové jevy na škále správně-špatně, nemá oporu v lingvistické teorii ani nemluvím.
Už nějaký čas se v lingv. komunitě mluví o tom, že celá řada věcí okolo spisovnosti, jazyk. správnosti atp., není výsledek vědeckého bádání, ale vlastně politickým rozhodnutím. Rozhodli jsme se proto s @lingvojazyce, že by bylo dobré prozkoumat, co si lingv. obec skutečně myslí.
Nevíme totiž, jestli jsme spíš konzervativní (jak si nás veřejnost často představuje, tedy jako strážce jazyka) či liberální (jenom se nám to nedaří lidem vysvětlit).
Pokud máte lingvistické vzdělání, pomůžete nám s tím a vyplníte dotazník? https://t.co/9IlwK1lo2n
Profi lingvistky a lingvisti, chceme s @CvrcekV vědět, co si my všichni myslíme o jazykové politice, regulaci, uplatňování a tvorbě kodifikace, o bysme a dalších kruciálních věcech všehomíra.
Do konce února, upřímně prosíme, vyplňte dotazník: https://t.co/p9ZC5pfNLq
Děkujeme 🦣
Our latest MDA paper in @RegisterStudies is out.
If you plan to elicit texts for your research don't forget to check which scenario gives the most or least leeway to the participants to express what you really want to examine.
https://t.co/suno7t14A0
#OTD 166 years ago, Ferdinand de Saussure (1857-1913) was born 🎂 One of the central figures of modern linguistics and structuralist thinking, semiotician, expert on Indo-European historical linguistics who formulated the so-called Laryngeal Theory.
#LinguisticBirthdays#Histlx
We have just released a new version of the KWords app (https://t.co/iIE80bMfpQ), which can analyse texts from 35+ languages, find prominent word forms/lemmas, and has a new function for keymorph analysis. All this using our parallel corpus InterCorp.
Už za dva týdny (25. 11.) se bude konat další z korpusových workshopů! Tentokrát bude zaměřen na využití korpusů ve výuce. Nemusíte mít žádné předchozí zkušenosti s prací s korpusem.
Přihlásit se můžete zde: https://t.co/CGaxMcFTcz
Víte, co je HiČKok? Jde o první pokus vytvořit jeden jednotně značkovaný korpus pokrývající celé vývojové kontinuum češtiny od 13. století po současnost. Pracujeme na projektu za přispění @TACR_cz spolu s ÚJČ AV ČR, @narodniknihovna a @ufal_cuni. Více na https://t.co/Zamq1cxuwo
The new version (16) of InterCorp is out! The number of words in all languages and text types has tripled from 1.8 bln to 5.3 bln. 20 new languages were added to Subtitles and thus to the corpus as a whole - the corpus now contains 62 languages (including Czech).