sorodni izrazi in sinonimi v sodobni slovenščini, hrvaščini in srbščini
Podobnost besed in fraz med rezultati je odvisna od tega, kolikokrat se beseda ali fraza pojavi v podobnem stavčnem kontekstu kot "besedilnem korpusu".
Kliknite za poizvedbo
Širši sorodni izrazi
Izrazi, ki navajajo besedilnem korpusu med svojimi sorodnimi izrazi, a jih seznam zgoraj ne doseže. Njihova podobnost je nižja od podobnosti zadnjega izraza nad njimi.
Primeri iz korpusa
Korpus Common Crawl
Common Crawl je korpus spletnih strani
V poglavju bo predstavljena pogostost rabe v anketo vključenih frazemov v besedilnem korpusu.
V obsežnem besedilnem korpusu se lahko najpogostejše besede, npr.
Poleg tega bi diskretna porazdelitev, ocenjena na danem učnem besedilnem korpusu, številnim zaporedjem iz testne množice neupravičeno dodelila ničelno verjetnost.
Iskanje skupne diskretne porazdelitve zaporedij besed je v obsežnem besedilnem korpusu zelo težka naloga.
V pravilih podobnega primera ne najdem , v besedilnem korpusu prevladuje cornwallski .
Avtomatsko luščenje kolokacij temelji predvsem na izračunu statističnih sopojavitev besed v besedilnem korpusu , vsi tako izluščeni kandidati pa niso ustrezni .
Model s 3-grami smo naučili na besedilnem korpusu ccGigafida, modele z nevronskimi mrežami pa na besedilnem korpusu ccKres.
Izraz pri iskanju po besedilnem korpusu je lahko dolg do 100 znakov , naenkrat pa bo izpisanih do 1000 pojavitev .
Pri sestavljanju Slovarja novejšega besedja slovenskega jezika smo se načelno držali usmeritve , da se mora beseda v besedilnem korpusu pojavljati najmanj desetkrat .
Gradivo , dostopno na spletu in v besedilnem korpusu Gigafida , pa izkazuje nekoliko pogostejšo rabo terminov iz besedne družine spajkanje kot lotanje .
AWS Comprehend avtomatsko uredi besedilne dokumente po temi, tako omogoča uporabniku boljše iskanje in navigacijo po besedilnem korpusu.
V besedilnem korpusu Gigafida se v večini primerov piše z malo začetnico , je pa tudi z veliko .
V besedilnem korpusu Gigafida ni težko najti zanimivega in bogatega nabora besednih zvez s pridevnikom personaliziran .
Na grafu si lahko ogledate podatke o pogostosti pojavljanja svojilnega pridevnika Shakespearov v besedilnem korpusu .
Soobstoj istih dvojnic opažamo tudi danes : v besedilnem korpusu Gigafida se igumen pojavi sedemkrat , iguman pa 30 - krat .
Tudi v besedilnem korpusu FIDAplus najdemo iztržke iz leposlovja , nekaj tudi iz opisa krajev .
Metoda Count izraze vrednoti glede na absolutno število njihovih pojavitev v besedilnem korpusu.
V besedilnem korpusu FidaPLUS kar devetkrat najdemo besedo dabest v treh različnih virih .
Rabo slovenskega besedja lahko brez predhodne prijave preverjamo v Jakopinovem 48 mio obsežnem besedilnem korpusu na .
Tako pisana je tudi prevladujoča v gradivu , npr. v besedilnem korpusu Gigafida .