Nyhetstexter från svt.se Sammanfattning Resurstyp Corpus Språk svenska Tokens 16 025 766 Sentences 1 043 497 Ladda ned svt-2020.xml.bz2 corpus (XML) scrambled licens: CC BY 4.0 (attribution) stats_svt-2020.csv token frequencies (CSV) licens: CC BY 4.0 (attribution)