Andrew Krizhanovsky + RusVectores-website  almost 8 years ago

Commit id: 6300442c8aaa7f21716d45d3d5e9c0f054c55bc3

deletions | additions      

       

\section{Эксперименты}  В этой работе используются нейронные модели, созданные авторами проекта $RusVectores$~\cite{Kutuzov_Andreev_2015}. А именно: модель, построенная по текстам Национального корпуса русского языка (НКРЯ или Ruscoprora), и модель, созданная на основе текстов отечественных новостных сайтов (Новостной корпус или News corpus). Модели доступны на сайте проекта $RusVectores$~\cite{Kutuzov_Andreev_2015}. $RusVectores$~\cite{RusVectores-website}.  Авторы $RusVectores$ А.~Кутузов и Е.~Кузьменко обращают внимание читателя на такие особенности НКРЯ,   как ручной отбор текстов для пополнения корпуса и регулирование соотношения объема текстов разных жанров, малый размер основного корпуса, порядка 107 млн слов (для сравнения Новостной корпус включает 2.4 млрд токенов).