Новости НКРЯ
Национальному корпусу русского языка – 20 лет!
29 апреля 2004 года сайт Корпуса был открыт для свободного доступа. Но работы по созданию НКРЯ начались значительно раньше, еще в 2000 году. Символично, что официальным «днем рождения» Корпуса стало именно 29 апреля – день рождения российского лингвиста, автора Грамматического словаря русского языка А. А. Зализняка (1935-2017).
Всё началось с идеи создать полное собрание текстов, которые были бы показательными с культурной точки зрения и отражали бы разнообразие прозы, написанной в период с 1965 по 2000 год. Сейчас НКРЯ – это 49 корпусов общим объемом более двух миллиардов слов. За 20 лет Корпус стал незаменимым инструментом для лингвистов, преподавателей, студентов и всех, кто интересуется русским языком.
Поздравляем создателей проекта и тех, кто помогает ему развиваться! Благодаря вам НКРЯ продолжает расти и совершенствоваться, предоставляя новые возможности для изучения русского языка.
Для тех, кому интересно узнать больше об истории и современных возможностях Корпуса, мы подготовили подборку материалов:
- Посмотрите, как выглядел сайт Корпуса 20 лет назад, в Музее НКРЯ.
- Погрузитесь в историю создания Корпуса «из первых уст» в специальном проекте «Большого города».
- Ознакомьтесь с Руководством пользователя и узнайте, как использовать корпус для разных задач.
- Изучите публикации о Корпусе в недавно обновленном разделе. Рекомендуем обратить внимание на свежую публикацию в журнале «Вопросы языкознания» о фундаментальной реконструкции и модернизации платформы НКРЯ.
- Скачайте и примените для собственных задач нейросетевые модели, которые используются для разметки слов и текстов Корпуса.
- Узнайте, как получить офлайновую версию Корпуса для исследований.
Тех, кто хочет принимать участие в развитии корпуса, приглашаем вступить в группу «Друзья НейроКРЯ». Вы будете первыми узнавать о готовящихся проектах и сможете принимать в них участие. Недавно мы запустили новый эксперимент, чтобы выяснить, какие определения слов лучше воспринимаются пользователями: взятые из словарей или сгенерированные нейросетью.