Открытый корпус вепсского и карельского языков

Обложка

Цитировать

Полный текст

Открытый доступ Открытый доступ
Доступ закрыт Доступ предоставлен
Доступ закрыт Только для подписчиков

Аннотация

C целью сохранения и системного изучения вепсского и карельского языков сотрудники Института языка, литературы и истории КарНЦ РАН и Института прикладных математических исследований КарНЦ РАН создали и продолжают совершенствовать языковой корпус ВепКар. Проект нацелен на накопление письменных текстов на карельском и вепсском языках, фиксацию и сбережение устной речи, исследование прибалтийско-финских языков Карелии, редактирование норм новописьменных вариантов языков, создание обучающих приложений. Любой желающий может пользоваться ВепКаром как электронной библиотекой и полноценным электронным словарём, что делает этот ресурс весьма востребованным.

Полный текст

Доступ закрыт

Об авторах

Ирма Ивановна Муллонен

Институт языка, литературы и истории Карельского научного центра РАН

Автор, ответственный за переписку.
Email: irma.mullonen@hotmail.com

член-корреспондент РАН, главный научный сотрудник сектора языкознания

Россия, Петрозаводск

Ирина Петровна Новак

Институт языка, литературы и истории Карельского научного центра РАН

Email: bel.irina@rambler.ru

кандидат филологических наук, директор

Россия, Петрозаводск

Список литературы

  1. Открытый корпус вепсского и карельского языков. http://dictorpus.krc.karelia.ru/ru
  2. Корпус вепсского языка. http://vepsian.krc.karelia.ru/about/
  3. Коряков Ю.Б., Давидюк Т.И., Харитонов В.С. и др. Список языков России и статусы их витальности. Монография-препринт. М.: Институт языкознания РАН, 2022.
  4. Итоги Всероссийской переписи населения 2020 г. Т. 5. Табл. 1. Национальный состав населения. https://view.officeapps.live.com/op/view.aspx?src=https%3A%2F%2Frosstat.gov.ru%2Fstorage%2Fmediabank%2FTom5_tab1_VPN-2020.xlsx&wdOrigin=BROWSELINK
  5. Итоги Всероссийской переписи населения 2020 г. Т. 5. Табл. 4. Владение языками и использование языков населением. https://view.officeapps.live.com/op/view.aspx?src=https%3A%2F%2Frosstat.gov.ru%2Fstorage%2Fmediabank%2FTom5_tab4_VPN-2020.xlsx&wdOrigin=BROWSELINK
  6. Atlas of the world’s languages in danger. Paris: Imprimerie Leclerc, 2010.
  7. Бойко Т.П., Зайцева Н.Г., Крижановская Н.Б. и др. Лингвистический корпус ВепКар – “заповедник” прибалтийско-финских языков Карелии // Труды Карельского научного центра Российской академии наук. 2021. № 7. С. 100–115.
  8. Boyko T., Zaitseva N., Krizhanovskaya N. et al. The Open corpus of the Veps and Karelian languages: overview and applications // KnE Social Sciences. 2022, no. 3, pp. 29–40.
  9. Родионова А.П., Крижановская Н.Б., Пеллинен Н.А. Речевой корпус ВепКар как инструмент сохранения диалектной речи прибалтийско-финских народов Карелии // Ежегодник финно-угорских исследований. 2023. № 3. С. 343–351.
  10. Аудиокарта прибалтийско-финских языков Карелии и сопредельных областей. http://dictorpus.krc.karelia.ru/ru/corpus/audiotext/map
  11. Новак И.П., Крижановская Н.Б., Бойко Т.П., Пеллинен Н.А. Разработка правил генерации именных словоформ для новописьменных вариантов карельского языка // Вестник угроведения. 2020. № 4. С. 679–691.
  12. Зайцева Н.Г., Харитонова Е.Е., Жукова О.Ю. Орфографический словарь вепсского языка. Петрозаводск: КарНЦ РАН, 2012.
  13. Бойко Т.П. Грамматико-орфографический словарь карельского языка. Петрозаводск: Periodika, 2022.
  14. Проект РНФ “Создание речевого корпуса прибалтийско-финских языков Карелии”. https://rscf.ru/project/22-28-20215/

Дополнительные файлы

Доп. файлы
Действие
1. JATS XML
2. Рис. 1. Главная страница Открытого корпуса карельского и вепсского языков

Скачать (644KB)
3. Рис. 2. Статистика текстов по подкорпусам ВепКара

Скачать (151KB)
4. Рис. 3. Пример текста из речевого диалектного подкорпуса

Скачать (373KB)
5. Рис. 4. Пример словарной статьи из Словаря лемм корпуса ВепКар

Скачать (276KB)
6. Рис. 5. Пример работы редактора по снятию омонимии

Скачать (195KB)
7. Рис. 6. Пример подбора ливвиковских глаголов в форме перфекта кондиционала с помощью системы лексико-грамматического поиска ВепКара

Скачать (164KB)
8. Рис. 7. Пример работы приложения по проверке орфографии. Слова, подчёркнутые красным, написаны с ошибкой или отсутствуют в базе корпуса

Скачать (178KB)
9. Рис. 8. Статистика посещений корпуса за январь–март 2024 г.

Скачать (100KB)
10. Рис. 9. Посещаемость корпуса за неделю 15.04.2024 г. – 21.04.2024 г. Резкое увеличение числа визитов и посетителей 19.04.2024 г. связано с проведением всероссийской акции “Диктант на карельском и вепсском языках”

Скачать (64KB)
11. Рис. 10. Пример оформления словарной статьи в LiPaS

Скачать (252KB)

© Российская академия наук, 2024

Согласие на обработку персональных данных с помощью сервиса «Яндекс.Метрика»

1. Я (далее – «Пользователь» или «Субъект персональных данных»), осуществляя использование сайта https://journals.rcsi.science/ (далее – «Сайт»), подтверждая свою полную дееспособность даю согласие на обработку персональных данных с использованием средств автоматизации Оператору - федеральному государственному бюджетному учреждению «Российский центр научной информации» (РЦНИ), далее – «Оператор», расположенному по адресу: 119991, г. Москва, Ленинский просп., д.32А, со следующими условиями.

2. Категории обрабатываемых данных: файлы «cookies» (куки-файлы). Файлы «cookie» – это небольшой текстовый файл, который веб-сервер может хранить в браузере Пользователя. Данные файлы веб-сервер загружает на устройство Пользователя при посещении им Сайта. При каждом следующем посещении Пользователем Сайта «cookie» файлы отправляются на Сайт Оператора. Данные файлы позволяют Сайту распознавать устройство Пользователя. Содержимое такого файла может как относиться, так и не относиться к персональным данным, в зависимости от того, содержит ли такой файл персональные данные или содержит обезличенные технические данные.

3. Цель обработки персональных данных: анализ пользовательской активности с помощью сервиса «Яндекс.Метрика».

4. Категории субъектов персональных данных: все Пользователи Сайта, которые дали согласие на обработку файлов «cookie».

5. Способы обработки: сбор, запись, систематизация, накопление, хранение, уточнение (обновление, изменение), извлечение, использование, передача (доступ, предоставление), блокирование, удаление, уничтожение персональных данных.

6. Срок обработки и хранения: до получения от Субъекта персональных данных требования о прекращении обработки/отзыва согласия.

7. Способ отзыва: заявление об отзыве в письменном виде путём его направления на адрес электронной почты Оператора: info@rcsi.science или путем письменного обращения по юридическому адресу: 119991, г. Москва, Ленинский просп., д.32А

8. Субъект персональных данных вправе запретить своему оборудованию прием этих данных или ограничить прием этих данных. При отказе от получения таких данных или при ограничении приема данных некоторые функции Сайта могут работать некорректно. Субъект персональных данных обязуется сам настроить свое оборудование таким способом, чтобы оно обеспечивало адекватный его желаниям режим работы и уровень защиты данных файлов «cookie», Оператор не предоставляет технологических и правовых консультаций на темы подобного характера.

9. Порядок уничтожения персональных данных при достижении цели их обработки или при наступлении иных законных оснований определяется Оператором в соответствии с законодательством Российской Федерации.

10. Я согласен/согласна квалифицировать в качестве своей простой электронной подписи под настоящим Согласием и под Политикой обработки персональных данных выполнение мною следующего действия на сайте: https://journals.rcsi.science/ нажатие мною на интерфейсе с текстом: «Сайт использует сервис «Яндекс.Метрика» (который использует файлы «cookie») на элемент с текстом «Принять и продолжить».