Датасет: Русско-европейские литературные связи XVIII века

В Репозитории открытых данных по русской литературе и фольклору опубликован новый датасет — «Русско-европейские литературные связи XVIII века». Он представляет

Читать далее

Датасет: Архив Р.Г. Назирова

Борис Орехов опубликовал набор данных «Назировского архива» — машиночитаемую коллекцию текстов выдающегося российского литературоведа и историка культуры Ромэна Гафановича Назирова

Читать далее

Датасет: русская проза с размеченными ударениями

В научно-исследовательском репозитории опубликован датасет, посвященный силлабо-тоническому стиху в русской прозе XIX века. Автор работы, Борис Орехов, представляет коллекцию из

Читать далее

Датасет для исследования авторства в танской поэзии: “Delta for Tang Poets”

В цифровых гуманитарных исследованиях, и особенно в стилометрии, большое значение имеют качественно подготовленные данные. В 2024 году Борис Орехов (НИУ

Читать далее

Новый датасет для культуромики: русские биграммы XX века

На платформе Hugging Face опубликован уникальный датасет nevmenandr/russian-20th-century-bigrams, содержащий частотности лемматизированных русских биграмм за период с 1918 по 2010 год.

Читать далее

Новые стилометрические данные для исследований авторства: репозиторий по «бахтинскому вопросу»

В открытом доступе на платформе Open Science Framework опубликован уникальный набор данных, подготовленный исследовательским коллективом под руководством Б. В. Орехова.

Читать далее

Литературный маршрут госпожи Курдюковой: геоданные одной поэмы

В 1840 году в тамбовской типографии вышла первая часть поэмы Ивана Мятлева «Сенсации и замечания госпожи Курдюковой за границею, дан

Читать далее

Русский стилеметрический датасет: новая исследовательская инфраструктура для Digital Humanities

В области стилеметрии одним из главных вызовов остается создание качественных, стратифицированных и открытых корпусов текстов. Особенно остро эта проблема стоит

Читать далее

Датасет с текстами в старой орфографии

Опубликован датасет с изображениями и текстами, изданными на русском языке в дореформенной орфографии. Данные пригодятся для разработки и оценки систем

Читать далее