fantlab ru



  Лингвистический анализ произведения
Произведение: Жмурик-проказник
Автор: Эдуард Веркин
Дата проведения анализа: 19 сентября 2022 года

Общая статистика

Длина текста, знаков:137273
Слов в произведении (СВП):20180
Приблизительно страниц:68
Средняя длина слова, знаков:5.13
Средняя длина предложения (СДП), знаков:41
СДП авторского текста, знаков:48.94
СДП диалога, знаков:31.66
Доля диалогов в тексте:35.65%
Доля авторского текста в диалогах:12.68%
Использование диалогов по тексту
(по горизонтали: счётчик знаков; по вертикали: процент диалогов;
размер скользящего окна: знаков, шаг: 1000 знаков)

Активный словарный запас

Использовано уникальных слов:4015
Активный словарный запас (АСЗ):3804
Активный несловарный запас (АНСЗ):211
Удельный АСЗ на 3000 слов текста:1098.10
Удельный АСЗ на 10000 слов текста:2508.35 —> 10399-е место в рейтинге УАСЗ-10000
Динамика изменения УАСЗ-3000 от начала до конца произведения
(по горизонтали: счётчик слов; по вертикали: УАСЗ-3000)
Максимальное значение УАСЗ-3000 (0) приходится приблизительно на 0-ю страницу текста.
Миниимальное значение УАСЗ-3000 (10000000) приходится приблизительно на 0-ю страницу текста.

Части речи

Неопределённых частей речи (НОЧР), слов:4429 (21.95% от СВП)
Определённых частей речи (ОЧР), слов:15751 (78.05% от СВП)
Из них (принимая ОЧР за 100%):
          Существительное5017 (31.85%)
          Прилагательное1309 (8.31%)
          Глагол4184 (26.56%)
          Местоимение-существительное1876 (11.91%)
          Местоименное прилагательное691 (4.39%)
          Местоимение-предикатив9 (0.06%)
          Числительное (количественное)209 (1.33%)
          Числительное (порядковое)47 (0.30%)
          Наречие898 (5.70%)
          Предикатив146 (0.93%)
          Предлог2024 (12.85%)
          Союз1624 (10.31%)
          Междометие293 (1.86%)
          Вводное слово113 (0.72%)
          Частица1032 (6.55%)
          Причастие171 (1.09%)
          Деепричастие39 (0.25%)
Служебных слов:7701 (48.89%)

Биграммы частей речи

В таблице показаны частоты словопар типа «существительное+прилагательное», «прилагательное+глагол» и т.д. Для удобства восприятия частота выражена в среднем количестве пары на 1000 слов текста. Вертикаль отражает часть речи первого слова биграммы, горизонталь — второго.

С
у
щ
е
с
т
в
и
т
е
л
ь
н
о
е
П
р
и
л
а
г
а
т
е
л
ь
н
о
е
Г
л
а
г
о
л
М
е
с
т
о
и
м
е
н
и
е
-
с
у
щ
е
с
т
в
и
т
е
л
ь
н
о
е
М
е
с
т
о
и
м
е
н
н
о
е

п
р
и
л
а
г
а
т
е
л
ь
н
о
е
М
е
с
т
о
и
м
е
н
и
е
-
п
р
е
д
и
к
а
т
и
в
Ч
и
с
л
и
т
е
л
ь
н
о
е

(
к
о
л
и
ч
е
с
т
в
е
н
н
о
е
)
Ч
и
с
л
и
т
е
л
ь
н
о
е

(
п
о
р
я
д
к
о
в
о
е
)
Н
а
р
е
ч
и
е
П
р
е
д
и
к
а
т
и
в
П
р
е
д
л
о
г
С
о
ю
з
М
е
ж
д
о
м
е
т
и
е
В
в
о
д
н
о
е

с
л
о
в
о
Ч
а
с
т
и
ц
а
П
р
и
ч
а
с
т
и
е
Д
е
е
п
р
и
ч
а
с
т
и
е
Существительное341364115.3.002.5.868.9.9826273.8.98122.8.61
Прилагательное355.2101.5.37.00.55.001.5.6143.9.55.002.74.00
Глагол461524169.251.5.259.51.343192.9.807.62.4.18
Местоимение-существительное9.77.1426.92.9.001.7.128.806.95.2.551.211.37.12
Местоименное прилагательное184.44.71.31.4.00.18.06.61.923.21.2.18.062.2.31.06
Местоимение-предикатив.00.00.18.06.00.00.00.00.00.00.06.00.00.00.00.00.00
Числительное (колич-ое)4.2.742.4.25.18.06.55.25.37.06.431.1.18.00.49.18.00
Числительное (порядковое)1.8.00.25.00.00.00.00.00.00.00.18.18.06.00.00.00.00
Наречие4.65165.11.2.12.37.063.184.22.1.43.123.8.31.00
Предикатив.49.122.4.80.43.00.00.00.12.12.43.43.37.18.43.00.00
Предлог73114.21112.122.6.861.4.37.31.80.00.00.311.8.06
Союз165.528133.1.00.98.255.7.928.53.41.2.866.5.49.25
Междометие6.7.25.804.7.74.00.12.06.55.061.3.68.12.00.55.06.06
Вводное слово1.4.31.92.55.18.00.18.00.31.00.55.61.06.00.68.06.00
Частица6.92.7245.21.7.00.74.003.6.495.15.3.49.553.12.06
Причастие5.1.80.31.12.12.00.00.00.37.061.9.31.00.06.06.00.00
Деепричастие.37.06.31.49.00.00.00.00.00.18.86.12.00.00.00.00.00

Части речи на позициях в предложении

Таблица показывает, с какой частотой употреблены автором различные части на позициях в предложении. Например, ячейка «глагол – 3» показывает с какой вероятностью третье слово в случайно взятом предложении произведения является глаголом. Вероятность выражена в процентах.

В каждом столбце максимальное значение отмечено жирным шрифтом, что позволяет по первым трём-пяти столбцам примерно представить типичное для произведения начало предлоджения. Например, последовательность «местоимение-существительное, глагол, прилагательное, существительное» может быть чем-то вроде «Он срубил старое дерево...»


 Номер слова в предложении
 12345678910
Существительное21202327282729263131
Прилагательное4.34.65.87.17.77.67.497.87.3
Глагол14292423212123201820
Местоимение-существительное19138.37.86.65.56.46.26.15.4
Местоименное прилагательное1.64.33.54.23.643.73.132.7
Местоимение-предикатив.00.00.00.00.20.10.00.10.00.20
Числительное (колич-ое).4011.41.2.901.71.31.31.60
Числительное (порядковое).10.40.30.10.20.40.40.10.10.00
Наречие5.5553.94.84.63.84.53.95.1
Предикатив.90.801.2.60.90.40.40.60.40.00
Предлог8.27131111109.8131012
Союз145.56.16.77.798.27.99.77.5
Междометие3.6.90.80111.81.41.1.602.2
Вводное слово1.1.80.50.30.80.10.40.60.30.20
Частица665.44.84.75.14.15.25.44.6
Причастие.40.50.6011.21.1.60.801.91.1
Деепричастие.50.20.00.10.00.20.10.10.30.20

Знаки препинания

Частоты знаков препинания (среднее количество на 1000 слов):
          ,    запятая92.22
          .    точка130.13
          -    тире44.30
          !    восклицательный знак13.97
          ?    вопросительный знак10.51
          ...    многоточие9.27
          !..    воскл. знак с многоточием0.00
          ?..    вопр. знак с многоточием0.00
          !!!    тройной воскл. знак0.05
          ?!    вопр. знак с восклицанием1.04
          "    кавычка8.62
          ()    скобки0.00
          :    двоеточие2.13
          ;    точка с запятой0.00




Распознавание автора текста

Алгоритм распознавания автора текста, разработанный в 2008 году Львовым Алексеем (creator) для Лаборатории Фантастики, основан на сравнении лингвистического профиля текста с идентичными по структуре лингвистическими профилями авторов для выявления наиболее точного совпадения. Лингвопрофили авторов вычисляются заблаговременно и хранятся в базе данных как массивы усреднённых показателей и их среднеквадратичных отклонений по всем текстам автора. Таких показателей насчитывается более тысячи, часть из которых приведена выше.

Эмпирический подсчёт показал, что совокупный анализ этих данных, взятых в весовых долях, позволяет определить автора романа с точностью 98.79%, рассказа — 84.32% (при условии, что в базе данных имеется лингвистический профиль истинного автора). Алгоритм сложен и обладает рядом инновационных решений, что позволяет достичь высокой точности в сравнении с прототипами, основанными на анализе одних лишь символьных биграмм.

Алгоритм работы лингвоанализатора кратко описан в статье «Лингвистический анализ текста и распознавание автора».


АвторСовпадение с лингвопрофилем автора (в условных единицах)
1. Эдуард Веркин
 35  – ожидает пересчёта
2. Сергей Волков
 31  – ожидает пересчёта
3. Олег Рой
 31  – ожидает пересчёта
4. Алекс Орлов
 31  – ожидает пересчёта
5. Алексей Лукьянов
 30  – ожидает пересчёта
6. Дмитрий Емец
 30  – ожидает пересчёта
7. Алексей Бессонов
 30  – ожидает пересчёта
8. Сергей Лукьяненко
 30  – ожидает пересчёта
9. Борис Акунин
 30  – ожидает пересчёта
10. Александр Матюхин
 30  – ожидает пересчёта
...смотреть весь список >>
⇑ Наверх