fantlab ru



  Лингвистический анализ произведения
Произведение: Нынче всё наоборот
Автор: Юрий Томин
Дата проведения анализа: 18 сентября 2022 года

Общая статистика

Длина текста, знаков:182038
Слов в произведении (СВП):27572
Приблизительно страниц:86
Средняя длина слова, знаков:4.75
Средняя длина предложения (СДП), знаков:42.55
СДП авторского текста, знаков:59.4
СДП диалога, знаков:33.5
Доля диалогов в тексте:51.34%
Доля авторского текста в диалогах:12.67%
Использование диалогов по тексту
(по горизонтали: счётчик знаков; по вертикали: процент диалогов;
размер скользящего окна: знаков, шаг: 1000 знаков)

Активный словарный запас

Использовано уникальных слов:3437
Активный словарный запас (АСЗ):3359
Активный несловарный запас (АНСЗ):78
Удельный АСЗ на 3000 слов текста:875.46
Удельный АСЗ на 10000 слов текста:1925.35 —> 11981-е место в рейтинге УАСЗ-10000
Динамика изменения УАСЗ-3000 от начала до конца произведения
(по горизонтали: счётчик слов; по вертикали: УАСЗ-3000)
Максимальное значение УАСЗ-3000 (0) приходится приблизительно на 0-ю страницу текста.
Миниимальное значение УАСЗ-3000 (10000000) приходится приблизительно на 0-ю страницу текста.

Части речи

Неопределённых частей речи (НОЧР), слов:7198 (26.11% от СВП)
Определённых частей речи (ОЧР), слов:20374 (73.89% от СВП)
Из них (принимая ОЧР за 100%):
          Существительное5126 (25.16%)
          Прилагательное1747 (8.57%)
          Глагол5915 (29.03%)
          Местоимение-существительное3251 (15.96%)
          Местоименное прилагательное965 (4.74%)
          Местоимение-предикатив5 (0.02%)
          Числительное (количественное)317 (1.56%)
          Числительное (порядковое)48 (0.24%)
          Наречие1495 (7.34%)
          Предикатив254 (1.25%)
          Предлог2193 (10.76%)
          Союз2578 (12.65%)
          Междометие497 (2.44%)
          Вводное слово125 (0.61%)
          Частица2448 (12.02%)
          Причастие115 (0.56%)
          Деепричастие43 (0.21%)
Служебных слов:12105 (59.41%)

Биграммы частей речи

В таблице показаны частоты словопар типа «существительное+прилагательное», «прилагательное+глагол» и т.д. Для удобства восприятия частота выражена в среднем количестве пары на 1000 слов текста. Вертикаль отражает часть речи первого слова биграммы, горизонталь — второго.

С
у
щ
е
с
т
в
и
т
е
л
ь
н
о
е
П
р
и
л
а
г
а
т
е
л
ь
н
о
е
Г
л
а
г
о
л
М
е
с
т
о
и
м
е
н
и
е
-
с
у
щ
е
с
т
в
и
т
е
л
ь
н
о
е
М
е
с
т
о
и
м
е
н
н
о
е

п
р
и
л
а
г
а
т
е
л
ь
н
о
е
М
е
с
т
о
и
м
е
н
и
е
-
п
р
е
д
и
к
а
т
и
в
Ч
и
с
л
и
т
е
л
ь
н
о
е

(
к
о
л
и
ч
е
с
т
в
е
н
н
о
е
)
Ч
и
с
л
и
т
е
л
ь
н
о
е

(
п
о
р
я
д
к
о
в
о
е
)
Н
а
р
е
ч
и
е
П
р
е
д
и
к
а
т
и
в
П
р
е
д
л
о
г
С
о
ю
з
М
е
ж
д
о
м
е
т
и
е
В
в
о
д
н
о
е

с
л
о
в
о
Ч
а
с
т
и
ц
а
П
р
и
ч
а
с
т
и
е
Д
е
е
п
р
и
ч
а
с
т
и
е
Существительное228468.85.9.001.1.317.21.415224.83131.4.26
Прилагательное202.9162.7.97.04.57.001.6.4835.6.57.003.7.18.18
Глагол341423158.7.091.9.53111.736213.8.48161.2.40
Местоимение-существительное128.541133.9.001.8.091318.47.8.92.8324.13.18
Местоименное прилагательное164.37.61.7.83.00.40.041.5.181.92.2.22.263.1.04.04
Местоимение-предикатив.00.04.04.00.04.00.00.00.00.00.00.04.00.00.00.00.00
Числительное (колич-ое)4.7.752.1.57.66.00.44.04.26.13.531.6.13.00.40.00.00
Числительное (порядковое)1.1.00.18.04.00.00.00.00.04.00.09.18.00.00.09.00.00
Наречие54.3188.71.1.00.40.002.9.834.34.3.57.356.9.22.13
Предикатив.75.222.21.1.13.00.13.00.35.04.13.57.09.04.75.00.00
Предлог547.71.61311.003.53.70.04.001.5.00.00.44.88.00
Союз14822222.9.041.4.137.8.798.36.51.8.4811.26.18
Междометие7.2.921.26.5.79.00.00.04.97.00.751.4.09.091.1.04.00
Вводное слово.57.2211.3.09.00.00.04.18.09.26.48.04.04.57.00.04
Частица115.145111.8.001.6.094.51.258.3.83.408.8.35.09
Причастие1.8.09.18.09.00.00.00.00.18.001.3.31.04.00.04.04.00
Деепричастие.22.09.44.09.00.00.00.00.04.00.53.09.04.00.18.00.00

Части речи на позициях в предложении

Таблица показывает, с какой частотой употреблены автором различные части на позициях в предложении. Например, ячейка «глагол – 3» показывает с какой вероятностью третье слово в случайно взятом предложении произведения является глаголом. Вероятность выражена в процентах.

В каждом столбце максимальное значение отмечено жирным шрифтом, что позволяет по первым трём-пяти столбцам примерно представить типичное для произведения начало предлоджения. Например, последовательность «местоимение-существительное, глагол, прилагательное, существительное» может быть чем-то вроде «Он срубил старое дерево...»


 Номер слова в предложении
 12345678910
Существительное12161721202024232520
Прилагательное66.15.76.86.46.96.36.45.66.3
Глагол14232324272623222320
Местоимение-существительное2018138.88.797.18.77.37.9
Местоименное прилагательное1.63.43.52.83.94.24.64.43.65
Местоимение-предикатив.00.00.00.10.00.00.00.00.00.00
Числительное (колич-ое).601.31.71.5111.6.601.31
Числительное (порядковое).10.20.10.30.20.10.00.30.20.00
Наречие7.47.364.64.54.14.64.64.36.4
Предикатив1.8.80.90.90.70.601.1.50.80.50
Предлог5.54.68.88.98.59.68.7101011
Союз167.77.48.88.78.68.68.98.211
Междометие4.81.31.3.801.21.11.81.71.31.2
Вводное слово.90.50.60.20.40.10.40.30.30.10
Частица9.29.7118.98.88.37.67.18.58.2
Причастие.10.30.30.60.50.50.50.90.50.80
Деепричастие.10.20.10.30.10.20.30.00.00.10

Знаки препинания

Частоты знаков препинания (среднее количество на 1000 слов):
          ,    запятая114.94
          .    точка111.45
          -    тире51.86
          !    восклицательный знак12.48
          ?    вопросительный знак19.08
          ...    многоточие8.02
          !..    воскл. знак с многоточием0.22
          ?..    вопр. знак с многоточием0.11
          !!!    тройной воскл. знак0.04
          ?!    вопр. знак с восклицанием1.70
          "    кавычка6.53
          ()    скобки0.00
          :    двоеточие4.68
          ;    точка с запятой0.29




Распознавание автора текста

Алгоритм распознавания автора текста, разработанный в 2008 году Львовым Алексеем (creator) для Лаборатории Фантастики, основан на сравнении лингвистического профиля текста с идентичными по структуре лингвистическими профилями авторов для выявления наиболее точного совпадения. Лингвопрофили авторов вычисляются заблаговременно и хранятся в базе данных как массивы усреднённых показателей и их среднеквадратичных отклонений по всем текстам автора. Таких показателей насчитывается более тысячи, часть из которых приведена выше.

Эмпирический подсчёт показал, что совокупный анализ этих данных, взятых в весовых долях, позволяет определить автора романа с точностью 98.79%, рассказа — 84.32% (при условии, что в базе данных имеется лингвистический профиль истинного автора). Алгоритм сложен и обладает рядом инновационных решений, что позволяет достичь высокой точности в сравнении с прототипами, основанными на анализе одних лишь символьных биграмм.

Алгоритм работы лингвоанализатора кратко описан в статье «Лингвистический анализ текста и распознавание автора».


АвторСовпадение с лингвопрофилем автора (в условных единицах)
1. Юрий Томин
 33  – ожидает пересчёта
2. Вячеслав Рыбаков
 30  – ожидает пересчёта
3. Андрей Буторин
 30  – ожидает пересчёта
4. Михаил Тырин
 30  – ожидает пересчёта
5. Алексей Лукьянов
 30  – ожидает пересчёта
6. Олег Дивов
 29  – ожидает пересчёта
7. Александр Громов
 29  – ожидает пересчёта
8. Аркадий и Борис Стругацкие
 29  – ожидает пересчёта
9. Борис Акунин
 29  – ожидает пересчёта
10. Леонид Каганов
 29  – ожидает пересчёта
...смотреть весь список >>
⇑ Наверх