<?xml version="1.0"?>
<feed xmlns="http://www.w3.org/2005/Atom" xml:lang="ru">
	<id>http://digida.mgpu.ru/index.php?action=history&amp;feed=atom&amp;title=%D0%9E%D0%BF%D0%B8%D1%81%D0%B0%D1%82%D0%B5%D0%BB%D1%8C%D0%BD%D0%B0%D1%8F_%D1%81%D1%82%D0%B0%D1%82%D0%B8%D1%81%D1%82%D0%B8%D0%BA%D0%B0_R_%D0%9A%D0%B0%D1%80%D0%BF%D0%BE%D0%B2</id>
	<title>Описательная статистика R Карпов - История изменений</title>
	<link rel="self" type="application/atom+xml" href="http://digida.mgpu.ru/index.php?action=history&amp;feed=atom&amp;title=%D0%9E%D0%BF%D0%B8%D1%81%D0%B0%D1%82%D0%B5%D0%BB%D1%8C%D0%BD%D0%B0%D1%8F_%D1%81%D1%82%D0%B0%D1%82%D0%B8%D1%81%D1%82%D0%B8%D0%BA%D0%B0_R_%D0%9A%D0%B0%D1%80%D0%BF%D0%BE%D0%B2"/>
	<link rel="alternate" type="text/html" href="http://digida.mgpu.ru/index.php?title=%D0%9E%D0%BF%D0%B8%D1%81%D0%B0%D1%82%D0%B5%D0%BB%D1%8C%D0%BD%D0%B0%D1%8F_%D1%81%D1%82%D0%B0%D1%82%D0%B8%D1%81%D1%82%D0%B8%D0%BA%D0%B0_R_%D0%9A%D0%B0%D1%80%D0%BF%D0%BE%D0%B2&amp;action=history"/>
	<updated>2026-08-13T19:58:00Z</updated>
	<subtitle>История изменений этой страницы в вики</subtitle>
	<generator>MediaWiki 1.44.0</generator>
	<entry>
		<id>http://digida.mgpu.ru/index.php?title=%D0%9E%D0%BF%D0%B8%D1%81%D0%B0%D1%82%D0%B5%D0%BB%D1%8C%D0%BD%D0%B0%D1%8F_%D1%81%D1%82%D0%B0%D1%82%D0%B8%D1%81%D1%82%D0%B8%D0%BA%D0%B0_R_%D0%9A%D0%B0%D1%80%D0%BF%D0%BE%D0%B2&amp;diff=47844&amp;oldid=prev</id>
		<title>Infectedsword64 в 09:08, 15 июня 2026</title>
		<link rel="alternate" type="text/html" href="http://digida.mgpu.ru/index.php?title=%D0%9E%D0%BF%D0%B8%D1%81%D0%B0%D1%82%D0%B5%D0%BB%D1%8C%D0%BD%D0%B0%D1%8F_%D1%81%D1%82%D0%B0%D1%82%D0%B8%D1%81%D1%82%D0%B8%D0%BA%D0%B0_R_%D0%9A%D0%B0%D1%80%D0%BF%D0%BE%D0%B2&amp;diff=47844&amp;oldid=prev"/>
		<updated>2026-06-15T09:08:47Z</updated>

		<summary type="html">&lt;p&gt;&lt;/p&gt;
&lt;table style=&quot;background-color: #fff; color: #202122;&quot; data-mw=&quot;interface&quot;&gt;
				&lt;col class=&quot;diff-marker&quot; /&gt;
				&lt;col class=&quot;diff-content&quot; /&gt;
				&lt;col class=&quot;diff-marker&quot; /&gt;
				&lt;col class=&quot;diff-content&quot; /&gt;
				&lt;tr class=&quot;diff-title&quot; lang=&quot;ru&quot;&gt;
				&lt;td colspan=&quot;2&quot; style=&quot;background-color: #fff; color: #202122; text-align: center;&quot;&gt;← Предыдущая версия&lt;/td&gt;
				&lt;td colspan=&quot;2&quot; style=&quot;background-color: #fff; color: #202122; text-align: center;&quot;&gt;Версия от 12:08, 15 июня 2026&lt;/td&gt;
				&lt;/tr&gt;&lt;tr&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-lineno&quot; id=&quot;mw-diff-left-l304&quot;&gt;Строка 304:&lt;/td&gt;
&lt;td colspan=&quot;2&quot; class=&quot;diff-lineno&quot;&gt;Строка 304:&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;br&gt;&lt;/td&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;br&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;Текст пригоден для дальнейшего семантического анализа, извлечения сущностей (имена, технологии, организации) и построения тематических моделей.&lt;/div&gt;&lt;/td&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;Текст пригоден для дальнейшего семантического анализа, извлечения сущностей (имена, технологии, организации) и построения тематических моделей.&lt;/div&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-side-deleted&quot;&gt;&lt;/td&gt;&lt;td class=&quot;diff-marker&quot; data-marker=&quot;+&quot;&gt;&lt;/td&gt;&lt;td style=&quot;color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #a3d3ff; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&lt;ins style=&quot;font-weight: bold; text-decoration: none;&quot;&gt;[[Категория:CompLing Works]]&lt;/ins&gt;&lt;/div&gt;&lt;/td&gt;&lt;/tr&gt;

&lt;!-- diff cache key digida:diff:1.41:old-47825:rev-47844:php=table --&gt;
&lt;/table&gt;</summary>
		<author><name>Infectedsword64</name></author>
	</entry>
	<entry>
		<id>http://digida.mgpu.ru/index.php?title=%D0%9E%D0%BF%D0%B8%D1%81%D0%B0%D1%82%D0%B5%D0%BB%D1%8C%D0%BD%D0%B0%D1%8F_%D1%81%D1%82%D0%B0%D1%82%D0%B8%D1%81%D1%82%D0%B8%D0%BA%D0%B0_R_%D0%9A%D0%B0%D1%80%D0%BF%D0%BE%D0%B2&amp;diff=47825&amp;oldid=prev</id>
		<title>Infectedsword64: Новая страница: «== Использование R в описательной статистике == Проанализируем очищенный от служебного текста текст статьи из Википедии, посвящённой интернету вещей. https://ru.wikipedia.org/wiki/Интернет_вещей  === Код программы === &lt;syntaxhighlight lang=&quot;R&quot; line&gt; # Подключаем библиотеки library(tidyverse)...»</title>
		<link rel="alternate" type="text/html" href="http://digida.mgpu.ru/index.php?title=%D0%9E%D0%BF%D0%B8%D1%81%D0%B0%D1%82%D0%B5%D0%BB%D1%8C%D0%BD%D0%B0%D1%8F_%D1%81%D1%82%D0%B0%D1%82%D0%B8%D1%81%D1%82%D0%B8%D0%BA%D0%B0_R_%D0%9A%D0%B0%D1%80%D0%BF%D0%BE%D0%B2&amp;diff=47825&amp;oldid=prev"/>
		<updated>2026-06-14T17:40:45Z</updated>

		<summary type="html">&lt;p&gt;Новая страница: «== Использование R в описательной статистике == Проанализируем очищенный от служебного текста текст статьи из Википедии, посвящённой интернету вещей. https://ru.wikipedia.org/wiki/Интернет_вещей  === Код программы === &amp;lt;syntaxhighlight lang=&amp;quot;R&amp;quot; line&amp;gt; # Подключаем библиотеки library(tidyverse)...»&lt;/p&gt;
&lt;p&gt;&lt;b&gt;Новая страница&lt;/b&gt;&lt;/p&gt;&lt;div&gt;== Использование R в описательной статистике ==&lt;br /&gt;
Проанализируем очищенный от служебного текста текст статьи из Википедии, посвящённой интернету вещей. https://ru.wikipedia.org/wiki/Интернет_вещей&lt;br /&gt;
&lt;br /&gt;
=== Код программы ===&lt;br /&gt;
&amp;lt;syntaxhighlight lang=&amp;quot;R&amp;quot; line&amp;gt;&lt;br /&gt;
# Подключаем библиотеки&lt;br /&gt;
library(tidyverse)&lt;br /&gt;
library(tidytext)&lt;br /&gt;
library(wordcloud)&lt;br /&gt;
library(ggplot2)&lt;br /&gt;
&lt;br /&gt;
# Читаем текст&lt;br /&gt;
text_data &amp;lt;- read_lines(&amp;quot;topic.txt&amp;quot;) %&amp;gt;%&lt;br /&gt;
  enframe(name = &amp;quot;line&amp;quot;, value = &amp;quot;text&amp;quot;)&lt;br /&gt;
&lt;br /&gt;
# Добавляем разделы для группировки&lt;br /&gt;
sections &amp;lt;- text_data %&amp;gt;%&lt;br /&gt;
  mutate(section = ifelse(str_detect(text, &amp;quot;^(История|Технологии|Приложения|Тенденции|Прогнозы|Литература|Ссылки)$&amp;quot;), text, NA)) %&amp;gt;%&lt;br /&gt;
  fill(section, .direction = &amp;quot;down&amp;quot;) %&amp;gt;%&lt;br /&gt;
  filter(!is.na(section), section != text, text != &amp;quot;&amp;quot;)&lt;br /&gt;
&lt;br /&gt;
# Токенизация&lt;br /&gt;
tokens &amp;lt;- sections %&amp;gt;%&lt;br /&gt;
  unnest_tokens(word, text) %&amp;gt;%&lt;br /&gt;
  anti_join(stop_words, by = &amp;quot;word&amp;quot;) %&amp;gt;%&lt;br /&gt;
  filter(!str_detect(word, &amp;quot;[0-9]+&amp;quot;))  # убираем числа&lt;br /&gt;
&lt;br /&gt;
# ============================================&lt;br /&gt;
# 1. Type-Token Ratio&lt;br /&gt;
# ============================================&lt;br /&gt;
total_words &amp;lt;- nrow(tokens)&lt;br /&gt;
unique_words &amp;lt;- n_distinct(tokens$word)&lt;br /&gt;
tt_ratio &amp;lt;- unique_words / total_words * 100&lt;br /&gt;
&lt;br /&gt;
cat(&amp;quot;Общее количество слов:&amp;quot;, total_words, &amp;quot;\n&amp;quot;)&lt;br /&gt;
cat(&amp;quot;Уникальных слов:&amp;quot;, unique_words, &amp;quot;\n&amp;quot;)&lt;br /&gt;
cat(&amp;quot;Type-Token Ratio:&amp;quot;, round(tt_ratio, 2), &amp;quot;%\n\n&amp;quot;)&lt;br /&gt;
&lt;br /&gt;
# ============================================&lt;br /&gt;
# 2. Частотный анализ (топ-20 слов)&lt;br /&gt;
# ============================================&lt;br /&gt;
word_freq &amp;lt;- tokens %&amp;gt;%&lt;br /&gt;
  count(word, sort = TRUE)&lt;br /&gt;
&lt;br /&gt;
cat(&amp;quot;Топ-20 самых частотных слов:\n&amp;quot;)&lt;br /&gt;
print(word_freq %&amp;gt;% head(20))&lt;br /&gt;
&lt;br /&gt;
# Визуализация топ-20 слов&lt;br /&gt;
p1 &amp;lt;- ggplot(word_freq %&amp;gt;% head(20), aes(x = reorder(word, n), y = n)) +&lt;br /&gt;
  geom_bar(stat = &amp;quot;identity&amp;quot;, fill = &amp;quot;steelblue&amp;quot;) +&lt;br /&gt;
  coord_flip() +&lt;br /&gt;
  labs(title = &amp;quot;Топ-20 слов в тексте&amp;quot;,&lt;br /&gt;
       x = &amp;quot;Слово&amp;quot;, y = &amp;quot;Частота&amp;quot;) +&lt;br /&gt;
  theme_minimal()&lt;br /&gt;
print(p1)&lt;br /&gt;
&lt;br /&gt;
# Облако слов&lt;br /&gt;
set.seed(123)&lt;br /&gt;
wordcloud(words = word_freq$word, &lt;br /&gt;
          freq = word_freq$n, &lt;br /&gt;
          max.words = 100, &lt;br /&gt;
          random.order = FALSE,&lt;br /&gt;
          colors = brewer.pal(8, &amp;quot;Dark2&amp;quot;))&lt;br /&gt;
&lt;br /&gt;
# ============================================&lt;br /&gt;
# 3. Биграммы (частоты пар слов)&lt;br /&gt;
# ============================================&lt;br /&gt;
bigrams &amp;lt;- sections %&amp;gt;%&lt;br /&gt;
  unnest_tokens(bigram, text, token = &amp;quot;ngrams&amp;quot;, n = 2) %&amp;gt;%&lt;br /&gt;
  separate(bigram, c(&amp;quot;word1&amp;quot;, &amp;quot;word2&amp;quot;), sep = &amp;quot; &amp;quot;) %&amp;gt;%&lt;br /&gt;
  filter(!word1 %in% stop_words$word,&lt;br /&gt;
         !word2 %in% stop_words$word) %&amp;gt;%&lt;br /&gt;
  count(word1, word2, sort = TRUE)&lt;br /&gt;
&lt;br /&gt;
cat(&amp;quot;\nТоп-15 самых частотных биграмм:\n&amp;quot;)&lt;br /&gt;
print(bigrams %&amp;gt;% head(15))&lt;br /&gt;
&lt;br /&gt;
# Визуализация топ-15 биграмм&lt;br /&gt;
bigrams_plot &amp;lt;- bigrams %&amp;gt;%&lt;br /&gt;
  head(15) %&amp;gt;%&lt;br /&gt;
  unite(bigram, word1, word2, sep = &amp;quot; &amp;quot;) %&amp;gt;%&lt;br /&gt;
  ggplot(aes(x = reorder(bigram, n), y = n)) +&lt;br /&gt;
  geom_bar(stat = &amp;quot;identity&amp;quot;, fill = &amp;quot;coral&amp;quot;) +&lt;br /&gt;
  coord_flip() +&lt;br /&gt;
  labs(title = &amp;quot;Топ-15 биграмм&amp;quot;, x = &amp;quot;Биграмма&amp;quot;, y = &amp;quot;Частота&amp;quot;) +&lt;br /&gt;
  theme_minimal()&lt;br /&gt;
print(bigrams_plot)&lt;br /&gt;
&lt;br /&gt;
# Тепловая карта биграмм (матрица)&lt;br /&gt;
bigram_matrix &amp;lt;- bigrams %&amp;gt;%&lt;br /&gt;
  head(30) %&amp;gt;%&lt;br /&gt;
  mutate(word1 = as.factor(word1),&lt;br /&gt;
         word2 = as.factor(word2))&lt;br /&gt;
&lt;br /&gt;
if(nrow(bigram_matrix) &amp;gt; 0) {&lt;br /&gt;
  p_heatmap &amp;lt;- ggplot(bigram_matrix, aes(x = word1, y = word2, fill = n)) +&lt;br /&gt;
    geom_tile() +&lt;br /&gt;
    scale_fill_gradient(low = &amp;quot;white&amp;quot;, high = &amp;quot;red&amp;quot;) +&lt;br /&gt;
    labs(title = &amp;quot;Тепловая карта биграмм&amp;quot;) +&lt;br /&gt;
    theme(axis.text.x = element_text(angle = 45, hjust = 1))&lt;br /&gt;
  print(p_heatmap)&lt;br /&gt;
}&lt;br /&gt;
&lt;br /&gt;
# ============================================&lt;br /&gt;
# 4. Сравнение частот между разделами&lt;br /&gt;
# ============================================&lt;br /&gt;
section_word_freq &amp;lt;- tokens %&amp;gt;%&lt;br /&gt;
  filter(section %in% c(&amp;quot;История&amp;quot;, &amp;quot;Технологии&amp;quot;, &amp;quot;Приложения&amp;quot;)) %&amp;gt;%&lt;br /&gt;
  count(section, word, sort = TRUE) %&amp;gt;%&lt;br /&gt;
  group_by(section) %&amp;gt;%&lt;br /&gt;
  top_n(10, n) %&amp;gt;%&lt;br /&gt;
  ungroup()&lt;br /&gt;
&lt;br /&gt;
p_sections &amp;lt;- ggplot(section_word_freq, aes(x = reorder(word, n), y = n, fill = section)) +&lt;br /&gt;
  geom_bar(stat = &amp;quot;identity&amp;quot;, position = &amp;quot;dodge&amp;quot;) +&lt;br /&gt;
  facet_wrap(~section, scales = &amp;quot;free&amp;quot;) +&lt;br /&gt;
  coord_flip() +&lt;br /&gt;
  labs(title = &amp;quot;Топ-10 слов по разделам&amp;quot;, x = &amp;quot;Слово&amp;quot;, y = &amp;quot;Частота&amp;quot;) +&lt;br /&gt;
  theme_minimal()&lt;br /&gt;
print(p_sections)&lt;br /&gt;
&lt;br /&gt;
# ============================================&lt;br /&gt;
# 5. Статистика по разделам (исправленная)&lt;br /&gt;
# ============================================&lt;br /&gt;
section_stats &amp;lt;- tokens %&amp;gt;%&lt;br /&gt;
  group_by(section) %&amp;gt;%&lt;br /&gt;
  summarise(&lt;br /&gt;
    total_words = n(),&lt;br /&gt;
    unique_words = n_distinct(word),&lt;br /&gt;
    tt_ratio = unique_words / total_words * 100&lt;br /&gt;
  ) %&amp;gt;%&lt;br /&gt;
  arrange(desc(total_words))&lt;br /&gt;
&lt;br /&gt;
cat(&amp;quot;\nСтатистика по разделам:\n&amp;quot;)&lt;br /&gt;
print(section_stats)&lt;br /&gt;
&lt;br /&gt;
# Визуализация TTR по разделам&lt;br /&gt;
p_ttr &amp;lt;- ggplot(section_stats, aes(x = reorder(section, tt_ratio), y = tt_ratio, fill = section)) +&lt;br /&gt;
  geom_bar(stat = &amp;quot;identity&amp;quot;) +&lt;br /&gt;
  coord_flip() +&lt;br /&gt;
  labs(title = &amp;quot;Лексическое разнообразие (TTR) по разделам&amp;quot;,&lt;br /&gt;
       x = &amp;quot;Раздел&amp;quot;, y = &amp;quot;Type-Token Ratio (%)&amp;quot;) +&lt;br /&gt;
  theme_minimal() +&lt;br /&gt;
  theme(legend.position = &amp;quot;none&amp;quot;)&lt;br /&gt;
print(p_ttr)&lt;br /&gt;
&lt;br /&gt;
# ============================================&lt;br /&gt;
# 6. Распределение длин предложений&lt;br /&gt;
# ============================================&lt;br /&gt;
sentence_lengths &amp;lt;- sections %&amp;gt;%&lt;br /&gt;
  mutate(sentence = str_extract_all(text, &amp;quot;[^.!?]+&amp;quot;)) %&amp;gt;%&lt;br /&gt;
  unnest(sentence) %&amp;gt;%&lt;br /&gt;
  mutate(length = str_count(sentence, &amp;quot;\\w+&amp;quot;)) %&amp;gt;%&lt;br /&gt;
  filter(length &amp;gt; 0)&lt;br /&gt;
&lt;br /&gt;
# Boxplot длины предложений&lt;br /&gt;
p_boxplot &amp;lt;- ggplot(sentence_lengths, aes(x = section, y = length, fill = section)) +&lt;br /&gt;
  geom_boxplot() +&lt;br /&gt;
  coord_flip() +&lt;br /&gt;
  labs(title = &amp;quot;Распределение длины предложений по разделам&amp;quot;,&lt;br /&gt;
       x = &amp;quot;Раздел&amp;quot;, y = &amp;quot;Количество слов в предложении&amp;quot;) +&lt;br /&gt;
  theme_minimal() +&lt;br /&gt;
  theme(legend.position = &amp;quot;none&amp;quot;)&lt;br /&gt;
print(p_boxplot)&lt;br /&gt;
&lt;br /&gt;
# Гистограмма общей длины предложений&lt;br /&gt;
p_hist &amp;lt;- ggplot(sentence_lengths, aes(x = length)) +&lt;br /&gt;
  geom_histogram(binwidth = 5, fill = &amp;quot;steelblue&amp;quot;, color = &amp;quot;white&amp;quot;) +&lt;br /&gt;
  labs(title = &amp;quot;Распределение длины предложений&amp;quot;,&lt;br /&gt;
       x = &amp;quot;Длина предложения (слова)&amp;quot;, y = &amp;quot;Частота&amp;quot;) +&lt;br /&gt;
  theme_minimal()&lt;br /&gt;
print(p_hist)&lt;br /&gt;
&lt;br /&gt;
# ============================================&lt;br /&gt;
# 7. Дополнительная статистика&lt;br /&gt;
# ============================================&lt;br /&gt;
cat(&amp;quot;\n=== Общая статистика текста ===\n&amp;quot;)&lt;br /&gt;
cat(&amp;quot;Количество разделов:&amp;quot;, n_distinct(tokens$section), &amp;quot;\n&amp;quot;)&lt;br /&gt;
cat(&amp;quot;Средняя длина предложения:&amp;quot;, round(mean(sentence_lengths$length), 2), &amp;quot;слов\n&amp;quot;)&lt;br /&gt;
cat(&amp;quot;Медианная длина предложения:&amp;quot;, median(sentence_lengths$length), &amp;quot;слов\n&amp;quot;)&lt;br /&gt;
cat(&amp;quot;Минимальная длина предложения:&amp;quot;, min(sentence_lengths$length), &amp;quot;слов\n&amp;quot;)&lt;br /&gt;
cat(&amp;quot;Максимальная длина предложения:&amp;quot;, max(sentence_lengths$length), &amp;quot;слов\n&amp;quot;)&lt;br /&gt;
&lt;br /&gt;
# Наиболее частотные слова в каждом разделе&lt;br /&gt;
cat(&amp;quot;\n=== Наиболее характерные слова по разделам ===\n&amp;quot;)&lt;br /&gt;
top_words_by_section &amp;lt;- tokens %&amp;gt;%&lt;br /&gt;
  group_by(section) %&amp;gt;%&lt;br /&gt;
  count(word) %&amp;gt;%&lt;br /&gt;
  top_n(5, n) %&amp;gt;%&lt;br /&gt;
  arrange(section, desc(n))&lt;br /&gt;
&lt;br /&gt;
print(top_words_by_section)&lt;br /&gt;
&amp;lt;/syntaxhighlight&amp;gt;&lt;br /&gt;
&lt;br /&gt;
=== Вывод программы ===&lt;br /&gt;
                                                                                                                                                                        &lt;br /&gt;
Общее количество слов: 4137 &lt;br /&gt;
Уникальных слов: 1941 &lt;br /&gt;
Type-Token Ratio: 46.92 %&lt;br /&gt;
&lt;br /&gt;
Топ-20 самых частотных слов:&lt;br /&gt;
 1 и            170&lt;br /&gt;
 2 в            147&lt;br /&gt;
 3 вещей         89&lt;br /&gt;
 4 для           87&lt;br /&gt;
 5 интернета     64&lt;br /&gt;
 6 на            51&lt;br /&gt;
 7 с             51&lt;br /&gt;
 8 как           47&lt;br /&gt;
 9 к             37&lt;br /&gt;
 10 или           31&lt;br /&gt;
 11 также         28&lt;br /&gt;
 12 могут         23&lt;br /&gt;
 13 по            23&lt;br /&gt;
 14 может         22&lt;br /&gt;
 15 системы       22&lt;br /&gt;
 16 данных        21&lt;br /&gt;
 17 устройств     21&lt;br /&gt;
 18 интернет      19&lt;br /&gt;
 19 которые       19&lt;br /&gt;
 20 устройства    19&lt;br /&gt;
&lt;br /&gt;
Топ-15 самых частотных биграмм:&lt;br /&gt;
&lt;br /&gt;
 1 интернета  вещей          64&lt;br /&gt;
 2 интернет   вещей          12&lt;br /&gt;
 3 вещей      в              10&lt;br /&gt;
 4 с          помощью        10&lt;br /&gt;
 5 а          также           9&lt;br /&gt;
 6 такие      как             9&lt;br /&gt;
 7 могут      быть            8&lt;br /&gt;
 8 может      быть            8&lt;br /&gt;
 9 устройства интернета       7&lt;br /&gt;
 10 в          этом            6&lt;br /&gt;
 11 для        обеспечения     6&lt;br /&gt;
 12 за         счет            6&lt;br /&gt;
 13 передачи   данных          6&lt;br /&gt;
 14 таких      как             6&lt;br /&gt;
 15 умного     дома            6&lt;br /&gt;
&lt;br /&gt;
Статистика по разделам:&lt;br /&gt;
1 Приложения        3369         1596     47.4&lt;br /&gt;
2 Технологии         404          275     68.1&lt;br /&gt;
3 История            364          279     76.6&lt;br /&gt;
&lt;br /&gt;
=== Общая статистика текста ===&lt;br /&gt;
Количество разделов: 3 &lt;br /&gt;
Средняя длина предложения: 20.57 слов&lt;br /&gt;
Медианная длина предложения: 20 слов&lt;br /&gt;
Минимальная длина предложения: 1 слов&lt;br /&gt;
Максимальная длина предложения: 91 слов&lt;br /&gt;
&lt;br /&gt;
=== Наиболее характерные слова по разделам ===&lt;br /&gt;
 1 История    в            15&lt;br /&gt;
 2 История    вещей        11&lt;br /&gt;
 3 История    и            11&lt;br /&gt;
 4 История    как           8&lt;br /&gt;
 5 История    с             7&lt;br /&gt;
 6 Приложения и           154&lt;br /&gt;
 7 Приложения в           118&lt;br /&gt;
 8 Приложения для          75&lt;br /&gt;
 9 Приложения вещей        69&lt;br /&gt;
 10 Приложения интернета    54&lt;br /&gt;
 11 Технологии в            14&lt;br /&gt;
 12 Технологии вещей         9&lt;br /&gt;
 13 Технологии для           9&lt;br /&gt;
 14 Технологии как           8&lt;br /&gt;
 15 Технологии средства      7&lt;br /&gt;
&lt;br /&gt;
=== Результаты анализа ===&lt;br /&gt;
&lt;br /&gt;
Текст обладает достаточно высоким лексическим разнообразием (почти половина слов уникальны). Это характерно для научно-технических статей, где используется разнообразная терминология.&lt;br /&gt;
&lt;br /&gt;
В тексте доминирует терминология, связанная с устройствами, сетями и передачей данных. Союз «и» лидирует, что указывает на перечислительный стиль изложения.&lt;br /&gt;
&lt;br /&gt;
Ключевой биграммой является &amp;quot;интернета вещей&amp;quot;, так как она встречается 64 раза, что подтверждает центральную тему.&lt;br /&gt;
&lt;br /&gt;
Характерны вводные обороты: такие как, а также, с помощью&lt;br /&gt;
Выделяется сочетание умного дома — важная прикладная область.&lt;br /&gt;
&lt;br /&gt;
Выводы по разделам:&lt;br /&gt;
&lt;br /&gt;
«Приложения» — самый большой раздел (81% текста). Низший TTR (47.4%) объясняется повторяемостью терминов (умный дом, медицина, транспорт, сельское хозяйство). Стиль — описательный и перечислительный.&lt;br /&gt;
&lt;br /&gt;
«Технологии» — высокое разнообразие (68.1%). Используются узкоспециализированные термины (RFID, 6LoWPAN, PLC, ZigBee, сенсоры, идентификация).&lt;br /&gt;
&lt;br /&gt;
«История» — самое высокое лексическое разнообразие (76.6%). Хронологический нарратив использует разные времена, названия организаций, имена и уникальные формулировки.&lt;br /&gt;
&lt;br /&gt;
Типичное предложение содержит ~20 слов (норма для научно-технического текста)&lt;br /&gt;
&lt;br /&gt;
Присутствуют экстремально длинные предложения (до 91 слова), что характерно для перечислений и сложных конструкций в технической литературе&lt;br /&gt;
&lt;br /&gt;
Короткие предложения (1 слово) — вероятно, заголовки подразделов&lt;br /&gt;
&lt;br /&gt;
Таким образом, на основании этого анализа можно заключить, что данный текст - это научно-техническая статья среднего уровня сложности с хорошим лексическим разнообразием.&lt;br /&gt;
&lt;br /&gt;
Раздел «Приложения» занимает более 80% объёма и имеет описательный, перечислительный характер.&lt;br /&gt;
&lt;br /&gt;
Разделы «История» и «Технологии» короткие, но терминологически насыщенные — в них выше TTR.&lt;br /&gt;
&lt;br /&gt;
Ключевая тема — интернет вещей (устойчивая биграмма, частота 64).&lt;br /&gt;
&lt;br /&gt;
Стиль характеризуется: длинными предложениями (до 91 слова), вводными оборотами (такие как, а также, с помощью), обилием союза и.&lt;br /&gt;
&lt;br /&gt;
Текст пригоден для дальнейшего семантического анализа, извлечения сущностей (имена, технологии, организации) и построения тематических моделей.&lt;/div&gt;</summary>
		<author><name>Infectedsword64</name></author>
	</entry>
</feed>