Существует десятки систем письма, смысл которых утерян навсегда — или пока остаётся недостижимым для науки. Эти неразобранные письменности хранят историю целых цивилизаций, ритуалов и, возможно, уникальных знаний. Каждая попытка дешифровки — это детективная история, где лингвисты, математики и программисты соревнуются в изобретательности.

Главная трудность не в отсутствии текстов, а в отсутствии ключа: билингвы, как камень Розетты для египетских иероглифов, для большинства таких систем просто не существует. Без параллельного текста на известном языке расшифровка превращается в угадывание с миллиардами комбинаций.

Что делает язык «нерасшифрованным»: критерии и классификация

Учёные выделяют три категории сложности. Первая — письменности известного языка, но с неизвестной графической системой (например, линейное письмо B до 1952 года). Вторая — неизвестный язык и неизвестная графика (войничская рукопись). Третья — псевдописьмо или декоративные знаки без языковой структуры.

Ключевой маркер подлинного языка — статистическая закономерность: закон Ципфа, энтропия биграмм, наличие повторяющихся морфем. Если текст подчиняется этим законам, это язык. Если нет — возможно, шифр или художественная выдумка.

  • 🔍 Закон Ципфа — частота слов обратно пропорциональна их рангу
  • 📊 Энтропия — мера неопределённости последовательности знаков
  • 🧩 Морфологические паттерны — повторяющиеся префиксы, суффиксы, корни
  • 📏 Длина слов — распределение по логнормальному закону
⚠️ Внимание: наличие статистических закономерностей не гарантирует, что текст несёт смысл. Сгенерированный марковской цепью текст может имитировать язык, но быть бессмыслицей.
📊 Какая неразобранная письменность кажется вам самой интригующей?
Линейное письмо A (minoанская)
Рукопись Войнича
Ронгоронго (остров Пасхи)
Письменность Индской долины
Диск Фаиста
Другая

Топ-5 самых известных неразобранных систем письма

Мировую славу обрели пять систем, каждая со своей драматической историей открытия и провалов дешифровки. Их изучение сформировало современную эпиграфику и криптолингвистику.

Система Регион / Культура Период Количество текстов Статус
Линейное письмо A Крит, минойцы 1800–1450 г. до н.э. ~1400 надписей Частично понятны знаки, язык неизвестен
Рукопись Войнича Европа (происхождение спорно) XV в. н.э. 1 кодекс, 240 стр. Язык / шифр / фальшивка — споры не утихают
Ронгоронго Остров Пасхи (Рапа-Нуи) XVII–XIX в. н.э. 25 деревянных табличек Пиктографическая система, язык утерян
Письменность Индской долины Харраппа, Мохенджо-Даро 2600–1900 г. до н.э. ~4000 печатей / надписей Слишком короткие тексты, нет билингвы
Диск Фаиста Крит, минойцы ~1700 г. до н.э. 1 керамический диск Уникальный артефакт, нет параллелей

Объединяет их одно: для ни одной нет двуязычной надписи, которая стала бы «камнем Розетты». Даже линейное письмо B, родственное A, было расшифровано только потому, что оказалось ранней формой греческого.

Линейное письмо A: тень минойской цивилизации

Артур Эванс открыл таблички в Кноссе в 1900 году. Он же разделил знаки на «линейное A» и «линейное B». Второе расшифровал Майкл Вентрис в 1952 году — это архаический греческий. Первое же так и осталось загадкой, хотя ~80% знаков совпадают по форме.

Проблема в том, что язык линейного A — этеокритский — не относится к индоевропейской семье. У него нет живых родственников. Попытки связать его с лювийским, фригийским или семитскими языками не дали воспроизводимых результатов.

⚠️ Внимание: многие «расшифровки» линейного A в интернете — любительские конспектуляции. Научное сообщество не признало ни одной из них.
Почему линейное B помогло, а линейное A — нет?

Линейное B записывало греческий язык, у которого есть известная грамматика и лексика. Вентрис подобрал значения знаков, подбирая греческие слова под частотные паттерны. Для линейного A нет опорного языка — подборка слов превращается в произвол.

Рукопись Войнича: средневековый троллинг или гениальный шифр?

Кодекс куплен Вилфридом Войничем в 1912 году. 240 пергаментных листов с растениями, астрономическими схемами, нагими женщинами в ваннах и текстом на неизвестном алфавите 20–30 знаков. Кربونное датирование: 1404–1438 гг. Текст подчиняется закону Ципфа, энтропия соответствует естественным языкам.

Основные гипотезы: искусственный язык (философский, алхимический), шифр (подстановка, перестановка, карданова решётка), фальшивка XVI века (для продажи Рудольфу II), глоссолилия (бессмыслица в трансе). Нейросети пока не нашли структуры, однозначно указывающие на язык.

  • 🌿 Растительный раздел — 113 иллюстраций несуществующих растений
  • 🌌 Астрономический — круговые диаграммы с знаками зодиака
  • 🛁 Балнеологический — женщины в соединённых сосудах с трубами
  • 📝 Рецептурный — короткие параграфы со звёздочками-маркерами
💡

При анализе Войнича используйте инструменты NLP: n-граммы, частотный словарь, поиск хапаксов (слов-одиночек). Настоящий язык даёт ~40–60% хапаксов, фальшивка — часто меньше или больше.

Ронгоронго: письмо, которое съели миссионеры

На острове Пасхи к XIX веку существовала уникальная письменность в Океании. Таблички из дерева торомиро покрыты иероглифами в бустрофедонном чтении (строки чередуют направление). В 1860-х перуанские рабовладельцы увезли большинство носителей культуры, а католические миссионеры сжигали таблички как «языческие идолы».

Выжило 25 экземпляров, разбросанных по музеям мира. Тексты, вероятно, содержат гениялогии, календари, ритуалы. Но язык рапа-нуи к тому времени уже смешался с таитянским, а традиция чтения прервалась. Попытки дешифровки Меторо, Томаса Бартхеля, Стивена Фишера дали лишь изолированные предположения о календарных знаках.

⚠️ Внимание: единственный «ключ» — пересказ метро (родоначальника короля) в 1886 г. — содержит явные противоречия и, вероятно, выдуман для европейцев.

Письменность Индской долины: короткие тексты — большая проблема

Более 4000 печатей и надписей на керамике, но средняя длина текста — 5 знаков. Максимум — 26 знаков на печати из Мохенджо-Даро. Это логосиллабическая система: знаки обозначают слова и слоги. Нет длинных монументальных надписей, как в Месопотамии или Египте.

Язык, вероятно,δραвидский (близок к тамильскому) или изолированный. Отсутствие билингвы и краткость текстов делают статистический анализ ненадёжным. Недавно команда из IISER Колкаты применила Markov models и conditional entropy — структура ближе к шумерской, чем к индоевропейским.

☑️ Что нужно для расшифровки индской письменности

Выполнено: 0 / 5

Современные методы: нейросети, энтропия и краудсорсинг

Последние 10 лет принесли новый инструментарий. Трансформеры (BERT, GPT) обучают на известных древних языках (аккадский, хеттский, микенский греческий), затем применяют перенос обучения к неразобранным системам. Проект Ithaca (DeepMind) восстанавливает пропуски в греческих надписях с точностью 72%.

Для Войнича используют топическое моделирование (LDA) — текст кластеризуется на темы, соответствующие иллюстрациям. Для ронгоронго — анализ бустрофедонной структуры через графовые нейросети. Но фундаментальная проблема остаётся: без якорей (известных слов) модель галлюцинирует.

💡

ИИ ускоряет поиск паттернов, но не заменяет билингву. Любая «расшифровка» нейросетью требует независимой лингвистической верификации.

Почему некоторые языки могут остаться нерасшифрованными навсегда

Есть объективные пределы. Если письменность записывала изолированный язык без потомков, текстов мало, они формуличны (печати, этикетки) и нет контекста — информационная емкость выборки ниже порога Шеннона для уникальной дешифровки. Математически существует бесконечное множество соответствий знаков → звуков → слов, дающих одинаковую статистику.

Пример: диск Фаиста. 241 знак, 45 уникальных типов, спиралевидная разметка. Даже если это язык, комбинаторика допускает миллионы интерпретаций. Никакая вычислительная мощность не сузит их до одной без внешних данных.

⚠️ Внимание: заявления в духе «ИИ расшифрует всё через 5 лет» игнорируют теоретические ограничения теории информации. Нет данных — нет решения, какой бы умной ни была машина.
Теоретический предел дешифровки без билингвы

Согласно работе Кондракина (2021), для однозначной дешифровки логосиллабической системы нужно минимум 10 000 знаков связного текста или 500+ уникальных лексем с известным контекстом. У индской письменности ~4000 знаков суммарно, у линейного A ~8000, у Войнича ~170 000 — но последний может быть шифром, а не языком.

FAQ: частые вопросы о неразобранных письменностях

Может ли рукопись Войнича быть современной фальшивкой?

Карбонное датирование пергамента (1404–1438) и чернил (соответствует периоду) делают фальшивку XX века невозможной. Но фальшивка XV–XVI века для продажи императору Рудольфу II — ведущая гипотеза среди скептиков (Гордон Рагг, 2004).

Почему линейное B расшифровали, а линейное A — нет?

Линейное B записывало ранний греческий диалект (микенский). Вентрис подобрал значения знаков, подбирая греческие слова под частотные паттерны. Линейное A использует похожие знаки, но язык (этеокритский) неиндоевропейский и не имеет известных родственников.

Есть ли шанс, что ИИ сам расшифрует ронгоронго?

Нейросети находят статистические регулярности, но не могут привязать знаки к семантике без «якорей» — известных слов или параллельных текстов. Краудсорсинг разметки + ИИ даёт лучшие результаты, но фундаментальная неопределённость остаётся.

Какая неразобранная письменность ближе всего к расшифровке?

Линейное письмо A — известны фонетические значения ~80% знаков (через линейное B), понятна структура текстов (административные списки). Остаётся только лексика языка. Индская письменность дальше всего из-за краткости текстов.

Что такое «бустрофедон» и где он встречается?

Способ письма, когда строки чередуют направление: слева направо, затем справа налево, как пашет вол. Характерен для раннегреческих надписей, рун, ронгоронго и некоторых этрусских текстов. Удобен для чтения с камня или дерева без переноса взгляда.