Манускрипт Войнича — это не просто старая книга, а единственный в истории кодекс, который устоял против усилий лучших криптографов мира на протяжении столетия. Приобретённый антикваром Уилфридом Войничем в 1912 году, он хранится в Библиотеке Бейнеке редких книг и манускриптов при Йельском университете. Радиоуглеродный анализ датирует пергамент началом XV века (1404–1438 гг.), а чернила и краски соответствуют этому периоду, что исключает современную подделку.

На 240 сохранившихся страницах текста нет ни одного понятного слова ни на каком известном языке. Иллюстрации изображают несуществующие растения, астрономические схемы с неизвестными созвездиями и наглых женщин в ваннах, соединённых сложной системой труб. Именно это сочетание технической подлинности и полной семантической непрозрачности делает кодекс «Святым Граалем» для лингвистов, историков и любителей загадок.

История находки и физическое описание кодекса

Происхождение рукописи до 1912 года восстанавливается лишь фрагментарно. Известно, что в XVII веке она принадлежала якофу де Тепенцу, а позже — императору Рудольфу II Габсбургу, заплатившему за неё 600 дукатов — огромную сумму на тот момент. После гибели владельца кодекс мигрировал по иезуитским коллегиям, пока не попал в виллу Мондругано под Фразакати, где Войнич его обнаружил.

Физически манускрипт представляет собой пергаментный кодекс формата 23,5 × 16,2 см. Страницы пронумерованы арабскими цифрами (позже добавлением), а переплёт — позднейший, XVIII века. Важно отметить: в тексте нет исправлений, зачёркиваний или проб — рука писца была невероятно уверенной, что говорит либо о переписывании готового оригинала, либо о владении автором системой письма на уровне родного языка.

  • 📜 Материал: телячий пергамент высокого качества
  • ✍️ Письмо: неизвестное алфавитно-силлабическое система (20–30 графем)
  • 🎨 Иллюстрации: 6 разделов (ботанический, астрономический, биологический, космологический, фармацевтический, рецептурный)
  • 🔢 Объём: ~170 000 знаков, ~35 000 «слов», ~8000 уникальных токенов
📊 Какой версии происхождения манускрипта Войнича вы склоняетесь больше всего?
Элфийский/конланг (искусственный язык)
Шифр/стeganография на известном языке
Смысловой хулиган/бессмыслица
Ещё не найден правильный ключ

Основные языковые и статистические аномалии текста

Первое, что бросается в глаза лингвисту — отсутствие однобуквенных и двубуквенных слов, типичных для всех естественных языков. Вместо этого текст демонстрирует экстремальное соблюдение закона Ципфа (ранг-частота слов), что характерно для естественной речи, но крайне трудно подделать намеренно. Энтропия текста (мера неопределённости) составляет ~10 бит на слово — выше, чем в английском или латыни, но ниже, чем в случайной последовательности.

Существует жесткая позиционная зависимость графем: некоторые символы встречаются только в начале слова, другие — только в конце, третьи — исключительно перед определёнными суффиксами. Это убивает теорию простую подстановки (моноалфавитный шифр). К тому же, в тексте наблюдается феномен «двойных слов» (например, daiin daiin), который в естественных языках встречается крайне редко, а здесь — системно.

ПараметрМанускрипт ВойничаАнглийский языкЛатынь
Энтропия (бит/слово)~10.0~9.5~9.8
Коэффициент Ципфа (R²)0.980.990.97
Уникальных токенов / Всего слов~23%~15%~18%
Средняя длина слова5.2 символа4.5 символа5.8 символа
Повторы биграмм (двойных слов)ВысокиеНизкиеНизкие
⚠️ Внимание: Любая «расшифровка», игнорирующая статистические свойства текста (закон Ципфа, энтропию, позиционные ограничения), является псевдонаукой. Настоящий язык или шифр обязан объяснять эти регулярности.

Самые известные попытки расшифровки: от Ньюболда до ИИ

История битвы за Войнича — это кладбище репутаций. В 1921 году Уильям Ньюболд заявил, что это шифр Роджера Бэкона, основанный на микроскопических деталях букв. Через десять лет Джон Мэнли доказал: эти «детали» — артефакты трещин на пергаменте. В 1940–50-х годах над кодексом ломали головы лучшие американские криптоаналитики — Уильям Фридман и Элизабет Смит — создавшие NSA. Они пришли к выводу: это искусственный язык или сложнейшая система шифрования, не поддающаяся взлому без ключа.

В 2000-х годах волну «разгадок» подняли энтузиасты с интернет-доступом. Гэбриел Ландаури предложил нагуатль, Стивен Бауэр — древнегерманский диалект, а в 2017–2019 годах вышли громкие заявления о «проломе» на пророческо-итальянском, иврите и даже прайском языке. Ни одна из работ не прошла рецензирование в Journal of Cryptology или Speculum. Методология обычно одна: подбирать произвольные значения символам, чтобы получились осмысленные фразы на целевом языке.

  • 🔬 Уильям Фридман (1950s): Признал неразшифруемость без ключа, гипотеза «синтетического языка»
  • 🌿 Джеймс Кеннеди (2000s): Статистический анализ, доказательство неслучайности структуры
  • 🤖 ИИ-модели (2018–2026): GPT, BERT, трансформеры — не нашли паттернов для перевода
  • 🧪 Герхард Штёкель (2020): Лингвистический анализ морфологии — подтвердил естественную структуру
💡

При оценке любой новой «расшифровки» проверяйте: опубликована ли работа в рецензируемом журнале по лингвистике или криптографии? Если только в медиа или на arXiv без peer review — это не наука.

Почему ни одна теория не признана научным сообществом

Критерий принятия расшифровки в науке жесток и прост: воспроизводимость. Любой независимый исследователь, применяя предложенный ключ к любому случайному фрагменту текста, должен получать связный, грамматически верный смысл, соответствующий иллюстрациям. Ни одна из сотен предложенных систем этого не обеспечивает. Обычно «ключ» работает только для 2–3 рукотворных фраз автора статьи, а на следующей странице выдаёт бессмыслицу.

Вторая проблема — круговое рассуждение. Авторы часто начинают с предположения языка (например, «это древний иврит»), а затем подгоняют значения графем под ожидаемый смысл. Это не дешифровка, а конструирование. Третья — игнорирование иллюстраций. Если текст описывает «подсолнух», а нарисовано растение с листьями папоротника и корнями орхидеи — теория неработоспособна.

⚠️ Внимание: Существует промышленность «разгадок Войнича» — книги, курсы, ютуб-каналы, зарабатывающие на сенсациях. Настоящий научный пролом будет опубликован в Nature, Science или профильном журнале с открытыми данными и кодом проверки.
Почему ИИ пока не смог расшифровать манускрипт?

Современные LLM (большие языковые модели) обучаются на миллиардах текстов естественных языков. Манускрипт Войнича — это либо язык-изолят без родственников, либо шифр с уникальным ключом, либо конланг. У ИИ нет обучающей выборки для этого «языка». Трансформеры находят статистические паттерны, но не могут восстановить семантику без параллельного корпуса (текст + перевод). Задача «перевести с неизвестного на известное без словаря» математически неразрешима в общем виде.

Роль современных технологий: машинное обучение и мультиспектральная визуализация

Последние 10 лет принесли больше данных о физике объекта, чем столетие до этого. Мультиспектральная визуализация (MSI) в диапазонах УФ, видимом и ИК свете выявила скрытые пометки, следы удалённых рисунков и вариации состава чернил. Оказалось, что рукопись писали минимум двумя руками (писец А и писец Б), отличающимися стилем письма и, возможно, диалектом/регистром. Также найдены следы линейки и циркуля для геометрических схем.

Машинное обучение применяется не для перевода, а для кластеризации. Нейросети успешно разделяют текст на «курсив А» и «курсив Б», выделяют функциональные части речи (предлоги, суффиксы, корни) чисто по распределению. В 2023 году команда University of Alberta с помощью ансамбля моделей доказала: текст имеет иерархическую морфологическую структуру, несовместимую со случайной генерацией или простым шифром подстановки. Это сильнейший аргумент за «естественный язык» или «сложный конланг».

Культурное наследие и влияние на поп-культуру

Манускрипт Войнича вышел за пределы академии. Он вдохновил Умберто Эко на «Имя розы», стал ключевым элементом в играх Assassin's Creed Valhalla и The Witcher 3, появился в сериале «Сверхъестественное» и десятках романов. Для криптографов это эталон неразрешимой задачи, для художников — символ тайны, для мошенников — способ заработать на наивности. В 2020 году фолио(codex) было полностью оцифровано в 4K и выложено в открытый доступ библиотекой Бейнеке — теперь каждый может попробовать себя в роли дешифратора.

Но популярность порождает шум. Каждый месяц в сети появляется «новая расшифровка». Чтобы не попасть в ловушку, используйте чек-лист критического мышления:

☑️ Как отличить научную гипотезу от псевдонауки в теме Войнича

Выполнено: 0 / 5

Перспективы решения загадки в ближайшие десятилетия

Оптимисты указывают на три вектора прорыва. Первый — палеографический: поиск родственных рукописей в архивах Европы, возможно, черновиков или ключей. Второй — компьютерный лингвистический: обучение моделей на «нулевых данных» (zero-shot) для выявления латентной грамматики без перевода. Третий — материальный: более глубокий анализ чернил, пергамента, следов хранения для реконструкции контекста создания.

Пессимисты (и большинство профессиональных криптографов) считают: если это шифр — ключ утерян навсегда. Если конланг — автор унёс грамматику в могилу. Если язык-изолят — нам не хватает билингва (текста-параллели). Но даже без расшифровки манускрипт уже дал науке уникальный корпус для тестирования гипотез о эволюции письменности и статистической природе языка.

💡

Манускрипт Войнича не расшифрован. Научный консенсус: это либо сложнейший шифр без ключа, либо искусственный язык, либо язык-изолят XV века. Любые заявления о «полной расшифровке» на сегодня — не подтверждены рецензируемой наукой.

❓ FAQ: Частые вопросы о манускрипте Войнича
Расшифрован ли манускрипт Войнича официально?

Нет. Ни одна из предложенных расшифровок не прошла независимую верификацию в научном сообществе (рецензируемые журналы по криптографии или лингвистике). Статус остаётся: «нерасшифрован».

Может ли это быть подделкой XIX–XX века?

Радиоуглеродное датирование пергамента (1404–1438 гг.) и анализ чернил/красок исключают современную подделку. Материалы и технологии полностью соответствуют XV веку.

Почему искусственный интеллект не может это прочитать?

ИИ требует обучающей выборки (параллельного корпуса: текст + перевод). Для Войнича нет ни перевода, ни родственных языков. Задача «перевод с нулевыми данными» фундаментально отличается от машинного перевода между известными языками.

Какая самая популярная научная гипотеза сейчас?

Две лидирующие: (1) Конланг (искусственный язык) — созданный человеком для тайной записи знаний (алхимия, медицина, магия); (2) Шифрованный естественный язык — сложная система шифрования (возможно, многоалфавитная с нулями/пустыми символами) на базе романского или германского языка.

Где можно посмотреть оригинал или качественные сканы?

Полный высококачественный факсимиле (4K) доступен бесплатно на сайте Beinecke Rare Book & Manuscript Library (Yale University) в разделе Digital Collections: MS 408.