Письмена — это совокупность графических знаков (графем), используемых для фиксации и передачи языка в визуальной форме. В лингвистике этот термин часто противопоставляется понятию «язык»: язык — это система звуков и правил, а писмено — лишь инструмент его записи. Одна и та же система письма может служить разным языкам, как латиница используется для английского, французского, польского и сотен других.
Важно отличать систему письма от орфографии. Система определяет принцип соответствия знаков единицам языка (звукам, слогам, смыслам), а орфография — это набор правил написания для конкретного языка внутри данной системы. Например, кириллица — это система, а правила написания «жи-ши с буквой и» — уже орфография русского языка.
История возникнения систем письма
Первые прото-письменные знаки появились в неолите (VII–IV тыс. до н.э.) как знаки собственности или счётные жетоны. Настоящая писменность, способная передавать речь бесконечно точно, зародилась независимо в нескольких центрах: в Месопотамии (пословная шумерская, позже клинопись), в Древнем Египте (иероглифика), в Китае (костяные гадания, потом ханьцзы) и в Месоамерике (письмо майя).
Ключевым прорывом стала фонетзация — переход от пиктограмм (рисунков предметов) к знакам, обозначающим звуки. Принцип ребуса позволил записать абстрактные слова. Алфавит был изобретён лишь один раз в истории — у кanaanских народов (прото-синайское письмо, ок. 1800 г. до н.э.), и все современные алфавиты происходят от него.
От прото-синайского письма произошла финикийская письменность, которая стала основой для греческой (добавившей знаки для гласных) и арамейской. От греческой пошли латиница и кириллица, от арамейской — еврейское, арабское, брахми (основа индийских и юго-восточноазиатских писем) и многие другие.
Классификация систем письма: основные типы
Лингвисты (Питер Дэниелс, Уильям Брайт) делят системы письма по принципу соответствия знака единице языка. Существует несколько фундаментальных типов, которые часто сочетаются в одной системе.
- 🔤 Алфавит — каждому фонеме (согласному и гласному) соответствует свой знак. Примеры: латиница, кириллица, греческая, армянская, грузинская.
- 🔠 Абджад (консонантная система) — записываются только согласные, гласные опускаются или отмечаются диакритиками. Примеры: арабская графика, иврит.
- 🔡 Абугида (силлабическая азбука) — базовый знак обозначает слог «согласный + базовая гласная», диакритики меняют гласную или убирают её. Примеры: деванагари (хинди, санскрит), тамيل, эфиопская (геэз).
- 🀄 Силлабика — каждому слогу свой уникальный знак, систематическая модификация отсутствует. Примеры: японская кана (хирагана, катакана), чероки, линби.
- 🧩 Логографическая (иероглифическая) — знак (лограмма) обозначает слово или морфему. Фонетические компоненты могут присутствовать как подсказки. Примеры: ханьцзы (китайские иероглифы), кандзи (в японском), ханча (в корейском).
Чистых типов почти не существует. Японская письменность — уникальный смешанный тип: кандзи (лограммы) + хирагана (силлабика для грамматики) + катакана (силлабика для заимствований) + ромадзи (латиница). Корейский хангыль формально алфавит, но буквы группируются в квадратные слоговые блоки.
☑️ Как определить тип письма по тексту
Сравнительная таблица типов письменности
| Тип системы | Принцип кодирования | Число базовых знаков | Примеры языков | Направление письма |
|---|---|---|---|---|
| Алфавит | Фонема → Знак | 20–40 | Русский, Английский, Греческий | Слева направо (LTR) |
| Абджад | Согласная → Знак | 20–30 | Арабский, Иврит, Персидский | Справа налево (RTL) |
| Абугида | Слог (C+V) → Знак + модификаторы | 30–60 базовых | Хинди, Бенгали, Амхарский, Тайский | Слева направо (LTR) |
| Силлабика | Слог → Уникальный знак | 50–100+ | Японский (Кана), Чероки, Инуктитут | Разное (LTR, TTB) |
| Логография | Морфема/Слово → Знак | 3000+ (базовых) | Китайский, Японский (Кандзи) | Традиц. сверху вниз, сейчас LTR |
⚠️ Внимание: Направление письма не привязано жёстко к типу системы. Уйгурское письмо (вертикальное LTR) происходит от сирийского (горизонтального RTL), а монгольское — от уйгурского, повернутого на 90°. В Юникоде направление задаётся свойством
Bidi_Class, а не типом письма.
Распространённые современные письма и их охват
Сегодня доминируют несколько крупных систем. Латиница является официальной или де-факто основной для более чем 2 миллиардов людей и доминирует в интернете, науке, программировании. Кириллица охватывает Евразию: русский, белорусский, украинский, казахский, монгольский и десятки языков России.
Арабская графика (и её производные: персидская, урдю, пашту, дари) используется сотнями миллионов от Атлантики до Тибета. Девагари и смежные индийские писма (бенгали, гударати, гурумукхи, тамиль, телугу, каннада, малаялам, ория) служат языкам Индии, Непала, Шри-Ланки. Ханьцзы — единственная древняя логографическая система, живущая в массовом употреблении (китайский, японский кандзи).
- 🌍 Латиница — ~70% веб-контента, международный стандарт (ISO 15924: Latn).
- 🌍 Кириллица — ~250 млн носителей, стандарт ISO 15924: Cyrl.
- 🌍 Арабская — религиозный и культурный код для 1,8 млрд мусульман, ISO 15924: Arab.
- 🌍 Ханьцзы — единая система для диалектов, не взаимопонятных на слух, ISO 15924: Hani.
- 🌍 Девагари — основа для хинди, маратхи, непали, ISO 15924: Deva.
Существует около 290 систем письма, зарегистрированных в стандарте ISO 15924. Многие из них — исторические (клинопись, руны, глаголица) или используются малыми группами (тфинаг у берберов, ол-чики у санталов, нко для мандинго).
При работе с многоязычными текстами всегда указывайте атрибут lang и направление dir в HTML: <html lang="ar" dir="rtl">. Это критично для скринридеров и корректного рендеринга бидирекционального текста.
Роль Юникода в стандартизации письменности
До 1990-х годов каждая страна использовала свои 8-битные кодировки (KOI8-R, Windows-1251, GB2312, Shift_JIS), что делало обмен текстами мучительным. Юникод (Unicode) — универсальный стандарт, присваивающий уникальный код (code point) каждому знаку всех письменностей мира. Версия 15.1 содержит более 149 000 символов, охватывая 161 скрипт.
Юникод не просто нумерует знаки. Он определяет свойства символов: направление письма (Bidi), категорию (буква, цифра, знак препинания), разложение (нормализация NFC/NFD), поведение при сортировке (Collation). Это позволяет ОС и браузерам корректно рендерить смешанный текст: Привет,! שלום.
Для редких и исторических писем (клинопись, египетские иероглифы, линейное письмо Б, руны) выделены специальные блоки в Дополнительной многоязычной плоскости (SMP, U+10000–U+1FFFF). Их поддержка требует шрифтов с OpenType-таблицами (GSUB, GPOS) для лигатур и контекстных форм.
Как работает рендеринг сложных писем (OpenType)
Шрифт содержит таблицы GSUB (замена глифов) и GPOS (позиционирование). Для деванагари: базовая консонанта + вирам (вирма) → полуформа + следующая консонанта → лигатура конъюнкта. Для арабского: изолированная/начальная/средняя/конечная форма выбирается контекстуально. Без поддержки OpenType текст разваливается на отдельные буквы.
Утраченные, расшифрованные и неразобранные системы
История дешифровки — это детективы на стыке лингвистики, истории и математики. Клинопись расшифрована Гротефендом и Роулинсоном благодаря трехъязычному бисотунскому надписи (староперсидский, эламский, вавилонский). Египетские иероглифы — Шампольоном через розеттский камень (иероглифы, демотика, греческий).
Линейное письмо Б (микенское) расшифровал Майкл Вентрис в 1952 г., доказав, что это древнегреческий диалект. Письмо майя поддалось в 1970–80-х (Кнурозов, Прусс, Шелхас) — это лого-силлабическая система, записывающая язык чольти.
⚠️ Внимание: Наличие билинга (двуязычной надписи) — не гарантия быстрой расшифровки. Этрусский язык использует griechский алфавит, текстов много, но язык изолят — смысл большинства надписей неясен. Ронгоронго (Остров Пасхи) и писанский диск (Крит) остаются неразобранными из-за недостатка материала и неизвестности языка.
Современные методы включают статистический анализ энтропии (определение типа системы: логография даёт низкую энтропию на знак, алфавит — высокую), машинное обучение для кластеризации графем и поиск параллельных текстов в цифровых архивах.
Расшифровка письма требует трёх компонентов: достаточного корпуса текстов, понимания типа системы (фонетична ли она) и знания или восстановления базового языка. Без языка — только статистика.
Будущее письменности: цифровая эволюция и новые формы
Цифровая среда меняет писменность быстрее, чем вековая история. Эмодзи — стандартизированные в Юникоде пиктограммы — выполняют функции прагматических маркеров (ирония, тон), превращаясь в полноценные грамматические частицы. В Восточной Азии развиваются вводные методы (IME), где фонетический ввод (пиньинь, ромадзи) конвертируется в иероглифы через ИИ-предсказание.
Появляются нейро-письма: генеративные модели создают новые глифы для художественных конлангов (конструируемых языков) или стилизуют существующие под рукописный почерк конкретного человека. Технология Variable Fonts (OpenType 1.8) позволяет одному файлу шрифта непрерывно менять начертание, ширину, оптический размер, адаптируясь под экран и контекст.
Важный вызов — сохранение малочисленных писем. Юникод даёт кодовые позиции, но без шрифтов, клавиатур, поддержки в ОС и контента на языке писмено умирает. Инициативы вроде Script Encoding Initiative (UC Berkeley) и сообщества SIL International работают над документированием и цифровой ревитализацией писем нко, османия, ванчо и других.
FAQ: Частые вопросы о писменах
В: Чем писмено отличается от алфавита?
Писмено — это общее название для любой системы графических знаков. Алфавит — конкретный тип писмена, где есть знаки и для согласных, и для гласных. Арабское писмено — это абджад, а не алфавит.
В: Почему китайцы не перешли на алфавит?
Ханьцзы объединяют носителей не взаимопонятных диалектов (мандарин, кантонский, уй). Алфавит зафиксировал бы произношение только одного диалекта, разорвав единство письменной культуры. Плюс гомонимы в китайском делают фонетическую запись неоднозначной без тонов.
В: Что такое транслитерация и транскрипция?
Транслитерация — побуквенное соответствие между писменами (кириллица → латиница: щ → šč). Транскрипция — передача звучания (фонетика): щ → shch или щ → ɕː (МФА). Для междunarodных паспортов используют транслитерацию (ICAO Doc 9303).
В: Сколько существует писем в мире?
По стандарту ISO 15924 зарегистрировано около 290 кодов систем письма (Script codes). В Юникоде 15.1 поддерживается 161 скрипт. Исторически известно более 400 систем, большинство — мёртвы или декоритивны.
В: Может ли один язык писаться разными писменами?
Да, это норма. Сербский: кириллица и латиница (официально). Уйгурский: арабская графика (Китай), латиница (УЛСУ), кириллица (КЗ, КГ). Казахстан официально переходит на латиницу к 2031 году, параллельно с кириллицей. Узбекский: латиница (офиц.), кириллица (в быту), арабская (исторически).