Исследование Юго-Восточной Азии не может быть полным без краткого представления о сущности китайского языка и его влияния на корейский, японский и вьетнамский языки, образующие общую синосферу. Если не углубляться в дебри лингвистики, то очень условно любой язык состоит из трех основных компонентов: то, как мы говорим (фонемный уровень), то как мы пишем (грамматический уровень, в свою очередь, делящийся на морфемный – принципы словообразования и синтаксический – принципы сочетания слов в предложения) и то, что мы имеем в виду (семантический уровень, дающий нам запас лексики – то есть доступных для записи и произнесения слов).
Сино-тибетские языки (и китайский, как их основной представитель) очень сильно отличаются от индоевропейских, к которым мы все привыкли, причем по всем параметрам. Необычная письменность (единственная, чисто иероглифическая, сохранившаяся до нашего времени и развивающаяся более трех тысяч лет), необычная фонетика и необычная морфология, а также непривычные соотношения между этими уровнями приводят к тому, что китайский заслуженно считается одним из самых сложных языков в мире. Однако, так как в китайском языке фонемы, морфемы, синтаксис и семантика вообще очень мало связаны между собой, можно отцепить одну какую-то часть, например, письменность, и приспособить ее к другой лексике и фонетике - собственно, так и появились письменный вьетнамский, японский и корейский языки.
Этот процесс в принципе невозможен, если ваша система письма не иероглифическая, поэтому сложно даже подобрать примерную аналогию, которая была бы доступна читателям, от банального транслита это максимально далеко. В основном процесс приспособления был чисто фонетическим – иероглифы подбирались исходя из близости звучания, а не смысла. Очень грубо, как если бы, желая описать книгу, мы, чисто фонетически, позаимствовали в английском (если бы он был иероглифический!) какой-нибудь значок человечка, который они произносят как nigger. И это еще не все удовольствия: поскольку пиктограмма человечка не имеет грамматических категорий – по ней не понять ни число, ни род, нам пришлось бы добавить какие-то фонетические значки, для выражения этих понятий. В итоге слово «книгам» мы писали бы как пиктограмму человечка с припиской «-ам».
Откуда взялись странности китайского языка? В отличие от других, ныне существующих, он сохранил максимально архаичную форму, соответствующую начальному уровню развития языковой системы. Как вообще придумываются языки? Если вы не обладаете познаниями в лингвистике, простейший вариант — это дать значок и какое-либо озвучание каждому объекту, который вы видите вокруг себя. Люди неолита и бронзового века сталкивались не с таким уж большим числом разных сущностей, так что старокитайский был устроен максимально просто. Пара тысяч пиктограмм, каждая обозначает отдельное понятие, грамматических категорий не существует, слова не различаются по родам, не изменяются по числам и падежам. Большая часть понятий максимально конкретны: человек, копье, гора, черепаха, еда, река, смена дня/ночи и т.п. Каждому понятию соответствует свой слог, для грамотности достаточно выучить, какая пиктограмма изображает предмет, о котором ты хочешь сказать. Все слова, естественно, односложные, просто в силу концепции.
Проблемы начинают возникать тогда, когда эту же систему мы пытаемся расширить так, что бы она описывала все более развивающийся мир, при этом ее принципы мы менять в упор не желаем. В результате сначала пришлось изобрести двусложные слова – образовав новые понятия путем сочетания двух старых (и до сих пор вся лексика Китая классической эпохи моносиллабическая, а большая часть лексики со времен Хань дисиллабическая). Двусложные слова возникли в результате сложения двух односложных, путем удвоения односложного или же, в самом продвинутом варианте, таки добавлением специально изобретенных иероглифов-суффиксов или префиксов. Естественно, с течением времени возник широкий класс служебных слов, обычные (предлоги и послелоги, союзы, частицы) и специальные (показатели членов предложения и синтаксических комплексов). Уникальной особенностью китайского является порядка ста слов-классификаторов (которые когда-то высмеял Борхес): они участвуют в словообразовании, уточняя, к какому типу относится предмет: имеющему плоскую поверхность или ручку, огромному как гора, носимой с собой вещи и так далее.
Классификация Борхеса, описанная им в рассказе «Аналитический язык Джона Уилкинса» тонко высмеивает китайскую систему.
"Ознакомившись с методом Уилкинса, придется еще рассмотреть проблему, которую невозможно или весьма трудно обойти: насколько удачна система из сорока делений, составляющая основу его языка. Взглянем на восьмую категорию – категорию камней. Уилкинс их подразделяет на обыкновенные (кремень, гравий, графит), среднедрагоценные (мрамор, амбра, коралл), драгоценные (жемчуг, опал), прозрачные (аметист, сапфир) и не растворяющиеся (каменный уголь, голубая глина и мышьяк). Как и восьмая, почти столь же сумбурна девятая категория. Она сообщает нам, что металлы бывают несовершенные (киноварь, ртуть), искусственные (бронза, латунь), отделяющиеся (опилки, ржавчина) и естественные (золото, олово, медь). Красота фигурирует в шестнадцатой категории – это живородящая, продолговатая рыба. Эти двусмысленные, приблизительные и неудачные определения напоминают классификацию, которую доктор Франц Кун приписывает одной китайской энциклопедии под названием «Небесная империя благодетельных знаний». На ее древних страницах написано, что животные делятся на а) принадлежащих Императору, б) набальзамированных, в) прирученных, г) сосунков, д) сирен, е) сказочных, ж) отдельных собак, з) включенных в эту классификацию, и) бегающих как сумасшедшие, к) бесчисленных, л) нарисованных тончайшей кистью из верблюжьей шерсти, м) прочих, н) разбивших цветочную вазу, о) похожих издали на мух. В Брюссельском библиографическом институте также царит хаос; мир там разделен на 1000 отделов из которых 262-й содержит относящееся к папе, 282-й – относящееся к Римской католической церкви, 263-й – к празднику Тела Господня, 268-й – к воскресным школам, 298-й – к мормонству, 294-й – к брахманизму, буддизму, синтоизму и даосизму. Не чураются там и смешанных отделов, например 179-й: «Жестокое обращение с животными. Защита животных. Дуэль и самоубийство с точки зрения морали. Пороки и различные недостатки. Добродетели и различные достоинства»."
В XX в. добавились многосложные слова, описывающие заимствованные понятия; например, 共产党员 (Gòng chǎn dǎng yuán) – коммунист (共 «в общем владении, разделяемый»; 产 «промысел, имущество, продукция»; 党 «клан, община»; 员 «служащий, участник»; буквально «участник общины, разделяющей продукцию»). На письме границы слова в китайском не обозначаются, что создает дополнительные радости пытающемуся это прочитать. А морфология языка приводила неоднократно к смешным ошибкам ранних онлайн-переводчиков, которые тупо подставляли первые попавшиеся существительные, так, вместо «коммунист», они могли выдать что-то в духе «общая продукция участник клан».
Фактически знание китайского подразумевает, прежде всего, заучивание нескольких тысяч стандартных иероглифов и их наиболее распространенных значений и комбинаций. Только тогда вы сможете корректно перевести буквальную надпись «молния родник нить течение переправа дерево роща» 电源线流过树林 как «ЛЭП (电源线) проходит (流) через (过) лес (树林)». Несложно видеть, что китайский язык автоматически чрезвычайно поэтичен и аллегоричен (эту особенность крайне сложно передать в других языках). Так классический термин 电 «молния» с XX в. имеет значение и «электричество», тогда 电源线 (шнур питания, кабель) буквально и образно будет чем-то вроде «нить от родника молнии». Эти вещи не поддаются какой-то особенной логике – все эти прямые и переносные смыслы приходится просто выучить, благо для понимания большей части простых текстов типа газетных новостей достаточно знать около 1500 стандартных сочетаний иероглифов. При этом после некоторых тренировок вполне можно воспринимать написанное на автомате, вместо буквального «я (我) [синтаксическое служебное слово 的] деньги (钱) потреблять/применять (用) завершить (完了)» (где «завершить» 完了 в свою очередь буквально «закончится» + 了, означающее в данном контексте окончательный финал) подставляя более привычное «у меня кончились деньги».
1500 — это вообще много или мало? На самом деле большая часть людей спокойно обходится таким количеством слов в любом языке. Что касается китайского статистика такова (для японского примерно также). Знание 1000 иероглифов покрывает 90% текстов, которые вам могут встретится. Знание 2400 уже 99%. Далее идет 3800 (99.9%), 5200 (99.99%) и 6600 (99.999%). Иероглифический запас людей, получивших первоклассное образование, как раз и составляет порядка 7-8 тысяч иероглифов, в результате словарь им нужен чрезвычайно редко. Самый полный в истории, тайванский словарь Dictionary of Chinese Character Variants (异体字词典), составляемый с 1984 г. в своем шестом издании 2017 г. содержит 106.330 иероглифов (но это включая иероглифы, во всех возможных вариантах: тайванской, гонконгской, корейской и японской формах). Полнейший словарь КНР Zhōng huá zì hǎi (中華字海) содержит 85.568 иероглифов. Эти два словаря содержат лишь иероглифы и занимают один том, а что насчет лексики?
Что касается количества слов, то лексический запас китайского языка определить чрезвычайно сложно.
Словарь корейского языка 표준국어대사전 511 тысяч, Grande Dizionario Hoepli Italiano, Webster's Third New International Dictionary и Lietuvių kalbos žodynas по полмиллиона, Rječnik hrvatskoga ili srpskoga jezika и Woordenboek der Nederlandsche Taal по 400. Самый большой русский словарь в истории – Толковый словарь живого великорусского языка Владимира Даля содержит всего 220 тысяч слов, что говорит о чрезвычайно бедной лексике по сравнению с другими языками (а также о ее не изученности – словаря большего размера в России за 160 лет создать так и не осилили, в 17- томном Большом академическом словаре зафиксировано 131.257 слов). Статистически, скорее всего, русский язык содержит порядка 300-350 тысяч слов. Это меньше, чем в сербскохорватском, португальском, финском, персидском, литовском, турецком, норвежском и даже курдском, гуджарати и тамильском. Отметим и тот факт, что полмиллиона – это технический предел для печати словаря, который будет занимать десятки толстых томов, весить под центнер и стоить сумасшедших денег, не говоря уже об удобстве пользователя. Поэтому все словари большего размера существуют только в онлайне: корейский (абсолютный рекорд в 1.100.373 слов!), португальский (818 тыс.), финский (800 тыс.), тамильский (784 тыс.), курдский (744 тыс.). Что касается писателей, то статистика отводит максимальный словарный запас Шекспиру (35 тыс. слов из которых около 3 тыс. были придуманы им самим), Джойсу (порядка 30 тыс. из которых множество неологизмов), Алишеру Навои (Alisher Navoiy, 1441 – 1501 гг., около 30 тыс.) и Пушкину (порядка 22 тыс.). Владимир Ленин использовал почти 40 тысяч слов. Набоков, Хлебников, Томас Пинчон, Гёте, Толстой – все они также обладали активным словарным запасом более чем в 20 тыс.
Теперь поговорим о фонетике. С фонетикой в китайском все плохо. В отличие от иероглифов, которых можно придумать сколь угодно много, ротовой аппарат человека не предназначен для стабильной артикуляции бесконечного количества существенно (для людей без абсолютного слуха) различающихся звуков. В результате китайская фонетика с течением веков безусловно менялась (одних официально признанных в КНР национальных диалектов, на слух отличающихся, порой, как японский и китайский, насчитывается 56 штук), но общее количество издаваемых звуков всегда на порядки уступало количеству иероглифов. Базовой фонетической единицей практически всех восточно-азиатских языков служит слог. Его можно разделить (не углубляясь детали, уточнения и исключения) на три главных компонента – начальный согласный (инициаль), конечный гласный (финаль) и тон. В современном официальном китайском языке – путунхуа (pǔtōnghuà), комбинации инициалей и финалей создают 414 слогов, комбинации инициалей, финалей и тонов — 1332. Для сравнения, в английском языке существует около 8 000 возможных слогов.
Теперь посмотрим на сами иероглифы. Их изначальная идея была идеогамматической. Каждый символ – это стилизованное изображение значения: 上 – верх, 下 – низ, 人- человек, 戈 - копье (человечек, метающий палку, откуда составной иероглиф 伐 «тыкать человека копьем», в общем смысле «бить») и т.п. Очевидно, что на все понятия в этом мире рисунков не напасешься, в результате чего 90% иероглифов были сочинены по другому принципу – фоноидеограматическому. Для того, что бы сконструировать новый иероглиф в таком стиле нужно взять два иероглифа: фонетик (описывает, в общем смысле, звучание слова) и детерминатив (описывает, опять-таки, в общем смысле, предметную область). Наиболее близкий пример из русского – взять символ «5» и букву «о» для образования нового слова «о5» («опять»).
Лексика доциньского периода в китайском языке была преимущественно моносиллабической – проще говоря, большая часть китайских слов состояли из одного слога. Сочетание этих факторов привело к тому, что классический древнекитайский язык был чисто письменным – разговаривать на нем было невозможно, так как многим тысячам иероглифов соответствовали всего сотни слогов. Современный шуточный пример: знаменитое стихотворение 施氏食獅史 (shī shì shí shī shǐ), сочиненное Чжао Юаньжэнем (趙元任, 1892 – 1982 гг., американский лингвист) в 1930-х годах. Оно состоит из 94 иероглифов, читаемых как shi, в результате, любой образованный китаец в состоянии понять его в письменном виде, но никто не в состоянии разобрать о чем идет речь, если попытаться его озвучить.
石室詩士施氏, 嗜獅, 誓食十獅。
氏時時適市視獅。
十時, 適十獅適市。
是時, 適施氏適市。
氏視是十獅, 恃矢勢, 使是十獅逝世。
氏拾是十獅屍, 適石室。
石室濕, 氏使侍拭石室。
石室拭, 氏始試食是十獅。
食時, 始識是十獅, 實十石獅屍。
試釋是事。
В целом на каждый слог в современном китайском приходится примерно 6-10 разных иероглифов например, 衣,一, 依 и 伊 все читаются как yī , иероглифы 田 и 甜 читаются как tián и т.д. Обратно, примерно 10% иероглифов имеют одно начертание, но разные чтения и смыслы, например, 说 это shuō («говорить») и shuì («освобождать»). Как же люди вообще справлялись? Да легко, в современной речи подавляющее большинство людей использует столько же слов, что и китаец эпохи Шан – не более 400-500 разных! Этого хватает для всех повседневных нужд. Очевидно, что 400 дифтонгов и 400 самых популярных иероглифов, им соответствующих, хватило бы для общения китайских крестьян без всяких заморочек с омонимией. А вот умение прочитать серьезный текст типа Мэнция или Конфуция было уже уделом исключительно высоких интеллектуалов, а озвучить его были не в состоянии даже они.
Классический китайский (古文 gǔwén, «древний текст» или, как позже назвали его европейцы, 文言 wényán, «литературный язык») появился в период Весен и Осеней и Сражающихся царств (V-II вв. до н.э.), кодифицирован и отшлифован был в работах «Ста школ китайской мысли» (諸子百家), включавшей сочинения конфуцианцев, легистов, моистов, даосов и многих других первых китайских философов. Он был исключительно письменным и служил эталоном и лингва франка для всей Юго-Восточной Азии от Вьетнама до Японии на протяжении более чем 2000 лет, вплоть до конца XIX в, играя роль азиатской латыни. Отметим, что другие формы письменного китайского не были, конечно, отдельными языками – просто они использовали расширенную и немного отличающуюся лексику и синтаксис. В качестве максимально грубой аналогии можно привести русский язык сочинений, например, Достоевского и русский язык в той его форме, в какой он принят в чиновничьих документах, печально известный канцелярит. Классический китайский и был своеобразной формой такого канцелярита – на нем были написаны все доханьские произведения и он оставался языком всех официальных документов, чиновничьих отчетов, приказов, энциклопедий и архивов. Естественно, любой язык рос и развивался и уже со времен Хань многие писатели перестали подражать стилю Конфуция, например, широко использовали двусложные слова. Собственно, переход к дисиллабической лексике и был обусловлен тем, что омонимия в случае двух слогов встречается крайне редко, а выбор между выбор между омонимичными знаками, как правило, становится очевиден на уровне предложения. Тем не менее, древний письменный стандарт сохранялся в качестве официального государственного – так возникла т.н. диглоссия или официальное использование двух языков: живого общения (многочисленных диалектов китайского, корейского, японского, вьетнамского) и формального делового языка (подобно латыни, классическому арабскому или санскриту). Отсюда и легкость своеобразной «пересадки» классического китайского на корейский, вьетнамский и японский – иероглифы можно было оставить без изменений, только подобрать их под звучание другого языка, да снабдить пометками чтения и синтаксиса.
На омонимии и омофонии основан огромный пласт китайской культуры суеверий, скажем крайне популярный иероглиф 福 («счастье») на табличках с пожеланиями всегда переворачивают из-за абсолютной омонимии выражений 福到 («счастье пришло») и 福倒 («счастье перевернулось»). Присущая китайцам любовь к летучим мышам (蝙蝠) связана с такой же омонимией со словом «счастье». Если вы хотите пожелать китайцу добра – подарите ему яблоко (苹果), ассоциирующееся с благополучием (平安), а вот грушу дарить нельзя (если вы не абсолютный варвар), в силу омонимии разрезания груши (分梨) и расставания (分离), ну а подарить часы – это буквально пожелать «что бы ты помер». На омонимии цифр и иероглифов основан и современный интернет-сленг молодежи, вместо 我爱你 («люблю тебя») не стесняйтесь писать 520, а вместо 酒吧 («бар») 98.
В самом Китае все официальные тексты до Движения четвертого мая (1919 г.) написаны на классическом языке, вэньян знал и Мао и мог на нем читать и писать, в программы современных школ он тоже входит и умение читать его отличает образованного человека. Забавно, но классический китайский использовался для написания прокламации Hunminjeong'eum (훈민정음, 1446 г.), в которой провозглашался переход к современному корейскому алфавиту хангыль, и эссе Ху Ши (胡適, 1891 – 1962 гг., философ и сторонник вестернизации), в котором он выступал за современный стандарт т.н. простонародного китайского – путунхуа (напоминает эссе Данте, написанное на латыни, в котором он объяснял достоинства итальянского языка). На Тайване переход к простонародному китайскому состоялся лишь в ходе реформ 1970-х гг, но большая часть законов и юридической литературы до сих пор написана на вэньяне, что делает его обязательным для изучения правоведами.
Литературный китайский известен в Японии как Kanbun (漢文 «китайское письмо»), văn ngôn (文言) или Hán văn (漢文) во Вьетнаме и Корее как hanja (한자). Во Вьетнам вэньянь пришел раньше всех, еще в III в до н.э. при Цинь, в Корею в I веке до н.э., после оккупации Хань, Япония же никогда не была завоевана, в итоге ее культура прилично отстала и письменность появилась у них только в IV-V вв. после проникновения на ее территорию китайского буддизма. Интеллигенция, духовенство и знать, естественно, писали на вэньяне, но возникла небольшая проблема – как приблизить и передать чтение китайских иероглифов в абсолютно другой фонетической и грамматической системе?
Китайский язык уникален по сравнению с прочими, на которые он повлиял. Вэньянь состоял из кратких односложных слов со строго аналитической структурой SVO (субъект-действие-объект), резко контрастирующей с полисиллабической, очень синтетической структурой SOV (субъект-объект-действие) корейского языка, имеющего грамматические структуры для выражения падежа, рода и уровней вежливости. Несмотря на принятие литературного китайского в качестве письменного языка, он не смог заменить разговорный корейский (который был куда удобнее) даже среди ученых, которые погрузились в его изучение.
Для начала корейцы подогнали порядок слов вэньяна к своему. Для этого они разбивали китайский текст на смысловые блоки, а в пробелы вставлялись ханча - иероглифы корейской разработки, используемые для обозначения звучания окончаний родного корейского языка. Поскольку литературный китайский был очень немногословен, и многое можно было понять лишь из контекста, вставка таких грамматических маркеров сильно помогала прояснить смысл написанного. Эта система получила название кугёль (입겿, «членение фразы») и была разработана учеными раннего королевства Корё (918 - 1392 гг.), в результате вэньянь стало возможно читать в корейском порядке слов с корейскими глоссами. У самого же корейского языка письменность хангыль появилась только в 1446 г., впрочем, до начала XX в. использовалась она вперемешку с вэньянем, составным шрифтом, в котором ханча перемежались с хангылем для местных слов и суффиксов. Ханча до сих пор преподается в школах полуострова, но в конце 1940-х годов она вышла из употребления в Северной Корее и все реже используется в Южной.
В Японии аналогом ханча была система камбун – запись японского языка китайскими иероглифами кандзи (漢字 «буквы Хань»). Тексты на камбуне были снабжены специальными значками каэритэн (返り点), указывающими на изменение порядка иероглифов в соответствии с японским синтаксисом. Как мы говорили, в китайском, в отличие от японского, отсутствуют грамматические показатели для изменения форм прилагательных и глаголов. Для записи японского языка их пришлось добавить еще одним типом значков – окуриганой (送り仮名). Иероглифы кандзи можно было читать близко к китайскому произношению (т.н. чтение онъёми 音読み, «фонетическое чтение» или просто он) или же к японскому (т.н. чтение кунъёми 訓読み, «толковое чтение» или просто кун), причем многие кандзи читаются самыми разнообразными способами (например, иероглиф 叡, имеющий он «эй» в качестве имени читается «Акира» или «Сатоси»). Для указания на чтение тоже потребовались значки – фуригана (振り仮名). Как видите, письменный японский конструировался из вэньяня постепенно и, как сказали бы разработчики программного обеспечения, добавлением все новых костылей, что сделало его невероятно замороченным даже по сравнению с и так не простым оригиналом. Кодифицирован камбун был около 800 г и стал настолько сложным, что владели им только монахи, чиновники и литераторы. Специальные знаки примерно в тоже время были сведены в слоговую азбуку – катакану.
Дизайн катаканы был разработан ученым и чиновником Киби-но Макиби (吉備真備, 695 – 775 гг.) и основан на кандзи: из близкого по звучанию иероглифа бралась какая-нибудь характерная комбинация черт и упрощалась для скорости написания. Примерно через сто лет появилась альтернативная, еще более быстрая в написании азбука – хирагана, которую употребляли как полноценную скоропись японского языка (уже без кандзи), основана она была на начертании иероглифов китайским скорописным почерком цаошу и разработана монахом Кукаем ( 空海, 774 – 835 гг.). К XIII в из-за междуусобиц, начавшихся войной Тайра и Минамото (1180 – 1185 гг.), грамотность в Японии угасла настолько, что даже чиновники нанимали для чтения и письма монахов – единственных, кто не утратил знания в хаосе Сэнгоку, периоде воюющих провинций. Второй расцвет классического китайского языка пришелся на сёгунат Токугава (1603 – 1868 гг.), а упразднен он был после революции Мэйдзи. В настоящее время для записи японского языка используется 2136 стандартных кандзи с суффиксами хираганы (до 1946 г. катаканы, сейчас отдельно катаканой записывают транскрипцию иностранных слов), хорошо образованные люди знают порядка 5-7 тысяч кандзи, да еще и в двух вариантах чтения – он и кун!). Целиком хираганой пишут в неофициальной переписке или при незнании соответствующих кандзи.
Во Вьетнаме же массово учить людей вэньяню начал как раз Ли Бон, что интересно – лексика, заимствованная из китайского, и сейчас составляет 60% вьетнамского языка (ничего зазорного в этом нет – романские языки точно также вытащили огромное количество слов из латыни). Следует различать письменность Chữ Hán («ханьское письмо») – собственно классический вэньянь (с особенностями вьетнамского чтения) и Chữ Nôm («южное письмо»), появившееся в XIII в и по конструкции похожее на камбун. Также как и в японском, в тьы-ном существовали китайские иероглифы и оригинальные вьетнамские, точно также различалось и произношение: оригинальное китайское или вьетнамское. Аналогично японскому для обозначения произношения добавлялись диакритические знаки ка-няй (cá-nháy). Вьетнамские слова записывались фонетически – их иероглифы не были связаны со своим значением в оригинальном китайском.