Перейти к содержанию

Руби (глоссы)

Статья из Авикипедии. Энциклопедии
    • Руби** (яп. ルビ, ромадзи: *rubi*; кор. 루비, новая романизация корейского языка: *rubi*) — небольшие пояснительные надписи (глоссы), которые обычно размещаются над или рядом с логографическими знаками в языках восточноазиатской культурной сферы, таких как китайские иероглифы, японские кандзи и корейские ханча, для указания их произношения. Исторически они применялись также для вьетнамского языка (тьы-ном) и изредка встречаются в старинных текстах. Подобные аннотации, обычно именуемые просто «руби», чаще всего служат подсказкой для чтения иероглифов, которые могут быть незнакомы читателю.
    1. Примеры использования
      1. В японском языке

В японском языке руби-аннотации называются **фуригана**. Пример для слова «Токио» (東京):

Хирагана Катакана Ромадзи
とうきょう トウキョウ TŌKYŌ

Фуригана преимущественно записывается слоговой азбукой хирагана, однако в отдельных случаях могут использоваться катакана или ромадзи. Иногда фуриганой передаётся смысл иностранных слов (чаще всего английских), и наоборот. В учебных пособиях онные чтения (заимствованные из китайского) иногда обозначаются катаканой, а кунные (исконно японские) — хираганой.

      1. В китайском языке

Пример руби-аннотаций для слова «Пекин» (北京) в различных системах транскрипции:

Чжуинь фухао Сяоэрцзин Пиньинь
ㄅㄟˇ ㄐㄧㄥ بِيٍ ڭِئٍ Běijīng

На Тайване в качестве основной слоговой системы для руби-аннотаций используется **чжуинь фухао** (бопомофо); в материковом Китае преимущественно применяется **пиньинь**. Обычно чжуинь в вертикальном традиционном письме размещается справа от иероглифов, а пиньинь в горизонтальном письме — над ними.

    • Сяоэрцзин** — адаптированный персидско-арабский алфавит, используемый китайскими мусульманами (хуэй) и иногда служащий для руби-аннотаций в рукописях. Эта система имеет недостатки, главным из которых является отсутствие обозначения тонов. С распространением пиньинь её применение сократилось. В рукописях сяоэрцзин обычно записывается справа налево, что связано с наличием арабских текстов (например, Корана), где китайское письмо выполняет пояснительную или переводческую функцию.

Книги с фонетическими подсказками (особенно на пиньинь) популярны среди детей и иностранцев, изучающих китайский язык.

    1. HTML-разметка

В 2001 году консорциум W3C опубликовал спецификацию для руби-аннотаций. Для браузеров, не имеющих встроенной поддержки руби, её можно добавить с помощью CSS-правил, доступных в сети.

Разметка руби структурирована таким образом, что при отсутствии поддержки браузер отображает резервный вариант: символы руби выводятся в скобках сразу после основного текста.

W3C также разрабатывает специальный модуль руби для CSS уровня 2, который позволяет группировать символы руби и автоматически скрывать фуригану, соответствующую аннотируемой части.

      1. Пример разметки

Ниже приведены примеры разметки руби. Сначала указывается исходная разметка, затем — отрендеренный вариант, а после — версия без разметки. Веб-браузеры либо корректно отображают аннотации (как в табличных примерах выше), либо используют резервное отображение со скобками:

XHTML CSS уровня 2
Пример кода Рендеринг Альтернатива
    1. Поддержка в Unicode

Стандарт Unicode и связанный с ним универсальный набор символов поддерживают руби-аннотации с помощью следующих символов **межстрочной аннотации**:

  • Кодовая точка `U+FFF9` (шестнадцатеричная) — **якорь межстрочной аннотации** — отмечает начало аннотируемого текста.
  • Кодовая точка `U+FFFA` (шестнадцатеричная) — **разделитель межстрочной аннотации** — отмечает начало аннотируемых символов.
  • Кодовая точка `U+FFFB` (шестнадцатеричная) — **терминатор межстрочной аннотации** — отмечает конец аннотируемого текста.

Эти символы реализованы в ограниченном числе приложений. Технический отчёт Unicode № 20 поясняет, что они предназначены для внутреннего использования в системах или приложениях, а не для непосредственного применения пользователями в языках разметки. Вместо них рекомендуется использовать соответствующую руби-разметку.

Символы межстрочных аннотаций входят в блок Unicode «Specials»:

**Специальные символы**
0 1 2 3 4 5 6 7 8 9 A B C D E F
U+FFFx
IA
A
IA
S
IA
T
OBJ
**Примечания**
1. По состоянию на версию 15.0.
2. Серые ячейки обозначают зарезервированные кодовые позиции.
    1. Стандарт ANSI

Стандарт ISO/IEC 6429 (также известный как Ecma International-48), определяющий управляющие последовательности ANSI, предусматривает механизм для руби-текста, используемый текстовыми терминалами, хотя его реализуют лишь немногие терминалы и эмуляторы. Управляющий код PARALLEL TEXTS (PTX) допускает шесть значений параметров, обеспечивая следующие последовательности для обозначения руби-текста:

  • `CSI 0 \` или просто `CSI \` (поскольку 0 является значением по умолчанию) — конец параллельных текстов.
  • `CSI 1 \` — начало строки основного параллельного текста.
  • `CSI 2 \` — начало строки дополнительного параллельного текста.
  • `CSI 3 \` — начало строки дополнительной фонетической разметки на японском языке.
  • `CSI 4 \` — начало строки дополнительной фонетической разметки на китайском языке.
  • `CSI 5 \` — конец строки дополнительной фонетической разметки.
    1. См. также
  • **Харакат** — огласовочные диакритические знаки арабского письма, помогающие в чтении арабских текстов.
  • **Никуд** — система обозначения гласных в еврейском письме, облегчающая чтение на иврите (еврейский алфавит обозначает преимущественно согласные).
  • Шаблон:Rubi
    1. Примечания
    1. Литература

Ссылки[править | править код]