---
name: hp-translate
description: >
  Добавление селективных огласовок (никуд), подстрочного перевода, литературного перевода (Росмэн)
  и анализа различий к извлечённому ивритскому тексту Гарри Поттера. Используй этот skill всегда,
  когда пользователь просит обработать/перевести извлечённый markdown с ивритским текстом Гарри Поттера,
  добавить огласовки, сделать подстрочник, добавить перевод Росмэн, создать учебные материалы из
  ивритского текста, или упоминает файлы вида «HP_ch*_*_*.md» в контексте перевода и огласовок.
  Также используй при любом упоминании «никуд», «подстрочный перевод», «литературный перевод»,
  «перевод Росмэн», «различия переводов» в контексте ивритского Гарри Поттера.
---

# Добавление огласовок, подстрочного и литературного переводов

## 1. Входные данные

Markdown-файл — выход скила `hp-extraction`.
Если скил `hp-extraction` ещё не выполнялся — предложить пользователю сначала запустить его на PDF-файле исходника.

Формат имени: `HP_ch{номер_главы}_{первая_страница}_{последняя_страница}.md` (например, `HP_ch1_30_35.md`).

### Структура входного файла

```
# Гарри Поттер — Глава {номер_главы} (иврит). Страницы XX–YY

---

## Страница N

### Текст на иврите

{неогласованный или частично огласованный текст}

### Сложные слова

| Слово на иврите | Перевод на русский |
|---|---|
| {слово с огласовками} | {перевод} |
```

Заголовки второго уровня `## Страница N` — разделяют страницы. На каждой странице:
- **Текст на иврите** — основной текст главы (может быть частично огласован: имена собственные обычно уже имеют огласовки)
- **Сложные слова** — таблица слов с огласовками и русским переводом

### Зависимость: исходные тексты (английский и Росмэн)

Для секций «Литературный перевод» и «Различия ивритского и русского переводов» необходимы:
- **Английский оригинал** главы
- **Русский перевод Росмэн** главы

Получение этих текстов описано в skill'е **`hp-source-texts`**. Перед началом обработки:

1. Определить номер главы из заголовка входного файла
2. Вызвать `hp-source-texts`: найти в Project Knowledge файлы `HP_en_ch{N}.md` и `HP_rosmen_ch{N}.md`
3. Если файлы не найдены — запросить у пользователя (см. fallback в `hp-source-texts`)
4. Извлечь фрагменты, соответствующие обрабатываемым страницам, сопоставив по содержанию (имена, прямая речь, события)

---

## 2. Выходной формат

### Имя файла

К имени входного файла добавляется суффикс `_translate`:

```
HP_ch{N}_{FROM}_{TO}.md → HP_ch{N}_{FROM}_{TO}_translate.md
```

Пример: `HP_ch1_30_35.md` → `HP_ch1_30_35_translate.md`

Выходной файл — вход для скила `hp-generate-docx`.

### Структура

Для **каждой страницы** из входного файла формируется следующая структура:

```markdown
# Страница N

## Иврит

{текст на иврите с селективными огласовками — см. раздел 3}

## Подстрочный перевод

| Иврит | Перевод |
|-------|---------|
| {фрагмент на иврите} | {дословный перевод фрагмента} |

## Литературный перевод

{канонический перевод издательства Росмэн}

## Список сложных слов

| Слово | Перевод |
|-------|---------|
| {слово с огласовками} | {перевод} |

## Различия ивритского и русского переводов

| Иврит | Пояснение |
|-------|-----------|
| {слово/выражение (перевод)} | {описание различия} |

---
```

### Важные замечания по структуре

- Заголовок первого уровня: `# Страница N`
- Заголовки второго уровня: `## Иврит`, `## Подстрочный перевод` и т.д.
- Все таблицы — из **двух** колонок
- Между страницами — горизонтальная линия `---`

---

## 3. Правила огласовки (никуд)

### 3.1 Целевая аудитория

Уровень владения ивритом — **между «алеф» и «бет»** (начальный–средний):
- знает алфавит и базовые формы
- простейшие слова (местоимения, частицы, предлоги) читает свободно
- сложные слова, редкие формы, биньяны хифиль/хитпаэль, бытовая лексика вне базового списка, заимствования — вызывают затруднения

### 3.2 Полные правила — в `references/nikud-rules.md`

Детальные правила («когда ставить» / «когда не ставить» / технические принципы / частые ошибки) вынесены в отдельный файл **`references/nikud-rules.md`**. Перед расстановкой никуда **прочитать его целиком**.

### 3.3 Краткое резюме

**Никуд ставится на:**
1. Все слова из таблицы «Сложные слова» входного файла.
2. Имена собственные и географические названия — **при каждом появлении** (`דַּמְבֶּלְדוֹר`, `הָארִי`, `דֶּרֶךְ פְּרִיוֶט`).
3. Заимствованные/английские названия в иврите (`סְמֶלְטִינְגְס`, `הוֹגְוורְטְס`).
4. Глаголы в биньянах הִפְעִיל / הוּפְעַל / הִתְפַּעֵל / פִּעֵל с неочевидным чтением.
5. Глаголы פָּעַל с неочевидной огласовкой (`צָרַח`, `שָׂרַף`, `דָּהַר`, `נָהַג`).
6. Редкая бытовая лексика (`מִסְדְּרוֹן`, `פַּטִּישׁ`, `אֲרוּבָּה`, `מַסְמֵר`, `מַחְצֶלֶת`, `אֶדֶן`).
7. Литературная и книжная лексика (`בּוֹ־בְּזְמַן`, `סָחוֹר־סָחוֹר`, `מִדֵּי פַּעַם`).

**Никуд НЕ ставится на:**
- местоимения, частицы, союзы, предлоги-приставки;
- базовые глаголы в простых формах (אמר, היה, ראה, חשב, עבר);
- простые существительные/прилагательные/числительные/наречия повседневной речи.

**Технический принцип:** работаем с **полным написанием** (ктив мале). При добавлении никуда **никогда не удалять «матери чтения»** (א, ה, ו, י): ✅ `שִׁימוּשִׁי` / ❌ `שִׁמֻשִׁי`.

**Принцип принятия решения:** прочитает ли ученик алеф-бет это слово уверенно с первого взгляда? Если есть сомнение — огласовать.

Полные списки и примеры — в `references/nikud-rules.md`.

---

## 4. Подстрочный перевод

### Назначение

Подстрочник — **основной инструмент чтения** для пользователя, а не вспомогательный комментарий к тексту. Пользователь читает главу именно по этой таблице, строка за строкой. Поэтому главное требование — **полнота**.

### Формат

Таблица из двух колонок: `| Иврит | Перевод |`

### Правила

1. **Сплошное покрытие (100 %)**: таблица покрывает весь ивритский текст без пропусков. Если склеить все ивритские ячейки по порядку, должен получиться ровно текст секции «Иврит» (с точностью до пробелов и пунктуации). **Ничто не опускается** — в том числе:
   - короткие восклицания и реплики прямой речи (например, «צא החוצה! החוצה!»),
   - повторы (например, «הם נסעו. נסעו.»),
   - короткие обстоятельства времени и места («שנייה אחר-כך», «עשר דקות מאוחר יותר», «בחוצותיה של עיר גדולה»),
   - короткие вводные предложения («הוא היה רעב», «מעולם לא עבר עליו יום נורא כל-כך»),
   - придаточные и обособленные обороты, даже если они кажутся «второстепенными».

2. **Линейный проход, а не отбор**: идти по тексту слева направо, превращая каждую законченную синтагму в строку таблицы. Не выбирать, что «достойно» попасть в подстрочник — попадает всё.

3. **Не подстраиваться под Росмэн**: литературный перевод Росмэна сливает предложения, опускает повторы и переставляет акценты. Подстрочник следует **ивритскому** тексту, а не ритму Росмэна. Если в иврите есть короткое отдельное предложение, а у Росмэна оно растворено в соседнем абзаце — в подстрочнике всё равно отдельная строка.

4. **Дословность**: перевод максимально близок к ивритскому тексту. Передаётся структура и порядок слов иврита, даже если русский звучит неестественно.

5. **Ивритский текст в таблице** берётся из секции «Иврит» (т.е. уже с огласовками, которые были проставлены на шаге 3).

6. **Разговорные обороты** переводятся буквально с пояснением смысла при необходимости.

7. **Размер строки**: обычно фраза из 5–15 слов. Очень короткие фрагменты (одно-два слова: восклицания, повторы, короткие обстоятельства) — тоже отдельная строка, не присоединять их к соседям.

Пример:
```
| הפרופסור מֶקְגוֹנֶגֶל הֵעִיפָה מַבָּט חד לְעֵבֶר דַּמְבֶּלְדוֹר | Профессор Макгонагалл бросила острый взгляд в сторону Дамблдора |
```

---

## 5. Литературный перевод

### Источник

Канонический перевод издательства **Росмэн** (русское издание серии «Гарри Поттер»).

Текст берётся из файла `HP_rosmen_ch{N}.md`, полученного через skill `hp-source-texts` (см. раздел «Зависимость: исходные тексты» выше).

### Правила

1. Используется **точный текст** перевода Росмэн — это не свободный пересказ, а цитата из опубликованного перевода.

2. **Имена и названия** — по канону Росмэн:
   - Voldemort → Волан-де-Морт (не Волдеморт)
   - Dumbledore → Дамблдор
   - McGonagall → Макгонагалл
   - Hagrid → Хагрид
   - Muggles → магглы (в Росмэн)
   - Godric's Hollow → Годрикова лощина (в Росмэн)
   - и т.д.

3. Текст оформляется **прозой** (не таблицей), с разбивкой на абзацы. Прямая речь — через тире, как в русской традиции.

4. Литературный перевод соответствует **тому же фрагменту**, что и ивритский текст на данной странице.

---

## 6. Список сложных слов

### Правила

1. В список включаются **только те слова, которые есть в таблице «Сложные слова» входного файла**. Своих слов не добавлять.

2. Формат — таблица из двух колонок: `| Слово | Перевод |`

3. Слова берутся **с огласовками** из входного файла.

4. Переводы берутся из входного файла.

5. Порядок слов — как во входном файле.

---

## 7. Различия ивритского и русского переводов

### Назначение

Учебная секция: показать, как один и тот же английский оригинал по-разному преломился в иврите и в русском Росмэне. На руках три текста (английский оригинал, иврит, Росмэн), поэтому главный инструмент — **триангуляция**: сравнивая все три, видно, *кто* отклонился от оригинала и в какую сторону. Для изучающего иврит ценнее всего наблюдения о самой **ивритской** стороне (лексика, идиомы, биньяны, составные слова, реалии), а не просто «Росмэн приукрасил».

### Формат

Таблица из двух колонок: `| Иврит | Пояснение |` (две колонки обязательны — файл далее обрабатывает `hp-generate-docx`).

- В колонке «Иврит» — ивритское слово/выражение и в скобках его буквальный перевод.
- В колонке «Пояснение» — суть расхождения: что в иврите, что в русском Росмэн, в чём разница. Где это объясняет расхождение, **явно приводить триангуляцию**: англ. `X` → иврит Y → Росмэн «Z». Английский даётся не везде подряд, а там, где он показывает, кто из переводчиков отошёл от оригинала.

### Что искать (типология различий)

Отмечаются **значимые** различия. Полезные категории (не обязательно все на каждой странице):

1. **Реалии и культура** — еда, единицы измерения, быт, школа, обращения (`fruitcake` → иврит «кусок пирога» → Росмэн «фруктовый кекс»).
2. **Магический лексикон, имена и транслитерации** — как иврит передал Hogwarts, Muggles, заклинания, имена; совпадает ли выбор с Росмэном.
3. **Идиомы и фразеология** — буквальное в иврите против идиомы в русском и наоборот (`לְאַבֵּד אותם` «потерять их» → Росмэн «сбить со следа»).
4. **Образ и метафора** — смена или потеря образа (поток/струение писем → «падают»).
5. **Регистр и стилистика** — нейтральное/книжное против разговорного, комическое, эмфаза.
6. **Добавления и опущения** — Росмэн часто расширяет и драматизирует, иврит суше; иногда наоборот.
7. **Кто ближе к оригиналу** — отдельно ценно отметить, когда иврит ближе к английскому, чем Росмэн, или наоборот.
8. **Ошибки и артефакты** — расхождения, похожие на ошибку перевода или дефект источника (`twin beds` → «двуспальные кровати»).
9. **Собственно ивритская фактура** — интересное для изучающего: составные слова (`מְחַמְמֵי-הָאוֹזְנַיִים`), выбор биньяна, редкая или книжная лексика, словообразование.

### Сколько

Включать **все значимые** различия. Обычно их 3–6 на страницу, но это ориентир, а не квота: **не добивать** список тривиальными наблюдениями ради числа и **не обрезать** находки, если их больше. Лучше одно точное наблюдение, чем три однотипных «иврит нейтрально — Росмэн ярче» подряд — следить за разнообразием категорий.

Примеры:
```
| מְחַמְמֵי-הָאוֹזְנַיִים (согреватели ушей / наушники) | англ. earmuffs (меховые наушники) → иврит буквально «согреватели ушей» (составное слово) → Росмэн «ушные затычки» (как earplugs). Иврит ближе к оригиналу; у Росмэна — другая реалия. Категория: реалии + ивритская фактура. |
| פְּרוּסַת הָעוּגָה (кусок пирога) | англ. fruitcake → иврит обобщает до «куска пирога» → Росмэн уточняет «фруктовый кекс», ближе к оригиналу. Категория: реалии. |
```

---

## 8. Пошаговый алгоритм обработки

### Подготовка (один раз перед обработкой страниц)

**Шаг 0.** Получить исходные тексты через skill `hp-source-texts`:
   - Определить номер главы из заголовка входного файла
   - Найти в Project Knowledge файлы `HP_en_ch{N}.md` и `HP_rosmen_ch{N}.md`
   - Извлечь фрагменты, соответствующие диапазону обрабатываемых страниц

### Для каждой страницы:

**Шаг 1.** Прочитать ивритский текст из входного файла.

**Шаг 2.** Прочитать таблицу сложных слов из входного файла — запомнить все слова с их огласовками.

**Шаг 3.** Создать секцию «Иврит»:
   - Взять ивритский текст из входного файла
   - Найти в нём все слова из таблицы сложных слов и проставить им огласовки из таблицы
   - Добавить огласовки к другим сложным словам (по правилам раздела 3.3)
   - Убедиться, что имена собственные и географические названия огласованы
   - **Не удалять «матери чтения»** — сохранять полное написание
   - Сохранить жирный шрифт (`**...**`) как в оригинале

**Шаг 4.** Создать секцию «Подстрочный перевод»:
   - Идти по огласованному ивритскому тексту **линейно, слева направо**, превращая каждую законченную синтагму в строку таблицы
   - **Покрыть весь текст** — не пропускать короткие восклицания, повторы, обстоятельства времени/места, вводные предложения
   - Дать дословный перевод каждого фрагмента
   - Не подстраиваться под ритм Росмэна (он сливает и опускает — подстрочник нет)
   - **Самопроверка:** мысленно склеить ивритские ячейки по порядку — должен получиться ровно текст секции «Иврит». Если есть расхождение — найти пропуск и добавить строку.

**Шаг 5.** Создать секцию «Литературный перевод»:
   - Взять соответствующий фрагмент из русского текста Росмэн (полученного на шаге 0)
   - Оформить прозой с прямой речью через тире

**Шаг 6.** Создать секцию «Список сложных слов»:
   - Перенести слова из таблицы входного файла
   - Формат: `| Слово | Перевод |`

**Шаг 7.** Создать секцию «Различия ивритского и русского переводов»:
   - Сопоставить **три текста**: ивритский, Росмэн и английский оригинал (полученные на шаге 0)
   - Пройти по типологии (раздел 7) и выделить значимые различия — по значимости, а не по квоте (обычно 3–6, без добивки и без обрезки)
   - Где уместно, привести триангуляцию англ.→иврит→Росмэн
   - Оформить таблицей с пояснениями

---

## 9. Проверка выхода

Перед сохранением проверить:

- [ ] «Матери чтения» (вав, йуд) не удалены — сохранено полное написание (ктив мале)
- [ ] Простые слова (אני, של, את и т.д.) НЕ огласованы
- [ ] Сложные слова, имена собственные и географические названия огласованы
- [ ] **Подстрочник покрывает ивритский текст на 100 %**: склеенные по порядку ивритские ячейки = текст секции «Иврит» (с точностью до пробелов и пунктуации). Проверить явно, пройдя по тексту секции «Иврит» от начала до конца и отметив каждую фразу как присутствующую в таблице.
- [ ] В подстрочнике на месте **все** короткие восклицания, повторы, обстоятельства времени/места, вводные предложения — ничто не «слито» и не «опущено» по образцу Росмэна
- [ ] Литературный перевод — точный текст Росмэн, не пересказ
- [ ] Различия переводов: значимые наблюдения (обычно 3–6), без добивки ради числа и без обрезки; разнообразие категорий; где уместно — триангуляция с английским оригиналом
- [ ] Список сложных слов содержит только слова из входного файла (своих не добавлено)
- [ ] Имя выходного файла с суффиксом `_translate`

---

## 10. Образцы готовых результатов

В папке `references/` этого skill:
- `nikud-rules.md` — **полные правила огласовки** (читать до начала работы)
- `HP_ch3_11_13_translate.md` — **эталонный пример** на 3 страницах с плотным никудом. Использовать как основной образец формата и плотности огласовок.

При использовании в Claude Project — прочитай `nikud-rules.md` и `HP_ch3_11_13_translate.md` перед началом работы.

---

## 11. Частые ошибки (чего избегать)

1. **Удаление «матерей чтения»** при добавлении никуд — это главная ошибка. Вав и йуд должны остаться.

2. **Огласовка простых слов** — не нужно огласовывать אני, של, את, הוא и подобные.

3. **Добавление слов в таблицу сложных слов**, которых нет во входном файле.

4. **Свободный пересказ** вместо перевода Росмэн в литературном переводе.

5. **Слишком крупные фрагменты** в подстрочном переводе — лучше разбивать на фразы по 5–15 слов.

6. **Пропуск огласовок** на именах собственных — имена должны быть всегда огласованы.

7. **Неполный подстрочник** — самая болезненная ошибка для пользователя, потому что он читает главу именно по подстрочнику. Типичные пропуски, которые нужно ловить:
   - **короткие восклицания и реплики** («צא החוצה! החוצה!», «אאאאחחח!»);
   - **повторы** («הם נסעו. נסעו.», «לאבד אותם... לאבד אותם...»);
   - **короткие обстоятельства времени/места** («שנייה אחר-כך», «עשר דקות מאוחר יותר», «בחוצותיה של עיר גדולה», «בזמן שדיבר»);
   - **короткие вводные предложения** в перечислениях («הוא היה רעב», «מעולם לא עבר עליו יום נורא כל-כך»);
   - **придаточные и обособленные обороты**, которые Росмэн сливает с соседним предложением («אחרי שגם הדודה פֶּטוּנְיָה וְדַּאדְלִי יצאו בריצה…»);
   - **хвосты реплик**, оставшиеся после основной фразы («יום בלי מכתבים ארורים...»).

   Эти фрагменты нельзя «всасывать» в соседнюю строку и нельзя опускать «для краткости» — каждый получает собственную строку таблицы.

8. **Дрейф к ритму Росмэна** в подстрочнике — Росмэн сливает, опускает и перестраивает; подстрочник следует иврит**у**. Если при составлении таблицы ловишь себя на мысли «но ведь у Росмэна этого нет» — это сигнал, что ты сбился: подстрочник строится от ивритского текста.
