# Несколько исходников: поиск продолжения и удаление повторов

## Типичная запись

Автор снимает первую часть, затем второй файл начинает с повторения последней фразы и продолжает финал. Если использовать только первый файл, ролик обрывается. Если просто добавить второй, фраза повторяется.

## Процесс

1. Найти все видео в архиве.
2. Получить пословную транскрибацию каждого файла.
3. Сравнить 20–50 последних слов предыдущего файла с 20–50 первыми следующего.
4. Найти самый длинный совпадающий фрагмент.
5. Определить локальное время первого нового слова во втором файле.
6. Создать план:

```json
{
  "sources": [
    {"file": "source_001.mov", "in": 0.0, "out": 34.20},
    {"file": "source_002.mov", "in": 4.73, "out": 16.37}
  ]
}
```

7. Пересчитать глобальное время слов после стыка.
8. На стыке проверить движение губ, звук, повтор текста и скачок экспозиции.

## Правила

- Не склеивать по размеру файла.
- Не считать короткий файл «ненужным дублем» до расшифровки.
- Не обрезать повтор по примерной секунде.
- Не копировать звук отдельно от видео.
- Если совпадение неоднозначно, сохранить обе версии плана и потребовать ручной выбор.
