Оцифровка старых бумажных фото — от скана стола до готовых кадров без ручной резки
Оцифровка старых бумажных фото — от скана стола до готовых кадров без ручной резки
Дома копилась пачка бумажных фото — раскладывал их на столе, фотографировал листами и хотел получить отдельные кадры без ручной обрезки каждого.
Написал каскадный детектор из пяти проходов (otsu → canny → adaptive → eroded → otsu), которые вычитают уже найденное и убирают дубли по пересечению областей. Вокруг — две независимые части: облачный MVP (пресайн-загрузка через Yandex Cloud Function, обработка, уведомление) и локальный batch-конвейер — HEIC на входе, обрезка стола, каскадный детектор, свои веб-инструменты для ручной коррекции и сравнения.
На тестовом наборе из пятнадцати кадров каскад поднял recall с 43 до 81 найденных фото. На боевом прогоне из 191 скана нашлось 897 вырезок, после ручной чистки осталось 846 годных кадров. 22 тестовых файла покрывают обе части.