ЧАСОВЕ ПОКРИТТЯ ВІДЕО У ВИЯВЛЕННІ ДИПФЕЙКІВ: ТОЧНІСТЬ ТА ОБЧИСЛЮВАЛЬНІ ВИТРАТИ
DOI:
https://doi.org/10.31673/2412-4338.2026.035602Анотація
Детектори відеодипфейків часто аналізують не весь запис, а один або кілька коротких фрагментів. Якщо ознаки підробки розподілені в часі нерівномірно, результат для одного фрагмента може не характеризувати відео в цілому. Водночас збільшення кількості фрагментів майже пропорційно підвищує обчислювальні витрати. Метою роботи було визначити, скільки рівномірно розміщених фрагментів потрібно для надійного оцінювання коротких відео та після якої кількості подальше збільшення часового покриття перестає давати практично помітний приріст. Дослідження виконано з незмінним детектором, що поєднує просторові та частотні ознаки кадрів із трансформерним аналізом їх послідовності. Три повторно навчені моделі об'єднано усередненням і перевірено на окремій зовнішній вибірці з 200 узгоджених пар справжніх і підроблених відео. Для кожного відео один раз оброблено дев'ять рівномірно розміщених 16-кадрових фрагментів. Режими з одним, трьома та п'ятьма фрагментами сформовано як вкладені підмножини тієї самої дев'ятиточкової сітки. Завдяки цьому відмінності не залежали від випадкового вибору кадрів або повторного запуску моделі. ROC AUC становив 0,8349 для одного центрального фрагмента, 0,8688 для трьох, 0,8724 для п'яти та 0,8732 для дев'яти. Дев'ять фрагментів підвищили AUC відносно одного на 0,0383; p-значення дорівнювало 0,001. Три фрагменти забезпечили 88,5% цього приросту за третини максимального обчислювального бюджету, а п'ять - 97,7% за п'яти дев'ятих бюджету. Підтвердженого поліпшення між п'ятьма і дев'ятьма фрагментами не виявлено. Мінливість оцінок між фрагментами у підроблених відео була приблизно у 1,9 раза вищою, ніж у справжніх. Медіана, максимум і середнє двох найбільших оцінок не перевершили звичайного середнього. Один центральний фрагмент недостатньо представляє коротке відео за умов перенесення між датасетами. Три фрагменти є доцільним режимом за жорсткого обмеження ресурсів, а п'ять - обережним вибором поблизу виявленого плато. Висновок не поширюється автоматично на багатохвилинні записи, для яких потрібне окреме дослідження адаптивного часового відбору.
Ключові слова: цифрова форензика, часове покриття, ROC AUC, міждатасетне оцінювання, часова неоднорідність, агрегація прогнозів, аналіз відео.