ТВ Центр: интеллектуальный поиск по видеоархиву на нейросетевых детекторах
Описание проекта
«Наносемантика» оптимизировала работу телеканала с видеоархивами с помощью ИИ: усовершенствован поиск, «пересобраны» базы данных, созданы детекторы для распознавания людей и других объектов на видео, предварительно изучены варианты и выбраны подходящие модели для обучения нейросетей. Результатом стал сервис интеллектуального поиска аудиовизуального контента по системе хранения метаданных: он использует все доступные признаки медиаактивов из оптимизированных или заново созданных детекторов и классификаторов, а поиск происходит по единой векторной базе согласно текстовому запросу в свободной форме. В состав решения вошли сервис «Детектор персон», сервис классификации локаций зданий, классификатор времени суток, сезона и определения местоположения кадра (в помещении/вне помещения), сервис ретроспективного поиска близких по смыслу видео, сервис описания сцен (Video Captioning) и детектор брендов.
Вендор и технология: «Наносемантика» (Nanosemantics Lab) — нейросетевые детекторы и классификаторы, единая векторная база, поиск по свободному текстовому запросу.
Задача
Поиск по видеоархивам канала был неэффективен, из-за чего журналисты и корреспонденты слабо переиспользовали накопленные медиаактивы. Кроме того, требовалось исключить попадание в эфир изображений иноагентов и посторонней брендовой символики, чреватое штрафами и судебными разбирательствами.
Цели внедрения
-
Оптимизировать работу с видеоархивами с помощью ИИ
-
создать интеллектуальный поиск по смыслу текстового запроса в свободной форме
-
повысить переиспользование медиаактивов
-
автоматически идентифицировать иноагентов в архивных материалах
-
исключить демонстрацию ненужной брендовой символики
Результаты
-
Результаты
-
Переиспользование медиаактивов увеличилось в 10–15 раз (по внутренней оценке АО «ТВ Центр»)
-
обработка документов выросла с 2 000 до 5 000 документов в час
-
детектор персон позволил идентифицировать иноагентов и избежать нарушения законодательства и штрафов
-
распознавание брендов исключает демонстрацию ненужной символики и связанные судебные издержки Нагрузка и масштаб
-
Централизованная система хранения метаданных медиаактивов федерального телеканала Сроки
-
Проект 2022/11 — 2025/02