Сегодня пользователь ориентируется на рекомендации внутри платформы или ищет видео самостоятельно - однако последний сценарий постепенно меняется: все больше задач пользователь перекладывает на рекомендательные алгоритмы. В ближайшие годы эта модель начнет меняться снова за счет более широкого проникновения в пользовательские сценарии и привычки аудитории: так, персональный ИИ-агент сможет самостоятельно собирать подборки роликов для обучения, отдыха, работы, выбора товара или планирования досуга.
Google уже объявил о переходе поиска к модели Search agents - информационным агентам, которые могут работать в фоновом режиме и находить нужную информацию в момент, когда она становится актуальной для пользователя. YouTube, в свою очередь, уже развивает разговорный ИИ, который позволяет задавать вопросы по видео и получать рекомендации, не прерывая просмотр контента.
"Следующий этап развития видеоплатформ - это переход от борьбы за клик к борьбе за решение агента. Пользователь может даже не открыть поисковую строку и не пролистать ленту. Его цифровой помощник сам поймет задачу, отберет релевантные видео, выделит нужные фрагменты и соберет персональную карту просмотра", - говорит Косинский.
По данным Gartner, уже к 2028 году треть пользовательских сценариев может сместиться от нативных приложений к агентским интерфейсам, что приведет к появлению новых моделей монетизации и ценообразования.
Фактически видеоплатформы начинают готовиться к миру, где их контент должен быть понятен не только человеку, но и машине. Уже сегодня YouTube Data API умеет считывать и анализировать название, описание, теги видео; Google Cloud Video Intelligence определяет, что происходит на видео, а Microsoft Video Indexer делает полную расшифровку слов, находит, в какие моменты появляются лица людей, о чем говорят люди и в каком они настроении и даже видит текст на картинке (например, вывески на зданиях).
Так появляется формат "дружелюбного к агентам" видео. Ролик будущего должен быть размечен так, чтобы ИИ мог понять его содержание, оценить релевантность, найти нужный момент, сформировать выжимку, порекомендовать продолжение или встроить фрагмент в пользовательский сценарий.
На рынке уже появляются первые примеры. В Reuters сделали так, что теперь их новости, фото и видео можно не просто смотреть на сайте, а напрямую запрашивать через ИИ чат-бота. Это отличается от обычного поиска в интернете, где бот сканирует открытые страницы и пересказывает их содержимое своими словами. Это позволяет ИИ-ассистенту обращаться к закрытому хранилищу и возвращать пользователю сам медиафайл в комплекте с точными метаданными (дата, место, тема, ключевые лица) и условиями использования.
"Видеоплатформы будущего будут проектироваться, можно сказать, вокруг данных. Интерфейс останется важным, но еще одним конкурентным преимуществом станет способность быть понятным для ИИ-агента. К 2030 году видеосервис должен будет ориентироваться на интересы не только пользователей, но и ИИ-агентов. В RUTUBE мы также учитываем этот фактор в долгосрочных сценариях развития продукта", - заключил Сергей Косинский.