Управляемая база знаний Amazon Bedrock теперь поддерживает мультимодальные встраивания видео, аудио и изображений с помощью TwelveLabs Marengo 3.0

Проведено: 11 сент. 2026 г.

AWS объявляет о доступности TwelveLabs Marengo 3.0 в качестве модели встраивания в управляемой базе знаний Amazon Bedrock, позволяющей клиентам создавать мультимодальные встраивания для видео, аудио и изображений. Управляемая база знаний Amazon Bedrock уже поддерживает поиск медиафайлов путем транскрибирования аудио и видео и создания текстовых встраиваний. Marengo 3.0 идет дальше, кодируя визуальные сцены, речь и видеосигналы непосредственно в мультимодальные встраивания, улавливая смысл, который невозможно передать одной транскрипцией. Просто загрузите медиаресурсы из таких источников данных, как Amazon S3, синхронизируйте их и выполняйте поиск на естественном языке без необходимости управлять инфраструктурой.
Marengo 3.0 создает компактные 512-мерные векторы, обеспечивающие передовую точность поиска. Результаты включают время начала и окончания сегмента, что позволяет приложениям сразу переходить к нужному моменту видео. Это открывает возможности для использования в таких областях, как спортивная аналитика, СМИ и развлечения, безопасность, образование и розничная торговля – от поиска конкретных игровых эпизодов в записях матчей за разные сезоны до поиска фрагментов лекций по концепции, а не по ключевым словам. Модель предлагает настраиваемые параметры сегментации в соответствии со структурой контента.
Подробнее см. в разделе Интеграция модели встраивания TwelveLabs Marengo 3.0 в Руководстве пользователя Базы знаний Amazon Bedrock. Для получения дополнительной информации посетите страницу продукта «База знаний Amazon Bedrock».