Amazon Bedrock Managed Knowledge Base 现已集成 TwelveLabs Marengo 3.0,可支持视频、音频和图像内容的多模态嵌入
发布于: 2026年9月11日
AWS 宣布在 Amazon Bedrock Managed Knowledge Base 中推出 TwelveLabs Marengo 3.0 嵌入模型,使客户能够为视频、音频和图像内容创建多模态嵌入。Amazon Bedrock Managed Knowledge Base 已支持媒体搜索:先将音频和视频转写为文本,再生成基于文本的嵌入;而 Marengo 3.0 则更进一步,它直接将视觉画面、语音和视频线索编码为多模态嵌入,从而捕获仅靠文本转写无法获取的语义。只需从 Amazon S3 等数据来源上传您的媒体资产,进行同步,即可使用自然语言进行搜索,无需管理任何基础设施。
Marengo 3.0 可生成紧凑的 512 维向量,并提供业界顶尖的检索精度。返回结果会包含片段的开始时间与结束时间,以便应用程序能够直接跳转至视频中的对应时刻。这为体育赛事分析、媒体娱乐、安防、教育和零售等领域解锁了丰富的应用场景,从通过观看多个赛季的比赛录像来找出具体战术,到按概念(而非关键字)找到课程视频片段。该模型提供可配置的分段选项,以贴合您的内容结构。
要了解更多信息,请参阅《Amazon Bedrock 知识库用户指南》中的 TwelveLabs Marengo 3.0 嵌入模型集成。有关更多信息,请访问 Amazon Bedrock 知识库产品页面。