Amazon Bedrock Managed Knowledge Base kini mendukung penyematan multimodal untuk konten video, audio, dan gambar dengan TwelveLabs Marengo 3.0
AWS mengumumkan ketersediaan TwelveLabs Marengo 3.0 sebagai model penyematan di Amazon Bedrock Managed Knowledge Base, yang memungkinkan pelanggan untuk membuat penyematan multimodal untuk konten video, audio, dan gambar. Amazon Bedrock Managed Knowledge Base sudah mendukung pencarian media dengan mentranskripsikan audio dan video ke dalam teks dan menghasilkan penyematan berbasis teks—Marengo 3.0 melangkah lebih jauh dengan mengkodekan adegan visual, ucapan, dan isyarat video langsung ke dalam penyematan multimodal, menangkap makna yang tidak dapat ditangkap hanya dengan transkripsi. Cukup unggah aset media Anda dari sumber data seperti Amazon S3, sinkronkan, dan cari menggunakan bahasa alami—tanpa perlu mengelola infrastruktur apa pun.
Marengo 3.0 menghasilkan vektor 512-dimensi yang ringkas, memberikan akurasi pengambilan data yang mutakhir. Hasilnya mencakup waktu mulai dan berakhirnya segmen, yang memungkinkan aplikasi untuk langsung melompat ke momen yang relevan dalam video. Hal ini membuka kasus penggunaan di bidang analitik olahraga, media dan hiburan, keamanan, pendidikan, dan ritel—mulai dari menemukan momen-momen spesifik di berbagai musim rekaman pertandingan hingga menemukan segmen kuliah berdasarkan konsep, bukan kata kunci. Model ini menawarkan opsi segmentasi yang dapat dikonfigurasi agar sesuai dengan struktur konten Anda.
Untuk mempelajari lebih lanjut, lihat integrasi model penyematan TwelveLabs Marengo 3.0 dalam Panduan Pengguna Amazon Bedrock Knowledge Base. Untuk informasi lebih lanjut, kunjungi halaman produk Amazon Bedrock Knowledge Bases.