Amazon Bedrock

  • Harga Model
  • Harga Model

    Harga bergantung pada modalitas, penyedia, dan model. Silakan pilih penyedia model untuk melihat harga terperinci.

    Amazon Bedrock mendukung berbagai tingkatan termasuk tingkatan Standar, Flex, Prioritas, dan Cadangan. Klik untuk mempelajari lebih lanjut tentang tingkatan layanan.

    Amazon Bedrock menawarkan model fondasi (FM) pilihan dari penyedia AI terkemuka, seperti Anthropic, Meta, Mistral AI, dan Amazon untuk inferensi batch dengan harga hingga 50% lebih rendah dibandingkan dengan harga inferensi sesuai permintaan. Untuk mempelajari lebih lanjut tentang Batch, klik di sini. Silakan merujuk ke daftar model di sini

    • AI21 Labs
    • AI21 Labs

      Harga Sesuai Permintaan

    • Amazon
      • Amazon Nova
      • Amazon Nova

        Harga untuk Model Pemahaman

        Inferensi Lintas Wilayah Global

        Inferensi lintas wilayah geografis dan dalam wilayah

        Alat Bawaan

        Harga untuk model Pembuatan Konten Kreatif

        Harga untuk Model Pemahaman dan Pembuatan Ucapan

        Harga Sesuai Permintaan untuk model fondasi ucapan ke ucapan

        Catatan: *Harga input dan output token teks berlaku untuk kasus penggunaan tertentu, seperti transkripsi ucapan-ke-teks, panggilan alat untuk penyelesaian tugas atau landasan pengetahuan, penambahan riwayat percakapan ke sesi, dll. 

        Inferensi sesuai permintaan untuk model Nova kustom dikenai harga yang sama dengan inferensi Nova dasar.

        Harga untuk model Penyematan

      • Amazon Titan
      • Amazon Titan

      • Amazon Lainnya
    • Anthropic
    • **Model Non-GA: Akses ke Claude Mythos 5 dan Claude Mythos Preview dibatasi dan memerlukan persetujuan. Hubungi tim akun Anthropic Anda untuk meminta akses di Bedrock.

      Anthropic

      Harga Sesuai Permintaan dan Batch

      Model dengan akses yang diperluas

      Penyedia Nama Model Wilayah Harga per 1 juta token input Harga per 1 juta token output Harga per 1 juta token input (batch) Harga per 1 juta token output (batch) Harga per 1 juta token input (penulisan cache) Harga per 1 juta token input (pembacaan cache)
       Anthropic  Claude 3.5 Sonnet (Akses Diperluas Publik, Efektif 1 Desember 2025) AS Timur (Virginia Utara), AS Timur (Ohio), AS Barat (Oregon), Eropa (Frankfurt), Eropa (Irlandia), Eropa (Zürich), Eropa (Paris) 6,00 USD 30,00 USD 3,00 USD 15,00 USD N/A N/A
      Anthropic  Claude 3.5 Sonnet v2 (Akses Diperluas Publik, Efektif 1 Desember 2025) AS Timur (Virginia Utara), AS Timur (Ohio), AS Barat (Oregon) 6,00 USD 30,00 USD 3,00 USD 15,00 USD 7,50 USD 0,60 USD

      Harga Tingkat Reservasi

      Inferensi yang Dioptimalkan Latensi

      Harga Throughput yang Disediakan

      Untuk harga Throughput yang Disediakan, silakan hubungi tim akun Anda.

    • Cohere
    • Cohere

      Harga Sesuai Permintaan

      Model Cohere Harga per 1.000 kueri**
      Rerank 3.5 2,00 USD
      **Anda dikenakan biaya untuk jumlah kueri di mana kueri dapat berisi hingga 100 potongan dokumen. Jika kueri berisi lebih dari 100 potongan dokumen, itu dihitung sebagai beberapa kueri. Misalnya, jika permintaan berisi 350 dokumen, itu akan diperlakukan sebagai 4 kueri. Perhatikan bahwa setiap dokumen hanya dapat berisi hingga 500 token (termasuk kueri dan token total dokumen), dan jika panjang token lebih tinggi dari 512 token, itu dipecah menjadi beberapa dokumen.

      *Total token yang dilatih = jumlah token dalam korpus data pelatihan x jumlah epoch

      Harga Provisioned Throughput

      Model Cohere Harga per jam per model 
      tanpa komitmen
      Harga per jam per unit model untuk komitmen 1 bulan

      Harga per jam per unit model untuk komitmen 6 bulan

      Cohere Command

      49,50 USD

      39,60 USD

      23,77 USD

      Cohere Command - Light 8,56 USD

      6,85 USD

      4,11 USD
      Embed 3 English 7,12 USD

      6,76 USD

      6,41 USD
      Embed 3 Multilingual 7,12 USD

      6,76 USD

      6,41 USD

      Hubungi tim akun atau penjualan AWS Anda untuk mendapatkan detail selengkapnya tentang unit model. 

    • DeepSeek
    • DeepSeek

      Harga Sesuai Permintaan

      • Standar
      • Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

        Model DeepSeek Harga per 1 juta token input Harga per 1 juta token output
        DeepSeek v3.2 0,62 USD 1,85 USD

        Wilayah: Asia Pasifik (Mumbai), Amerika Selatan (Sao Paulo), Asia Pasifik (Jakarta), Asia Pasifik (Tokyo) dan Eropa (Stockholm)

        Model DeepSeek Harga per 1 juta token input Harga per 1 juta token output
        DeepSeek v3.2 0,74 USD 2,22 USD

        Wilayah: Asia Pasifik (Sydney)

        Model DeepSeek Harga per 1 juta token input Harga per 1 juta token output
        DeepSeek v3.1 0,5974 USD 1,7304 USD
        DeepSeek v3.2 0,6386 USD 1,9055 USD
      • Prioritas
      • Wilayah: Asia Pasifik (Sydney)

        Model DeepSeek Harga per 1 juta token input Harga per 1 juta token output
        DeepSeek v3.1 1,0455 USD 3,0282 USD
      • Flex
      • Wilayah: Asia Pasifik (Sydney)

        Model DeepSeek Harga per 1 juta token input Harga per 1 juta token output
        DeepSeek v3.1 0,2987 USD 0,8652 USD
    • Google
    • Google

      Harga Sesuai Permintaan

      Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

      Model Google Harga per 1 juta token input Harga per 1 juta token output
      Gemma 4 31B 0,14 USD 0,40 USD
      Gemma 4 26B A4B 0,13 USD 0,40 USD
      Gemma 4 E2B 0,04 USD 0,08 USD
      Gemma 3 4B 0,04 USD 0,08 USD
      Gemma 3 12B 0,09 USD 0,29 USD
      Gemma 3 27B 0,23 USD 0,38 USD

      Wilayah: Eropa (Frankfurt)

      Model Google Harga per 1 juta token input Harga per 1 juta token output
      Gemma 4 31B 0,17 USD 0,48 USD
      Gemma 4 26B A4B 0,16 USD 0,48 USD
      Gemma 4 E2B 0,05 USD 0,10 USD

      Wilayah: Asia Pasifik (Mumbai), Eropa (Irlandia), dan Eropa (Milan)

      Model Google Harga per 1 juta token input Harga per 1 juta token output
      Gemma 3 4B 0,05 USD 0,09 USD
      Gemma 3 12B 0,11 USD 0,34 USD
      Gemma 3 27B 0,27 USD 0,45 USD

      Wilayah: Amerika Selatan (Sao Paulo) dan Asia Pasifik (Tokyo)

      Model Google Harga per 1 juta token input Harga per 1 juta token output
      Gemma 3 4B 0,05 USD 0,10 USD
      Gemma 3 12B 0,11 USD 0,35 USD
      Gemma 3 27B 0,28 USD 0,46 USD

      Wilayah: Eropa (London) 

      Model Google Harga per 1 juta token input Harga per 1 juta token output
      Gemma 3 4B 0,06 USD 0,12 USD
      Gemma 3 12B 0,14 USD 0,45 USD
      Gemma 3 27B 0,36 USD 0,59 USD

      Wilayah: Asia Pasifik (Sydney)

      Model Google Harga per 1 juta token input Harga per 1 juta token output
      Gemma 3 4B 0,0412 USD 0,0824 USD
      Gemma 3 12B 0,0927 USD 0,2987 USD
      Gemma 3 27B 0,2369 USD 0,3914 USD

      * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
      * Harga tingkat Flex mendapatkan diskon 50% dibandingkan harga tingkat Standar

    • Luma AI
    • Luma AI

      Harga Sesuai Permintaan

    • Meta
    • Meta

      Llama 4

      Harga Sesuai Permintaan dan Batch 

      Llama 3.3

      Harga Sesuai Permintaan dan Batch

      Llama 3.2

      Harga Sesuai Permintaan dan Batch

      Harga untuk kustomisasi model (penyempurnaan)

      Harga Throughput yang Disediakan

      Llama 3.1

      Harga Sesuai Permintaan dan Batch

      Harga untuk kustomisasi model (penyempurnaan)

      Harga Throughput yang Disediakan

      Llama 3

      Harga Sesuai Permintaan 

      Llama 2

      Harga Sesuai Permintaan 

      Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

      Model Meta Harga per 1 juta token input Harga per 1 juta token output

      Llama 2 Chat (13B)

      0,75 USD

      1,00 USD

      Llama 2 Chat (70B)

      1,95 USD

      2,56 USD

      Harga untuk kustomisasi model (penyempurnaan)

      Model Meta Harga untuk melatih 1 juta token Harga untuk menyimpan setiap model khusus* per bulan Harga untuk inferensi model khusus untuk 1 unit model per jam (dengan harga Provisioned Throughput tanpa komitmen)

      Llama 2 Pretrained (13B)

      1,49 USD

      1,95 USD

      23,50 USD

      Llama 2 Pretrained (70B)

      7,99 USD

      1,95 USD 23,50 USD

      *Penyimpanan model khusus = 1,95 USD

      Harga Provisioned Throughput

      Model Meta Harga per jam per unit model untuk komitmen 1 bulan Harga per jam per unit model untuk komitmen 6 bulan

      Llama 2 Pretrained and Chat (13B)

      21,18 USD

      13,08 USD

      Llama 2 Pretrained (70B)

      21,18 USD

      13,08 USD

      *Model Llama 2 Pre-trained hanya tersedia dalam provisioned throughput setelah penyesuaian.

      Hubungi tim akun atau penjualan AWS Anda untuk detail selengkapnya tentang unit model.

    • MiniMax AI
    • MiniMax AI

      Harga Sesuai Permintaan

      Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

      Model Minimax Harga per 1 juta token input Harga per 1 juta token output
      Minimax M2 0,30 USD 1,20 USD
      Minimax M2.1 0,30 USD 1,20 USD
      MiniMax M2.5 0,30 USD 1,20 USD

      Wilayah: Asia Pasifik (Mumbai), Eropa (Irlandia), dan Eropa (Milan)

      Model Minimax Harga per 1 juta token input Harga per 1 juta token output
      Minimax M2 0,35 USD 1,41 USD
      Minimax M2.1 0,36 USD 1,44 USD
      Minimax M2.5 0,36 USD 1,44 USD

      Wilayah: Amerika Selatan (Sao Paulo) dan Asia Pasifik (Tokyo)

      Model Minimax Harga per 1 juta token input Harga per 1 juta token output
      Minimax M2 0,36 USD 1,45 USD
      Minimax M2.1 0,36 USD 1,44 USD
      Minimax M2.5 0,36 USD 1,44 USD

      Wilayah: Eropa (London) 

      Model Minimax Harga per 1 juta token input Harga per 1 juta token output
      Minimax M2 0,47 USD 1,86 USD
      Minimax M2.1 0,47 USD 1,86 USD
      Minimax M2.5 0,47 USD 1,86 USD

      Wilayah: Eropa (Frankfurt), Eropa (Stockholm), Asia Pasifik (Jakarta)

      Model Minimax Harga per 1 juta token input Harga per 1 juta token output
      Minimax M2.1 0,36 USD 1,44 USD
      Minimax M2.5 0,36 USD 1,44 USD

      Wilayah: Asia Pasifik (Sydney)

      Model Minimax Harga per 1 juta token input Harga per 1 juta token output
      Minimax M2 0,3090 USD 1,2360 USD
      Minimax M2.1 0,3090 USD 1,2360 USD
      Minimax M2.5 0,31 USD 1,24 USD

      * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
      * Harga tingkat Flex mendapatkan diskon 50% dibandingkan harga tingkat Standar

    • Mistral AI
    • Mistral AI

      Harga Sesuai Permintaan

      Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

      Model Mistral Harga per 1 juta token input Harga per 1 juta token output
      Devstral 2 123B 0,40 USD 2,00 USD
      Magistral Small 1.2
      0,50 USD 1,50 USD
      Voxtral Mini 1.0
      0,04 USD 0,04 USD
      Voxtral Small 1.0
      0,10 USD 0,30 USD
      Ministral 3B 3.0
      0,10 USD 0,10 USD
      Ministral 8B 3.0
      0,15 USD 0,15 USD
      Ministral 14B 3.0
      0,20 USD 0,20 USD
      Mistral Large 3 0,50 USD 1,50 USD

      Wilayah: Asia Pasifik (Mumbai)

      Model Mistral Harga per 1 juta token input Harga per 1 juta token output
      Devstral 2 123B 0,48 USD 2,40 USD
      Magistral Small 1.2
      0,59 USD 1,76 USD
      Voxtral Mini 1.0
      0,05 USD 0,05 USD
      Voxtral Small 1.0
      0,12 USD 0,35 USD
      Ministral 3B 3.0
      0,12 USD 0,12 USD
      Ministral 8B 3.0
      0,18 USD 0,18 USD
      Ministral 14B 3.0
      0,24 USD 0,24 USD
      Mistral Large 3 0,59 USD 1,76 USD

      Wilayah: Amerika Selatan (Sao Paulo) dan Asia Pasifik (Tokyo)

      Model Mistral Harga per 1 juta token input Harga per 1 juta token output
      Devstral 2 123B 0,48 USD 2,40 USD
      Magistral Small 1.2
      0,61 USD 1,82 USD
      Voxtral Mini 1.0
      0,05 USD 0,05 USD
      Voxtral Small 1.0
      0,12 USD 0,36 USD
      Ministral 3B 3.0
      0,12 USD 0,12 USD
      Ministral 8B 3.0
      0,18 USD 0,18 USD
      Ministral 14B 3.0
      0,24 USD 0,24 USD
      Mistral Large 3 0,61 USD 1,82 USD

      Wilayah: Eropa (Irlandia) dan Eropa (Milan)

      Model Mistral Harga per 1 juta token input Harga per 1 juta token output
      Devstral 2 123B 0,48 USD 2,40 USD
      Magistral Small 1.2
      0,59 USD 1,76 USD
      Voxtral Mini 1.0
      0,05 USD 0,05 USD
      Voxtral Small 1.0
      0,12 USD 0,35 USD
      Ministral 3B 3.0
      0,12 USD 0,12 USD
      Ministral 8B 3.0
      0,18 USD 0,18 USD
      Ministral 14B 3.0
      0,24 USD 0,24 USD

      Wilayah: Eropa (London) 

      Model Mistral Harga per 1 juta token input Harga per 1 juta token output
      Devstral 2 123B 0,62 USD 3,10 USD
      Magistral Small 1.2
      0,78 USD 2,33 USD
      Voxtral Mini 1.0
      0,06 USD 0,06 USD
      Voxtral Small 1.0
      0,16 USD 0,47 USD
      Ministral 3B 3.0
      0,16 USD 0,16 USD
      Ministral 8B 3.0
      0,23 USD 0,23 USD
      Ministral 14B 3.0
      0,31 USD 0,31 USD

      Wilayah: Asia Pasifik (Sydney)

      Model Mistral Harga per 1 juta token input Harga per 1 juta token output
      Devstral 2 123B 0,41 USD 2,06 USD
      Magistral Small 1.2
      0,5150 USD 1,5450 USD
      Voxtral Mini 1.0
      0,0412 USD 0,0412 USD
      Voxtral Small 1.0
      0,1030 USD 0,3090 USD
      Ministral 3B 3.0
      0,1030 USD 0,1030 USD
      Ministral 8B 3.0
      0,1545 USD 0,1545 USD
      Ministral 14B 3.0
      0,2060 USD 0,2060 USD
      Mistral Large 3 0,5150 USD 1,5450 USD

      Wilayah: Asia Pasifik (Jakarta), Eropa (Frankfurt), Eropa (Stockholm)

      Model Mistral Harga per 1 juta token input Harga per 1 juta token output
      Devstral 2 123B 0,48 USD 2,40 USD

      * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
      * Harga tingkat Flex mendapatkan diskon 50% dibandingkan harga tingkat Standar

    • Moonshot AI
    • Moonshot AI

      Harga Sesuai Permintaan

      Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

      Model Kimi Harga per 1 juta token input Harga per 1 juta token output
      Kimi K2 Thinking 0,60 USD 2,50 USD
      Kimi K2.5 0,60 USD 3,00 USD

      Wilayah: Asia Pasifik (Mumbai)

      Model Kimi Harga per 1 juta token input Harga per 1 juta token output
      Kimi K2 Thinking 0,71 USD 2,94 USD
      Kimi K2.5 0,72 USD 3,60 USD

      Wilayah: Amerika Selatan (Sao Paulo) dan Asia Pasifik (Tokyo)

      Model Kimi Harga per 1 juta token input Harga per 1 juta token output
      Kimi K2 Thinking 0,73 USD 3,03 USD
      Kimi K2.5 0,72 USD 3,60 USD

      Wilayah: Eropa (Stockholm), Asia Pasifik (Jakarta)

      Model Kimi Harga per 1 juta token input Harga per 1 juta token output
      Kimi K2.5 0,72 USD 3,60 USD

      Wilayah: Asia Pasifik (Sydney)

      Model Kimi Harga per 1 juta token input Harga per 1 juta token output
      Kimi K2 Thinking 0,6180 USD 2,5750 USD
      Kimi K2.5 0,6180 USD 3,0900 USD

      * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
      * Harga tingkat Flex mendapatkan diskon 50% dibandingkan harga tingkat Standar

    • NVIDIA
    • NVIDIA

      Harga Sesuai Permintaan

      Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

      Model NVIDIA Harga per 1 juta token input Harga per 1 juta token output
      NVIDIA Nemotron Nano 2 0,06 USD 0,23 USD
      NVIDIA Nemotron Nano 2 VL 0,20 USD 0,60 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,06 USD 0,24 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,15 USD 0,65 USD

      Wilayah: AWS GovCloud (AS-Timur dan AS-Barat)

      Model NVIDIA Harga per 1 juta token input Harga per 1 juta token output
      NVIDIA Nemotron Nano 2 0,072 USD 0,276 USD
      NVIDIA Nemotron Nano 2 VL 0,240 USD 0,720 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,072 USD 0,288 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,180 USD 0,780 USD

      Wilayah: Asia Pasifik (Mumbai), Eropa (Irlandia), dan Eropa (Milan)

      Model NVIDIA Harga per 1 juta token input Harga per 1 juta token output
      NVIDIA Nemotron Nano 2 0,07 USD 0,27 USD
      NVIDIA Nemotron Nano 2 VL 0,24 USD 0,71 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,07 USD 0,28 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,18 USD 0,78 USD

      Wilayah: Amerika Selatan (Sao Paulo) dan Asia Pasifik (Tokyo)

      Model NVIDIA Harga per 1 juta token input Harga per 1 juta token output
      NVIDIA Nemotron Nano 2 0,07 USD 0,28 USD
      NVIDIA Nemotron Nano 2 VL 0,24 USD 0,73 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,07 USD 0,29 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,18 USD 0,78 USD

      Wilayah: Eropa (London) 

      Model NVIDIA Harga per 1 juta token input Harga per 1 juta token output
      NVIDIA Nemotron Nano 2 0,09 USD 0,36 USD
      NVIDIA Nemotron Nano 2 VL 0,31 USD 0,93 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,09 USD 0,37 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,23 USD 1,01 USD

      Wilayah: Asia Pasifik (Sydney)

      Model NVIDIA Harga per 1 juta token input Harga per 1 juta token output
      NVIDIA Nemotron Nano 2 0,0618 USD 0,2369 USD
      NVIDIA Nemotron Nano 2 VL 0,2060 USD 0,6180 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0,0618 USD 0,2472 USD
      NVIDIA Nemotron 3 Super 120B A12B 0,15 USD 0,67 USD

      Wilayah: Asia Pasifik (Jakarta), Eropa (Frankfurt), dan Eropa (Stockholm)

      Model NVIDIA Harga per 1 juta token input Harga per 1 juta token output
      NVIDIA Nemotron 3 Super 120B A12B 0,18 USD 0,78 USD

      * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
      * Harga tingkat Flex dan Batch mendapatkan diskon 50% dibandingkan harga tingkat Standar

    • OpenAI
    • OpenAI

      • Model Frontier
      • Inferensi sesuai permintaan dalam wilayah

        Wilayah: AS Timur (Ohio)

          Jendela Konteks Pendek (272.000) Jendela Konteks Panjang (1 juta)
        Model OpenAI Harga per 1 juta token input Harga per 1 juta token input (penulisan cache 30 menit) Harga per 1 juta token input (pembacaan cache) Harga per 1 juta token output Harga per 1 juta token input Harga per 1 juta token input (penulisan cache 30 menit) Harga per 1 juta token input (pembacaan cache) Harga per 1 juta token output
        Daybreak Red: GPT-5.6 Cyber 13,75 USD 17,1875 USD 1,375 USD 82,50 USD  -  -  -  -
        Daybreak Blue: GPT-5.6 Sol 5,50 USD 6,875 USD 0,55 USD 33,00 USD 11,00 USD 13,75 USD 1,10 USD 49,50 USD
        GPT-5.6 Sol 5,50 USD 6,875 USD 0,55 USD 33,00 USD 11,00 USD 13,75 USD 1,10 USD 49,50 USD
        GPT-5.6 Terra 2,20 USD 2,75 USD 0,22 USD 13,20 USD 4,40 USD 5,50 USD 0,44 USD 19,80 USD
        GPT-5.6 Luna 0,22 USD 0,275 USD 0,022 USD 1,32 USD 0,44 USD 0,55 USD 0,044 USD 1,98 USD
        GPT-5.5 5,50 USD - 0,55 USD 33,00 USD  -  -  -  -
        GPT-5.4 2,75 USD - 0,275 USD 16,50 USD  -  -  -  -

        Wilayah: AS Timur (Virginia Utara)

          Jendela Konteks Pendek (272K) Jendela Konteks Panjang (1 juta)
        Model OpenAI Harga per 1 juta token input Harga per 1 juta token input (penulisan cache 30 menit) Harga per 1 juta token input (pembacaan cache) Harga per 1 juta token output Harga per 1 juta token input Harga per 1 juta token input (penulisan cache 30 menit) Harga per 1 juta token input (pembacaan cache) Harga per 1 juta token output
        GPT-5.6 Sol 5,50 USD 6,875 USD 0,55 USD 33,00 USD 11,00 USD 13,75 USD 1,10 USD 49,50 USD
        GPT-5.6 Terra 2,20 USD 2,75 USD 0,22 USD 13,20 USD 4,40 USD 5,50 USD 0,44 USD 19,80 USD
        GPT-5.6 Luna 0,22 USD 0,275 USD 0,022 USD 1,32 USD 0,44 USD 0,55 USD 0,044 USD 1,98 USD
        GPT-5.5 5,50 USD - 0,55 USD 33,00 USD  -  -  -  -
        GPT-5.4 2,75 USD - 0,275 USD 16,50 USD  -  -  -  -

        Wilayah: AS Barat (Oregon)

          Jendela Konteks Pendek (272K) Jendela Konteks Panjang (1 juta)
        Model OpenAI Harga per 1 juta token input Harga per 1 juta token input (penulisan cache 30 menit) Harga per 1 juta token input (pembacaan cache) Harga per 1 juta token output Harga per 1 juta token input Harga per 1 juta token input (penulisan cache 30 menit) Harga per 1 juta token input (pembacaan cache) Harga per 1 juta token output
        GPT-5.6 Terra 2,20 USD 2,75 USD 0,22 USD 13,20 USD 4,40 USD 5,50 USD 0,44 USD 19,80 USD
        GPT-5.6 Luna 0,22 USD 0,275 USD 0,022 USD 1,32 USD 0,44 USD 0,55 USD 0,044 USD 1,98 USD
        GPT-5.4 2,75 USD - 0,275 USD 16,50 USD  -  -  -  -

        Wilayah: AWS GovCloud (AS-Barat)

        Model OpenAI Harga per 1 juta token input Harga per 1 juta token input yang di-cache Harga per 1 juta token output
        GPT-5.4 3,30 USD 0,33 USD 19,80 USD

        Catatan: Inferensi dalam wilayah dihargai setara dengan tingkat residensi data OpenAI. Harga inferensi lintas wilayah global segera hadir.

      • gpt-oss-20b, 120b
        • Standar
        • Wilayah: Asia Pasifik (Sydney)

          Model OpenAI Harga per 1 juta token input Harga per 1 juta token output
          gpt-oss-20b 0,0721 USD 0,3090 USD
          gpt-oss-120b 0,1545 USD 0,6180 USD
        • Prioritas
        • Wilayah: Asia Pasifik (Sydney)

          Model OpenAI Harga per 1 juta token input Harga per 1 juta token output
          gpt-oss-20b 0,1262 USD 0,5408 USD
          gpt-oss-120b 0,2704 USD 1,0815 USD
        • Flex
        • Wilayah: Asia Pasifik (Sydney)

          Model OpenAI Harga per 1 juta token input Harga per 1 juta token output
          gpt-oss-20b 0,0361 USD 0,1545 USD
          gpt-oss-120b 0,0773 USD 0,3090 USD
        • Batch
        • Wilayah: Asia Pasifik (Sydney)

          Model OpenAI Harga per 1 juta token input Harga per 1 juta token output
          gpt-oss-20b 0,0361 USD 0,1545 USD
          gpt-oss-120b 0,0773 USD 0,3090 USD
        • Kustomisasi Model
        • Kustomisasi Model

          Harga Penyempurnaan dengan Penguatan

          Dengan kapabilitas Penyempurnaan dengan Penguatan di Amazon Bedrock, Anda dapat meningkatkan akurasi model tanpa memerlukan keahlian machine learning mendalam atau kumpulan data berlabel dalam jumlah besar. Amazon Bedrock mengotomatiskan alur kerja penyempurnaan dengan penguatan. Layanan ini mengambil sampel prompt Anda, menghasilkan respons model, dan menilainya menggunakan fungsi hadiah Anda. Prompt, respons, dan skor tersebut kemudian digunakan untuk melatih model Anda melalui alur kerja RFT yang bersifat iteratif. 

          Seluruh alur kerja pelatihan dikenakan biaya dengan tarif per jam. Setelah pelatihan selesai, pelanggan dapat segera menggunakan model yang disempurnakan yang dihasilkan untuk inferensi sesuai permintaan. Opsi inferensi sesuai permintaan mencakup model harga berbasis token yang mengenakan biaya berdasarkan jumlah token yang diproses selama inferensi.

          Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

          Model OpenAI Harga per jam pelatihan Harga per 1 juta token input Harga per 1 juta token output Harga untuk menyimpan setiap model yang dilatih per bulan
          gpt-oss-20b 80,00 USD 0,09 USD 0,39 USD 1,95 USD
      • gpt-oss-safeguard 20b, 120b
      • Harga Sesuai Permintaan

        Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

        Model OpenAI Harga per 1 juta token input Harga per 1 juta token output
        GPT OSS Safeguard 20B 0,07 USD 0,20 USD
        GPT OSS Safeguard 120B 0,15 USD 0,60 USD

        Wilayah: Asia Pasifik (Mumbai), Amerika Selatan (Sao Paulo), dan Asia Pasifik (Tokyo)

        Model OpenAI Harga per 1 juta token input Harga per 1 juta token output
        GPT OSS Safeguard 20B 0,08 USD 0,24 USD
        GPT OSS Safeguard 120B 0,18 USD 0,71 USD

        Wilayah: Eropa (Irlandia) dan Eropa (Milan)

        Model OpenAI Harga per 1 juta token input Harga per 1 juta token output
        GPT OSS Safeguard 20B 0,08 USD 0,23 USD
        GPT OSS Safeguard 120B 0,18 USD 0,70 USD

        Wilayah: Eropa (London) 

        Model OpenAI Harga per 1 juta token input Harga per 1 juta token output
        GPT OSS Safeguard 20B 0,11 USD 0,31 USD
        GPT OSS Safeguard 120B 0,23 USD 0,93 USD

        Wilayah: Asia Pasifik (Sydney)

        Model OpenAI Harga per 1 juta token input Harga per 1 juta token output
        GPT OSS Safeguard 20B 0,0721 USD 0,2060 USD
        GPT OSS Safeguard 120B 0,1545 USD 0,6180 USD

        * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
        * Harga tingkat Flex dan Batch mendapatkan diskon 50% dibandingkan harga tingkat Standar.

    • Qwen
    • Amazon Bedrock

      Qwen

      • Qwen3 Coder, 32B, 235B
        • Standar
        • Wilayah: Asia Pasifik (Sydney)

          Model Qwen Harga per 1 juta token input Harga per 1 juta token output
          Qwen3 Coder 30B A3B 0,1545 USD 0,6180 USD
          Qwen3 32B 0,1545 USD 0,6180 USD
          Qwen3 235B A22B 2507 0,2266 USD 0,9064 USD
        • Prioritas
        • Wilayah: Asia Pasifik (Sydney)

          Model Qwen Harga per 1 juta token input Harga per 1 juta token output
          Qwen3 Coder 30B A3B 0,2704 USD 1,0815 USD
          Qwen3 32B 0,2704 USD 1,0815 USD
          Qwen3 235B A22B 2507 0,3966 USD 1,5862 USD
        • Flex
        • Wilayah: Asia Pasifik (Sydney)

          Model Qwen Harga per 1 juta token input Harga per 1 juta token output
          Qwen3 Coder 30B A3B 0,0773 USD 0,3090 USD
          Qwen3 32B 0,0773 USD 0,3090 USD
          Qwen3 235B A22B 2507 0,1133 USD 0,4532 USD
        • Batch
        • Wilayah: Asia Pasifik (Sydney)

          Model Qwen Harga per 1 juta token input Harga per 1 juta token output
          Qwen3 Coder 30B A3B 0,0773 USD 0,3090 USD
          Qwen3 32B 0,0773 USD 0,3090 USD
          Qwen3 235B A22B 2507 0,1133 USD 0,4532 USD
        • Kustomisasi Model
        • Kustomisasi Model

          Harga Penyempurnaan dengan Penguatan

          Dengan kapabilitas Penyempurnaan dengan Penguatan di Amazon Bedrock, Anda dapat meningkatkan akurasi model tanpa memerlukan keahlian machine learning mendalam atau kumpulan data berlabel dalam jumlah besar. Amazon Bedrock mengotomatiskan alur kerja penyempurnaan dengan penguatan. Layanan ini mengambil sampel prompt Anda, menghasilkan respons model, dan menilainya menggunakan fungsi hadiah Anda. Prompt, respons, dan skor tersebut kemudian digunakan untuk melatih model Anda melalui alur kerja RFT yang bersifat iteratif.

          Seluruh alur kerja pelatihan dikenakan biaya dengan tarif per jam. Setelah pelatihan selesai, pelanggan dapat segera menggunakan model yang disempurnakan yang dihasilkan untuk inferensi sesuai permintaan. Opsi inferensi sesuai permintaan mencakup model harga berbasis token yang mengenakan biaya berdasarkan jumlah token yang diproses selama inferensi.

          Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

          Model Qwen Harga per jam pelatihan Harga per 1 juta token input Harga per 1 juta token output Harga untuk menyimpan setiap model yang dilatih per bulan
          Qwen3 32B 80,00 USD 0,20 USD 0,78 USD 1,95 USD
      • Qwen 3 Next, VL, Coder Next
      • Harga Sesuai Permintaan

        Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

        Model Qwen Harga per 1 juta token input Harga per 1 juta token output
        Qwen3 Next 80B A3B 0,15 USD 1,20 USD
        Qwen3 VL 235B A22B 0,53 USD 2,66 USD
        Qwen3 Coder Next 0,50 USD 1,20 USD

        Wilayah: Asia Pasifik (Mumbai), Eropa (Irlandia), dan Eropa (Milan)

        Model Qwen Harga per 1 juta token input Harga per 1 juta token output
        Qwen3 Next 80B A3B 0,18 USD 1,41 USD
        Qwen3 VL 235B A22B 0,62 USD 3,13 USD
        Qwen3 Coder Next 0,60 USD 1,44 USD

        Wilayah: Amerika Selatan (Sao Paulo) dan Asia Pasifik (Tokyo)

        Model Qwen Harga per 1 juta token input Harga per 1 juta token output
        Qwen3 Next 80B A3B 0,18 USD 1,45 USD
        Qwen3 VL 235B A22B 0,64 USD 3,22 USD
        Qwen3 Coder Next 0,60 USD 1,44 USD

        Wilayah: Eropa (London) 

        Model Qwen Harga per 1 juta token input Harga per 1 juta token output
        Qwen3 Next 80B A3B 0,23 USD 1,86 USD
        Qwen3 VL 235B A22B 0,82 USD 4,12 USD
        Qwen3 Coder Next 0,78 USD 1,86 USD

        Wilayah: Eropa (Frankfurt) dan Asia Pasifik (Jakarta)

        Model Qwen Harga per 1 juta token input Harga per 1 juta token output
        Qwen3 Coder Next 0,60 USD 1,44 USD

        Wilayah: Asia Pasifik (Sydney)

        Model Qwen Harga per 1 juta token input Harga per 1 juta token output
        Qwen3 Next 80B A3B 0,1545 USD 1,2360 USD
        Qwen3 VL 235B A22B 0,5459 USD 2,7398 USD
        Qwen3 Coder Next 0,5150 USD 1,2360 USD

        * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
        * Harga tingkat Flex dan Batch mendapatkan diskon 50% dibandingkan harga tingkat Standar.

    • Stability AI
    • Stability AI

      Harga Sesuai Permintaan

      Pembuatan sebelumnya dari model gambar yang ditawarkan oleh Stability AI dihargai per gambar, bergantung pada jumlah langkah dan resolusi gambar.

       

      Wilayah: Oregon, Virginia Utara, Ohio

      Layanan Gambar Stability AI Harga per pembuatan untuk setiap model  
      Penghapusan Latar Belakang Stable Image 0,07 USD  
      Penghapusan Objek Stable Image 0,07 USD  
      Kontrol Struktur Stable Image 0,07 USD  
      Kontrol Sketsa Stable Image 0,07 USD  
      Panduan Gaya Stable Image 0,07 USD  
      Pencarian dan Penggantian Stable Image 0,07 USD  
      Inpaint Stable Image 0,07 USD  
      Pencarian dan Pewarnaan Ulang Stable Image 0,07 USD  
      Transfer Gaya Stable Image 0,08 USD  
      Peningkatan Konservatif Stable Image 0,40 USD  
      Peningkatan Kreatif Stable Image 0,60 USD  
      Peningkatan Cepat Stable Image 0,03 USD  
      Outpaint Stable Image 0,06 USD  
    • TwelveLabs
    • TwelveLabs

      Harga Sesuai Permintaan

      • Inferensi Lintas Wilayah Global
      • Inferensi Geografis, Dalam Wilayah, dan Lintas Wilayah
    • Writer
    • Penulis

      Harga sesuai permintaan

      Model Writer Harga per 1 juta token input Harga per 1 juta token output
      Palmyra X4 2,50 USD 10,00 USD
      Palmyra X5 0,60 USD 6,00 USD
      Palmyra Vision 7B 0,15 USD 0,60 USD
    • xAI
    • xAI

      Harga Sesuai Permintaan

      Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

      Model xAI Harga per 1 juta token input Harga per 1 juta token input yang di-cache Harga per 1 juta token output
      Grok 4.3 1,25 USD 0,20 USD 2,50 USD
    • Z AI
    • Amazon Bedrock

      Z AI

      • GLM 5
      • Harga Sesuai Permintaan

        Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 5 1,00 USD 3,20 USD

        Wilayah: Asia Pasifik (Jakarta), Asia Pasifik (Mumbai), Asia Pasifik (Tokyo), Amerika Selatan (Sao Paulo), dan Eropa (Stockholm)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 5 1,20 USD 3,84 USD

        Wilayah: Eropa (London) 

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 5 1,55 USD 4,96 USD

        Wilayah: Asia Pasifik (Sydney)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 5 1,03 USD 3,30 USD

        * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
        * Harga tingkat Flex dan Batch mendapatkan diskon 50% dibandingkan harga tingkat Standar.

      • GLM 4.7
      • Harga Sesuai Permintaan

        Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 4.7 0,60 USD 2,20 USD

        Wilayah: Asia Pasifik (Jakarta), Asia Pasifik (Mumbai), Asia Pasifik (Tokyo), Amerika Selatan (Sao Paulo), dan Eropa (Stockholm)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 4.7 0,72 USD 2,64 USD

        Wilayah: Asia Pasifik (Sydney)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 4.7 0,6180 USD 2,2660 USD

        * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
        * Harga tingkat Flex dan Batch mendapatkan diskon 50% dibandingkan harga tingkat Standar.

      • GLM 4.7 Flash
      • Harga Sesuai Permintaan

        Wilayah: AS Timur (Virginia Utara), AS Timur (Ohio), dan AS Barat (Oregon)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 4.7 Flash 0,07 USD 0,40 USD
        GLM 5 1,00 USD 3,20 USD

        Wilayah: Asia Pasifik (Jakarta), Asia Pasifik (Mumbai), Asia Pasifik (Tokyo), Eropa (Frankfurt), Eropa (Irlandia), Eropa (Milan), Eropa (Stockholm) dan Amerika Selatan (Sao Paulo)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 4.7 Flash 0,08 USD 0,48 USD

        Wilayah: Asia Pasifik (Jakarta), Asia Pasifik (Mumbai), Asia Pasifik (Tokyo), Eropa (Frankfurt), Eropa (Stockholm), dan Amerika Selatan (Sao Paulo)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 5 1,20 USD 3,84 USD

        Wilayah: Eropa (London) 

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 4.7 Flash 0,11 USD 0,62 USD
        GLM 5 1,55 USD 4,96 USD

        Wilayah: Asia Pasifik (Sydney)

        Model Z AI Harga per 1 juta token input Harga per 1 juta token output
        GLM 4.7 Flash 0,0721 USD 0,4120 USD
        GLM 5 1,03 USD 3,30 USD

        * Harga tingkat Prioritas berada pada premi 75% dibandingkan harga tingkat Standar
        * Harga tingkat Flex dan Batch mendapatkan diskon 50% dibandingkan harga tingkat Standar.

    • Impor Model Kustom
    • Impor Model Kustom

      • Llama
      • Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,05718 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Wilayah: Eropa (Frankfurt)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,07144 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Catatan: Unit Model Kustom yang diperlukan untuk meng-host model bergantung pada berbagai faktor - terutama arsitektur model, jumlah parameter model, dan panjang konteks. Jumlah pasti Unit Model Kustom yang dibutuhkan akan ditentukan saat impor. Sebagai referensi, model Llama 3.1 8B 128K membutuhkan 2 Unit Model Kustom, model Llama 3.1 70B 128k membutuhkan 8 Unit Model Kustom.

        *Ditagih dalam periode 5 menit

      • Llama Multimodal
      • Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,05718 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Wilayah: Eropa (Frankfurt)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,07144 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Catatan: Unit Model Kustom yang diperlukan untuk meng-host model bergantung pada berbagai faktor - terutama arsitektur model, jumlah parameter model, dan panjang konteks. Jumlah pasti Unit Model Kustom yang dibutuhkan akan ditentukan saat impor. Sebagai referensi, model Llama 3.1 8B 128K membutuhkan 2 Unit Model Kustom, model Llama 3.1 70B 128k membutuhkan 8 Unit Model Kustom.

        *Ditagih dalam periode 5 menit

      • Mistral
      • Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,05718 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Wilayah: Eropa (Frankfurt)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,07144 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Catatan: Unit Model Kustom yang diperlukan untuk meng-host model bergantung pada berbagai faktor - terutama arsitektur model, jumlah parameter model, dan panjang konteks. Jumlah pasti Unit Model Kustom yang dibutuhkan akan ditentukan saat impor. Sebagai referensi, model Llama 3.1 8B 128K membutuhkan 2 Unit Model Kustom, model Llama 3.1 70B 128k membutuhkan 8 Unit Model Kustom.

        *Ditagih dalam periode 5 menit

      • Mixtral
      • Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,05718 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Wilayah: Eropa (Frankfurt)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,07144 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Catatan: Unit Model Kustom yang diperlukan untuk meng-host model bergantung pada berbagai faktor - terutama arsitektur model, jumlah parameter model, dan panjang konteks. Jumlah pasti Unit Model Kustom yang dibutuhkan akan ditentukan saat impor. Sebagai referensi, model Llama 3.1 8B 128K membutuhkan 2 Unit Model Kustom, model Llama 3.1 70B 128k membutuhkan 8 Unit Model Kustom.

        *Ditagih dalam periode 5 menit

      • Flan
      • Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,05718 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Wilayah: Eropa (Frankfurt)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,07144 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Catatan: Unit Model Kustom yang diperlukan untuk meng-host model bergantung pada berbagai faktor - terutama arsitektur model, jumlah parameter model, dan panjang konteks. Jumlah pasti Unit Model Kustom yang dibutuhkan akan ditentukan saat impor. Sebagai referensi, model Llama 3.1 8B 128K membutuhkan 2 Unit Model Kustom, model Llama 3.1 70B 128k membutuhkan 8 Unit Model Kustom.

        *Ditagih dalam periode 5 menit

        Harga Inferensi Sesuai Permintaan:
        Anda ditagih dalam periode 5 menit selama salinan model Anda aktif, dimulai dari invokasi pertama yang berhasil. Batas throughput dan konkurensi maksimum per salinan model bergantung pada faktor-faktor seperti, campuran token input/output, tipe perangkat keras, ukuran model, arsitektur, optimisasi inferensi, dan ditentukan selama alur kerja impor model.

        Bedrock menskalakan jumlah salinan model secara otomatis tergantung pada pola penggunaan Anda. Jika tidak ada invokasi selama periode 5 menit, Bedrock akan menurunkan skala menjadi nol dan menaikkan kembali skala saat Anda menginvokasi model. Saat menaikkan kembali skala, Anda mungkin mengalami durasi pemulaian dingin (dalam puluhan detik) tergantung pada ukuran model. Bedrock juga menaikkan skala jumlah salinan model jika volume inferensi Anda secara konsisten melebihi batas konkurensi dari satu salinan model. Catatan: Terdapat batas maksimum default sebanyak 3 salinan model per akun untuk setiap model yang diimpor, yang dapat ditingkatkan melalui Service Quotas.

      • Qwen
      • Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,05718 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Wilayah: Eropa (Frankfurt)

        Versi Unit Model Kustom v1.0
        Harga per Unit Model Kustom per menit* 0,07144 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Catatan: Unit Model Kustom yang diperlukan untuk meng-host model bergantung pada berbagai faktor - terutama arsitektur model, jumlah parameter model, dan panjang konteks. Jumlah pasti Unit Model Kustom yang dibutuhkan akan ditentukan saat impor. Sebagai referensi, model Llama 3.1 8B 128K membutuhkan 2 Unit Model Kustom, model Llama 3.1 70B 128k membutuhkan 8 Unit Model Kustom.

        *Ditagih dalam periode 5 menit

        Harga Inferensi Sesuai Permintaan:
        Anda ditagih dalam periode 5 menit selama salinan model Anda aktif, dimulai dari invokasi pertama yang berhasil. Batas throughput dan konkurensi maksimum per salinan model bergantung pada faktor-faktor seperti, campuran token input/output, tipe perangkat keras, ukuran model, arsitektur, optimisasi inferensi, dan ditentukan selama alur kerja impor model.

        Bedrock menskalakan jumlah salinan model secara otomatis tergantung pada pola penggunaan Anda. Jika tidak ada invokasi selama periode 5 menit, Bedrock akan menurunkan skala menjadi nol dan menaikkan kembali skala saat Anda menginvokasi model. Saat menaikkan kembali skala, Anda mungkin mengalami durasi pemulaian dingin (dalam puluhan detik) tergantung pada ukuran model. Bedrock juga menaikkan skala jumlah salinan model jika volume inferensi Anda secara konsisten melebihi batas konkurensi dari satu salinan model. Catatan: Terdapat batas maksimum default sebanyak 3 salinan model per akun untuk setiap model yang diimpor, yang dapat ditingkatkan melalui Service Quotas.

      • OpenAI
      • Wilayah: AS Timur (Virginia Utara) dan AS Barat (Oregon)

        Versi Unit Model Kustom v2.0
        Harga per Unit Model Kustom per menit* 0,1433 USD
        Biaya penyimpanan bulanan per Unit Model Kustom 1,95 USD

        Catatan: Unit Model Kustom yang diperlukan untuk meng-host model bergantung pada berbagai faktor - terutama arsitektur model, jumlah parameter model, dan panjang konteks. Jumlah pasti Unit Model Kustom yang dibutuhkan akan ditentukan saat impor. Sebagai referensi, model Llama 3.1 8B 128K membutuhkan 2 Unit Model Kustom, model Llama 3.1 70B 128k membutuhkan 8 Unit Model Kustom.

        *Ditagih dalam periode 5 menit

        Harga Inferensi Sesuai Permintaan:
        Anda ditagih dalam periode 5 menit selama salinan model Anda aktif, dimulai dari invokasi pertama yang berhasil. Batas throughput dan konkurensi maksimum per salinan model bergantung pada faktor-faktor seperti, campuran token input/output, tipe perangkat keras, ukuran model, arsitektur, optimisasi inferensi, dan ditentukan selama alur kerja impor model.

        Bedrock menskalakan jumlah salinan model secara otomatis tergantung pada pola penggunaan Anda. Jika tidak ada invokasi selama periode 5 menit, Bedrock akan menurunkan skala menjadi nol dan menaikkan kembali skala saat Anda menginvokasi model. Saat menaikkan kembali skala, Anda mungkin mengalami durasi pemulaian dingin (dalam puluhan detik) tergantung pada ukuran model. Bedrock juga menaikkan skala jumlah salinan model jika volume inferensi Anda secara konsisten melebihi batas konkurensi dari satu salinan model. Catatan: Terdapat batas default maksimum sebanyak 3 salinan model per akun untuk setiap model yang diimpor, yang dapat ditingkatkan melalui Service Quotas.

  • Basis Pengetahuan
    • Basis Pengetahuan Terkelola
    • Basis Pengetahuan Terkelola Amazon Bedrock

      Basis Pengetahuan Terkelola Amazon Bedrock memberi agen Anda kemampuan untuk menemukan, menalar, dan mengambil informasi yang tepat dari dokumen, gambar, audio, dan video Anda — tanpa mengelola infrastruktur apa pun. Ini terintegrasi dengan mulus dengan Amazon Bedrock AgentCore untuk beban kerja AI Anda. Baik Anda seorang developer berpengalaman atau membangun agen AI pertama Anda, Basis Pengetahuan Terkelola menangani penyerapan data, penguraian multimodal, penyimpanan vektor, dan pengambilan cerdas secara otomatis. Anda membayar hanya untuk apa yang Anda simpan dan ambil.

      Apa yang termasuk tanpa biaya tambahan:

      • Penguraian dokumen multimodal dengan parser terkelola
      • Pembuatan penyematan dengan model terkelola
      • Pemberian peringkat ulang dengan pemberi peringkat terkelola

      Catatan: Biaya invokasi alat Gateway Standar berlaku jika Anda memanggil Basis Pengetahuan Terkelola melalui AgentCore Gateway. Tarif CloudWatch standar berlaku jika Observabilitas diaktifkan.

      Fitur Deskripsi Harga

      Penyimpanan Indeks

      Indeks pencarian terkelola dengan konektor asli untuk menyinkronkan data dari S3, SharePoint, Confluence, dan lainnya.

      5,00 USD per GB data mentah / bulan

      Penguraian Dokumen Multimodal (parser terkelola)

      Mengurai teks, PDF, gambar, tabel, audio, dan video menjadi konten yang dapat dicari.

      0 USD

      Pembuatan Penyematan (model terkelola)

      Mengkonversi konten Anda menjadi vektor yang dapat dicari menggunakan model bawaan.

      0 USD

      Pengambilan Standar (API Pengambilan)

      Pencarian hibrida menggabungkan pencarian semantik dan kata kunci di atas konten Anda yang diindeks.

      1,00 USD per 1.000 panggilan API

      Pemberian peringkat ulang (pemberi peringkat terkelola)*

      Menyusun ulang bagian yang diambil berdasarkan relevansi.

      0 USD

      Pengambilan Agentik — Perencanaan LLM terkelola**

      Pengambilan multi-hop menggunakan LLM bawaan untuk perencanaan kueri.

      4,00 USD per 1.000 panggilan API Pengambilan Agentik + 1,00 USD per 1.000 panggilan API Pengambilan yang mendasarinya

      * Jika Anda memilih model pilihan Anda untuk pembuatan penyematan atau pemberian peringkat ulang, biaya tambahan berlaku. Silakan lihat bagian penyedia model untuk harga.

      ** Untuk Pengambilan Agentik dengan LLM pilihan Anda, Anda membayar 1,00 USD per 1.000 panggilan API Pengambilan yang mendasarinya ditambah harga penyedia model untuk LLM yang digunakan untuk perencanaan kueri.

    • Basis Pengetahuan yang Dikelola Sendiri
    • Pengambilan Data Terstruktur (Pembuatan SQL)

      Structured Data Retrieval dikenakan biaya untuk setiap permintaan untuk menghasilkan kueri SQL. Kueri SQL yang dihasilkan digunakan untuk mengambil data dari penyimpanan data terstruktur.

      Model Rerank

      Model Rerank dirancang untuk meningkatkan relevansi dan akurasi respons dalam aplikasi Retrieval Augmented Generation (RAG). Mereka dikenakan biaya per kueri.

      **Anda dikenakan biaya untuk jumlah kueri di mana kueri dapat berisi hingga 100 potongan dokumen. Jika kueri berisi lebih dari 100 potongan dokumen, itu dihitung sebagai beberapa kueri. Misalnya, jika permintaan berisi 350 dokumen, itu akan diperlakukan sebagai 4 kueri. Perhatikan bahwa setiap dokumen hanya dapat berisi hingga 512 token (termasuk kueri dan token total dokumen), dan jika panjang token lebih tinggi dari 512 token, itu dipecah menjadi beberapa dokumen. Sebuah kueri setara dengan unit pencarian.

  • Pagar Pembatas
  • Batasan Pengaman Amazon Bedrock

    Harga untuk Batasan Pengaman Amazon Bedrock didasarkan pada biaya yang timbul dari filter yang digunakan dalam batasan pengaman. Harga sama untuk tingkat standar dan tingkat klasik.

    Pengaman/filter Batasan Pengaman Bedrock*

    Harga

    Filter konten untuk tingkat standar dan tingkat klasik (konten teks)

    0,15 USD per 1.000 unit teks

    Filter konten (konten gambar)

    0,00075 USD per gambar yang diproses

    Topik yang ditolak untuk tingkat standar dan tingkat klasik

    0,15 USD per 1.000 unit teks

    Filter informasi sensitif 

    0,10 USD per 1.000 unit teks

    Filter informasi sensitif (ekspresi reguler) 

    Gratis

    Filter kata

    Gratis

    Pemeriksaan landasan kontekstual**

    0,10 USD per 1.000 unit teks

    Pemeriksaan Penalaran Otomatis

    0,17 USD per 1.000 unit teks per kebijakan Penalaran Otomatis

    Tabel di bawah ini mencantumkan harga untuk Batasan Pengaman Bedrock bila digunakan dengan API InvokeGuardrailChecks. 

    Pengaman/filter Batasan Pengaman Bedrock*

    Harga

    Filter konten (hanya konten teks)

    0,07 USD per 1.000 unit teks

    Serangan prompt (hanya konten teks) ***

    0,08 USD per 1.000 unit teks

    Filter informasi sensitif

    0,10 USD per 1.000 unit teks

    Harga Sesuai Permintaan

    * Setiap filter batasan pengaman bersifat opsional dan dapat diaktifkan sesuai dengan kebutuhan aplikasi Anda. Biaya akan dikenakan berdasarkan pengamanan yang digunakan. Misalnya, jika Anda menggunakan filter konten dan filter informasi sensitif, biaya akan dikenakan untuk kedua filter ini, sementara tidak akan ada biaya yang terkait dengan filter lainnya. 

    ** Pemeriksaan landasan kontekstual menggunakan sumber referensi dan kueri untuk menentukan apakah respons model didasarkan pada sumber dan relevan dengan kueri. Total jumlah unit teks yang dikenakan biaya dihitung dengan menggabungkan semua karakter dalam sumber, kueri, dan respons model. 

    *** Dengan API InvokeGuardrailChecks, Anda dapat menggunakan filter serangan prompt secara terpisah di luar filter konten. Pemisahan ini hanya tersedia dengan API ini. 

    Catatan: Satu unit teks dapat berisi hingga 1000 karakter. Jika berisi lebih dari 1000 karakter, input teks diproses sebagai lebih dari satu unit teks, yang masing-masingnya berisi 1000 karakter atau kurang. Misalnya, jika berisi 5600 karakter, input teks akan dikenakan biaya untuk 6 unit teks. 

  • Evaluasi Model
  • Evaluasi Model

    Evaluasi model dikenai biaya untuk inferensi dari model pilihan Anda. Skor algoritmik yang dihasilkan secara otomatis disediakan tanpa biaya tambahan. Untuk evaluasi berbasis manusia, saat membawa tim kerja Anda sendiri, Anda dikenai biaya untuk inferensi model dalam evaluasi, dan biaya sebesar 0,21 USD per tugas manusia yang diselesaikan.

    Jika Anda menggunakan evaluasi RAG atau LLM sebagai juri dalam Evaluasi Model, token yang digunakan model juri dikenakan biaya berdasarkan harga tingkat standar sesuai permintaan. Prompt juri dikenakan biaya sebagai bagian dari penggunaan token Anda dan tersedia di dokumentasi publik. Evaluasi RAG pada Basis Pengetahuan Bedrock juga dikenakan biaya penggunaan reguler dari Basis Pengetahuan Bedrock.

    Model

    Harga per 1.000 token input

    Harga per 1.000 token output

    Harga per tugas manusia

     

    Model yang dipilih untuk evaluasi

    Berdasarkan model yang dipilih

    Berdasarkan model yang dipilih

     

    0,21 USD

     
  • Otomatisasi Data
  • Otomatisasi Data

    Otomatisasi Data Amazon Bedrock mengubah konten multimodal yang tidak terstruktur menjadi format data terstruktur untuk kasus penggunaan, seperti pemrosesan dokumen cerdas, analisis video, dan RAG. Otomatisasi Data Bedrock dapat menghasilkan konten Output Standar dengan menggunakan default yang telah ditentukan yang spesifik untuk modalitas tertentu, seperti deskripsi video adegan demi adegan, transkrip audio, atau analisis dokumen otomatis. Pelanggan juga dapat membuat Output Kustom dengan menentukan persyaratan output mereka di Cetak biru berdasarkan skema data mereka sendiri yang kemudian dapat dengan mudah dimuat ke basis data atau gudang data yang ada. Melalui integrasi dengan Basis Pengetahuan, Otomatisasi Data Bedrock juga dapat digunakan untuk menguraikan konten untuk aplikasi RAG, meningkatkan akurasi dan relevansi hasil dengan memasukkan informasi yang disematkan baik dalam gambar maupun teks.

    Basis Pengetahuan Amazon Bedrock menawarkan integrasi Otomatisasi Data Bedrock untuk memberikan respons yang lebih relevan dan akurat untuk data multimodal. Saat menyiapkan Basis Pengetahuan, Anda dapat memilih Otomatisasi Data Bedrock sebagai metode penguraian Anda untuk menganalisis dan mengekstrak wawasan yang berarti dari gambar atau dokumen, yang dapat mencakup gambar, bagan, dan diagram. Selama pemrosesan, Otomatisasi Data Bedrock mengekstrak informasi yang berarti dari dokumen dan gambar yang dicerna, yang kemudian digunakan dalam langkah-langkah Basis Pengetahuan berikutnya untuk pemotongan, penyematan, dan penyimpanan. Ketika terintegrasi dengan Basis Pengetahuan, Otomatisasi Data Bedrock memberikan dan mengenakan biaya untuk output standar.

  • Perutean Prompt Cerdas
  • Titik Harga Dimensi Harga Rencana Harga
    Perutean Prompt Cerdas 1 USD per 1.000 permintaan Sesuai Permintaan

    Perutean Prompt Cerdas

    Perutean Prompt Cerdas memungkinkan Anda menggunakan kombinasi model fondasi (FM) dari keluarga model yang sama untuk membantu mengoptimalkan kualitas dan biaya. Misalnya, dengan keluarga model Claude Anthropic, Amazon Bedrock dapat merutekan permintaan secara cerdas antara Claude 3.5 Sonnet dan Claude 3 Haiku tergantung pada kompleksitas prompt. Demikian pula, Amazon Bedrock dapat merutekan permintaan antara Meta Llama 3.3 70B dan 3.18B, dan Nova Pro dan Nova Lite. Perute prompt memprediksi model mana yang akan memberikan performa terbaik untuk setiap permintaan sekaligus membantu mengoptimalkan kualitas respons dan biaya. Hal ini sangat berguna untuk aplikasi seperti asisten layanan pelanggan, di mana kueri yang tidak rumit dapat ditangani oleh model yang lebih kecil, lebih cepat, dan lebih hemat biaya, dan kueri kompleks dialihkan ke model yang lebih mumpuni. Perutean Prompt Cerdas dapat mengurangi biaya hingga 30 persen tanpa mengorbankan akurasi.

  • Optimisasi Prompt
  • Optimisasi Prompt untuk Amazon Bedrock

    Amazon Bedrock menawarkan dua pengoptimal prompt. 
    Pengoptimal Prompt Sederhana
    Pengoptimal prompt sederhana tersedia dengan satu klik di playground dan Manajer Prompt. Ini juga tersedia melalui API OptimizePrompt. Anda dikenakan biaya berdasarkan total jumlah token input prompt dan hasil prompt yang dioptimalkan. Harganya adalah 0,03 USD per 1.000 token

    Pengoptimal Prompt Tingkat Lanjut
    Optimisasi Prompt Tingkat Lanjut Bedrock tersedia di bagian Optimisasi Prompt Tingkat Lanjut dari Bedrock Console dan API CreateAdvancedPromptOptimizationJob. Anda dikenakan biaya untuk token tingkat standar sesuai permintaan yang digunakan dalam optimisasi. Untuk memperkirakan penggunaan Anda, hal berikut ini penting: Pengoptimal prompt menggunakan LLM sebagai penulis ulang dan evaluator yang bekerja dalam loop berulang antara inferensi, evaluasi, dan penulisan ulang. Gunakan persamaan berikut untuk memperkirakan biaya Anda, di mana N = jumlah catatan set data dalam set data evaluasi Anda untuk setiap templat prompt, P adalah jumlah token input dalam templat prompt Anda, O = perkiraan jumlah token output model target, G = jumlah token respons referensi kebenaran dasar.

    Evaluator fungsi Lambda: Jika Anda memilih untuk menggunakan fungsi Lambda sebagai evaluator, rumus berikut dapat digunakan untuk memperkirakan total token dan biaya per templat prompt: 
    Invokasi Lambda per templat prompt = 16*N. 
    Jumlah Total Token Model Target = 16*N*(P+O). 
    Jumlah token Input LLM pengoptimal (saat ini Anthropic Claude Sonnet 4.6) = 101 * (3700+0,35P). 

    Evaluator LLM sebagai juri: Jika Anda memilih opsi LLM sebagai juri atau kriteria pengarahan bahasa alami, rumus berikut dapat digunakan untuk memperkirakan total token per templat prompt Jumlah Token Model Target Total = 16*N*(P+O). 
    Jumlah token Input LLM pengoptimal (saat ini Anthropic Claude Sonnet 4.6) = 101 * (3700+0,35P). 
    Jumlah token LLMJudge = 16*N*(P+O+G + Prompt juri)

    Catatan: Ini adalah fitur AI generatif; jumlah token output yang tepat tidak diketahui sampai runtime dan bervariasi berdasarkan apa yang dirancang untuk dihasilkan oleh prompt.

  • Pencarian Web
  • Pencarian Web memungkinkan model dan agen Anda mengambil informasi terkini dari web untuk mendasarkan respons pada konten terbaru.  Anda dikenakan biaya per kueri, di mana kueri mewakili permintaan pencarian web tunggal.

Contoh harga

  • Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock: Permintaan ke model Jurassic-2 Mid AI21 untuk meringkas input sebesar 10 ribu token teks input menjadi output sebesar 2 ribu token.

    Total biaya yang timbul = 10 ribu token / 1000 * 0,0125 USD + 2 ribu token / 1000 * 0,0125 USD = 0,15 USD

  • Harga Sesuai Permintaan

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock setiap jam: Permintaan ke model Amazon Titan Text – Lite untuk meringkas input sebesar 2 ribu token teks input menjadi output sebesar 1 ribu token.

    Total biaya per jam yang dikeluarkan adalah = 2 ribu token/1.000 * 0,0003 USD + 1 ribu token/1.000 * 0,0004 USD = 0,001 USD.

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock: Permintaan ke model dasar Amazon Titan Image Generator untuk menghasilkan 1000 gambar berukuran 1024 x 1024 dengan kualitas standar.

    Total biaya yang dikeluarkan = 1.000 gambar * 0,01 USD per gambar = 10 USD

    Harga kustomisasi (penyempurnaan dan prapelatihan lanjutan)

    Developer aplikasi menyesuaikan model Amazon Titan Image Generator menggunakan 1000 pasangan gambar-teks. Setelah pelatihan, developer menggunakan provisioned throughput model khusus selama 1 jam untuk mengevaluasi performa model. Model yang disempurnakan disimpan selama 1 bulan. Setelah evaluasi, developer menggunakan provisioned throughput (masa komitmen 1 bulan) untuk meng-hosting model yang disesuaikan.

    Biaya bulanan yang dikeluarkan untuk Penyempurnaan adalah: Pelatihan penyempurnaan (0,005 USD * 500 * 64). Pada kalkulasi tersebut, 0,005 USD adalah harga per gambar yang dilihat, 500 adalah jumlah langkah, dan 64 adalah ukuran batch + penyimpanan model khusus per bulan (1,95 USD) + 1 jam inferensi model khusus (21 USD) = 160 USD + 1,95 USD + 21 = 182,95 USD

    Harga Provisioned Throughput

    Developer aplikasi membeli dua unit model Amazon Titan Text Express dengan komitmen 1 bulan untuk kasus penggunaan peringkasan teks mereka.

    Total biaya bulanan yang dikeluarkan = 2 unit model * 18,40 USD/jam * 24 jam * 31 hari = 27.379,20 USD

    Developer aplikasi membeli satu unit model dari model dasar Amazon Titan Image Generator dengan komitmen 1 bulan.

    Total biaya yang timbul = 1 unit model * 16,20 USD * 24 jam * 31 hari = 12.052,80 USD

  • Contoh 1: Chatbot dukungan pelanggan
    Pengembang aplikasi membuat chatbot dukungan pelanggan dan menggunakan filter konten untuk memblokir konten berbahaya dan topik yang ditolak untuk menyaring pertanyaan dan tanggapan yang tidak diinginkan.

    Chatbot melayani 1000 permintaan pengguna per jam. Setiap permintaan pengguna memiliki panjang input rata-rata 200 karakter dan menerima respons FM 1500 karakter.

    Setiap permintaan pengguna 200 karakter sesuai dengan 1 unit teks.

    Setiap respons FM 1.500 karakter sesuai dengan 2 unit teks.

    Unit teks diproses setiap jam = (1 + 2) * 1000 kueri = 3000 unit teks

    Total biaya yang dikeluarkan per jam untuk filter konten dan topik yang ditolak = 3000 * (0,15 USD + 0,15 USD) / 1000 = 0,90 USD

     

    Contoh 2: Ringkasan transkrip pusat panggilan
    Pengembang aplikasi membuat aplikasi untuk meringkas transkrip obrolan antara pengguna dan agen dukungan. Ini menggunakan filter informasi sensitif untuk menyunting informasi pengenal pribadi (PII) dalam ringkasan yang dihasilkan untuk 10.000 percakapan.

    Setiap ringkasan yang dihasilkan memiliki rata-rata 3.500 karakter yang sesuai dengan 4 unit teks.

    Total biaya yang dikeluarkan untuk meringkas 10.000 percakapan = 10000 * 4 * (0,1 USD/1000) = 4 USD

     

    Contoh 3: Mesin Verifikasi Protokol Medis
    Sebuah perusahaan teknologi layanan kesehatan mengimplementasikan pemeriksaan Penalaran Otomatis dalam sistem dukungan keputusan klinis mereka untuk memvalidasi saran perawatan terhadap pedoman medis.

    Sistem ini memproses 5.000 kasus pasien per bulan. Setiap kasus meliputi:

    • Ringkasan data pasien: 500 karakter (1 unit teks)
    • Penilaian diagnostik: 2.000 karakter (2 unit teks)
    • Rekomendasi perawatan: 4.500 karakter (5 unit teks)

    Unit teks yang diproses per bulan = (1 + 2 + 5) 5.000 kasus = 40.000 unit teks
    Total biaya yang dikeluarkan per bulan untuk pemeriksaan Penalaran Otomatis = 40.000 (0,17 USD)/1000 = 6,80 USD

     

  • Contoh Harga

    Contoh 1: Chatbot Dukungan Pelanggan (menggunakan Pengambilan Standar)

    Anda mengindeks 50 GB konten dari situs SharePoint Anda — sekitar 100.000 dokumen termasuk PDF, presentasi, file Word, dan gambar. Agen Anda menangani 100.000 kueri pengambilan standar per bulan.

    Item Baris Penghitungan Biaya

    Penyimpanan Indeks

    50 GB × 5,00 USD

    250,00 USD

    Penguraian Dokumen Multimodal (parser terkelola)

    Termasuk

    0 USD

    Pembuatan Penyematan (model terkelola)

    Termasuk

    0 USD

    Pengambilan Standar

    100.000 ÷ 1.000 × 1,00 USD

    100,00 USD

    Pemberian peringkat ulang (pemberi peringkat terkelola)

    Termasuk

    0 USD
    Total Bulanan   350,00 USD

    Contoh 2: Asisten Riset Perusahaan (menggunakan Pengambilan Agentik)

    Anda mengindeks 50 GB konten dari situs SharePoint Anda — sekitar 100.000 dokumen termasuk PDF, presentasi, file Word, dan gambar. Agen Anda menangani 100.000 panggilan API Pengambilan Agentik per bulan. Rata-rata, setiap panggilan agentik membuat 2 panggilan API Pengambilan yang mendasarinya.

    Item Baris Penghitungan Biaya

    Penyimpanan Indeks

    50 GB × 5,00 USD

    250,00 USD

    Penguraian Dokumen Multimodal (parser terkelola)

    Termasuk 0 USD

    Pembuatan Penyematan (model terkelola)

    Termasuk 0 USD

    Panggilan API Pengambilan Agentik

    100.000 ÷ 1.000 × 4,00 USD

    400,00 USD

    Panggilan API Pengambilan yang mendasari

    (100.000 × 2) ÷ 1.000 × 1,00 USD

    200,00 USD

    Pemberian peringkat ulang (pemberi peringkat terkelola)

    Termasuk 0 USD
    Total Bulanan   850,00 USD
  • Harga Sesuai Permintaan

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock di Wilayah AS Barat (Oregon): Permintaan ke model Claude Anthropic untuk meringkas input sebesar 11 ribu token teks input menjadi output sebesar 4 ribu token.

    Total biaya yang dikeluarkan = 11 ribu token/1000 * 0,008 USD + 4 ribu token/1000 * 0,024 USD = 0,088 USD + 0,096 USD = 0,184 USD

    Harga Provisioned Throughput

    Developer aplikasi membeli satu unit model Anthropic Claude Instant di Wilayah AS Barat (Oregon):

    Total biaya bulanan yang timbul = 1 unit model * 39,60 USD * 24 jam * 31 hari = 29.462,40 USD

  • Harga On-Demand

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock: permintaan ke model Command Cohere untuk meringkas input sebesar 6 ribu token teks input menjadi output sebesar 2 ribu token.

    Total biaya yang dikeluarkan = 6 ribu token/1.000 * 0,0015 USD + 2 ribu token/1.000 * 0,0020 USD = 0,013 USD

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock: Permintaan ke model Command-Light Cohere untuk meringkas input sebesar 6 ribu token teks input menjadi output sebesar 2 ribu token.

    Total biaya yang dikeluarkan = 6 ribu token/1000 * 0,0003 USD + 2 ribu token/1000 * 0,0006 USD = 0,003 USD

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock: Permintaan ke model Embed English atau Embed Multilingual Cohere untuk menghasilkan penyematan untuk 10 ribu token input.

    Total biaya yang dikeluarkan = 10 ribu token/1000 * 0,0001 USD = 0,001 USD

    Harga kustomisasi (penyempurnaan)

    Developer aplikasi menyesuaikan model Cohere Command menggunakan 1.000 token data. Setelah pelatihan, menggunakan provisioned throughput model khusus selama 1 jam untuk mengevaluasi performa model. Model yang disempurnakan disimpan selama 1 bulan. Setelah evaluasi, developer menggunakan provisioned throughput (komitmen 1 bulan) untuk meng-hosting model yang disesuaikan.

    Biaya bulanan yang dikeluarkan untuk penyempurnaan adalah: Pelatihan penyempurnaan (0,004 USD * 1000) + penyimpanan model khusus per bulan (1,95 USD) + 1 jam inferensi model khusus (49,50 USD) = 55,45 USD

    Biaya bulanan yang dikeluarkan untuk provisioned throughput (komitmen 1 bulan) dari model khusus = 39,60 USD

    Harga Provisioned Throughput

    Developer aplikasi membeli satu unit model Cohere Command dengan komitmen 1 bulan untuk kasus penggunaan peringkasan teks mereka.

    Total biaya bulanan yang timbul = 1 unit model * 39,60 USD * 24 jam * 31 hari = 29.462,40 USD

  • Contoh Harga: Developer aplikasi mengimpor model tipe Llama 3.1 yang disesuaikan dengan ukuran parameter 8B dengan panjang urutan 128K di wilayah us-east-1 dan menghapus model setelah 1 bulan. Hal ini membutuhkan 2 Unit Model Kustom. Jadi, harga per menit akan menjadi 0,1570 USD karena diperlukan 2 Unit Model Kustom. Biaya penyimpanan model untuk 2 Unit Model Kustom adalah 3,90 USD untuk bulan tersebut.

    Tidak ada biaya untuk mengimpor model. Invokasi pertama yang berhasil adalah pukul 8.03, saat pengukuran dimulai. Periode pengukuran 5 menit dimulai pukul 8.03 – 8.07; 8.07 –8.11, dan seterusnya. Jika ada setidaknya satu invokasi selama periode 5 menit, periode tersebut akan dianggap aktif untuk penagihan. Jika ada invoaksi pada pukul 08.03 dan tidak ada invokasi lebih lanjut setelah pukul 08.07, pengukuran akan berhenti pada pukul 08.07. Dalam kasus ini, tagihan akan dihitung sebagai berikut: 0,1570 USD * 5 menit * 1 periode lima menit = 0,785 USD.

  • Contoh harga 1:
    Katakanlah Anda memproses dokumen 1.000 halaman menggunakan BDA Custom Output. Semua 1.000 halaman diproses menggunakan cetak biru 1 yang memiliki 15 bidang. Harga per halaman untuk cetak biru dengan 30 bidang atau kurang adalah 0,040 USD. Total biayanya adalah 40 USD.

    Total halaman yang diproses = 1.000
    Harga per halaman untuk cetak biru dengan kurang dari 30 bidang = 0,040 USD
    Total biaya = 1.000 * 0,040 USD = 40 USD

     

    Contoh harga 2:
    Katakanlah Anda memproses 2 dokumen menggunakan BDA Custom Output. Dokumen 1 memiliki 40 halaman dan diproses menggunakan cetak biru 1 yang memiliki 20 bidang. Dokumen 2 memiliki 10 halaman dan diproses menggunakan cetak biru 2, yang memiliki 40 bidang. Harga per halaman untuk cetak biru 1 adalah 0,040 USD karena cetak biru tersebut memiliki 30 bidang atau kurang. Harga per halaman cetak biru 2 adalah 0,045 USD. Biaya pemrosesan untuk Dokumen 1 menggunakan cetak biru 1 adalah 1,60 USD. Biaya pemrosesan untuk Dokumen 2 menggunakan cetak biru 2 adalah 0,45 USD. Total biaya pemrosesan kedua dokumen adalah 2,05 USD.

    Total halaman yang diproses = 50
    Harga per halaman untuk Cetak biru 1 dengan kurang dari 30 bidang = 0,040 USD
    Harga per halaman untuk Cetak biru 2 dengan 40 bidang = 0,040 USD + (# bidang tambahan di atas 30*0,0005 USD per bidang)
    Jumlah bidang tambahan di atas 30 = 40 - 30 = 10
    Harga per halaman untuk Cetak biru 2 dengan 40 bidang = 0,040 USD + (10 * 0,0005 USD per bidang) = 0,045 USD
    Biaya untuk Dokumen 1 menggunakan Cetak biru 1 = 40 halaman x 0,040 USD per halaman = 1,6 USD
    Biaya untuk Dokumen 2 menggunakan Cetak biru 2 = 10 halaman x 0,045 USD per halaman = 0,45 USD
    Total biaya = Biaya untuk Dokumen 1 + Biaya untuk Dokumen 2 = 1,6 USD + 0,45 USD = 2,05 USD

     

    Contoh Harga 3:
    Anggaplah Anda mengatur Basis Pengetahuan Bedrock untuk menggunakan Otomatisasi Data Bedrock sebagai pengurai, lalu menyerap dokumen 1.000 halaman. Perhatikan bahwa struktur biaya berbeda-beda antara opsi penguraian Basis Pengetahuan. BDA menggunakan harga per halaman, sementara pengurai Model Fondasi ditagih berdasarkan token input dan output. Sebagai konteks, memproses 1.000 halaman, dengan 30% berisi tabel dan 30% berisi gambar, biasanya memerlukan 2.900 token input dan 750 token output. Konsumsi token bervariasi menurut jenis konten, sehingga pelanggan didorong untuk menguji menggunakan data mereka sendiri untuk mendapatkan perkiraan yang lebih akurat. Basis Pengetahuan Bedrock dan integrasi Otomatisasi Data Bedrock menggunakan output standar, dengan harga per halaman adalah 0,010 USD. Total biayanya adalah 10 USD.

    Total halaman yang diproses = 1.000
    Harga per halaman untuk output standar = 0,010 USD
    Total biaya = 1.000 * 0,010 USD = 10 USD

     

    Contoh harga 4:
    Anggaplah Anda memproses video 60 menit menggunakan Output Standar BDA. Harga per menit untuk output standar video adalah 0,050 USD. Total biayanya adalah 3,00 USD.

    Total menit diproses = 60
    Harga per menit untuk output standar video = 0,050 USD
    Total biaya = 60 * 0,050 = 3,00 USD

     

    Contoh harga 5:
    Anggaplah Anda memproses 2.000 gambar menggunakan Output Kustom BDA. 1.000 gambar pertama diproses menggunakan cetak biru 1, yang memiliki 10 bidang. 1.000 halaman terakhir diproses menggunakan cetak biru 2, yang memiliki 40 bidang. Harga per gambar untuk cetak biru 1 adalah 0,005 USD, karena berisi 30 bidang atau kurang. Harga per gambar cetak biru 2 adalah 0,01 USD. Biaya pemrosesan untuk 1.000 gambar pertama menggunakan cetak biru 1 adalah 5,00 USD. Biaya pemrosesan untuk 1.000 gambar kedua menggunakan cetak biru 2 adalah 10,00 USD. Total biaya pemrosesan 2.000 gambar keseluruhan akan menjadi 15,00 USD

    Biaya untuk 1000 gambar pertama = 1.000 gambar * 0,005 USD per gambar = 5,00 USD
    Biaya untuk 1.000 gambar kedua = 1.000 gambar * (0,005 USD + (# bidang tambahan di atas 30 * 0,0005 USD per bidang))
    = 1.000 * (0,005 USD + ((40-30) * 0,0005 USD))
    = 1.000 * (0,005 USD + (10 * 0,0005 USD)) = 10,00 USD
    Total biaya = 5,00 USD + 10,00 USD = 15,00 USD

     

    Contoh Harga 6:
    Misalkan Anda ingin menggunakan Output Standar Otomatisasi Data Bedrock untuk memproses 15.000 menit rekaman audio rapat di organisasi Anda. Total biaya pemrosesan keseluruhan 15.000 menit audio akan menjadi 90 USD.

    Total menit yang diproses = 15.000 menit
    Total biaya = 15.000 menit × 0,006 USD = 90 USD

     

  • Harga Sesuai Permintaan

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock setiap jam: permintaan ke model DeepSeek-R1 untuk meringkas input sebesar 2 ribu token teks input menjadi output sebesar 1 ribu token (termasuk token penalaran):

    Total biaya per jam yang timbul = 2 ribu token / 1000 * 0,00135 USD + 1 ribu token / 1000 * 0,0054 USD = 0,0081 USD

  • Contoh: Ringkasan berita
    Developer aplikasi membuat alur untuk mengotomatiskan ringkasan berita untuk pedagang saham. Alur tersebut mencakup simpul Input yang mengambil lokasi S3, dan simpul pengambilan S3 yang mengambil 10 file yang menyertakan artikel dari 10 kantor berita utama di S3 (2 transisi simpul). Alur tersebut kemudian menggunakan pengulang simpul untuk menginvokasi model dengan simpul prompt untuk meringkas setiap file (+ 10 file x 2 transisi simpul). Alur tersebut kemudian mengumpulkan semua hasil menggunakan simpul kolektor, menulis hasilnya ke S3 menggunakan simpul penyimpanan S3, dan menyelesaikan dalam simpul Output (+ 3 transisi simpul). Mereka menjalankan alur ini setiap setengah jam setiap hari kerja.

    Jumlah transisi simpul per eksekusi alur adalah: 2 + 1 + 10 * 2 + 3 = 25 transisi simpul/eksekusi aliran

    Jumlah eksekusi aliran per bulan adalah: 24 jam * 2 * 5 hari * 4 minggu = 960 eksekusi alur/bulan.

    Total tagihan per bulan adalah: 25 * 960 * 0,035 USD/1000 = 0,84 USD

    Biaya tambahan
    Tagihan tersebut juga akan mencakup biaya tambahan untuk layanan AWS yang digunakan dalam eksekusi alur kerja, termasuk penggunaan Amazon S3 dalam simpul pengambilan dan penyimpanan, serta penggunaan model fondasi Amazon Bedrock dalam simpul prompt.

  • Harga Sesuai Permintaan

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock: permintaan ke model Llama 2 Chat (13B) Meta untuk meringkas input sebesar 2 ribu token teks input menjadi output sebesar 500 token.

    Total biaya yang dikeluarkan = 2 ribu token/1000 * 0,00075 USD + 500 token/1000 * 0,001 USD = 0,002 USD

    Harga kustomisasi (penyempurnaan)

    Developer aplikasi menyesuaikan model Llama 2 Pretrained (70B) menggunakan 1000 token data. Setelah pelatihan, menggunakan provisioned throughput model khusus selama 1 jam untuk mengevaluasi performa model. Model yang disempurnakan disimpan selama 1 bulan. Setelah evaluasi, developer menggunakan provisioned throughput (komitmen 1 bulan) untuk meng-hosting model yang disesuaikan.

    Biaya bulanan yang dikeluarkan untuk penyempurnaan adalah: Pelatihan penyempurnaan (0,00799 USD * 1000) + penyimpanan model khusus per bulan (1,95 USD) + 1 jam inferensi model khusus (23,50 USD) = 33,44 USD

    Biaya bulanan yang dikeluarkan untuk provisioned throughput (komitmen 1 bulan) dari model khusus = 21,18 USD

    Harga Provisioned Throughput

    Developer aplikasi membeli satu unit model Meta Llama 2 dengan komitmen 1 bulan untuk kasus penggunaan peringkasan teks mereka.

    Total biaya bulanan yang timbul = 1 unit model * 21,18 USD * 24 jam * 31 hari = 15.757,92 USD

  • Harga Sesuai Permintaan

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock pada setiap jam: Permintaan ke model Mistral 7B untuk meringkas input sebesar 2 ribu token teks input menjadi output sebesar 1 ribu token.

    Total biaya per jam yang dikeluarkan = 2 ribu token/1000 * 0,00015 USD + 1 ribu token/1000 * 0,0002 USD = 0,0005 USD

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock pada setiap jam: permintaan ke model Mixtral 8x7B untuk meringkas input sebesar 2 ribu token teks input menjadi output sebesar 1 ribu token.

    Total biaya per jam yang dikeluarkan = 2 ribu token/1000 * 0,00045 USD + seribu token/1000 * 0,0007 USD = 0,0016 USD

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock pada setiap jam: permintaan ke model Mistral Large untuk meringkas input sebesar 2 ribu token teks input menjadi output sebesar 1 ribu token. 

    Total biaya per jam yang timbul = 2 ribu token / 1000 * 0,008 USD + 1 ribu token / 1000 * 0,024 USD = 0,04 USD

  • Contoh evaluasi model 1:

    Harga on-demand
    Developer aplikasi mengirimkan set data untuk evaluasi model berbasis manusia menggunakan Anthropic Claude 2.1 dan Anthropic Claude Instant di Wilayah AWS AS Timur (Virginia Utara).

    Set data berisi 50 perintah, dan developer memerlukan satu pekerja untuk menilai setiap rangkaian respons perintah (dapat dikonfigurasi dalam pembuatan tugas evaluasi sebagai parameter “pekerja per perintah”).

    Akan ada 50 tugas dalam pekerjaan evaluasi ini (satu tugas untuk setiap set respons cepat per setiap pekerja). Sebanyak 50 perintah digabungkan menjadi 5000 token input, dan respons terkait digabungkan menjadi 15,000 token untuk Anthropic Claude Instant dan 20,000 token untuk Anthropic Claude 2.1.

    Biaya berikut dikeluarkan untuk tugas evaluasi model ini:

    Item Jumlah token input Harga per 1.000 token input Biaya input Jumlah token output Harga per 1.000 token output Biaya output Jumlah tugas manusia Biaya per tugas manusia Biaya tugas manusia Total
    Claude Instant Inference 5.000 0,0008 USD 0,004 USD 15.000 0,0024 USD 0,036 USD       0,04 USD
    Claude 2.1 Inference 5.000 0,008 USD 0,04 USD 20.000 0,024 USD 0,48 USD       0,52 USD
    Tugas Manusia             50 0,21 USD 10,50 USD 10,50 USD
    Total                   11,06 USD

    Contoh evaluasi model 2:

    Harga on-demand
    Developer aplikasi mengirimkan set data untuk evaluasi model berbasis manusia menggunakan Anthropic Claude 2.1 dan Anthropic Claude Instant di Wilayah AWS AS Timur (Virginia Utara).

    Set data berisi 50 perintah, dan developer memerlukan dua pekerja untuk menilai setiap rangkaian respons perintah (dapat dikonfigurasi dalam pembuatan tugas evaluasi sebagai parameter “pekerja per perintah”). Akan ada 100 tugas dalam tugas evaluasi ini (1 tugas untuk setiap set respons-perintah per setiap pekerja: 2 pekerja x 50 rangkaian respons-perintah = 100 tugas manusia).

    Sebanyak 50 perintah digabungkan menjadi 5.000 token input, dan respons terkait digabungkan menjadi 15.000 token untuk Anthropic Claude Instant dan 20.000 token untuk Anthropic Claude 2.1.

    Biaya berikut dikeluarkan untuk tugas evaluasi model ini:

    Item Jumlah token input Harga per 1.000 token input Biaya input Jumlah token output Harga per 1.000 token output Biaya output Jumlah tugas manusia Biaya per tugas manusia Biaya tugas manusia Total
    Claude Instant Inference 5.000 0,0008 USD 0,0040 USD 15.000 0,0024 USD 0,036 USD       0,04 USD
    Claude 2.1 Inference 5.000 0,008 USD 0,0400 USD 20.000 0,024 USD 0,48 USD       0,52 USD
    Tugas Manusia             100 0,21 USD 21,00 USD 21,00 USD
    Total                   21,56 USD
  • Contoh: Ringkasan berita
    Developer aplikasi membuat prompt untuk meringkas berita bagi trader menggunakan Claude 3.5. Prompt asli mencakup 429 token. Prompt yang dioptimalkan memiliki 511 token, dan mencakup instruksi dan contoh yang lebih spesifik untuk menghasilkan jawaban yang lebih ringkas dari FM. Ia menggunakan prompt yang dioptimalkan dengan 511 token sebagai input untuk pengoptimal prompt, dan membuat 2 varian baru untuk Claude 3.7 serta Nova Pro dengan 582 dan 579 token.

    Jumlah total token input dan output untuk optimisasi prompt: 429 + 511 + 511 + 582 + 511 + 579 = 3.123

    Total tagihan per bulan adalah: 3.123 / 1000 * 0,03 USD = 0,09 USD

  • Harga On-Demand

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock: permintaan ke model SDXL untuk menghasilkan gambar 512 x 512 dengan ukuran langkah sebesar 70 (kualitas premium).

    Total biaya yang dikeluarkan = 1 gambar * 0,036 USD per gambar = 0,036 USD

    Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock: Permintaan ke model SDXL 1.0 untuk menghasilkan gambar berukuran 1024 x 1024 dengan ukuran langkah sebesar 70 (kualitas premium).

    Total biaya yang dikeluarkan = 1 gambar * 0,08 USD per gambar = 0,08 USD

    Harga Provisioned Throughput

    Developer aplikasi membeli satu unit model SDXL 1.0 dengan komitmen 1 bulan.

    Total biaya yang dikeluarkan = 1 * 49,86 USD * 24 jam * 31 hari = 37.095,84 USD

  • Harga Sesuai Permintaan

    Developer aplikasi membuat panggilan API berikut ke Amazon Bedrock: permintaan ke model Pegasus 1.2 untuk menjelaskan apa isi video sepanjang 10 detik, yang memberikan output 2.000 token.

    Total biaya yang dikeluarkan = 10 detik * 0,00049 USD + 2 ribu token/1000 * 0,0075 USD = 0,0199 USD


    Developer aplikasi membuat panggilan API berikut ke Amazon Bedrock: permintaan ke model Marengo Embed [3.0 atau 2.7] untuk menyematkan 10 video, dengan durasi gabungan 100 menit.

    Total biaya yang dikeluarkan = 100 menit (yaitu 6000 detik) * 0,00070 USD = 4,2 USD


    Developer aplikasi membuat panggilan API berikut ke Amazon Bedrock: permintaan ke model Marengo Embed 3.0 dengan menyediakan teks dan gambar bersama, untuk menghasilkan sematan yang dapat mereka gunakan untuk menemukan klip yang memiliki tas yang ditampilkan dalam gambar yang diberikan, di seluruh repositori penyematan yang akan mereka buat menggunakan contoh di atas. 

    Total biaya yang dikeluarkan = 1 permintaan teks * 0,00007 USD + 1 permintaan gambar * 0,0001 USD = 0,00017 USD


    Developer aplikasi membuat panggilan API berikut ke Amazon Bedrock: permintaan ke model Marengo Embed [3.0 atau 2.7] dengan menyediakan teks untuk menghasilkan sematan yang dapat mereka gunakan untuk menemukan klip yang cocok dari repositori penyematan yang akan mereka buat menggunakan contoh di atas. 

    Total biaya yang dikeluarkan = 1 permintaan teks * 0,00007 USD = 0,00007 USD

  • Developer aplikasi melakukan panggilan API berikut ke Amazon Bedrock: Permintaan ke model Palmyra X5 milik Penulis untuk meringkas input sebesar 10 ribu token teks input menjadi output sebesar 2 ribu token.

    Total biaya yang dikeluarkan = 10 ribu token/1000 * 0,003 USD + 2 ribu token/1000 * 0,015 USD = 0,06 USD