Amazon Bedrock

  • การกำหนดราคาโมเดล
  • การกำหนดราคาโมเดล

    ราคาขึ้นอยู่กับรูปแบบ ผู้ให้บริการ และโมเดล โปรดเลือกผู้ให้บริการโมเดลเพื่อดูราคาโดยละเอียด

    Amazon Bedrock รองรับระดับที่หลากหลาย ได้แก่ ระดับ Standard, Flex, Priority และ Reserved คลิกเพื่อเรียนรู้เพิ่มเติมเกี่ยวกับระดับต่าง ๆ ของบริการ

    Amazon Bedrock นำเสนอโมเดลพื้นฐาน (FM) ที่เลือกจากผู้ให้บริการ AI ชั้นนำเช่น Anthropic, Meta, Mistral AI และ Amazon สำหรับการอนุมานแบบแบทช์ในราคาที่ต่ำกว่า 50% เมื่อเทียบกับราคาอนุมานแบบ On-Demand หากต้องการเรียนรู้เพิ่มเติมเกี่ยวกับแบตช์ ให้คลิกที่นี่ โปรดดูรายการโมเดลที่นี่ 

    • AI21 Labs
    • AI21 Labs

      ราคาแบบ On-Demand

    • Amazon
      • Amazon Nova
      • Amazon Nova

        ราคาสำหรับโมเดลการทำความเข้าใจ

        การอนุมานข้ามรีเจี้ยนทั่วโลก

        การอนุมานข้ามภูมิภาคตามภูมิศาสตร์และในรีเจี้ยน

        เครื่องมือในตัว

        ราคาสำหรับโมเดลการสร้างเนื้อหาสร้างสรรค์

        ราคาสำหรับโมเดลการสร้างและทำความเข้าใจคำพูด

        ราคาแบบตามความต้องการสำหรับโมเดลพื้นฐานการแปลงคำพูดเป็นคำพูด

        หมายเหตุ: *ราคาอินพุตและเอาต์พุตโทเค็นข้อความใช้กับกรณีการใช้งานเฉพาะ เช่น การถอดคำพูดเป็นข้อความ การเรียกใช้เครื่องมือเพื่อทำงานให้เสร็จสิ้นหรือสร้างพื้นฐานความรู้ การเพิ่มประวัติการสนทนาลงในเซสชัน ฯลฯ 

        การอนุมานตามความต้องการสำหรับโมเดล Nova ที่กำหนดเองมีราคาเท่ากับการอนุมานพื้นฐาน Nova

        ราคาสำหรับโมเดลการฝัง

      • Amazon Titan
      • Amazon Titan

      • Amazon อื่น ๆ
    • Anthropic
    • **โมเดลที่ไม่ใช่ GA: การเข้าถึง Claude Mythos 5 และ Claude Mythos Preview ถูกจำกัดสิทธิ์และต้องได้รับอนุมัติ ติดต่อทีมบัญชี Anthropic ของคุณเพื่อขอสิทธิ์เข้าถึงบน Bedrock

      Anthropic

      ราคาแบบตามความต้องการและแบบแบตช์

      โมเดลที่มีการเข้าถึงเพิ่มเติม

      ผู้ให้บริการ ชื่อโมเดล ภูมิภาค ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M ราคาต่อโทเค็นอินพุต 1M (แบตช์) ราคาต่อโทเค็นเอาต์พุต 1M (แบตช์) ราคาต่อโทเค็นอินพุต 1M (เขียนแคช) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช)
       Anthropic  Claude 3.5 Sonnet (การเข้าถึงแบบขยายสาธารณะมีผลบังคับใช้ตั้งแต่วันที่ 1 ธันวาคม 2025) สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ), สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ), สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน), ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (ไอร์แลนด์), ยุโรป (ซูริก), ยุโรป (ปารีส) 6.00 USD 30.00 USD 3.00 USD 15.00 USD ไม่มี ไม่มี
      Anthropic  Claude 3.5 Sonnet v2 (การเข้าถึงแบบขยายสาธารณะมีผลบังคับใช้ตั้งแต่วันที่ 1 ธันวาคม 2025) สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ), สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ), สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน) 6.00 USD 30.00 USD 3.00 USD 15.00 USD 7.50 USD 0.60 USD

      ราคาระดับ Reserved

      การอนุมานแบบเพิ่มประสิทธิภาพเวลาแฝง

      ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

      โปรดติดต่อทีมงานบัญชีของคุณสำหรับราคา Provisioned Throughput

    • Cohere
    • Cohere

      ค่าบริการแบบ On-Demand

      โมเดล Cohere ราคาต่อการสืบค้น 1,000 รายการ**
      Rerank 3.5 2.00 USD
      **คุณจะถูกเรียกเก็บเงินตามจำนวนการสืบค้นโดยที่การสืบค้นหนึ่งรายการสามารถมีชิ้นส่วนเอกสารได้สูงสุด 100 ชิ้น หากการสืบค้นมีชิ้นส่วนเอกสารมากกว่า 100 ชิ้น จะนับเป็นการสืบค้นหลายรายการ ตัวอย่างเช่น หากคำขอมีเอกสาร 350 ฉบับ จะถือว่าเป็นการสืบค้น 4 รายการ โปรดทราบว่าเอกสารแต่ละฉบับสามารถมีโทเค็นได้สูงสุด 500 โทเค็นเท่านั้น (รวมถึงแบบสอบถามและโทเค็นทั้งหมดของเอกสาร) และหากความยาวโทเค็นสูงกว่า 512 โทเค็น จะแบ่งออกเป็นเอกสารหลายฉบับ

      *โทเค็นทั้งหมดที่ได้รับการฝึก = จำนวนโทเค็นในคลังข้อมูลการฝึก x จำนวน Epoch

      ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

      โมเดล Cohere ราคาต่อชั่วโมงต่อโมเดล 
      โดยไม่มีสัญญาผูกมัด
      ราคาต่อชั่วโมงต่อหน่วยโมเดลสำหรับสัญญา 1 เดือน

      ราคาต่อชั่วโมงต่อหน่วยโมเดลสำหรับสัญญา 6 เดือน

      Cohere Command

      49.50 USD

      39.60 USD

      23.77 USD

      Cohere Command - Light 8.56 USD

      6.85 USD

      4.11 USD
      ฝัง 3 ภาษาอังกฤษ 7.12 USD

      6.76 USD

      6.41 USD
      ฝัง 3 ภาษา 7.12 USD

      6.76 USD

      6.41 USD

      โปรดติดต่อทีมบัญชีหรือฝ่ายขายของ AWS ของคุณเพื่อขอดูรายละเอียดเพิ่มเติมเกี่ยวกับหน่วยโมเดล 

    • DeepSeek
    • DeepSeek

      ราคาแบบ On-Demand

      • มาตรฐาน
      • รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ), สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        DeepSeek v3.2 0.62 USD 1.85 USD

        รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), อเมริกาใต้ (เซาเปาลู), เอเชียแปซิฟิก (จาการ์ตา) เอเชียแปซิฟิก (โตเกียว) และยุโรป (สตอกโฮล์ม)

        โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        DeepSeek v3.2 0.74 USD 2.22 USD

        รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

        โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        DeepSeek v3.1 0.5974 USD 1.7304 USD
        DeepSeek v3.2 0.6386 USD 1.9055 USD
      • Priority
      • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

        โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        DeepSeek v3.1 1.0455 USD 3.0282 USD
      • Flex
      • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

        โมเดล DeepSeek ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        DeepSeek v3.1 0.2987 USD 0.8652 USD
    • Google
    • Google

      ราคาแบบ On-Demand

      รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

      โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Gemma 4 31B 0.14 USD 0.40 USD
      Gemma 4 26B A4B 0.13 USD 0.40 USD
      Gemma 4 E2B 0.04 USD 0.08 USD
      Gemma 3 4B 0.04 USD 0.08 USD
      Gemma 3 12B 0.09 USD 0.29 USD
      Gemma 3 27B 0.23 USD 0.38 USD

      รีเจี้ยน: ยุโรป (แฟรงก์เฟิร์ต)

      โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Gemma 4 31B 0.17 USD 0.48 USD
      Gemma 4 26B A4B 0.16 USD 0.48 USD
      Gemma 4 E2B 0.05 USD 0.10 USD

      รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)

      โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Gemma 3 4B 0.05 USD 0.09 USD
      Gemma 3 12B 0.11 USD 0.34 USD
      Gemma 3 27B 0.27 USD 0.45 USD

      รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)

      โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Gemma 3 4B 0.05 USD 0.10 USD
      Gemma 3 12B 0.11 USD 0.35 USD
      Gemma 3 27B 0.28 USD 0.46 USD

      รีเจี้ยน: ยุโรป (ลอนดอน)

      โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Gemma 3 4B 0.06 USD 0.12 USD
      Gemma 3 12B 0.14 USD 0.45 USD
      Gemma 3 27B 0.36 USD 0.59 USD

      รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

      โมเดลของ Google ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Gemma 3 4B 0.0412 USD 0.0824 USD
      Gemma 3 12B 0.0927 USD 0.2987 USD
      Gemma 3 27B 0.2369 USD 0.3914 USD

      * ราคาระดับ Priority สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
      * ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard

    • Luma AI
    • Luma AI

      ราคาแบบ On-Demand

    • Meta
    • Meta

      Llama 4

      ราคาแบบตามความต้องการและแบบแบตช์

      Llama 3.3

      ราคาแบบตามความต้องการและแบบแบตช์

      Llama 3.2

      ราคาแบบ On-Demand และแบบ Batch

      ราคาสำหรับการปรับแต่งโมเดล (การปรับแต่งอย่างละเอียด)

      ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

      Llama 3.1

      ราคาแบบ On-Demand และแบบ Batch

      ราคาสำหรับการปรับแต่งโมเดล (การปรับแต่งอย่างละเอียด)

      ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

      Llama 3

      ราคาแบบ On-Demand

      Llama 2

      ราคาแบบ On-Demand

      Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

      โมเดล Meta ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M

      Llama 2 Chat (13B)

      0.75 USD

      1.00 USD

      Llama 2 Chat (70B)

      1.95 USD

      2.56 USD

      ราคาสำหรับการปรับแต่งโมเดล (การปรับแต่งอย่างละเอียด)

      โมเดล Meta ราคาสำหรับการฝึกโทเค็น 1M ราคาในการจัดเก็บโมเดลแบบกำหนดเองแต่ละโมเดล* ต่อเดือน ราคาเพื่อการอนุมานจากโมเดลที่กำหนดเองต่อ 1 หน่วยโมเดลต่อชั่วโมง (โดยไม่มีการกำหนดราคา อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้โดยไม่มีสัญญาผูกมัด)

      Llama 2 Pretrained (13B)

      1.49 USD

      1.95 USD

      23.50 USD

      Llama 2 Pretrained (70B)

      7.99 USD

      1.95 USD 23.50 USD

      *พื้นที่จัดเก็บโมเดลแบบกำหนดเอง = 1.95 USD

      ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

      โมเดล Meta ราคาต่อชั่วโมงต่อหน่วยโมเดลสำหรับสัญญา 1 เดือน ราคาต่อชั่วโมงต่อหน่วยโมเดลสำหรับสัญญา 6 เดือน

      Llama 2 Pretrained และ Chat (13B)

      21.18 USD

      13.08 USD

      Llama 2 Pretrained (70B)

      21.18 USD

      13.08 USD

      *โมเดล Llama 2 Pre-trained มีเฉพาะใน Provisioned Throughput หลังจากการปรับแต่งเท่านั้น

      โปรดติดต่อทีมบัญชีหรือฝ่ายขายของ AWS ของคุณเพื่อขอดูรายละเอียดเพิ่มเติมเกี่ยวกับหน่วยโมเดล

    • MiniMax AI
    • MiniMax AI

      ราคาแบบ On-Demand

      รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

      Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Minimax M2 0.30 USD 1.20 USD
      Minimax M2.1 0.30 USD 1.20 USD
      MiniMax M2.5 0.30 USD 1.20 USD

      รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)

      Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Minimax M2 0.35 USD 1.41 USD
      Minimax M2.1 0.36 USD 1.44 USD
      Minimax M2.5 0.36 USD 1.44 USD

      รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)

      Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Minimax M2 0.36 USD 1.45 USD
      Minimax M2.1 0.36 USD 1.44 USD
      Minimax M2.5 0.36 USD 1.44 USD

      รีเจี้ยน: ยุโรป (ลอนดอน)

      Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Minimax M2 0.47 USD 1.86 USD
      Minimax M2.1 0.47 USD 1.86 USD
      Minimax M2.5 0.47 USD 1.86 USD

      รีเจี้ยน: ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (สตอกโฮล์ม), เอเชียแปซิฟิก (จาการ์ตา)

      Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Minimax M2.1 0.36 USD 1.44 USD
      Minimax M2.5 0.36 USD 1.44 USD

      รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

      Minimax models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Minimax M2 0.3090 USD 1.2360 USD
      Minimax M2.1 0.3090 USD 1.2360 USD
      Minimax M2.5 0.31 USD 1.24 USD

      * ราคาระดับ Priority สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
      * ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard

    • Mistral AI
    • Mistral AI

      ราคาแบบ On-Demand

      รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

      โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Devstral 2 123B 0.40 USD 2.00 USD
      Magistral Small 1.2
      0.50 USD 1.50 USD
      Voxtral Mini 1.0
      0.04 USD 0.04 USD
      Voxtral Small 1.0
      0.10 USD 0.30 USD
      Ministral 3B 3.0
      0.10 USD 0.10 USD
      Ministral 8B 3.0
      0.15 USD 0.15 USD
      Ministral 14B 3.0
      0.20 USD 0.20 USD
      Mistral Large 3 0.50 USD 1.50 USD

      รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ)

      โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Devstral 2 123B 0.48 USD 2.40 USD
      Magistral Small 1.2
      0.59 USD 1.76 USD
      Voxtral Mini 1.0
      0.05 USD 0.05 USD
      Voxtral Small 1.0
      0.12 USD 0.35 USD
      Ministral 3B 3.0
      0.12 USD 0.12 USD
      Ministral 8B 3.0
      0.18 USD 0.18 USD
      Ministral 14B 3.0
      0.24 USD 0.24 USD
      Mistral Large 3 0.59 USD 1.76 USD

      รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)

      โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Devstral 2 123B 0.48 USD 2.40 USD
      Magistral Small 1.2
      0.61 USD 1.82 USD
      Voxtral Mini 1.0
      0.05 USD 0.05 USD
      Voxtral Small 1.0
      0.12 USD 0.36 USD
      Ministral 3B 3.0
      0.12 USD 0.12 USD
      Ministral 8B 3.0
      0.18 USD 0.18 USD
      Ministral 14B 3.0
      0.24 USD 0.24 USD
      Mistral Large 3 0.61 USD 1.82 USD

      รีเจี้ยน: ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)

      โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Devstral 2 123B 0.48 USD 2.40 USD
      Magistral Small 1.2
      0.59 USD 1.76 USD
      Voxtral Mini 1.0
      0.05 USD 0.05 USD
      Voxtral Small 1.0
      0.12 USD 0.35 USD
      Ministral 3B 3.0
      0.12 USD 0.12 USD
      Ministral 8B 3.0
      0.18 USD 0.18 USD
      Ministral 14B 3.0
      0.24 USD 0.24 USD

      รีเจี้ยน: ยุโรป (ลอนดอน)

      โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Devstral 2 123B 0.62 USD 3.10 USD
      Magistral Small 1.2
      0.78 USD 2.33 USD
      Voxtral Mini 1.0
      0.06 USD 0.06 USD
      Voxtral Small 1.0
      0.16 USD 0.47 USD
      Ministral 3B 3.0
      0.16 USD 0.16 USD
      Ministral 8B 3.0
      0.23 USD 0.23 USD
      Ministral 14B 3.0
      0.31 USD 0.31 USD

      รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

      โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Devstral 2 123B 0.41 USD 2.06 USD
      Magistral Small 1.2
      0.5150 USD 1.5450 USD
      Voxtral Mini 1.0
      0.0412 USD 0.0412 USD
      Voxtral Small 1.0
      0.1030 USD 0.3090 USD
      Ministral 3B 3.0
      0.1030 USD 0.1030 USD
      Ministral 8B 3.0
      0.1545 USD 0.1545 USD
      Ministral 14B 3.0
      0.2060 USD 0.2060 USD
      Mistral Large 3 0.5150 USD 1.5450 USD

      รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (สตอกโฮล์ม)

      โมเดล Mistral ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Devstral 2 123B 0.48 USD 2.40 USD

      * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
      * ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard

    • Moonshot AI
    • Moonshot AI

      ราคาแบบ On-Demand

      รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

      Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Kimi K2 Thinking 0.60 USD 2.50 USD
      Kimi K2.5 0.60 USD 3.00 USD

      รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ)

      Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Kimi K2 Thinking 0.71 USD 2.94 USD
      Kimi K2.5 0.72 USD 3.60 USD

      รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)

      Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Kimi K2 Thinking 0.73 USD 3.03 USD
      Kimi K2.5 0.72 USD 3.60 USD

      รีเจี้ยน: ยุโรป (สตอกโฮล์ม), เอเชียแปซิฟิก (จาการ์ตา)

      Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Kimi K2.5 0.72 USD 3.60 USD

      รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

      Kimi models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Kimi K2 Thinking 0.6180 USD 2.5750 USD
      Kimi K2.5 0.6180 USD 3.0900 USD

      * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
      * ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard

    • NVIDIA
    • NVIDIA

      ราคาแบบ On-Demand

      รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

      โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      NVIDIA Nemotron Nano 2 0.06 USD 0.23 USD
      NVIDIA Nemotron Nano 2 VL 0.20 USD 0.60 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0.06 USD 0.24 USD
      NVIDIA Nemotron 3 Super 120B A12B 0.15 USD 0.65 USD

      รีเจี้ยน: AWS GovCloud (สหรัฐฯ ฝั่งตะวันออกและสหรัฐฯ ฝั่งตะวันตก)

      โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      NVIDIA Nemotron Nano 2 0.072 USD 0.276 USD
      NVIDIA Nemotron Nano 2 VL 0.240 USD 0.720 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0.072 USD 0.288 USD
      NVIDIA Nemotron 3 Super 120B A12B 0.180 USD 0.780 USD

      รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)

      NVIDIA models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      NVIDIA Nemotron Nano 2 0.07 USD 0.27 USD
      NVIDIA Nemotron Nano 2 VL 0.24 USD 0.71 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0.07 USD 0.28 USD
      NVIDIA Nemotron 3 Super 120B A12B 0.18 USD 0.78 USD

      รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)

      โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      NVIDIA Nemotron Nano 2 0.07 USD 0.28 USD
      NVIDIA Nemotron Nano 2 VL 0.24 USD 0.73 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0.07 USD 0.29 USD
      NVIDIA Nemotron 3 Super 120B A12B 0.18 USD 0.78 USD

      รีเจี้ยน: ยุโรป (ลอนดอน)

      NVIDIA models ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      NVIDIA Nemotron Nano 2 0.09 USD 0.36 USD
      NVIDIA Nemotron Nano 2 VL 0.31 USD 0.93 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0.09 USD 0.37 USD
      NVIDIA Nemotron 3 Super 120B A12B 0.23 USD 1.01 USD

      รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

      โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      NVIDIA Nemotron Nano 2 0.0618 USD 0.2369 USD
      NVIDIA Nemotron Nano 2 VL 0.2060 USD 0.6180 USD
      NVIDIA Nemotron 3 Nano 30B A3B 0.0618 USD 0.2472 USD
      NVIDIA Nemotron 3 Super 120B A12B 0.15 USD 0.67 USD

      รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), ยุโรป (แฟรงก์เฟิร์ต) และยุโรป (สตอกโฮล์ม)

      โมเดลของ NVIDIA ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      NVIDIA Nemotron 3 Super 120B A12B 0.18 USD 0.78 USD

      * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
      * ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard

    • OpenAI
    • OpenAI

      • โมเดลของ Frontier
      • การอนุมานแบบ On-Demand ในรีเจี้ยน

        รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ)

          ระยะเวลาบริบทสั้น (272K) ระยะเวลาบริบทยาว (1M)
        โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M
        Daybreak Red: GPT-5.6 Cyber 13.75 USD 17.1875 USD 1.375 USD 82.50 USD  -  -  -  -
        Daybreak Blue: GPT-5.6 Sol 5.50 USD 6.875 USD 0.55 USD 33.00 USD 10.00 USD 13.75 USD 1.10 USD 49.50 USD
        GPT-5.6 Sol 5.50 USD 6.875 USD 0.55 USD 33.00 USD 10.00 USD 13.75 USD 1.10 USD 49.50 USD
        GPT-5.6 Terra 2.20 USD 2.75 USD 0.22 USD 13.20 USD 4.40 USD 5.50 USD 0.44 USD 19.80 USD
        GPT-5.6 Luna 0.22 USD 0.275 USD 0.022 USD 1.32 USD 0.44 USD 0.55 USD 0.044 USD 1.98 USD
        GPT-5.5 5.50 USD - 0.55 USD 33.00 USD  -  -  -  -
        GPT-5.4 2.75 USD - 0.275 USD 16.50 USD  -  -  -  -

        รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ)

          ระยะเวลาบริบทสั้น (272K) ระยะเวลาบริบทยาว (1M)
        โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M
        GPT-5.6 Sol 5.50 USD 6.875 USD 0.55 USD 33.00 USD 10.00 USD 13.75 USD 1.10 USD 49.50 USD
        GPT-5.6 Terra 2.20 USD 2.75 USD 0.22 USD 13.20 USD 4.40 USD 5.50 USD 0.44 USD 19.80 USD
        GPT-5.6 Luna 0.22 USD 0.275 USD 0.022 USD 1.32 USD 0.44 USD 0.55 USD 0.044 USD 1.98 USD
        GPT-5.5 5.50 USD - 0.55 USD 33.00 USD  -  -  -  -
        GPT-5.4 2.75 USD - 0.275 USD 16.50 USD  -  -  -  -

        รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

          ระยะเวลาบริบทสั้น (272K) ระยะเวลาบริบทยาว (1M)
        โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุต 1M (เขียนแคช 30 นาที) ราคาต่อโทเค็นอินพุต 1M (อ่านแคช) ราคาต่อโทเค็นเอาต์พุต 1M
        GPT-5.6 Terra 2.20 USD 2.75 USD 0.22 USD 13.20 USD 4.40 USD 5.50 USD 0.44 USD 19.80 USD
        GPT-5.6 Luna 0.22 USD 0.275 USD 0.022 USD 1.32 USD 0.44 USD 0.55 USD 0.044 USD 1.98 USD
        GPT-5.4 2.75 USD - 0.275 USD 16.50 USD  -  -  -  -

        รีเจี้ยน: AWS GovCloud (สหรัฐฯ ฝั่งตะวันตก)

        โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุตแคช 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GPT-5.4 3.30 USD 0.33 USD 19.80 USD

        หมายเหตุ: การอนุมานในรีเจี้ยนมีราคาเทียบเท่ากับระดับสถานที่จัดเก็บข้อมูลของ OpenAI การกำหนดราคาอนุมานข้ามรีเจี้ยนทั่วโลกจะมาเร็ว ๆ นี้

      • gpt-oss-20b, 120b
        • มาตรฐาน
        • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

          โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
          gpt-oss-20b 0.0721 USD 0.3090 USD
          gpt-oss-120b 0.1545 USD 0.6180 USD
        • Priority
        • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

          โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
          gpt-oss-20b 0.1262 USD 0.5408 USD
          gpt-oss-120b 0.2704 USD 1.0815 USD
        • Flex
        • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

          โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
          gpt-oss-20b 0.0361 USD 0.1545 USD
          gpt-oss-120b 0.0773 USD 0.3090 USD
        • Batch
        • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

          โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
          gpt-oss-20b 0.0361 USD 0.1545 USD
          gpt-oss-120b 0.0773 USD 0.3090 USD
        • การปรับแต่งโมเดล
        • การปรับแต่งโมเดล

          การกำหนดราคา Reinforcement Fine Tuning

          ด้วยความสามารถในการปรับแต่งเพิ่มเติมการเสริมแรงใน Amazon Bedrock คุณสามารถปรับปรุงความแม่นยำของโมเดลได้โดยไม่ต้องมีความเชี่ยวชาญเชิงลึกด้านแมชชีนเลิร์นนิง หรือใช้ข้อมูลที่ติดป้ายกำกับจำนวนมาก Amazon Bedrock จะเปลี่ยนเวิร์กโฟลว์การปรับแต่งการเสริมแรงให้เป็นระบบอัตโนมัติ: ใช้พร้อมท์ของคุณ สร้างการตอบสนองแบบจำลอง และให้คะแนนโดยใช้ฟังก์ชันรางวัลของคุณ พร้อมท์ คำตอบ และคะแนนเหล่านี้ จะนำไปใช้ฝึกโมเดลของคุณผ่านเวิร์กโฟลว์ RFT แบบวนซ้ำ 

          เวิร์กโฟลว์การฝึกทั้งหมดจะถูกเรียกเก็บเป็นอัตราต่อชั่วโมง หลังจากการฝึกเสร็จสิ้นลูกค้าสามารถใช้โมเดลที่ปรับแต่งได้ทันทีเพื่ออนุมานแบบ On-Demand ตัวเลือกการอนุมานแบบ On-Demand ประกอบด้วยแบบจำลองการกำหนดราคาตามโทเค็นที่เรียกเก็บเงินตามจำนวนโทเค็นที่ประมวลผลระหว่างการอนุมาน

          ภูมิภาค: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

          โมเดล OpenAI ราคาต่อชั่วโมงการฝึก ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M ราคาในการจัดเก็บแต่ละโมเดลที่ผ่านการฝึกต่อเดือน
          gpt-oss-20b 80.00 USD 0.09 USD 0.39 USD 1.95 USD
      • gpt-oss-safeguard 20b, 120b
      • ราคาแบบ On-Demand

        รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GPT OSS Safeguard 20B 0.07 USD 0.20 USD
        GPT OSS Safeguard 120B 0.15 USD 0.60 USD

        รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)

        โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GPT OSS Safeguard 20B 0.08 USD 0.24 USD
        GPT OSS Safeguard 120B 0.18 USD 0.71 USD

        รีเจี้ยน: ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)

        โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GPT OSS Safeguard 20B 0.08 USD 0.23 USD
        GPT OSS Safeguard 120B 0.18 USD 0.70 USD

        รีเจี้ยน: ยุโรป (ลอนดอน)

        โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GPT OSS Safeguard 20B 0.11 USD 0.31 USD
        GPT OSS Safeguard 120B 0.23 USD 0.93 USD

        รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

        โมเดล OpenAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GPT OSS Safeguard 20B 0.0721 USD 0.2060 USD
        GPT OSS Safeguard 120B 0.1545 USD 0.6180 USD

        * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
        * ราคาระดับ Flex มีส่วนลด 50% จากราคาระดับ Standard

    • Qwen
    • Amazon Bedrock

      Qwen

      • Qwen3 Coder, 32B, 235B
        • มาตรฐาน
        • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

          โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
          Qwen3 Coder 30B A3B 0.1545 USD 0.6180 USD
          Qwen3 32B 0.1545 USD 0.6180 USD
          Qwen3 235B A22B 2507 0.2266 USD 0.9064 USD
        • Priority
        • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

          โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
          Qwen3 Coder 30B A3B 0.2704 USD 1.0815 USD
          Qwen3 32B 0.2704 USD 1.0815 USD
          Qwen3 235B A22B 2507 0.3966 USD 1.5862 USD
        • Flex
        • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

          โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
          Qwen3 Coder 30B A3B 0.0773 USD 0.3090 USD
          Qwen3 32B 0.0773 USD 0.3090 USD
          Qwen3 235B A22B 2507 0.1133 USD 0.4532 USD
        • Batch
        • รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

          โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
          Qwen3 Coder 30B A3B 0.0773 USD 0.3090 USD
          Qwen3 32B 0.0773 USD 0.3090 USD
          Qwen3 235B A22B 2507 0.1133 USD 0.4532 USD
        • การปรับแต่งโมเดล
        • การปรับแต่งโมเดล

          การกำหนดราคา Reinforcement Fine Tuning

          ด้วยความสามารถในการปรับแต่งเพิ่มเติมการเสริมแรงใน Amazon Bedrock คุณสามารถปรับปรุงความแม่นยำของโมเดลได้โดยไม่ต้องมีความเชี่ยวชาญเชิงลึกด้านแมชชีนเลิร์นนิง หรือใช้ข้อมูลที่ติดป้ายกำกับจำนวนมาก Amazon Bedrock จะเปลี่ยนเวิร์กโฟลว์การปรับแต่งการเสริมแรงให้เป็นระบบอัตโนมัติ: ใช้พร้อมท์ของคุณ สร้างการตอบสนองแบบจำลอง และให้คะแนนโดยใช้ฟังก์ชันรางวัลของคุณ พร้อมท์ คำตอบ และคะแนนเหล่านี้ จะนำไปใช้ฝึกโมเดลของคุณผ่านเวิร์กโฟลว์ RFT แบบวนซ้ำ

          เวิร์กโฟลว์การฝึกทั้งหมดจะถูกเรียกเก็บเป็นอัตราต่อชั่วโมง หลังจากการฝึกเสร็จสิ้นลูกค้าสามารถใช้โมเดลที่ปรับแต่งได้ทันทีเพื่ออนุมานแบบ On-Demand ตัวเลือกการอนุมานแบบ On-Demand ประกอบด้วยแบบจำลองการกำหนดราคาตามโทเค็นที่เรียกเก็บเงินตามจำนวนโทเค็นที่ประมวลผลระหว่างการอนุมาน

          ภูมิภาค: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

          โมเดลของ Qwen ราคาต่อชั่วโมงการฝึก ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M ราคาในการจัดเก็บแต่ละรุ่นที่ผ่านการฝึกต่อเดือนน
          Qwen3 32B 80.00 USD 0.20 USD 0.78 USD 1.95 USD
      • Qwen 3 Next, VL, Coder Next
      • ราคาแบบ On-Demand

        รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        Qwen3 Next 80B A3B 0.15 USD 1.20 USD
        Qwen3 VL 235B A22B 0.53 USD 2.66 USD
        Qwen3 Coder Next 0.50 USD 1.20 USD

        รีเจี้ยน: เอเชียแปซิฟิก (มุมไบ), ยุโรป (ไอร์แลนด์) และยุโรป (มิลาน)

        โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        Qwen3 Next 80B A3B 0.18 USD 1.41 USD
        Qwen3 VL 235B A22B 0.62 USD 3.13 USD
        Qwen3 Coder Next 0.60 USD 1.44 USD

        รีเจี้ยน: อเมริกาใต้ (เซาเปาลู) และเอเชียแปซิฟิก (โตเกียว)

        โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        Qwen3 Next 80B A3B 0.18 USD 1.45 USD
        Qwen3 VL 235B A22B 0.64 USD 3.22 USD
        Qwen3 Coder Next 0.60 USD 1.44 USD

        รีเจี้ยน: ยุโรป (ลอนดอน)

        โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        Qwen3 Next 80B A3B 0.23 USD 1.86 USD
        Qwen3 VL 235B A22B 0.82 USD 4.12 USD
        Qwen3 Coder Next 0.78 USD 1.86 USD

        รีเจี้ยน: ยุโรป (แฟรงก์เฟิร์ต) และเอเชียแปซิฟิก (จาการ์ตา)

        โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        Qwen3 Coder Next 0.60 USD 1.44 USD

        รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

        โมเดลของ Qwen ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        Qwen3 Next 80B A3B 0.1545 USD 1.2360 USD
        Qwen3 VL 235B A22B 0.5459 USD 2.7398 USD
        Qwen3 Coder Next 0.5150 USD 1.2360 USD

        * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
        * ราคาระดับ Flex และ Batch มีส่วนลด 50% จากราคาระดับ Standard

    • Stability AI
    • Stability AI

      ราคาแบบ On-Demand

      โมเดลรูปภาพรุ่นก่อนหน้าที่ Stability AI นำเสนอจะมีราคาต่อภาพ ขึ้นอยู่กับจำนวนขั้นตอนและความละเอียดของภาพ

       

      ภูมิภาค: โอเรกอน, เวอร์จิเนียฝั่งเหนือ, โอไฮโอ

      บริการรูปภาพ Stability AI ราคาต่อการสร้างสำหรับแต่ละโมเดล  
      ลบพื้นหลังด้วย Stable Image 0.07 USD  
      วัตถุลบด้วย Stable Image 0.07 USD  
      โครงสร้างการควบคุม Stable Image 0.07 USD  
      ภาพร่างการควบคุม Stable Image 0.07 USD  
      คู่มือรูปแบบ Stable Image 0.07 USD  
      การค้นหาและแทนที่ Stable Image 0.07 USD  
      การแก้ไขรายละเอียดด้วย Stable Image 0.07 USD  
      การค้นหาและปรับสีใหม่ด้วย Stable Image 0.07 USD  
      การถ่ายโอนรูปแบบ Stable Image 0.08 USD  
      การอัปสเกลแบบคงรายละเอียดด้วย Stable Image 0.40 USD  
      การอัปสเกลเชิงสร้างสรรค์ด้วย Stable Image 0.60 USD  
      การอัปสเกลแบบรวดเร็วด้วย Stable Image 0.03 USD  
      การเพิ่มรายละเอียดด้วย Stable Image 0.06 USD  
    • TwelveLabs
    • TwelveLabs

      ราคาแบบ On-Demand

      • การอนุมานข้ามรีเจี้ยนทั่วโลก
      • การอนุมานข้ามภูมิภาคตามภูมิศาสตร์และในรีเจี้ยน
    • Writer
    • Writer

      ราคาแบบ On-demand

      โมเดล Writer ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Palmyra X4 2.50 USD 10.00 USD
      Palmyra X5 0.60 USD 6.00 USD
      Palmyra Vision 7B 0.15 USD 0.60 USD
    • xAI
    • xAI

      ราคาแบบ On-Demand

      รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

      โมเดลของ xAI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นอินพุตแคช 1M ราคาต่อโทเค็นเอาต์พุต 1M
      Grok 4.3 1.25 USD 0.20 USD 2.50 USD
    • Z AI
    • Amazon Bedrock

      Z AI

      • GLM 5
      • ราคาแบบ On-Demand

        รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 5 1.00 USD 3.20 USD

        รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), เอเชียแปซิฟิก (มุมไบ), เอเชียแปซิฟิก (โตเกียว), อเมริกาใต้ (เซาเปาลู) และยุโรป (สตอกโฮล์ม)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 5 1.20 USD 3.84 USD

        รีเจี้ยน: ยุโรป (ลอนดอน)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 5 1.55 USD 4.96 USD

        รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 5 1.03 USD 3.30 USD

        * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
        * ราคาระดับ Flex และ Batch มีส่วนลด 50% จากราคาระดับ Standard

      • GLM 4.7
      • ราคาแบบ On-Demand

        รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 4.7 0.60 USD 2.20 USD

        รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), เอเชียแปซิฟิก (มุมไบ), เอเชียแปซิฟิก (โตเกียว), อเมริกาใต้ (เซาเปาลู) และยุโรป (สตอกโฮล์ม)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 4.7 0.72 USD 2.64 USD

        รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 4.7 0.6180 USD 2.2660 USD

        * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
        * ราคาระดับ Flex และ Batch มีส่วนลด 50% จากราคาระดับ Standard

      • GLM 4.7 Flash
      • ราคาแบบ On-Demand

        รีเจี้ยน: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) สหรัฐอเมริกาฝั่งตะวันออก (โอไฮโอ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 4.7 Flash 0.07 USD 0.40 USD
        GLM 5 1.00 USD 3.20 USD

        รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), เอเชียแปซิฟิก (มุมไบ), เอเชียแปซิฟิก (โตเกียว), ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (ไอร์แลนด์), ยุโรป (มิลาน), ยุโรป (สตอกโฮล์ม) และอเมริกาใต้ (เซาเปาลู)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 4.7 Flash 0.08 USD 0.48 USD

        รีเจี้ยน: เอเชียแปซิฟิก (จาการ์ตา), เอเชียแปซิฟิก (มุมไบ), เอเชียแปซิฟิก (โตเกียว), ยุโรป (แฟรงก์เฟิร์ต), ยุโรป (สตอกโฮล์ม) และอเมริกาใต้ (เซาเปาลู)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 5 1.20 USD 3.84 USD

        รีเจี้ยน: ยุโรป (ลอนดอน)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 4.7 Flash 0.11 USD 0.62 USD
        GLM 5 1.55 USD 4.96 USD

        รีเจี้ยน: เอเชียแปซิฟิก (ซิดนีย์)

        โมเดลของ Z AI ราคาต่อโทเค็นอินพุต 1M ราคาต่อโทเค็นเอาต์พุต 1M
        GLM 4.7 Flash 0.0721 USD 0.4120 USD
        GLM 5 1.03 USD 3.30 USD

        * ราคาระดับ Priority อยู่สูงกว่า 75% เมื่อเทียบกับราคาระดับ Standard
        * ราคาระดับ Flex และ Batch มีส่วนลด 50% จากราคาระดับ Standard

    • นำเข้าโมเดลที่กำหนดเอง
    • นำเข้าโมเดลที่กำหนดเอง

      • Llama
      • Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        Region: ยุโรป (แฟรงก์เฟิร์ต) 

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย

        *เรียกเก็บเงินภายในกรอบเวลา 5 นาที

      • Llama หลายรูปแบบ
      • Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        Region: ยุโรป (แฟรงก์เฟิร์ต) 

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย

        *เรียกเก็บเงินภายในกรอบเวลา 5 นาที

      • Mistral
      • Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        Region: ยุโรป (แฟรงก์เฟิร์ต) 

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย

        *เรียกเก็บเงินภายในกรอบเวลา 5 นาที

      • Mixtral
      • Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        Region: ยุโรป (แฟรงก์เฟิร์ต) 

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย

        *เรียกเก็บเงินภายในกรอบเวลา 5 นาที

      • Flan
      • Region: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        Region: ยุโรป (แฟรงก์เฟิร์ต) 

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย

        *เรียกเก็บเงินภายในกรอบเวลา 5 นาที

        การกำหนดราคาอนุมานตามความต้องการ:
        คุณจะถูกเรียกเก็บเงินเป็นช่วงเวลา 5 นาทีสำหรับระยะเวลาที่สำเนาโมเดลของคุณใช้งานอยู่ตั้งแต่การเรียกดำเนินการครั้งแรกที่ประสบความสำเร็จ ปริมาณงานสูงสุดและขีดจำกัดความพร้อมกันต่อสำเนาโมเดลขึ้นอยู่กับปัจจัยต่าง ๆ เช่น การผสมโทเค็นอินพุต/เอาต์พุต ประเภทฮาร์ดแวร์ ขนาดโมเดล สถาปัตยกรรม การเพิ่มประสิทธิภาพการอนุมานและจะถูกกำหนดในระหว่างเวิร์กโฟลว์การนำเข้าโมเดล

        Bedrock จะปรับขนาดจำนวนสำเนาโมเดลโดยอัตโนมัติขึ้นอยู่กับรูปแบบการใช้งานของคุณ หากไม่มีการเรียกดำเนินการเป็นระยะเวลา 5 นาที Bedrock จะลดลงเป็นศูนย์และปรับขนาดสำรองเมื่อคุณเรียกดำเนินการโมเดลของคุณ ขณะปรับขนาดสำรองข้อมูลคุณอาจมีระยะเวลาโคลด์สตาร์ทได้ (ในหลายสิบวินาที) ขึ้นอยู่กับขนาดของโมเดล Bedrock ยังขยายขนาดสำเนาโมเดลหากปริมาณการอนุมานของคุณเกินขีดจำกัดความพร้อมกันของสำเนาโมเดลเดียวอย่างสม่ำเสมอ หมายเหตุ: มีค่าเริ่มต้นสูงสุด 3 สำเนาโมเดลต่อบัญชีต่อโมเดลที่นำเข้าซึ่งสามารถเพิ่มได้ผ่าน Service Quotas

      • Qwen
      • ภูมิภาค: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.05718 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        Region: ยุโรป (แฟรงก์เฟิร์ต) 

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v1.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.07144 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย

        *เรียกเก็บเงินภายในกรอบเวลา 5 นาที

        การกำหนดราคาอนุมานตามความต้องการ:
        คุณจะถูกเรียกเก็บเงินเป็นช่วงเวลา 5 นาทีสำหรับระยะเวลาที่สำเนาโมเดลของคุณใช้งานอยู่ตั้งแต่การเรียกดำเนินการครั้งแรกที่ประสบความสำเร็จ ปริมาณงานสูงสุดและขีดจำกัดความพร้อมกันต่อสำเนาโมเดลขึ้นอยู่กับปัจจัยต่าง ๆ เช่น การผสมโทเค็นอินพุต/เอาต์พุต ประเภทฮาร์ดแวร์ ขนาดโมเดล สถาปัตยกรรม การเพิ่มประสิทธิภาพการอนุมานและจะถูกกำหนดในระหว่างเวิร์กโฟลว์การนำเข้าโมเดล

        Bedrock จะปรับขนาดจำนวนสำเนาโมเดลโดยอัตโนมัติขึ้นอยู่กับรูปแบบการใช้งานของคุณ หากไม่มีการเรียกดำเนินการเป็นระยะเวลา 5 นาที Bedrock จะลดลงเป็นศูนย์และปรับขนาดสำรองเมื่อคุณเรียกดำเนินการโมเดลของคุณ ขณะปรับขนาดสำรองข้อมูลคุณอาจมีระยะเวลาโคลด์สตาร์ทได้ (ในหลายสิบวินาที) ขึ้นอยู่กับขนาดของโมเดล Bedrock ยังขยายขนาดสำเนาโมเดลหากปริมาณการอนุมานของคุณเกินขีดจำกัดความพร้อมกันของสำเนาโมเดลเดียวอย่างสม่ำเสมอ หมายเหตุ: มีค่าเริ่มต้นสูงสุด 3 สำเนาโมเดลต่อบัญชีต่อโมเดลที่นำเข้าซึ่งสามารถเพิ่มได้ผ่าน Service Quotas

      • OpenAI
      • ภูมิภาค: สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ) และสหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

        เวอร์ชันหน่วยโมเดลแบบกำหนดเอง v2.0
        ราคาต่อหน่วยโมเดลแบบกำหนดเองต่อนาที* 0.1433 USD
        ต้นทุนพื้นที่จัดเก็บรายเดือนต่อหน่วยโมเดลแบบกำหนดเอง 1.95 USD

        หมายเหตุ: หน่วยโมเดลแบบกำหนดเองที่จำเป็นในการโฮสต์โมเดลนั้นขึ้นอยู่กับปัจจัยหลายประการ โดยเฉพาะสถาปัตยกรรมโมเดล จำนวนพารามิเตอร์ของโมเดล และความยาวของบริบท จำนวนหน่วยโมเดลแบบกำหนดเองที่ต้องการจะถูกกำหนด ณ เวลาที่นำเข้า สำหรับการอ้างอิง รุ่น Llama 3.1 8B 128K ต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ส่วนรุ่น Llama 3.1 70B 128k ต้องใช้หน่วยโมเดลแบบกำหนดเอง 8 หน่วย

        *เรียกเก็บเงินภายในกรอบเวลา 5 นาที

        การกำหนดราคาอนุมานตามความต้องการ:
        คุณจะถูกเรียกเก็บเงินเป็นช่วงเวลา 5 นาทีสำหรับระยะเวลาที่สำเนาโมเดลของคุณใช้งานอยู่ตั้งแต่การเรียกดำเนินการครั้งแรกที่ประสบความสำเร็จ ปริมาณงานสูงสุดและขีดจำกัดความพร้อมกันต่อสำเนาโมเดลขึ้นอยู่กับปัจจัยต่าง ๆ เช่น การผสมโทเค็นอินพุต/เอาต์พุต ประเภทฮาร์ดแวร์ ขนาดโมเดล สถาปัตยกรรม การเพิ่มประสิทธิภาพการอนุมานและจะถูกกำหนดในระหว่างเวิร์กโฟลว์การนำเข้าโมเดล

        Bedrock จะปรับขนาดจำนวนสำเนาโมเดลโดยอัตโนมัติขึ้นอยู่กับรูปแบบการใช้งานของคุณ หากไม่มีการเรียกดำเนินการเป็นระยะเวลา 5 นาที Bedrock จะลดลงเป็นศูนย์และปรับขนาดสำรองเมื่อคุณเรียกดำเนินการโมเดลของคุณ ขณะปรับขนาดสำรองข้อมูลคุณอาจมีระยะเวลาโคลด์สตาร์ทได้ (ในหลายสิบวินาที) ขึ้นอยู่กับขนาดของโมเดล Bedrock ยังขยายขนาดสำเนาโมเดลหากปริมาณการอนุมานของคุณเกินขีดจำกัดความพร้อมกันของสำเนาโมเดลเดียวอย่างสม่ำเสมอ หมายเหตุ: มีค่าเริ่มต้นสูงสุด 3 สำเนาโมเดลต่อบัญชีต่อโมเดลที่นำเข้าซึ่งสามารถเพิ่มได้ผ่าน Service Quotas

  • ฐานความรู้
    • ฐานความรู้ที่มีการจัดการ
    • ฐานความรู้ที่มีการจัดการของ Amazon Bedrock

      ฐานความรู้ที่มีการจัดการของ Amazon Bedrock ช่วยให้เจ้าหน้าที่ของคุณสามารถค้นหา พิจารณา และดึงข้อมูลที่ถูกต้องจากเอกสาร รูปภาพ เสียง และวิดีโอของคุณ โดยไม่ต้องจัดการโครงสร้างพื้นฐานใด ๆ โดยจะผสานรวมเข้ากับ Amazon Bedrock AgentCore อย่างราบรื่นสำหรับเวิร์กโหลด AI ของคุณ ไม่ว่าคุณจะเป็นนักพัฒนาที่มีประสบการณ์หรือสร้าง AI Agent ตัวแรกของคุณ ฐานความรู้ที่มีการจัดการจะจัดการกับการนำข้อมูลเข้า การวิเคราะห์แบบหลายรูปแบบ การจัดเก็บเวกเตอร์ และการดึงข้อมูลอัจฉริยะโดยอัตโนมัติ คุณจ่ายเฉพาะสำหรับสิ่งที่คุณเก็บและเรียกคืนเท่านั้น

      มีอะไรรวมโดยไม่มีค่าใช้จ่ายเพิ่มเติม:

      • การแยกวิเคราะห์เอกสารแบบหลายรูปแบบด้วยตัวแยกวิเคราะห์ที่มีการจัดการ
      • การสร้างการฝังด้วยโมเดลที่มีการจัดการ
      • การจัดอันดับซ้ำด้วยตัวจัดอันดับแบบมีการจัดการ

      หมายเหตุ: จะมีค่าธรรมเนียมการเรียกใช้เครื่องมือ Standard Gateway หากคุณเรียกใช้ฐานความรู้ที่มีการจัดการผ่าน AgentCore Gateway จะมีค่าบริการตามอัตรา CloudWatch แบบ Standard หากเปิดใช้งานข้อมูลการสังเกตได้

      คุณสมบัติ คำอธิบาย ราคา

      การจัดเก็บดัชนี

      ดัชนีการค้นหาที่มีการจัดการด้วยตัวเชื่อมต่อดั้งเดิมเพื่อซิงค์ข้อมูลจาก S3, SharePoint, Confluence และอื่น ๆ

      5.00 USD ต่อ GB ของข้อมูลดิบ/เดือน

      การแยกวิเคราะห์เอกสารแบบหลายรูปแบบ (ตัวแยกข้อมูลที่มีการจัดการ)

      วิเคราะห์ข้อความ, ไฟล์, PDF, รูปภาพ, ตาราง, เสียง และวิดีโอเป็นเนื้อหาที่ค้นหาได้

      0 USD

      การสร้างการฝังตัว (โมเดลที่มีการจัดการ)

      แปลงเนื้อหาของคุณเป็นเวกเตอร์ที่ค้นหาได้โดยใช้โมเดลในตัว

      0 USD

      Standard Retrieval (Retrieve API)

      การค้นหาแบบไฮบริดรวมการค้นหาเชิงความหมายและการค้นหาคำหลักบนเนื้อหาที่จัดทำดัชนีของคุณ

      1.00 USD ต่อการเรียกใช้ API 1,000 ครั้ง

      จัดอันดับใหม่ (ผู้จัดอันดับที่มีการจัดการ)*

      จัดเรียงลำดับข้อความที่ดึงมาใหม่ตามความเกี่ยวข้อง

      0 USD

      การดึงข้อมูลแบบเอเจนติก - การวางแผน LLM ที่มีการจัดการ**

      การดึงข้อมูลแบบมัลติฮอปโดยใช้ LLM ในตัวสำหรับการวางแผนการสืบค้น

      4.00 USDต่อการเรียกใช้ Agentic Retrieve API 1,000 ครั้ง + 1.00 USD ต่อ 1,000 การเรียกใช้ Retrieve API พื้นฐาน

      * มีค่าใช้จ่ายเพิ่มเติมหากคุณเลือกโมเดลที่คุณกำหนดเองสำหรับการสร้างการฝังหรือจัดอันดับซ้ำ โปรดดูราคาในส่วนผู้ให้บริการโมเดล

      ** สำหรับการดึงข้อมูลของ Agentic กับ LLM ที่คุณเลือก คุณจะจ่ายเงิน 1.00 USD ต่อการเรียกใช้ Retrieve API 1,000 ครั้ง และราคาผู้ให้บริการแบบจำลองสำหรับ LLM ที่ใช้สำหรับการวางแผนแบบสอบถาม

    • ฐานความรู้ที่มีการจัดการด้วยตนเอง
    • การดึงข้อมูลที่มีโครงสร้าง (การสร้าง SQL)

      การดึงข้อมูลที่มีโครงสร้างจะถูกเรียกเก็บเงินสำหรับคำขอแต่ละรายการเพื่อสร้างการสืบค้น SQL การสืบค้น SQL ที่สร้างขึ้นจะใช้เพื่อดึงข้อมูลจากที่เก็บข้อมูลที่มีโครงสร้าง

      โมเดล Rerank

      โมเดล Rerank ได้รับการออกแบบมาเพื่อปรับปรุงความเกี่ยวข้องและความแม่นยำของการตอบสนองในแอปพลิเคชันการดึงข้อมูลเพื่อการสร้างแบบเสริม (RAG) มีการเรียกเก็บเงินต่อการสืบค้น

      **คุณจะถูกเรียกเก็บเงินตามจำนวนการสืบค้นโดยที่การสืบค้นหนึ่งรายการสามารถมีชิ้นส่วนเอกสารได้สูงสุด 100 ชิ้น หากการสืบค้นมีชิ้นส่วนเอกสารมากกว่า 100 ชิ้น จะนับเป็นการสืบค้นหลายรายการ ตัวอย่างเช่น หากคำขอมีเอกสาร 350 ฉบับ จะถือว่าเป็นการสืบค้น 4 รายการ โปรดทราบว่าเอกสารแต่ละฉบับสามารถมีโทเค็นได้สูงสุด 512 โทเค็นเท่านั้น (รวมถึงการสืบค้นและโทเค็นทั้งหมดของเอกสาร) และหากความยาวโทเค็นสูงกว่า 512 โทเค็น จะแบ่งออกเป็นเอกสารหลายฉบับ การสืบค้นเทียบเท่ากับหน่วยค้นหา

  • กฎควบคุมระบบ
  • กฎควบคุมระบบ Amazon Bedrock

    การกำหนดราคาสำหรับ Amazon Bedrock Guardrails ขึ้นอยู่กับค่าใช้จ่ายที่เกิดขึ้นจากตัวกรองที่ใช้ในกฎควบคุมระบบ ราคาจะเหมือนกันสำหรับทั้งระดับ Standard และระดับ Classic

    การป้องกัน/การกรอง Bedrock Guardrails*

    ราคา

    ตัวกรองเนื้อหาสำหรับทั้งระดับ Standard และระดับ Classic (เนื้อหาข้อความ)

    0.15 USD ต่อ 1,000 หน่วยข้อความ

    ตัวกรองเนื้อหา (เนื้อหาภาพ)

    0.00075 USD ต่อภาพที่ประมวลผล

    หัวข้อปฏิเสธสำหรับทั้งระดับ Standard และระดับ Classic

    0.15 USD ต่อ 1,000 หน่วยข้อความ

    ตัวกรองข้อมูลที่ละเอียดอ่อน 

    0.10 USD ต่อ 1,000 หน่วยข้อความ

    ตัวกรองข้อมูลที่ละเอียดอ่อน (นิพจน์ปกติ) 

    ฟรี

    ตัวกรองคำ

    ฟรี

    การตรวจสอบกราวด์ดิ้งตามบริบท**

    0.10 USD ต่อ 1,000 หน่วยข้อความ

    การตรวจสอบการให้เหตุผลอัตโนมัติ

    0.17 USD ต่อ 1,000 หน่วยข้อความ ต่อนโยบายการให้เหตุผลอัตโนมัติ

    ตารางด้านล่างแสดงราคาสำหรับ Bedrock Guardrails เมื่อใช้กับ InvokeGuardRailChecks API 

    การป้องกัน/การกรอง Bedrock Guardrails*

    ราคา

    ตัวกรองเนื้อหา (เนื้อหาข้อความเท่านั้น)

    0.07 USD ต่อ 1,000 หน่วยข้อความ

    การโจมตีพร้อมท์ (เนื้อหาข้อความเท่านั้น) ***

    0.08 USD ต่อ 1,000 หน่วยข้อความ

    ตัวกรองข้อมูลที่ละเอียดอ่อน

    0.10 USD ต่อ 1,000 หน่วยข้อความ

    ราคาแบบ On-Demand

    * นโยบายกฎควบคุมระบบแต่ละข้อเป็นทางเลือกและสามารถเปิดใช้งานได้ตามความต้องการของแอปพลิเคชันของคุณ ค่าธรรมเนียมจะเกิดขึ้นตามการป้องกันที่ใช้ ตัวอย่างเช่น หากคุณใช้งานตัวกรองเนื้อหาและตัวกรองข้อมูลที่มีความละเอียดอ่อน จะมีค่าบริการเกิดขึ้นเฉพาะตัวกรองทั้งสองประเภทนี้เท่านั้น โดยไม่มีค่าบริการใด ๆ สำหรับตัวกรองประเภทอื่น

    ** การตรวจสอบกราวด์ดิ้งตามบริบทใช้แหล่งอ้างอิงและการสืบค้นเพื่อตรวจสอบว่าการตอบสนองของโมเดลมีพื้นฐานตามแหล่งที่มาและเกี่ยวข้องกับการสืบค้นหรือไม่ จำนวนหน่วยข้อความทั้งหมดที่เรียกเก็บเงินจะถูกคำนวณโดยการรวมอักขระทั้งหมดในแหล่งที่มาการสืบค้นและการตอบสนองแบบจำลอง 

    *** ด้วย InvokeGuardRailChecks API คุณสามารถใช้ตัวกรองการโจมตีแบบพร้อมท์แยกต่างหากนอกตัวกรองเนื้อหา การแยกนี้สามารถใช้ได้กับ API นี้เท่านั้น 

    หมายเหตุ: หน่วยข้อความสามารถมีตัวอักษรได้สูงสุด 1,000 ตัวอักษร หากการป้อนข้อความมีมากกว่า 1000 ตัวอักษรจะถูกประมวลผลเป็นหน่วยข้อความหลายหน่วยโดยแต่ละตัวมีตัวอักษร 1000 ตัวหรือน้อยกว่า ตัวอย่างเช่น หากการป้อนข้อความมีอักขระ 5,600 ตัว จะถูกเรียกเก็บค่าใช้จ่ายสำหรับหน่วยข้อความ 6 หน่วย

  • การประเมินโมเดล
  • การประเมินโมเดล

    จะมีการเรียกเก็บค่าบริการการประเมินโมเดลสำหรับการอนุมานจากแบบจำลองที่คุณเลือก คะแนนอัลกอริทึมที่สร้างขึ้นโดยอัตโนมัติจะให้บริการโดยไม่มีค่าใช้จ่ายเพิ่มเติม สำหรับการประเมินด้วยมนุษย์ที่คุณนำเวิร์กสตรีมของคุณมาเอง คุณจะถูกเรียกเก็บสำหรับการอนุมานโมเดลในการประเมิน และคิดค่าใช้จ่าย 0.21 USD ต่องานของมนุษย์ที่เสร็จสมบูรณ์

    หากคุณใช้การประเมินผล RAG หรือ LLM-as-a-Judge ในการประเมินโมเดล จะมีการเรียกเก็บค่าบริการสำหรับโทเค็นที่โมเดลตัดสินที่ใช้ตามราคาระดับ Standard แบบ On-Demand พร้อมท์ตัดสินจะถูกคิดค่าบริการรวมอยู่ในปริมาณการใช้งานโทเค็นของคุณ และสามารถเข้าดูรายละเอียดได้ในเอกสารสาธารณะ การประเมิน RAG บนฐานความรู้ Bedrock ยังมีค่าใช้จ่ายในการใช้งานปกติจากฐานความรู้ Bedrock

    รุ่น

    ค่าบริการต่อโทเค็นอินพุต 1,000 รายการ

    ราคาต่อโทเค็นเอาต์พุต 1,000 รายการ

    ค่าบริการต่องานของมนุษย์

     

    แบบจำลองที่เลือกสำหรับการประเมิน

    ขึ้นอยู่กับโมเดลที่เลือก

    ขึ้นอยู่กับโมเดลที่เลือก

     

    0.21 USD

     
  • ระบบอัตโนมัติข้อมูล
  • Data Automation

    Amazon Bedrock Data Automation เปลี่ยนเนื้อหาแบบหลายรูปแบบที่ไม่มีโครงสร้างเป็นรูปแบบข้อมูลที่มีโครงสร้างสำหรับกรณีการใช้งาน เช่น การประมวลผลเอกสารอัจฉริยะ การวิเคราะห์วิดีโอและ RAG Bedrock Data Automation สามารถสร้างเนื้อหาเอาต์พุตมาตรฐานโดยใช้ค่าเริ่มต้นที่กำหนดไว้ล่วงหน้าซึ่งเฉพาะรูปแบบเฉพาะ เช่น คำอธิบายวิดีโอแต่ละฉาก การถอดเสียงหรือการวิเคราะห์เอกสารอัตโนมัติ นอกจากนี้ ลูกค้ายังสามารถสร้างเอาต์พุตที่กำหนดเองได้โดยระบุข้อกำหนดเอาต์พุตในพิมพ์เขียวตามรูปแบบข้อมูลของตนเอง ซึ่งจากนั้นสามารถโหลดลงในฐานข้อมูลหรือคลังข้อมูลที่มีอยู่ได้อย่างง่ายดาย Bedrock Data Automation ยังสามารถใช้เพื่อวิเคราะห์เนื้อหาสำหรับแอปพลิเคชัน RAG ได้ ผ่านการผสานการทำงานกับฐานความรู้ ซึ่งช่วยปรับปรุงความแม่นยำและความเกี่ยวข้องของผลลัพธ์ด้วยการรวมข้อมูลที่ฝังอยู่ในทั้งรูปภาพและข้อความ

    ฐานความรู้ของ Amazon Bedrock นำเสนอการผสานรวมระบบอัตโนมัติข้อมูล Bedrock เพื่อให้การตอบสนองที่เกี่ยวข้องและแม่นยำยิ่งขึ้นสำหรับข้อมูลหลายรูปแบบ เมื่อตั้งค่าฐานความรู้ คุณสามารถเลือกระบบอัตโนมัติข้อมูล Bedrock เป็นวิธีการแยกวิเคราะห์เพื่อวิเคราะห์และดึงข้อมูลเชิงลึกที่มีความหมายจากรูปภาพหรือเอกสาร ซึ่งอาจรวมถึงตัวเลข แผนภูมิ และไดอะแกรม ในระหว่างการประมวลผล ระบบอัตโนมัติข้อมูล Bedrock จะดึงข้อมูลที่มีความหมายจากเอกสารและรูปภาพที่ป้อนเข้าไป ซึ่งต่อมาจะถูกนำไปใช้ในขั้นตอนฐานความรู้ในลำดับถัดมาเพื่อทำการตัด การฝัง และการจัดเก็บ เมื่อผสานรวมเข้ากับฐานความรู้แล้ว ระบบอัตโนมัติข้อมูล Bedrock จะส่งมอบผลลัพธ์และคิดค่าบริการสำหรับผลลัพธ์ที่ได้มาตรฐานนั้น

  • การกำหนดเส้นทางพร้อมท์อัจฉริยะ
  • จุดราคา ขอบเขตราคา แผนราคา
    การกำหนดเส้นทางพร้อมท์อัจฉริยะ 1 USD ต่อ 1,000 คำขอ On-Demand

    การกำหนดเส้นทางพร้อมท์อัจฉริยะ

    การกำหนดเส้นทางพร้อมท์อัจฉริยะช่วยให้คุณสามารถใช้การผสมผสานโมเดลพื้นฐาน (FM) จากตระกูลโมเดลเดียวกันเพื่อช่วยเพิ่มประสิทธิภาพในด้านคุณภาพและต้นทุน ตัวอย่างเช่น ด้วยตระกูลโมเดล Claude ของ Anthropic, Amazon Bedrock สามารถกำหนดเส้นทางคำขอระหว่าง Claude 3.5 Sonnet และ Claude 3 Haiku ได้อย่างชาญฉลาดขึ้นอยู่กับความซับซ้อนของพร้อมท์ ในทำนองเดียวกัน Amazon Bedrock สามารถกำหนดเส้นทางคำขอระหว่าง Meta Llama 3.3 70B และ 3.18B และ Nova Pro และ Nova Lite เราเตอร์พร้อมท์จะทำนายว่าโมเดลใดจะให้ประสิทธิภาพที่ดีที่สุดสำหรับแต่ละคำขอ พร้อมทั้งช่วยเพิ่มประสิทธิภาพคุณภาพการตอบสนองและต้นทุน สิ่งนี้มีประโยชน์อย่างยิ่งสำหรับแอปพลิเคชัน เช่น ผู้ช่วยฝ่ายบริการลูกค้า ที่สามารถจัดการกับข้อสอบถามที่ไม่ซับซ้อนได้โดยใช้โมเดลที่เล็กกว่า เร็วกว่า และคุ้มต้นทุนมากกว่า ขณะที่ข้อสอบถามที่ซับซ้อนจะถูกส่งต่อไปยังโมเดลที่มีความสามารถมากกว่า การกำหนดเส้นทางพร้อมท์อัจฉริยะสามารถลดต้นทุนได้ถึง 30 เปอร์เซ็นต์โดยไม่กระทบต่อความแม่นยำ

  • การปรับเพิ่มประสิทธิภาพพร้อมท์
  • การปรับเพิ่มประสิทธิภาพพร้อมท์สำหรับ Amazon Bedrock

    Amazon Bedrock นำเสนอเครื่องมือเพิ่มประสิทธิภาพที่รวดเร็วสองตัว 
    เครื่องมือเพิ่มประสิทธิภาพพร้อมท์อย่างง่าย
    เครื่องมือเพิ่มประสิทธิภาพพร้อมใช้งานง่ายด้วยการคลิกเพียงครั้งเดียวในสนามเด็กเล่นและตัวจัดการพร้อมท์ นอกจากนี้ยังสามารถใช้ได้ผ่าน OptimizePrompt API คุณจะถูกเรียกเก็บเงินสำหรับจำนวนโทเค็นพร้อมท์อินพุตทั้งหมดและพร้อมท์ที่ผ่านการปรับแต่งให้เหมาะสมแล้วเท่านั้น ราคาคือ 0.03 USD ต่อ 1,000 โทเค็น

    Advanced Prompt Optimizer
    Advanced Prompt Optimization ของ Bedrock มีอยู่ในส่วน Advanced Prompt Optimization ของ Bedrock Conole และ CreateAdvancedPromptopTimizationJob API คุณจะถูกเรียกเก็บเงินสำหรับโทเค็นระดับ Standard แบบ On-Demand ที่ใช้ในการเพิ่มประสิทธิภาพ ในการประเมินการใช้งานของคุณ สิ่งต่อไปนี้เป็นสิ่งสำคัญ: เครื่องมือเพิ่มประสิทธิภาพพร้อมท์ใช้ LLM เป็นผู้เขียนใหม่และประเมินผลที่ทำงานในลูปซ้ำระหว่างการอนุมานการประเมินและการเขียนใหม่ ใช้สมการต่อไปนี้เพื่อประมาณต้นทุนของคุณ โดยที่ N = จำนวนบันทึกชุดข้อมูลในชุดข้อมูลการประเมินของคุณสำหรับเทมเพลตพร้อมท์แต่ละเทมเพลต P คือจำนวนโทเค็นอินพุตในเทมเพลตพร้อมท์ของคุณ O = จำนวนโทเค็นเอาต์พุตแบบจำลองเป้าหมายโดยประมาณ, G = จำนวนโทเค็นการตอบสนองอ้างอิงความจริงพื้นฐาน

    ตัวประเมินฟังก์ชัน Lambda: หากคุณเลือกที่จะนำฟังก์ชัน Lambda มาเป็นใช้เป็นตัวประเมิน คุณสามารถใช้สูตรต่อไปนี้เพื่อประมาณโทเค็นและต้นทุนรวมทั้งหมดต่อเทมเพลตพร้อมท์: 
    การเรียกร้องแลมบ์ดาต่อเทมเพลตพร้อมท์ = 16* N 
    จำนวนโทเค็นรุ่นเป้าหมายทั้งหมด = 16* N* (P+O) 
    จำนวนโทเค็นอินพุต LLM ของตัวเพิ่มประสิทธิภาพ (ปัจจุบัน Anthropic Claude Sonnet 4.6) = 101 * (3700+0.35P)

    ตัวประเมิน LLM-as-a-Judge: หากคุณเลือกตัวเลือก LLM-as-a-Judge หรือเกณฑ์การควบคุมภาษาธรรมชาติ คุณสามารถใช้สูตรต่อไปนี้เพื่อประมาณโทเค็นรวมทั้งหมดต่อเทมเพลตพร้อมท์ จำนวนโทเค็นโมเดลเป้าหมายทั้งหมด = 16*N* (P+O) 
    จำนวนโทเค็นอินพุต LLM ของตัวเพิ่มประสิทธิภาพ (ปัจจุบัน Anthropic Claude Sonnet 4.6) = 101 * (3700+0.35P) 
    จำนวนโทเค็น LLMJudge = 16* N* (P+O+G + พร้อมท์ตัดสิน)

    หมายเหตุ: นี่คือคุณสมบัติ AI ช่วยสร้าง จำนวนโทเค็นเอาต์พุตที่แน่นอนจะไม่ทราบจนกว่าจะมีการรันไทม์ และแตกต่างกันไปตามที่พร้อมท์ที่ออกแบบมาเพื่อเอาต์พุต

  • ค้นหาเว็บ
  • การค้นหาเว็บช่วยให้โมเดลและเอเจนต์ของคุณดึงข้อมูลปัจจุบันจากเว็บเพื่อตอบสนองพื้นฐาน ในเนื้อหาที่ทันสมัย  คุณจะถูกเรียกเก็บเงินต่อการสืบค้น โดยที่แบบสอบถามแสดงถึงคำขอค้นหาเว็บเดียว

ตัวอย่างราคา

  • นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Jurrasic-2 Mid ของ AI21 สรุปการป้อนข้อความอินพุต 10,000 โทเค็นเป็นเอาต์พุต 2,000 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 10,000 โทเค็น/1,000 * 0.0125 USD + 2,000 โทเค็น/1,000 * 0.0125 USD = 0.15 USD

  • ค่าบริการแบบตามความต้องการ

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล Amazon Titan Text – Lite สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 2,000 โทเค็น/1,000 * 0.0003 USD + 1,000 โทเค็น/1,000 * 0.0004 USD = 0.001 USD

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดลพื้นฐาน Amazon Titan Image Generator สร้างภาพขนาด 1024 x 1024 ในขนาดคุณภาพ Standard จำนวน 1,000 ภาพ

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1,000 ภาพ* 0.01 USD ต่อภาพ = 10 USD

    ค่าบริการการปรับแต่ง (การปรับแต่งอย่างละเอียดและการฝึกล่วงหน้าอย่างต่อเนื่อง)

    นักพัฒนาแอปพลิเคชันปรับแต่งโมเดล Amazon Titan Image Generator โดยใช้คู่รูปภาพและข้อความ 1,000 คู่ หลังการฝึก นักพัฒนาจะใช้อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ ที่เป็นโมเดลแบบกำหนดเองเป็นเวลา 1 ชั่วโมงเพื่อประเมินประสิทธิภาพของโมเดล โมเดลที่ปรับแต่งอย่างละเอียดจะถูกเก็บไว้เป็นเวลา 1 เดือน หลังการประเมิน นักพัฒนาจะใช้อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) เพื่อโฮสต์โมเดลที่กำหนดเอง

    ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับการปรับแต่งอย่างละเอียด= การฝึกการปรับแต่งอย่างละเอียด (0.005 USD * 500 * 64) โดยที่ 0.005 USD คือราคาต่อภาพที่เห็น 500 คือจำนวนขั้นตอน และ 64 คือขนาดแบทช์ + พื้นที่จัดเก็บโมเดลแบบกำหนดเองต่อเดือน (1.95 USD) + 1 ชั่วโมงของการอนุมานโมเดลแบบกำหนดเอง (21 USD) = 160 USD + 1.95 USD + 21 = 182.95 USD

    ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

    นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดล Amazon Titan Text Express สองหน่วยพร้อมสัญญา 1 เดือนเพื่อกรณีการใช้งานสรุปข้อความ

    ค่าใช้จ่ายรายเดือนทั้งหมดที่เกิดขึ้น = 2 หน่วยโมเดล* 18.40 USD/ชั่วโมง* 24 ชั่วโมง* 31 วัน = 27,379.20 USD

    นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดล Amazon Titan Image Generator พื้นฐานหนึ่งหน่วยพร้อมสัญญา 1 เดือน

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 หน่วยโมเดล * 16.20 USD * 24 ชั่วโมง* 31 วัน = 12,052.80 USD

  • ตัวอย่างที่ 1: แชทบอทสนับสนุนลูกค้า
    ผู้พัฒนาแอปพลิเคชันสร้างแชทบอทสนับสนุนลูกค้าและใช้ตัวกรองเนื้อหาเพื่อบล็อกเนื้อหาที่เป็นอันตรายและหัวข้อที่ปฏิเสธเพื่อกรองคำสืบค้นและการตอบสนองที่ไม่พึงประสงค์

    แชทบอทให้บริการแบบสอบถามผู้ใช้จำนวน 1000 รายการต่อชั่วโมง แบบสอบถามผู้ใช้แต่ละรายการมีความยาวป้อนข้อมูลเฉลี่ย 200 ตัวอักษรและได้รับการตอบสนอง FM 1500 ตัวอักษร

    แบบสอบถามผู้ใช้แต่ละตัวที่มีตัวอักษร 200 ตัวสอดคล้องกับ 1 หน่วยข้อความ

    การตอบสนอง FM แต่ละตัวที่มีตัวอักษร 1,500 ตัวสอดคล้องกับ 2 หน่วยข้อความ

    หน่วยข้อความที่ประมวลผลในแต่ละชั่วโมง = (1 + 2) * 1,000 การสืบค้น = 3,000 หน่วยข้อความ

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นต่อชั่วโมงสำหรับตัวกรองเนื้อหาและหัวข้อที่ถูกปฏิเสธ = 3,000 * (0.15 USD + 0.15 USD) / 1,000 = 0.90 USD

     

    ตัวอย่างที่ 2: การสรุปผลการถอดเสียงคอลเซ็นเตอร์
    ผู้พัฒนาแอปพลิเคชันสร้างแอปพลิเคชันเพื่อสรุปการถอดรหัสการแชทระหว่างผู้ใช้และเจ้าหน้าที่สนับสนุน ใช้ตัวกรองข้อมูลที่ละเอียดอ่อนเพื่อแก้ไขข้อมูลที่ระบุตัวตนของบุคคลได้ (PII) ในสรุปที่สร้างขึ้นสำหรับการสนทนา 10,000 รายการ

    สรุปที่สร้างขึ้นแต่ละตัวมีตัวอักษรเฉลี่ย 3,500 ตัวซึ่งสอดคล้องกับ 4 หน่วยข้อความ

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นในการสรุป 10,000 บทสนทนา = 10000 * 4 * (0.1 USD/1000) = 4 USD

     

    ตัวอย่างที่ 3: เครื่องมือตรวจสอบโปรโตคอลทางการแพทย์
    บริษัทเทคโนโลยีการดูแลสุขภาพใช้การตรวจสอบเหตุผลอัตโนมัติในระบบสนับสนุนการตัดสินใจทางคลินิกเพื่อตรวจสอบคำแนะนำการรักษาตามแนวทางการแพทย์

    ระบบประมวลผลผู้ป่วย 5,000 เคสต่อเดือน โดยแต่ละเคสมีการใช้งานดังนี้:

    • สรุปข้อมูลผู้ป่วย: 500 อักขระ (1 หน่วยข้อความ)
    • การประเมินการวินิจฉัย: 2,000 อักขระ (2 หน่วยข้อความ)
    • คำแนะนำในการรักษา: 4,500 อักขระ (5 หน่วยข้อความ)

    หน่วยข้อความที่ประมวลผลต่อเดือน = (1 + 2 + 5) 5,000 เคส = 40,000 หน่วยข้อความ
    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นต่อเดือนสำหรับการตรวจสอบการให้เหตุผลอัตโนมัติ = 40,000 (0.17 USD)/1000 = 6.80 USD

     

  • ตัวอย่างค่าบริการ

    ตัวอย่างที่ 1: แชทบอทสนับสนุนลูกค้า (ใช้ Standard Retrieval))

    คุณจัดทำดัชนีเนื้อหา 50 GB จากไซต์ SharePoint ของคุณ ซึ่งมีเอกสารประมาณ 100,000 รายการ รวมถึง PDF, งานนำเสนอ, ไฟล์ Word และรูปภาพ เอเจนต์ของคุณจัดการการสืบค้นการดึงข้อมูลมาตรฐาน 100,000 รายการต่อเดือน

    รายการสินค้า การคำนวณ ค่าใช้จ่าย

    การจัดเก็บดัชนี

    50 กิกะบิต× 5.00 USD

    250.00 USD

    การแยกวิเคราะห์เอกสารแบบหลายรูปแบบด้วยตัวแยกวิเคราะห์ที่มีการจัดการ

    สิ่งที่รวมอยู่ด้วย

    0 USD

    การสร้างการฝังตัว (โมเดลที่มีการจัดการ)

    สิ่งที่รวมอยู่ด้วย

    0 USD

    Standard Retrieval

    100,000 ÷ 1,000 × 1.00 USD

    100.00 USD

    จัดอันดับใหม่ (ผู้จัดอันดับที่มีการจัดการ)

    สิ่งที่รวมอยู่ด้วย

    0 USD
    รายเดือนทั้งหมด   350.00 USD

    ตัวอย่างที่ 2: ผู้ช่วยวิจัยองค์กร (ใช้ Agentic Retrieval)

    คุณจัดทำดัชนีเนื้อหา 50 GB จากไซต์ SharePoint ของคุณ ซึ่งมีเอกสารประมาณ 100,000 รายการ รวมถึง PDF, งานนำเสนอ, ไฟล์ Word และรูปภาพ เจ้าหน้าที่ของคุณจัดการการเรียกใช้ Agentic Retrieve จำนวน 100,000 ครั้งต่อเดือน โดยเฉลี่ยแล้วการเรียกใช้แต่ละครั้งจะทำการเรียกใช้ Receive API พื้นฐาน 2 ครั้ง

    รายการสินค้า การคำนวณ ค่าใช้จ่าย

    การจัดเก็บดัชนี

    50 กิกะบิต × 5.00 USD

    250.00 USD

    การแยกวิเคราะห์เอกสารแบบหลายรูปแบบด้วยตัวแยกวิเคราะห์ที่มีการจัดการ

    สิ่งที่รวมอยู่ด้วย 0 USD

    การสร้างการฝังตัว (โมเดลที่มีการจัดการ)

    สิ่งที่รวมอยู่ด้วย 0 USD

    การเรียกใช้ Agentic Retrieve API

    100,000 ÷ 1,000 × 4.00 USD

    400.00 USD

    การเรียกใช้ Retrieve APIพื้นฐาน

    (100,000 × 2) ÷ 1,000 × 1.00 USD

    200.00 USD

    จัดอันดับใหม่ (ผู้จัดอันดับที่มีการจัดการ)

    สิ่งที่รวมอยู่ด้วย 0 USD
    รายเดือนทั้งหมด   850.00 USD
  • ค่าบริการแบบตามความต้องการ

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock ใน Region สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน) คือ คำขอให้โมเดล Claude ของ Anthropic สรุปการป้อนข้อความอินพุต 11,000 โทเค็นเป็นเอาต์พุต 4,000 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 11,000 โทเค็น/1,000 * 0.008 USD + 4,000 โทเค็น/1,000 * 0.024 USD = 0.088 USD + 0.096 USD = 0.184 USD

    ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

    นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดลของ Anthropic Claude Instant หนึ่งหน่วยใน Region สหรัฐอเมริกาฝั่งตะวันตก (ออริกอน)

    ค่าใช้จ่ายรายเดือนทั้งหมดที่เกิดขึ้น= 1 หน่วยโมเดล* 39.60 USD * 24 ชั่วโมง* 31 วัน = 29,462.40 USD

  • ค่าบริการแบบ On-Demand

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Command ของ Cohere สรุปการป้อนข้อความอินพุต 6,000 โทเค็นเป็นเอาต์พุต 2,000 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 6,000 โทเค็น/1,000 * 0.0015 USD + 2,000 โทเค็น/1,000 * 0.0020 USD = 0.013 USD

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Command-Light ของ Cohere สรุปการป้อนข้อความอินพุต 6,000 โทเค็นเป็นเอาต์พุต 2,000 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 6,000 โทเค็น/1,000 * 0.0003 USD + 2,000 โทเค็น/1,000 * 0.0006 USD = 0.003 USD

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอให้ทั้ง Embed ภาษาอังกฤษหรือโมเดลหลายภาษาของ Cohere สร้างการฝังสำหรับอินพุต 10,000 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 10,000 โทเค็น/1,000* 0.0001 USD = 0.001 USD

    ค่าบริการการปรับแต่ง (การปรับแต่งอย่างละเอียด)

    นักพัฒนาแอปพลิเคชันปรับแต่งโมเดลคำสั่ง Cohere โดยใช้ข้อมูล 1,000 โทเค็น หลังการฝึก จะใช้อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้โมเดลแบบกำหนดเองเป็นเวลา 1 ชั่วโมงเพื่อประเมินประสิทธิภาพของโมเดล โมเดลที่ปรับแต่งอย่างละเอียดจะถูกเก็บไว้เป็นเวลา 1 เดือน หลังการประเมิน นักพัฒนาจะใช้ อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) เพื่อโฮสต์โมเดลที่กำหนดเอง

    ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับการปรับแต่งอย่างละเอียดคือ การฝึกปรับแต่งอย่างละเอียด (0.004 USD * 1000) + การจัดเก็บโมเดลแบบกำหนดเองต่อเดือน (1.95 USD) + 1 ชั่วโมงการอนุมานโมเดลแบบกำหนดเอง(49.50 USD) = 55.45 USD

    ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) ของโมเดลแบบกำหนดเอง = 39.60 USD

    ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

    นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดล Cohere Command หนึ่งหน่วยพร้อมสัญญา 1 เดือนเพื่อกรณีการใช้งานสรุปข้อความ

    ค่าใช้จ่ายรายเดือนทั้งหมดที่เกิดขึ้น= 1 หน่วยโมเดล* 39.60 USD * 24 ชั่วโมง* 31 วัน = 29,462.40 USD

  • ตัวอย่างราคา: นักพัฒนาแอปพลิเคชันนำเข้าประเภทโมเดล Llama 3.1 ที่กำหนดเองที่มีขนาดพารามิเตอร์ 8B ที่มีความยาวลำดับ 128K ในรีเจี้ยน us-east-1 และลบโมเดลหลังจากผ่านไป 1 เดือน ซึ่งต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ดังนั้น ราคาต่อนาทีจะเท่ากับ 0.1570 USD เนื่องจากต้องใช้หน่วยโมเดลแบบกำหนดเอง 2 หน่วย ค่าใช้จ่ายสำหรับพื้นที่จัดเก็บโมเดลสำหรับหน่วยโมเดลแบบกำหนดเอง 2 หน่วยจะอยู่ที่ 3.90 USD ต่อเดือน

    ไม่มีค่าใช้จ่ายในการนำเข้าโมเดล การเรียกดำเนินการครั้งแรกที่ประสบความสำเร็จคือเวลา 8:03 น. ซึ่งเวลาดังกล่าว การวัดจะเริ่มขึ้น การวัดช่วงเวลา 5 นาทีจะตั้งแต่ 8:03 น. - 8:07 น.; 8:07 น. - 8:11 น. เป็นต้น หากมีการเรียกดำเนินการอย่างน้อยหนึ่งครั้งในช่วงระยะเวลา 5 นาที ช่วงเวลาดังกล่าวจะถือว่าเป็นการใช้งานสำหรับการเรียกเก็บเงิน หากมีการเรียกดำเนินการเวลา 08:03 น. และไม่มีการเรียกอีกต่อไปหลังเวลา 08:07 น. การนับจะหยุดที่เวลา 08:07 น. ในกรณีนี้ จะมีการคำนวณใบเรียกเก็บเงินดังนี้ 0.1570 USD * 5 นาที * 1 ช่วงเวลาห้านาที = 0.785 USD

  • ตัวอย่างราคา 1:
    สมมติว่าคุณประมวลผลเอกสาร 1,000 หน้า โดยใช้เอาต์พุตแบบกำหนดเองของ BDA เอกสารทั้งหมด 1,000 หน้าจะประมวลผลโดยใช้พิมพ์เขียว 1 ซึ่งมีฟิลด์ 15 ช่อง ราคาต่อหน้าสำหรับพิมพ์เขียวใด ๆ ที่มีฟิลด์ 30 ช่องหรือน้อยกว่าคือ 0.040 USD ค่าใช้จ่ายทั้งหมดจะอยู่ที่ 40 USD

    จำนวนหน้าทั้งหมดที่ประมวลผล = 1,000 หน้า
    ราคาต่อหน้าสำหรับพิมพ์เขียวที่มีฟิลด์น้อยกว่า 30 ช่อง = 0.040 USD
    ค่าบริการทั้งหมด = 1,000 * 0.040 USD = 40 USD

     

    ตัวอย่างราคา 2:
    สมมติว่าคุณประมวลผลเอกสาร 2 ฉบับ โดยใช้เอาต์พุตแบบกำหนดเองของ BDA เอกสาร 1 มี 40 หน้า และประมวลผลโดยใช้พิมพ์เขียว 1 ซึ่งมีฟิลด์ 20 ช่อง เอกสาร 2 มี 10 หน้า และประมวลผลโดยใช้พิมพ์เขียว 2 ซึ่งมีฟิลด์ 40 ช่อง ราคาต่อหน้าสำหรับพิมพ์เขียว 1 คือ 0.040 USD เนื่องจากมีฟิลด์ 30 ช่องหรือน้อยกว่า ราคาต่อหน้าสำหรับพิมพ์เขียว 2 คือ 0.045 USD ค่าใช้จ่ายในการประมวลผลสำหรับเอกสาร 1 โดยใช้พิมพ์เขียว 1 คือ 1.60 USD ค่าใช้จ่ายในการประมวลผลสำหรับเอกสาร 2 โดยใช้พิมพ์เขียว 2 คือ 0.45 USD ค่าใช้จ่ายทั้งหมดในการประมวลผลเอกสารทั้งสองจะอยู่ที่ 2.05 USD

    จำนวนหน้าทั้งหมดที่ประมวลผล = 50 หน้า
    ราคาต่อหน้าสำหรับพิมพ์เขียว 1 ที่มีฟิลด์น้อยกว่า 30 ช่อง = 0.040 USD
    ราคาต่อหน้าสำหรับพิมพ์เขียว 2 ที่มี 40 ฟิลด์ = 0.040 USD + (จำนวนของฟิลด์เพิ่มเติมที่เกิน 30 *0.0005 USD ต่อฟิลด์)
    จำนวนฟิลด์เพิ่มเติมที่เกิน 30 = 40 - 30 = 10
    ราคาต่อหน้าสำหรับพิมพ์เขียว 2 ที่มี 40 ฟิลด์ = 0.040 USD + (10 * 0.0005 USD ต่อฟิลด์) = 0.045 USD
    ค่าธรรมเนียมสำหรับเอกสาร 1 โดยใช้พิมพ์เขียว 1 = 40 หน้า x 0.040 USD ต่อหน้า = 1.6 USD
    ค่าธรรมเนียมสำหรับเอกสาร 2 โดยใช้พิมพ์เขียว 2 = 10 หน้า x 0.045 USD ต่อหน้า = 0.45 USD
    ค่าบริการทั้งหมด = ค่าธรรมเนียมสำหรับเอกสาร 1 + ค่าธรรมเนียมสำหรับเอกสาร 2 = 1.6 USD + 0.45 USD = 2.05 USD

     

    ตัวอย่างราคา 3:
    สมมติว่าคุณตั้งค่าฐานความรู้ Bedrock เพื่อใช้ระบบอัตโนมัติข้อมูล Bedrock เป็นตัวแยกวิเคราะห์แล้วป้อนเอกสาร 1,000 หน้าเข้าไป หมายเหตุ โครงสร้างต้นทุนจะแตกต่างกันไปตามตัวเลือกการแยกวิเคราะห์ฐานความรู้ BDA ใช้การกำหนดราคาต่อหน้า ในขณะที่ตัวแยกวิเคราะห์แบบพื้นฐานจะเรียกเก็บเงินตามโทเค็นอินพุตและเอาต์พุต สำหรับบริบท การประมวลผล 1,000 หน้า โดยที่ 30% มีตารางและ 30% มีตัวเลข โดยทั่วไปต้องใช้ 2,900 โทเค็นอินพุตและ 750 โทเค็นเอาต์พุต การบริโภคโทเค็นแตกต่างกันไปตามประเภทเนื้อหา ดังนั้นลูกค้าจึงขอแนะนำให้ทดสอบโดยใช้ข้อมูลของตนเองเพื่อรับการประมาณการที่แม่นยำยิ่งขึ้น การผสานรวมฐานความรู้ Bedrock และระบบอัตโนมัติข้อมูล Bedrock ใช้เอาต์พุตมาตรฐาน โดยที่ราคาต่อหน้าจะเป็น 0.010 USD ค่าใช้จ่ายทั้งหมดจะอยู่ที่ 10 USD

    จำนวนหน้าทั้งหมดที่ประมวลผล = 1,000 หน้า
    ราคาต่อหน้าสำหรับเอาต์พุตมาตรฐาน = 0.010 USD
    ค่าบริการทั้งหมด = 1,000 * 0.010 USD = 10 USD

     

    ตัวอย่างราคา 4:
    สมมติว่าคุณประมวลผลวิดีโอ 60 นาทีโดยใช้เอาต์พุตมาตรฐาน BDA ราคาต่อนาทีสำหรับเอาต์พุตมาตรฐานวิดีโอคือ 0.050 USD ค่าใช้จ่ายทั้งหมดจะอยู่ที่ 3.00 USD

    จำนวนนาทีที่ประมวลผล = 60
    ราคาต่อนาทีสำหรับเอาต์พุตมาตรฐานวิดีโอ = 0.050 USD
    ค่าบริการทั้งหมด = 60 * 0.050 USD = 3.00 USD

     

    ตัวอย่างราคา 5:
    สมมติว่าคุณประมวลผลภาพ 2,000 ภาพ โดยใช้เอาต์พุตแบบกำหนดเองของ BDA ภาพ 1,000 ภาพแรกจะถูกประมวลผลโดยใช้พิมพ์เขียว 1 ซึ่งมีฟิลด์ 10 ช่อง เอกสาร 1,000 หน้าสุดท้ายจะถูกประมวลผลโดยใช้พิมพ์เขียว 2 ซึ่งมีฟิลด์ 40 ช่อง ราคาต่อภาพสำหรับพิมพ์เขียว 1 คือ 0.005 USD เนื่องจากมีฟิลด์ 30 ช่องหรือน้อยกว่า ราคาต่อภาพสำหรับพิมพ์เขียว 2 คือ 0.01 USD ค่าใช้จ่ายในการประมวลผลสำหรับ 1,000 ภาพแรกโดยใช้พิมพ์เขียว 1 คือ 5.00 USD ค่าใช้จ่ายในการประมวลผลสำหรับ 1,000 ภาพที่สองโดยใช้พิมพ์เขียว 2 คือ 10.00 USD ค่าใช้จ่ายทั้งหมดในการประมวลผลภาพทั้งหมด 2,000 ภาพจะอยู่ที่ 15.00 USD

    ค่าใช้จ่ายสำหรับ 1000 ภาพแรก = 1,000 ภาพ * 0.005 USD ต่อภาพ = 5.00 USD
    ค่าใช้จ่ายสำหรับ 1,000 ภาพที่สอง = 1,000 รูปภาพ * (0.005 USD + (จำนวนของฟิลด์เพิ่มเติมที่เกิน 30 *0.0005 USD ต่อฟิลด์))
    = 1,000 * (0.005 USD + ((40-30)*0.0005 USD))
    = 1,000 * (0.005 + (10*0.0005 USD)) = 10.00 USD
    ค่าใช้จ่ายทั้งหมด = 5.00 USD + 10.00 USD = 15.00 USD

     

    ตัวอย่างราคา 6:
    สมมติว่าคุณต้องการใช้เอาต์พุตมาตรฐานของระบบอัตโนมัติข้อมูล Bedrock เพื่อประมวลผลการบันทึกเสียงการประชุม 15,000 นาทีในองค์กรของคุณ ค่าใช้จ่ายทั้งหมดในการประมวลผลเสียงทั้งหมด 15,000 นาทีจะอยู่ที่ 90 USD

    จำนวนนาทีที่ประมวลผล = 15,000 นาที
    ค่าบริการทั้งหมด = 15,000 นาที × 0.006 USD = 90 USD

     

  • ค่าบริการแบบตามความต้องการ

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล DeepSeek-R1 สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น (รวมถึงโทเค็นการให้เหตุผล)

    ค่าใช้จ่ายรวมต่อชั่วโมงที่เกิดขึ้นคือ = 2,000 โทเค็น/1,000 * 0.00135 USD + 1,000 โทเค็น/1,000 * 0.0054 USD = 0.0081 USD

  • ตัวอย่าง: สรุปข่าว
    นักพัฒนาแอปพลิเคชันสร้างโฟลว์เพื่อสรุปข่าวโดยอัตโนมัติสำหรับผู้ค้า โฟลว์ประกอบด้วยโหนดอินพุตที่อยู่ในตำแหน่ง S3 และโหนดดึงข้อมูล S3 ที่ดึงไฟล์ 10 ไฟล์ที่มีบทความจากสำนักข่าวหลัก 10 แห่งใน S3 (การเปลี่ยนโหนด 2 โหนด) จากนั้นจะใช้โหนดอิเทอเรเตอร์ เพื่อเรียกดำเนินการโมเดลที่มีโหนดพร้อมท์เพื่อสรุปแต่ละไฟล์ (+ 10 ไฟล์ x การเปลี่ยนโหนด 2 โหนด) จากนั้นจะรวบรวมผลลัพธ์ทั้งหมดโดยใช้โหนดรวบรวม เขียนผลลัพธ์ไปยัง S3 โดยใช้โหนดจัดเก็บ S3 และเสร็จสมบูรณ์ในโหนดเอาต์พุต (+ การเปลี่ยนโหนด 3 โหนด) พวกเขาเปิดการทำงานของโฟลว์นี้ทุกครึ่งชั่วโมงในทุกวันจันทร์ถึงศุกร์

    จำนวนการเปลี่ยนโหนดต่อการดำเนินการโฟลว์คือ: 2+1+10*2 + 3 = 25 การเปลี่ยนโหนด/การดำเนินการโฟลว์

    จำนวนการดำเนินการโฟลว์ต่อเดือนคือ: 24 ชั่วโมง *2* 5 วัน * 4 สัปดาห์ = 960 การดำเนินการโฟลว์/เดือน

    บิลรายเดือนทั้งหมดคือ 25 * 960 * 0.035 USD/1,000 = 0.84 USD

    ค่าบริการเพิ่มเติม
    นอกจากนี้ใบเรียกเก็บเงินจะรวมถึงค่าใช้จ่ายเพิ่มเติมสำหรับบริการ AWS ที่ใช้ในการดำเนินการเวิร์กโฟลว์ รวมถึงการใช้ Amazon S3 ในโหนดการดึงข้อมูลและการจัดเก็บข้อมูล และการใช้โมเดลพื้นฐานของ Amazon Bedrock ในโหนดพร้อมท์

  • ค่าบริการแบบตามความต้องการ

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Llama 2 Chat (13B) ของ Meta สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 500 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 2,000 โทเค็น/1,000* 0.00075 USD + 500 โทเค็น/1000* 0.001 USD = 0.002 USD

    ค่าบริการการปรับแต่ง (การปรับแต่งอย่างละเอียด)

    นักพัฒนาแอปพลิเคชันปรับแต่งโมเดล Llama 2 ที่ผ่านการฝึกล่วงหน้า (70B) โดยใช้ข้อมูล 1,000 โทเค็น หลังการฝึก จะใช้อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้โมเดลแบบกำหนดเองเป็นเวลา 1 ชั่วโมงเพื่อประเมินประสิทธิภาพของโมเดล โมเดลที่ปรับแต่งอย่างละเอียดจะถูกเก็บไว้เป็นเวลา 1 เดือน หลังการประเมิน นักพัฒนาจะใช้ อัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) เพื่อโฮสต์โมเดลที่กำหนดเอง

    ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับการปรับแต่งอย่างละเอียดคือ การฝึกปรับแต่งอย่างละเอียด (0.00799 USD * 1000) + การจัดเก็บโมเดลแบบกำหนดเองต่อเดือน (1.95 USD) + 1 ชั่วโมงการอนุมานโมเดลแบบกำหนดเอง (23.50 USD) = 33.44 USD

    ค่าใช้จ่ายรายเดือนที่เกิดขึ้นสำหรับอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้ (สัญญา 1 เดือน) ของโมเดลแบบกำหนดเอง = 21.18 USD

    ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

    นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดลของ Meta Llama 2 หนึ่งหน่วยพร้อมสัญญา 1 เดือนเพื่อกรณีการใช้งานสรุปข้อความ

    ค่าใช้จ่ายรายเดือนทั้งหมดที่เกิดขึ้นคือ 1 หน่วยโมเดล* 21.18 USD * 24 ชั่วโมง* 31 วัน = 15,757.92 USD

  • ค่าบริการแบบตามความต้องการ

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล Mistral 7B สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 2,000 โทเค็น/1,000 * 0.00015 USD + 1,000 โทเค็น/1,000 * 0.0002 USD = 0.0005 USD

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล Mixtral 8x7B สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น

    ค่าใช้จ่ายรวมต่อชั่วโมงที่เกิดขึ้นคือ = 2,000 โทเค็น/1,000 * 0.00045 USD + 1,000 โทเค็น/1,000 * 0.0007 USD = 0.0016 USD

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock แบบรายชั่วโมง คือ คำขอให้โมเดล Mistral Large สรุปการป้อนข้อความอินพุต 2,000 โทเค็นเป็นเอาต์พุต 1,000 โทเค็น 

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 2,000 โทเค็น/1,000 * 0.008 USD + 1,000 โทเค็น/1,000 * 0.024 USD = 0.04 USD

  • ตัวอย่างการประเมินโมเดลที่ 1:

    ราคาแบบ On-demand
    นักพัฒนาแอปพลิเคชันส่งชุดข้อมูลสำหรับการประเมินโมเดลโดยมนุษย์โดยใช้ Anthropic Claude 2.1 และ Anthropic Claude Instant ใน AWS Region สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ)

    ชุดข้อมูลประกอบด้วยพรอมต์ 50 รายการ และนักพัฒนาต้องการให้ผู้ปฏิบัติงานหนึ่งคนให้คะแนนชุดการตอบกลับพรอมต์แต่ละชุด (กำหนดค่าได้ในการสร้างงานการประเมินเป็นพารามิเตอร์ “ผู้ปฏิบัติงานต่อหนึ่งพรอมต์”)

    จะมี 50 งานในงานประเมินนี้ (หนึ่งงานสำหรับแต่ละชุดการตอบสนองแบบแจ้งต่อผู้ปฏิบัติงานแต่ละคน) พรอมต์ 50 รายการรวมกันเป็นโทเค็นอินพุต 5,000 รายการ และการตอบกลับที่เกี่ยวข้องรวมกันเป็น 15,000 โทเค็นสำหรับ Anthropic Claude Instant และ 20,000 โทเค็นสำหรับ Anthropic Claude 2.1

    จะมีค่าใช้จ่ายสำหรับงานการประเมินโมเดลนี้ดังต่อไปนี้

    รายการ จำนวนโทเค็นอินพุต ค่าบริการต่อโทเค็นอินพุต 1,000 รายการ ค่าใช้จ่ายของอินพุต จำนวนโทเค็นเอาต์พุต ค่าบริการต่อโทเค็นเอาต์พุต 1,000 รายการ ค่าใช้จ่ายของเอาต์พุต จำนวนงานของมนุษย์ ค่าบริการต่องานของมนุษย์ ค่าใช้จ่ายของงานของมนุษย์ รวมทั้งหมด
    การอนุมานทันทีของ Claude 5000 0.0008 USD 0.004 USD 15000 0.0024 USD 0.036 USD       0.04 USD
    Claude 2.1 Inference 5000 0.008 USD 0.04 USD 20000 0.024 USD 0.48 USD       0.52 USD
    งานของมนุษย์             50 0.21 USD 10.50 USD 10.50 USD
    รวมทั้งหมด                   11.06 USD

    ตัวอย่างการประเมินโมเดลที่ 2:

    ราคาแบบ On-demand
    นักพัฒนาแอปพลิเคชันส่งชุดข้อมูลสำหรับการประเมินโมเดลโดยมนุษย์โดยใช้ Anthropic Claude 2.1 และ Anthropic Claude Instant ใน AWS Region สหรัฐอเมริกาฝั่งตะวันออก (เวอร์จิเนียฝั่งเหนือ)

    ชุดข้อมูลประกอบด้วยพรอมต์ 50 รายการ และนักพัฒนาต้องการให้ผู้ปฏิบัติงานสองคนให้คะแนนชุดการตอบกลับพรอมต์แต่ละชุด (กำหนดค่าได้ในการสร้างงานการประเมินเป็นพารามิเตอร์ “ผู้ปฏิบัติงานต่อหนึ่งพรอมต์”) งานการประเมินนี้จะมี 100 งาน (1 งานสำหรับแต่ละคู่การตอบกลับพรอมต์ต่อพนักงานแต่ละคน: 2 คน x ชุดการตอบกลับพรอมต์ 50 ชุด = 100 งานของมนุษย์)

    พรอมต์ 50 รายการรวมกันเป็นโทเค็นอินพุต 5,000 รายการ และการตอบกลับที่เกี่ยวข้องรวมกันเป็น 15,000 โทเค็นสำหรับ Anthropic Claude Instant และ 20,000 โทเค็นสำหรับ Anthropic Claude 2.1

    จะมีค่าใช้จ่ายสำหรับงานการประเมินโมเดลนี้ดังต่อไปนี้

    รายการ จำนวนโทเค็นอินพุต ค่าบริการต่อโทเค็นอินพุต 1,000 รายการ ค่าใช้จ่ายของอินพุต จำนวนโทเค็นเอาต์พุต ค่าบริการต่อโทเค็นเอาต์พุต 1,000 รายการ ค่าใช้จ่ายของเอาต์พุต จำนวนงานของมนุษย์ ค่าบริการต่องานของมนุษย์ ค่าใช้จ่ายของงานของมนุษย์ รวมทั้งหมด
    การอนุมานทันทีของ Claude 5000 0.0008 USD 0.0040 USD 15000 0.0024 USD 0.036 USD       0.04 USD
    Claude 2.1 Inference 5000 0.008 USD 0.0400 USD 20000 0.024 USD 0.48 USD       0.52 USD
    งานของมนุษย์             100 0.21 USD 21.00 USD 21.00 USD
    รวมทั้งหมด                   21.56 USD
  • ตัวอย่าง: การสรุปข่าว
    นักพัฒนาแอปพลิเคชันสร้างพร้อมท์เพื่อสรุปข่าวสำหรับผู้ค้าที่ใช้ Claude 3.5 พร้อมท์ดั้งเดิมประกอบด้วย 429 โทเค็น พร้อมท์ที่ปรับเพิ่มประสิทธิภาพมี 511 โทเค็น และมีคำแนะนำและตัวอย่างที่เฉพาะเจาะจงมากขึ้นเพื่อสร้างคำตอบที่กระชับมากขึ้นจาก FM เขาใช้พร้อมท์ที่ปรับเพิ่มประสิทธภาพที่มี 511 โทเค็นเป็นอินพุตสำหรับเครื่องมือเพิ่มประสิทธิภาพพร้อมท์ และสร้างตัวแปรใหม่ 2 ตัวสำหรับ Claude 3.7 และ Nova Pro ที่มี 582 โทเค็นและ 579 โทเค็น

    จำนวนโทเค็นอินพุตและเอาต์พุตทั้งหมดสำหรับการปรับเพิ่มประสิทธิภาพพร้อมท์: 429 + 511 + 511 + 582 + 511 + 579 = 3,123

    บิลรายเดือนทั้งหมดคือ: 3,123 / 1000 * 0.03 USD = 0.09 USD

  • ค่าบริการแบบ On-Demand

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล SDXL เพื่อสร้างภาพ 512 x 512 ด้วยขนาดสเต็ป 70 (คุณภาพระดับพรีเมียม)

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 ภาพ* 0.036 USD ต่อภาพ = 0.036 USD

    นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล SDXL 1.0 เพื่อสร้างภาพ 1024 x 1024 ด้วยขนาดสเต็ป 70 (คุณภาพระดับพรีเมียม)

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 ภาพ* 0.08 USD ต่อภาพ = 0.08 USD

    ราคาอัตราการโอนถ่ายข้อมูลที่จัดเตรียมไว้

    นักพัฒนาแอปพลิเคชันซื้อหน่วยโมเดล SDXL1.0 หนึ่งหน่วยพร้อมสัญญา 1 เดือน

    ค่าใช้จ่ายรวมที่เกิดขึ้น = 1 * 49.86 USD * 24 ชั่วโมง* 31 วัน = 37,095.84 USD

  • ราคาแบบตามความต้องการ

    นักพัฒนาแอปพลิเคชันเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล Pegasus 1.2 เพื่ออธิบายว่าวิดีโอยาว 10 วินาทีเกี่ยวข้องกับอะไร โดยใช้เอาต์พุต 2,000 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 10 วินาที* 0.00049 USD + 2,000 โทเค็น / 1000 * 0.0075 USD = 0.0199 USD


    ผู้พัฒนาแอปพลิเคชันเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล Marengo Embed [3.0 หรือ 2.7] เพื่อฝังวิดีโอ 10 รายการโดยมีระยะเวลารวม 100 นาที

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 100 นาที (ซึ่งเท่ากับ 6,000 วินาที) * 0.00070 USD = 4.2 USD


    นักพัฒนาแอปพลิเคชันเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล Marengo Embed 3.0 โดยให้ข้อความและรูปภาพร่วมกันเพื่อสร้างการฝังที่สามารถใช้เพื่อค้นหาคลิปที่มีกระเป๋าที่แสดงในภาพที่กำหนดในคลังเนื้อหาแบบฝังที่สร้างไว้โดยใช้ตัวอย่างข้างต้น 

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 คำขอข้อความ* 0.00007 USD +1 คำขอรูปภาพ* 0.0001 USD = 0.00017 USD


    นักพัฒนาแอปพลิเคชันเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock: คำขอไปยังโมเดล Marengo Embed [3.0 หรือ 2.7]โดยให้ข้อความเพื่อสร้างการฝังที่สามารถใช้เพื่อค้นหาคลิปที่ตรงกันในคลังเนื้อหาแบบฝังที่สร้างไว้โดยใช้ตัวอย่างข้างต้น 

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้น = 1 คำขอข้อความ* 0.00007 USD = 0.00007 USD

  • นักพัฒนาแอปพลิเคชันทำการเรียกใช้ API ต่อไปนี้ไปยัง Amazon Bedrock คือ คำขอให้โมเดล Palmyra X5 ของ Writer สรุปการป้อนข้อความอินพุต 10,000 โทเค็นเป็นเอาต์พุต 2,000 โทเค็น

    ค่าใช้จ่ายทั้งหมดที่เกิดขึ้นคือ = 10,000 โทเค็น/1,000 * 0.003 USD + 2,000 โทเค็น/1,000 * 0.015 USD = 0.06 USD