GLM-5.2 FP8, NVIDIA-Nemotron-Nano-12B-v2 ve GLM-OCR modelleri artık Amazon SageMaker JumpStart'ta mevcut
Amazon SageMaker JumpStart'ta kullanılabilen Z.ai'ın GLM-5.2 FP8, NVIDIA'nın Nemotron-Nano-12B-v2 ve Z.ai'ın GLM-OCR modelleri artık AWS müşterilerine sunulan temel model portföyünü genişletir. Bu üç model; uzun vadeli temsilci mühendisliği, verimli hibrit akıl yürütme ve gelişmiş belge anlama alanlarında uzmanlaşmış özellikler sunarak, müşterilerin yüksek performanslı ve ölçeklenebilir yapay zeka çözümlerini AWS altyapısında dağıtmasına olanak tanır.
GLM-5.2 FP8, gereksinimlerden dağıtıma kadar tam döngü yazılım geliştirme gibi uzun vadeli görevler ve temsilci mühendisliği iş akışları için optimize edilmiştir. GLM-5.2 FP8, önceki sürümü GLM-5.1'e kıyasla uzun vadeli görev yürütme konusunda ciddi bir gelişme sağlar ve bundan önce eşi benzeri görülmemiş gerçekten kullanılabilen 1 milyonluk belirteç bağlam penceresine sahip olması, proje düzeyinde mühendislik bağlamı yönetebilmesine, uzun süredir çalışan görevler yürütmesine, mühendislik standartlarını tutarlı bir şekilde takip etmesine ve bütün geliştirme iş akışlarını tek bir görevde tamamlamasına olanak tanır.
NVIDIA-Nemotron-Nano-12B-v2, yüksek çıkarım verimi ile birleşik akıl yürütme görevlerinde ve akıl yürütme olmayan görevlerde uzmanlaşmıştır ve hem doğruluk hem de hız gerektiren kurumsal uygulamalar için idealdir. 128 bin bağlam uzunluğuna sahip hibrit bir Mamba-2 ve Transformer mimarisi kullanır ve son yanıtını vermeden önce akıl yürütme izleri oluşturur. Kompakt 12B parametre tasarımı, önde gelen açık modellerle karşılaştırılabilir veya daha iyi doğruluk sağlarken, 6 kata kadar daha yüksek çıkarım verimi sağlar.
GLM-OCR, taranmış PDF'ler, el yazısı notlar, formüllü karmaşık akademik makaleler, çok sütunlu tablolar, kod belgeleri ve çok dilli metinler dahil olmak üzere karmaşık gerçek dünya materyalleri için doğru, hızlı ve kapsamlı belge anlama sağlar. Bu 0.9B parametreli çok modlu model, yapıyı, tabloları ve formülleri gerçek zamanlı hizmetler ve uç cihazlar için yeterince düşük gecikmeyle temiz Markdown, JSON veya LaTeX olarak yeniden yapılandırır; büyük ölçekli belge işleme ve fatura çıkarma iş akışları için idealdir.
Müşteriler, SageMaker JumpStart ile belirli yapay zeka kullanım ihtiyaçları için bu modellerden herhangi birini yalnızca birkaç tıklamayla devreye alabilirler.
Bu modelleri kullanmaya başlamak için SageMaker konsolunda SageMaker JumpStart model kataloğuna gidin veya modelleri AWS hesabınıza dağıtmak için SageMaker Python SDK'sini kullanın. SageMaker JumpStart'ta temel model dağıtma ve kullanma hakkında daha fazla bilgi için Amazon SageMaker JumpStart belgelerine bakın.