Privacy-filter của OpenAI để phát hiện và che giấu PII hiện có sẵn trong Amazon SageMaker JumpStart

Ngày đăng: 13 Th07 2026

Hôm nay, AWS đã công bố việc cung cấp privacy-filter trong Amazon SageMaker JumpStart, mở rộng danh mục mô hình nền tảng có sẵn cho khách hàng AWS. Mô hình này từ OpenAI là mô hình phân loại mã thông báo hai chiều để phát hiện và che giấu thông tin nhận dạng cá nhân (PII) trong văn bản, cho phép khách hàng xây dựng quy trình công việc làm sạch dữ liệu trên cơ sở hạ tầng AWS.

Privacy-filter có tốc độ cao, nhận biết ngữ cảnh và có thể điều chỉnh, được thiết kế cho quy trình công việc làm sạch dữ liệu thông lượng cao mà các đội ngũ có thể chạy tại chỗ. Mô hình này gắn nhãn cho một chuỗi đầu vào trong một lần chuyển tiếp duy nhất và phát hiện các danh mục đoạn PII bao gồm số tài khoản, địa chỉ, email, tên, số điện thoại, URL, ngày tháng và thông tin bí mật. 

Với SageMaker JumpStart, khách hàng có thể triển khai mô hình này chỉ với một vài cú nhấp chuột để giải quyết các trường hợp sử dụng AI cụ thể của họ. Để bắt đầu sử dụng mô hình này, hãy điều hướng đến phần Mô hình của Studio SageMaker hoặc sử dụng SageMaker Python SDK để triển khai mô hình vào tài khoản AWS của bạn. Để biết thêm thông tin về việc triển khai và sử dụng mô hình nền tảng trong SageMaker JumpStart, hãy xem tài liệu về Amazon SageMaker JumpStart.