Anthropic đã tiến hành điều tra ba sự cố an ninh mạng có thật trong quá trình đánh giá hệ thống của mình. Mục tiêu là rút ra bài học và cải thiện khả năng phòng thủ trước các mối đe dọa thực tế.
Tóm tắt này được dịch tự động từ nguồn gốc tiếng Anh. Đọc bài gốc tại Anthropic News →
Anthropic đã tiến hành điều tra ba sự cố an ninh mạng có thật trong quá trình đánh giá hệ thống của mình. Mục tiêu là rút ra bài học và cải thiện khả năng phòng thủ trước các mối đe dọa thực tế.
Xem nguồn gốc: Anthropic News
Anthropic cam kết không ngừng nâng cao các nỗ lực về sự phù hợp và bảo mật. Điều này nhằm đảm bảo các mô hình AI của hãng, bao gồm cả Claude, hoạt động an toàn, đáng tin cậy và phù hợp với các giá trị của con người.
04/09/2026
Anthropic đang tài trợ các nghiên cứu nhằm cải thiện cách chúng ta đánh giá tác động của trí tuệ nhân tạo (AI) đến hạnh phúc và sự thịnh vượng của con người. Mục tiêu là phát triển các phương pháp đo lường hiệu quả hơn để hiểu rõ hơn về ảnh hưởng của AI trong xã hội.
28/08/2026

Anthropic vừa công bố chi tiết về các biện pháp bảo vệ an ninh mạng tích hợp trong Fable 5, đặc biệt là các bộ phân loại an toàn (safety classifiers). Bài viết cũng giới thiệu bản dự thảo đầu tiên về khung đánh giá mức độ nghiêm trọng của jailbreak, một nỗ lực nhằm chuẩn hóa cách ngành công nghiệp AI thảo luận và xử lý các rủi ro bảo mật.
04/07/2026