Anthropic cam kết không ngừng nâng cao các nỗ lực về sự phù hợp và bảo mật. Điều này nhằm đảm bảo các mô hình AI của hãng, bao gồm cả Claude, hoạt động an toàn, đáng tin cậy và phù hợp với các giá trị của con người.
Tóm tắt này được dịch tự động từ nguồn gốc tiếng Anh. Đọc bài gốc tại Anthropic News →
Anthropic cam kết không ngừng nâng cao các nỗ lực về sự phù hợp và bảo mật. Điều này nhằm đảm bảo các mô hình AI của hãng, bao gồm cả Claude, hoạt động an toàn, đáng tin cậy và phù hợp với các giá trị của con người.
Xem nguồn gốc: Anthropic News
Anthropic đã tiến hành điều tra ba sự cố an ninh mạng có thật trong quá trình đánh giá hệ thống của mình. Mục tiêu là rút ra bài học và cải thiện khả năng phòng thủ trước các mối đe dọa thực tế.
31/07/2026

Anthropic vừa công bố chi tiết về các biện pháp bảo vệ an ninh mạng tích hợp trong Fable 5, đặc biệt là các bộ phân loại an toàn (safety classifiers). Bài viết cũng giới thiệu bản dự thảo đầu tiên về khung đánh giá mức độ nghiêm trọng của jailbreak, một nỗ lực nhằm chuẩn hóa cách ngành công nghiệp AI thảo luận và xử lý các rủi ro bảo mật.
04/07/2026

Trong một năm, Anthropic đã phân tích 832 trường hợp lạm dụng AI cho mục đích tấn công mạng, từ viết mã độc đến xâm nhập sâu vào hệ thống. Báo cáo này không chỉ vạch trần các chiến thuật mới của tin tặc mà còn chỉ ra những lỗ hổng trong các khung phòng thủ hiện tại như MITRE ATT&CK, đặt ra yêu cầu cấp thiết về việc phải suy nghĩ lại cách chúng ta bảo vệ không gian mạng.
04/06/2026