Anthropic đã tiến hành điều tra ba sự cố an ninh mạng có thật trong quá trình đánh giá hệ thống của mình. Mục tiêu là rút ra bài học và cải thiện khả năng phòng thủ trước các mối đe dọa thực tế.
Tóm tắt này được dịch tự động từ nguồn gốc tiếng Anh. Đọc bài gốc tại Anthropic News →
Anthropic đã tiến hành điều tra ba sự cố an ninh mạng có thật trong quá trình đánh giá hệ thống của mình. Mục tiêu là rút ra bài học và cải thiện khả năng phòng thủ trước các mối đe dọa thực tế.
Xem nguồn gốc: Anthropic News
Chính phủ Alberta đã triển khai Claude để tăng cường an ninh mạng, sử dụng công nghệ AI này để phát hiện và khắc phục các lỗ hổng bảo mật trên toàn bộ hệ thống của mình. Sáng kiến này giúp bảo vệ dữ liệu và thông tin quan trọng của công dân, đảm bảo an toàn cho các dịch vụ công trực tuyến.
12/07/2026

Anthropic vừa công bố chi tiết về các biện pháp bảo vệ an ninh mạng tích hợp trong Fable 5, đặc biệt là các bộ phân loại an toàn (safety classifiers). Bài viết cũng giới thiệu bản dự thảo đầu tiên về khung đánh giá mức độ nghiêm trọng của jailbreak, một nỗ lực nhằm chuẩn hóa cách ngành công nghiệp AI thảo luận và xử lý các rủi ro bảo mật.
04/07/2026

Nhóm Frontier Red Team của Anthropic đã công bố LLM ATT&CK Navigator, một công cụ đột phá để lập bản đồ các mối đe dọa an ninh mạng do AI gây ra. Bằng cách điều chỉnh khuôn khổ MITRE ATT&CK nổi tiếng cho các mô hình ngôn ngữ lớn, nghiên cứu này cung cấp một cái nhìn sâu sắc về cách các tác nhân độc hại có thể khai thác AI và quan trọng hơn là cách chúng ta có thể xây dựng hệ thống phòng thủ chủ động để chống lại chúng.
17/06/2026