.jpg)
Nguồn ảnh: Krisztian Bocsi/Bloomberg / Getty Images
Việc ra mắt hạn chế này là một phần của sáng kiến bảo mật mới mang tên Project Glasswing, trong đó 12 tổ chức đối tác sẽ triển khai mô hình nhằm phục vụ “công việc an ninh phòng thủ” và bảo vệ các phần mềm quan trọng, theo Anthropic. Dù không được huấn luyện chuyên biệt cho lĩnh vực an ninh mạng, mô hình sẽ được sử dụng để quét cả hệ thống phần mềm nội bộ và mã nguồn mở nhằm phát hiện lỗ hổng bảo mật trong mã, công ty cho biết.
Anthropic tuyên bố rằng trong vài tuần qua, Mythos đã phát hiện “hàng nghìn lỗ hổng zero-day, nhiều trong số đó là nghiêm trọng.” Công ty cũng cho biết thêm, nhiều lỗ hổng đã tồn tại từ một đến hai thập kỷ.
Mythos là mô hình đa dụng dành cho hệ thống AI Claude của Anthropic, được công ty khẳng định có năng lực mạnh về lập trình theo tác nhân (agentic coding) và suy luận. Các mô hình tiên phong của Anthropic được xem là những mô hình tinh vi và hiệu năng cao nhất, được thiết kế cho các tác vụ phức tạp hơn, bao gồm xây dựng tác nhân và lập trình.
Các tổ chức đối tác tham gia thử nghiệm Mythos trong Project Glasswing bao gồm Amazon, Apple, Broadcom, Cisco, CrowdStrike, Linux Foundation, Microsoft và Palo Alto Networks. Trong khuôn khổ sáng kiến này, các đối tác cuối cùng sẽ chia sẻ những gì họ học được từ việc sử dụng mô hình để toàn ngành công nghệ có thể hưởng lợi. Anthropic cho biết bản xem trước sẽ không được phát hành rộng rãi, dù có tổng cộng 40 tổ chức sẽ được tiếp cận Mythos ngoài nhóm đối tác chính thức.
Anthropic cũng cho biết họ đang có các “cuộc thảo luận liên tục” với các quan chức liên bang về việc sử dụng Mythos, dù có thể thấy những trao đổi này khá phức tạp trong bối cảnh Anthropic và chính quyền Trump hiện đang vướng vào một tranh chấp pháp lý, sau khi Lầu Năm Góc đánh giá phòng thí nghiệm AI này là rủi ro chuỗi cung ứng do từ chối cho phép nhắm mục tiêu tự động hoặc giám sát công dân Mỹ.
Thông tin về Mythos ban đầu bị rò rỉ trong một sự cố bảo mật dữ liệu được Fortune đưa tin vào tháng trước. Một bản nháp bài blog về mô hình (khi đó có tên “Capybara”) đã bị để trong bộ nhớ đệm tài liệu không được bảo mật, nằm trong một kho dữ liệu có thể truy cập công khai. Vụ rò rỉ, sau đó được Anthropic quy cho “lỗi con người,” ban đầu được phát hiện bởi các nhà nghiên cứu bảo mật. “‘Capybara’ là tên mới cho một phân khúc mô hình mới: lớn hơn và thông minh hơn các mô hình Opus của chúng tôi — vốn trước đây là mạnh nhất,” tài liệu bị rò rỉ cho biết, đồng thời nói thêm rằng đây là “mô hình AI mạnh nhất mà chúng tôi từng phát triển,” theo báo cáo.
Trong tài liệu rò rỉ, Anthropic cho biết mô hình mới vượt xa các mức hiệu năng (như “lập trình phần mềm, suy luận học thuật và an ninh mạng”) của các mô hình công khai hiện tại, và có thể trở thành mối đe dọa an ninh mạng nếu bị các tác nhân xấu lợi dụng để tìm và khai thác lỗi (thay vì khắc phục chúng như cách Mythos được triển khai).
Tháng trước, công ty đã vô tình làm lộ gần 2.000 tệp mã nguồn và hơn nửa triệu dòng mã do sai sót trong quá trình phát hành phiên bản 2.1.88 của gói phần mềm Claude Code. Sau đó, trong nỗ lực khắc phục sự cố, công ty lại vô tình khiến hàng nghìn kho mã trên GitHub bị gỡ xuống.
Đính chính ngày 7/4/2026: Một phiên bản trước của bài viết đã nêu sai số lượng đối tác làm việc với Anthropic trong Project Glasswing. Có 12 tổ chức đối tác, trong khi tổng cộng 40 tổ chức sẽ có quyền truy cập vào bản xem trước Mythos.
(Theo TechCrunch)