Anthropies: Công cụ chống watermark AI hay chỉ là một lời cảnh báo?
Võ Yến
Điều gì xảy ra nếu một công cụ được quảng bá là 'loại bỏ watermark AI' lại chọn cách trình diễn trên chính định dạng dữ liệu mà watermark gần như không tồn tại? Charles Hoskinson, người sáng lập Cardano, vừa phát hành Anthropies – một bộ công cụ mã nguồn mở dưới giấy phép Apache 2.0, hứa hẹn giúp người dùng 'tẩy' watermark từ Claude của Anthropic. Nhưng khi nhìn vào mã nguồn, tôi thấy một sự thật phản trực giác: code – thứ mà Hoskinson dùng làm ví dụ chính – hầu như không mang tín hiệu watermark. Phải chăng đây là một tuyên bố chính trị hơn là một giải pháp kỹ thuật?
Bối cảnh: Anthropic, startup AI đang chuẩn bị IPO với định giá hơn 2 nghìn tỷ USD, đã triển khai watermark ẩn dựa trên 'tournament sampling' – một cơ chế chọn lọc xác suất để chèn tín hiệu thống kê vào đầu ra Claude. Động thái này nhằm tuân thủ Đạo luật AI của EU có hiệu lực từ tháng 8/2026, yêu cầu nội dung AI phải được phát hiện bằng máy. Hoskinson, vốn nổi tiếng với những cuộc tranh luận gay gắt về quyền sở hữu và phi tập trung, đã phản ứng bằng Anthropies chỉ 5 ngày sau khi thông tin về watermark được công bố. Ông gọi đây là 'lời cảnh báo' hơn là công cụ thực dụng.
Phân tích kỹ thuật: Anthropies chia chiến lược chống watermark thành ba lớp. Lớp 1: loại bỏ git trailer 'Co-Authored-By' – thao tác xác định, dễ dàng. Lớp 2: xóa metadata C2PA khỏi ảnh – cũng đơn giản. Lớp 3: prose (văn xuôi) – lớp khó nhất, nơi watermark thực sự ẩn náu trong phân bố thống kê của văn bản. Ở lớp này, Anthropies áp dụng 'non-origin rewrite': chuyển văn bản qua một mô hình LLM khác không có watermark (như Gemini hoặc GPT) để viết lại, hy vọng làm loãng tín hiệu. Điểm thú vị: công cụ tự động phát hiện host model và từ chối thực thi rewrite nếu phát hiện model đã bị watermark – một thiết kế có đạo đức kỹ thuật, nhưng đồng thời thừa nhận giới hạn: nó không thể hoạt động độc lập trong hệ sinh thái model có watermark.
Dựa trên kinh nghiệm audit smart contract suốt 26 năm, tôi nhận thấy một điểm mù quan trọng: Hoskinson chọn code làm demo chính vì code có cấu trúc cứng nhắc, ít chỗ cho thay thế cú pháp – watermark gần như không thể ẩn náu. Nhưng vấn đề thực sự là văn xuôi tự nhiên, nơi con người giao tiếp hàng ngày. Hiệu quả của 'non-origin rewrite' trên văn xuôi phụ thuộc hoàn toàn vào chất lượng model trung gian và mức độ hy sinh tính trung thực của văn bản gốc. Nếu Claude viết một bài luận sâu sắc, việc cho GPT viết lại có thể khiến nội dung bị xáo trộn, mất đi sắc thái. Đây là sự đánh đổi không thể tránh khỏi: hoặc giữ watermark, hoặc mất bản sắc. Công cụ không giải quyết được triệt để.
Góc nhìn phản trực giác: Có lẽ giá trị thực sự của Anthropies không nằm ở kỹ thuật, mà ở đòn pháp lý đi kèm. Hoskinson lập luận rằng điều khoản dịch vụ của Anthropic – 'quyền sở hữu đầu ra được chuyển giao với điều kiện bạn tuân thủ điều khoản của chúng tôi' – tạo ra một 'condition precedent': nếu người dùng vi phạm điều khoản (ví dụ bằng cách loại bỏ watermark), quyền sở hữu chưa bao giờ thực sự được chuyển giao. Điều này, nếu được tòa án công nhận, sẽ làm sụp đổ tuyên bố 'bạn sở hữu đầu ra' của Anthropic. Nhưng với tư cách một người đã từng đọc hàng trăm hợp đồng thông minh, tôi thấy lập luận này khá mong manh: luật hợp đồng phân biệt giữa 'promissory condition' và 'condition precedent', và hầu hết các điều khoản dịch vụ đều nghiêng về dạng trước, nghĩa là vi phạm dẫn đến hậu quả chứ không làm vô hiệu quyền sở hữu từ đầu. Hoskinson đang chọn cách giải thích có lợi cho mình, nhưng chưa có tiền lệ pháp lý nào ủng hộ.
Hơn nữa, việc chọn mã nguồn mở Apache 2.0 là một nước cờ thông minh: nó ngăn Anthropic kiện vì vi phạm bằng sáng chế, và biến Anthropies thành 'hàng hóa công cộng' không thể bị dập tắt bằng một vụ kiện đơn lẻ. Nhưng cũng chính Apache 2.0 cho phép bất kỳ ai fork và sử dụng cho mục đích xấu – như tạo nội dung giả mạo tràn lan. Hoskinson không thêm bất kỳ hạn chế sử dụng nào, để lại rủi ro đạo đức.
Takeaway: Anthropies là một tín hiệu thú vị nhưng không phải là bước đột phá. Nó giống một 'tuyên ngôn kỹ thuật' hơn là công cụ sẵn sàng sử dụng. Trong bối cảnh thị trường đi ngang, nơi mọi người đang tìm kiếm tín hiệu định giá thấp, tôi cho rằng ảnh hưởng của nó lên ADA là không đáng kể – chỉ là cảm xúc nhất thời. Câu hỏi thực sự là: liệu cuộc chiến watermark AI này có thúc đẩy các nhà lập pháp siết chặt hơn, hay mở ra một kỷ nguyên mới của 'công cụ kháng cự' nguồn mở? Tôi nghiêng về kịch bản thứ hai, nhưng với tốc độ chậm hơn nhiều so với kỳ vọng.