Anthropic sẽ gắn watermark vào văn bản do Claude tạo ra

Anthropic sẽ gắn watermark ngay ở cấp mô hình Claude để đánh dấu văn bản và tệp do AI tạo ra, đáp ứng EU AI Act Transparency Code từ 2/8.

Anthropic sẽ gắn watermark vào văn bản do Claude tạo ra

Anthropic cho biết sẽ gắn watermark vào văn bản do các mô hình Claude tạo ra, một phần trong kế hoạch đáp ứng các yêu cầu minh bạch mới đối với nội dung AI tại Liên minh châu Âu (EU). Cơ chế này được triển khai ở cấp mô hình, thay vì phụ thuộc vào từng ứng dụng hoặc giao diện mà người dùng sử dụng.

Thay đổi được Anthropic xác nhận trong trang hỗ trợ cập nhật về cách Claude đánh dấu nội dung do AI tạo ra. Theo công ty, các mô hình phát hành sau ngày 2/8 sẽ được tích hợp công nghệ đánh dấu cho cả văn bản lẫn tệp được tạo bởi AI.

Động thái này diễn ra sau khi các yêu cầu thuộc EU AI Act Transparency Code có hiệu lực từ ngày 2/8. Bộ quy tắc yêu cầu các công ty AI triển khai phương thức giúp hệ thống khác nhận biết nội dung được tạo hoặc chỉnh sửa bằng trí tuệ nhân tạo.

Watermark có thể đi theo văn bản khi copy và paste

Với các tệp do Claude tạo ra, Anthropic sẽ sử dụng C2PA, tiêu chuẩn mở dành cho việc xác thực nguồn gốc và lịch sử của nội dung số. Trong khi đó, văn bản sẽ sử dụng một cơ chế watermark được tích hợp trực tiếp ở cấp mô hình.

Anthropic cho biết watermark trở thành một phần của văn bản nên có thể tiếp tục tồn tại khi người dùng copy và paste nội dung sang nơi khác. Dấu hiệu này cũng có khả năng được giữ lại sau một số thao tác chỉnh sửa, dù công ty chưa công bố mức độ thay đổi cần thiết để watermark không còn được nhận diện.

Việc triển khai ở cấp mô hình đồng nghĩa nội dung có thể được đánh dấu bất kể người dùng tạo văn bản thông qua sản phẩm nào của Anthropic. Danh sách được công ty đề cập gồm Claude, Claude Platform API, Claude Code, Claude Cowork và Claude Tag.

Anthropic cũng dự kiến mở rộng cơ chế này sang các mô hình cũ hơn. Tuy nhiên, công ty chưa cung cấp lịch triển khai cụ thể cho từng phiên bản Claude.

Nhiều nền tảng AI bắt đầu tăng cường đánh dấu nội dung

Watermark và các phương thức xác thực nguồn gốc nội dung đang được nhiều công ty công nghệ triển khai trong bối cảnh nội dung do AI tạo ra ngày càng phổ biến, đồng thời các cơ quan quản lý tăng yêu cầu về khả năng nhận diện và minh bạch.

Nền tảng tạo nhạc AI Suno gần đây cũng cho biết sẽ bắt đầu đánh dấu những bản nhạc được tạo trên dịch vụ của mình. Substack trước đó hợp tác với Pangram để hỗ trợ phát hiện nội dung có khả năng được tạo bằng AI trên các newsletter.

Ngoài Anthropic, nhiều công ty gồm Black Forest Labs, Google, Meta, Microsoft, OpenAI và Synthesia cũng đã cam kết tuân thủ bộ quy tắc minh bạch của EU đối với nội dung do AI tạo ra.

Với Anthropic, việc đưa watermark xuống cấp mô hình giúp cơ chế đánh dấu không bị giới hạn trong một sản phẩm riêng lẻ. Khi cùng một mô hình được sử dụng thông qua Claude, API hay các công cụ dành cho lập trình viên, nội dung tạo ra vẫn có thể mang dấu hiệu phục vụ quá trình nhận diện bằng hệ thống khác.