Tin tức AISố chữ 5631Thời gian đọc15 phút

Các Mô hình Claude Tương lai Sẽ Đóng Dấu Nước Văn bản Trên Toàn cầu Theo Quy định của Đạo luật AI EU

Anthropic sẽ bổ sung dấu nước văn bản dựa trên SynthID và thông tin xác thực tệp C2PA cho các mô hình Claude tương lai trên toàn cầu.

Anthropic sẽ tích hợp các tín hiệu nguồn gốc có thể đọc bằng máy vào các mô hình Claude tương lai, bổ sung dấu nước thống kê vào văn bản được tạo và siêu dữ liệu C2PA có chữ ký vào các tệp được hỗ trợ. Dù thay đổi này nhằm tuân thủ Đạo luật AI của Liên minh châu Âu, Anthropic dự định áp dụng dấu nước văn bản trên toàn cầu thay vì chỉ giới hạn cho người dùng châu Âu.

Chính sách này áp dụng cho các mô hình Claude được ra mắt tại EU vào hoặc sau ngày 2 tháng 8 năm 2026. Những mô hình đó sẽ hỗ trợ đánh dấu ngay từ khi ra mắt, trong khi Anthropic cho biết đang triển khai mở rộng hệ thống tới các mô hình phát hành trước ngày đó trong những tháng tới. Công ty chưa nêu tên một mô hình Claude mới cụ thể nào sẽ là bản triển khai đầu tiên.

Dấu nước sẽ không xuất hiện dưới dạng nhãn, ký tự Unicode ẩn hoặc một dòng bổ sung trong phản hồi. Thay vào đó, nó sẽ thay đổi quy trình thống kê mà Claude sử dụng để chọn token trong quá trình tạo sinh. Anthropic cho biết điều này sẽ không làm thay đổi ý nghĩa, khả năng đọc, độ trễ hoặc giá cả, nhưng công ty vẫn chưa công bố trình phát hiện dành riêng cho Claude, các ngưỡng, tỷ lệ dương tính giả hoặc đánh giá kỹ thuật đầy đủ.

1. Việc đánh dấu sẽ bao phủ các sản phẩm Claude và quyền truy cập qua đám mây

Anthropic cho biết các mô hình được hỗ trợ sẽ áp dụng dấu nước văn bản trên dịch vụ Claude dành cho người dùng, Claude Platform API, Claude Code, Claude Cowork và Claude Tag. Dấu nước cũng sẽ được áp dụng khi các mô hình đó được truy cập thông qua AWS, Google Cloud hoặc Microsoft Foundry.

Việc triển khai ở cấp độ mô hình này quan trọng vì dấu đánh dấu không phụ thuộc vào một giao diện người dùng cụ thể. Một nhà phát triển gọi API và một người sử dụng Claude trực tiếp sẽ nhận được văn bản được tạo bằng cùng một quy trình đóng dấu nước khi họ dùng mô hình được hỗ trợ.

Việc triển khai diễn ra trên toàn cầu. Anthropic cho biết hiện chưa có cách bền vững để giới hạn cơ chế này theo khu vực, vì vậy các mô hình được hỗ trợ sẽ đánh dấu văn bản ở bất cứ nơi nào Claude được cung cấp. Điều này biến một yêu cầu tuân thủ của EU thành thay đổi sản phẩm cho cả người dùng và nhà phát triển Claude ngoài khối.

Phạm vi rộng này có những điều kiện đi kèm. Siêu dữ liệu tệp có chữ ký có thể không khả dụng trên mọi nền tảng đám mây, tính năng sản phẩm hoặc loại tệp. Các mô hình Claude hiện có cũng có thể vẫn chưa được đánh dấu cho đến khi Anthropic cập nhật chúng. Do đó, việc không có dấu có thể phát hiện được sẽ không chứng minh rằng một đoạn văn được tạo mà không có Claude.

Anthropic cho biết dấu nước không mang thông tin nào về người dùng, tổ chức, tài khoản hoặc cuộc trò chuyện đã tạo ra văn bản. Nó nhận diện một mẫu thống kê gắn với quy trình tạo sinh của Claude, chứ không phải một nguồn cá nhân. Cơ chế này cũng không tạo thêm token đầu ra, vì vậy Anthropic cho biết nó sẽ không làm tăng phí sử dụng.

2. Claude sẽ sử dụng một phiên bản của SynthID-Text

Dấu nước văn bản của Claude dựa trên SynthID-Text, phương pháp mà Google DeepMind mô tả trong một bài báo trên Nature năm 2024 và sau đó cung cấp cho các nhà phát triển mô hình khác.

Một mô hình ngôn ngữ thông thường chọn từng token tiếp theo từ một phân phối xác suất được điều kiện hóa theo văn bản trước đó. Nhiều đoạn văn có những điểm mà một vài lựa chọn đều phù hợp tương đương. Hệ thống đóng dấu nước có thể sử dụng các lựa chọn đó để tạo ra một mẫu thống kê lặp lại mà không chèn ký hiệu hiển thị hoặc trường siêu dữ liệu riêng biệt.

Anthropic mô tả cách triển khai của mình là sử dụng khóa riêng và các từ đứng trước để xác định nguồn ngẫu nhiên được dùng cho các lựa chọn đủ điều kiện. Một trình phát hiện có quyền truy cập vào khóa liên quan có thể kiểm tra một đoạn văn và chấm điểm mức độ nhất quán của chuỗi token với quy trình tạo sinh có dấu nước của Claude.

Bản triển khai tham chiếu của Google mô tả SynthID-Text là một bộ xử lý logits được áp dụng sau khi lọc top-k và top-p. Một hàm giả ngẫu nhiên gán điểm trên toàn bộ từ vựng của mô hình, và cấu hình đóng dấu nước ảnh hưởng đến việc chọn token. Không cần huấn luyện bổ sung cho mô hình, nhưng khóa và cấu hình phải được giữ riêng tư; nếu không, bên thứ ba có thể tái tạo tín hiệu.

Vì vậy, dấu nước là một phần của câu chữ được tạo ra và thông thường vẫn tồn tại khi sao chép rồi dán. Những chỉnh sửa nhẹ hoặc đoạn trích có thể giữ lại đủ mẫu để vẫn phát hiện được. Việc viết lại kỹ lưỡng, dịch thuật hoặc trộn với văn bản khác có thể làm giảm độ tin cậy của trình phát hiện hoặc loại bỏ tín hiệu có thể sử dụng.

Mật độ dấu nước cũng phụ thuộc vào tác vụ. Văn xuôi mở cho phép nhiều lựa chọn từ ngữ ít rủi ro, trong khi các câu trả lời thực tế chứa nhiều token mà một cách hoàn thiện rõ ràng chính xác hơn các lựa chọn khác. Anthropic cho biết sẽ tránh áp dụng tác động điều hướng của dấu nước khi điều đó có thể làm ảnh hưởng đến tính chính xác.

Giới hạn tương tự cũng ảnh hưởng đến mã nguồn. Cú pháp chính xác, định danh và hành vi chương trình hạn chế số lượng lựa chọn token có thể thay thế cho nhau, vì vậy mã có thể chứa ít dấu nước có thể phát hiện hơn văn xuôi. Bình luận hoặc các cách diễn đạt tùy ý khác vẫn có thể mang mẫu này. Việc hiệu đính tương tự có thể để lại rất ít tín hiệu khi Claude giữ nguyên phần lớn câu chữ gốc của một người, trong khi bản dịch có nhiều khả năng mang dấu nước hơn vì Claude chọn mọi từ trong đầu ra đã dịch.

3. Tệp sẽ sử dụng siêu dữ liệu C2PA, không phải kỹ thuật dành cho văn bản

Đối với các tệp được hỗ trợ như đầu ra SVG, PNG và JPEG, Anthropic sẽ đính kèm một bản ghi nguồn gốc nhỏ, được ký bằng mật mã theo tiêu chuẩn Coalition for Content Provenance and Authenticity.

Thông tin xác thực C2PA ghi lại thông tin về nguồn gốc và lịch sử xử lý của một tệp. Một công cụ xác minh tương thích có thể kiểm tra bản ghi có chữ ký và xác định liệu tệp có bị thay đổi theo cách phá vỡ mối quan hệ mật mã với bản ghi đó hay không.

Cơ chế này khác với dấu nước văn bản của Claude. Thông tin C2PA nằm trong siêu dữ liệu của tệp thay vì được mã hóa thống kê vào pixel hoặc câu chữ. Sự hiện diện của nó có thể cho thấy Claude đã tạo hoặc xử lý một tệp, nhưng không xác lập rằng Claude là nguồn gốc của mọi thành phần trong đó.

Siêu dữ liệu cũng dễ bị mất hơn một mẫu thống kê ở cấp độ văn bản. Anthropic cảnh báo rằng chuyển đổi định dạng, lưu lại, chụp ảnh màn hình hoặc các cách xử lý khác có thể loại bỏ thông tin xác thực của tệp. Một số nền tảng có thể ngay từ đầu không bảo toàn hoặc hỗ trợ siêu dữ liệu này.

Do đó, việc thiếu thông tin xác thực không chứng minh Claude không có vai trò nào trong một tệp. Ngược lại, một thông tin xác thực hợp lệ chỉ xác lập sự kiện xử lý đã được ghi lại; nó không phải là phán đoán về việc nội dung có chính xác, xác thực theo nghĩa biên tập rộng hơn hay chủ yếu do con người sáng tác hay không.

4. Việc phát hiện vẫn mang tính xác suất và Claude API vẫn chưa khả dụng

Anthropic cho biết sẽ cung cấp API phát hiện dấu nước, nhưng tính đến ngày 27 tháng 8, công ty chưa công bố API đó, ngày phát hành, các ngưỡng quyết định hoặc kết quả hiệu năng chi tiết dành riêng cho Claude. Tài liệu trợ giúp của công ty cho biết hướng dẫn kỹ thuật bổ sung sẽ được cung cấp sau.

Thông tin còn thiếu này ngăn cản việc đánh giá chính xác xác suất dương tính giả của Claude. Việc phát hiện SynthID-Text vốn mang tính xác suất, và bản triển khai công khai của Google có thể trả về “có dấu nước”, “không có dấu nước” hoặc “không chắc chắn”. Người vận hành cấu hình các ngưỡng để đánh đổi giữa dương tính giả và âm tính giả.

Trình phát hiện của Anthropic sẽ trả lời một câu hỏi có phạm vi hạn chế: khả năng Claude đã tham gia tạo ra ít nhất một phần của văn bản được gửi là bao nhiêu. Nó sẽ không chứng minh Claude đã viết toàn bộ tài liệu, phân biệt việc tạo sinh với chỉnh sửa đáng kể, nhận diện người dùng hoặc phát hiện văn bản do một mô hình không liên quan tạo ra với khóa đóng dấu nước khác.

Một kết quả dương tính có thể bao gồm tài liệu mà ý tưởng nền tảng hoặc câu chữ gốc đến từ một con người. Claude có thể đã dịch, tóm tắt, định dạng lại hoặc chỉnh sửa đáng kể tài liệu đó. Kết quả âm tính cũng không mang tính kết luận vì đoạn văn có thể quá ngắn, bị viết lại nhiều, trộn lẫn với văn bản khác, được tạo bởi một mô hình Claude cũ hơn hoặc được tạo qua một bề mặt không được hỗ trợ.

Anthropic báo cáo rằng thử nghiệm nội bộ của họ không tìm thấy ảnh hưởng đến nội dung, tính sáng tạo hoặc khả năng đọc, nhưng chưa công bố đánh giá Claude nền tảng. Bằng chứng công khai quy mô lớn gần nhất đến từ nghiên cứu SynthID-Text của Google DeepMind, nghiên cứu này so sánh phản hồi đối với gần 20 triệu câu trả lời Gemini có và không có dấu nước, đồng thời báo cáo không có khác biệt có ý nghĩa thống kê trong đánh giá của người dùng. Kết quả đó ủng hộ phương pháp chung, nhưng không phải là phép đo độc lập về cách triển khai chưa được công bố của Anthropic.

Những giới hạn này khiến trình phát hiện không phù hợp để làm bằng chứng độc lập trong các quyết định về việc làm, giáo dục, đạo văn hoặc kỷ luật. Ngay cả sau khi API xuất hiện, việc sử dụng có trách nhiệm sẽ đòi hỏi ngưỡng đã công bố, dữ liệu đánh giá, độ dài đoạn văn, ngôn ngữ, lịch sử chỉnh sửa và các bằng chứng nguồn gốc khác.

5. Thay đổi này thực hiện một yêu cầu pháp lý về đánh dấu

Điều 50 của Đạo luật AI EU bắt đầu được áp dụng vào ngày 2 tháng 8 năm 2026. Điều này yêu cầu các nhà cung cấp hệ thống AI tạo sinh phải khiến đầu ra âm thanh, hình ảnh, video và văn bản tổng hợp có thể phát hiện được ở định dạng máy có thể đọc, bằng các kỹ thuật hiệu quả, có khả năng tương tác, bền vững và đáng tin cậy trong chừng mực khả thi về mặt kỹ thuật.

Anthropic là một trong các tổ chức đã ký Bộ quy tắc thực hành của EU về tính minh bạch của nội dung do AI tạo sinh. Bộ quy tắc là tự nguyện, nhưng các nghĩa vụ nền tảng theo Điều 50 có tính ràng buộc pháp lý. Ủy ban châu Âu và AI Board đã công nhận bộ quy tắc này là khuôn khổ để các bên ký kết chứng minh sự tuân thủ.

Yêu cầu đánh dấu phía nhà cung cấp tách biệt với các quy định về công bố thông tin hiển thị. Các nhà cung cấp như Anthropic phải xây dựng tín hiệu máy có thể đọc vào các hệ thống áp dụng. Bên triển khai phải đối mặt với các nghĩa vụ bổ sung nhằm gắn nhãn deepfake và một số văn bản do AI tạo hoặc thao túng được công bố để thông tin cho công chúng về các vấn đề vì lợi ích công cộng, tùy thuộc vào các ngoại lệ bao gồm sự xem xét của con người và trách nhiệm biên tập.

Đối với các nhà phát triển tích hợp Claude vào sản phẩm khác, dấu nước ở cấp độ mô hình của Anthropic có thể cung cấp một phần hạ tầng nguồn gốc cần thiết, nhưng không giải quyết các nghĩa vụ tuân thủ của chính nhà phát triển. Anthropic khuyến nghị rõ ràng các đơn vị xây dựng ở hạ nguồn đánh giá cách Điều 50 áp dụng cho sản phẩm và dịch vụ của họ.

Câu hỏi thường gặp

Mọi phản hồi của Claude hiện đều đã chứa dấu nước?

Không. Cam kết áp dụng cho các mô hình được hỗ trợ ra mắt vào hoặc sau ngày 2 tháng 8 năm 2026, trong khi việc đánh dấu cho các mô hình cũ hơn vẫn đang được phát triển.

Sao chép văn bản Claude có thể loại bỏ dấu nước không?

Việc sao chép và dán thông thường sẽ giữ nguyên dấu nước vì mẫu được mã hóa trong lựa chọn từ ngữ. Viết lại nhiều, dịch thuật hoặc trộn với văn bản khác có thể làm suy yếu hoặc loại bỏ tín hiệu có thể phát hiện.

Dấu nước có thể chứng minh Claude đã viết toàn bộ tài liệu không?

Không. Nó có thể cho thấy Claude có khả năng đã tham gia, nhưng không thể phân biệt giữa việc tạo toàn bộ nội dung với chỉnh sửa đáng kể, dịch thuật hoặc tóm tắt.

Việc đóng dấu nước có làm tăng lượng token hoặc giá của Claude không?

Anthropic cho biết không có token bổ sung nào được tạo ra và cơ chế này có ảnh hưởng không đáng kể đến tốc độ tạo sinh, vì vậy giá sẽ không thay đổi do dấu nước.

Trình phát hiện dấu nước của Claude đã công khai chưa?

Chưa. Anthropic cho biết API phát hiện và tài liệu kỹ thuật bổ sung sẽ được cung cấp sau, nhưng chưa công bố ngày phát hành hoặc tỷ lệ lỗi dành riêng cho Claude.

Tham khảo nguồn

Share

Chia sẻ bài viết