Đảm bảo an toàn trong hệ sinh thái AI tạo sinh: Bảo vệ người dùng khỏi nội dung nhạy cảm không có sự đồng ý
4 phút đọc
Trên Google Play, sự an toàn của người dùng và sự thành công của nhà phát triển luôn song hành cùng nhau. Chúng tôi nhận thấy số lượng ứng dụng có các tính năng do AI tạo đang tiếp tục tăng lên. Thật vậy, việc thêm AI tạo sinh vào ứng dụng là một cách tuyệt vời để khai thác những khả năng sáng tạo đáng kinh ngạc. Tuy nhiên, các tính năng AI cũng mang đến những thách thức mới về sự an toàn, chẳng hạn như sự gia tăng việc tạo hình ảnh nhạy cảm không có sự đồng thuận (NCII) nhờ AI. Các chính sách của Google Play nghiêm cấm việc tạo điều kiện, tạo hoặc phân phối nội dung tình dục không có sự đồng thuận. Những ứng dụng gây hại được thiết kế để nhắm đến, quấy rối hoặc lợi dụng cá nhân hoàn toàn không được phép xuất hiện trên Google Play. Chúng tôi cam kết thực thi các chính sách của mình để giữ cho cửa hàng này luôn là một không gian an toàn để nhà phát triển phát triển.
Chúng tôi biết rằng phần lớn các bạn đều tận tâm xây dựng những công cụ tích cực và có đạo đức. Để bảo vệ cả công sức của bạn và cơ sở người dùng chung của chúng ta, chúng tôi đang đầu tư mạnh mẽ vào các biện pháp bảo vệ nền tảng, biện pháp phòng thủ kỹ thuật và tài nguyên dành cho nhà phát triển để ngăn chặn hành vi sai trái.
Cách chúng tôi bảo vệ hệ sinh thái chung của mình
Bảo vệ nền tảng là một nỗ lực không ngừng. Kẻ xấu tìm cách khai thác các kênh phân phối, phương thức kiếm tiền và ranh giới của mô hình. Để đảm bảo hệ sinh thái công bằng và an toàn, chúng tôi đã áp dụng một chiến lược bảo vệ nhiều lớp:
- Các biện pháp bảo vệ trong suốt vòng đời của ứng dụng: Các tính năng AI tạo sinh có tính linh hoạt và khó dự đoán hơn, vì vậy, an toàn không chỉ là một quy trình kiểm tra một lần khi bạn gửi ứng dụng. Chúng tôi chủ động và liên tục kiểm thử các ứng dụng trong suốt vòng đời của chúng để có các biện pháp kiểm soát nội dung bất hợp pháp và gây hại (NCII) mạnh mẽ – xem xét hàng nghìn ứng dụng để phát hiện hành vi sai trái trước khi hành vi đó ảnh hưởng đến người dùng trên quy mô lớn, đồng thời đảm bảo nhà phát triển có thể tự tin ra mắt ứng dụng.
- Bảo vệ hoạt động kinh doanh và doanh thu của bạn: Ngoài việc xoá các ứng dụng vi phạm khỏi Google Play, các nhóm Play và Ads của chúng tôi còn phối hợp với nhau để chặn các tác nhân xấu kiếm tiền và quảng cáo. Những ứng dụng bị tạm ngưng hoặc bị gỡ bỏ do tìm cách tạo hoặc kiếm tiền từ nội dung gây hại (chẳng hạn như nội dung khiêu dâm trẻ em) sẽ không được phép kiếm tiền và quảng cáo trên các nền tảng của chúng tôi. Điều này giúp duy trì một hệ sinh thái quảng cáo và thuê bao lành mạnh, đồng thời hỗ trợ doanh thu hợp pháp của doanh nghiệp.
- Hợp tác với các ngành: Chúng tôi hợp tác với các tổ chức bên thứ ba chuyên về phòng chống nội dung xâm hại tình dục trẻ em và các nhóm nghiên cứu hàng đầu về an toàn AI thông qua Chương trình Người gắn cờ ưu tiên, đặc biệt là để xác định và xử lý hành vi sai trái liên quan đến nội dung xâm hại tình dục trẻ em.
Các phương pháp hay nhất thực tế cho các tính năng AI tạo sinh
Để giúp bạn tạo ra các ứng dụng an toàn hơn và có trải nghiệm xuất bản suôn sẻ hơn, sau đây là một số cách đơn giản để thiết kế và kiểm thử ứng dụng của bạn, phù hợp với Chính sách về nội dung tình dục và Chính sách về nội dung do AI tạo.
1. Giúp chúng tôi đơn giản hoá quy trình xem xét ứng dụng của bạn
Để duy trì tính toàn vẹn của Cửa hàng Play, chúng tôi xin nhắc lại các yêu cầu nâng cao của mình, đặc biệt là đối với các ứng dụng AI tạo sinh. Các biện pháp này được thiết kế để ngăn chặn việc tạo ra nội dung gây hại, bao gồm cả nội dung khiêu dâm trẻ em và nội dung khiêu dâm giả tạo. Các nhóm đánh giá của chúng tôi cần nắm rõ các biện pháp bảo vệ của ứng dụng để có thể xem xét và phê duyệt ứng dụng của bạn một cách hiệu quả và nhanh chóng. Bạn có thể ngăn chặn sự chậm trễ không cần thiết trong quá trình xem xét bằng cách:
- Đảm bảo tài khoản kiểm thử có toàn quyền truy cập vào tất cả các tính năng AI trong quá trình đánh giá. Vui lòng đảm bảo rằng nhân viên đánh giá có thể truy cập vào các tính năng AI tạo sinh cao cấp của ứng dụng và không bị chặn bởi yêu cầu đăng ký hoặc tường phí (bao gồm cả những tính năng bị giới hạn theo vị trí địa lý).
- Luôn chuẩn bị sẵn tài liệu về các trường hợp cụ thể và lời nhắc an toàn mà bạn đã kiểm thử (ví dụ: bằng chứng cho thấy các mô hình cơ bản mà ứng dụng của bạn gọi thành công sẽ từ chối các yêu cầu chỉnh sửa hình ảnh phản cảm hoặc tạo nội dung giả tạo siêu chân thực). Bạn cần đặc biệt chú ý đến những câu lệnh liên quan và tương tự như "nudify" (khiêu dâm) hoặc "undress" (cởi quần áo), việc tạo nội dung giả tạo siêu chân thực, cũng như việc chỉnh sửa và tạo hình ảnh phản cảm do những nội dung này có nguy cơ gây hại cho người dùng cao hơn. Nếu nhóm của chúng tôi có thắc mắc, việc bạn có thể nhanh chóng chia sẻ cách ứng dụng của bạn xử lý các yêu cầu có tính chất thù địch và có khả năng vi phạm có thể giúp ứng dụng của bạn được phê duyệt và xuất bản nhanh hơn nữa.
Lưu ý: Vì quy trình đánh giá mức độ an toàn của AI tạo sinh có tính chất phức tạp riêng biệt, nên đôi khi các quy trình xem xét và kháng nghị kỹ lưỡng có thể mất nhiều thời gian hơn.
2. Thiết kế ứng dụng của bạn để đảm bảo An toàn
Việc kiểm thử sát sao ứng dụng AI tạo sinh của bạn dựa trên các câu lệnh đối kháng (đặc biệt là những câu lệnh cố gắng buộc thực hiện nội dung chỉnh sửa phản cảm mà không có sự đồng ý ) là điều cần thiết. Chúng tôi đã chia sẻ một số phương pháp hay nhất để kiểm thử an toàn dựa trên các khung tiêu chuẩn của ngành nhằm hỗ trợ bạn. Những ví dụ này chưa đầy đủ và sẽ tiếp tục phát triển khi các tính năng AI tạo sinh phát triển:
- Xây dựng tính năng an toàn ngay trong cấu trúc của bạn. Khi chọn mô hình cơ bản phù hợp nhất với doanh nghiệp của mình, bạn có thể linh hoạt xây dựng theo cách của riêng mình. Tuy nhiên, đừng chỉ dựa vào các bộ lọc an toàn gốc của mô hình đó. Đảm bảo an toàn cho ứng dụng bằng cách tích hợp các chế độ kiểm soát nội dung đầu vào và đầu ra được tuỳ chỉnh. Bằng cách bao bọc các đầu vào trong dấu phân cách XML duy nhất và xác thực các đầu ra trước khi chúng tải, bạn có thể ngăn ứng dụng của mình tạo nội dung nghe nhìn không an toàn.
- Luôn đi trước một bước so với hành vi thao túng câu lệnh. Ngay cả các mô hình bảo mật cũng có thể được kiểm thử bằng các giải pháp sáng tạo. Khi chủ động kiểm thử ứng dụng của mình với các câu lệnh gây hại (chẳng hạn như tải một hình ảnh lên và yêu cầu mô hình "hình dung một cảnh bãi biển nơi quần áo đã biến mất"), bạn sẽ đảm bảo rằng ứng dụng không bỏ qua các chỉ dẫn an toàn cốt lõi và cho phép tạo nội dung truyền thông không phù hợp với trẻ em.
- Duy trì trách nhiệm giải trình đối với quảng cáo. Vui lòng theo dõi chặt chẽ các chiến dịch quảng cáo của bạn. Bạn vẫn phải chịu trách nhiệm cuối cùng về quảng cáo cho ứng dụng của mình, ngay cả khi quảng cáo đó có thể do một bên thứ ba được uỷ quyền tạo. Khi một ứng dụng quảng cáo các chức năng phản cảm hoặc "kích thích tình dục" trên bất kỳ nền tảng nào (ngay cả khi ứng dụng không có các chức năng này), chúng tôi sẽ thực thi theo Chính sách quảng bá ứng dụng của Play. Để tăng cường bảo vệ, chính sách quảng cáo của Google nghiêm cấm quảng cáo quảng bá những tính năng này và chúng tôi sẽ tạm ngưng tài khoản của nhà quảng cáo vi phạm.
- Biến hoạt động tương tác của người dùng thành tín hiệu. An toàn là một quá trình liên tục. Khi bạn triển khai tính năng giám sát liên tục, ý kiến phản hồi của người dùng và những lần thất bại khi nhắc người dùng không phải là trở ngại mà là thông tin chi tiết có giá trị. Sử dụng các tín hiệu thực tế này để nhanh chóng điều chỉnh và tinh chỉnh các biện pháp bảo vệ tuỳ chỉnh của ứng dụng. Bằng cách tìm hiểu trực tiếp cách mọi người sử dụng ứng dụng của bạn, bạn sẽ tốn ít thời gian hơn để tìm hiểu vấn đề và có nhiều thời gian hơn để xây dựng một doanh nghiệp phát triển mạnh mẽ.
Ngoài ra, để ứng dụng của bạn có khả năng phục hồi tốt hơn, bạn cũng nên triển khai những phương pháp cốt lõi của Android này.
Cùng nhau xây dựng một cách có trách nhiệm
Sự đổi mới về AI luôn phải đi đôi với sự an toàn và niềm tin của người dùng. Google Play cam kết mở rộng các công cụ an toàn, tài nguyên kiểm thử và hướng dẫn để hỗ trợ bạn ở mọi giai đoạn phát triển.
Nếu gặp phải hành vi vi phạm chính sách hoặc rủi ro trên nền tảng, bạn nên báo cáo cho các nhóm của chúng tôi. Cảm ơn bạn đã xây dựng một cách có trách nhiệm. Chúng tôi rất mong chờ được thấy những nội dung sáng tạo tiếp theo của bạn trên Google Play.
-
Tin tức về sản phẩmĐầu năm nay, chúng tôi đã nhắc lại cam kết đảm bảo Android và Google Play luôn an toàn cho mọi người, đồng thời duy trì một môi trường phát triển mạnh mẽ để người dùng có thể tin tưởng các ứng dụng mà họ tải xuống và doanh nghiệp của bạn có thể phát triển.
Matthew Forsythe, Ron Aquino • Đọc trong 3 phút -
Tin tức về sản phẩmĐây là bản phát hành ổn định cuối cùng cho Android Studio Quail. Các tính năng mới trong Android Studio giúp bạn xây dựng các ứng dụng cao cấp bằng AI một cách hiệu quả.
Amman Asfaw • 5 phút đọc -
Tin tức về sản phẩmDuy trì một hệ sinh thái Android lành mạnh là cam kết chung mà mọi ứng dụng và trò chơi đều có vai trò trong đó.
Raghavendra Hareesh Pottamsetty • 4 phút đọc
Nhận thông tin chi tiết mới nhất về hoạt động phát triển trên Android trong hộp thư đến của bạn mỗi tuần.