Zapewnianie bezpieczeństwa w ekosystemie generatywnej AI: ochrona użytkowników przed intymnymi treściami bez ich zgody
Czas czytania: 4 minuty
W Google Play bezpieczeństwo użytkowników i sukces deweloperów idą w parze. Stale obserwujemy wzrost liczby aplikacji z funkcjami opartymi na generatywnej AI. Dodanie generatywnej AI do aplikacji to świetny sposób na odblokowanie niesamowitych możliwości twórczych. Funkcje AI stwarzają jednak nowe wyzwania związane z bezpieczeństwem, takie jak wzrost liczby zdjęć o charakterze erotycznym uzyskanych, rozpowszechnianych i powielanych bez zgody osoby, którą przedstawiają, generowanych przy użyciu AI. Zasady Google Play zabraniają ułatwiania tworzenia i dystrybucji treści o charakterze seksualnym związanych z przymusem. Szkodliwe aplikacje, które mają na celu atakowanie, nękanie lub wykorzystywanie osób, nie mają prawa pojawiać się w Google Play. Dokładamy wszelkich starań, aby egzekwować nasze zasady i zapewniać deweloperom bezpieczną przestrzeń do rozwoju.
Wiemy, że większość z Was tworzy narzędzia, które są etyczne i przynoszą pozytywne efekty. Aby chronić Twoją ciężką pracę i naszą wspólną bazę użytkowników, inwestujemy w ochronę platformy, zabezpieczenia techniczne i zasoby dla deweloperów, które pomagają zapobiegać nadużyciom.
Jak chronimy nasz wspólny ekosystem
Ochrona platformy to ciągły proces. Osoby działające na szkodę innych próbują wykorzystywać kanały dystrybucji, sposoby zarabiania i granice modeli. Aby zapewnić sprawiedliwość i bezpieczeństwo w ekosystemie, wdrożyliśmy wielowarstwową strategię ochrony:
- Zabezpieczenia w całym cyklu życia aplikacji: funkcje generatywnej AI są dynamiczne i mogą być mniej przewidywalne, więc bezpieczeństwo nie jest tylko jednorazową weryfikacją podczas przesyłania aplikacji. Aktywnie i wielokrotnie testujemy aplikacje w całym cyklu życia pod kątem solidnych mechanizmów kontroli NCII. Sprawdzamy tysiące aplikacji, aby wykrywać nadużycia, zanim dotkną one użytkowników na dużą skalę, a jednocześnie zapewniamy deweloperom możliwość pewnego wprowadzania aplikacji na rynek.
- Ochrona Twojej firmy i przychodów: oprócz usuwania aplikacji naruszających zasady z Google Play nasze zespoły ds. Google Play i Google Ads współpracują ze sobą, aby odciąć nieuczciwych deweloperów od możliwości zarabiania i reklamowania. Aplikacje, które zostały zawieszone lub usunięte z powodu prób generowania lub zarabiania na szkodliwych treściach, takich jak NCII, są blokowane w zakresie zarabiania i wyświetlania reklam na naszych platformach. Pomaga to utrzymać ekosystem reklam i subskrypcji w dobrej kondycji oraz wspierać przychody rzetelnych firm.
- Współpraca z branżą: w ramach programu dla priorytetowych podmiotów sygnalizujących współpracujemy ze specjalistycznymi organizacjami zewnętrznymi zajmującymi się przeciwdziałaniem NCII oraz z wiodącymi grupami badawczymi zajmującymi się bezpieczeństwem AI. Celem tej współpracy jest wykrywanie i zwalczanie nadużyć związanych z NCII.
Praktyczne sprawdzone metody dotyczące funkcji opartych na generatywnej AI
Aby ułatwić Ci tworzenie bezpieczniejszych aplikacji i sprawniejsze publikowanie, przedstawiamy kilka prostych sposobów projektowania i testowania aplikacji zgodnie z naszymi zasadami dotyczącymi treści o charakterze seksualnym i zasadami dotyczącymi treści wygenerowanych przez AI.
1. Pomóż nam usprawnić proces sprawdzania aplikacji
Aby zachować integralność Sklepu Play, przypominamy o naszych zaostrzonych wymaganiach dotyczących aplikacji z generatywną AI. Te środki mają zapobiegać tworzeniu szkodliwych treści, w tym materiałów przedstawiających wykorzystywanie dzieci i materiałów typu „nudify”. Zespoły weryfikacyjne muszą mieć jasny wgląd w zabezpieczenia aplikacji, aby mogły skutecznie i szybko ją sprawdzić i zatwierdzić. Aby uniknąć niepotrzebnych opóźnień w sprawdzaniu:
- Zapewnienie, że konta testowe mają pełny dostęp do wszystkich funkcji AI podczas weryfikacji. Upewnij się, że recenzenci mają dostęp do funkcji premium opartych na generatywnej AI w Twojej aplikacji i nie są blokowani przez wymagania dotyczące subskrypcji ani paywalle (dotyczy to też funkcji, które są ograniczone geograficznie).
- Miej pod ręką dokumentację dotyczącą promptów związanych z bezpieczeństwem i przypadków granicznych, które zostały przez Ciebie przetestowane (np. dowód na to, że modele bazowe, z których korzysta Twoja aplikacja, skutecznie odrzucają prośby o wyraźne zmiany obrazu lub deepfake). Szczególną uwagę należy zwrócić na prompty związane z „rozbieraniem” lub podobne, generowanie deepfake’ów oraz edytowanie i generowanie obrazów o charakterze jednoznacznie seksualnym, ponieważ w tych kontekstach istnieje zwiększone ryzyko wyrządzenia szkody użytkownikom. Jeśli nasz zespół będzie mieć pytania, możliwość szybkiego udostępnienia informacji o tym, jak Twoja aplikacja obsługuje wrogie i potencjalnie naruszające zasady żądania, może przyspieszyć zatwierdzenie i opublikowanie aplikacji.
Uwaga: ocena bezpieczeństwa generatywnej AI jest wyjątkowo złożona, dlatego dokładne sprawdzenie i rozpatrzenie odwołań może czasami potrwać dłużej.
2. Projektowanie aplikacji z myślą o bezpieczeństwie
Testowanie aplikacji generatywnej AI pod kątem szkodliwych promptów – zwłaszcza tych, które próbują wymusić niekonsensualne, wyraźne zmiany – jest niezbędne. Podzieliliśmy się kilkoma sprawdzonymi metodami testowania bezpieczeństwa, które opierają się na standardowych w branży frameworkach. Te przykłady nie są wyczerpujące i będą się zmieniać wraz z rozwojem funkcji opartych na generatywnej AI:
- Zadbaj o bezpieczeństwo już na etapie projektowania architektury. Gdy wybierzesz model bazowy, który najlepiej pasuje do Twojej firmy, zyskasz elastyczność w zakresie tworzenia. Nie polegaj jednak wyłącznie na wbudowanych filtrach bezpieczeństwa tego modelu. Zadbaj o bezpieczeństwo aplikacji, integrując dostosowane ustawienia moderowania danych wejściowych i wyjściowych. Umieszczając dane wejściowe w unikalnych ogranicznikach XML i weryfikując dane wyjściowe przed ich załadowaniem, możesz zapobiec tworzeniu przez aplikację niebezpiecznych multimediów.
- Bądź o krok przed manipulacją promptami. Nawet bezpieczne modele można przetestować za pomocą kreatywnych obejść. Gdy aktywnie testujesz aplikację pod kątem niekorzystnych promptów, np. przesyłając obraz i prosząc model o „wyobrażenie sobie sceny na plaży, na której zniknęły ubrania”, masz pewność, że nie omija ona podstawowych instrukcji bezpieczeństwa i nie pozwala na tworzenie treści NCII.
- Odpowiedzialność za reklamy Uważnie monitoruj kampanie reklamowe – ponosisz ostateczną odpowiedzialność za reklamy aplikacji, nawet jeśli zostały one utworzone przez autoryzowaną firmę zewnętrzną. Jeśli aplikacja reklamuje na dowolnej platformie funkcje o charakterze jednoznacznie seksualnym lub „odzierające z ubrań” – nawet jeśli ich nie ma – egzekwujemy zgodność z zasadami Google Play dotyczącymi promowania aplikacji. Dodatkową ochronę zapewniają zasady reklamowe Google, które surowo zabraniają wyświetlania reklam promujących te funkcje. Konto reklamodawcy naruszającego te zasady zostanie zawieszone.
- Przekształcanie interakcji użytkowników w sygnały. Bezpieczeństwo to ciągły proces. Gdy wdrożysz ciągłe monitorowanie, opinie użytkowników i nieudane próby promptowania nie będą przeszkodami, ale cennymi informacjami. Korzystaj z tych sygnałów z rzeczywistego świata, aby szybko dostosowywać i precyzyjnie konfigurować niestandardowe zabezpieczenia aplikacji. Dzięki temu, że będziesz się uczyć bezpośrednio na podstawie sposobu, w jaki użytkownicy korzystają z Twojej aplikacji, poświęcisz mniej czasu na rozwiązywanie problemów, a więcej na rozwijanie firmy.
Aby zwiększyć odporność aplikacji, zalecamy też wdrożenie tych podstawowych praktyk dotyczących Androida.
Wspólne tworzenie w odpowiedzialny sposób
Innowacje w zakresie AI powinny zawsze iść w parze z bezpieczeństwem i zaufaniem użytkowników. Google Play stale rozwija narzędzia do zapewniania bezpieczeństwa, zasoby do testowania i wskazówki, aby wspierać Cię na każdym etapie rozwoju.
Jeśli natrafisz na zachowania naruszające zasady lub zagrożenia związane z platformą, zachęcamy do zgłoszenia ich naszym zespołom. Dziękujemy za odpowiedzialne tworzenie aplikacji. Z niecierpliwością czekamy na Twoje kolejne projekty w Google Play.
-
Wiadomości o usługachNa początku tego roku potwierdziliśmy nasze zaangażowanie w zapewnianie bezpieczeństwa Androida i Google Play wszystkim użytkownikom oraz w utrzymywanie środowiska, w którym użytkownicy mogą ufać pobieranym aplikacjom, a Twoja firma może się rozwijać.
Matthew Forsythe, Ron Aquino • Czas czytania: 3 minuty -
Wiadomości o usługachZ przyjemnością ogłaszamy stabilną wersję bibliotek AndroidX Security State 1.1.0 i Security State Provider 1.0.0.
Maunik Shah, Alec Garcia, Joseph Yong • Czas czytania: 4 minuty -
Wiadomości o usługachDziś udostępniamy pierwszy zestaw zadań długoterminowych (LHT), czyli bardzo złożonych zadań, których wykonanie zajmuje inżynierowi kilka dni, a nawet tydzień. Wprowadzamy też ocenę agentów, zaczynając od agentów od odpowiednich dostawców modeli.
Matthew McCullough • Czas czytania: 3 minuty
Otrzymuj co tydzień najnowsze informacje o tworzeniu aplikacji na Androida na swoją skrzynkę odbiorczą.