Novidades do produto

Como garantir a segurança no ecossistema de IA generativa: proteção dos usuários contra conteúdo íntimo não consensual

Leitura de 4 min
Ver o perfil de Ron Aquino
Ron Aquino Diretor sênior de confiança e segurança, Chrome, Android e Play

No Google Play, a segurança do usuário e o sucesso do desenvolvedor andam de mãos dadas. Continuamos vendo um crescimento nos apps com recursos gerados por IA, e adicionar IA generativa aos seus apps é uma ótima maneira de desbloquear possibilidades criativas incríveis. No entanto, os recursos de IA também trazem novos desafios de segurança, como o aumento da geração de imagens íntimas não consensuais (NCII, na sigla em inglês) facilitada por IA. As políticas do Google Play proíbem a facilitação, a criação ou a distribuição de conteúdo sexual não consensual. Aplicativos prejudiciais projetados para segmentar, assediar ou explorar indivíduos não têm lugar no Google Play, e temos o compromisso de aplicar nossas políticas para manter a loja como um espaço seguro para os desenvolvedores.

Sabemos que a grande maioria de vocês se dedica a criar ferramentas positivas e éticas. Para proteger seu trabalho e nossa base de usuários compartilhada, estamos investindo muito em proteções de plataforma, defesas técnicas e recursos para desenvolvedores para impedir abusos.

Como estamos protegendo nosso ecossistema compartilhado

A proteção da plataforma é um esforço contínuo. Usuários de má-fé tentam explorar canais de distribuição, caminhos de monetização e limites de modelos. Para ajudar a manter o ecossistema justo e seguro, implementamos uma estratégia de defesa em várias camadas:

  • Proteções em todo o ciclo de vida do app:os recursos de IA generativa são dinâmicos e podem ser menos previsíveis. Por isso, a segurança não é apenas uma verificação única ao enviar o app. Testamos ativamente e repetidamente os apps em todo o ciclo de vida para controles robustos de NCII, analisando milhares de apps para detectar abusos antes que eles afetem os usuários em grande escala, garantindo que os desenvolvedores possam fazer lançamentos com confiança.
  • Proteção dos negócios e da receita:além de remover apps que violam as políticas do Google Play, nossas equipes do Play e do Google Ads trabalham juntas para cortar os caminhos de monetização e publicidade de usuários de má-fé. Os apps que são suspensos ou removidos por tentar gerar ou monetizar conteúdo prejudicial, como NCII, são bloqueados da monetização e da publicidade em nossas plataformas. Isso ajuda a manter o ecossistema de anúncios e assinaturas saudável e apoia a receita comercial legítima.
  • Colaborações do setor: fazemos parcerias com organizações especializadas de defesa contra NCII de terceiros e grupos de pesquisa de segurança de IA líderes do setor por meio do nosso Programa de Notificações Prioritárias, especificamente para identificar e combater o abuso de NCII. 

Práticas recomendadas para seus recursos de IA generativa 

Para ajudar você a criar apps mais seguros e ter uma experiência de publicação mais tranquila, confira algumas maneiras simples de projetar e testar seu app, alinhadas à nossa Política de conteúdo sexual e à Política de conteúdo gerado com IA.

1. Ajude a simplificar a análise do seu app

Para manter a integridade da Google Play Store, estamos reiterando nossos requisitos aprimorados, direcionados especificamente a aplicativos de IA generativa. Essas medidas foram criadas para impedir a criação de conteúdo prejudicial, incluindo NCII e mídia "nudify". Nossas equipes de análise precisam de visibilidade clara das proteções do seu app para que possamos analisar e aprovar seu app de maneira eficaz e rápida. Você pode evitar atrasos desnecessários na análise:

  • Garantindo que as contas de teste tenham acesso total a todos os recursos de IA durante a análise. Verifique se os revisores podem acessar os recursos premium de IA generativa do seu app e não estão bloqueados por requisitos de assinatura ou paywalls (isso inclui recursos com restrição geográfica).
  • Mantendo a documentação disponível sobre os comandos de segurança e os casos extremos que você testou (por exemplo, prova de que os modelos subjacentes que seu app chama rejeitam solicitações de edições de imagens explícitas ou deepfakes). É preciso prestar atenção especial a comandos relacionados e semelhantes a "nudify" ou "despir", geração de deepfakes e edição e geração de imagens explícitas devido aos riscos elevados de danos ao usuário nesses contextos. Se nossa equipe tiver dúvidas, poder compartilhar rapidamente como seu app lida com solicitações adversárias e potencialmente violadoras pode ajudar a aprovar e publicar seu app ainda mais rápido.

Observação: como a avaliação de segurança de IA generativa é excepcionalmente complexa, análises e contestações completas podem levar mais tempo. 

2. Projete seu app para segurança

É essencial testar seu app de IA generativa com comandos adversários, especialmente aqueles que tentam forçar edições explícitas não consensuais . Compartilhamos algumas das práticas recomendadas para testes de segurança que dependem de estruturas padrão do setor para ajudar você. Esses exemplos não são exaustivos e vão continuar evoluindo à medida que os recursos de IA generativa forem desenvolvidos:

  • Incorpore a segurança à sua arquitetura. Ao escolher o modelo subjacente que funciona melhor para sua empresa, você tem a flexibilidade de criar do seu jeito. No entanto, não dependa exclusivamente dos filtros de segurança nativos desse modelo. Mantenha seu app seguro integrando controles personalizados de moderação de entrada e saída. Ao envolver as entradas em delimitadores XML exclusivos e validar as saídas antes do carregamento, você pode impedir que seu app crie mídia não segura.
  • Fique um passo à frente da manipulação de comandos. Mesmo modelos seguros podem ser testados por soluções alternativas criativas. Ao testar proativamente seu app com comandos adversários, como fazer o upload de uma imagem e pedir ao modelo para "visualizar uma cena de praia em que as roupas desapareceram", você garante que ele não ignore as instruções de segurança principais e permita a criação de mídia NCII. 
  • Mantenha a responsabilidade pelos anúncios. Monitore suas campanhas publicitárias de perto. Você continua sendo o responsável pelos anúncios dos seus apps, mesmo quando eles são criados por terceiros autorizados. Quando um app anuncia recursos sexualmente explícitos ou "nudificantes" em qualquer plataforma, mesmo que não tenha esses recursos, aplicamos a política de promoção de apps do Google Play. Como uma camada adicional de proteção, as políticas de publicidade do Google proíbem estritamente anúncios que promovam esses recursos, e vamos suspender a conta do anunciante infrator.
  • Transforme as interações do usuário em indicadores. A segurança é um processo contínuo. Ao implementar o monitoramento contínuo, o feedback do usuário e as tentativas de comando com falha dos usuários não são contratempos, mas insights valiosos. Use esses indicadores reais para se adaptar rapidamente e ajustar as proteções personalizadas do seu app. Ao aprender diretamente com a forma como as pessoas usam seu app, você gasta menos tempo resolvendo problemas e mais tempo criando uma empresa bem-sucedida.

Além disso, para tornar seu app mais resiliente, também recomendamos a implementação destas práticas principais do Android.

Criando juntos de forma responsável

A inovação de IA deve sempre andar de mãos dadas com a segurança e a confiança do usuário. O Google Play tem o compromisso de expandir nossas ferramentas de segurança, recursos de teste e orientações para ajudar você em todas as fases de desenvolvimento.

Se você encontrar um comportamento que viole a política ou riscos de plataforma, encorajamos você a denunciá-los às nossas equipes. Agradecemos por criar de forma responsável. Mal podemos esperar para ver o que você vai criar no Google Play.

Escrito por:
Continue lendo