Como detectamos violações

Nossos princípios

O Porn Works AI segue diretrizes éticas rigorosas e práticas recomendadas para garantir que as tecnologias de IA sejam usadas de forma segura, respeitosa e protetora dos direitos humanos.

Quaisquer violações de nossas Termos de Serviço será rapidamente encaminhado às autoridades policiais, quando aplicável.

O Porn Works AI usa seus próprios modelos de IA pré-treinados para detectar menores de idade, violência e outros itens proibidos pelo usuário conteúdo em qualquer imagem ou vídeo gerado, bloqueando-o imediatamente. Combinando a detecção de IA com a revisão manual humana, bloqueamos com eficácia cerca de 100% de conteúdo inadequado ou ilegal.

Várias camadas de moderação

Camada 1: Filtragem de palavras de parada

Nossa primeira linha de defesa é um amplo dicionário de palavras e frases restritas. Essa camada interrompe rapidamente as tentativas de gerar conteúdo inadequado ou prejudicial antes que ele chegue a outros estágios de processamento.

Camada 2: Analisando o conteúdo gerado

Como os modelos de geração de IA podem produzir resultados imprevisíveis, mesmo a partir de prompts seguros, não podemos confiar apenas na entrada de texto. Para resolver esse problema, usamos vários modelos de visão e linguagem (VLMs) para analisar as imagens e os vídeos finais reais. Esses modelos proporcionam uma compreensão mais profunda do conteúdo e nos ajudam a detectar violações que, de outra forma, passariam pelos filtros em nível de prompt.

Camada 3: Revisão humana

Por fim, nossa equipe de moderação realiza verificações manuais no conteúdo sinalizado. Para apoiar seu trabalho, fornecemos painéis especiais que permitem analisar o comportamento do usuário, os níveis de confiança e os padrões de atividade. Isso permite que os moderadores tomem decisões informadas, apliquem contexto quando necessário e detectem abusos com mais eficiência. O julgamento humano continua sendo essencial para casos extremos em que é necessário haver nuances ou sensibilidade cultural.