A moderação por IA usa um modelo de IA (OpenAI Moderation) para verificar as publicações e, se você quiser, as respostas quando são criadas ou editadas. Ela atribui pontuações ao conteúdo em categorias como assédio, ódio e violência, e pode ocultar ou sinalizar o conteúdo que ultrapassa os seus limites. Ela funciona junto com as suas regras de palavra-chave e de filtro de spam, não no lugar delas.
Quem pode fazer isso: proprietários e administradores ativam e configuram a moderação por IA. Os moderadores podem ver a Atividade de IA e analisar o conteúdo retido. · Onde: web, no console de administração. · Plano: disponível em todos os planos da plataforma. A moderação por IA não consome a cota de IA do seu plano.
Ativar a moderação por IA
- Acesse Admin → Configurações → Segurança de conteúdo. O título da página é Moderação de Conteúdo.
- Em Moderação por IA, ative Ativar moderação por IA.
- Clique em Save Changes na parte inferior da página.
Quando a chave está desativada, nenhuma publicação é enviada à OpenAI. O conteúdo é enviado a um serviço de terceiros, então revise sua política de privacidade antes de ativá-la. Veja Privacidade de dados e limitações da IA.
Configurar a Classificação por IA
As configurações detalhadas ficam em Admin → Moderação → Moderação Automatizada, na seção Classificação por IA. Você também pode clicar em Configurar em Moderação Automatizada na página Segurança de conteúdo. Só proprietários e administradores veem esta seção.
Clique em Configurar e defina:
- Modo: Sombra ou Aplicar (veja a próxima seção). As comunidades novas começam em Sombra.
- Verificar: Publicações de nível raiz, Respostas e comentários ou os dois. Escolha pelo menos um. As respostas geram de 5 a 20× o tráfego de moderação das publicações principais.
- Limites: quando o conteúdo é bloqueado ou sinalizado, por categoria.
Clique em Salvar alterações. Salvar aqui não altera a chave de ativação em Segurança de conteúdo.
Modo Sombra e modo Aplicar
| Modo | O que acontece |
|---|---|
| Sombra | A IA só registra as pontuações. Nada é ocultado e nada entra na fila. Use-o para ver como a IA avalia o conteúdo da sua comunidade. |
| Aplicar | O conteúdo acima de um limite Bloquear é ocultado imediatamente e enviado para revisão. O conteúdo acima de um limite Sinalizar continua visível e aguarda a decisão de um moderador. |
Ao mudar para Aplicar, você precisa marcar uma confirmação de que as publicações sinalizadas passarão a ser retidas a partir de agora. Revise antes os resultados do modo sombra em Atividade de IA.
Definir os limites da moderação por IA
Cada categoria tem um limite de 0 a 1. Uma categoria é acionada quando a pontuação do conteúdo é igual ou maior que o limite, então um limite menor é mais rigoroso.
- Bloquear (recusar conteúdo): categorias graves, como Sexual content involving minors, Graphic violence, Self-harm instructions, Threatening hate speech e Violent wrongdoing.
- Sinalizar (enviar para fila de revisão): categorias mais amplas: Hate, Harassment, Sexual content, Violence, Self-harm e Illicit behavior.
Marque uma categoria para usá-la e defina o valor dela, ou clique em Padrões recomendados. Cada nível é salvo por inteiro: as categorias que você deixar desmarcadas em um nível deixam de ser acionadas. Avançado (JSON) mostra as mesmas configurações em JSON.
Analisar o conteúdo retido pela moderação por IA
No modo Aplicar, o conteúdo bloqueado e o sinalizado aguardam em Admin → Moderação → Conteúdo Pendente, onde Motivo da sinalização mostra IA. Aprove-o para publicá-lo ou rejeite-o para removê-lo. O conteúdo bloqueado fica oculto até você decidir; o conteúdo sinalizado continua visível enquanto isso. Para saber como analisá-lo e o que os autores veem, veja Analisar conteúdo retido e pendente.
Conferir as decisões da IA na página Atividade de IA
Admin → Moderação → Atividade de IA lista todas as decisões da moderação por IA. É um registro, não uma fila de trabalho: agir aqui não altera o conteúdo.
- Cada linha mostra o Conteúdo, o Autor, as Categorias, a Pontuação, o Modo, o Resultado e a Data. Os resultados são Bloquearia ou Sinalizaria (modo sombra, apenas registrado), Bloqueado, Sinalizado, Não aplicado ou Aprovado.
- Filtre por modo, resultado, categoria, tipo de conteúdo e período.
- Clique em uma linha para ver o modelo, os limites e as Pontuações por categoria.
- Use Decisão correta ou Decisão errada (revertida) para avaliar as decisões da IA. Taxa de reversão mostra com que frequência os moderadores discordam.
- Por categoria mostra com que frequência cada categoria é acionada e revertida. Uma taxa de reversão alta significa que o limite está frouxo demais. Clique em Ajustar limites para alterá-lo.
O que saber sobre a moderação por IA
- A moderação por IA verifica o título e o texto do corpo das publicações e respostas, quando são criadas e quando são editadas. Ela não verifica imagens, anexos nem vídeos.
- As publicações e respostas dos administradores da comunidade e dos moderadores do espaço não são enviadas à moderação por IA.
- As regras de palavra-chave, regex e filtro de spam são configuradas separadamente. Veja Configurar regras de moderação automática.
- A moderação por IA não consome a cota de IA do seu plano. Veja Entender o uso e os créditos de IA.
Artigos relacionados
Este guia foi útil?