La moderación con IA usa un modelo de IA (OpenAI Moderation) para revisar las publicaciones y, si quieres, las respuestas cuando se crean o se editan. Puntúa el contenido en categorías como acoso, odio y violencia, y puede ocultar o marcar el contenido que supera tus umbrales. Funciona junto con tus reglas de palabras clave y de filtro de spam, no en su lugar.
Quién puede hacerlo: los propietarios y administradores activan y configuran la moderación con IA. Los moderadores pueden ver Actividad de IA y revisar el contenido retenido. · Dónde: web, en la consola de administración. · Plan: disponible en todos los planes de la plataforma. La moderación con IA no consume el cupo de IA de tu plan.
Activar la moderación con IA
- Ve a Admin → Configuración → Seguridad del contenido. La página se titula Moderación de contenido.
- En Moderación con IA, activa Activar moderación con IA.
- Haz clic en Save Changes en la parte inferior de la página.
Cuando el interruptor está desactivado, no se envía ninguna publicación a OpenAI. El contenido se envía a un servicio de terceros, así que revisa tu política de privacidad antes de activarlo. Consulta Privacidad de datos y limitaciones de la IA.
Configurar la Clasificación con IA
La configuración detallada está en Admin → Moderación → Moderación automatizada, en la sección Clasificación con IA. También puedes hacer clic en Configurar en Moderación automática en la página Seguridad del contenido. Solo los propietarios y administradores ven esta sección.
Haz clic en Configurar y define:
- Modo: Sombra o Aplicar (consulta la siguiente sección). Las comunidades nuevas empiezan en Sombra.
- Analizar: Publicaciones de nivel superior, Respuestas y comentarios o ambas. Elige al menos una. Las respuestas generan entre 5 y 20 veces más tráfico de moderación que las publicaciones de nivel superior.
- Umbrales: cuándo se bloquea o se marca el contenido, por categoría.
Haz clic en Guardar cambios. Guardar aquí no cambia el interruptor de activación de Seguridad del contenido.
Modo Sombra y modo Aplicar
| Modo | Qué ocurre |
|---|---|
| Sombra | La IA solo registra puntuaciones. No se oculta nada ni entra nada en la cola. Úsalo para ver cómo juzga la IA el contenido de tu comunidad. |
| Aplicar | El contenido que supera un umbral de Bloquear se oculta de inmediato y se envía a revisión. El contenido que supera un umbral de Marcar sigue visible y espera la decisión de un moderador. |
Cuando cambias a Aplicar, debes marcar una confirmación de que, a partir de ese momento, las publicaciones marcadas se retendrán. Revisa antes los resultados del modo sombra en Actividad de IA.
Configurar los umbrales de la moderación con IA
Cada categoría tiene un umbral de 0 a 1. Una categoría se activa cuando la puntuación del contenido es igual o superior al umbral, así que un umbral más bajo es más estricto.
- Bloquear (rechazar contenido): categorías graves, como Sexual content involving minors, Graphic violence, Self-harm instructions, Threatening hate speech y Violent wrongdoing.
- Marcar (enviar a la cola de revisión): categorías más amplias: Hate, Harassment, Sexual content, Violence, Self-harm e Illicit behavior.
Marca una categoría para usarla y configura su valor, o haz clic en Valores predeterminados recomendados. Cada nivel se guarda completo: las categorías que dejes sin marcar en un nivel dejan de activarse. Avanzado (JSON) muestra la misma configuración en JSON.
Revisar el contenido retenido por la moderación con IA
En el modo Aplicar, el contenido bloqueado y el marcado esperan en Admin → Moderación → Contenido pendiente, donde Motivo de la marca muestra IA. Apruébalo para publicarlo o recházalo para eliminarlo. El contenido bloqueado permanece oculto hasta que decidas; el contenido marcado sigue visible mientras tanto. Para saber cómo revisarlo y qué ven los autores, consulta Revisar el contenido retenido y pendiente.
Consultar las decisiones de la IA en la página Actividad de IA
Admin → Moderación → Actividad de IA muestra todas las decisiones de la moderación con IA. Es un registro, no una cola de trabajo: actuar aquí no cambia el contenido.
- Cada fila muestra el Contenido, el Autor, las Categorías, la Puntuación, el Modo, el Resultado y la Fecha. Los resultados son Bloquearía o Marcaría (modo sombra, solo registrado), Bloqueado, Marcado, No aplicado o Aprobado.
- Filtra por modo, resultado, categoría, tipo de contenido y rango de fechas.
- Haz clic en una fila para ver el modelo, los umbrales y las Puntuaciones por categoría.
- Usa Decisión correcta o Decisión incorrecta (reversión) para valorar las decisiones de la IA. Tasa de reversión muestra con qué frecuencia los moderadores no están de acuerdo.
- Por categoría muestra con qué frecuencia se activa y se revierte cada categoría. Una tasa de reversión alta significa que ese umbral es demasiado permisivo. Haz clic en Ajustar umbrales para cambiarlo.
Qué debes saber sobre la moderación con IA
- La moderación con IA revisa el título y el texto del cuerpo de las publicaciones y las respuestas, cuando se crean y cuando se editan. No revisa imágenes, archivos adjuntos ni vídeos.
- Las publicaciones y respuestas de los administradores de la comunidad y de los moderadores de espacio no se envían a la moderación con IA.
- Las reglas de palabras clave, de expresiones regulares y de filtro de spam se configuran por separado. Consulta Configurar reglas de auto-moderación.
- La moderación con IA no consume el cupo de IA de tu plan. Consulta Entender el uso y los créditos de IA.
Artículos relacionados
¿Te resultó útil esta guía?