#785 · Seguridad y moderación

Clasificador de gravedad de lenguaje ofensivo

Analiza texto para localizar expresiones potencialmente ofensivas y asignar una gravedad orientativa según la cantidad y el tipo de coincidencias detectadas. El clasificador utiliza listas locales de términos y patrones comunes; no determina intención, contexto cultural ni si un contenido infringe una política concreta. Sirve como filtro preliminar para priorizar revisiones humanas, no como decisión automática de moderación.

Entrada de texto

Texto para moderación
Espacio publicitario

Cómo usar esta herramienta de texto

  1. Pega o escribe el texto en el área de entrada.
  2. Revisa el contenido y, si procede, prueba con el ejemplo incluido.
  3. Selecciona Clasificar gravedad para procesarlo.
  4. Comprueba el informe y copia o descarga el resultado que necesites.

Qué hace esta herramienta

Analiza texto para localizar expresiones potencialmente ofensivas y asignar una gravedad orientativa según la cantidad y el tipo de coincidencias detectadas. El clasificador utiliza listas locales de términos y patrones comunes; no determina intención, contexto cultural ni si un contenido infringe una política concreta. Sirve como filtro preliminar para priorizar revisiones humanas, no como decisión automática de moderación.

Busca términos ofensivos en grupos de severidad y calcula un nivel orientativo a partir de coincidencias únicas y repetidas.

El resultado es una ayuda de procesamiento local. Revisa el contexto y las políticas aplicables antes de tomar decisiones editoriales o de moderación.

Ejemplo

Entrada:

Ese comentario es estúpido. Eres un idiota y no aportas nada.

Resultado esperado: la herramienta genera un informe estructurado de acuerdo con las reglas descritas en esta página.

Casos de uso

  • Priorizar colas de moderación.
  • Revisar comentarios antes de publicarlos.
  • Detectar lenguaje que requiere una segunda revisión.

Consejos para obtener mejores resultados

  • Interpreta siempre las coincidencias en contexto.
  • No equipares una palabra aislada con una infracción.
  • Adapta las políticas a tu comunidad.
  • Escala los casos ambiguos a revisión humana.

Detalles del procesamiento

Busca términos ofensivos en grupos de severidad y calcula un nivel orientativo a partir de coincidencias únicas y repetidas. Todo el procesamiento se realiza localmente en el navegador y no requiere una API externa.

Los patrones automáticos no comprenden por completo intención, contexto cultural, ironía ni todas las variantes lingüísticas. Usa el resultado como apoyo y no como única fuente de decisión.

Preguntas frecuentes

¿Cómo se mide la gravedad del lenguaje ofensivo en este clasificador?

Se combinan el número de coincidencias y una clasificación local de ciertos términos. El resultado es orientativo y no sustituye las reglas específicas de una plataforma o comunidad.

¿Puede detectar insultos aunque estén usados como broma entre amigos?

Puede detectar las palabras, pero no interpretar con fiabilidad la relación entre hablantes, el tono o la intención. Ese contexto debe revisarse manualmente.

¿Qué significa que el resultado sea “Sin coincidencias”?

Solo significa que no se encontraron términos de la lista local. No garantiza que el texto sea respetuoso ni que esté libre de lenguaje abusivo.

¿Sirve para moderar automáticamente comentarios públicos?

No se recomienda usarlo como única decisión automática. Es más apropiado como filtro preliminar para priorizar contenido que requiere revisión humana.

¿El texto analizado se envía a servicios externos?

No. La comprobación se ejecuta localmente en el navegador con patrones incluidos en la página.

Resumen de módulos

MóduloDetalle
CoberturaLista local de expresiones
UsoPriorización, no decisión final