#341 · Extractores

Extractor de palabras con mayúscula inicial

Extrae del texto las palabras que comienzan con una letra mayúscula y obtén una lista limpia para revisar nombres propios, encabezados o términos destacados. Puedes decidir si quieres incluir palabras escritas completamente en mayúsculas, como siglas. El procesamiento se realiza en el navegador y conserva caracteres acentuados y letras Unicode habituales.

Entrada de texto

Procesamiento local en el navegador
Espacio publicitario

Cómo usar esta herramienta de texto

  1. Pega o escribe el texto que quieres analizar.
  2. Elige si deben incluirse siglas y si quieres eliminar repeticiones.
  3. Pulsa «Extraer palabras».
  4. Copia o descarga la lista resultante.

Qué hace esta herramienta

Identifica tokens de palabra cuyo primer carácter alfabético es una mayúscula Unicode. Es útil como primera revisión de nombres propios, entidades y términos destacados.

Se tokeniza el texto por letras Unicode, se filtran las palabras que empiezan por mayúscula y, opcionalmente, se excluyen siglas o se eliminan duplicados sin distinguir mayúsculas de minúsculas.

Una palabra al inicio de una oración también puede aparecer aunque no sea un nombre propio; la herramienta no realiza análisis semántico.

Ejemplo

Con «Madrid y UNESCO visitan Sevilla», el resultado puede ser «Madrid», «UNESCO» y «Sevilla» si las siglas están incluidas.

Casos de uso

  • Revisar nombres propios en borradores.
  • Localizar entidades antes de una normalización editorial.
  • Extraer términos capitalizados de notas o transcripciones.
  • Comprobar siglas presentes en un documento.

Consejos para obtener mejores resultados

  • Revisa el texto de origen antes de copiar el resultado a un documento definitivo.
  • Prueba con un fragmento pequeño si el texto contiene formatos o símbolos poco habituales.
  • Usa opciones de sensibilidad a mayúsculas solo cuando la distinción sea relevante.
  • Conserva una copia del texto original cuando vayas a aplicar el resultado en bloque.

Detalles del procesamiento

La detección usa propiedades Unicode para reconocer letras mayúsculas y admite palabras con acentos, guiones y apóstrofos comunes.

No decide si una coincidencia es realmente un nombre propio ni interpreta reglas de capitalización específicas de cada estilo editorial.

Preguntas frecuentes

¿Cómo extraer nombres propios de un texto sin perder letras acentuadas?

La herramienta reconoce letras Unicode, por lo que palabras como «Álvaro» o «Écija» pueden detectarse correctamente cuando empiezan por mayúscula.

¿Puedo excluir siglas como ONU o SEO del resultado?

Sí. Desactiva la opción de incluir palabras totalmente en mayúsculas para dejar fuera muchas siglas y abreviaturas de ese tipo.

¿Por qué aparecen palabras normales que están al inicio de una frase?

Porque la detección se basa en la forma escrita. Una palabra inicial con mayúscula cumple el patrón aunque no sea un nombre propio.

¿La extracción distingue entre Madrid y MADRID?

La opción de siglas controla palabras completamente en mayúsculas. Si activas «mostrar cada palabra solo una vez», las variantes se deduplican sin distinguir el uso de mayúsculas.

¿Se envía el texto a un servidor para detectar las mayúsculas?

No. El análisis se ejecuta en el navegador con JavaScript y no requiere una API externa.

Resumen del módulo

ElementoDetalle
CategoríaExtractores
ProcesamientoLocal en el navegador
SalidaTexto, TXT, CSV o JSON según el resultado
PrivacidadSin API externa para el procesamiento

Explora más herramientas de Extractores

Encuentra más utilidades de esta categoría para trabajar con texto directamente en el navegador.

Ver categoría: Extractores