Extractor de nombres propios
Extrae nombres, lugares y marcas de un bloque de texto.
Extractor de nombres propios
Copia un artículo, transcripción o conjunto de notas y esta herramienta extrae las palabras que probablemente sean nombres, lugares o menciones de marcas: palabras capitalizadas que no están simplemente al inicio de una oración. Es una forma rápida de ver quién y qué trata realmente un texto, sin leerlo línea por línea.
Por defecto, una letra mayúscula solo cuenta cuando aparece en medio de una oración, ya que una palabra al inicio de una oración está capitalizada independientemente de lo que sea. Activa «Incluir palabras al inicio de oraciones» para ampliar la búsqueda cuando prefieras recolectar de más que de menos. «Fusionar palabras capitalizadas adyacentes» une ejecuciones como "New York" o "Golden Gate Bridge" en una sola entidad en lugar de dividirlas en palabras separadas, e «Ignorar palabras comunes» elimina elementos capitalizados frecuentes: pronombres, saludos, nombres de días y meses, que rara vez son el nombre que realmente buscas. Ordena los resultados por frecuencia para ver qué se menciona más, o alfabéticamente para escanear una lista de referencia limpia, y elige salida en lista simple o CSV según dónde vaya el resultado a continuación.
La herramienta reconoce abreviaturas comunes como "Dr.", "Sr." y "San" para que la palabra posterior no se trate erróneamente como el inicio de una nueva oración y se omita. Maneja saltos de línea de Windows y Unix de la misma manera, gestiona entradas muy largas sin ralentizarse, y el conteo bajo la salida informa cuántas entidades distintas se encontraron y cuántas veces ocurrieron en total.
Todo se ejecuta localmente en tu navegador: el texto que pegas nunca se carga ni se envía a ningún lado. Cuando termines, copia el resultado, descárgalo como archivo .txt, o envía la salida directamente de vuelta a la entrada para refinarla aún más.