Extractor de substantive proprii
Extrage nume, locații și mărci probabile dintr-un bloc de text.
Extractor de substantive proprii
Lipiți un articol, transcripție sau set de note și acest instrument extrage cuvintele care sunt probabil nume, locații sau mențiuni de marcă: cuvinte capitalizate care nu stau pur și simplu la începutul unei fraze. Este o modalitate rapidă de a vedea cine și ce tratează de fapt un text, fără a-l citi linie cu linie.
În mod implicit, o literă mare contează doar atunci când apare în mijlocul unei fraze, deoarece un cuvânt de la începutul unei fraze este capitalizat indiferent de ce este. Activați "Includeți cuvintele de la începutul frazelor" pentru a extinde rețeaua atunci când preferați să colectați prea mult decât să pierdeți ceva. "Uniți cuvintele capitalizate adiacente" unește secvențe precum "New York" sau "Golden Gate Bridge" într-o singură entitate în loc să le împarțiți în cuvinte separate, iar "Ignora cuvintele comune" elimină articole capitalizate frecvente — pronume, salutări, numele zilelor săptămânii și lunilor — care sunt rar numele pe care îl căutați. Sortați rezultatele după frecvență pentru a vedea ce este menționat cel mai mult, sau alfabetic pentru a examina o listă de referință curată, și alegeți format de listă simplu sau CSV în funcție de destinația rezultatului.
Instrumentul recunoaște abrevieri comune cum ar fi "Dr.", "Mr." și "St." pentru ca cuvântul din urmă să nu fie tratat greșit ca start al unei noi fraze și omis. Gestionează întreruperile de linie Windows și Unix în același mod, face față intrării foarte lungi fără a încetini, iar numărătoarea de sub ieșire raportează câte entități distincte au fost găsite și de câte ori au apărut în total.
Tot se execută local în browserul dvs. — textul pe care îl lipiți nu este niciodată încărcat sau trimis nicăieri. Când terminați, copiați rezultatul, descărcați-l ca fișier .txt sau trimiteți ieșirea înapoi la intrare pentru a o rafina în continuare.