Egennamnsextraktor
Extrahera troliga namn, platser och märkesnamn från en textblock.
Egennamnsextraktor
Klistra in en artikel, transkription eller anteckningar och det här verktyget hämtar de ord som sannolikt är namn, platser eller märkesnämnanden: kapitaliserade ord som inte bara står i början av en mening. Det är ett snabbt sätt att se vem och vad en text faktiskt handlar om, utan att läsa det rad för rad.
Standard räknas en stor bokstav bara när den förekommer mitt i meningen, eftersom ett ord i början av en mening är kapitaliserat oavsett vad det är. Slå på "Inkludera meningsstartsord" för att utöka nätet när du hellre samlar in allt än missar något. "Sammanfoga angränsande stora bokstäver" förenas som "New York" eller "Golden Gate Bridge" till en enda enhet istället för att dela dem i separata ord, och "Ignorera vanliga ord" tar bort ofta kapitaliserade poster – pronomen, hälsningar, veckodags- och månadsnamn – som sällan är det namn du letar efter. Sortera resultaten efter frekvens för att se vad som nämns mest, eller alfabetiskt för att skanna en ren referenslista, och välj vanlig lista eller CSV-utgång beroende på var resultatet går härnäst.
Verktyget känner igen vanliga förkortningar som "Dr.", "Mr." och "St." så ordet direkt efter tas inte av misstag för början av en ny mening och hoppas över. Det hanterar Windows- och Unix-radbrytningar på samma sätt, klarar mycket lång inmatning utan att sakta ner, och summeringen under utgången rapporterar hur många distinkta enheter som hittades och hur många gånger de förekom totalt.
Allt körs lokalt i din webbläsare – texten du klistrar in skickas aldrig nånstans. När du är klar kopierar du resultatet, laddar ner det som en .txt-fil, eller skickar utgången direkt tillbaka till inmatningen för att förfina det ytterligare.