Ein zentrales Ziel der text extraction ist die Identifizierung und Klassifizierung von Entitäten, Beziehungen und Ereignissen in Texten. Dazu werden verschiedene Ansätze wie maschinelles Lernen, natürliche Sprachverarbeitung und Datenmining eingesetzt. Die text extraction hat zahlreiche Anwendungsfelder, wie zum Beispiel die Informationsbeschaffung, die Textsummarisierung und die Sentiment-Analyse. Du findest wissenschaftliche Arbeiten zu text extraction als PDF und eBook, viele auch als Print-on-Demand, bei GRIN.