| Klassifikationsmerkmal |
Eine Ressource, die für die Erkennung und Kategorisierung von Dokumenttypen in einer Sammlung trainiert wird Siehe auch Textklassifikationsmerkmal und Dokumentklassifikationsmerkmal. Weitere Informationen |
| Dokumentklassifikationsmerkmal |
Ein Klassifikationsmerkmal, das Dokumente auf der Basis von Wörtern und Ausdrücken kategorisiert, die aus den Textfeldern des Hauptteils extrahiert werden, mit Informationen aus Aufbereitungen, die auf den Haupttext angewendet werden, der
berücksichtigt wird. |
| Datenquelle |
Die Datenquelle selbst, z. B. eine Datenbank oder XML-Datei, und die erforderlichen Verbindungsinformationen für den Zugriff auf die Daten. Weitere Informationen. |
| Domänenspezifisch |
Bezieht sich auf Begriffe und Konzepte, die eine besondere Bedeutung für eine Branche oder ein Unternehmen haben. Im Tennis hat beispielsweise der Begriff Liebe eine besondere Bedeutung. |
| Aufbereitung |
Die Erweiterung von Daten durch das Hinzufügen relevanter Kontexte zu Dokumenten. Beispiel: Tagging-Begriffe, die Stadtnamen oder berühmte Personen als Orte oder Personen von Interesse erwähnen. |
| Facette |
Eine Kategorie, die zum Filtern von Suchergebnissen verwendet wird. Weitere Informationen |
| Regulärer Ausdruck |
Eine Gruppe von Zeichen, Metazeichen und Operatoren, |
| die eine Zeichenfolge oder Zeichenfolgengruppe in einem |
|
| Suchbegriff definieren. Weitere Informationen. |
|
| Stoppwort |
A word that is commonly used, such as the, an, or and, that is ignored by a search application. Weitere Informationen. |
| Textklassifikationsmerkmal |
Ein Klassifikationsmerkmal, das Dokumente auf der Basis von Wörtern und Ausdrücken kategorisiert, die aus dem Haupttext extrahiert werden. |