{"id":{"repo_id":"stuttgart","oai_identifier":"oai:elib.uni-stuttgart.de:11682/9916"},"canonical_url":"https://search.dev.ndltd.org/etd/stuttgart/oai:elib.uni-stuttgart.de:11682/9916","repository":{"repo_id":"stuttgart","name":"Universität Stuttgart","base_url":"http://elib.uni-stuttgart.de/oai/request"},"display":{"title":"Erschließen von Freitextfeldern mittels Text Mining und die Qualität der gewonnenen Informationen","abstract":"Vermehrt fallen innerhalb von Firmen neben den einfach auszuwertenden strukturierten Daten, auch unstrukturierte Daten in Form von Freitexten an. In dieser Ausarbeitung werden Techniken zur Strukturierung von Freitexten sowie verwandte Arbeiten und Vor- und Nachteile der Nutzung von Freitexten vorgestellt. Der Fokus liegt auf der Repräsentation der Daten als Vektoren und der Filterung von Stoppwörtern. Außerdem wird ein Prototyp zum Clustern von Freitextfeldern vorgestellt und auf einen Datensatz der NHTSA angewendet. Durch die Anwendung des Prototyps auf den NHTSA-Datensatz wird geklärt, inwiefern dieser Informationen in den Freitextfelder enthält, die nicht in den strukturierten Daten enthalten sind. Und ob das Clustering zu vollständigeren Informationen, das heißt zur erhöhter Datenqualität führt. Die Beantwortung geschieht durch Datenanalysen auf den vom Prototyp erweiterten Datensatz. Eine zusätzliche Anwendung und Auswertung des Prototyps, findet auf einen Datensatz aus der Industrie statt.","abstract_html":"Vermehrt fallen innerhalb von Firmen neben den einfach auszuwertenden strukturierten Daten, auch unstrukturierte Daten in Form von Freitexten an. In dieser Ausarbeitung werden Techniken zur Strukturierung von Freitexten sowie verwandte Arbeiten und Vor- und Nachteile der Nutzung von Freitexten vorgestellt. Der Fokus liegt auf der Repräsentation der Daten als Vektoren und der Filterung von Stoppwörtern. Außerdem wird ein Prototyp zum Clustern von Freitextfeldern vorgestellt und auf einen Datensatz der NHTSA angewendet. Durch die Anwendung des Prototyps auf den NHTSA-Datensatz wird geklärt, inwiefern dieser Informationen in den Freitextfelder enthält, die nicht in den strukturierten Daten enthalten sind. Und ob das Clustering zu vollständigeren Informationen, das heißt zur erhöhter Datenqualität führt. Die Beantwortung geschieht durch Datenanalysen auf den vom Prototyp erweiterten Datensatz. Eine zusätzliche Anwendung und Auswertung des Prototyps, findet auf einen Datensatz aus der Industrie statt.","abstract_has_math":false,"creators":["Link, Marco"],"institution":null,"degree_name":null,"degree_level":null,"degree_discipline":null,"degree_department":null,"school":null,"contributors":[],"advisors":[],"committee_chairs":[],"committee_members":[],"year":2017,"date_issued":"2017","date_published":"2017","updated_at":"2026-07-27T21:10:08Z","subjects":[],"languages":["de"],"rights":["info:eu-repo/semantics/openAccess"],"rights_urls":[],"identifier_entries":[{"key":"dc:identifier.uri","label":"Identifier URI","values":["http://elib.uni-stuttgart.de/handle/11682/9916","http://dx.doi.org/10.18419/opus-9899"],"render_values":[{"text":"http://elib.uni-stuttgart.de/handle/11682/9916","href":"http://elib.uni-stuttgart.de/handle/11682/9916","code":true},{"text":"http://dx.doi.org/10.18419/opus-9899","href":"http://dx.doi.org/10.18419/opus-9899","code":true}]},{"key":"dc:identifier.other","label":"Dc Identifier Other","values":["510079857"],"render_values":[{"text":"510079857","href":null,"code":true}]}]},"links":{"outbound_url":"http://nbn-resolving.de/urn:nbn:de:bsz:93-opus-ds-99160","outbound_label":"Repository record","outbound_source":"dc:identifier.uri"},"metadata_groups":[{"id":"people","label":"People","entries":[{"key":"dc:creator","label":"Author","values":["Link, Marco"]}]},{"id":"academic_context","label":"Academic Context","entries":[{"key":"dc:date.accessioned","label":"Dc Date Accessioned","values":["2018-07-09T11:53:46Z"]},{"key":"dc:date.available","label":"Dc Date Available","values":["2018-07-09T11:53:46Z"]},{"key":"dc:date.issued","label":"Date","values":["2017"]},{"key":"dc:type","label":"Dc Type","values":["bachelorThesis"]}]},{"id":"language_rights","label":"Language and Rights","entries":[{"key":"dc:language.iso","label":"Language (ISO)","values":["de"]},{"key":"dc:rights","label":"Dc Rights","values":["info:eu-repo/semantics/openAccess"]}]},{"id":"identifiers","label":"Identifiers","entries":[{"key":"dc:identifier.other","label":"Dc Identifier Other","values":["510079857"]},{"key":"dc:identifier.uri","label":"Identifier URI","values":["http://nbn-resolving.de/urn:nbn:de:bsz:93-opus-ds-99160","http://elib.uni-stuttgart.de/handle/11682/9916","http://dx.doi.org/10.18419/opus-9899"]}]},{"id":"additional","label":"Additional Metadata","entries":[{"key":"dc:description.abstract","label":"Abstract","values":["Vermehrt fallen innerhalb von Firmen neben den einfach auszuwertenden strukturierten Daten, auch unstrukturierte Daten in Form von Freitexten an. In dieser Ausarbeitung werden Techniken zur Strukturierung von Freitexten sowie verwandte Arbeiten und Vor- und Nachteile der Nutzung von Freitexten vorgestellt. Der Fokus liegt auf der Repräsentation der Daten als Vektoren und der Filterung von Stoppwörtern. Außerdem wird ein Prototyp zum Clustern von Freitextfeldern vorgestellt und auf einen Datensatz der NHTSA angewendet. Durch die Anwendung des Prototyps auf den NHTSA-Datensatz wird geklärt, inwiefern dieser Informationen in den Freitextfelder enthält, die nicht in den strukturierten Daten enthalten sind. Und ob das Clustering zu vollständigeren Informationen, das heißt zur erhöhter Datenqualität führt. Die Beantwortung geschieht durch Datenanalysen auf den vom Prototyp erweiterten Datensatz. Eine zusätzliche Anwendung und Auswertung des Prototyps, findet auf einen Datensatz aus der Industrie statt."]},{"key":"dc:title","label":"Title","values":["Erschließen von Freitextfeldern mittels Text Mining und die Qualität der gewonnenen Informationen"]}]}],"canonical_facts":{"dc:creator":["Link, Marco"],"dc:date.accessioned":["2018-07-09T11:53:46Z"],"dc:date.available":["2018-07-09T11:53:46Z"],"dc:date.issued":["2017"],"dc:description.abstract":["Vermehrt fallen innerhalb von Firmen neben den einfach auszuwertenden strukturierten Daten, auch unstrukturierte Daten in Form von Freitexten an. In dieser Ausarbeitung werden Techniken zur Strukturierung von Freitexten sowie verwandte Arbeiten und Vor- und Nachteile der Nutzung von Freitexten vorgestellt. Der Fokus liegt auf der Repräsentation der Daten als Vektoren und der Filterung von Stoppwörtern. Außerdem wird ein Prototyp zum Clustern von Freitextfeldern vorgestellt und auf einen Datensatz der NHTSA angewendet. Durch die Anwendung des Prototyps auf den NHTSA-Datensatz wird geklärt, inwiefern dieser Informationen in den Freitextfelder enthält, die nicht in den strukturierten Daten enthalten sind. Und ob das Clustering zu vollständigeren Informationen, das heißt zur erhöhter Datenqualität führt. Die Beantwortung geschieht durch Datenanalysen auf den vom Prototyp erweiterten Datensatz. Eine zusätzliche Anwendung und Auswertung des Prototyps, findet auf einen Datensatz aus der Industrie statt."],"dc:identifier.other":["510079857"],"dc:identifier.uri":["http://nbn-resolving.de/urn:nbn:de:bsz:93-opus-ds-99160","http://elib.uni-stuttgart.de/handle/11682/9916","http://dx.doi.org/10.18419/opus-9899"],"dc:language.iso":["de"],"dc:rights":["info:eu-repo/semantics/openAccess"],"dc:title":["Erschließen von Freitextfeldern mittels Text Mining und die Qualität der gewonnenen Informationen"],"dc:type":["bachelorThesis"]},"updated_at":"2026-07-27T21:10:08Z"}