✍️ 🧑‍🦱 💚 Autor:innen verdienen bei uns doppelt. Dank euch haben sie so schon 462.732 € mehr verdient. → Mehr erfahren 💪 📚 🙏

Population der Daten im Schema der extrahierten Webtabelle

Population der Daten im Schema der extrahierten Webtabelle

von Kamran Shaukat, Nayyer Masood und Sundas Mehreen Fatima Haider
Softcover - 9786207667543
35,90 €
  • Versandkostenfrei
Auf meine Merkliste
  • Hinweis: Print on Demand. Lieferbar in 2 Tagen.
  • Lieferzeit nach Versand: ca. 1-2 Tage
  • inkl. MwSt. & Versandkosten (innerhalb Deutschlands)

Autorenfreundlich Bücher kaufen?!

Beschreibung

Tabellarische Daten sind eine bestehende Informationsquelle im Internet. Wir haben mit der Sammlung von HTML-Tabellen aus dem Internet begonnen. Zunächst werden Tabellen guter Qualität identifiziert, dann wird ein Schema-Matching durchgeführt. Beim Schema-Matching wird die Anzahl der Übereinstimmungen ermittelt, die die ähnlichen Elemente aus zwei verschiedenen Schemata bestimmen. Die Spalten und Datenwerte werden nacheinander verglichen, um das Schema abzugleichen. Bei der Suche nach tabellarischen Daten im Web kann die Suchmaschine eine URL anstelle von tabellarischen Daten zurückgeben, was das Hauptproblem ist. Wir arbeiten also an diesem Problem, indem wir Daten von tabellarischen Webseiten extrahieren und ihr Schema extrahieren und dann einen Schemaabgleich durchführen, indem wir die Korrespondenz ähnlicher Elemente durch korpusbasierte Technik identifizieren. Nach dem Schemaabgleich füllten wir die Daten der HTML-Seiten auf, indem wir verwandte Tabellen in einer HTML-Tabelle zusammenfügten, die für die Benutzer besser geeignet und hilfreich ist.

Details

Verlag Verlag Unser Wissen
Ersterscheinung Juni 2024
Maße 22 cm x 15 cm x 0.4 cm
Gewicht 102 Gramm
Format Softcover
ISBN-13 9786207667543
Seiten 56

Widerruf erklären

Füllen Sie das folgende Formular aus, um Ihre Widerrufserklärung abzugeben.