Posts mit dem Label Web of Data werden angezeigt. Alle Posts anzeigen
Posts mit dem Label Web of Data werden angezeigt. Alle Posts anzeigen

1. Dezember 2010

Die Prinzipien des Web nach Tim Berners-Lee

Semantic Web, Web of Data und Web 2.0 sind unterschiedliche Sichtweisen auf ein Ganzes - das Web. Auch das Web hat Prinzipien, welche im sehr lesenswerten Beitrag Long Live the Web: A Call for Continued Open Standards and Neutrality von Tim Berners-Lee vorgestellt wurden:
  • Universalität als primäres Designprinzip: Es erlaubt ein Funktionieren des Web und ein Publizieren am Web für alle Menschen, unabhängig von Hardware, Software, Netzwerkverbindung und Sprache. Alle Menschen müssen in der Lage sein, jeglichen Inhalt auf das Web zu stellen und zu jeder Ressource am Web zu verlinken.
  • Offenheit der technischen Standards als Treiber für Innovation: Alle relevanten technischen Standards wie Hypertext Markup Language (HTML) zum Erstellen von Web-Seiten, Uniform Ressource Identifier (URI) zum Auffindbarmachen von Web-Seiten und Hypertext Transfer Protocol (HTTP) zur Bereitstellung von Web-Seiten sind offen, lizenzkostenfrei und erlauben grundsätzlich jedem Menschen, Anwendungen am Web zu erstellen, ohne die Erlaubnis von Dritten einzuholen und ohne eine Gebühr zu entrichten.
  • Trennung des Web von Internet: Das Web ist eine einzelne Anwendung, welche auf dem Internet läuft. Dagegen stellt das Internet ein elektronisches Netzwerk dar, welches Informationspakete zwischen Millionen von Computern versendet und dabei auf wenige offene Protokolle zurückgreift. Die Trennung von Web und Internet ist wesentlich für Innovationen: So wurde 1990 das Web über das Internet ausgerollt, ohne eine Anpassung des Internet zu erfordern.
  • Elektronische Menschenrechte und Netzneutralität. Die Netzneutralität ist fundamental. Sie bedeutet, dass jegliche Zugangsanbieter (Internet Service Provider - ISP) Datenpakete von und an ihre Kunden unverändert und gleichberechtigt übertragen sollen, unabhängig davon, woher sie stammen oder welche Anwendungen diese Pakete generiert haben. Ein neutrales Kommunikationsmedium ist die Basis für eine faire Marktwirtschaft, für Demokratie und Wissenschaft (und für elektronische Menschenrechte).
  • Kein Ausspionieren: Auch Bedrohungen des Internet durch Unternehmen und/oder Regierungen, welche Internet-Traffic ausspionieren, gefährden die Grundrechte der Menschen im Web. Dabei könnten ISP beispielsweise verfolgen, welche Kunden welche URI ansurfen und daraufhin zielgerichtete Werbung anbieten. Eine davor zu passierende Bewertung von Informationen in einem Internetpaket ist jedoch äquivalent zum Abhören eines Telefons oder zum Öffnen eines Briefes.
Neue Web-Anwendungen, Linked Data (also auch das Web of Data) sowie zukünftige Web-Technologien werden gemäß Tim Berners-Lee nur dann gedeihen, wenn diese fundamentalen Grundprinzipien des Web geschützt werden.

Und an dieser Stelle schließt mein Blog-Beitrag mit einer Zustimmung.

25. November 2010

Web of Data: Wo bleibst Du?

Nachdem ich hier in den letzten Monaten vor allem zu Web 2.0 und Enterprise 2.0 geschrieben habe, möchte ich mich diesmal dem „Web of Data“ als einen wesentlichen Schritt hin zu einem Semantic Web widmen.

Während die Konzepte hinter dem Web 2.0 für Praktiker noch relativ transparent sind, sieht es beim Web of Data noch viel anders aus (beim Semantic Web erst recht). Was verbirgt sich nun hinter dem Web of Data?

Web 2.0 vs. Web of Data

Im Gegensatz zum Web 2.0 mit seinen Prinzipien (Web als Plattform, Beteiligung der Nutzer, gesteigerter Wert der Daten, kollektive Intelligenz, Netzwerkeffekte per default, perpetual beta, Services & MashUps) steht beim Web of Data die Bereitstellung und Vernetzung von Daten im Vordergrund. Im heutigen Web können Menschen nämlich über gebräuchliche Suchmaschinen wie Google ausschließlich Dokumente finden und den Inhalt dieser Dokumente auch nur manuell erschließen (durch “Lesen“ und anschließendes „Interpretieren“ des Inhalts in einem bestimmten Kontext). Computerprogramme könnten den Menschen in dieser Tätigkeit prinzipiell unterstützen, tun sie jedoch noch nicht, weil sie die Daten in diesen Dokumenten weder lesen, noch bearbeiten noch interpretieren können.

Was ist jetzt das Web of Data?

Im Web of Data geht es nun darum, dass Daten in einer speziellen Art und Weise bereit gestellt und miteinander verlinkt sind (so spricht man auch von „Linked Data“). Dazu wurden erstmals eine Menge an technischer Standards entwickelt, wie Uniform Ressource Identifier (URI) zur Identifikation von Ressourcen im Web, Resource Description Framework (RDF) zur Kodierung und Verlinkung von Daten und SPARQL Protocol and RDF Query Language (SPARQL) als graphbasierte Abfragesprache für RDF.

Durch die mit der Einhaltung dieser Standards verbundene spezielle Art der Bereitstellung werden  endlich auch Maschinen (Computerprogramme) in die Lage versetzt, die Daten am Web zu interpretieren und automatisiert zu verarbeiten.

Neben den eigentlichen Daten (dem Inhalt), werden auch noch Metadaten (die Daten beschreibende Daten) für Maschinen bereitgestellt. Diese Metadaten orientieren sich an einem bestimmten Schema (einer Ontologie). Die Datenbereitstellung (und auch die Nutzung) derselben ist für gewöhnlich nicht trivial. Die Daten sind nach gängiger Lehrmeinung vor allem auch durch die einheitliche Struktur und die bestehenden gemeinsamen technologischen Standards zumindest für Softwareentwickler viel einfacher zu nutzen, als bei proprietären (plattformabhängigen)  Lösungen. 

Wer möchte, kann im Beitrag "Towards a Commercial Adoption of Linked Data for Online Content Provider" im Detail in einem echten Anwendungsfall nachlesen. Gerne stelle ich diesen Beitrag hier (auf Scribd) zur Verfügung.

Wann kommt nun das Web of Data?

Damit das Web of Data einmal zur Realität wird, muss es erst ein „Henne-Ei-Problem“ überwinden: Bevor jemand sinnvolle Anwendungen entwickelt, welche das Web of Data nutzen, muss erst eine große Menge an strukturierten und verlinkten Daten am Web vorhanden sein. Dabei wird der Ball zuerst zu den großen Datenanbietern gespielt. Denen mangelt es noch an Motivation, ihren Datenschatz in ein zum Semantic Web kompatibles Format zu bringen und mit anderen Daten zu verlinken, weil erst wenige Anwendungen für Endnutzer vorhanden sind (bzw. weil Sie ihren Datenschatz gar nicht öffnen wollen). Ohne Daten entstehen keine Anwendungen und ohne Anwendungen fehlt den Unternehmen jegliche Grundlage zu dieser speziellen Art der Datenbereitstellung. Um schnell erste Daten zur Verfügung zu haben, wurde beispielsweise die Wikipedia als DBpedia in ein zum Web of Data kompatibles Format gebracht.

Open Government Data als Lückenfüller

Diese Lücke sowie die Henne-Ei-Problematik würde in der Zwischenzeit erkannt - und man versucht kreativ Wege aus dem Dilemma zu finden. Zunehmend wird im Zusammenhang mit dem Web of Data über offene Daten diskutiert (daher spricht man auch von „Linked Open Data“), also Daten frei von Copyrights, Patenten und anderen Kontrollmechanismen.

Vor allem die Daten eines Staats, eines Bundeslands oder einer Stadt, welche aufgrund ihrer Natur schon durch öffentliche Gelder finanziert wurden, könnten und sollten am Web of Data bereitgestellt werden (man spricht hier von „Open Government Data“). Auf Basis dieser Daten könnten dann innovative Anwendungen entwickelt werden, jedoch nicht notwendigerweise durch Staat, Bundesland oder Stadt, sondern durch engagierte Software-Entwickler (Geeks, Evangelisten, ..).

Holt sich das Web of Data Ideen aus der Open Innovation Community?

Die Idee, zuerst Daten am Web zu veröffentlichen und dann zu warten, bis die Web-Community interessante Anwendungen entwickelt bzw. dem Datenschatz wertvolle Informationen entlockt und zur Verfügung stellt ist nicht ganz neu: Schon im Jahr 2000 veranstaltete das kanadische Explorationsunternehmen Goldcorp Inc einen mit 500.000 $ Preisgeld dotierten Wettbewerb. Ziel dieses Wettbewerbs bestand darin, neue Erfolg versprechende Schürfstellen in einer bestehenden Goldmine zu finden. Sämtliches bestehendes Kartenmaterial und sämtliche Informationen zu bisherigen Explorationsstrategien wurden über das Web zur Verfügung gestellt. So konnten durch Nutzerbeteiligung in teils aufwändiger eigenständiger Analyse dieser geologischen Daten 110 potenzielle Fundstellen identifiziert werden - die Goldcorp Challenge war ein riesiger auch monetärer Erfolg.

Nutzen statt nur bereitstellen: die BBC Fallstudie

Bisher hat man sich hauptsächlich auf die Bereitstellung von Daten konzentriert. Dabei sind eine Reihe von Datensätzen entstanden, welche in der Linked Data Cloud dargestellt werden. Zukünftig wird aber vor allem die Nutzung dieser Daten (durch intelligente Anwendungen) in den Vordergrund treten. Stehen erst einmal genügend interessante Daten zur Verfügung, werden auch Nutzer (oder Unternehmen) sinnvolle oder weniger sinnvolle auf diesen Daten aufbauende Anwendungen entwickeln (..."zeige mir den Standort aller Bauern auf Google Maps, welche über 100k € EU-Förderungen bezogen haben ;-) )

Derzeit kann BBC als eines der wenigen nutzernahen Anwendungsbeispiele des Web of Data Anwendungen mit Mehrwert für die Nutzer bereitstellen. BBC ist nämlich eines der ersten Unternehmen, welches Linked Data kommerziell intensiv nutzt, um die historisch gewachsenen isolierten BBC Einzelportale besser miteinander zu vernetzen. Beispielsweise hat die technologische Weiterentwicklung iBC ermöglicht, dass an einer zentralen Stelle sehr einfach und intuitiv durch Nutzer abgerufen werden kann, auf welchem Sender BBC ein bestimmtes Musikstück eines bestimmten Interpreten gerade spielt, obwohl diese Information aus vielen einzelnen dezentralen Datenquellen (den unterschiedlichen Web-Portalen) ermittelt werden muss. Damit wurde mit Hilfe von Linked Data die ehemals heterogene Datenwelt bei BBC konform zum Web  of Data homogenisiert.

Zusätzlich nutzt BBC Semantic Web Daten von Dritten wie etwa DBpedia oder MusicBrainz (zum Web of Data konformes Musikarchiv) in eigenen Web-Portalen wie BBC Music (www.bbc.co.uk/music). So erhalten Nutzer von BBC Diensten vielfältige Informationen zu Interpreten sowie ihrem gesamten musikalischen Schaffen (z.B. auch Diskografien), ohne dass BBC diese Daten selbst besitzen muss. BBC kann Nutzern einen vollkommen neuen Nutzen generieren, weil BBC plötzlich vom klassischen Medienunternehmen zum Gesamtanbieter aller Information über Musiker und Musikgruppen transformiert. Das Web of Data hat die Value Proposition, also das Nutzenversprechen, der BBC als Betreiber vieler Radiostationen und Portale transformiert.

Web of Data in a nutshell

Zusammengefasst steckt hinter dem Web of Data die grundsätzliche Idee, dass das Web nicht nur durch Computer, sondern auch in der Folge durch Menschen „besser“ genutzt werden kann, weil viele neue Anwendungen/Dienste angeboten werden, welche auf den bereitgestellten Daten basieren. Insbesondere lassen sich viele Aktivitäten plattformübergreifend vernetzen und automatisieren. Damit entsteht ein Mehrwert für Nutzer, weil es viele Anwendungen nur aufgrund des Web of Data geben wird.

Weiterführende Informationen zum Web of Data finden sich in meinem Beitrag „Die Wertschöpfungskette der Daten. Eine Basis für zukünftige wirtschaftswissenschaftliche Betrachtungen des Web of Data“, welcher in der Zeitschrift HMD Praxis der Wirtschaftsinformatik, Heft 275 publiziert wurde. Ich stelle den gescannten Beitrag gerne hier (auf Scribd) zur Verfügung.

16. April 2010

Open Government Data?

Open Government Data ist sicherlich ein spannendes und aktuelles Thema. Die Daten sind ein öffentliches Gut und der Staat müßte dafür sorgen, dass diese Daten auch angeboten werden. Aufbauend auf diesen Daten werden dann Anwendungen entwickelt, welche zu einer Wertschöpfung führen.

Ist die Nutzung der Daten kostenlos, könnte durch Unternehmen/Berater immerhin noch zwei Mal verdient werden:
  • Für die Unterstützung bei der Bereitstellung dieser Daten und 
  • im Rahmen der Anwendungsentwicklung (damit dann was mit den Daten passiert).
Es wird allerdings auch weiterhin Daten geben, welche nicht als Open Data bereitgestellt werden. Überall dort, wo Auswertungen und Analysen von Daten nämlich als kostenpflichtiger Service angeboten werden.
Es könnten jedoch dort Anwendungen entstehen, wo bisher noch niemand mit Daten Geld verdient. Außerdem denke ich, dass ein Großteil dieser Anwendungen auch ohne kommerziellen Hintergrund entstehen wird.

16. November 2009

Neue Geschäftsmodelle im Semantic Web und die Wertschöpfungskette der Daten

Alexander Stocker und Klaus Tochtermann (DOK Magazin)

Themen, welche das Internet der Zukunft maßgeblich prägen werden, finden sich in letzter Zeit unter dem Begriff Future Internet vereint. Im Internet der Zukunft soll das Semantic Web als das "Web der Daten" langfristig dazu beitragen, Daten am Web besser zu vernetzen. Dann werden auch für die Anwender erhebliche Vorteile generiert, weil sich viele Vorgänge im Web automatisieren lassen. Für Unternehmen wird sich ein großer Markt entwickeln, um innovative Services im Web bereitzustellen, mit ganz neuen Wertschöpfungsketten.

Zitat: Stocker, Alexander und Tochtermann, Klaus: Neue Geschäftsmodelle im Semantic Web und die Wertschöpfungskette der Daten, DOK Magazin, 2009.

Download Beitrag

16. Juni 2009

Wann kommt nun das Semantic Web?

Alexander Stocker und Klaus Tochtermann (Monitor)

Gemäß der Vision des Web-Erfinders Tim Berners Lee soll das „Semantic Web“ - ein Web der Daten - das Web, wie wir es kennen, erweitern: Neben Menschen werden vom Semantic Web
insbesondere Maschinen profitieren, weil sie Inhalte von Webseiten verstehen und verarbeiten können.

Zitat: Stocker, Alexander; Tochtermann, Klaus, Wann kommt nun das Semantic Web? In: MONITOR – Das Magazin für Informationstechnologie, 2009.

Download Beitrag

Beliebte Beiträge