Huhu zusammen.
Ich arbeite grad an einer Präsie zu dem Thema Suchmaschinen.
Hierzu wollte ich einerseits die Theorie wie Suchmaschinen arbeiten (also: Meta-Suchmaschine funzt so, Webkataloge so, Volltextsuchmaschinen so, Social Behavior so…) machen.
Dies ist soweit nicht so aufwendig und zum großen Teil eh Allgemeinwissen.
Was aber viel mehr interessiert ist der Technische Aufbau wie z.B: Server1 mit Spider durchsucht das Web (nach welchem Verzeichnis eigentl?) und lädt die Websites hinter den Links herunter.
Dahinter stehen dann 5 Server, die die von diesem Spider geladenen Website via bestimmter Progs und Verfahren analysieren/Wörter indexieren usw.
Dahinter steht die Datenbank für die Indexe und die Datenbank die (glaub Alta Vista macht das) die das Web 1-1 kopiert.
Auf die Datenbanken greift der Abfrageservewr zu in dem der Nutzer die Abfrage eingibt.
Bei Förderierten Suchmaschinen gibts nur die Abfrageserver, die dann halt auf die Volltextsuchmaschinen zugreifen + eine eigene Datenbank.
Sowas in der Richtung nur in „richtig“ und mit ein bisschen Tiefe.
Geht dabei darum, wie komplex Suchmaschinen aufgebaut sind, wie die Relationen sind zwischen Abfrageservern, Spider-servern und Datenbanken usw und auch darum, warum man mit einer Suchanfrage einige Watt Strom verbraucht usw.
Google hat etliche Tausend Server, wieviele Server werden benötigt meine Suchabfrage zu bedienen. Schließlich greife ich bei einer Suche zwecks Geschwindigkeitsoptimierung auf einige Server auf einmal zu.
Sowas in Abstrakter Form wäre genau das richtige.
Und überhaupt iwas sinnnvolles nur in der groben Richtung zu finden…
ich habs net geschafft.
Mfg.