Snapsearch: SEO fürs dynamische Web dank Firefox-Backend
Mit modernen Webtechniken wie HTML5 oder auch Javascript lassen sich sehr komplexe dynamische Inhalte für Webseiten erstellen. Nur können die meisten derzeit aktuellen Web-Crawler wie jener der Google-Suche oder die Bild-Extraktion für Facebook nicht damit umgehen. Dieses Problem will Snapsearch(öffnet im neuen Fenster) lösen, indem den Crawlern ein Schnappschuss der Seite samt dynamischer Inhalte angeboten wird.
So sollen denjenigen Clients, die auf die Webseite zugreifen, sämtliche Inhalte dargestellt werden können, auch wenn diese selbst kein Javascript ausführen können. Dazu müssen die Webseiten oder Web-Anwendungen eine derartige Nachfrage erkennen und an die von Snapsearch bereitgestellte Middleware weiterleiten.
Firefox-Engine als Unterbau
Jene Middleware nutzt intern Nightly-Builds von Firefox, um ständig aktuelle HTML5-Techniken benutzen zu können. Durch die Verwendung der Browser-Engine wird erreicht, dass der an den Crawler weitergeleitete Schnappschuss dem entspricht, was ein Nutzer sähe. Zudem ist Snapsearch dadurch unabhängig von dem Javascript-Frameworks, mit denen die Anwendung erstellt worden ist.
Der Dienst von Snapsearch arbeitet mit Lastverteilung und ist so in der Lage, auch sehr große Seiten zu bearbeiten. Die Schnappschüsse selbst werden in der Amazon-Cloud gespeichert und über Prüfsummen unterschieden. Die Caches werden zwischen einer und 200 Stunden vorgehalten.
Das Unternehmen rechnet pro erstelltem Schnappschuss, die ersten 1000 sind gratis. Weitere 1000 Zugriffe kosten je zwei Australische-Dollar, etwa 1,50 Euro. Die Snapsearch-Clients sind samt Demo-Code auf Github(öffnet im neuen Fenster) in PHP, Ruby, Python und als Node.js-Paket verfügbar.
- Anzeige Hier geht es zum Handbuch für Softwareentwickler bei Amazon Wenn Sie auf diesen Link klicken und darüber einkaufen, erhält Golem eine kleine Provision. Dies ändert nichts am Preis der Artikel.