blogger.de ist down. Seit Freitag morgen, mit einem kurzen Funktionsintermezzo zwischen Freitag 17:55 und Samstag später Abend. Und wieder geht das öffentliche Waschen der Schmutzwäsche los, denn auf dem eigens eingerichteten Protokoll-Blogeintrag »Hetzner: Protokoll eines Scheiterns«, rechnet der Betreiber von blogger.de
mit seinem Hoster Hetzner ab.
Bei Hetzner stehen für Blogger.de und Blogscout.de insgesamt fünf ihrer Rootserver. Bislang war ich sehr zufrieden und habe Hetzner sogar weiterempfohlen: […]
Nach den Erfahrungen der letzten Tage bin ich jedoch ziemlich ernüchtert. Ich hatte mich damals extra gegen 1&1, sowie Strato entschieden, weil ich lieber einen “kleinen” Hoster unterstützen wollte. Hinzu kommt, dass die Preise von Hetzner (im Gegensatz zu z.B. HostEurope), es mir überhaupt erst ermöglichen, die Dienste durch Werbung zu refinanzieren.
An dieser Stelle möchte ich protokollieren, wie schwierig sich die Kommunikation mit Hetzner gestaltet hat.
Es folgt eine Darstellung des bisherigen Mailwechsels mit dem Hoster, eine Interpretation des Betreibers — und ein Verweis auf das Forum des Hosters, wo der Vorfall durch Hetzner-Kunden ebenfalls behandelt wird, teilweise durchaus mit einer anderen Brille als der des blogger.de-Betreibers.
Kommentar eines Selbsthosters (ich habe eigene – ausgelutschter Kram von eBay – Hardware im Housing in einem Datacenter stehen): der Supportablauf via eMail liest sich wenig professionell — granted.
Aber ansonsten muß man dem Betreiber von blogger.de, lt. Selbstdarstellung im Hetzner-Forum ist »Blogger.de ein Hobbyprojekt, welches neben einer ganz normalen Arbeitswoche gestemmt wird«, auch ein gewisses Maß an Versäumnissen ankreiden — nicht zuletzt, wenn es sich um ein Hosting von 9000 Blogs handelt, wie im Hetzner-Forum anklang:
Wenn der Server jetzt erstmal wieder einigermaßen läuft, werde ich sicherlich ein Raid installieren. Ich will ja einen möglichst zuverlässigen Dienst anbieten. Wie schon gesagt: bisher wusste ich nicht, dass da zwei Platten drin sind.
Und sicher hast Du Recht, dass die Platten in dem Sinne defekt sind, dass sie in dem Rechner nicht laufen. Ich meinte das in dem Sinne, das smart, dmesg, oder andere Dinge, keinen Hinweis auf einen Defekt der Platte brachten. […] Klar, hätte ich mehr Zeit in die Problemlösung stecken können, als der Server noch lief. […]
Und unter den Voraussetzungen war ein Reset alle paar Wochen zu verschmerzen.
Weder wurde die Hardware untersucht (»fdisk -l« ist so schwer nun nicht) noch wurden Maßnahmen eingeleitet, den offensichlichen Problemen (Hänger) nachzugehen. Statt dessen wurde sich auf den, bekanntermaßen nicht mehr zuverlässigen, Reboot-Service per Web-Auftrag verlasen. Konsequenterweise wurde auch unter gar keinen Umständen erwogen, auch nach Wahrnehmung eines vermeindtlichen 33%igen Mailverlustes nicht, mal den Support anzurufen.
(Technisch vermute ich mal, daß die Maxtor-Platte(n) sich derart verabschieden, daß nur ein Powercycle (und nicht ein normaler Reboot) sie reanimiert, für unbestimmte Zeit.)
Für ein Projekt, von dem mehrere Tausend Leute abhängig sind, stellt sich mir – unbeleckt der Tatsache, daß ja keiner formal gezwungen ist, zu den Konditionen dort sein Blog zu haben – schon die Frage nach der Sinnhaftigkeit dieses Setups und des Vorgehens der Betreiber.
Außerdem fehlt mir die Rechfertigung dafür, den Ausfall, der gegen Zahlung von rd. 120 EUR längst hätte behoben sein können (»Ein Supporteinsatz am Wochenende und nachts kostet 116,- Euro inklusive 15 Minuten Arbeit. Das ist eine Summe, für die ich die Blogger.de-Server für einen Monat bezahlen kann. Aus dem Grund müssen wir leider bis Montag morgen warten, bis Hetzner dann hoffentlich schneller den DB-Server resettet und vielleicht auch gleich schon eine der defekten Platten austauscht.«), publikumswirksam dem Hoster anzukreiden. Unter dem Aspekt der Schadensminderung hätte es entweder eine »Service will be restored on Monday«-Meldung auf den Webservern sein dürfen oder aber eine Beauftragung des Wochenendeinsatzes mit Zahlung unter Vorbehalt, denn die Aufträge sind, lt. neuem Blog ja vor der kostenpflichtigen Zeit erteilt worden. Schuld am Ausfall über das Wochenende hat jedenfalls nicht der Hoster alleine; auch wenn das die Eingangsseite und die Überschrift des Blogeintrags suggerieren. Als Hoster würde ich mir derlei verbitten — und vorzugsweise Blogs aus der Liste der erlaubten Dienste streichen. Gegen derlei, in meinen Augen ungerechtfertigte, negative Publicity kann man nicht anarbeiten.
Zeit für ein neues Startup, BlogHosting 2.0?
Update, 22:15 Na toll, jetzt hat es der, ich bin schon fast geneigt zu schreiben »gewollte Ausfall«, von blogger.de es zum BOO geschafft:
Im Vordergrund steht sein [des Hosters] Bemühen, die Sache ans Laufen zu bekommen. Im Hintergrund möchte man meinen, die lassen ihn bewusst auflaufen. Das ist eine persönliche Meinung, aber bestimmte Tendenzen sind fast nicht anders erklärbar.
Geboot wird hier Hetzner, dem Dirk Olbertz drücken wir die Daumen.
Ganz groß, Jungs …

Ich saß Freitag den ganzen Tag im Büro, bei dem Job der mich tatsächlich bezahlt und es überhaupt möglich macht, Blogger.de und Blogscout.de zu betreiben. Da telefoniere ich nicht privat, wenn die normale Eskalationskette über das Ticketingsystem bisher problemlos funktioniert hat und die sich Supporthotline bei bisherigen Inanspruchnahme nur als Fernbedienung des Ticketingsystem erwies.
Dass es einen direkten Zugang zu den einzelnen Rechenzentren gibt, ist mir erst heute bewusst gewesen und hätte sicherlich einigen Frust erspart.
Natürlich hätte ich die 116,- Euro in die Hand nehmen können, aber soll ich nach dem Kommunikationsdesaster am Freitag wirklich darauf hoffen, die Leistung von Hetzner nicht in Rechnung gestellt zu bekommen? Ich habe nicht daran geglaubt, dass dies der Fall sein wird. Gleichzeitig aber gesehen, dass es nicht dazu hätte kommen müssen, wenn man auf meine Frage geantwortet hätte, wann am Samstag die Platte ausgetauscht wird.
Und natürlich wurden Sachen wie fdisk, smart, etc. eingesetzt. Das mache ich alleine deshalb schon regelmäßig um nicht erst im Schadensfall blöd da zu stehen.
Aber so wie ich auch Hetzner verstanden habe, sind nicht die Platten das Problem, sondern das Zusammenspiel mit dem Server als Gesamtsystem. Manchmal sind alle Einzelteile in Ordnung und das Gesamtsystem macht Probleme.
Warum Hetzner um das Problem wusste und nicht alle Besitzer solcher Systeme davon in Kenntnis gesetzt hat, gerät plötzlich in den Hintergrund.
Aber wie ich schon so oft erklärt habe: mir geht es nicht darum, dass Fehler passiert sind und der Server lahm gelegt war. Mir geht es um die mangelhafte Kommunikation in der Sache. Nur wenn ich weiß, was los ist, kann ich es meinen “Kunden” erklären. Und das habe ich auf meinem Blog getan. Denn meine “Kunden” möchte ich nicht mit einem “der Server ist am Montag hoffentlich wieder da” im Regen stehen lassen, wenn ich dieses Versprechen nicht selbst in der Hand habe.
Dirk, ich will Dir nicht zu Nahe treten, aber ein paar Aussagen sehe ich mich dann doch zu kommentieren genötigt:
Warum nicht? Du hattest Zeit, entweder die Webseite zu updaten oder jemanden zu informieren, der dies tat: Screenshot von Freitag, 1734.
Dies, während Du »den ganzen Tag im Büro« warst. Gut, Du meinst, daß die »Supporthotline bei bisherigen Inanspruchnahme [sich] nur als Fernbedienung des Ticketingsystem erwies«, das kann ich nicht beurteilen. Ich kann nur für mich sprechen, und die Mitarbeiter meines Dienstleisters kennen das aus leidvoller Erfahrung (hoffe, sie kommentieren hier nicht ;)), wenn es auf den Feierabend (d. h. auf nach 16 Uhr) zugeht, lasse ich Ticketworkflow Ticketworkflow sein und nehme das Telefon und frage penetrant und in bester Kunde-ist-König-Manier nach, ob und wann denn sich jemand bewegt. Wann immer ich das nicht getan habe, habe ich mit Nichtfunktion teuer bezahlt.
Wetten abschließen würde ich darauf auch nicht. Ich finde es aber, mit Verlaub, schon dreist, dann Hetzner: Protokoll eines Scheiterns zu skandieren. Die Downtime über das Wochenende hat nicht Hetzner alleine zu vertreten; Du hättest die Funktion wiederherstellen lassen können und im Nachgang mit Hetzner die Kostendetails klären. Darüber, auch bei einem Scheitern der Kostenübernahme, hätte ich einen Blogeintrag für opportun erachtet — das jetzt, von Dir gewollt oder nicht, die Runde machende »Hetzner läßt Kunden verhungern« halte ich für weder sachgerecht noch fair.
Hmm. »fdisk -l« hat mir bislang jede vom System erkannte Festplatte angezeigt; wenn Du das »regelmäßig« einsetzt, wieso war Dir die zweite Platte nie aufgefallen? (Davon ab, daß ich schon einen Ausfall einer meiner Kisten erleben durfte, die trotz SW-RAID-1 und sogar funktionalem grub auf hdc nach Ausfall von hda platt war: hda war nicht tot, hda war nur generell unpäßlich, sodaß von hda gebootet wurde und dies nie gelang. Details gerne per Mail. Lies: SW-RAID-1 ist mitnichten die allein seeligmachende, blogger.de sicher gerettet habende, Lösung.)
Nein, die Frage halte ich für legitim; sie tritt allerdings dadurch in den Hintergrund, daß Du »Hetzner ist schuld am Ausfall von *.blogger.de« in die Welt gesetzt hast; Details interessieren nun nicht mehr wirklich :(
Allerdings habe ich bislang Hoster gemieden und mache meinen Kram selbst (da weiß ich meistens, wen ich treten muß ;)) und kann insofern nicht wirklich mitreden, was zu dessen Pflichten lt. Vertrag/AGB gehört. Da die Hardware die des Hosters ist, würde ich erwarten, daß er seine betroffenen Kunden nach Kenntnis zeitnah informiert und auf seine Kosten in Absprache die notwendigen Änderungen vornimmt.
Nun, was Du erreicht hast, ist ein BOO mit dem schönen Titel »Hetzner rund um die Uhr nicht erreichbar. Das sind wir unseren Kunden schuldig.« — und Du meinst, das hilft Deinen Kunden mehr als ein Anruf bei der Hotline?
Dir als non-profit-Projekt schadet die Downtime nicht finanziell. Kannst Du mögliche Schäden für Hetzner aufgrund der von Dir losgetretenen negativen Publicity ausschließen oder auch nur annähernd beziffern?
Den Server hättest Du aus meiner Sicht durch die Einmalzahlung, über die Du hinterher hättest mit Hetzner reden können, wieder an den Start bringen können. Damit wäre, hoffentlich, diese ganze Affäre allen erspart geblieben; ein qualitätsbewußter Manager bei Hetzner hätte in meinen Augen schnell eingesehen, daß sein Support da Bockmist gebaut hat und die Einsatzkosten übernommen (ggf. auch nur als Gutschrift auf Deine nächste Rechnung – Workflows halt).
Gut, Du hast Dich anders entschieden. Deine Sache. Aber gegen unpassendes Providerbashing erlaube ich mir, zurückzubloggen.
(Historische Anmerkung: ich habe vor etlichen Jahren einen UUCP-Knoten im sog. Subnet betrieben, von dessen Funktion andere für Mail und News abhängig waren. Und dafür habe ich Hardware gekauft, damit das Ding weiter funktioniert und dafür habe ich auch nächtliches Zug-Taxi-Reset-FixIt-Taxi-Zug (mit ICE-Fahrzeit >3h) in Kauf genommnen; nein, es kam von außen kein Geld dafür, das war purer Idealismus und das Bewußtsein ob der Verantwortung für die (einstelligen) Nutzer. Es ist, um das klarzustellen, also nicht so, daß ich das, was ich hier von Dirk fordere, nicht selbst schon praktiziert hätte.)
Hey, hinterher ist man immer schlauer. Das ein Telefonat (an eine andere Nummer), diesmal etwas gebracht hätte, konnte ich Freitag ja noch nicht wissen.
Zwischendurch wurde man über das Ticketingsystem ja immer wieder “angefüttert”: der Fehler wurde gefunden (nach dem ich zu dem Zeitpunkt ja garnicht habe suchen lassen), der Reset wurde nach deren Angaben ausgeführt, etc..
In einer ähnlichen Situation hatte ich mit dem Telefon keinen Erfolg, sondern mit dem Ticketingsystem. Wobei es auch zweitrangig ist, welche Kommunikation nicht funktioniert hat.
Der Ausfall heute war sicher ausschlaggebend, aber nicht ursächlich für den Blogbeitrag. Ich habe Freitag extra noch keinen Beitrag mit meiner Erfahrung bei Hetzner geschrieben, weil ich noch abwarten wollte, wie nun der Austausch der Festplatte vor sich geht. Ich bin fest davon ausgegangen, dass das gut über die Bühne geht und ich dann höchstens davon geschrieben hätte.
»Hey, hinterher ist man immer schlauer.« – Ack.
Ansonsten bleibt es wohl dabei: ich finde den losgetretenen Blogsturm der Entrüstung für deplaziert, Dirk eher nicht.
Dirk, Review Ende der kommenden Woche? Be my Guest …