한국어English日本語简体中文繁體中文DeutschไทยTiếng ViệtРусскийPortuguês (Brasil)EspañolBahasa Indonesia

Game-Lag-Whitepaper › L11 Datenträger

Schreiben von Core-Dumps Core dump writing

Ursachen-ID dk-coredump · Hauptzuständig Server-Infrastruktur (Infrastrukturteam) · Beteiligt Server-Entwicklung (Entwicklungsteam)

In der interaktiven Fassung mit Grafiken und Experimenten öffnen →

Stürzt der Server ab, schreibt er mehrere GB Arbeitsspeicher auf den Datenträger. Das kann den Neustart um einige Minuten verzögern.

Warum Serverabsturz, der gesamte Arbeitsspeicher wird in eine Datei geschrieben → Folge Kein Neustart möglich, solange mehrere GB geschrieben werden → Auf dem Bildschirm Server abgestürzt, nach dem Verbindungsabbruch lange kein Login möglich

Symptome
Kein Login / Endlos-Laden
Faktoren
Stillstand
Wer ist betroffen
Ganzer Server
Wann
Gelegentlich, zufällig
Zuständigkeit
Hauptzuständig Server-Infrastruktur (Infrastrukturteam) · Beteiligt Server-Entwicklung (Entwicklungsteam)
Aufgaben Entwicklungsteam
Einsatz kleiner Dumps prüfen, die nur den nötigen Speicher enthalten (Minidumps), Absturzursache beheben.
Aufgaben Infrastrukturteam
Dump-Größe begrenzen (Core-Dump-Einstellungen des OS), schnelle Datenträger einsetzen, Neustart und Dump entkoppeln (Komprimieren und Hochladen des Dumps erst nach dem Neustart separat erledigen).
Im Graphen
Verbindungen brechen gleichzeitig ab · Anzahl der Verbindungen, Zeitpunkt des Serverneustarts
Wo nachsehen
Absturzzeitpunkt, Größe der Core-Datei (coredumpctl list und info oder die Datei an dem Ort, auf den core_pattern zeigt), Zeitpunkt, an dem die Datei fertig geschrieben war, und Zeitpunkt, an dem der Dienst wieder lief, nebeneinanderlegen und für diesen Zeitraum wkB/s aus iostat -x prüfen
Spricht dafür
Nach dem Absturz liegen die Disk-Schreibvorgänge nahe am Limit, solange eine Core-Datei von mehreren GB geschrieben wird, und der Neustart beginnt erst, wenn das Schreiben beendet ist
Spricht dagegen
Core-Dumps abgeschaltet oder klein und schnell fertig, Neustart trotzdem langsam: eher der Serverstart selbst, etwa Laden der Karten oder kalter DB-Cache (db-cold-cache)
Prüfmittel
Mit Infrastruktur-Tools prüfbar (ohne Spielcode)

Quellen

  1. core(5) — Linux manual page Linux man-pages
    Obergrenze der Core-Dateigröße per RLIMIT_CORE, Auswahl der enthaltenen Speicherbereiche per coredump_filter, Core-Dumps per Pipe an ein Programm übergeben und separat verarbeiten
  2. Minidump Files Microsoft
    Ein Minidump enthält nur den nützlichen Teil der Crash-Dump-Informationen und ist dadurch schnell erstellt und klein
  3. coredumpctl(1) — Linux manual page systemd
    list: im Journal erfasste Core-Dumps (TIME ist der vom Kernel gemeldete Absturzzeitpunkt), info: Details je Dump und die auf den Datenträger geschriebene Größe
  4. iostat(1) — Linux manual page sysstat
    -x: wkB/s (pro Sekunde auf den Datenträger geschriebene Datenmenge)

Verwandte Ursachen

Gleiche Schicht: L11 Datenträger

Ursachen aus anderen Schichten mit demselben Symptom (Kein Login / Endlos-Laden)

Karte in der interaktiven Fassung mit Grafiken und Experimenten ansehen