한국어English日本語简体中文繁體中文DeutschไทยTiếng ViệtРусскийPortuguês (Brasil)EspañolBahasa Indonesia

Game-Lag-Whitepaper › Grundursachen von TCP-Retransmissions

Überschrittenes Verarbeitungslimit von Zwischengeräten (Firewall, IPS, DDoS-Schutz) Inline appliance PPS / CPU overload

Ursachen-ID rt-appliance-pps · Hauptzuständig Netzwerk-Infrastruktur (Infrastrukturteam) · Beteiligt Server-Entwicklung (Entwicklungsteam)

In der interaktiven Fassung mit Grafiken und Experimenten öffnen →

Firewalls, Intrusion-Prevention-Systeme (IPS) und DDoS-Schutzgeräte prüfen jedes durchlaufende Paket einzeln. Sobald ihre Prüfkapazität überschritten ist, verwerfen sie die Pakete, die sie nicht mehr verarbeiten können.

Warum Zur Stoßzeit oder bei Events kommen pro Sekunde mehrere hunderttausend und mehr kleine Spielpakete zusammen, oder die Prüfregeln sind aufwendig → Folge CPU- oder PPS-Limit des Geräts erreicht, das Gerät verwirft Pakete. Bei False Positives werden auch legitime Pakete blockiert → Auf dem Bildschirm Freeze oder Teleportieren auf allen Servern hinter dem Gerät gleichzeitig, verschärft sich nur bei großem Andrang

Symptome
Freeze, Zeitraffer, Teleportieren, Verbindungsabbruch
Faktoren
Paketverlust, Latenz
Wer ist betroffen
Ganzer Server, Bestimmte Region oder Provider
Wann
Abendliche Stoßzeit, Bei großem Andrang
Zuständigkeit
Hauptzuständig Netzwerk-Infrastruktur (Infrastrukturteam) · Beteiligt Server-Entwicklung (Entwicklungsteam)
Aufgaben Entwicklungsteam
Traffic-Muster des Spiels (Ports, Paketgrößen, PPS) mit dem Infrastrukturteam teilen, kleine Nachrichten eines Ticks sammeln und gebündelt senden, um die Paketzahl zu senken.
Aufgaben Infrastrukturteam
CPU, PPS und Drop-Zähler der Geräte zusammen mit den Spielmetriken betrachten, Gerätekapazität auf Basis kleiner Pakete planen, Spielports von aufwendigen Prüfungen ausnehmen, DDoS-Schutzregeln an die Traffic-Muster des Spiels anpassen.
Größenordnungen
Die „10 Gbps“ im Datenblatt beziehen sich oft auf große Pakete mit 1.500 Byte. Spielpakete mit etwa 100 Byte ergeben bei derselben Bandbreite mehr als 10-mal so viele Pakete. Auch wenn die Leitung ruhig aussieht, ist daher zuerst das PPS-Limit erreicht.
Im Graphen
Plateau am Limit · PPS und CPU-Auslastung des Geräts, Drops am Gerät
Wo nachsehen
CPU, PPS und Drop-Zähler des Geräts prüfen, Paketzahlen an den Switch-Ports vor und hinter dem Gerät im selben Intervall vergleichen. Zusammen mit der Zahl gleichzeitiger Spieler und der Retransmission-Rate des Servers in einer Ansicht überlagern
Spricht dafür
Zu Stoßzeiten oder bei Events kommen PPS oder CPU des Geräts über einen bestimmten Wert nicht hinaus, aus dem Gerät kommen weniger Pakete heraus als hinein, und gleichzeitig steigt die Retransmission-Rate aller Server dahinter
Spricht dagegen
Paketzahl vor und hinter dem Gerät gleich, keine Drops am Gerät: andere Ursache. Steigen auf dem Server die Drop-Zähler der NIC oder softnet dropped: „Verworfene Pakete auf dem empfangenden Server-Host“
Prüfmittel
Mit Infrastruktur-Tools prüfbar (ohne Spielcode)

Quellen

  1. RFC 2544: Benchmarking Methodology for Network Interconnect Devices IETF
    Die Geräteleistung muss mit mehreren Frame-Größen einschließlich Minimal- und Maximalgröße getestet werden (die Verarbeitungsleistung hängt von der Paketgröße ab)

Verwandte Ursachen

Gleiche Schicht: Grundursachen von TCP-Retransmissions

Ursachen aus anderen Schichten mit demselben Symptom (Freeze)

Karte in der interaktiven Fassung mit Grafiken und Experimenten ansehen