한국어English日本語简体中文繁體中文DeutschไทยTiếng ViệtРусскийPortuguês (Brasil)EspañolBahasa Indonesia

Buku Putih Lag Game › L11 Disk

Disk penuh Disk full

ID penyebab dk-full · Penanggung jawab utama Infrastruktur server (Tim Infrastruktur) · Turut terlibat Infrastruktur DB (Tim Infrastruktur), Pengembangan server (Tim Pengembang Game)

Buka kartu interaktif dengan gambar dan simulasi →

Jika log dan dump menumpuk hingga disk penuh, penulisan gagal, dan tanpa penanganan, server crash.

Mengapa Log, dump, dan file sementara menumpuk hingga 100% → Akibatnya Penulisan gagal. Tanpa penanganan error, server crash; dengan penanganan error, penyimpanan gagal → Di layar Disconnect, rollback progres

Gejala
Disconnect, Aksi hilang / rollback
Faktor
Stall
Siapa yang mengalami
Seluruh server
Kapan
Makin lama menyala
Penanggung jawab
Penanggung jawab utama Infrastruktur server (Tim Infrastruktur) · Turut terlibat Infrastruktur DB (Tim Infrastruktur), Pengembangan server (Tim Pengembang Game)
Tugas Tim Pengembang Game
Tangani kegagalan penulisan dengan mencoba ulang penyimpanan dan memicu alert agar server tidak crash, kurangi log dan dump yang tidak perlu.
Tugas Tim Infrastruktur
Server/OS: rotasi log, alert kapasitas, pisahkan disk log dan data. Server DB: pantau agar log transaksi DB (WAL, binlog) tidak menumpuk akibat replikasi terhenti atau backup log terlewat.
Di grafik
Naik perlahan · Penggunaan ruang disk
Yang diperiksa
Periksa persentase penggunaan di df -h dan penggunaan inode di df -i, lalu cari error ENOSPC di log server dan DB. Untuk DB, periksa slot dengan active bernilai false di pg_replication_slots (PostgreSQL), jumlah dan ukuran file di SHOW BINARY LOGS (MySQL), log_reuse_wait_desc di sys.databases (SQL Server), dan FreeStorageSpace (RDS)
Cocok jika
Penggunaan naik terus selama beberapa hari, dan saat mencapai 100% bertepatan dengan waktu crash atau gagal simpan; ENOSPC tercatat di log
Tidak cocok jika
Ruang masih lega tetapi penulisan gagal: lebih mungkin penyebab lain seperti izin atau batas ukuran file
Sarana pemeriksaan
Tools infrastruktur (tanpa perlu kode game)
Pelajari lebih lanjut
Log transaksi DB (WAL, binlog, dan lainnya) tidak terhapus dan terus menumpuk jika replika berhenti atau backup log terlewat. Jika disk ini penuh, semua penulisan di DB berhenti sehingga penyimpanan dan trade gagal serentak.

Sumber

  1. write(2) — Linux manual page Linux man-pages
    Jika perangkat kehabisan ruang, penulisan gagal dengan error ENOSPC
  2. Monitoring Disk Usage (PostgreSQL Documentation) PostgreSQL
    Jika disk WAL penuh, server DB bisa berhenti karena panic
  3. Log-Shipping Standby Servers (PostgreSQL Documentation) PostgreSQL
    Replication slot tidak menghapus WAL sampai replika menerimanya, sehingga bisa memenuhi ruang pg_wal (dibatasi dengan max_slot_wal_keep_size)
  4. Troubleshoot a full transaction log (SQL Server Error 9002) Microsoft SQL Server
    Jika log penuh, DB hanya bisa dibaca dan tidak bisa diubah; penyebab umum yang menghalangi pembersihan log adalah backup log yang terlewat, replication lag, dan transaksi panjang; penghalangnya bisa dilihat di log_reuse_wait_desc pada sys.databases
  5. df(1) — Linux manual page coreutils
    Penggunaan per file system; -i menampilkan penggunaan inode sebagai pengganti blok
  6. pg_replication_slots (PostgreSQL Documentation) PostgreSQL
    active: apakah slot sedang melakukan streaming; wal_status: apakah WAL yang ditahan slot sudah melewati max_wal_size
  7. SHOW BINARY LOGS Statement MySQL
    Daftar file binary log di server dan ukuran filenya (File_size)
  8. Amazon CloudWatch metrics for Amazon RDS AWS
    FreeStorageSpace: sisa ruang penyimpanan instance DB

Lihat juga

Lapisan yang sama: L11 Disk

Penyebab di lapisan lain dengan gejala yang sama (Disconnect)

Lihat kartu interaktif dengan gambar dan simulasi