Límite de PPS de la nube superado Cloud PPS / bandwidth allowance
ID de la causa nic-cloud-pps · Responsable principal Infraestructura de servidores (Equipo de infraestructura) · También Desarrollo de servidor (Equipo de desarrollo), Externo (Externo)
Cada tipo de servidor en la nube tiene límites de paquetes por segundo y de ancho de banda, y lo que los supera se descarta en silencio.
Por qué Al subir los jugadores conectados a la vez (CCU), los paquetes por segundo superan el límite de la instancia → Efecto La red de la nube descarta el exceso → En pantalla Teletransporte y habilidades que no salen por una pérdida sin causa aparente. La CPU del servidor va sobrada
Cuando se junta mucha gente, Horas pico de la noche
Responsable
Responsable principal Infraestructura de servidores (Equipo de infraestructura) · También Desarrollo de servidor (Equipo de desarrollo), Externo (Externo)
Tareas (Equipo de desarrollo)
Agrupar paquetes (los mensajes de un tick en un solo paquete), no enviar con frecuencia paquetes muy pequeños.
Tareas (Equipo de infraestructura)
Revisar los contadores de límite superado (en AWS, pps_allowance_exceeded, conntrack_allowance_exceeded, etc.) y poner alertas, pasar a una instancia más grande, evitar el límite de seguimiento de conexiones con una configuración del grupo de seguridad que no genere seguimiento.
Tareas (Externo)
Preguntar al proveedor de nube los límites de paquetes por segundo y de seguimiento de conexiones de cada tipo de instancia.
Cifras de referencia
Los límites varían según el tamaño de la instancia, y el límite de paquetes por segundo muchas veces no se publica. El “hasta 10 Gbps” de las instancias pequeñas es una velocidad de ráfaga disponible solo mientras quedan créditos (normalmente 5–60 minutos), y la velocidad base habitual es mucho menor.
En el gráfico
Topa con el límite · Paquetes por segundo, contadores de allowance superado
Dónde mirar
Recoger a intervalos cortos los contadores ENA pps_allowance_exceeded, bw_in_allowance_exceeded, bw_out_allowance_exceeded y conntrack_allowance_exceeded de ethtool -S y verlos junto a los paquetes por segundo. También se pueden publicar con el agente de CloudWatch y ponerles alarmas
Se confirma si
A la hora de la pérdida suben los contadores de allowance superado y los paquetes por segundo no pasan de un valor fijo. La CPU del servidor va sobrada
Se descarta si
Si los contadores de límite superado no se mueven, no es esta causa. Si el %soft de un núcleo está al 100%, apunta a “Interrupciones de la NIC concentradas en un solo núcleo”
Se verifica con
Con herramientas de infraestructura (no hace falta código del juego)
Para saber más
conntrack_allowance_exceeded indica que la tabla de seguimiento de conexiones se llenó y se descartaron conexiones nuevas. Si la tabla tiene margen y solo se cortan las conexiones inactivas porque su seguimiento expiró, consulta la entrada “Expiración del seguimiento de conexiones en grupos de seguridad de la nube”.
Fuentes
Monitor network performance for ENA settings on your EC2 instanceAWS Cada instancia tiene límites de ancho de banda, PPS y seguimiento de conexiones; lo que los supera se encola y luego se descarta; contadores pps_allowance_exceeded y conntrack_allowance_exceeded
Amazon EC2 instance network bandwidthAWS El “hasta N Gbps” de las instancias de 16 vCPU o menos es una ráfaga que consume créditos de E/S de red (normalmente 5–60 minutos); cuando se acaban los créditos, vuelve al ancho de banda base