要准确评估带宽瓶颈,先从业务维度与链路维度分别测量。业务维度看应用峰值带宽与并发,链路维度看物理/虚拟网口吞吐。
推荐使用 iperf3(端到端吞吐)、speedtest-cli(对外带宽)、vnStat(流量统计)、mtr(丢包与延迟路径)等。
1)在同机房不同节点做iperf3双向测试;2)从外部节点做speedtest和wget/curl并发下载测试;3)结合vnStat看长期流量曲线。
避免峰值自动限速时间段、关闭影响测试的防火墙速率限制、记录CPU和磁盘I/O以排除非网络瓶颈。
降低延迟需要从物理拓扑、路由与主机内核三方面入手:选择合适机房、优化BGP/路由、调整TCP/IP栈。
优先选择靠近目标用户的香港机房或本地POP,使用有良好国际/国内直连的带宽商或支持优质中转的运营商。
启用TCP窗口扩大、启用TCP Fast Open(视场景)、使用HTTP/2或QUIC(UDP+TLS)可有效减少握手与抖动。
配置合理的MTU、关闭IPv6不必要路径(或确保IPv6路由良好)、在必要时使用Anycast或CDN节点分发以就近响应。
带宽配置要基于业务流量模型(上行主要是上传日志、推送;下行主要是下载、静态资源)。区分峰值带宽与平均带宽,预留余量。
如果大量用户向VPS上传(如文件收集、备份),选择对称带宽;以网站、下载为主可选择下行更大比例的方案。
通过tc(traffic control)做流量整形与优先级队列(QoS),对SSH/管理口限速、对大文件下载设置并发控制,防止突发占满链路。
监控带宽计量,启用burst策略(如果提供商支持)在短时突发场景允许峰值带宽,通过报警避免计费超标。
系统层面调整内核网络参数、禁用不必要服务、优化网络驱动与中断分配;应用层面优化协议、压缩与缓存。
调整 /proc/sys/net/ 下的tcp_tw_reuse、tcp_fin_timeout、net.core.rmem_max/wmem_max、tcp_window_scaling等参数以提升吞吐与并发能力。
使用gzip或Brotli压缩静态资源、启用缓存(Redis、Memcached、HTTP缓存头)、使用连接池与长连接减少握手开销。
通过Nginx/HAProxy做反向代理、使用缓存层与CDN卸载静态流量,将带宽压力分散到边缘节点。
排查先从链路到主机逐层诊断:外部路由->运营商链路->交换机/虚拟交换->VPS网络栈->应用。
先用mtr定位丢包/抖动发生在哪一跳;再用ifconfig/ethtool查看网口错误、丢包计数;查看系统负载、interrupt分布与队列长度。
重启网卡或调整队列参数,升级网卡驱动或更换虚拟网卡类型,向云/机房运营商提交链路质量故障单并提供mtr/traceroute日志。
配置SYN/连接速率限制、启用防DDOS策略、设置流量报警与自动扩容计划,定期评估带宽瓶颈并进行容量规划。