1.
- 确认手机显示“无服务”的具体表现(信号栏空白、仅紧急呼叫、无移动数据等)。
- 记录设备信息:IMEI、IMSI、ICCID、操作系统版本、基带版本(Baseband)、是否为eSIM。
- 采集射频与链路层指标:RSSI/RSRP、SINR/RSRQ、RSCP(示例:LTE RSRP=-95 dBm,RSRQ=-10 dB,SINR=8 dB)。
- 收集时间、地点(GPS坐标)、附近小区ID(CID/TAC),以及出现故障时的截图与通话/数据日志。
- 如果设备能连到Wi-Fi或USB共享,使用tcpdump或抓包工具采集流量(pcap),并标注采集时间与UTC时戳。
2.
- 确定运营商(示例:Viettel、Vinaphone、Mobifone、VNPT)并通过官方支持渠道提交工单或热线。
- 提交必备材料:IMEI、IMSI、ICCID、小区ID、故障开始时间、症状说明和抓包文件(pcap)。
- 要求运营商检查无线接入网(RAN)与核心网(MSC/SGSN/MME/PGW)日志,确认是否存在HLR/HSS、SMSC或P-CSCF注册失败。
- 若为漫游问题,要求核查MCC/MNC路由、漫游前缀与SIP/TCP会话建立是否受限。
- 索要故障单编号,并定期跟进;必要时要求运营商做基站层面的重启或切换频段测试。
3.
- 对于应用无法在移动网络访问,提供外网访问的traceroute、mtr三路追踪(含ICMP/TCP),并标注时间点。
- 提供服务器监听端口、服务(HTTP/HTTPS/SIP)、NAT类型与公网IP地址(IPv4/IPv6)。
- 上传服务器侧的tcpdump片段(例如:tcpdump -w /tmp/cap.pcap port 80 or host x.x.x.x),并说明抓包时间UTC。
- 提供服务商侧控制面信息:BGP邻居、ASN、带宽保留、DDoS清洗阈值与最近的流量图。
- 要求CDN/防护商核查是否有WAF/速率限制、地理封禁或运营商级别黑洞丢包。
4.
- 案情概述:2025年某越南在线教育客户用户在多地出现“无服务”或移动数据无法访问App的情况,Wi-Fi正常。
- 采集的数据:用户反馈IMEI/IMSI、采样RSRP均在-110到-85 dBm区间,traceroute在第4跳到运营商网关出现大量丢包。
- 分析与处理:通过运营商工单确认为某区域基站向核心网的路由异常,运营商在6小时内完成基站重启并恢复。
- 服务器调整:同时我们在新加坡VPS上部署反向代理并启用Cloudflare国际加速,避免运营商间跨境路由问题对业务造成中断。
- 结果:用户访问恢复,后续在关键路由点增加BGP备路径并配置DDoS清洗阈值,减少相似事故影响。
5.
- 示例VPS规格(推荐用于跨境代理):2 vCPU / 4 GB RAM / 80 GB SSD / 1 Gbps 带宽,Ubuntu 22.04。
- NGINX 核心参数示例:worker_processes auto; worker_connections 10240; client_max_body_size 50M; keepalive_timeout 65; sendfile on。
- 防火墙与内核优化示例:net.core.somaxconn=1024; net.ipv4.tcp_tw_reuse=1; iptables 仅允许必要端口(80/443/3478/SIP端口)。
- CDN与DDoS防护:Cloudflare/Alibaba CDN + 弹性清洗链路,设置速率限制与地理访问策略,DDoS清洗阈值示例:流量>200 Mbps时触发。
- 备份与监控:启用Prometheus + Grafana监控网络丢包、延迟、连接数;设置报警(丢包>5%、HTTP 5xx>1%)。
6.
以下表格展示了一个典型故障排查中使用的服务器规格与网络采样指标,用于与运营商/服务商沟通时参考。
7.

- 快速响应清单:采集IMEI/IMSI、抓包、traceroute、RSSI/RSRP、时间地点并提交给运营商与服务商。
- 与运营商沟通要点:请求RAN与核心网日志、漫游路由检查、基站状态与重启记录。
- 与VPS/CDN/域名服务商沟通要点:提交pcap、traceroute、BGP/ASN信息、请求临时流量白名单或清洗。
- 灾备策略:在关键区域布置多点出口(多地VPS或CDN PoP),启用BGP备份、监控与自动告警。
- 如果自行排查无果,建议寻求第三方网络咨询或直接委托服务商工程师现场协助以缩短故障恢复时间。