买了VPS之后,新手遇到的第一个问题往往不是怎么搭网站,而是"为什么SSH连不上了?""为什么网站突然打不开了?""为什么打开这么慢?"。
很多新手一遇到问题就慌,直接去找客服,结果客服排队半小时,其实80%的问题自己5分钟就能解决。本文把VPS使用中最常见的故障整理成系统的排查流程,跟着步骤走,能解决90%的常见问题。
💡 故障排查黄金法则:
1. 从简单到复杂,先查最可能的问题
2. 先看日志,不要靠猜,日志会告诉你准确原因
3. 改配置之前一定要先备份!
4. 一次只改一个地方,改完测试,不要一次改一堆
5. 不要随便在网上搜个命令就复制执行,先搞清楚命令是干嘛的
一、最常见问题统计
根据我们的客服工单统计,VPS使用中常见问题分布如下:
其中SSH连不上、网站5xx错误、速度慢这三类问题加起来占了接近70%,大部分都是配置错误或者小问题,不需要等客服自己就能解决。
二、通用故障排查思路
不管遇到什么问题,都可以按这个流程一步步排查,不要东一榔头西一棒子乱试:
先确认网络通不通,再确认端口开没开,再看服务日志找具体错误,大部分问题到这一步就能定位原因了。
三、问题1:SSH连接不上(最常见,占25%)
SSH是你管理VPS的入口,连不上SSH等于服务器失控,是新手遇到最多的问题。遇到SSH连接失败,先看错误提示是什么,不同错误原因完全不一样:
排查步骤:
- 先ping一下服务器IP:
ping 你的服务器IP,看看能不能ping通 - 如果ping不通:先检查服务器是不是关机了、是不是被DDoS了、IP是不是被封了,直接去VNC控制台登录看看
-
如果能ping通:继续下一步
-
测试22端口通不通:
telnet 你的服务器IP 22或者用nc -zv 你的服务器IP 22 - 如果端口不通:检查防火墙有没有开22端口、SSH服务有没有启动、安全组有没有放行
-
如果端口通:继续下一步
-
检查SSH服务状态:通过VNC登录服务器,执行
systemctl status sshd看服务是不是running - 如果服务没启动:
systemctl start sshd启动,systemctl enable sshd设置开机自启 -
如果服务启动了:看日志
journalctl -u sshd -n 50找错误原因 -
常见错误对应原因:
- Connection refused:SSH服务没启动,或者端口改了不是22
- Connection timed out:防火墙/安全组没放通22端口,或者IP被墙了
- Permission denied:密码错了,或者密钥不对,或者root登录被禁用了
- Too many authentication failures: fail2ban把你IP ban了,等10分钟或者换个IP登录
⚠️ 重要提醒:LuckVM所有节点都提供网页VNC控制台,哪怕SSH连不上,也可以通过后台VNC登录服务器排查问题,不要一上来就重装系统。
四、问题2:网站打不开(占22%)
网站打不开先看浏览器返回的错误码是什么,不同错误码对应完全不同的原因:
最常见的502 Bad Gateway排查:
502错误90%的原因是后端服务(PHP/Nginx反代的服务)没启动或者挂了:
1. 先看Nginx错误日志,错误日志会告诉你准确原因:
# 看最后50行Nginx错误日志
tail -n 50 /var/log/nginx/error.log

- 如果看到
connect() failed (111: Connection refused)说明后端服务没起来: - WordPress网站:PHP-FPM没启动,执行
systemctl start php8.2-fpm(版本号按你实际的来) - Node.js/Java等服务:对应的进程挂了,重启服务就行
- 如果看到
upstream timed out:说明后端响应太慢,超时了,检查是不是数据库慢查询或者CPU跑满了
403 Forbidden常见原因:
- 文件/目录权限不对(网站目录权限应该是755,文件644)
- Nginx配置里deny了你的IP
- .htaccess规则错误
- 索引文件不存在(index.html/index.php)
504 Gateway Timeout:
- 后端处理时间太长,超过了Nginx的超时时间
- 数据库查询太慢卡死了
- PHP执行时间太短,改php.ini里的max_execution_time
五、问题3:网站打开速度很慢
网站突然变慢不要急着怪服务器,先排查原因,大部分时候不是服务器的问题:
- 先看服务器负载:SSH登录后执行
top命令 - 看%CPU是不是跑满100%了,哪个进程占CPU最高
- 看Mem内存是不是用完了,有没有大量swap
-
看load average三个值(1分钟/5分钟/15分钟),如果大于CPU核心数说明过载了
-
看磁盘IO:执行
iotop看是不是磁盘IO跑满了 - MySQL大量写入、日志暴涨、备份任务运行中都会导致IO高
-
如果是NVMe SSD正常IO应该很高,普通SATA磁盘IO满了就会卡
-
看带宽是不是跑满了:执行
vnstat -l看实时带宽占用 - 被爬虫爬、被DDoS、大文件被下载都会跑满带宽
-
LuckVM所有节点都是独享带宽,正常不会被别人影响,跑满了就是自己的流量
-
客户端网络测试:
- 用本地ping看延迟高不高、有没有丢包
- 用mtr看路由在哪一跳丢包
- 换个网络/手机4G试试,是不是你本地网络的问题

六、问题4:磁盘满了(占12%)
磁盘满了会导致各种奇怪的问题:MySQL启动不了、网站502、会话保存失败、日志写不进去。
- 先看磁盘占用:
df -h看哪个分区满了 - 找大文件:
du -sh /* | sort -hr从根目录开始一层一层找哪个目录占空间最大 - 常见占用大户:
- Nginx/Apache日志:
/var/log/nginx/,定期清理旧日志 - MySQL binlog:如果开了binlog会占大量空间
- 备份文件:旧的备份包忘记删了
- Docker镜像/容器:
docker system prune清理没用的镜像 - 清理完确认:
df -h看空间释放了没有
💡 建议:磁盘用到80%就要注意清理了,不要等到100%才处理,会导致数据损坏。
七、问题5:邮件发不出去(占10%)
- 先测25端口通不通:
telnet smtp.qq.com 25 - 如果连不上:很多服务商默认封25端口防滥发,LuckVM默认开放25端口
- 如果端口通:继续排查
- 检查DNS解析:SPF/DKIM/DMARC记录有没有配置正确
- 检查IP是不是在邮件黑名单:去 mxtoolbox.com 查你的IP有没有被列入黑名单
- 看邮件日志:
tail -n 50 /var/log/maillog看退信原因
八、什么时候需要找客服,怎么找最快解决
自己排查了15-20分钟还解决不了,就联系客服,联系的时候一定要提供这些信息,能少一半沟通时间:
联系客服时需要提供:
1. 你的服务器IP地址(不要只说"我的服务器",客服不知道是哪台)
2. 问题发生的准确时间(几点几分开始出问题的)
3. 具体错误现象(错误截图/错误码,不要只说"连不上了")
4. 出问题之前你做了什么操作(改了配置?装了软件?重启了服务器?诚实说出来,不要隐瞒,能省很多时间)
5. 你自己已经做了哪些排查(不用让客服再重复一遍你已经试过的步骤)
💡 提示:LuckVM客服7*24小时在线,提供信息越完整,解决速度越快。不要上来就说"你们服务器垃圾连不上",好好沟通效率高得多。
九、必备排查命令速查表
| 命令 | 作用 |
|---|---|
top / htop |
看CPU、内存、进程负载 |
df -h |
看磁盘分区占用 |
du -sh * | sort -hr |
找当前目录下最大的文件/目录 |
free -h |
看内存使用情况 |
netstat -tulnp |
看本机哪些端口在监听 |
ss -tulnp |
netstat替代命令,更快 |
journalctl -u 服务名 -n 50 |
看某个服务最近50行日志 |
tail -n 50 /var/log/nginx/error.log |
看Nginx错误日志 |
systemctl status 服务名 |
看某个服务运行状态 |
systemctl restart 服务名 |
重启某个服务(万能解决80%小问题) |
ping IP/域名 |
测试网络连通性 |
mtr -rw IP |
测试路由丢包情况 |
iptables -nL |
看防火墙规则 |
uptime |
看系统运行时间和负载 |
十、日常预防比事后排查重要
- 定期备份:重要数据每天自动备份,备份到异地,不要只存在服务器本地
- 改SSH端口+禁用密码登录用密钥:减少被暴力破解的概率
- 开fail2ban:自动封暴力破解的IP
- 配置监控告警:CPU/内存/磁盘/服务挂了自动发邮件提醒
- 不要随便装来历不明的脚本:很多脚本带后门或者乱改配置
- 改配置之前先备份原文件:改坏了还能恢复
- 开BBR加速:提升网络传输速度
FAQ 常见问题
Q:服务器突然ping不通了怎么办?
A:先去后台看服务器是不是运行中,有没有被DDoS,用VNC登录进去看防火墙规则,检查IP是不是被墙了。
Q:重启服务器后网站打不开了?
A:大概率是相关服务没设置开机自启,systemctl enable设置开机自启,重启一下Nginx/PHP/MySQL就行。
Q:为什么我本地打开慢,别人打开快?
A:你本地网络的问题,换手机4G试试,或者换个地区的节点测试,不是服务器的问题。
Q:配置改坏了网站打不开,又忘了原来什么样怎么办?
A:有备份就恢复备份,没备份就老老实实从日志找错误,下次记得改之前备份。
Q:top里看到kdevtmpfsi/kinsing这种进程占满CPU是什么?
A:挖矿木马,服务器被黑了,赶紧备份数据重装系统,排查密码是不是太弱了。
Q:磁盘明明还有很多空间,但是写文件提示No space left on device?
A:inode用完了(小文件太多),df -i 看inode使用情况,清理大量小文件。
Q:能ping通,端口也通,但是SSH就是连不上卡在哪里?
A:看/etc/hosts.deny是不是被加了拒绝规则,或者fail2ban把你IP ban了。
Q:网站偶尔502,过一会自己又好了?
A:PHP进程数设置太少,流量高峰的时候进程用完了就502,调大php-fpm的pm.max_children参数。
Q:为什么国外打开很快,国内打开很慢?
A:线路问题,选直连国内三网的线路(比如CN2 GIA),不要选普通国际线路。
Q:遇到解决不了的问题能不能重装系统?
A:如果实在排查不出来,备份好所有数据后可以重装系统,但这是最后手段,不要一遇到问题就重装。
故障排查检查清单
遇到问题按这个清单一项项查:
- [ ] 先ping服务器IP,确认服务器是活着的
- [ ] telnet对应端口(22/80/443),确认端口是通的
- [ ] 去VNC控制台登录,不用依赖网络
- [ ] systemctl status看对应服务状态
- [ ] 看服务错误日志找具体错误信息
- [ ] 看top/df/free确认服务器资源没跑满
- [ ] 检查防火墙/安全组规则有没有问题
- [ ] 改配置之前有没有备份?改坏了恢复备份
- [ ] 重启相关服务试试(万能大招)
- [ ] 自己排查20分钟解决不了,带着完整信息找客服
相关阅读
- Linux服务器安全加固15条:从入门到入狱的防黑指南
- VPS被DDoS攻击怎么办?防御与恢复完整指南
- VPS数据自动备份完整指南:3-2-1备份策略
- 2026年海外VPS选购终极指南:不被坑的选购方法
- 1Panel面板完整使用教程:从安装到建站全流程
- VPS网站搬家完整教程:零 downtime 迁移指南
本文由 LuckVM技术团队 原创发布,LuckVM提供香港CN2 GIA、新加坡Premium、日本东京、美国洛杉矶四大高速节点,全部节点NVMe SSD+独享带宽+默认50G DDoS防护,支持7天无理由退款,新用户购买可联系客服免费协助环境配置和网站迁移。





