很多站点运营者把注意力放在内容、结构和連結上,服務器本身却常常只在出問题时才被想起。磁盘空間就是典型:它不會立刻报警,但当日誌、缓存、临时文件慢慢堆积,站点可能先變慢,接着寫入失敗,最後连資料库都可能啟動異常。與其等問题出現,不如把日誌和磁盘空間纳入日常巡检。
為什么日誌和磁盘容易被忽略
服務器日誌本身是排查問题的好帮手,訪問日誌、错誤日誌、慢查询日誌、爬虫抓取记錄,都能帮助判断站点狀態。但日誌預設往往會一直追加,如果從不轮轉和清理,几個月後單個文件就可能占用數 GB。再加上图片缓存、备份包、临时上传文件,磁盘占用會在不知不觉中上升。
更麻烦的是,很多服務器只在磁盘接近寫满时才發通知,而那时候留给运营者處理的時間已经不多。提前建立检查和清理习惯,比事後救火更省力。
先看磁盘占用:找出增長最快的位置
排查时不要一上来就删文件,先看清楚空間到底被谁占用了。可以從整体到目錄逐层展開,重点關注日誌目錄、缓存目錄、备份目錄和上传目錄。
常用排查思路
- 先看整体磁盘使用率,確認是某個分区满,還是全局都紧張。
- 按目錄大小排序,找出占用最大的几层路径。
- 查看大文件列表,留意異常大的日誌、压缩包和資料库临时文件。
- 對比几天前的資料,判断哪些文件在持續快速增長。
- 检查是否有舊的备份包、測試环境文件或已下线項目的残留。
這里的關键是“先定位、再處理”。如果直接刪除目錄,可能誤删仍在使用的缓存或配置文件,反而引起新的故障。
日誌治理:轮轉、保留與清理
日誌不是不能留,而是要有保留策略。對大多數中小站点来说,訪問日誌保留數周到數月、错誤日誌保留更久一些,通常已经够用。具体保留多久,要结合排查需求和磁盘容量来定。
訪問日誌與错誤日誌
- 確認日誌是否已经配置轮轉,避免所有记錄寫進同一個文件。
- 設定合理的轮轉周期和保留份數,例如按天切分、保留若干份歷史文件。
- 對压缩後的舊日誌定期清理,不要只轮轉不刪除。
- 错誤日誌單獨關注,尤其是反复出現的警告和致命错誤。
- 如果日誌量異常大,先查原因,再决定是否降低记錄級別。
有些抓取频率異常、頁面报错循环、接口被频繁調用,都會让日誌量突然上升。日誌治理不只是省空間,也能暴露站点執行中的異常信号。
清理时的注意事項
清理磁盘空間时,建议遵循几個原則:不确定用途的文件先备份或改名观察;正在被進程占用的日誌不要直接刪除,優先用轮轉或清空内容的方式處理;資料库文件、證书、配置文件不要凭感觉清理;清理後观察站点訪問、图片加载和後台功能是否正常。
把“清理”当成一次小變更来對待:先记錄改了什么,再观察一段時間。這样即使出現問题,也能快速回退。
建立定期巡检清單
服務器维護不需要很复杂,但需要固定节奏。可以每周或每两周做一次快速检查,按月做一次較完整的清理和复盘。
- 查看磁盘使用率,记錄趋势,而不是只看目前數字。
- 检查日誌轮轉是否正常执行,保留份數是否符合预期。
- 清理過期备份、临时文件和不再使用的舊版本文件。
- 確認缓存目錄没有失控增長,必要时調整缓存策略。
- 检查错誤日誌中是否有反复出現的異常,及时记錄並處理。
- 清理完成後,简單訪問几個核心頁面,確認站点响應正常。
站点运营中的很多問题,都来自“平时没人看”的角落。日誌和磁盘空間恰好属于這一類。把它們纳入常規巡检,不需要多高深的技術,却能在關键时刻避免站点因為空間不足而停摆。對运营者来说,稳定本身也是一種体驗。