一台电脑如果只是看网页、写文档、看视频都正常,一打开3D游戏就死机,十有八九是电源或散热出了问题。这不是随机故障,而是负载变化把部件的薄弱环节暴露了出来。
3D游戏和普通应用最大的区别是功耗。以一块中端显卡为例,桌面待机时功耗在10瓦左右,看高清视频时可能到30瓦,但在3D游戏里,核心和显存会同时高负载运行,功耗可以到150瓦以上。旗舰卡更夸张,比如RTX 3070在满载时整卡功耗约220瓦,瞬时峰值能超过280瓦。再加上CPU、主板、机械硬盘等等,整机功耗从待机的50瓦左右跳到300瓦以上。这个过程通常只需要几秒。如果电源的额定功率不够,或者用了太久导致输出电容老化,12V电压会被瞬间拉低,系统就会死机、重启,甚至直接断电。
怎么判断是不是电源?拿一个功率计插座测试一下游戏时整机功耗,再对比电源铭牌上的12V输出能力。很多电源标称额定功率是450瓦,但12V输出电流只有30安,也就是360瓦,那么在一台CPU功耗150瓦、显卡功耗200瓦的机器上,满载必然超负荷。另一个简单的办法是打开HWiNFO或GPU-Z,记录游戏时显卡的12V电压读数。ATX规范允许12V波动在5%以内,也就是11.4V到12.6V。如果游戏过程中电压掉到11.3V以下,基本可以确定是电源问题。注意软件读数可能有误差,但反复出现同样情况就值得怀疑。
散热问题同样常见。显卡在高负载下发热量非常可观。一块GTX 1060游戏时核心温度可能到80多度,如果机箱风道差、散热器积灰,或者用了五六年硅脂已经干裂,温度会轻松超过90度。NVIDIA显卡默认温度上限一般在83度,超过后会自动提高风扇转速并降频,如果仍压不住,到93度左右就会触发关机保护;AMD的Radeon显卡核心温度上限通常更高,但超过100度也容易出问题。开机后打开MSI Afterburner的监控功能,运行游戏,观察死机前几秒的温度曲线。如果显卡温度已经到90度以上,而且风扇转速拉满还是没有改善,清灰换硅脂、改善机箱通风是必须的。CPU过热也会造成死机,开3D游戏时CPU占用率升高,比如六核处理器从待机的20瓦升到80瓦,塔式散热器如果风扇失效,温度会迅速到100度并触发保护。判断方法是看CPU温度,一般超过95度就有风险。
显存故障也要考虑。最近几年显卡市场有大量矿卡翻新,显存在高温高负载下长期运行,焊点老化、颗粒寿命衰减。普通2D应用只调用少量显存带宽,不触发问题;3D游戏会写入几GB的显存,一旦某个颗粒出错,轻则花屏,重则整机卡死。这种问题不容易用普通软件查出,可以用OCCT的显存压力测试跑几分钟,如果中途死机,基本坐实显存或者显卡本身的问题。但注意,显存测试也会让显卡处于超高负载,要提前做好散热。另外,如果显卡有保修,直接送修更稳妥。

驱动有时也会导致死机,但通常表现不同。驱动崩溃往往是游戏画面突然卡住,然后弹回桌面或者黑屏几秒后恢复,如果整个系统完全失去响应,鼠标键盘都不动,硬件级故障的概率远大于驱动。不过为了保险起见,可以用DDU彻底卸载显卡驱动,再安装最新的官方驱动跑一次游戏。这一步成本最低,但也不能完全排除硬件问题。
内存不稳定偶尔也会造成3D游戏死机。特别是超频过的内存,在2D环境下看不出问题,一跑大型游戏就蓝屏或者卡死。用MemTest86启动盘跑完整循环,如果检测到错误,把内存频率降到默认再测试。这种情况相对少见,但如果电源和散热都正常,还是要查一下。
综合来看,遇到这种问题,优先换一个可靠的电源试试。手头没有备用电源,就先把显卡和散热器拆下来清灰,重新涂抹硅脂。如果还是死机,再考虑显卡本身和内存。顺序很重要,因为电源和散热是成本最低、最容易替换的两个部分。多数情况下,问题就出在这两处。不要一上来就重装系统,那基本没有用。用温度监控和功耗监控拿到数据,再决定动哪个部件,能省去很多折腾时间。