Files
general_tools/copilot_workspace/repair/PRD copy.txt
T
2026-01-22 20:42:07 +08:00

181 lines
12 KiB
Plaintext
Raw Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
====================
人工输入(2026-01-16
====================
我的windows11电脑遇到了一个非常偶发的卡死问题,接下来你需要和我一起尝试定位解决这个问题。你需要把你的发言也记录在这篇文档内,以便后续查阅。
以下是我遇到的问题以及我尝试过的解决方案
我的电脑是一台联想拯救者刃9000k 2023,搭载RTX 4090, i9-13900KFz690主板
最近半年左右,电脑会偶发的出现黑屏卡死的问题。表现为,从睡眠/休眠/息屏状态下敲击键盘或者移动鼠标尝试唤醒的时候,有一定概率会卡在正在锁定的界面上。此时画面会完全卡死,双屏显示器中,主显示器卡在正在锁定的转圈界面,副显示器直接失去信号输入。
此时,键盘的Caps Lock键是没有反应的(正常状态下Caps Lock键应该按下以后会显示是否开启大写锁定,所以我认为这可能是一个重要的信号,但我不知道这意味着什么)
在这个状态下如果我不做任何操作,电脑会一直卡死在这个状态下,电脑上安装的机械硬盘持续仍然在工作,风扇也在转,但是不会有任何响应。唯一的方法就是长按电源键强制重启
在强制重启完成以后查看windows事件查看器,找不到任何有用的信息,只能看到一个非正常关机的报错。
我当前尝试过的操作包括:
1. 关闭了快速启动
2. 把我的windows版本更新到了最新版本
3. 重装了电源管理驱动
4. 在卡死状态下通过长按win+ctrl+shift+B尝试重启显卡驱动,没有成功
在卡死状态下,尝试通过windows自带的远程桌面进入系统,会一直卡在正在配置远程电脑这一步,看起来像是初始的网络连接已经建立成功,但是电脑在某个阶段没有响应导致一直卡在这里。我之前遇到过一次,还没有卡死的情况下直接远程到这台电脑,成功建立远程连接,然后我关闭远程连接,尝试将其从息屏状态下唤醒,就卡死了,然后再尝试远程桌面,就卡在配置远程电脑这一步了
因为这个卡死是一个偶发的问题,我也不能100%复现,所以非常头疼,我需要你的帮助
====================
Copilot 记录(2026-01-16
====================
【我对现象的结构化归纳】
- 设备:拯救者刃9000k 2023RTX 4090 + i9-13900KF + Z690;双显示器。
- 触发场景:从“睡眠/休眠/息屏”被键鼠唤醒时,有概率卡在锁屏“正在锁定/转圈”界面;副屏无信号。
- 卡死特征:Caps Lock 指示无响应(倾向于系统/输入栈整体失去调度,而非单纯显示问题);风扇/机械盘仍工作;只能硬关机。
- 复现后:事件查看器几乎只有非正常关机;Win+Ctrl+Shift+B 无效;RDP 连接会卡在“正在配置远程电脑”。
【初步判断(先不下结论)】
这更像“唤醒路径上的系统级挂起”:可能发生在 GPU/显示驱动恢复、PCIe/电源管理、或会话/锁屏相关组件恢复阶段。副屏掉信号 + Win 图形重置快捷键无效 + RDP 卡住,说明不只是显示器‘没亮’,而是系统在较早阶段就僵住了。
【下一步目标】
因为问题偶发且当前日志不足,我们优先做两件事:
1) 明确你机器当前到底在用哪种睡眠/待机模型(S3 vs 现代待机 S0),以及究竟是“睡眠/休眠/仅息屏”哪一种更相关;
2) 配置并采集“下一次发生时/发生后”的证据(电源与唤醒报告、关键事件日志、GPU LiveKernelReports、可靠性历史),让我们能定位到具体链路。
【我需要你回答的 3 个关键信息(尽量精确)】
1) 你确认“最容易出问题”的是:睡眠、休眠、还是仅关闭显示器(息屏)?(三者机制不同)
2) 你的显示器连接方式:主/副屏分别是 DP 还是 HDMI?是否经过扩展坞/转接头/延长线?
3) 最近一次更新的:BIOS 版本、NVIDIA 驱动版本(Game Ready/Studio)、以及是否开启 HAGS(硬件加速 GPU 调度)。
(下一条我会给出一套可执行的数据采集步骤,并在工作区提供一键导出脚本;你运行后把生成的压缩包里关键信息贴回来即可。)
====================
Copilot 记录:证据采集方案(2026-01-16)
====================
【采集原则】
- 先做一次“基线采集”(现在电脑正常时做);下次复现卡死并强制重启后,立刻再做一次“复现后采集”。
- 复现后采集重点是:最后一次进入睡眠/唤醒、显示驱动恢复、内核电源事件、WHEA 硬件错误、以及是否生成 LiveKernelReports。
【手动采集(你可以先不等脚本,直接跑这些命令)】
请用“管理员 PowerShell”依次执行(每条单独一行):
1) 查看系统支持的睡眠模型(非常关键)
- `powercfg /a`
2) 生成睡眠/唤醒诊断报告(适用于大多数机器)
- `powercfg /systemsleepdiagnostics`
3) 查看最近一次唤醒来源
- `powercfg /lastwake`
4) 检查是否存在阻止睡眠/唤醒的请求
- `powercfg /requests`
5) 若你的机器支持“现代待机 S0”,再额外生成 SleepStudy
- `powercfg /sleepstudy`
【需要你回传/提供的结果】
- 把 `powercfg /a` 的输出原文贴到这里(它会告诉我们是 S3 还是 S0)。
- `powercfg /systemsleepdiagnostics` 和(如有)`powercfg /sleepstudy` 生成的报告文件路径与文件本身(之后我会让脚本自动打包)。
【复现后必查的目录(强烈建议)】
- `C:\Windows\LiveKernelReports\`(特别是 `WATCHDOG`、`DISPLAY`、`PoW32kWatchdog` 等子目录)
- 如果这里出现新的 `.dmp`,通常对定位 GPU/显示/电源路径很有帮助。
【事件日志导出(复现后优先做)】
先不要求你手工导出全部;你只需要告诉我以下几个日志里是否出现“黄色/红色”的关键事件(脚本会自动导出更完整的):
- 事件查看器 → Windows 日志 → 系统:
- 重点来源:`Kernel-Power`、`Kernel-Boot`、`Power-Troubleshooter`、`Display`、`WHEA-Logger`、`volmgr`
- 事件查看器 → 应用程序和服务日志 → Microsoft → Windows
- 重点:`DxgKrnl`、`DriverFrameworks-UserMode`、`Kernel-PnP`
【一个重要解释:Caps Lock 无响应意味着什么】
Caps Lock 灯不切换通常表示:系统已经严重挂起/中断风暴/内核死锁等,连键盘输入处理都无法及时响应;这比“仅显示黑屏”更偏向系统级冻结。
下一步我会在工作区加一个一键采集脚本:自动收集上述报告、关键事件日志、LiveKernelReports、驱动与版本信息,并打包成 zip,方便你每次复现后直接发我分析。
====================
Copilot 记录:一键采集脚本(2026-01-16)
====================
我已在工作区新增脚本:
- `Copilot_id_card\tools\collect-freeze-diag.ps1`
【如何运行(推荐:管理员 PowerShell)】
在 `d:\CodingProject\AI_Playground\Copilot_id_card` 目录下执行:
- `powershell -ExecutionPolicy Bypass -File .\tools\collect-freeze-diag.ps1`
可选参数:
- `-RecentDays 30`(默认 14,控制收集最近多少天的 LiveKernelReports 文件)
【产物】
- 输出目录:`Copilot_id_card\diag_out\freeze-时间戳\`
- 同目录会生成一个 zip`freeze-时间戳.zip`
【你需要给我的内容】
- 直接把生成的 `freeze-*.zip` 发我(或把其中 `powercfg-a.txt`、`system-last600.txt`、以及 `LiveKernelReports` 里新增的文件信息贴出来)。
【注意】
- 不用等复现,现在先跑一次当“基线”;下次卡死强制重启后再跑一次当“复现后样本”。两份 zip 对比非常关键。
====================
Copilot 记录:逐步排除清单(2026-01-16)
====================
【操作纪律】
- 一次只改 1 项;至少观察 3-7 天或经历若干次睡眠/唤醒循环。
- 每改一次,跑一次 `collect-freeze-diag.ps1` 留存样本(便于回滚与对比)。
【第 0 步:先确定睡眠模型与触发面】
- 先执行并贴出:`powercfg /a`
- 如果显示支持/正在用 S0(现代待机),后续排查路径会偏向“现代待机 + 驱动恢复”。
- 如果是 S3,路径会偏向“传统睡眠恢复 + PCIe/显卡/多屏握手”。
【低风险(优先)】
1) BIOS/固件与主板驱动
- 更新到联想/主板最新 BIOS;同时更新 Intel ME(管理引擎)与芯片组驱动。
- 验证:更新后连续多次睡眠/唤醒是否仍复现;并查看复现后样本里是否出现 WHEA 相关事件。
2) NVIDIA 驱动“干净重装”并做版本对照
- 用 DDU(安全模式)卸载后,安装一个明确版本做对照:优先尝试 Studio Driver(或换到相邻的大版本)。
- 验证:复现概率是否变化;复现后 `DxgKrnl/Display` 是否出现新的错误;`LiveKernelReports` 是否新增。
3) Windows 图形相关开关(可逆)
- 关闭 HAGS:设置 → 系统 → 显示 → 图形 → 默认图形设置 → 关闭“硬件加速 GPU 调度”。
- 如仍复现,再考虑关闭 MPO(多平面叠加):我建议等我们先拿到一次样本后再做,避免变量过多。
4) 电源计划里禁用容易引发唤醒问题的省电项(可回滚)
- 控制面板 → 电源选项 → 高级设置:
- “睡眠”:关闭“混合睡眠”(若开启);
- “PCI Express”:将“链接状态电源管理”设为“关闭”;
- “USB 设置”:将“USB 选择性暂停”设为“已禁用”。
【中风险(需要更谨慎)】
5) 多显示器链路排除
- 临时只接主屏使用一段时间,或更换 DP/HDMI 线材与接口(避免转接头/延长线);
- 若显示器支持,尝试关闭 DSC/降低刷新率做对照(仅用于定位)。
6) 稳定性与超频因素
- 若有开启 XMP/CPU 自动超频/显卡超频,建议先回到默认(特别是 WHEA 有记录时)。
【高风险/最后手段(我们拿到证据后再决定)】
7) 配置更强的“卡死取证”(例如强制触发转储/更激进的验证器)
- 这类手段可能影响日常使用与稳定性,建议等我们先从日志判断方向再上。
【你现在可以做的两件事(最有效)】
1) 运行一次脚本生成“基线 zip”;
2) 把 `powercfg /a` 输出 + 你显示器连接方式(DP/HDMI/是否转接)+ BIOS 与 NVIDIA 驱动版本 回到这份文档里。
====================
人工输入(2026-01-16
====================
我现在没在我那台故障的机器跟前,我会尽可能先回答你的问题,但是暂时没办法做测试。我们先收集我已知的信息并尝试确定定位解决方向,等到我可以操作故障的机器了我会通知你。
关于你需要我回答的三个问题:
1) 你确认“最容易出问题”的是:睡眠、休眠、还是仅关闭显示器(息屏)?(三者机制不同)
我无法确认这三者哪个更容易出问题,看起来三者都有可能故障。不过我最常用的状态是息屏和休眠。休眠是我通过powercfg -h on来开起来的,我也不知道是那种。
2) 你的显示器连接方式:主/副屏分别是 DP 还是 HDMI?是否经过扩展坞/转接头/延长线?
我的两台显示器分别通过HDMI和DP连接到4090上,没有经过任何扩展坞/转接头/延长线。我尝试把这两台显示器调换过,也没能解决息屏问题。
3) 最近一次更新的:BIOS 版本、NVIDIA 驱动版本(Game Ready/Studio)、以及是否开启 HAGS(硬件加速 GPU 调度)。
我暂时看不到这些信息,但我需要你提供如何查看这些信息的step-by-step指引。