Hi there!
I get random amdgpu ring gfx_0.0.0 timeout crashes while playing WoW Midnight. Everything was fine during TWW. Every other game is fine. The screens go black then return. Most of the time only the game (and steam) crash in this process, sometimes I get an additional “device wedged” and screens freeze. I launch WoW using wine-cachyos 10.0-20260227 with ntsync on and mangohud.
Here’s what I tried:
- I tried reverting to mesa 25.3.6, but then PLM won’t show anything, just a blinking cursor in the top left corner.
- I disabled overclocking (removed kernel parameter), but that didn’t change anything.
- I tried limiting core clock to 2500 MHz (amdgpu detects 2935 MHz), without success.
Here’s the kernel log:
Mär 15 20:28:32 minotar kernel: amdgpu 0000:33:00.0: amdgpu: MODE1 reset
Mär 15 20:28:32 minotar kernel: amdgpu 0000:33:00.0: amdgpu: GPU mode1 reset
Mär 15 20:28:32 minotar kernel: amdgpu 0000:33:00.0: amdgpu: GPU smu mode1 reset
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: GPU reset succeeded, trying to resume
Mär 15 20:28:33 minotar kernel: [drm] PCIE GART of 512M enabled (table at 0x0000008001300000).
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: VRAM is lost due to GPU reset!
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: PSP is resuming...
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: reserve 0x1300000 from 0x85fc000000 for PSP TMR
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: RAP: optional rap ta ucode is not available
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: SECUREDISPLAY: optional securedisplay ta ucode is not available
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: SMU is resuming...
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: smu driver if version = 0x0000003d, smu fw if version = 0x00000040, smu fw pro>
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: SMU driver if version not matched
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: SMU is resumed successfully!
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: [drm] DMUB hardware initialized: version=0x07002F00
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring gfx_0.0.0 uses VM inv eng 0 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring comp_1.0.0 uses VM inv eng 1 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring comp_1.1.0 uses VM inv eng 4 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring comp_1.2.0 uses VM inv eng 6 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring comp_1.3.0 uses VM inv eng 7 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring comp_1.0.1 uses VM inv eng 8 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring comp_1.1.1 uses VM inv eng 9 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring comp_1.2.1 uses VM inv eng 10 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring comp_1.3.1 uses VM inv eng 11 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring sdma0 uses VM inv eng 12 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring sdma1 uses VM inv eng 13 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring vcn_unified_0 uses VM inv eng 0 on hub 8
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring vcn_unified_1 uses VM inv eng 1 on hub 8
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring jpeg_dec uses VM inv eng 4 on hub 8
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: ring mes_kiq_3.1.0 uses VM inv eng 14 on hub 0
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: amdgpu: GPU reset(1) succeeded!
Mär 15 20:28:33 minotar kernel: amdgpu 0000:33:00.0: [drm] device wedged, but recovered through reset
Mär 15 20:28:44 minotar kernel: amdgpu 0000:33:00.0: [drm] *ERROR* [CRTC:254:crtc-1] flip_done timed out
Mär 15 20:28:44 minotar kernel: amdgpu 0000:33:00.0: amdgpu: [drm] *ERROR* [CRTC:254:crtc-1] hw_done or flip_done timed out
Here’s the output of sudo cachyos-bugreport.sh: 4328f47 I just noticed that the crash is not part of this bugreport as I did multiple reboots inbetween. I will upload a new one after the next crash (shouldn’t take long).
How can I revert mesa to an older version and not break PLM? What can I do to mitigate this issue if a downgrade is not possible?
Best regards,
Mr nUUb