You are not logged in.

#1 2026-07-28 20:54:42

lainlover
Member
Registered: 2024-04-01
Posts: 21

[SOLVED] nvidia-drm runs out of memory, locks up, freezes wayland

This is an issue I've begun noticing recently (in the last couple weeks). Particularly when my machine resumes from suspension, after running heavy graphical applications for a while (especially videogames), it will just suddenly lock up. Sometimes I can Ctrl+Alt+F(1-9) into a tty, often not even that and I need to perform a hard reset. Seems to be an issue with running out of GPU memory (NV_ERR_NO_MEMORY) and the driver not handling it gracefully

My GPU is a 3060Ti, DE is KDE Plasma (wayland), system is up-to-date.
Leaving the journalctl logs below past the point in the session that looks relevant

jul 28 21:01:10 systemd-helper[22634]: Running cleanup for 'root'.
jul 28 21:01:10 systemd-helper[22634]: Running number cleanup for 'root'.
jul 28 21:01:10 systemd-helper[22634]: Running timeline cleanup for 'root'.
jul 28 21:01:10 systemd-helper[22634]: Running empty-pre-post cleanup for 'root'.
jul 28 21:01:11 systemd[1]: snapper-cleanup.service: Deactivated successfully.
jul 28 21:02:11 systemd[1]: snapperd.service: Deactivated successfully.
jul 28 21:03:05 rtkit-daemon[1228]: Successfully made thread 22716 of process 22438 owned by '1000' RT at priority 20.
jul 28 21:03:05 pipewire[1219]: mod.client-node: detected old client version 4
jul 28 21:03:58 freetube[21307]: [21307:0728/210358.047677:ERROR:gpu/command_buffer/service/shared_image/shared_image_manager.cc:253] SharedImageManager::ProduceSkia: Trying to Produce a Skia representation from a non-existent mailbox.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: nvAssertOkFailedNoLog: Assertion failed: Out of memory [NV_ERR_NO_MEMORY] (0x00000051) returned from pReuseMappingDb->pMapCb(pReuseMappingDb->pGlobalCtx, pAllocCtx, range, cachingFlags, &token, _reusemappingdbAddMappingCallback) @ mapping_reuse.c:273
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: resource: resource sanity check: requesting [mem 0x000000fcefe40000-0x000000fcf016ffff], which spans more than 0000:01:00.0 [mem 0xfce0000000-0xfcefffffff 64bit pref]
jul 28 21:11:50 kernel: caller __nv_drm_gem_nvkms_map+0xc3/0x130 [nvidia_drm] mapping multiple BARs
jul 28 21:11:50 kernel: NVRM: GPU at PCI:0000:01:00: GPU-bc65f44a-8045-f2db-8dd9-40b5907257ae
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 0000021c 00010094 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 00000444 0001008f 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 0000021c 00010094 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 00000444 0001008f 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 0000021c 00010094 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 00000444 0001008f 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 0000021c 00010094 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 00000444 0001008f 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 0000021c 00010094 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 00000444 0001008f 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 0000021c 00010094 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 00000444 0001008f 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 0000021c 00010094 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 00000444 0001008f 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 0000021c 00010094 00000007 00000000
jul 28 21:11:50 kernel: NVRM: Xid (PCI:0000:01:00): 56, CMDre 00000007 00000444 0001008f 00000007 00000000
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: nvAssertOkFailedNoLog: Assertion failed: Out of memory [NV_ERR_NO_MEMORY] (0x00000051) returned from pReuseMappingDb->pMapCb(pReuseMappingDb->pGlobalCtx, pAllocCtx, range, cachingFlags, &token, _reusemappingdbAddMappingCallback) @ mapping_reuse.c:273
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: dmaAllocMapping_GM107: can't alloc VA space for mapping.
jul 28 21:11:50 kernel: NVRM: nvAssertOkFailedNoLog: Assertion failed: Out of memory [NV_ERR_NO_MEMORY] (0x00000051) returned from pReuseMappingDb->pMapCb(pReuseMappingDb->pGlobalCtx, pAllocCtx, range, cachingFlags, &token, _reusemappingdbAddMappingCallback) @ mapping_reuse.c:273
jul 28 21:11:50 kernel: NVRM: nvAssertOkFailedNoLog: Assertion failed: Out of memory [NV_ERR_NO_MEMORY] (0x00000051) returned from reusemappingdbMap(&pBar1VaInfo->reuseDb, pMappingType, mapRange, pMemArea, cachingFlags) @ kern_bus_gm107.c:3150
jul 28 21:11:50 kernel: [drm:__nv_drm_gem_nvkms_map [nvidia_drm]] *ERROR* [nvidia-drm] [GPU ID 0x00000100] Failed to map NvKmsKapiMemory 0x00000000cebe4b81
jul 28 21:11:50 kernel: traps: Media[21503] trap int3 ip:55b12ad4df88 sp:7f3c6b5fbd60 error:0 in freetube[8b8bf88,55b124fc7000+9a3a000]
jul 28 21:11:50 systemd-coredump[23042]: Process 21339 (freetube) of user 1000 terminated abnormally with signal 5/TRAP, processing...
jul 28 21:11:50 systemd[1]: Created slice Slice /system/systemd-coredump.
jul 28 21:11:50 systemd[1]: Started Process Core Dump (PID 23042/UID 0).
jul 28 21:11:52 kwin_wayland[1168]: Pageflip timed out! This is a bug in the nvidia-drm kernel driver
jul 28 21:11:52 kwin_wayland[1168]: Please report this at https://forums.developer.nvidia.com/c/gpu-graphics/linux
jul 28 21:11:52 kwin_wayland[1168]: With the output of 'sudo dmesg' and 'journalctl --user-unit plasma-kwin_wayland --boot 0'
jul 28 21:11:53 kwin_wayland[1168]: Pageflip timed out! This is a bug in the nvidia-drm kernel driver
jul 28 21:11:53 kwin_wayland[1168]: Please report this at https://forums.developer.nvidia.com/c/gpu-graphics/linux
jul 28 21:11:53 kwin_wayland[1168]: With the output of 'sudo dmesg' and 'journalctl --user-unit plasma-kwin_wayland --boot 0'
jul 28 21:12:39 kernel: NVRM: GPU0 _kgspIsHeartbeatTimedOut: Heartbeat timed out, currentTimeMs 2858131114 heartbeat 2858082572 heartbeatWithOffsetMs 2858082572 diff 48542 timeout 5200
jul 28 21:12:39 kernel: NVRM: GPU0 _kgspIsHeartbeatTimedOut: Heartbeat timed out, currentTimeMs 2858131114 heartbeat 2858082579 heartbeatWithOffsetMs 2858082579 diff 48535 timeout 5200
jul 28 21:12:39 kernel: NVRM: GPU0 nvAssertFailedNoLog: Assertion failed: !pKernelGsp->bPollingForRpcResponse @ kernel_gsp.c:2893
jul 28 21:12:39 kernel: NVRM: GPU0 _issueRpcAndWait: rpcRecvPoll failed with status 0x00000040 for fn 76 sequence 31265!
jul 28 21:12:39 kernel: NVRM: GPU0 _kgspClassifyGspTimeout: ================ GSP core unresponsive ===============
jul 28 21:12:39 kernel: NVRM: GPU0 _kgspLogRpcTimeout: ********************************* GSP Timeout **********************************
jul 28 21:12:39 kernel: NVRM: GPU0 _kgspLogRpcTimeout: Note: Please also check logs above.
jul 28 21:12:39 kernel: NVRM: Xid (PCI:0000:01:00): 119, pid=1168, name=kwin_wayland, Timeout after 11s of waiting for RPC response from GPU0 GSP! Expected function 76 (GSP_RM_CONTROL) sequence 31264 (0x20800a70 0x0).
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspDumpRmState: Failed to get RM state, timeout
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: Gsp Trace Crash Buffer
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394809344,8192,0,11110,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394810336,4096,0,11111,3,5
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394826912,8192,0,11112,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394829664,34359738368,0,11113,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510412934144,68719476736,0,11114,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510412937024,4096,0,11115,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510412938016,8192,0,11116,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510412939232,4096,0,11117,3,2
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 178526951041295945NVIDIA6,512,0,11118,3,165
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510412973728,1024,0,11119,3,165
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510412983552,8192,0,11120,3,2
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510412984320,4096,0,11121,3,4
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510412987456,8192,0,11122,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510412988288,4096,0,11123,3,5
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510356290464,8192,0,11074,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510356292256,4096,0,11075,3,23322040
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510356390720,8192,0,11076,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510356397120,34359738368,0,11077,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358395936,68719476736,0,11078,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358399584,4096,0,11079,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358400960,8192,0,11080,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358403936,4096,0,11081,3,2
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358430240,512,0,11082,3,165
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358451488,1024,0,11083,3,165
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358466976,8192,0,11084,3,2
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358467744,4096,0,11085,3,4
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358471520,8192,0,11086,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358472512,4096,0,11087,3,5
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358489216,8192,0,11088,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510358491776,34359738368,0,11089,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376571040,68719476736,0,11090,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376573984,4096,0,11091,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376574848,8192,0,11092,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376576064,4096,0,11093,3,2
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376597664,512,0,11094,3,165
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376613152,1024,0,11095,3,165
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376623104,8192,0,11096,3,2
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376623904,4096,0,11097,3,4
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376627136,8192,0,11098,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376628032,4096,0,11099,3,5
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376645248,8192,0,11100,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510376648032,34359738368,0,11101,3,0
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394752256,68719476736,0,11102,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394755264,4096,0,11103,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394756128,8192,0,11104,3,1
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394757344,4096,0,11105,3,2
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394779104,512,0,11106,3,165
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394793888,1024,0,11107,3,165
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394805408,8192,0,11108,3,2
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogGspTraceCrashBuffer: 1785269510394806176,4096,0,11109,3,4
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: riscvPc               : 930029d8
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: riscvCpuctl           : 00000080
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: riscvIrqmask          : 01049052
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: riscvIrqdest          : 01000050
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: riscvPrivErrStat      : 00000000
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: riscvPrivErrInfo      : badf5041
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: riscvPrivErrAddr      : 200000000010ec40
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: riscvHubErrStat       : 00000000
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: falconMailbox         : 0:00000000 1:00000000
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: falconIrqstat         : 00000000
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: falconIrqmode         : 0180fc24
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: fbifInstblk           : 00000000
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: fbifCtl               : 00000090
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: fbifThrottle          : 00000064
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: fbifAchkBlk           : 0:33af3ecd 1:2dd6fffe
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: fbifAchkCtl           : 0:00000000 1:00000000
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: PRI: fbifCg1               : 0000000f
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 00 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 01 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 02 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 03 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 04 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 05 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 06 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 07 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 08 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 09 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 10 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 11 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 12 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 13 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 14 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 15 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 16 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 17 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 18 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 19 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 20 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 21 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 22 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 23 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 24 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 25 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 26 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 27 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 28 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 29 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 30 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 31 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 32 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 33 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 34 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 35 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 36 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 37 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 38 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 39 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 40 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 41 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 42 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 43 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 44 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 45 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 46 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 47 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 48 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 49 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 50 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 51 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 52 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 53 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 54 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kflcnCoreDumpNondestructive_IMPL: TRACE: 55 = 0x0000000001b34580
jul 28 21:12:42 kernel: NVRM: GPU0 kgspDumpMailbox_TU102: GSP: MAILBOX(0) = 0xAA5AE10C
jul 28 21:12:42 kernel: NVRM: GPU0 kgspDumpMailbox_TU102: GSP: MAILBOX(1) = 0xAA5AE113
jul 28 21:12:42 kernel: NVRM: GPU0 kgspDumpMailbox_TU102: GSP: MAILBOX(2) = 0x00000000
jul 28 21:12:42 kernel: NVRM: GPU0 kgspDumpMailbox_TU102: GSP: MAILBOX(3) = 0x00000000
jul 28 21:12:42 kernel: NVRM: GPU0 GSP RPC buffer contains function 76 (GSP_RM_CONTROL) sequence 31265 and data 0x0000000020800a70 0x0000000000000000.
jul 28 21:12:42 kernel: NVRM: GPU0 RPC history (CPU -> GSP):
jul 28 21:12:42 kernel: NVRM:     entry function                     sequence data0              data1              ts_start           ts_end             duration actively_polling
jul 28 21:12:42 kernel: NVRM:      0    76   GSP_RM_CONTROL             31265 0x0000000020800a70 0x0000000000000000 0x000657b175e696d6 0x0000000000000000          y
jul 28 21:12:42 kernel: NVRM:     -1    76   GSP_RM_CONTROL             31264 0x0000000020802a08 0x0000000000000004 0x000657b17337eedc 0x0000000000000000           
jul 28 21:12:42 kernel: NVRM:     -2    103  GSP_RM_ALLOC               31263 0x0000000000000079 0x0000000000000018 0x000657b173010224 0x000657b173010327    259us  
jul 28 21:12:42 kernel: NVRM:     -3    10   FREE                       31262 0x00000000000000a3 0x0000000000000000 0x000657b172545ca3 0x000657b172545d9c    249us  
jul 28 21:12:42 kernel: NVRM:     -4    10   FREE                       31261 0x000000000000009d 0x0000000000000000 0x000657b172545b0d 0x000657b172545c5c    335us  
jul 28 21:12:42 kernel: NVRM:     -5    76   GSP_RM_CONTROL             31260 0x0000000090960101 0x0000000000000028 0x000657b171cf8e8a 0x000657b171cf8f89    255us  
jul 28 21:12:42 kernel: NVRM:     -6    103  GSP_RM_ALLOC               31259 0x0000000000000079 0x0000000000000018 0x000657b17112fd7c 0x000657b17112ff05    393us  
jul 28 21:12:42 kernel: NVRM:     -7    103  GSP_RM_ALLOC               31258 0x0000000000000079 0x0000000000000018 0x000657b170cb399d 0x000657b170cb3b33    406us  
jul 28 21:12:42 kernel: NVRM: GPU0 RPC event history (CPU <- GSP):
jul 28 21:12:42 kernel: NVRM:     entry function                     sequence data0              data1              ts_start           ts_end             duration during_incomplete_rpc
jul 28 21:12:42 kernel: NVRM:      0    4102 OS_ERROR_LOG                   0 0x0000000000000000 0x0000000000000000 0x000657b172ffcd5a 0x000657b172ffcd5c      2us  
jul 28 21:12:42 kernel: NVRM:     -1    4102 OS_ERROR_LOG                   0 0x0000000000000000 0x0000000000000000 0x000657b172ffcb18 0x000657b172ffcb1d      5us  
jul 28 21:12:42 kernel: NVRM:     -2    4102 OS_ERROR_LOG                   0 0x0000000000000000 0x0000000000000000 0x000657b172ffb153 0x000657b172ffb156      3us  
jul 28 21:12:42 kernel: NVRM:     -3    4102 OS_ERROR_LOG                   0 0x0000000000000000 0x0000000000000000 0x000657b172ffaf16 0x000657b172ffaf1b      5us  
jul 28 21:12:42 kernel: NVRM:     -4    4102 OS_ERROR_LOG                   0 0x0000000000000000 0x0000000000000000 0x000657b172ffa1a0 0x000657b172ffa1a3      3us  
jul 28 21:12:42 kernel: NVRM:     -5    4102 OS_ERROR_LOG                   0 0x0000000000000000 0x0000000000000000 0x000657b172ff9f54 0x000657b172ff9f58      4us  
jul 28 21:12:42 kernel: NVRM:     -6    4102 OS_ERROR_LOG                   0 0x0000000000000000 0x0000000000000000 0x000657b172ff1f0d 0x000657b172ff1f0f      2us  
jul 28 21:12:42 kernel: NVRM:     -7    4102 OS_ERROR_LOG                   0 0x0000000000000000 0x0000000000000000 0x000657b172ff1cc6 0x000657b172ff1cca      4us  
jul 28 21:12:42 kernel: CPU: 14 UID: 1000 PID: 1168 Comm: kwin_wayland Tainted: G           OE       7.1.4-arch1-1 #1 PREEMPT(full)  61d56d2636cea52940dfe901004a27f7fabd9566
jul 28 21:12:42 kernel: Tainted: [O]=OOT_MODULE, [E]=UNSIGNED_MODULE
jul 28 21:12:42 kernel: Hardware name: ASUS System Product Name/ROG STRIX B650-A GAMING WIFI, BIOS 2214 01/02/2024
jul 28 21:12:42 kernel: Call Trace:
jul 28 21:12:42 kernel:  <TASK>
jul 28 21:12:42 kernel:  dump_stack_lvl+0x5d/0x80
jul 28 21:12:42 kernel:  _kgspRpcRecvPoll+0xdf2/0x15c0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  _issueRpcAndWait+0x1f1/0x990 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? FinnRmApiGetSerializedSize+0x3c/0xd0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? osGetCurrentThread+0x29/0x60 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  rpcRmApiControl_GSP+0x25b/0x9a0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? gpuSanityCheckRegisterAccess_IMPL+0x97/0x150 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? nvDbg_vPrintf+0x64/0x180 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  kceGetFaultMethodBufferSize_IMPL+0x4e/0xd0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  gpuGetCeFaultMethodBufferSize_KERNEL+0x35/0x50 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  kchangrpAllocFaultMethodBuffers_GV100+0xdb/0x390 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  kchangrpInit_IMPL+0x33f/0x7d0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  kchangrpapiConstruct_IMPL+0x4b8/0x13f0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? gpuresConstruct_IMPL+0x1aa/0x1c0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? __nvoc_ctor_GpuResource+0x4e/0x70 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  __nvoc_objCreate_KernelChannelGroupApi+0x16f/0x280 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  __nvoc_objCreateDynamic+0x48/0x70 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? gpumgrSetCurrentGpuInstance+0x45/0x120 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  resservResourceFactory+0x1bf/0x350 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  _clientAllocResourceHelper+0x2aa/0x6c0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? kvfree_call_rcu+0x214/0x400
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  serverAllocResourceUnderLock+0x369/0xa40 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? portThreadGetCurrentThreadId+0x1d/0x30 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? rmclientValidateLocks_IMPL+0x21/0x90 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? _serverLockClientWithLockInfo.constprop.0+0xce/0x260 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  serverAllocResource+0x2df/0x5f0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  rmapiAllocWithSecInfo+0x233/0x490 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  rmapiAllocWithSecInfoTls+0x75/0xa0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  Nv04AllocWithAccessSecInfo+0x69/0x80 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? security_capable+0x5d/0x1a0
jul 28 21:12:42 kernel:  RmIoctl+0xa62/0xdf0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? os_get_monotonic_time_ns+0x3a/0xa0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? os_acquire_spinlock+0x12/0x30 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? portSyncSpinlockAcquire+0x18/0x30 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  rm_ioctl+0x7b/0x600 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? __check_object_size+0x1e8/0x200
jul 28 21:12:42 kernel:  nvidia_unlocked_ioctl+0x723/0xab0 [nvidia ebba05e31ab711f6c6e8bf68321dc91b92d0ccd1]
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  __x64_sys_ioctl+0xb9/0x100
jul 28 21:12:42 kernel:  do_syscall_64+0xaa/0x660
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? __alloc_frozen_pages_noprof+0x1a0/0x380
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? __mod_memcg_lruvec_state+0xeb/0x1b0
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? lruvec_stat_mod_folio+0x93/0xd0
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? __folio_mod_stat+0x2d/0x90
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? map_anon_folio_pte_nopf+0xc7/0x160
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? do_anonymous_page+0x10b/0x890
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? __pte_offset_map+0x1b/0x100
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? __handle_mm_fault+0xb72/0xf80
jul 28 21:12:42 kernel:  ? __x64_sys_fcntl+0xc1/0x120
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? count_memcg_events+0xd1/0x190
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? handle_mm_fault+0x1e5/0x2c0
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? do_user_addr_fault+0x23b/0x730
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? do_syscall_64+0x5f/0x660
jul 28 21:12:42 kernel:  ? srso_alias_return_thunk+0x5/0xfbef5
jul 28 21:12:42 kernel:  ? exc_page_fault+0x90/0x1f0
jul 28 21:12:42 kernel:  entry_SYSCALL_64_after_hwframe+0x76/0x7e
jul 28 21:12:42 kernel: RIP: 0033:0x7fd1f0d17b9d
jul 28 21:12:42 kernel: Code: 04 25 28 00 00 00 48 89 45 c8 31 c0 48 8d 45 10 c7 45 b0 10 00 00 00 48 89 45 b8 48 8d 45 d0 48 89 45 c0 b8 10 00 00 00 0f 05 <89> c2 3d 00 f0 ff ff 77 1a 48 8b 45 c8 64 48 2b 04 25 28 00 00 00
jul 28 21:12:42 kernel: RSP: 002b:00007ffdb0aff330 EFLAGS: 00000246 ORIG_RAX: 0000000000000010
jul 28 21:12:42 kernel: RAX: ffffffffffffffda RBX: 0000000000000030 RCX: 00007fd1f0d17b9d
jul 28 21:12:42 kernel: RDX: 00007ffdb0aff490 RSI: 00000000c030462b RDI: 0000000000000017
jul 28 21:12:42 kernel: RBP: 00007ffdb0aff380 R08: 00007ffdb0aff490 R09: 00007ffdb0aff4b8
jul 28 21:12:42 kernel: R10: 00007fd1e2c53db0 R11: 0000000000000246 R12: 0000000000000017
jul 28 21:12:42 kernel: R13: 00000000c030462b R14: 000000000000002b R15: 00007ffdb0aff390
jul 28 21:12:42 kernel:  </TASK>
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspLogRpcTimeout: ********************************************************************************
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspIsHeartbeatTimedOut: Heartbeat timed out, currentTimeMs 2858134120 heartbeat 2858082572 heartbeatWithOffsetMs 2858082572 diff 51548 timeout 5200
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspRpcRecvPoll: GSP RM heartbeat timed out
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspIsHeartbeatTimedOut: Heartbeat timed out, currentTimeMs 2858134120 heartbeat 2858082579 heartbeatWithOffsetMs 2858082579 diff 51541 timeout 5200
jul 28 21:12:42 kernel: NVRM: GPU0 _kgspRpcRecvPoll: LibOS heartbeat timed out
jul 28 21:12:42 kernel: NVRM: GPU0 _issueRpcAndWait: rpcRecvPoll timedout for fn 76 sequence 31264!
jul 28 21:12:42 kernel: NVRM: GPU0 nvAssertOkFailedNoLog: Assertion failed: Call timed out [NV_ERR_TIMEOUT] (0x00000065) returned from pRmApi->Control(pRmApi, pGpu->hInternalClient, pGpu->hInternalSubdevice, NV2080_CTRL_CMD_CE_GET_FAULT_METHOD_BUFFER_SIZE, &params, sizeof(params)) @ kernel_ce.c:857
jul 28 21:12:42 kernel: NVRM: GPU0 nvAssertFailedNoLog: Assertion failed: (bufSizeInBytes > 0) @ kernel_channel_group_gv100.c:78
jul 28 21:12:42 kernel: NVRM: GPU0 kchangrpInit_IMPL:  Fault method buffer allocation failed forNVIDIAnnel_group_api.c:274
jul 28 21:13:04 systemd-coredump[23043]: Process 21339 (freetube) of user 1000 dumped core.
                                         
                                         Stack trace of thread 30:
                                         #0  0x000055b12ad4df88 n/a (n/a + 0x0)
                                         ELF object binary architecture: AMD x86-64
jul 28 21:13:07 systemd[1]: systemd-coredump@0-1-23042_23098-0.service: Deactivated successfully.
jul 28 21:13:07 systemd[1]: systemd-coredump@0-1-23042_23098-0.service: Consumed 44.395s CPU time over 1min 16.535s wall clock time, 7.5G memory peak.

Last edited by lainlover (Yesterday 18:35:47)

Offline

#2 2026-07-28 21:34:16

seth
Member
From: Won't reply 2 private help req
Registered: 2012-09-03
Posts: 77,050

Offline

#3 Yesterday 18:35:32

lainlover
Member
Registered: 2024-04-01
Posts: 21

Re: [SOLVED] nvidia-drm runs out of memory, locks up, freezes wayland

That seems to have solved it, thanks.

I also ran

# systemctl enable nvidia-suspend.service nvidia-resume.service nvidia-hibernate.service

and added nvidia.NVreg_PreserveVideoMemoryAllocations=1 to boot parameters, either one of these or all of them together made it work

Offline

Board footer

Powered by FluxBB