Docker内からnvidia-smiが通らない!?
Failed to initialize NVML: GPU access blocked by the operating system
Failed to properly shut down NVML: GPU access blocked by the operating system
あるとき、いきなり作業場所のdocker内からGPUが使えなくなってしまいました。nvcr.io/nvidia/pytorch:25.10-py3をベースにしているので、使えないわけがない!
以前は使えていたのに!
環境は、wsl2にdocker engineを入れていて、wsl2からはnvidia-smiが通り、一部docker環境からnvidia-smiが通らない状況。
解決策:docker restartしましょう・・・
ググったら、/etc/nvidia-container-runtime/config.tomlの一部のオプションをno-cgroups = falseに書き換えると通ったという記事が出てきました。しかし、このコンフィグファイルを見ても、そもそもno-cgroupsという項目自体がまだ作られていない・・・
とりあえずdocker restartしてから様子を見ようと思ったら、リスタートだけで解消してしまいました。長らく継続して使ってきていたコンテナだったので、どこかのアプデか何かで不整合が起きたんでしょうね。
再起動、大事です。

コメント