DockerからのGPU接続エラー!?

Docker内からnvidia-smiが通らない!?

Failed to initialize NVML: GPU access blocked by the operating system
Failed to properly shut down NVML: GPU access blocked by the operating system

あるとき、いきなり作業場所のdocker内からGPUが使えなくなってしまいました。
nvcr.io/nvidia/pytorch:25.10-py3をベースにしているので、使えないわけがない!
以前は使えていたのに!

環境は、wsl2にdocker engineを入れていて、wsl2からはnvidia-smiが通り、一部docker環境からnvidia-smiが通らない状況。

解決策:docker restartしましょう・・・

ググったら、/etc/nvidia-container-runtime/config.tomlの一部のオプションをno-cgroups = falseに書き換えると通ったという記事が出てきました。しかし、このコンフィグファイルを見ても、そもそもno-cgroupsという項目自体がまだ作られていない・・・

とりあえずdocker restartしてから様子を見ようと思ったら、リスタートだけで解消してしまいました。長らく継続して使ってきていたコンテナだったので、どこかのアプデか何かで不整合が起きたんでしょうね。

再起動、大事です。

コメント

タイトルとURLをコピーしました