広告

個人開発AI活用

WSL 3.0.1でコンテナが一般提供 Local LLMの実行環境はどう変わる?

デイリートピックス編集部公開: 2026/10/01約5分で読めます5 views
広告

Microsoftは2026年9月29日、WSL containersの一般提供を発表しました。WindowsからLinuxコンテナをビルド、実行、デプロイでき、Windowsアプリからコンテナを操作するAPIも用意されています。Microsoftの発表

WSLを更新すると、`wslc.exe`のほか、別名の`container.exe`でも操作できます。

WSL 3.0.1は新しい実行方式ではない

WSL containersはWSL 3.0.1で一般提供されました。「3.0」は製品のバージョン番号です。WSL 1やWSL 2のように、Linux環境を動かす方式の新しい分類が加わったわけではありません。WSL 3.0.1のリリース情報

追加された操作には、ホスト上のパスをコンテナに接続する`--mount`、コンテナの再起動やファイルコピー、ネットワークの接続・切断、イベント確認、ヘルスチェック、保存先の指定などがあります。一般提供の発表

ファイル共有とデータ保存

WSL containersはvirtiofsを使い、WindowsのパスをLinuxコンテナにマウントします。Microsoftは、従来のplan9方式と比べてWindowsファイルへのアクセスが最大約2倍速いと説明しています。アーキテクチャ解説

この性能値はファイルアクセスの比較です。LLMの推論速度が2倍になることを示す測定結果ではありません。

コンテナ内のscratch領域は、コンテナを削除すると失われます。ボリュームを使えば、コンテナの外にデータを保持できます。Windowsのパスを使う方法と、VHDによるLinux向けボリュームが用意されています。アーキテクチャ解説

モデルファイルや設定をコンテナ削除後も使う場合は、永続ボリュームに保存する構成が考えられます。

Local LLMを動かす構成

たとえば、手元の文書を要約するWindowsアプリから、ローカルの推論APIを呼び出す構成が考えられます。推論サーバーと依存ソフトをコンテナにまとめ、モデルファイルを永続ボリュームに置けば、アプリと推論環境を分けながらモデルを保持できます。

広告

MicrosoftもローカルAIをWSL containersの用途に挙げています。一般提供の発表

Ollamaの公式Docker手順では、`/root/.ollama`を永続化し、11434番ポートを公開します。NVIDIA GPUを使う例では、NVIDIA Container Toolkitなどの準備も必要です。OllamaのDocker手順

この手順はDocker向けです。コマンドを`wslc`に置き換えるだけで同じ構成になるとは限らないため、利用する推論ランタイムの対応状況を確認してから構成します。

OllamaのローカルAPIのベースURLは`http://localhost:11434/api`で、チャットには`/api/chat`を使います。ダウンロード済みのローカルモデルへのリクエストには認証ヘッダーは不要です。[Ollama APIの概要](https://docs.ollama.com/api/introduction)

認証が不要でも、APIを外部ネットワークに公開してよいという意味ではありません。接続範囲を確認してください。

ローカルモデルを選び、クラウド連携を使わない構成なら、推論処理をPC内で完結させられます。ただし、モデルやコンテナイメージの取得には通常ネットワークが必要です。WSLを導入しただけで通信がなくなるわけではありません。

導入前に確認したいこと

GPU推論には、対応GPU、Windows側のドライバー、推論ランタイム、モデルが収まるVRAMなどの条件があります。WSLでのGPU利用は以前から可能で、WSL containersで初めて加わった機能ではありません。WSLでのGPU計算

GPUを使う場合は、利用するランタイムとGPUの要件を確認して構成します。

Compose対応は今後の開発項目です。現時点で`wslc compose`が使えるものとして導入手順に組み込むことはできません。Microsoftの発表

WSL containersはWindows上でLinuxコンテナを扱う選択肢を増やします。Local LLM環境を構成する際は、ランタイムやGPUの要件、モデルの保存方法を確認し、Docker向けの手順をそのまま当てはめないことが大切です。

出典・参考リンク

広告

あわせて読みたい