Contents
Qwen 3.5 ローカル導入ガイド: 実践的なインストール手順と対応策
Qwen 3.5をローカル環境で稼働させるには、システム要件や手順の正確な確認が不可欠です。本記事では公式ドキュメントに基づいた最新情報をもとに、Linux/Windows/macOSそれぞれでのインストール方法とトラブルシューティングまで網羅したガイドを提供します。ローカル導入の準備から実行までの一連のフローを確認することで、自社環境での性能評価がスムーズに進みます。
導入前の準備: 必要環境と前提条件
ローカルインストールを実施する前に、システム環境やソフトウェアのバージョンを確認しておく必要があります。Qwen 3.5は高パフォーマンスなモデルであるため、ハードウェア・ソフトウェア両面での適切な準備が求められます。
システム要件と推奨設定
各OSにおける最低動作環境と推奨設定を以下にまとめます。導入前のチェックリストとして活用してください。
| OS | 最低メモリ | 推奨ストレージ容量 | プロセッサ要件 |
|---|---|---|---|
| Linux | 8 GB | 20 GB | x64アーキテクチャ |
| Windows | 16 GB | 50 GB | Intel i7以上 |
| macOS | 16 GB | 30 GB | Apple M1チップ以上 |
注意:モデルファイルのダウンロードサイズは約20~30GBです。ストレージ容量に余裕を持たせることが推奨されます。
バージョン整合性の確認
導入前の必須項目として、公式リポジトリの最新版と自身の環境のバージョンが一致しているかを確認してください。サポートされたPythonバージョンやDockerイメージタグなどは必ず確認しましょう。
DockerおよびPython環境構築手順
ローカル環境ではDockerとPythonを活用し、安定した実行環境を整えます。公式イメージを使用することで、再現性が高まるため推奨です。
Docker Engineのインストールと起動確認
- Linuxユーザーは
apt-get install docker.ioやyum install dockerでDockerをインストールします。 - Windows/macOSユーザーはDocker Desktopを公式サイトからダウンロードし、インストールします。
- インストール後、以下のコマンドで動作確認を行います。
|
1 2 3 |
docker --version docker run hello-world |
ポイント:Dockerデーモンが起動していない場合は
systemctl start docker(Linux)やDockerアプリの起動を確認してください。
Python環境整備
Qwen 3.5はPython 3.10以上を要します。以下のコマンドでバージョンを確認し、必要に応じてアップグレードを行います。
|
1 2 |
python --version |
- Windows:Anacondaや公式サイトからインストール。
- macOS/Linux:
sudo apt install python3.10(Linux)またはbrew install python@3.10(macOS)を実行。
注意:Homebrewの
python@3.10パッケージが最新バージョンに対応しているか、公式ドキュメントで確認してください。
モデルファイルのダウンロードと配置
公式リポジトリからモデルファイルを取得し、ローカルストレージに配置します。ここでの選定はパフォーマンスと実行時間のバランスが重要です。
公式リポジトリからのモデル取得手順
- 公式リポジトリにアクセスし、
Qwen3.5リポジトリをクローンします。 git clone https://github.com/Qwen/qwen3.5.git- モデルファイルのダウンロードは
scripts/download_model.shスクリプトを使用して実施します。
|
1 2 3 4 |
cd qwen3.5 chmod +x scripts/download_model.sh ./scripts/download_model.sh |
注意:リポジトリURLは公式ブランド名に合わせて修正してください(例:
Qwen-Labs→Qwen)。
ローカルストレージ配置場所指定
モデルサイズが膨大なため、SSDを推奨します。以下のファイル構成例を使用してください。
|
1 2 3 4 5 6 7 |
/qwen_local_storage ├── models/ │ └── qwen3.5/ │ ├── config.json │ └── pytorch_model.bin └── logs/ |
ポイント:SSDの空き容量はモデルサイズ(20~30GB)を超える余裕を確保してください。
CUDA設定とGPU利用オプション
GPUを使用することで、Qwen 3.5の推論速度が飛躍的に向上します。CUDA環境の整備には注意が必要です。
NVIDIAドライバ確認
GPU利用の前提としてNVIDIAドライバを導入してください。以下でバージョンを確認できます。
|
1 2 |
nvidia-smi |
出力例:
|
1 2 |
NVIDIA-SMI 535.182 Driver Version: 535.182 CUDA Version: 12.3 |
CUDA Toolkitのバージョン管理
CUDA Toolkitはモデル実行に必要なライブラリを提供します。以下でインストールできます。
- Linux:
apt install cuda-toolkit - Windows:NVIDIA CUDA Toolkit公式サイトからダウンロード
注意:CUDA Toolkitのバージョンとドライババージョンが一致しているか、
nvcc --versionで確認してください。
GPUアクセラレーション有効化手順
Dockerコンテナ起動時にGPUオプションを指定します。
|
1 2 |
docker run --gpus all -v /qwen_local_storage:/models qwen3.5:latest |
比較例:
| 実行環境 | 推論速度(tok/s) | メモリ使用量 |
|---|---|---|
| CPU | 4 tok/s | 8 GB |
| GPU (RTX 3090) | 25 tok/s | 16 GB |
起動時のトラブルシューティング
インストール後によく発生するエラーとその解決策を紹介します。特に権限関連やCUDAドライバ不整合の確認が重要です。
Permission deniedエラー対応
- モデルファイルにアクセス権がない場合、
chmod -R 755 /qwen_local_storageでパーミッションを変更してください。 - Dockerコンテナ起動時に
--privilegedオプションを使用する場合もあります。
CUDAドライバ不整合確認方法
以下コマンドでCUDAとNVIDIAドライバが一致しているかを確認します。
|
1 2 3 |
nvcc --version # CUDAバージョン確認 nvidia-smi # ドライババージョン確認 |
不一致の場合はドライバまたはCUDA Toolkitを再インストールしてください。
メモリ不足時の対応
エラー例:
|
1 2 |
RuntimeError: Insufficient memory to load model. |
- 解決策:
--max_memoryパラメータで使用可能なメモリ量を指定- 量子化モデル(Q6_Kなど)を使用する
導入後評価と今後の展望
インストールが完了したら、自社環境での性能とカスタマイズ可能性を確認しましょう。将来的なアップグレードにも対応できる仕組みを構築することが重要です。
性能ベンチマークの実施方法
以下のように評価スクリプトを実行します:
|
1 2 3 |
cd benchmarks python run_benchmark.py --model_path /qwen_local_storage/models/qwen3.5 |
出力例:
- 推論速度:20 tok/s(GPU利用時)
- レスポンス遅延:1.8秒平均
カスタマイズオプション
Qwen 3.5は以下のようなカスタマイズが可能です:
- ローカルモデルファインチューニング
- 特定タスク向けのプラグイン導入
- 推論時のパラメータ調整
今後、企業固有のデータセットへの適応を目的としたアップグレードパスも公式に提供される予定です。
まとめ
- ローカル導入にはDockerとPython環境が必須
- モデルファイルはSSDでの保存が推奨
- CUDAドライバの整合性確認でGPU性能を最大限に引き出す
- 性能評価とカスタマイズオプションによって、自社環境最適化が可能
本ガイドに従ってローカルインストールを実施し、Qwen 3.5の性能を自社環境で評価してみましょう。