デバイス要件
このページについて
ShareAIアプリケーションは、デバイスのGPU VRAMに基づいて共有に適したAIモデルを自動的に推奨します。貢献を最大化しながら最適なパフォーマンスを確保するために、以下の2種類の要件を使用しています:
1. 推奨要件#
- これらは、モデルを効率的に実行するために必要な理想的なVRAMを示します。
- GPUが推奨VRAMを満たしている場合, 、良好なパフォーマンスと最適なタスク処理速度が期待できます。
- GPUが推奨VRAMを下回っている場合, 、モデルをインストールして実行することは可能ですが、パフォーマンスが著しく低下する可能性があります。最適な条件と比較して、デバイスが処理するタスク数が1秒あたりで少なくなります。
2. 最小要件#
- これらは、特定のモデルを実行するためにGPUが満たす必要がある最低限のVRAM値です。
- GPUが最小VRAMを満たしていない場合, 、モデルをインストールまたは共有することはできません。これにより、ネットワークの信頼性が確保され、リソースの非効率的な利用が防止されます。
GPU VRAMの分類#
GPUのVRAMに基づいて、デバイスは以下のカテゴリのいずれかに分類されます:
| VRAM範囲(GB) | 推奨モデル |
|---|---|
| 4–6 GB | 1B、3B |
| 8–12 GB | 7B(量子化 4/8ビット) |
| 16–24 GB | 7B、14B(量子化 4ビット) |
| 32–48 GB | 14B、20B(量子化 4/8ビット)、70B(4ビット) |
| 48–96 GB(複数GPU) | 70B(8ビット量子化) |
| 96 GB+(複数GPU) | 70B(16ビット精度または複数インスタンス) |
例えば:
- RTX 3060(12GB):推奨されるモデルは7–8Bパラメータ(例:DeepSeek-r1:8B)です。パフォーマンス低下を受け入れる場合、13Bモデルまでインストール可能です。
- RTX 4080(16GB): 推奨対象: 7–14Bモデル (量子化4ビット)。
アラートと通知#
新しいモデルを追加する際:
- GPUが推奨要件を満たしている場合:
- 警告や制限はありません。
- GPUが推奨以下だが最低要件以上の場合:
- 非ブロッキング警告メッセージが表示され、潜在的な性能問題について通知されます。
- 警告例: ⚠️ 性能通知: GPUのVRAMが推奨量を下回っています。このモデルは遅く動作し、1秒あたりのタスク処理数が少なくなる可能性があります。
- GPUが最低要件を満たしていない場合:
- ブロッキングアラートが表示され、インストールを防止します。
- アラート例: 🔴 VRAM不足: このモデルの最低要件を満たすGPUのVRAMがありません。GPUをアップグレードするか、より小さいモデルを選択してください。 詳しくはこちら.
特殊なケース#
- K-Quant オーバーヘッド: K-Quant(K_S、K_M、K_L)で量子化されたモデルを使用する場合、追加のVRAMオーバーヘッドが考慮されます。ShareAIは自動的に計算し、それに応じて推奨を調整します。
:latestモデル:- 以来
:latestモデルが事前にパラメータ数を指定しない場合、ShareAIはチェックを実行します。ollama showコマンドを使用してチェックを行います。 - チェック後にリソースがモデルの最低要件を満たしていない場合、モデルはアクティブ化されません。
- 以来
最終的な推奨事項#
- ShareAIインターフェース内でGPU推奨事項を定期的に確認してください。
- 最適なパフォーマンスのためにGPUドライバーを更新してください。
- ネットワークに大きく貢献したり、より大きなモデルをホストしたい場合は、GPUのアップグレードを検討してください。
これにより、貢献の効率性とShareAI分散型AIネットワークの健全性の両方が確保されます。
最終更新日 9月 14, 2025