アイドルまたは常時稼働
選択したインフラがどの程度一貫して貢献するかを選択します。
企業プロバイダー
対象の組織計算リソースをShareAIに持ち込みます。サポートされるモデルを設定し、デバイスを管理し、運用ニーズに応じた貢献モードを選択します。
チェックデバイスの適格性を確認する
接続対応するサービングを設定する
選択する貢献モードを選択する
8. 残高と使用量を追跡する活動とインセンティブを確認する
解決する価値のある部分
組織は、どのインフラが参加できるか、いつ利用可能か、誰が提供を運営するかを決定する必要があります。
より明確なモデル
対象の容量、サポートされたオンボーディング、明確な可用性から始めます。固定収益を想定せずに、適用可能なRewards、Exchange、またはMissionプログラムを探ります。
適合する場所
選択したインフラがどの程度一貫して貢献するかを選択します。
Providerワークスペースを通じてデバイス、モデルサポート、可用性を管理します。
計算リソースの貢献とAIの利用を、企業参加の2つの部分として探ります。
あなたの動機を選択してください。
適格なProvidersに利用可能なインセンティブの道を探索してください。Providerワークスペースで適用可能なプログラムとデバイス要件を確認してください。
Rewardsは、ネットワークに提供された適格な容量に対する金銭的インセンティブの道です。利用可能な場合、その条件と活動を確認してください。接続されたマシンは収入を保証するものではありません。
Exchangeは、適格なコンピュートの貢献に対してトークンまたはAI使用価値を提供します(対応している場合)。これにより、ネットワークへの貢献とAIの使用が適用可能なExchange条件の下で接続されます。
Missionが利用可能なサポートされる目的を選択してください。例として、教育、環境、医療、人道支援、動物福祉のイニシアチブがあります。
GPUを活用しましょう
GPUを選択し、料金を設定して、フルブックのスケジュールがどれほどの価値になるか確認してください。
参照モデルLlama 2 7B · Q4_0
短いリクエスト: 512入力トークンと128出力トークン。各GPUは一度に1つのリクエストを処理します。
独自のベンチマークがありますか?両方の速度を置き換えてください。別のGPUを選択すると、その参照値が復元されます。
100%は、選択した時間内にリクエストが継続的に到着することを意味します。アイドル時間を考慮して値を下げてください。
公開された速度は、コミュニティのllama.cppテストから得られたもので、Flash Attentionはオフになっています。RTX 3080 TiプリセットはRTX 3080を参照しており、測定された3080 Tiの結果ではなく概算値です。
入力処理と出力生成は同じ時間予算を共有します。実際のスループットは、コンテキスト、ソフトウェア、リクエストのオーバーヘッドにも依存します。1か月は30日間で、週ごとのスケジュールが繰り返されます。
ベンチマークソースを見る100%ジョブ負荷時
電気代、手数料、税金を差し引く前の総見積もり。
これは合成シナリオであり、支払いオファーではありません。実際の提供と報酬は、資格、需要、プログラム条件に依存します。ExchangeとMissionには独自のインセンティブがあります。
実際のシナリオ
運用チームが対象インフラを選択し、サポートされるモデルを設定し、可用性を監視してから貢献を拡大します。
参加はデバイスの適格性とサポートされる設定に依存します。ハードウェアを接続する前にProviderの要件を確認してください。どのマシンも自動的に適格ではありません。
Providersはアイドルタイム貢献または常時オン貢献を選択できます。あなたのセットアップに合ったモードを選び、選択したプログラムの利用可能性要件を確認してください。
ProviderのオンボーディングトピックにはWindows、Ubuntu、macOS、Dockerが含まれます。デバイスに関連するプラットフォーム、ハードウェア、サービング設定の現在の指示を確認してください。
これらは異なるインセンティブパスです。Rewardsは利用可能な場合に金銭を提供し、ExchangeはトークンまたはAI使用価値を提供し、Missionはサポートされる目的への貢献を指示します。適用される条件が参加を決定します。
Providersは計算能力を提供します。Buildersはアプリケーションを所有し、ルーティングされたAIトラフィックに基づいて設定されたマージンを稼ぎます。Creatorsはモデル資産を所有または管理し、モデルアクセス条件を選択します。
プロバイダー