aiDAPTIV TM

オンプレミスで実現する、プライベートかつ高速なLLM 推論と大規模学習

Pascari aiDAPTIV™で構築 

Build with 
Pascari aiDAPTIV™ 

顧客が実際に使用するマシン向けに構築 

エンドユーザーにとって、ボトルネックがGPUメモリ、ユニファイドメモリ、DRAM、KVキャッシュ、エキスパートミスのいずれであるかは重要ではありません。 

重要なのは、目の前のマシンで製品が動作するかどうかです。 

aiDAPTIVTMは、アプリケーションチームとプラットフォームチームに、顧客が実際に導入するシステムのメモリ制限を考慮した設計手段を提供します。 

ISV向け 

製品がラボ環境では良好に動作していても、顧客のローカルPC、ワークステーション、エッジデバイス、またはプライベートGPUサーバーでは制約を受ける場合があります。 

メモリ容量は、以下を左右します。

アプリケーションで実行可能なモデル

保持可能なコンテキスト

再利用可能なRAGデータ

保持可能なエージェント状態

サポート可能なアクティブワークフロー数

より大規模なMoEモデルが実用可能かどうか

ファインチューニングを完了できるかどうか

これは、プライベートナレッジアシスタント、長文ドキュメントおよびRAGワークフロー、コーディングおよび開発者向けツール、エージェントワークフロー、ローカルまたはハイブリッドAIアプリケーション、特定用途向けプライベート推論サービスにおいて重要です。 

 

導入の可能性についてご相談いただく際は、モデル、ランタイム、対象プラットフォーム、メモリアーキテクチャ、メモリ制約をご提示のうえ、ファイソン社までお問い合わせください。

aiDAPTIV ミドルウェアのリソース

最新のミドルウェアのセットアップまたはファインチューニングワークフローのリソースが必要ですか?

OEMおよびシステムメーカー向け 

AIシステムでは、メモリがユーザー体験を左右する

プラットフォームは、プロセッサ、GPU、ストレージ容量だけで決まるものではありません。ユーザーにとって重要なのは、どのモデルを実行できるか、どれだけのコンテキストを保持できるか、また長いドキュメント、ツール、エージェント、繰り返し使用されるコンテキストを扱う場合でも実用性を維持できるかという点です。

aiDAPTIVTMは、対応するシステムにおいて、より多くのGPUメモリやシステムメモリ、より上位クラスのプラットフォーム、またはクラウドでの実行を必要とすることなく、実用的なモデル容量とコンテキスト容量の拡張を支援します。

これは、aiDAPTIVTMをサポートするディスクリートGPU、統合GPU、ユニファイドメモリの各プラットフォーム設計に適用されます。

プラットフォームアーキテクチャ、ランタイム統合、対象構成については、Phison社までお問い合わせください。 

SEAMLESS INTEGRATION

  • Optimized middleware to extends GPU memory capacity
  • 2x 2TB aiDAPTIVCache to support 70B model
  • 低遅延

HIGH ENDURANCE

  • 業界をリードするDWPD 5 年以内に 1 日あたり 100 回の書き込み
  • 高度な NAND 修正アルゴリズムを備えた SLC NAND

aiDAPTIV+ BENEFITS

  • 簡単に実装
  • AI アプリケーションを変更する必要はありません
  • Reuse existing HW or add nodes

aiDAPTIV+ MIDDLEWARE

  • モデルを分割して各GPUに割り当てる
  • Hold pending slices on aiDAPTIVCache
  • Swap pending slices w/ finished slices on GPU

FOR SYSTEM INTEGRATORS

  • Access to ai100E SSD
  • Middleware library license

  • Full Phison support to bring up