aiDAPTIV TM

更快速的 AI 推論效能與更大規模的 LLM 訓練,全程於本地部署(On-Prem)私有環境完成

彈性微調

在本機微調大型模型

微調可能在算力用盡之前,就先發生記憶體不足的問題。 

訓練任務需要的記憶體不只有模型權重。它還需要梯度、最佳化器狀態、活化值、中間資料、輸入序列與批次。 

增加模型大小、序列長度或批次大小,高速記憶體就可能在系統尚未用盡運算能力之前耗盡。 

Pascari aiDAPTIV™ 將模型與訓練狀態的可用容量擴充到 GPU 記憶體之外,有助於讓受記憶體限制的微調更具可行性。 

Fine-tuning data flow with aiDAPTIV

Fine-tuning needs many types of training data. aiDAPTIV helps make larger fine-tuning jobs practical.

為訓練狀態預留空間

Make room
for training state

在支援的訓練整合中,aiDAPTIV 可以透過 GPU 記憶體、系統記憶體與快取記憶體,暫存模型與訓練狀態,而無須將完整的工作集一次全部保留在 GPU 記憶體中。 

確切處理方式因模型、執行階段、訓練方法、硬體配置、序列長度與批次大小而異。視工作負載而定,資料可能會被保留、在記憶體系統中移動,或是重新運算,在容量與執行時間之間取得平衡。 

可實現的效益

探索更大的候選模型或要求更高的微調配置,同時將資料保存在您控制的環境中。 

LoRA 與 QLoRA

參數高效微調仍然可能會遇到模型大小、序列長度

與批次配置方面的記憶體限制。

私有化調適

在不適合雲端訓練的情況下,將領域資料保留在本機。

Capacity comes with tradeoffs

Fine-tuning performance depends on the model, runtime, training method, hardware configuration, sequence length, batch size, and data movement through the memory tiers. 

The value is added training capacity when GPU memory alone is the limiting factor. 

SEAMLESS INTEGRATION

  • Optimized middleware to extends GPU memory capacity
  • 2x 2TB aiDAPTIVCache to support 70B model
  • 低延遲

HIGH ENDURANCE

  • 業界領先,高達100次的五年內每日寫入次數(DWPD)
  • 採用業界先進NAND 糾錯算法的SLC NAND

aiDAPTIV+ BENEFITS

  • 隨插即用,無縫整合
  • 無需修改現有 AI 應用
  • Reuse existing HW or add nodes

aiDAPTIV+ MIDDLEWARE

  • 模型自動分割與 GPU 資源調度
  • Hold pending slices on aiDAPTIVCache
  • Swap pending slices w/ finished slices on GPU

FOR SYSTEM INTEGRATORS

  • Access to ai100E SSD
  • Middleware library license

  • Full Phison support to bring up