aiDAPTIV TM

更快的 AI 推理性能与更大规模的 LLM 训练,全程在本地部署(On-Prem)私有环境中完成

概览

当内存成为限制时,仅提升算力并不足够

现代 AI 往往会在算力耗尽前,先遭遇内存容量瓶颈。

Pascari aiDAPTIV™ 是 Phison 专为 AI 系统打造的解决方案,适用于从客户端电脑、工作站,到边缘部署环境和服务器等多种应用。该方案结合 aiDAPTIV 中间件和 aiDAPTIV 缓存内存,通过整合 GPU 内存、系统内存和基于闪存的专用存储层,扩展可用 AI 内存。

运行更大模型。保留更多上下文

AI 工作负载所需的内存超乎您想象

一个模型可能在加载阶段运行正常,但真正开始执行任务时出现问题。当加入长文档、RAG 资料、工具定义(Tool Definitions)、智能体状态或更大的 MoE(混合专家)模型时,同一套系统可能会耗尽内存。

在处理第一个提示词前,模型权重就已占用了部分内存。

KV 缓存会随着对话、文档以及检索上下文的增加而增长。 

智能体工作流在多个步骤中持续保留指令、工具信息、观察结果和工作产物。

MoE 模型要能访问完整专家模型池,即使每个 token 只会激活其中一部分专家。

微调过程还会额外引入梯度、优化器状态、激活值以及训练数据。

一个模型可能在加载阶段运行正常,但真正开始执行任务时出现问题。当加入长文档、RAG 资料、工具定义(Tool Definitions)、智能体状态或更大的 MoE(混合专家)模型时,同一套系统可能会耗尽内存。

专为 AI 数据打造的内存系统

aiDAPTIV Middleware

aiDAPTIV 受支持的运行时环境,将活跃的 AI 状态保持在靠近计算资源的位置,不太活跃的状态保存到更大容量的内存层并在需要时将其调回。

aiDAPTIV 缓存内存

aiDAPTIV 缓存内存是基于闪存的专用存储层,用于存放无法永久保留在高速内存中的 AI 状态,以避免其挤占更紧迫的工作所需的空间。 

内存层
主要作用
典型数据示例 
GPU 内存或统一内存
即时计算
活跃模型状态,活跃 KV 缓存,活跃专家,当前训练层
系统内存
独立 GPU 系统中的数据暂存与空间扩展
预取数据、中间缓存、近期可能再次使用的状态
aiDAPTIV 缓存内存
保留容量
不太活跃的 KV 缓存、较少使用的专家、暂存模型或训练数据
Memory Tier

GPU 内存或统一内存

主要作用

即时计算

典型数据示例 

活跃模型状态,活跃 KV 缓存,活跃专家,当前训练层

Memory Tier

系统内存

主要作用

Staging and expanded capacity on
discrete-GPU systems

典型数据示例 

Prefetched data, intermediate cache, state likely to be needed soon

Memory Tier

aiDAPTIV 缓存内存

主要作用

保留容量

典型数据示例 

不太活跃的 KV 缓存、较少使用的专家、暂存模型或训练数据

使用 aiDAPTIV 解决常见内存问题

Keep more context
Run a larger model
Adapt a larger model
遇到了什么问题?
从这里开始

长提示词、RAG 或重复使用的文档会使首 Token 延迟变得难以忍受 

稀疏 MoE 模型所需空间超过可用内存

微调因内存不足而失败 

我的模型或总上下文超出了可用空间,但我不确定是哪项内存限制导致了问题 

基于 aiDAPTIV 构建

开发 AI 应用?
平台或系统?
想了解技术细节?
寻找预配置工作站?

查看 Newegg 上搭载 aiDAPTIV 配置的 ABS 系统。 

SEAMLESS INTEGRATION

  • Optimized middleware to extends GPU memory capacity
  • 2x 2TB aiDAPTIVCache to support 70B model
  • 低延迟

HIGH ENDURANCE

  • 业界领先,高达100次的五年内每日写入次数(DWPD)
  • 采用业界先进NAND 纠错算法的SLC NAND

aiDAPTIV+ BENEFITS

  • 即插即用,无缝集成
  • 无需修改现有 AI 应用
  • Reuse existing HW or add nodes

aiDAPTIV+ MIDDLEWARE

  • 模型自动分割与 GPU 资源调度
  • Hold pending slices on aiDAPTIVCache
  • Swap pending slices w/ finished slices on GPU

FOR SYSTEM INTEGRATORS

  • Access to ai100E SSD
  • Middleware library license

  • Full Phison support to bring up