aiDAPTIV TM

更快的 AI 推理性能与更大规模的 LLM 训练,全程在本地部署(On-Prem)私有环境中完成

基于 Pascari aiDAPTIV™ 构建 

Build with 
Pascari aiDAPTIV™ 

基于客户实际使用的设备构建 

终端用户并不关心瓶颈究竟来自 GPU 内存、统一内存、DRAM、KV 缓存,还是 MoE 专家未命中。 

他们关心的是:产品在眼前这台设备上能不能正常运行。 

通过 aiDAPTIV,应用和平台团队可以围绕客户实际部署系统的内存限制进行产品构建。 

对于 ISV(独立软件供应商) 

产品可能在实验室中运行良好,但到了客户的本地 PC、工作站、边缘设备或私有 GPU 服务器上,就会受到内存限制。 

内存容量可决定:

应用能运行多大的模型

能保留多长的上下文

能复用哪些 RAG 资料

能保留多少智能体状态

能支持多少个活跃工作流

更大的 MoE 模型是否可行

微调能否完成

这些因素对于以下应用场景尤为重要:私有知识助手、长文档和 RAG 工作流、编程和开发者工具、智能体工作流、本地或混合 AI 应用、面向特定场景的私有推理服务。 

 

如需讨论潜在应用,请咨询 Phison,并说明模型、执行环境、目标平台、内存架构,以及面临的内存瓶颈。

aiDAPTIV 中间件资源

需要最新的中间件配置或微调工作流资料?

对于OEM(原始设备制造商)和整机厂商 

对于 AI 系统而言,内存是用户体验的一部分

平台并非仅由处理器、GPU 或存储容量来定义。用户是通过具体场景感受到平台性能的,比如它能运行什么模型、能保留多少上下文,以及面对长文档、工具、智能体或重复上下文时,是否依然能够发挥作用。

aiDAPTIV 可帮助平台团队扩展系统实际可支持的模型规模和上下文能力,而这些系统原本可能需要更多 GPU 内存、更多系统内存、更高等级的平台或云端执行。

这适用于兼容 aiDAPTIV 的独立 GPU、集成 GPU 和统一内存平台。

如需咨询平台架构、执行环境集成方案和目标配置,请联系 Phison。 

SEAMLESS INTEGRATION

  • Optimized middleware to extends GPU memory capacity
  • 2x 2TB aiDAPTIVCache to support 70B model
  • 低延迟

HIGH ENDURANCE

  • 业界领先,高达100次的五年内每日写入次数(DWPD)
  • 采用业界先进NAND 纠错算法的SLC NAND

aiDAPTIV+ BENEFITS

  • 即插即用,无缝集成
  • 无需修改现有 AI 应用
  • Reuse existing HW or add nodes

aiDAPTIV+ MIDDLEWARE

  • 模型自动分割与 GPU 资源调度
  • Hold pending slices on aiDAPTIVCache
  • Swap pending slices w/ finished slices on GPU

FOR SYSTEM INTEGRATORS

  • Access to ai100E SSD
  • Middleware library license

  • Full Phison support to bring up