NXP Semiconductors Ara240离散神经处理单元 (DNPU)

NXP Semiconductors Ara240独立神经处理单元(DNPU)支持在边缘及嵌入式计算系统中运行实时生成式AI、大语言模型(LLM)和视觉语言模型(VLM),实现低延迟、较低运营成本和增强型数据隐私。其创新型架构结合了均衡的计算能力和高片外带宽,可高效执行大型模型。

Ara240架构专为支持先进的多模态和基于Transformer的工作负载而设计,可实现高达40等效万亿次运算/秒(eTOPS)的算力,支持高达16GB的LPDDR4内存。此特性使得大型复杂模型可直接在边缘端流畅执行,无需依赖高成本的云端计算资源。

Ara240集成安全启动和硬件信任根处理器,可为工业、企业和嵌入式部署环境提供强化的安全性。通过其PCIe Gen4和USB 3.2主机接口,该器件可轻松集成至边缘计算平台、PC/笔记本电脑以及支持AI的嵌入式系统中。

NXP Semiconductors Ara240拥有NXP AI/ML生态系统支持,包括NXP eIQ工具包Ara软件开发套件(SDK),可加速模型的开发、优化与部署。

特性

  • 处理器
    • Ara240离散神经处理单元 (DNPU) 每秒可提供高达40 eTOPS(等效每秒万亿次运算)
    • 专有神经网络处理器(NNP),运行频率高达900MHz
  • 存储器
    • 支持高达16GB的外部低功耗双倍数据速率4(LPDDR4)内存
    • 配备4MB SPI NOR闪存和8KB I2C EEPROM,用于启动、配置和运行时数据存储
  • 安全
    • 安全启动功能确保模块经过身份验证后启动
    • 信任根处理器,为安全AI部署奠定硬件基础
  • 接口与连接
    • PCIe Gen4主机接口,可配置为x1、x2或x4通道,用于高带宽数据传输
    • USB 3.2 Gen 2,用于灵活的主机通信
  • 易于使用
    • 操作系统支持(运行时)- Linux
    • 阿拉 Software Development Kit (SDK)
  • 17mm x 17mm x 0.65mm间距倒装芯片球栅阵列(FCBGA)封装
  • 在边缘运行LLM、VLM、多模态及生成式AI工作负载的高性能实时AI,算力高达40 eTOPS
  • 本地推理执行延迟低,运营成本低,减少往返延迟和对云服务的依赖
  • 支持大型模型执行,具备高片上内存和高达16GB LPDDR4(X),可高效处理大型Transformer模型
  • 内置安全启动和信任根处理器,实现安全部署
  • 通过PCIe Gen4和USB接口实现灵活主机集成,适用于嵌入式、PC和边缘服务器平台

应用

  • 边缘生成式AI
  • 计算机视觉和多模态系统
  • 工业自动化
  • 高级机器人技术

视频

方框图

框图 - NXP Semiconductors Ara240离散神经处理单元 (DNPU)
发布日期: 2026-04-15 | 更新日期: 2026-08-11