移远 QSC600XA-AP:24 TOPS、5W 的 M.2 算力板卡,把端侧 AI 变成一次插卡升级
移远通信 9 月 29 日发布 M.2 智能算力板卡 QSC600XA-AP,内置爱芯元智 AX8850:NPU 24 TOPS@INT8、满载功耗 5 W,八核 Cortex-A55 @1.5 GHz,标配 8 GB LPDDR4X,M.2 2280 B-M Key 配 PCIe 2.0,22 × 80 × 3.1 mm、裸板约 6.37 g;原生 Linux 5.15,已适配 70+ 开源模型(Qwen3.5、YOLO、Whisper)。存量网关、机器人、数字标牌、NVR 有 M.2 插槽即可补齐端侧 AI 算力,不必重画主板;产品已进入商用阶段。
移远通信 9 月 29 日发布 M.2 智能算力板卡 QSC600XA-AP,内置爱芯元智 AX8850:NPU 24 TOPS@INT8,满载功耗 5 W,标配 8 GB LPDDR4X,标准 M.2 2280 B-M Key 配 PCIe 2.0,22 × 80 × 3.1 mm,裸板约 6.37 g。形态比算力数字更值得琢磨——存量网关、服务机器人、工控设备、数字标牌、NVR,只要机上有一个 M.2 插槽,插上就有端侧 AI 推理能力,不必重画主板。移远称已商用,可提供测试试用。
先看规格:24 TOPS@INT8,NPU 满载 5 W
爱芯元智官网给出的 AX8850 参数是八核 Cortex-A55 @1.5 GHz、NPU 24 TOPS@INT8、封装 16 mm × 16 mm,芯片级视频能力为 H.264/H.265 的 8K@30fps 编解码。移远的板卡规格(来源:移远通信 2026-09-29;爱芯元智官网):
- NPU:24 TOPS@INT8,支持混合精度,官方点名兼容 Transformer、ViT、DETR
- CPU 与内存:八核 Cortex-A55 @1.5 GHz,标配 8 GB LPDDR4X(可选 4 GB)
- 形态:M.2 2280 B-M Key,PCIe 2.0,22 × 80 × 3.1 mm,裸板约 6.37 g
- 功耗:NPU 满载 5 W;另有带散热外壳版本
- 软件与平台:原生 Linux 5.15 内核,兼容 Windows、Android、Ubuntu;适配 Intel、AMD、树莓派、Rockchip
即插即用省下的是主板、结构、EMC 的整轮验证
M.2 2280 是 PC 与嵌入式通用标准,SSD、无线模组共用同一套机械与电气规范。客户现有的工控主板、边缘网关、树莓派 5 平台,只要有一个 M Key 或 B-M Key 插槽,就能把它当一张 PCIe 设备插上去用,省掉重画主板的排期、结构与电源验证,以及重走一遍 EMC 与认证的成本。
移远给的场景清单是边缘计算网关、服务机器人、工业控制、智能安全、数字广告牌,以及路由器与家庭网关,基本都是"主控成熟、AI 算力不够用"的存量产品。
70+ 模型就绪,实际卖点是工具链
移远强调板卡适配超过 70 个开源模型,覆盖大语言模型、多模态、图像生成与 AIGC,点名了 Qwen3.5、Qwen3-VL、Qwen2.5-VL、YOLO 和 Whisper 系列,客户不用自己做模型转换、量化调优与兼容性适配。
爱芯元智公开资料补上另一半:其 AI 处理器算子指令集覆盖 Conv、Transformer、LSTM 等超百种算子,原生适配 DeepSeek、Qwen、Llama,支持 4bit 至 32bit 混合精度计算;工具链兼容 PyTorch、TensorFlow、ONNX,厂商称其能效比较传统 GPGPU 提升一个数量级(爱芯元智官网)。
需求侧也在同向推。IDC 2026 年 7 月预测 2026 年全球 Gen AI PC 出货 0.5 亿台、Gen AI 手机 4.32 亿台,并判断 2027 年 80% 的企业会部署分布式边缘基础设施;CIC 灼识咨询 2026 年 2 月报告给出 2024–2030 年端侧 AI 推理芯片细分年复合增长率:机器人 54.9%、视觉端侧产品 34.2%、智能汽车 34.0%。
横向对比:M.2 算力卡和 Jetson 不是一类东西
- 移远 QSC600XA-AP:AX8850,24 TOPS@INT8,NPU 满载 5 W,八核 A55 + 8 GB LPDDR4X,M.2 2280 B-M Key / PCIe 2.0(移远通信)
- Hailo-8 M.2 模块:26 TOPS(INT8),典型功耗 2.5 W,PCIe Gen3 x4,扩展温度版 -40 ~ 85 ℃;ET 模块数据表另标 TDP 8.65 W、满载最大 8.25 W。它是纯加速器,没有 CPU(Hailo 官方产品页与数据表)
- NVIDIA Jetson Orin Nano 8GB:40 TOPS(INT8),模块功耗 7–15 W,6 核 Cortex-A78AE,8 GB LPDDR5,69.6 × 45 mm 的 260-pin SO-DIMM;Super 版 67 TOPS(MAXN_SUPER)、7–25 W(NVIDIA 数据表)
- 爱芯元智自家 M.2 算力卡:同为 AX8850,2242/2280 接口,功耗 < 8 W,可扩展为 PCIe 卡,已适配树莓派 5、RK3588、Intel 工控机(爱芯元智官网)
这几个参照物回答的是不同问题:Hailo-8 是纯加速器,CPU、内存和系统都留给主机;Jetson Orin Nano 是完整 SoM,40 TOPS 要配 7–15 W 的模块功耗预算,还得用 SO-DIMM 座子,形态上不是"往槽里插一张卡"。QSC600XA-AP 居中偏加速卡一侧,自带 CPU 和内存能独立跑系统,又维持标准 M.2 形态。三者功耗口径不同,4.8、10.4、2.7 TOPS/W 只能当量级参考。
恒森视角
这张卡出来以后,我们被问得最多的其实是同一句话:我手上那台设备,插上它到底能不能用。说句实在话,客户对 24 TOPS 这个数字基本没异议,真正卡住他们的是几个很具体的点。M.2 有 B、M、B+M、A+E 好几种键位,工控板上空着的那个槽往往不是给算力卡留的,有些只走了 USB 或 SATA 信号,PCIe 通道根本没引出来,插上去认不到设备——这个坑每年都有人踩,而且通常打样之后才发现,返工成本很高。再就是散热和供电:裸板 6.37 g 看着很轻,可满载 5 W 的 NPU 加上 CPU、内存、存储挤在同一块小板上,密闭机壳里温度很容易顶上去,我们一般会提醒客户先把风道想清楚,或者干脆选带外壳的版本。PCIe 只有 2.0 的带宽也常被忽略,前面要接多路高清视频流时,解码和缩放怎么分配得提前算。
至于 70+ 模型就绪这件事,数字本身意义有限——里面大半客户一辈子也用不上。我们更在意它把量化调优和算子适配那一段路省掉了。做过端侧部署的人都清楚,模型能跑起来是一回事,跑出来精度掉不掉点、算子会不会回退到 CPU 跑是另一回事;爱芯这套工具链如果真能把 Qwen、YOLO、Whisper 这些常用模型直接落下来,客户省下的是排期,不只是开发费用。
我们货架上现在摆着好几条路线,客户经常拿来一起比。NVIDIA 那条线的优势是软件生态,JetPack 和 CUDA 的成熟度不用解释,但它是 SoM 形态,要换载板换结构;Hailo 的卡功耗数字漂亮,代价是它自己不跑系统,得主机给内存给 CPU。爱芯和移远这张走的是第三条路,自带完整 SoC,插上去就能当一个独立节点用。我们一般会先反问一句:你要的是给现有主控加一个 AI 协处理器,还是换一套能自己跑操作系统的算力平台?这个问题答清楚,型号基本就定了。
补一句,移远基于同一颗 AX8850 还做了 LGA 封装的智能模组,适合想自己做载板、把算力焊到主板上的客户;做整机自研的团队通常两条路都会评估。落地时最常见的小麻烦是内核版本对不上,存量工控机里跑老内核的不少,换内核或改用 Ubuntu 是常规处理路径,要留时间但不算大问题。真机上的功耗和散热表现,光看规格书判断不出来,这张卡我们建议客户先申请实测再定型,尤其是密闭机壳和宽温场景——把主板空着的 M.2 槽位、Key 位和 PCIe 通道数发过来,我们帮着先对一遍可行性。
信息来源:移远通信《端侧AI普及提速!移远通信M.2智能算力板卡QSC600XA-AP,让AI算力"即插即用"》(quectel.com.cn,2026-09-29);爱芯元智 AX8850 产品页(axera-tech.com);Hailo-8 M.2 模块产品页与 ET 模块数据表 Rev2.2(hailo.ai);NVIDIA Jetson Orin Nano 数据表(nvidia.com);IDC 端侧算力分析与 FutureScape 预测(idc.com,2026-07-15);CIC 灼识咨询《2024-2030 全球及中国端侧 AI 推理芯片市场规模与出货量预测》(cninsights.com)。
