安谋科技新一代“玲珑”武当VPU IP曝光,让机器视觉再上台阶

导读

  当AI开始通过摄像头“看懂”世界,视频压缩就不再只是为了节省存储空间,而是一场关乎机器感知精度的革命。在近日举行的WAIC 2026现场,安谋科技亮出了这场革命的最新答案:新一代“玲珑”VPU产品“武当。它正试图在让人类看清画面的同时,教会机器更聪明地理解每一帧。

  1、三维跃升:PPA、规格与画质的全面进阶

  据安谋科技VPU研发总监黄鑫博士介绍,即将面世的“玲珑”武当VPU,目前已实现了PPA、编码规格与编码质量上的全面升级。

  PPA大幅提升:单核性能在1GHz下达到8K 30fps+,可满足多元AI应用的性能需求。同时,编码器PPA较上一代节省40%以上,在提升算力的同时进一步降低了芯片面积与功耗开销;

  更全面的编码器规格:新增YUV422编码格式支持,适配专业摄像场景;支持Raw Data直接压缩,省去格式转换环节,更高效地服务AI训练;支持高达1Gbps+的超高码率,可满足人形机器人等Physical AI场景的高带宽需求;

  编码质量再进阶:全面继承前一代CAE技术,该技术集成轻量化AI,可显著降低码率,改善视频质量。此外,进一步增强了运动特征的提取和匹配,在不规则运动等AI典型场景下,编码质量可额外提升5%–10%。

  2、全局智能:从CAE到AI端到端的编码质变

  除PPA、编码规格与画质三大维度的硬件升级外,“玲珑”武当VPU在视频编码技术层面亦实现了从“局部优化”到“全局智能”的质变。其核心在于引入AI端到端视频编码技术,并基于全新的AI VPU训练框架构建了完整的闭环链路。

  在训练阶段,通过前置网络与虚拟编码器的协同,将特定AI任务接入全链路联合训练体系,利用反向传播机制实现端到端的最优参数调优,使编码过程天然适配下游任务需求。在部署阶段,经训好的前置网络与玲珑VPU编码器直接耦合,形成任务感知编码器,从而在显著提升压缩效率的同时,最大程度保障AI任务的精度。

  目前,该框架已完成工程层面的初步验证。在目标追踪与动作识别两大典型AI任务中,编码质量在精度无损的前提下均实现了超过10%的显著提升。更值得关注的是,该框架具备良好的任务泛化能力,未来通过引入前后处理网络及多模态配置参数,可灵活适配各类AI应用场景,最终实现“人眼主观视觉”与“机器感知精度”的双向共赢。

  从为人眼优化画质,到为机器优化感知,安谋科技“玲珑”VPU的每一次技术跃迁,都精准踩中了AI时代最底层的视频处理需求。当端侧AI从“能看见”走向“能看懂”,视频编解码技术不再是幕后的辅助角色,而是决定AI感知上限的核心引擎。