日前,无锡诚恒微电子有限公司正式发布了CH37系列边端侧AI SoC芯片。这款集高性能、低功耗与高集成度于一身的单芯片解决方案,以其硬核的技术细节,为具身智能与边缘计算产业提供了全新的底层支撑。

CH37系列的核心竞争力,源于其对边端侧AI计算本质的深刻理解与技术重构。在仅7.29平方厘米、重约7.7克的封装内,它通过先进的异构计算架构,将十类计算单元进行了深度耦合与协同优化,而非简单的功能堆叠。其AI计算核心由六核NPU与四核GPGPU共同构成,NPU采用自研的脉动阵列架构,针对Transformer、CNN等主流AI模型进行了算子级优化,INT8峰值算力达48 TOPS,且支持动态稀疏化计算,在实际推理场景中有效算力利用率超85%。

GPGPU则基于景嘉微成熟的图形处理IP演进而来,提供1 TFLOPS FP32通用并行算力,可高效承载非结构化数据处理、科学计算及自定义AI算子,弥补了传统NPU在灵活性上的不足。二者通过片上高速NoC总线互联,共享统一内存空间,避免了数据搬运带来的延迟与功耗损耗,让感知与决策能够在芯片内部实现无缝衔接。

视觉处理是边端AI的关键入口,CH37内置双路独立ISP,每路支持最高4K@60fps RAW域处理。它集成了多帧降噪、宽动态合成、镜头校正等六大硬件加速引擎,可在RAW域完成去马赛克、色彩校正等预处理,直接将高质量YUV/RGB数据输送给NPU,使后端AI识别准确率提升15%以上。同时,芯片支持MIPI CSI-2、LVDS、HDMI 2.1等多协议视频输入输出,可无缝对接各类工业相机、激光雷达与热成像传感器,满足复杂场景下的多模态感知需求。

在系统级设计上,CH37采用了多层次功耗管理技术。除全局DVFS外,还对每个计算单元实现了细粒度的时钟门控与电压调节,结合智能任务调度器,可根据负载动态分配算力资源。实测显示,在处理8路1080P视频分析任务时,典型功耗仅12W,满载峰值功耗不超过25W,远优于同算力级别的分立方案。存储子系统支持LPDDR5 6400Mbps,配合自研的内存压缩与QoS调度算法,在多路视频并发读写场景下带宽利用率提升至92%,彻底解决了边端设备常见的内存瓶颈问题。

软件生态方面,CH37提供了完整的异构编译工具链,支持PyTorch、TensorFlow等主流框架的一键部署,内置200+预优化算子库与50+行业模型模板,开发者无需深入底层硬件即可完成模型迁移与性能调优。SDK还开放了NPU/GPGPU/ISP的底层API,允许客户进行定制化算法开发,充分释放硬件潜力,降低了边端AI应用的开发门槛。

CH37系列的硬核表现,离不开母公司景嘉微十余年的技术积淀。作为景嘉微控股子公司,诚恒微电子成立于2023年,专注于边端侧AI SoC研发。公司继承了景嘉微在GPU架构、异构计算及国产化适配方面的核心IP,并针对边端场景进行了深度定制。在CH37之前,公司已推出过面向工业视觉的AI加速模块与NPU IP验证平台,其自研的ISP算法与NPU微架构在前代产品中已完成多轮迭代,为CH37的高集成度与高可靠性奠定了坚实基础。

依托景嘉微的信创生态,CH37从设计之初就实现了与国产OS、框架及整机的全栈兼容,确保了在关键领域的自主可控。随着小批量量产启动与客户对接加速,CH37系列有望在机器人、智能巡检、工业边缘等场景快速落地。

文章来自:电子发烧友

Loading

作者 yinhua

发表回复