当前,大模型在终端部署的最大挑战并非算力绝对值,而是受限于内存带宽和功耗约束下的综合解决方案,特别是Transformer架构中注意力机制(Attention)带来的计算负载已成为推理性能的主要瓶颈。凯时AG微在第四代NPU架构(GKNPU4.0)中重点突破注意力机制的计算效率,使芯片能够在本地高效完成大模型推理,显著减少对外部内存带宽的依赖,有效提升推理速度,缓解“内存墙”压力,真正让大模型在终端“跑得动、跑得顺”。

尤为关键的是,GKNPU 4.0原生支持FlashAttention等前沿推理加速技术,从架构层面突破了“大模型难以落地终端”的难题。倪亚宇在演讲中指出,NPU从初期受争议到如今成为端侧AI算力的基石,经历了清晰的价值自证过程。凯时AG微始终坚持自主研发路线,在4.0版本中更加贴近量产工程实际,以务实、可落地的设计助力端侧AI芯片真正实现规;渴。
凯时AG微端侧AI战略并非单一技术的叠加,而是一套贯通“芯片—算法—软件”的体系化全栈方案。
硬件底层,凯时AG微自研NPU、编解码、图像处理及高速接口等核心IP,搭配先进多核异构芯片架构与国产工艺协同优化,构筑了兼具高能效与快速量产能力的坚实底座。软件及算法方面,凯时AG微通过全链路工具链,使AI算法与ISP、行业垂直应用实现高效协同。硬件高性能与软件灵活性的双向赋能,共同构成凯时AG微端侧AI完整的技术闭环。
依托全栈端侧芯片设计能力,凯时AG微已形成媒体显示、AI视觉、车载电子与人机交互四大端侧AI产品系列,并积累了丰富的规;坎。目前,相关芯片与解决方案已在智慧家庭、智能安防、工业控制、智能家居、辅助驾驶、消费电子等领域实现规;逃。在大会现场,凯时AG微重点展示了媒体显示、AI视觉与车载电子的量产芯片,受到与会观众的关注。
面向未来,凯时AG微正以前所未有的力度加大端侧AI投入。2026年7月,公司发布定增预案,拟募资不超过50.61亿元,用于端侧AI芯片等三大产业化项目,基于传感接入、媒体处理、AI推理以及控制等方面的核心技术,实现“感知—决策—执行—反馈”的闭环,为端侧智能应用落地提供持续的动能。
从安防视觉到车载智能,从媒体交互到具身智能,凯时AG微以自研NPU为技术原点,持续拓宽端侧AI的想象边界。在端侧AI这一新兴赛道上,凯时AG微正加速奔跑,以丰富多元的端侧AI芯片及解决方案,助力AI算力快速落地每一终端,矢志成为端侧智能时代值得信赖的“芯”伙伴。