您现在的位置是:探索 >>正文
AI智能体全面爆发!Hexagon NPU重组算力底座
探索213人已围观
简介高通Hexagon NPU搭载Element Accelerator与大容量共享内存两大新特性,不仅能够充分承载AI智能体的高频算力需求,还大幅降低了端侧大模型的部署门槛,为手机端AI生态落地扫清硬件 ...
高通Hexagon NPU搭载Element Accelerator与大容量共享内存两大新特性,智能U重组算座不仅能够充分承载AI智能体的体全高频算力需求,还大幅降低了端侧大模型的面爆部署门槛,为手机端AI生态落地扫清硬件障碍。力底
PChome 9月10日报道,智能U重组算座随着各大手机厂商陆续官宣新一代操作系统,体全AI功能已然成为全系新机的面爆核心主打卖点,各类AI智能体功能遍地开花。力底新一代手机AI体验迎来全方位进化,智能U重组算座但能够自主执行任务、体全闭环服务的面爆终端AI智能体,对硬件底层算力提出了极高要求。力底出于用户数据隐私安全考量,智能U重组算座端侧本地化算力的体全核心价值愈发凸显,成为高端AI体验的面爆核心支撑。
针对这一行业发展趋势,高通新一代第六代骁龙8至尊版移动平台完成针对性深度迭代。全新升级的Hexagon NPU搭载两大核心创新特性,Element Accelerator与大容量共享内存,不仅能够充分承载AI智能体的高频算力需求,还大幅降低了端侧大模型的部署门槛,为手机端AI生态落地扫清硬件障碍。

据高通官方介绍,Element Accelerator是专为AI智能体场景量身打造的加速架构,高度适配智能体复杂、连续的运算逻辑,可大幅提升AI推理运算效率,实现用户指令的高速响应,彻底改善传统端侧AI卡顿、延迟高、响应慢的痛点。
在CPU和GPU中大放异彩的高速缓存思路,同样在Hexagon NPU中发挥了重要作用。高通将NPU大容量共享内存容量扩容50%,可将AI运算上下文数据留存于NPU内部,大幅降低设备对外置内存的频繁访问损耗,让NPU算力全部聚焦于AI推理核心运算,有效规避无效空转造成的性能浪费与算力衰减。
依托全新架构优化,Hexagon NPU的端侧大模型运行能力实现跨越式提升。其INT4模型预填充速度提升50%,首个词元生成耗时低于1.5秒,达成近乎实时的人机交互体验。同时,该NPU全面兼容多精度运算模式,支持INT2、INT4、INT8、FP8、FP16多种精度,可适配不同参数、不同场景的端侧AI模型。
除此之外,高通携手内存、AI模型厂商深度联动,针对MoE混合专家架构完成专项优化。该架构可直接从闪存加载模型数据,有效突破传统设备内存容量限制,支撑超大参数AI模型落地终端。以300亿参数大模型为例,通过MoE架构可仅激活加载30亿参数参与运算,大幅降低硬件资源占用,让大模型端侧规模化部署成为现实。在高端内存成本居高不下的当下,这套全新技术方案,也是现阶段端侧大模型普及落地的最优解之一,为手机AI智能体的全民普及奠定了硬件基础。
高通已经公布了第六代骁龙8至尊版的诸多新特性,更加的性能表现与更适合AI时代的特性支持,让我们对新一代旗舰手机更为期待了。高通骁龙技术峰会将在9月23日正式开幕,届时,第六代骁龙8至尊版的全部实力将就此揭晓。
Tags:
相关文章
钢化玻璃生产设备多少钱 钢化玻璃怎么生产,行业资讯
探索如今随着厂家生产技术不断发展,玻璃也有了各种新的种类,拥有更多更强的功能,逐渐取代普通玻璃。举例来说,原本只能透光挡风的普通玻璃窗,使用夹胶玻璃后就具备了降噪隔热的功能,更加方便实用。本篇文章将介绍钢 ...
【探索】
阅读更多泉州这个小区内有一处“森林公寓” 装修花费近30万
探索日前,在鲤城区金色外滩小区内的一处公寓里,记者发现了一片“森林”。记者 苏玮杰 王柏峰 文/图)套房的装修风格独特,感觉像是把“森林”搬回了家。虽然早前 ...
【探索】
阅读更多三通集团:国产调光玻璃有望走进寻常百姓家,产品视窗
探索“调光玻璃的关键是调光膜,制造调光膜的核心材料从在美国商业化量产之初的每克240美元,到5年前的每克8美元,目前我们公司自主研发的调光膜,成本已控制到了每克不到3美元。相信我们的国产调光玻 ...
【探索】
阅读更多