告别算力“整租”时代!华为云柔性智算FlexNPU,打造弹性伸缩“算力金箍棒”
2026-03-21 20:29:41 |来源:财讯网
3月20日,华为云中小企业AI解决方案发布会上推出了一项算力黑科技——柔性智算操作系统FlexNPU,将Token消耗“吞金兽”有效控制在企业预算范围内,打造面向Agentic时代的极致Token性价比,为企业级智能体的普及突破算力瓶颈。
华为云中国区销售伙伴发展部部长、华为云中国区Marketing与解决方案销售部部长郭婷在致辞中表示,2026年华为云将构建AI时代更加肥沃的“黑土地”,让算力服务更柔性、更适配中小企业的轻量化需求,实现从“调度靠拍板”到“成本算到精”的转变,解决“用不起、用不好”算力的核心难题。

(华为云中国区销售伙伴发展部部长、华为云中国区Marketing与解决方案销售部部长郭婷)
企业AI应用现状:一半是海水,一半是火焰
当下,“养龙虾”成为全民热点话题,为千行万业尤其是中小企业提供了建设智能化工作流程的清晰思路。会上,华为云SMB解决方案与持续运营部部长刘杰用“一半是海水,一半是火焰”生动形容了目前企业智能化转型的现状:以OpenClaw为代表的先进生产力工具层出不穷,但AI实际应用往往面临着成本高山、技术壁垒、场景错位等挑战。

(华为云SMB解决方案与持续运营部部长刘杰)
对此,华为云发布中小企业AI解决方案,涵盖AI基础设施层、模型服务层、智能体平台层、智能体应用层,帮助企业打造能对接ERP、能调用API、能闭环业务流程的“数字员工”。目前,华为云已深入2600多家企业、30多个行业,解决500多个AI场景化问题,成为企业AI创新路上的可靠伙伴。
刘杰介绍,在AI基础设施层,华为云提供昇腾多代系产品,以及自研的AI Infra OS,尤其是FlexNPU柔性智算技术,一方面满足中小企业小模型训练场景,另一方面通过弹性调度能够大幅提升资源利用率;在模型服务层,华为云支持业界主流开源模型,让企业既能根据业务需求灵活选择,也能结合自有数据低成本微调专属模型;在智能体平台层,华为云提供易用高效的Agent开发环境,助力开发者和中小企业面向行业结合场景打造企业级智能体;在智能体应用层,华为云联合伙伴深入场景,覆盖洞察分析、营销运营、协同办公、开发运维、内容制作等高频需求。
刘杰还表示,华为云致力于提供AI解决方案,做好基础设施和平台底座,伙伴则提供AI行业解决方案、AI行业场景应用、AI专业服务交付,实现深度共创。会上,华为云发布“加速智能化 企业快成长行动2026”,为中小企业、开发者提供从品牌、商业、技术等全方位的支持,共赢AI市场,共同加速企业智能升级。
打造算力“金箍棒”,大幅降低算力成本
“我们的推理池平均利用率竟然不足30%,我们花费重金建设、动辄数万、数十万卡的AI硬件算力池,竟有超过一半以上的算力在‘摸鱼,吃空饷’。”华为云首席架构师、华为公司Fellow顾炯炯在现场抛出了一组惊人数据。他指出,Agent时代企业普遍面临算力痛点:Agent自主规划、多轮迭代、长上下文导致Token消耗量呈指数级增长,如何有效降低Token成本,成为最核心和迫切的挑战。
为此,华为云发布了黑科技——柔性智算FlexNPU,通过构筑强大而灵活的AI Infra层算力调度技术,大幅提升推理池的有效算力利用率,从而以相同AI硬件算力投入,提供更大的Token吞吐输出。

(华为云首席架构师、华为公司Fellow顾炯炯)
对于柔性智算FlexNPU,顾炯炯以可大可小、变化随心的“如意金箍棒”生动形容,表示FlexNPU赋予NPU/GPU算力“柔性或液态化”供给与伸缩的能力,可依据任意业务需求动态变化随需而动,如同金箍棒一般“可大可小、变化随心”,通过最大化AI算力投入的利用率,最终实现Token性价比的最优化。
具体而言,柔性智算FlexNPU具备极致共享、极致弹性和极致高可用3大属性:
大模型推理方面,FlexNPU通过引入基于柔性算力的PD动态混部、在离线推理混部等创新技术,完美解决了传统PD分离架构下Prefill和Decode集群不均衡的AI Core与显存利用率,以及推理业务潮汐变化规律所导致的大量AI算力空转浪费难题,将带来至少40%的Token性价比提升空间
小模型推理方面,FlexNPU通过实现最小粒度达1% NPU卡及128MB显存的颗粒度的AI Core时分复用,以及显存空分复用,为小模型提供真正完美匹配其算力诉求、量体裁衣的虚拟NPU资源,将小模型的平均算力成本降低2-3倍以上;
推理高可用保障方面,FlexNPU通过软硬解耦及Token级KV Cache的实时快照,使得上层推理框架不再需要感知底层的硬件故障,即可实现故障秒级快速恢复及断点续推,大大减少了Agent推理会话重计算开销,提升了用户的推理体验
顾炯炯最后总结到,FlexNPU的核心价值体现在:无需再为大模型推理的闲置算力,以及小模型推理的独占算力浪费买单,更不再需要为昂贵的故障重算买单,真正实现了AI算力分配供给从“资源模式”到“效率模式”的范式转变,“让每分AI算力投入迸发最大价值,让智能体的海量Token人人消费得起。”
深入千行万业,做好伙伴AI创新的“黑土地”
华为云领先的智能化基础设施,正在成为千行万业伙伴进行技术创新、产品研发和商业拓展的重要支撑。发布会现场,华为云伙伴代表分享了多个真实案例。
天宽科技有限公司CTO龚徐建介绍,天宽科技基于昇腾算力平台打造制造业Agent解决方案,可实现智能知识问答、合同智能审核、风险识别等功能,合同审核准确率达90%,审核效率提升3倍,生产数据查询时间从1小时缩短到2分钟,将企业人力从繁琐重复的工作中解放,双方后续将在市场洞察、能力共建、成单路径等方面进行拓展合作。

(天宽科技有限公司CTO龚徐建)
天津宏达瑞信科技有限公司CEO丁照祥则从零售物流行业角度,探讨AI落地带来的巨大价值,表示宏达瑞信基于华为云天筹求解能力,打造AI智能路径规划方案,助力商家获得商品从仓库到经销商的运输最优解,并且可以根据复杂的交通条件灵活配置,排线效率提升60倍以上,减少冗余出车次数20%,物流成本降低5.8%。

(天津宏达瑞信科技有限公司CEO丁照祥)
人工智能底层技术发展,牵引Al Infra算力基础设施、开闭源大小模型、Agent使能框架与工具等快速演进,激发更多AI创新。面向未来,华为云将秉持“用AI解行业难题”的理念,在应用层、模型层、算力层耕耘AI算力黑土地,携手伙伴共进共赢,抓住AI时代的机遇。
免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。
标签阅读
-
华为云AI战略升级:以行业智能体为中心,打造企业级AI创新“黑土地”
2026-03-21 -
告别算力“整租”时代!华为云柔性智算FlexNPU,打造弹性伸缩“算力金箍棒”
2026-03-21 -
赵都礼宴周年庆典盛启,一岁正风华
2026-03-20 -
焕新启幕!2026 武汉整装定制家居展开幕
2026-03-20 -
2026年Robotaxi赛道分野,自运营模式与金三角模式的双线竞速
2026-03-20 -
“慧相链,欣价值——慧择控股·齐欣云服走进保司系列活动”首站游学新华保险总部,共同见证快享福5号上市发布
2026-03-19 -
健康守护 权益同行!“3·15” 金融消保骑行活动圆满落幕
2026-03-19 -
拉夏贝尔重返百亿:首创服装行业BMS+D新生态模式
2026-03-19 -
上海百家商会联谊会暨上海天长市商会会员大会在沪举行
2026-03-17 -
多场景宣传精准触达 陆家嘴国泰人寿厦门分公司织密金融消保网
2026-03-17 -
创想三维赴港IPO :经调整净利超9000万 行业龙头受益AI热潮
2026-03-16 -
幸福人寿湖北分公司开展3·15专题宣传活动
2026-03-13 -
友邦保险研究显示对于健康的固有刻板印象正窒碍亚洲大众的身心健康发展
2026-03-13 -
指数投资大厂“上新”,港股通信息技术ETF华夏3月16日起盛大发行
2026-03-13 -
微短剧,游园会……招行信用卡把消保宣教“玩出花”
2026-03-13 -
港区全国人大代表冼汉迪: 加快推动自动驾驶规模化、全球化发展
2026-03-12 -
AI赋能,挖掘先机:九方智投AI股票机举办“318 AI理财节”
2026-03-12 -
瑞众保险重磅回归央视《开门大吉》,以温暖守护诠释品牌信赖
2026-03-12 -
2026中关村论坛年会「AI 未来论坛」启动报名
2026-03-11 -
欢聚集团Q4营收5.819亿美元 环比增长7.7% 同比增长5.9%
2026-03-11




