点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:华为云发布FlexNPU 打造弹性伸缩的“算力金箍棒”
首页> 经济频道> 光明经济 > 正文

华为云发布FlexNPU 打造弹性伸缩的“算力金箍棒”

来源:光明网2026-03-21 21:55

  3月20日,华为云中小企业AI解决方案发布会上推出了一项算力黑科技——柔性智算操作系统FlexNPU,将Token消耗“吞金兽”有效控制在企业预算范围内,打造面向Agentic时代的极致Token性价比,为企业级智能体的普及突破算力瓶颈。

  华为云中国区销售伙伴发展部部长、华为云中国区Marketing与解决方案销售部部长郭婷在致辞中表示,2026年华为云将构建AI时代更加肥沃的“黑土地”,让算力服务更柔性、更适配中小企业的轻量化需求,实现从“调度靠拍板”到“成本算到精”的转变,解决“用不起、用不好”算力的核心难题。

华为云发布FlexNPU 打造弹性伸缩的“算力金箍棒”

华为云中国区销售伙伴发展部部长、华为云中国区Marketing与解决方案销售部部长郭婷

  企业AI应用现状:一半是海水,一半是火焰

  当下,“养龙虾”成为全民热点话题,为千行万业尤其是中小企业提供了建设智能化工作流程的清晰思路。会上,华为云SMB解决方案与持续运营部部长刘杰用“一半是海水,一半是火焰”生动形容了目前企业智能化转型的现状:以OpenClaw为代表的先进生产力工具层出不穷,但AI实际应用往往面临着成本高山、技术壁垒、场景错位等挑战。

  对此,华为云发布中小企业AI解决方案,涵盖AI基础设施层、模型服务层、智能体平台层、智能体应用层,帮助企业打造能对接ERP、能调用API、能闭环业务流程的“数字员工”。目前,华为云已深入2600多家企业、30多个行业,解决500多个AI场景化问题,成为企业AI创新路上的可靠伙伴。

  刘杰介绍,在AI基础设施层,华为云提供昇腾多代系产品,以及自研的AI Infra OS,尤其是FlexNPU柔性智算技术,一方面满足中小企业小模型训练场景,另一方面通过弹性调度能够大幅提升资源利用率;在模型服务层,华为云支持业界主流开源模型,让企业既能根据业务需求灵活选择,也能结合自有数据低成本微调专属模型;在智能体平台层,华为云提供易用高效的Agent开发环境,助力开发者和中小企业面向行业结合场景打造企业级智能体;在智能体应用层,华为云联合伙伴深入场景,覆盖洞察分析、营销运营、协同办公、开发运维、内容制作等高频需求。

  刘杰还表示,华为云致力于提供AI解决方案,做好基础设施和平台底座,伙伴则提供AI行业解决方案、AI行业场景应用、AI专业服务交付,实现深度共创。会上,华为云发布“加速智能化 企业快成长行动2026”,为中小企业、开发者提供从品牌、商业、技术等全方位的支持,共赢AI市场,共同加速企业智能升级。

  打造算力“金箍棒”,大幅降低算力成本

  “我们的推理池平均利用率竟然不足30%,我们花费重金建设、动辄数万、数十万卡的AI硬件算力池,竟有超过一半以上的算力在‘摸鱼,吃空饷’。”华为云首席架构师、华为公司Fellow顾炯炯在现场抛出了一组惊人数据。他指出,Agent时代企业普遍面临算力痛点:Agent自主规划、多轮迭代、长上下文导致Token消耗量呈指数级增长,如何有效降低Token成本,成为最核心和迫切的挑战。

  为此,华为云发布了黑科技——柔性智算FlexNPU,通过构筑强大而灵活的AI Infra层算力调度技术,大幅提升推理池的有效算力利用率,从而以相同AI硬件算力投入,提供更大的Token吞吐输出。

  对于柔性智算FlexNPU,顾炯炯以可大可小、变化随心的“如意金箍棒”生动形容,表示FlexNPU赋予NPU/GPU算力“柔性或液态化”供给与伸缩的能力,可依据任意业务需求动态变化随需而动,如同金箍棒一般“可大可小、变化随心”,通过最大化AI算力投入的利用率,最终实现Token性价比的最优化。

  具体而言,柔性智算FlexNPU具备极致共享、极致弹性和极致高可用3大属性:

  大模型推理方面,FlexNPU通过引入基于柔性算力的PD动态混部、在离线推理混部等创新技术,完美解决了传统PD分离架构下Prefill和Decode集群不均衡的AI Core与显存利用率,以及推理业务潮汐变化规律所导致的大量AI算力空转浪费难题,将带来至少40%的Token性价比提升空间

  小模型推理方面,FlexNPU通过实现最小粒度达1% NPU卡及128MB显存的颗粒度的AI Core时分复用,以及显存空分复用,为小模型提供真正完美匹配其算力诉求、量体裁衣的虚拟NPU资源,将小模型的算力成本降低2-3倍以上;

  推理高可用保障方面,FlexNPU通过软硬解耦及Token级KV Cache的实时快照,使得上层推理框架不再需要感知底层的硬件故障,即可实现故障秒级快速恢复及断点续推,大大减少了Agent推理会话重计算开销,提升了用户的推理体验

  顾炯炯强最后总结到,FlexNPU的核心价值体现在:无需再为大模型推理的闲置算力,以及小模型推理的独占算力浪费买单,更不再需要为昂贵的故障重算买单,真正实现了AI算力分配供给从“资源模式”到“效率模式”的范式转变,“让每分AI算力投入迸发最大价值,让智能体的海量Token人人消费得起。”

  深入千行万业,做好伙伴AI创新的“黑土地”

  华为云领先的智能化基础设施,正在成为千行万业伙伴进行技术创新、产品研发和商业拓展的重要支撑。发布会现场,华为云伙伴代表分享了多个真实案例。

  天宽科技有限公司CTO龚徐建介绍,天宽科技基于昇腾算力平台打造制造业Agent解决方案,可实现智能知识问答、合同智能审核、风险识别等功能,合同审核准确率达90%,审核效率提升3倍,生产数据查询时间从1小时缩短到2分钟,将企业人力从繁琐重复的工作中解放,双方后续将在市场洞察、能力共建、成单路径等方面进行拓展合作。

  天津宏达瑞信科技有限公司CEO丁照祥则从零售物流行业角度,探讨AI落地带来的巨大价值,表示宏达瑞信基于华为云天筹求解能力,打造AI智能路径规划方案,助力商家获得商品从仓库到经销商的运输最优解,并且可以根据复杂的交通条件灵活配置,排线效率提升60倍以上,减少冗余出车次数20%,物流成本降低5.8%。

  人工智能底层技术发展,牵引Al Infra算力基础设施、开闭源大小模型、Agent使能框架与工具等快速演进,激发更多AI创新。面向未来,华为云将秉持“用AI解行业难题”的理念,在应用层、模型层、算力层耕耘AI算力黑土地,携手伙伴共进共赢,抓住AI时代的机遇。(张伟)

阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 山西运城:花海春色

  • 星空相册丨春分悬日

独家策划

推荐阅读
“遥感是人们在距离和感官上的延伸,是认知地球、探查资源、监测环境的重要技术手段。本次活动由全国科学道德和学风建设宣讲教育领导小组主办,中国科协科学技术传播中心、湖南省科学技术协会、中南大学、光明网联合承办。
2026-03-20 09:42
每年春季,花粉过敏会给不少人带来困扰。该检测试剂盒采用微量血清特异性洋白蜡花粉过敏原IgE定量检测,用以辅助诊断,成为目前用于花粉症精准诊断的主要方法。
2026-03-20 09:39
3月18日,记者从新疆电力交易中心有限公司获悉,自2010年启动“疆电外送”以来,新疆累计外送新能源电量已达3043.6亿千瓦时,约占总外送电量的三成。
2026-03-20 09:39
吕小康:从现实语义上看,情感AI既指能够识别、理解、模拟和响应人类情感的人工智能技术,也指基于这类技术设计和开发的情感智能体。吕小康:为引导青年群体健康使用情感AI,还需要进一步加强协同治理,培育积极有益的陪伴型人工智能应用环境。
2026-03-20 09:36
据3月17日农情调度,全国早稻育秧已三成半,同比略快。据介绍,北方冬小麦当前的田管重点是继续促进弱苗转化升级,抓好病虫防控,防范春旱、倒春寒、干热风等灾害。“近日国家启动投放1000余万吨氮磷及复合肥储备,作为国家化肥储备重要承储主体,全国供销合作社系统农资企业积极按要求将储备化肥及时集中投放市场,稳定市场价格。
2026-03-20 09:36
小时候我们背过一句话:万物由原子组成。这一路走来,从质子的异常,到夸克模型的提出,再到量子色动力学和标准模型的建立,人类把物质拆解到了17种基本粒子的层级。曾获国家六部委回国人员成就奖、德国洪堡研究奖、吴有训物理奖、中国科学院优秀研究生导师奖。
2026-03-20 09:35
吴晓民(右一)团队在野外工作。藏羚羊曾广泛分布于高原全境,其漫长的演化史与复杂的种群波动,始终是全球动物保护与演化生物学领域关注的焦点。研究团队还通过生态位模拟,锁定了藏羚羊的生命庇护所——青藏高原北部的可可西里、羌塘高原等区域。
2026-03-19 10:11
通知明确,各城市群应优先选择具备条件的燃料电池汽车、绿色氨醇、氢基化工原料替代、氢冶金以及掺氢燃烧等应用场景开展试点,积极探索氢能创新应用场景,形成“1个燃料电池汽车通用场景+N个工业领域应用场景+X个创新应用场景”的氢能综合应用生态。通知要求,氢能综合应用试点以城市群为主体开展申报,城市群应立足自身资源条件,因地制宜、宜氢则氢,避免各场景一拥而上、低水平重复建设。
2026-03-19 10:10
2026中关村论坛年会将于3月25日至29日在北京举办。
2026-03-19 10:04
日前发布的《中国地热产业发展报告2025》显示,我国地热产业多元化利用格局正在形成。在地热供暖发展带动下,我国地热产业规模长期稳居世界第一。
2026-03-19 10:00
由于土豆块茎外形粗陋、埋于地下,又不见于《圣经》,一度被殖民者视为“魔鬼之根”或带毒之物。另一方面,随着城市扩张与人口增长,粮食压力加剧,土豆因高产、耐寒、适宜在小块土地种植而被人们重视。
2026-03-19 10:00
作者:刘琦 仇焕广(分别系中国人民大学助理教授,辽宁大学党委常委、副校长)  今年《政府工作报告》提出,“推进先进适用农机装备研发应用,打通农业科技推广‘最后一公里’”。
2026-03-19 09:59
为此,生态环境法典针对重点流域、重要生态单元设置专门规范,明确长江、黄河等重点区域一体化保护要求,建立协同机制。生态环境法典第三编第六章“生态退化的预防和治理”,整合水土保持法、防沙治沙法的有关规定,分为水土保持、防沙治沙两节。
2026-03-18 09:38
“‘两弹一星’不是孤立的科技突破,而是面向国家需求‘从0到1’的科技创新。本次活动由全国科学道德和学风建设宣讲教育领导小组主办,中国科协科学技术传播中心、安徽省科学技术协会、安徽农业大学、光明网联合承办。
2026-03-18 09:27
对于1型糖尿病患者而言,胰腺中那些负责分泌胰岛素、调节血糖的胰岛β细胞,被自身免疫系统错误地当成了“入侵者”,日复一日地遭受攻击,直至彻底损毁。这3个病例,分别代表中国乃至全球再生医学领域的3个“首次”——世界首例自体、中国首例异体、世界首例青少年再生胰岛移植治疗1型糖尿病。
2026-03-18 09:27
记者3月17日从国家能源局获悉,2026年1至2月,全社会用电量累计16546亿千瓦时,同比增长6.1%。从分产业用电看,第一产业用电量223亿千瓦时,同比增长7.4%;第二产业用电量10279亿千瓦时,同比增长6.3%,其中,工业用电量同比增长6.4%,高技术及装备制造业用电量同比增长10.6%;第三产业用电量3231亿千瓦时,同比增长8.3%,其中,充换电服务业、互联网数据服务业用电量增速分别达到55.1%、46.2%。
2026-03-18 09:26
当前,以家庭农场、农民合作社、龙头企业为代表的新型农业经营主体已成为“强农兴村”的中坚力量,发展成效显著。夯实联农带农长效机制,还需构建多层次、可落地的政策环境,让农业经营主体有动力、有能力、有底气带动小农户共同增收。
2026-03-18 09:26
在成都温江区,骑行爱好者李先生沿着北林绿道前行,穿梭在虫鸣鸟叫、淡淡花香之中。”  一幅幅充满生机的新春图景,正是成都加快建设践行新发展理念的公园城市示范区的生动注脚。
2026-03-18 09:26
分享几个故事,一起走进地球科学的世界。
2026-03-16 18:39
工业和信息化部、财政部、国家发展改革委日前印发《关于开展氢能综合应用试点工作的通知》。通知提出,通过城市群试点,将氢能应用场景由燃料电池汽车向交通、工业等具备条件的多元领域拓展。
2026-03-17 09:35
加载更多