欢迎访问CEO资讯

面壁智能开源ForgeStencil:工业软件优化进入Agent时代

科技IT 2026-08-06 user795653

  比特网8月5日消息,日前,面壁智能联合OpenBMB开源社区发布了全球首个支持Stencil(模板计算)自动研究、自动部署的AI优化系统ForgeStencil。官方数据显示,该系统在一周内完成100+个真实工业与科学计算软件的自动优化,研发效率较人类专家提升约100倍,且全程无需人工介入任何一步优化决策。

  在现代工业与科研底层,普遍跑着一种极度耗算力的核心模式――Stencil(模板计算)。无论是大气动力学、地震波场,还是电磁场演化、流体力学,其底层都是用网格点邻居的加权组合反复更新整个网格的访存密集计算,往往占据应用大部分运行时间,直接决定关键软件效率。过去把它优化到硬件极限,靠的是极度稀缺的HPC专家,且始终难以规模化。

  ForgeStencil的突破在于,首次实现从提出优化想法到应用无缝部署的全自动闭环。人类只需提供待优化的应用源码,后续从自动分析、定位热点、锻造Kernel,到算子替换、正确性验证与集成回原应用,全程没有专家介入任何优化决策。

  系统由两个Agent协作完成:Kernel Agent针对主流Stencil类型、多种Shape与精度自主构建专用算子矩阵,把数学表达写成逼近硬件极限的优雅代码;App Agent为每个应用单独锻造方案,定位热点、建立GPU基线、集成回原应用,并用应用自带测例做端到端评测。

  在同等硬件下与Halide、Devito、EBISU、DRStencil、FlashFFTStencil等开源最优框架对比,ForgeStencil展现明显优势:同精度(fp32)对比下,ForgeStencil获得几何平均2.35倍的加速比;混合精度(fp16)读写时,ForgeStencil拿下额外的1.95倍提速;在更难的变系数Stencil全部Shape上,相比最优基线ForgeStencil取得几何平均下1.34倍的加速。

  过去一位HPC专家每年精调的应用一般不超过20个,而ForgeStencil仅用1周即完成100+应用优化,单应用压缩到小时级,研发吞吐提升约1C2个数量级,且可随算力规模并行放大。与人类专家经验锁在脑子里不同,其并行Agent共享知识库,经验可实时复用、集体同步进化。目前,该项目已在GitHub开源。

  总体来看,ForgeStencil把Stencil这类最耗专家、最难规模化的底层算力优化自动化,给国产工业软件性能突围提供了新抓手。相信随着开源社区持续参与和更多真实工业场景接入,这套自动化范式将在产业落地中释放更大价值。

(来源:比特网)
The End
免责声明:本文内容来源于第三方或整理自互联网,本站仅提供展示,不拥有所有权,不代表本站观点立场,也不构成任何其他建议,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容,不承担相关法律责任。如发现本站文章、图片等内容有涉及版权/违法违规或其他不适合的内容, 请及时联系我们进行处理。

Copyright © 2099 CEO资讯 |中华人民共和国增值电信业务经营许可证号:苏B2-20221286

苏ICP备2022030477号-13 |——:合作/投稿联系微信:nvshen2168

|—— TXT地图 | 网站地图 |