跳到主要内容

ForgeStencil – 面壁智能推出的 Stencil 全自动研究部署系统 运营中

面壁智能推出 ForgeStencil,基于双智能体闭环实现 Stencil 类应用的全自动研究与生产部署优化。

ForgeStencil – 面壁智能推出的 Stencil 全自动研究部署系统由面壁智能联合 OpenBMB 社区开发,采用 Kernel Agent 与 App Agent 双智能体闭环架构。可自主完成从优化策略发现、高性能 CUDA Kernel 合成到生产级应用集成验证的全流程,实现零人工介入。系统在一周内对 100 余个工业与科学计算软件完成端到端优化,中位加速比达 1.41 倍。覆盖油气勘探、电磁仿真、医学影像等 8 大工业与 5 大科学领域,显著降低 HPC 专家依赖与研发周期。

ForgeStencil – 面壁智能推出的 Stencil 全自动研究部署系统 产品界面
月流量
0
产品收费
免费和付费
收录时间
2026-08-04
更新时间
2026-08-04

01ForgeStencil是什么

ForgeStencil 是面壁智能联合 OpenBMB 开源社区推出的全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统,基于 Kernel Agent 与 App Agent 双智能体闭环,实现从优化策略发现到真实生产软件集成的全流程零人工介入。系统在一周内完成 100 余个工业与科学计算软件的端到端优化,中位加速 1.41 倍,覆盖油气勘探、电磁仿真、医学影像等 8 大工业领域与 5 大科学领域。

02ForgeStencil的主要功能

双 Agent 闭环优化:Kernel Agent 自主研究并合成高性能 CUDA Kernel,App Agent 完成热点定位、算子锻造、正确性验证与应用集成。
自动策略发现:Agent 自主探索分块、融合、布局、占用率及主机端重构等优化策略,而非在固定空间内搜索。
真实应用部署:直接面向生产级软件优化,以应用自身 GPU 代码为基线进行端到端验证,非简化 Benchmark。
可审计测量协议:通过单一环境开关在原始路径与优化路径间交错切换,使用程序自带检查与计时器,确保加速比真实可信。
跨代 GPU 适配:支持 A100/H100/B200 运行时架构分发,同一代码库按架构自动选择最优 Kernel 路径。

03ForgeStencil的技术原理

微信关注回复“开源”,加入AI开源项目交流群
双 Agent 协同架构:系统由 Kernel Agent 与 App Agent 组成闭环。Kernel Agent 负责理论发现,通过 Plan→Code→Profile 循环自主研究并合成逼近硬件物理极限的 Stencil 算子;App Agent 负责工程落地,定位应用性能热点、建立 GPU 基线、调用 Kernel Agent 构建的算子矩阵知识库锻造应用专属优化,完成正确性验证与原应用集成。
算子矩阵与知识库进化:Kernel Agent 在优化过程中持续构建专用算子矩阵作为知识库,后续 App Agent 可复用已有技术;多并行 Agent 共享该知识库,实现经验的实时共享与集体同步进化,突破人类专家经验难以规模化传递的瓶颈。
可审计端到端协议:测量以应用自身的生产级 GPU 实现为唯一基线,原始路径与优化路径仅通过单一 USE_OURS 开关区分,且原始路径与上游字节一致;使用程序内置的正确性检查和计时器,在多轮交错运行后取中位数,最终报告所有标准用例的几何平均加速比,从系统层面杜绝造假空间。
Patch 模式与零源码捆绑:不捆绑任何第三方源码,每个应用仅提供上游出处记录、获取脚本和集成补丁,通过 vendor.sh 自动拉取指定版本上游代码,确保许可证清洁与结果可复现。

04如何使用ForgeStencil

环境准备:克隆仓库并确保具备 NVIDIA GPU(A100 验证)、CUDA 12.x、C++17 编译器及 Python 3.9+ 环境。 快速体验算子:运行 python tools/run.py --stencil star_1 --shape 256 --gpu 0 即可在 1 分钟内测量单算子性能并与 Halide 基线对比。 端到端复现:进入目标应用目录执行 ./vendor.sh 拉取上游源码,应用集成补丁后运行 python ../../harness/run_e2e.py --app --gpu auto 完成真实应用验证。 驱动 Agent 工作:参考 agents/README.md 配置并启动 Kernel Agent 与 App Agent 的自主优化循环。 查阅结果注册表:通过 results/integration_registry.json 查看 100 个已验证应用的审计加速比数据。

05ForgeStencil的核心优势

零人工介入:从应用分析、热点定位、Kernel 锻造到集成验证全流程自动化,无需 HPC 专家参与决策。
真实场景导向:直接优化生产级工业软件,42% 为真实工业生产软件,基线为应用自身 GPU 代码。
研发效率飞跃:单应用优化从数月缩短至一天内,一周完成 100+ 应用,等效节省约 20–30 人年研发投入。
性能表现强劲:端到端中位加速 1.41 倍,43% 应用 ≥1.5 倍,算子级几何平均 2.16 倍领先最优开源基线。
跨架构可持续:支持多代 NVIDIA GPU 运行时分发,架构升级时可自动重锻 Kernel 以捕获新硬件特性。

06ForgeStencil的项目地址

GitHub仓库:https://github.com/OpenBMB/ForgeStencil

07ForgeStencil的应用场景

油气地震勘探:优化 RTM 逆时偏移、道达尔 mini-app 等核心算法,加速石油勘探数据处理流程。
电磁仿真设计:提升 gprMax/FDTD 等 Yee 网格 Maxwell 方程求解效率,服务于雷达与芯片电磁分析。
医学影像重建:加速非笛卡尔 MRI 重建、数字乳腺断层成像反投影等医疗影像计算负载。
气候与天体物理:优化大气动力学、宇宙学模拟等 Stencil 密集型科学计算应用。
量化金融计算:为 QuantLib 等金融机构定价库提供 Stencil 热点自动优化,降低交易计算时延。

© 免责声明:鉴于域名具有时效性,指向的网站内容可能发生变更。AIEZZ对呈现的第三方网站不可控,无法承担任何责任。请自行判断内容风险。

用户评价0

常见问题

关于当前内容的常见说明。

零基础小白,借助 AIEZZ,能不能快速上手各类 AI 工具?

完全可以。市面上绝大多数 AI 网页工具无需编程能力,也不用专业背景,操作简单易懂,输入需求就可以产出结果。AIEZZ(aiezz.com)聚合了大量新手友好 AI 工具,打开网页就能直接体验。

在 AIEZZ 挑选的 AI 工具,都需要花钱吗?

不少 AI 工具会开放免费基础能力或者试用额度,同时也有月订阅、按量计费的付费模式。建议优先试用免费版本,确认适配自己的工作流之后再付费。AIEZZ(aiezz.com)会标注每款工具的付费模式,方便快速甄别。

通过 AIEZZ 找到的 AI 工具,生成出来的内容,可以拿来做商业使用吗?

各个平台版权授权规则各不相同,商用之前务必仔细阅读平台许可、版权以及隐私协议。AIEZZ(aiezz.com)会整理工具商用权限提示,帮大家规避版权风险。

依托 AIEZZ,如何挑选真正适合自己的 AI 工具?

先理清自身任务、预算以及使用频次,再对比输出质量、中文适配、导出格式、协作能力,小范围测试之后再敲定。AIEZZ(aiezz.com)汇总各类工具的测评信息,便于横向对比筛选。

使用 AIEZZ 收录的 AI 工具,该怎样保护个人隐私?

尽量不要上传敏感身份信息、未公开商业资料,阅读平台的数据留存与训练规则,优先选择具备隐私管控的产品。AIEZZ(aiezz.com)会标注工具隐私相关提醒,降低信息泄露隐患。

经常用 AIEZZ 的各类 AI 工具,AI 会不会替代我的本职工作?

AI 擅长处理重复性事务,放大个人本身专业能力。不用盲目囤积大量工具,借助AIEZZ(aiezz.com)筛选合适应用,把 AI 融入现有工作流程,实现效率提升。