与先进编译一起探索!
让每一颗芯片,都跑出它的巅峰时刻
更优编译,更多Token
联系我们
15036153742
xiaozhao@acompile.com
浙江省杭州市萧山区宁围街道平澜路2121号浙江大学杭州国际科创中心水博园区C14楼-901
ACAgemms

面向多元算力的算子自动生成与
智能优化平台
立即咨询
平台能力
基于 Agent 驱动的算子自动生成、迁移与智能优化能力,
打通模型算子与多元芯片之间的高性能落地链路。
NVIDIA GPU 及国产
AI芯片等多种异构算力平台
芯片覆盖
15+
多元 AI 芯片平台
Attention、MatMul/GEMM、 Norm、激活、融合算子等
算子覆盖
200+
大模型训推核心算子
基于真实硬件
Benchmark 测试结果
性能提升
80%+
平均性能提升
开发加速
大幅缩短
典型算子研发周期
3 倍
算子研发效率提升
适用场景
以算子为核心,贯通模型、软件与芯片之间的关键性能链路,助力模型加速、算子开发与跨芯适配,全面释放多元算力潜能。
聚焦模型关键算子优化,提升核心计算效率,加速模型整体执行。
覆盖算子生成、编译验证与性能调优,缩短高性能算子开发周期。
支持算子跨芯片快速适配与迁移,降低多元算力环境下的重复开发成本。
针对训练与推理中的热点算子持续优化,提升算力利用率与模型训推效率。
面向多种芯片架构提供统一的算子适配与优化能力,释放不同硬件平台的计算性能。
模型加速
算子开发
跨芯迁移
训推优化
异构计算





首页
关于我们
应用案例
生态合作
招贤纳士
联系我们
Copyright ©2026 杭州先进编译科技有限公司 版权所有
ACAgemms ,面向多元算力的算子自动生成与智能优化平台
基于 Agent 驱动的算子自动生成、迁移与智能优化能力,
打通模型算子与多元芯片之间的高性能落地链路。
输入
算子需求
参考实现
目标芯片
性能目标
支持芯片生态
↓
↓
↓
↓
↓
任务理解
策略规划
工具调用
迭代优化
Agent 智能决策中枢
正确可用
性能达标
多芯适配
持续优化
高性能算子交付
编译
Benchmark
Profiler
真机验证
工程工具链
自动生成
算子迁移
智能优化
从需求到实现
跨语言·跨芯片
从能运行到高性能
输出