AGC 体系结构
AGC — AI Computer System with the GPU as its Core。以GPU为系统绝对核心,CPU仅作为控制通道和I/O接口使用,构建新一代智算架构体系。
全栈自研,构筑技术壁垒
AGC联盟从底层芯片架构到上层推理框架,构建了完整的技术闭环。关键技术模块包括:GPU能耗智能管理、GPU热插拔技术、GPU-Raid热备技术,三大核心突破为智算中心提供了前所未有的可靠性保障。
三大核心突破:GPU能耗智能管理(基于AGC体系设计的动态功耗调节,空闲休眠10%功耗,节省90%电费)、GPU热插拔技术(服务器7×24小时运行中直接插拔GPU,无需停机,支持在线扩容与故障更换)、GPU-Raid热备技术(计算层硬件级冗余备份,毫秒级故障切换,零数据丢失零服务中断),三大突破重塑智算基础设施运维范式。
AGC 联盟介绍
AGC联盟致力于推动AGC体系标准的制定与产业落地,构建开放共赢的智算新生态。
联盟定位
在中国开放指令生态(RISC-V)联盟框架下,致力于推动AGC体系标准的制定与产业落地,构建开放共赢的智算新生态。
标准制定
牵头制定AGC体系五大标准:结构标准、接口标准、协议标准、控制标准、能耗标准,为中国智算产业提供技术规范与行业准则。
生态成员
专业组首批成员覆盖服务器厂商、AI芯片研究院、系统厂商等领域,涵盖寒武纪、燧原、天数、登临、井芯微、墨芯等国产GPU领军企业。
认证赋能
设立AGC三级认证体系:AGC-CSP(认证方案伙伴)、AGC-CTE(认证技术工程师)、AGC-CSA(认证系统架构师),为产业链输送标准化人才。
权威认可
AGC架构荣获第十三届ITEC全球创业赛唯一特等奖(全球141国、5215个项目中脱颖而出),获得国家级认可与行业权威背书。
国际协同
作为工信部人工智能标准化委员会成员单位,持续参与国家及行业标准制定,对接ISO/IEC、ITU等国际标准组织。
联盟生态
AGC联盟生态坚持"开放、共享、共赢"价值观,实现产业链全覆盖与技术协同创新。
产业链全覆盖,技术协同创新
AGC联盟从底层芯片到应用服务实现全链路生态联动,联合国产GPU厂商、服务器伙伴、软件生态、科研院校共同打造智算产业新格局。
服务器伙伴
整机OEM · 模块合作 · 浪潮合资
国产GPU厂商
寒武纪 · 燧原 · 天数 · 登临等
软件生态伙伴
百度飞桨 · PyTorch · TensorFlow
科研院校
清华 · 北大高可信软件实验室
权威机构
工信一所 · 中国信通院 · RISC-V
渠道代理商
区域独家授权 · 阶梯返点政策
行业用户
互联网 · 金融 · 制造 · 医疗 · 政务
认证培训体系
AGC-CSP · AGC-CTE · AGC-CSA 三级认证
AGC 联盟动态
追踪联盟前沿资讯,了解行业最新动态与合作机会
AGC联盟携创新架构亮相北京智算峰会
AGC联盟联合RISC-V联盟于北京国际会议中心举办智算架构创新论坛,AGC全栈解决方案获行业高度关注,现场签约合作伙
了解详情 →AGC联盟服务
全方位服务体系,助力合作伙伴快速融入AGC智算生态
AGC技术认证
提供AGC-CSP/AGC-CTE/AGC-CSA三级认证培训体系,覆盖从入门到专家的完整学习路径,助力合作伙伴快速掌握AGC技术核心能力。
AGC 核心能力
全栈自研的四大技术模块,从架构创新到智能运维,覆盖智算产品的完整生命周期,构建难以复制的技术竞争壁垒。
去中心化分布式控制
将控制能力下沉到每个计算单元,实现分布式的智能调度,彻底消除传统集中式控制单元的单点瓶颈。算力利用率从传统架构的平均45%提升至82%,训练任务完成时间缩短30%-50%。
数据就近处理
让计算任务尽可能靠近数据所在位置运行,大幅减少跨节点数据搬移开销。彻底解决冯诺依曼架构内存墙/带宽墙/功耗墙三大根本瓶颈,从架构层消除无效数据搬运损耗。
资源全局池化
将GPU等算力资源形成统一资源池,实现按需分配与灵活调度。单台AGC系列服务器GPU/CPU比可达20:1,而传统架构仅为2:1,算力密度提升10倍,大幅降低配套资源成本。
AIOS 智能操作系统
专为AGC架构设计的自研操作系统,是整个智算系统的大脑。四大核心能力:资源池化、智能调度(AI算法实现任务最优分配)、异构管理(统一纳管CPU/GPU/NPU)、全栈安全可控,实现对底层硬件资源的精细化管理。
AI BMC 智能管理系统
专为AGC架构设计的小脑,实现全机状态采集、分析决策、下发执行、闭环优化的完整管控链路。内置小模型加持BMC系统管理,支持芯片级监控,数据延迟缩短至微秒级,支持GPU能耗管理与设备篡改监控。
全链路智能运维
自动化部署(分钟级上线)、AI驱动智能调度(集群负载均衡)、精细化监控(实时监控GPU温度/功耗/利用率等百项指标)、自动化运维(批量操作/软件升级/故障自愈),整体运维效率提升50%以上。
GPU 动态热插拔
在服务器正常运行、业务不中断的情况下,可直接对GPU板卡进行物理插拔操作,无需停机或重启。实现关键业务7x24小时零中断,彻底打破传统运维的时间窗口限制,支持在线扩容和故障在线更换。
GPU-Raid 热备份
借鉴成熟硬盘RAID原理,在计算层为GPU集群构建硬件级冗余备份机制。主GPU故障时,系统毫秒级自动触发任务迁移,全程无需人工干预,实现零数据丢失、零服务中断,满足金融/医疗等高安全等级场景。
GPU 节能休眠管理
GPU空闲时自动切换至低功耗休眠模式,休眠功耗仅为峰值功耗的10%;新任务到达时毫秒级唤醒,保障业务零感知。闲置功耗节省90%,直接降低数据中心电费,同时延长GPU硬件使用寿命,减少固定资产投入。
K系列 — 通用型智算主力
面向中小企业和部门级AI应用,提供高性价比、开箱即用的智算解决方案。兼容国内外主流GPU加速卡,支持2-64卡灵活配置,成熟风冷散热架构,全模块化设计便于维护升级,已在数百家企业稳定运行。
AGC系列 — 旗舰高性能算力
面向AI 2.0时代的超大规模高性能算力旗舰,搭载完整AGC计算架构。集成超级点散热、GPU热插拔、GPU-Raid热备三大独家技术,AI训练性能较同配置传统架构提升40%,散热效率提升50%,专为万亿参数大模型训练设计。
华安推理框架
高性能推理引擎,通过算子融合、内存优化等底层技术,结合AGC架构优势,推理性能比行业通用框架提升20%-40%。提供统一简洁API,支持主流模型格式一键转换,分钟级模型部署上线,支持公有云/私有云/边缘多平台适配。