以高性能AI服务器,驱动Agentic AI

前言
人工智能正快速从内容生成进一步发展至自主决策。生成式AI已改变企业生成文本、图像与代码的方式,而下一波AI创新的核心,将由Agentic AI推动。
Agentic AI是一种具备推理、规划、执行与持续自我改进能力的智能系统,能够在极少的人为干预下自主运行。相较于传统AI应用,AI Agent需要更多的计算资源,因此现代高性能服务器将成为构建可扩展、安全且高效的Agentic AI基础架构的核心。
从生成式AI迈向Agentic AI
生成式AI主要根据用户提示生成内容,擅长创建文本、图像、代码及其他形式的内容,但本质上仍属于被动响应,并依赖人类下达指令。
Agentic AI 则进一步扩展这些能力,能够自主分析目标、协调多个AI模型、与外部工具互动,并根据实时信息持续调整决策。AI Agent不再只是生成回应,而是通过自主执行,朝着完成完整目标而运行。
|
生成式 AI |
Agentic AI |
|
根据提示生成内容 |
自主执行目标 |
|
单步骤、被动响应 |
多步骤、主动执行 |
|
单一LLM |
多个 LLM 与多模态AI模型 |
Agentic AI 的基础架构需求
支持Agentic AI的基础架构,必须能够处理多个 AI 模型与企业应用之间持续进行的推理、协调、检索与推理运算。相较于传统AI推理,Agentic AI对计算性能、内存带宽、网络连接、可靠性及系统可扩展性提出了更高的要求。
|
基础架构需求 |
对Agentic AI的重要性 |
|
计算性能 |
采用CPU、GPU 与 AI加速器的异构计算架构,以支持推理、推理运算与协调工作负载 |
|
连接能力 |
高带宽网络、PCIe Gen5/Gen6、DDR5与NVMe存储,实现低延迟的数据传输 |
|
可靠性 |
高能效服务器架构、企业级防护与高效散热设计,确保 AI 系统可靠地24/7持续运行 |
|
可扩展性 |
提供灵活的扩展能力,以应对更大型的 AI 模型、更多AI Agent及持续增长的工作负载 |
AEWIN AI服务器,赋能Agentic AI
AEWIN AI服务器专为持续运行的AI工作负载打造,提供所需的高性能基础架构。通过具备可扩展性与高度灵活性的架构,AEWIN平台能够协助企业根据不同工作负载需求部署AI基础架构,从企业级AI推理到大规模 Agentic AI应用皆可灵活支持。
AEWIN平台搭载最新的Intel Xeon 6处理器与AMD EPYC 9006系列服务器CPU,搭配高性能AI加速器,提供应对日益复杂AI工作负载所需的异构计算架构。平台支持PCIe Gen5/Gen6 扩展、DDR5 内存、高速网络及灵活的NVMe存储配置,提供高带宽数据传输能力,实现高效的数据处理与可扩展的AI计算。
为进一步提升基础架构效率,AEWIN采用Arivor的先进双相直接液冷(2P DLC)技术,在提升计算密度的同时,也改善高负载AI环境下的能源使用效率。
这些先进的散热方案有助于降低功耗、提升整体基础架构效率,并确保系统可靠性与长期运行稳定性,为可持续的AI部署提供支持。
总结
Agentic AI正将人工智能从被动的内容生成推向自主决策与执行。这一演进需要具备可扩展计算能力、低延迟连接、安全性与能源效率的AI基础架构。
通过专为高负载AI工作负载打造的高性能服务器,AEWIN提供可靠的基础,协助加速Agentic AI的导入与应用。

