以高效能AI伺服器,驅動Agentic AI

前言
人工智慧正快速從內容生成,進一步演進至自主決策。生成式 AI 已改變企業產生文字、影像與程式碼的方式,而下一波 AI 創新的核心,將由 Agentic AI 推動。
Agentic AI 是一種具備推理、規劃、執行與持續自我改善能力的智慧系統,能在極少的人為介入下自主運作。相較於傳統 AI 應用,AI Agent 需要更多的運算資源,因此現代高效能伺服器將成為建構可擴展、安全且高效率的 Agentic AI 基礎架構之核心。
從生成式 AI 邁向 Agentic AI
生成式 AI 主要根據使用者的提示產生內容,擅長生成文字、影像、程式碼及其他形式的內容,但本質上仍屬於被動回應,並依賴人類下達指令。
Agentic AI 則進一步擴展這些能力,能夠自主分析目標、協調多個 AI 模型、與外部工具互動,並根據即時資訊持續調整決策。AI Agent 不再只是產生回應,而是透過自主執行,朝著完成完整目標而運作。
|
Generative AI |
Agentic AI |
|
根據提示產生內容 |
自主執行目標 |
|
單步驟、被動回應 |
多步驟、主動執行 |
|
單一 LLM |
多個 LLM 與多模態 AI 模型 |
Agentic AI 的基礎架構需求
支援 Agentic AI 的基礎架構,必須能處理多個 AI 模型與企業應用之間持續進行的推理、協調、資料檢索與推論。相較於傳統 AI 推論,Agentic AI 對運算效能、記憶體頻寬、網路連接、可靠性及系統擴展性提出更高的要求。
|
基礎架構需求 |
對 Agentic AI 的重要性 |
|
運算效能 |
採用 CPU、GPU 與 AI 加速器的異質運算架構,以支援推理、推論與協調工作負載。 |
|
連接能力 |
高頻寬網路、PCIe Gen5/Gen6、DDR5 與 NVMe 儲存,以實現低延遲的資料傳輸。 |
|
可靠性 |
高能源效率的伺服器架構、企業級防護與高效散熱設計,確保 AI 系統能可靠地 24/7 持續運作。 |
|
擴展性 |
提供彈性的擴充能力,以因應更大型的 AI 模型、更多 AI Agent 及持續成長的工作負載。 |
AEWIN AI 伺服器,賦能 Agentic AI
AEWIN AI伺服器專為持續運作的AI工作負載打造,提供所需的高效能基礎架構。透過具備擴展性與高度彈性的架構,AEWIN平台能協助企業依據不同工作負載需求部署AI基礎架構,從企業級AI推論到大規模Agentic AI應用皆能靈活支援。
AEWIN 平台搭載最新的Intel Xeon 6處理器與AMD EPYC 9006系列伺服器CPU,搭配高效能 AI 加速器,提供因應日益複雜 AI 工作負載所需的異質運算架構。平台支援PCIe Gen5/Gen6擴充、DDR5記憶體、高速網路及彈性的 NVMe 儲存配置,提供高頻寬資料傳輸能力,以實現高效率的資料處理與可擴展的 AI 運算。
為進一步提升基礎架構效率,AEWIN 採用Arivor的先進 雙相直接液冷(2P DLC) 技術,在提升運算密度的同時,也改善高負載AI環境下的能源使用效率。
這些先進的散熱方案有助於降低功耗、提升整體基礎架構效率,並確保系統可靠性與長期運作穩定性,為永續的AI部署提供支援。
總結
Agentic AI正將人工智慧從被動的內容生成,推向自主決策與執行。這項演進需要具備可擴展運算能力、低延遲連接、安全性與能源效率的 AI 基礎架構。
透過專為高負載AI工作負載打造的高效能伺服器,AEWIN提供可靠的基礎,協助加速Agentic AI的導入與應用。

