GIGABYTE 搭載 AMD Radeon™ AI PRO 系列解決方案
企業級 AI 推論,恰如其分,隨需擴展
AMD Radeon AI PRO軟體AI 推論
強大效能與開放、可擴展 AI 的完美結合
並非每個 AI 部署都需要頂級訓練叢集。多數企業真正需要的是能可靠、安全的執行推論運算,並且建置成本為可負擔的方案。AMD Radeon™ AI PRO R9000 系列皆支援 AMD ROCm™軟體、配備 32 GB 記憶體並支援開放式多 GPU 擴展,單台伺服器最多可容納 16 張顯示卡—為大型語言模型、RAG 資料處理排程,以及運行於自有基礎架構上的代理式 AI 提供實用的基礎。
選擇適配的 GPU,加速 AI 推論
R9700S 與 R9600D 具備高達 64 個運算單元、128 個第二代 AI 加速器,並原生支援 FP8、FP16 與 INT8資料型態,為當今嚴苛的 AI 工作負載帶來多樣性。透過 AMD ROCm™ 軟體提供的簡潔多 GPU 擴展能力,開發者能在開放 AI 生態系統中突破單卡記憶體限制,於 Linux 上部署具成本效益的大型語言模型加速方案。兩款顯卡皆採被動散熱設計,藉由氣流與液冷工程最佳化散熱設計確保運作順暢。
RDNA™ 4
架構
PCIe Gen5
頻寬
第二代
AI加速器
32GB
記憶體
DisplayPort™
2.1
規格 | AMD Radeon AI PRO R9700S | AMD Radeon AI PRO R9600D |
| 運算單元 | 64 | 48 |
| 第 3 代光線追蹤加速器 | 64 | 48 |
| 第 2 代 AI 加速器 | 128 | 96 |
| 架構 | RDNA 4 | |
| 峰值半精度(FP16 矩陣)效能 | 191 | 99 |
| 記憶體匯流排寬度 | 256-bit | |
| 記憶體頻寬 | 640 GB/s | |
| 實體記憶體 | 32 GB GDDR6 | |
| 主機介面 | PCIe Gen5 | |
| 顯示卡功耗 (TBP) | 300 瓦 | 150 瓦 |
| PCIe 尺寸 | 全高全長 | |
| 散熱與外型規格 | 被動式散熱、雙插槽 | 被動式散熱、單插槽 |
開源軟體,開放生態系
高效運算設備只是完成AI部屬的起始階段。AMD ROCm™ 是一套開放的軟體堆疊,讓開發者可在已使用的框架與模型執行期直接運行,無需支付綁定費用;且多 GPU 的擴充能力為原生內建。對於習於採用開放模型與開放工具的開發者而言,此為關鍵所在:開發者能保有隨技術演進而即時更換模型、框架與供應商的彈性與自由度。
為企業級代理式 AI 打造的推論引擎
AMD Radeon™ AI PRO R9000 系列專為企業 AI 實際部署的場景而打造—無論是工廠、醫院或是金融交易。在邊緣 AI、醫療照護與金融服務等領域,R9700S 與 R9600D 皆能加速智慧影像分析、醫學影像與 AI 輔助診斷、詐欺偵測、風險模型建置以及自主 AI 代理等推論工作。結合 GIGABYTE 高密度 GPU 伺服器,能同時處理大量運行的 AI 請求與代理操作,維持高利用率,並隨需求成長而彈性擴展且同時降低每次推論運算的總成本。
邊緣 AI
零售 | 智慧城市 | 製造業
醫療照護
醫學影像 | 基因體學 | 電子病歷 (EMR)
金融服務
詐欺偵測 | 演算法交易 | 風險模型
GIGABYTE AI 推論伺服器解決方案
G494-ZB0-LAP1 + 8 x R9700S
領先業界的 AMD 平台搭載於 4U 液冷設計GPU伺服器,專為需要兼顧最高 GPU 密度與能源效率的資料中心部署而設計。
- CPU + GPU DLC 解決方案,最高可節省 23% 電力
- 2 x AMD EPYC 9005 伺服器處理器
- 8 x AMD Radeon AI PRO R9700S顯示卡
- 支援AMD Pensando™ Pollara 400 AI 網路介面卡
W793-ZU0-LA71 + 4 x R9700S
閉環迴路液冷設計工作站,適合需要在低噪音或中小企業環境中部署AI 運算能力的團隊。
- 閉環迴路液冷解決方案,辦公室即插即用
- 1 x AMD EPYC 9005 伺服器處理器
- 4 x AMD Radeon AI PRO R9700S顯示卡
- 高覆蓋率液冷設計,涵蓋處理器/記憶體/運算卡/電源供應器
- 低噪音,低於50分貝
G294-Z43-AAP2 + 16 x R9600D
高密度AI推論平台,搭載16張R9600D顯示卡,實現每機架單位最大同時服務量。
- 處理器/運算卡獨立氣流通道設計
- 2 x AMD EPYC 9005 伺服器處理器
- 16 x AMD Radeon AI PRO R9600D顯示卡
採用 AMD Radeon AI PRO的高密度AI推論液體冷卻機櫃決方案
由32張 AMD Radeon™ AI PRO R9700S顯示卡與8顆AMD EPYC™ 處理器組成,配置於四個 G494 4U冷伺服器中,這套42U機櫃級平台為生成式AI、RAG與代理式AI提供高密度推論能力。機櫃內搭載G-REX用於管理監控冷卻分配單元、電力與散熱管理系統,確保溫度與功耗維持在可控範圍內。透過GIGABYTE POD Manager (GPM) 進行叢集規模遠端監控維運管理、納管已驗證的軟體定義儲存方案或GIGABYTE儲存伺服器擴充容量,為安全、高效、企業級的私有AI提供隨插即用的基礎架構。
企業私有 AI
讓 AI 模型運行於企業自主掌控的基礎架構,從企業內部智慧助理、文件檢索到企業知識庫問答助手,擁有資料主權安全可控。
代理式 AI
讓 AI 能跨多步驟、多工具自主規劃並執行任務,而非僅回應單一提示,提供持續吞吐量與並行處理能力,是效能表現的關鍵所在。
邊緣 AI
讓推論運算在資料產生的當下即完成。資料延遲、部署空間、電力功耗與噪音在邊緣運算場域都成為建置瓶頸,而這正是顯現單插槽、150瓦的 R9600D顯示卡與 GIGABYTE邊緣運算平台展現優勢之處。
RAG / MCP
檢索增強生成(RAG)讓模型的回應建立在企業自有文件與資料庫之上,模型上下文協定(MCP)則提供標準化方式存取即時工具與資料來源。兩者皆以模型規模換取更高的準確性與時效性,而具備充裕記憶體與強大 FP16/INT8 推論能力的 AMD Radeon AI PRO 顯示卡,正是此應用的最佳選擇。
多用戶 AI 服務
一套 AI 平台同時服務多人、多團隊或多應用場景,成為企業內部共享服務站,而非單一用途的專屬設備。其成效以每櫃、每瓦特的平行工作負載衡量,高GPU密度節點搭配 GIGABYTE POD Manager 的資源配置與監控功能,讓 IT 團隊能依使用需求進行資源調度。