三種算力交付模式
裸機、虛擬化與容器、token 計量
裸機、虛擬化
KONST Group(康斯特超算集團)提供三種算力交付方案:KONST 直供的裸機叢集、集團自研 Horizon AI 的 token 計量平台,以及合作夥伴 Glows.ai 的虛擬化與容器資源。機型涵蓋 B300、B200、H200 與 H100。
三種交付模式,
從千卡 GPU 叢集到 token API Key
起算點是工作負載:長期滿載的訓練取裸機,需要彈性配額取虛擬化與容器,只需要模型輸出取 token 計量。三種模式可在同一專案並用。
token 計量交付
集團自研的 ATP Token 平台,一把 API Key 呼叫 70 個以上開源模型,逐請求計量,不需取得硬體。
從負載評估到開通,
四階段完成交付
先確認負載型態,再回推交付模式與機型。三種模式的開通方式不同:裸機移交連線權限,平台開通配額,token 計量發放專案 Key。
- 01負載評估
確認工作負載是訓練、微調或推論,以及預計使用時數與資料存放要求。
- 02選定模式與機型
依負載回推交付模式與 GPU 機型,同一專案可跨模式配置,例如訓練走裸機、推論走 token 計量。
- 03開通與移交
裸機於作業系統初始安裝後以專屬 VPN 移交使用權;虛擬化與容器於平台開通配額;token 計量發放專案 Key 即時生效。
- 04用量與維運
裸機自移交日起進入維運範圍;token 用量依組織、工作區與專案歸戶,於用量儀表板逐專案檢視。
累計交付 3,856 張 GPU,
最大單案 1,024 張
GPU 數與最大單案沿用 GPU 叢集建置頁的口徑,專案涵蓋台灣、日本與馬來西亞;機型數為裸機與虛擬化兩種模式的聯集。
裸機交付
KONST · GPU Cluster
整批獨占硬體,由 KONST 直供。設備置於康斯特機房,作業系統初始安裝完成後以專屬 VPN 移交使用權,設備所有權留康斯特。
單節點至千卡叢集
從單台伺服器到千卡等級叢集整批交付
InfiniBand · RoCE v2
跨節點高速互連,依叢集規模選定
高速儲存
叢集搭配 AI 高速儲存一併交付
專屬 VPN 移交
獨立網路與專屬連線,資料留在指定場域
- HGX B300最新世代
- HGX B200
- HGX H200
- HGX H100
- SXM A100
單一叢集規模 · 最大單案 1,024 張 B300
- InfiniBand
- RoCE v2
- AI 高速儲存
虛擬化與容器交付
Glows.ai · GPU Cloud
以虛擬機或容器取用 GPU,平台開通即用,依專案分配配額,按使用時間計費,免自建與自維。平台由合作夥伴 Glows.ai 提供。
虛擬機與容器環境
虛擬機與容器兩種環境,依工作負載選用
自動部署
運算環境自動部署,開通即可使用
Datadrive 與快照
Datadrive 持久儲存,環境可存成快照
VPC 與 Matrix0 資料庫
私有網路隔離,資料庫服務內建
- HGX B200
- HGX H200
- HGX H100
- RTX PRO 6000
- SXM A100
- L40S
- RTX 6000 Ada
- VMs
- 容器環境
- 自動部署
- Datadrive
- 快照
- Matrix0 資料庫
- VPC
token 計量交付
Horizon AI · ATP Token
One Key, Every Model。集團自研的 ATP Token 平台,一把專案 API Key 呼叫 70 個以上開源模型,逐請求計量;既有程式改接入點即可,不需取得硬體。
One Key, Every Model
相容 OpenAI、Anthropic、Gemini 介面
專案額度與點數
預儲值、無月費,依請求用量計費
用量儀表板
依組織、工作區、專案逐層檢視用量
請求級稽核日誌
每一筆請求可追溯、可查核
組織›工作區›專案›Key
- 多模型接入
- MCP 工具整合
- A2A 協議
- Agentic RAG
- Agent 工作流程
- 人工確認
- 權限邊界
- 用量治理
- 程式開發 Agent
- 深度研究 Agent
- 瀏覽器 Agent
- 多 Agent 編排器
三種 GPU 算力交付模式適用情境比較
判準是負載曲線:用量長期貼著容量跑選裸機,起伏大選虛擬化與容器,只需要模型輸出選 token 計量。
| 比較項目 | 裸機交付 | 虛擬化與容器交付 | token 計量交付 |
|---|---|---|---|
| 取得的是什麼 | 整批獨占的 GPU 伺服器 | 依配額取用的虛擬機或容器 | 模型的輸出,不含硬體 |
| 負載型態 | 長期滿載,連續數月不停機 | 間歇或尖峰負載,用量隨需求起伏 | 零星或不固定的推論請求 |
| 典型應用 | 大模型預訓練與長時間微調;多節點分散式訓練;高吞吐量的批次推論 | 分子動力學等科學運算;量化交易策略回測;教學、研究與課程環境 | 企業 AI 應用與服務開發;Agent 工作流與自動化;多模型比對與評測 |
| 硬體控制權 | 完整控制,自行安裝框架與驅動 | 平台環境內自行配置 | 不需管理硬體與模型部署 |
| 資料存放 | 留在指定場域,專屬 VPN 連線 | 平台內 VPC 隔離 | 依專案 Key 分層權限控管 |
| 計費基礎 | 依卡數與合約期間 | 按使用時間 | 按請求用量,預儲值、無月費 |
| 開通方式 | 作業系統初始安裝後以 VPN 移交 | 平台開通即用 | 發放專案 Key 即時生效 |
三種模式共用同一套效率、合規與安全
效率、合規與安全三項不分交付模式,比較基準是企業自建自維同等算力時需自行補齊的維運與稽核能力。
成本優化
- 監控平台
- 全球算力供應
- 多元選擇
企業級維運
- ISO 27001
- 請求級稽核日誌
- 24x7 維運
權限與隔離
- 分層 Key 權限
- 團隊版權限隔離
- 私有雲 / 混合雲
相關延伸服務
算力交付之外,機房建置、設備託管與企業 AI 導入各有獨立服務線,可在同一專案一併委任。
常見問題
同一個專案可以同時用兩種以上的交付模式嗎?
可以。例如訓練走裸機、推論走 token 計量,資源與帳務分開。三種模式分屬不同的服務線,不必綁在同一份合約。
只需要模型輸出,還需要先租 GPU 嗎?
不需要。token 計量交付以請求計費,不必取得整台機器,也不必自行部署與維運。需要獨占硬體或自行部署模型時,才需要裸機或虛擬化與容器資源。
哪些 GPU 機型可以透過這三種模式取得?
裸機涵蓋 HGX B300、B200、H200、H100 與 SXM A100。虛擬化與容器涵蓋 HGX B200、H200、H100、RTX PRO 6000、SXM A100、L40S 與 RTX 6000 Ada。token 計量以模型計,不需指定機型。
裸機叢集最大可以做到多少張 GPU?
單節點至千卡叢集。最大單案為馬來西亞 1,024 張 B300,高速互連採 InfiniBand 或 RoCE v2,依叢集規模與訓練需求選定。
虛擬化與容器交付和裸機交付差在哪?
差在是否獨占硬體。裸機整批獨占,適合連續數月滿載的訓練;虛擬化與容器依專案分配配額、按使用時間計費,適合間歇負載與短期驗證。
token 計量交付如何控管各團隊的用量?
以組織、工作區、專案、Key 四層歸戶。每個專案可設額度與點數上限,用量儀表板逐專案檢視,請求級稽核日誌可逐筆查核。
可以部署在私有雲或混合雲嗎?
可以。資料不得離開指定場域時,可採私有雲或混合雲架構,搭配分層 Key 權限與團隊版權限隔離。
還在評估哪一種交付模式?
說明負載型態、預計使用時數與資料存放要求,我們回覆建議的交付模式與機型配置。