KONST
AI 訓練計算器聯絡我們
繁中
算力交付

三種算力交付模式
裸機、虛擬化與容器、token 計量

KONST Group(康斯特超算集團)提供三種算力交付方案:KONST 直供的裸機叢集、集團自研 Horizon AI 的 token 計量平台,以及合作夥伴 Glows.ai 的虛擬化與容器資源。機型涵蓋 B300、B200、H200 與 H100。

GPU 累計交付3,856張最大單案 1,024 張
SOLUTION| 康斯特的解法

三種交付模式,
從千卡 GPU 叢集到 token API Key

起算點是工作負載:長期滿載的訓練取裸機,需要彈性配額取虛擬化與容器,只需要模型輸出取 token 計量。三種模式可在同一專案並用。

01KONST · GPU Cluster

裸機交付

整批獨占硬體,單節點至千卡叢集,InfiniBand 或 RoCE v2 高速互連。設備置於康斯特機房,所有權留康斯特。

裸機交付規格
02Glows.ai · GPU Cloud

虛擬化與容器交付

以虛擬機或容器取用 GPU,快照與 VPC 隔離內建,免自建與自維;平台由合作夥伴 Glows.ai 提供。

虛擬化與容器規格
03Horizon AI · ATP Token

token 計量交付

集團自研的 ATP Token 平台,一把 API Key 呼叫 70 個以上開源模型,逐請求計量,不需取得硬體。

token 計量規格
PROCESS| 執行流程

從負載評估到開通,
四階段完成交付

先確認負載型態,再回推交付模式與機型。三種模式的開通方式不同:裸機移交連線權限,平台開通配額,token 計量發放專案 Key。

  1. 01負載評估

    確認工作負載是訓練、微調或推論,以及預計使用時數與資料存放要求。

  2. 02選定模式與機型

    依負載回推交付模式與 GPU 機型,同一專案可跨模式配置,例如訓練走裸機、推論走 token 計量。

  3. 03開通與移交

    裸機於作業系統初始安裝後以專屬 VPN 移交使用權;虛擬化與容器於平台開通配額;token 計量發放專案 Key 即時生效。

  4. 04用量與維運

    裸機自移交日起進入維運範圍;token 用量依組織、工作區與專案歸戶,於用量儀表板逐專案檢視。

EVIDENCE| 實績與數據

累計交付 3,856 張 GPU,
最大單案 1,024 張

GPU 數與最大單案沿用 GPU 叢集建置頁的口徑,專案涵蓋台灣、日本與馬來西亞;機型數為裸機與虛擬化兩種模式的聯集。

3,856張GPU 累計交付
1,024張最大單案(馬來西亞,B300)
8款可取得的 GPU 機型
70+個token 平台接入開源模型
FEATURE| 核心功能 01

裸機交付

KONST · GPU Cluster

整批獨占硬體,由 KONST 直供。設備置於康斯特機房,作業系統初始安裝完成後以專屬 VPN 移交使用權,設備所有權留康斯特。

單節點至千卡叢集

從單台伺服器到千卡等級叢集整批交付

InfiniBand · RoCE v2

跨節點高速互連,依叢集規模選定

高速儲存

叢集搭配 AI 高速儲存一併交付

專屬 VPN 移交

獨立網路與專屬連線,資料留在指定場域

可用 GPU
  • HGX B300最新世代
  • HGX B200
  • HGX H200
  • HGX H100
  • SXM A100
1 節點1,000+ GPU

單一叢集規模 · 最大單案 1,024 張 B300

  • InfiniBand
  • RoCE v2
  • AI 高速儲存
FEATURE| 核心功能 02

虛擬化與容器交付

Glows.ai · GPU Cloud

以虛擬機或容器取用 GPU,平台開通即用,依專案分配配額,按使用時間計費,免自建與自維。平台由合作夥伴 Glows.ai 提供。

虛擬機與容器環境

虛擬機與容器兩種環境,依工作負載選用

自動部署

運算環境自動部署,開通即可使用

Datadrive 與快照

Datadrive 持久儲存,環境可存成快照

VPC 與 Matrix0 資料庫

私有網路隔離,資料庫服務內建

可用 GPU
  • HGX B200
  • HGX H200
  • HGX H100
  • RTX PRO 6000
  • SXM A100
  • L40S
  • RTX 6000 Ada
平台服務
  • VMs
  • 容器環境
  • 自動部署
  • Datadrive
  • 快照
  • Matrix0 資料庫
  • VPC
FEATURE| 核心功能 03

token 計量交付

Horizon AI · ATP Token

One Key, Every Model。集團自研的 ATP Token 平台,一把專案 API Key 呼叫 70 個以上開源模型,逐請求計量;既有程式改接入點即可,不需取得硬體。

One Key, Every Model

相容 OpenAI、Anthropic、Gemini 介面

專案額度與點數

預儲值、無月費,依請求用量計費

用量儀表板

依組織、工作區、專案逐層檢視用量

請求級稽核日誌

每一筆請求可追溯、可查核

組織架構

組織工作區專案Key

70+接入開源模型
Agent 能力
  • 多模型接入
  • MCP 工具整合
  • A2A 協議
  • Agentic RAG
  • Agent 工作流程
  • 人工確認
  • 權限邊界
  • 用量治理
可承載應用
  • 程式開發 Agent
  • 深度研究 Agent
  • 瀏覽器 Agent
  • 多 Agent 編排器
FEATURE| 適用情境比較

三種 GPU 算力交付模式適用情境比較

判準是負載曲線:用量長期貼著容量跑選裸機,起伏大選虛擬化與容器,只需要模型輸出選 token 計量。

比較項目裸機交付虛擬化與容器交付token 計量交付
取得的是什麼整批獨占的 GPU 伺服器依配額取用的虛擬機或容器模型的輸出,不含硬體
負載型態長期滿載,連續數月不停機間歇或尖峰負載,用量隨需求起伏零星或不固定的推論請求
典型應用大模型預訓練與長時間微調;多節點分散式訓練;高吞吐量的批次推論分子動力學等科學運算;量化交易策略回測;教學、研究與課程環境企業 AI 應用與服務開發;Agent 工作流與自動化;多模型比對與評測
硬體控制權完整控制,自行安裝框架與驅動平台環境內自行配置不需管理硬體與模型部署
資料存放留在指定場域,專屬 VPN 連線平台內 VPC 隔離依專案 Key 分層權限控管
計費基礎依卡數與合約期間按使用時間按請求用量,預儲值、無月費
開通方式作業系統初始安裝後以 VPN 移交平台開通即用發放專案 Key 即時生效
BENEFIT| 共通保障

三種模式共用同一套效率、合規與安全

效率、合規與安全三項不分交付模式,比較基準是企業自建自維同等算力時需自行補齊的維運與稽核能力。

效率

成本優化

  • 監控平台
  • 全球算力供應
  • 多元選擇
合規

企業級維運

  • ISO 27001
  • 請求級稽核日誌
  • 24x7 維運
安全

權限與隔離

  • 分層 Key 權限
  • 團隊版權限隔離
  • 私有雲 / 混合雲
FAQ| 常見問題

常見問題

同一個專案可以同時用兩種以上的交付模式嗎?

可以。例如訓練走裸機、推論走 token 計量,資源與帳務分開。三種模式分屬不同的服務線,不必綁在同一份合約。

只需要模型輸出,還需要先租 GPU 嗎?

不需要。token 計量交付以請求計費,不必取得整台機器,也不必自行部署與維運。需要獨占硬體或自行部署模型時,才需要裸機或虛擬化與容器資源。

哪些 GPU 機型可以透過這三種模式取得?

裸機涵蓋 HGX B300、B200、H200、H100 與 SXM A100。虛擬化與容器涵蓋 HGX B200、H200、H100、RTX PRO 6000、SXM A100、L40S 與 RTX 6000 Ada。token 計量以模型計,不需指定機型。

裸機叢集最大可以做到多少張 GPU?

單節點至千卡叢集。最大單案為馬來西亞 1,024 張 B300,高速互連採 InfiniBand 或 RoCE v2,依叢集規模與訓練需求選定。

虛擬化與容器交付和裸機交付差在哪?

差在是否獨占硬體。裸機整批獨占,適合連續數月滿載的訓練;虛擬化與容器依專案分配配額、按使用時間計費,適合間歇負載與短期驗證。

token 計量交付如何控管各團隊的用量?

以組織、工作區、專案、Key 四層歸戶。每個專案可設額度與點數上限,用量儀表板逐專案檢視,請求級稽核日誌可逐筆查核。

可以部署在私有雲或混合雲嗎?

可以。資料不得離開指定場域時,可採私有雲或混合雲架構,搭配分層 Key 權限與團隊版權限隔離。

還在評估哪一種交付模式?

說明負載型態、預計使用時數與資料存放要求,我們回覆建議的交付模式與機型配置。