跳到主要內容
AI 武林

推論與部署

Inference & Serving ・ 40 筆內容

把模型變成穩定、便宜、夠快的服務。

也叫做:推論、推理部署、inference、model serving、vLLM、TGI、模型部署、latency、throughput、KV cache

排行前 11 名

依相關、人氣、新鮮度綜合排序;站長推薦的加成

最新

依發布時間

  1. 文章INSIDE入門中文

    AI 代理來襲!台灣 74% 企業推 AI 僅 35% 導入 Kubernetes,Nutanix 揭 IT 雙重負擔(在新分頁開啟原站)

    台灣企業推動 AI 意願高,但僅 35% 正式匯入 Kubernetes,多數仍依賴虛擬化環境,面臨維運成本雙重負擔。Nutanix 透過單一平台策略協助企業平滑過渡,並推出支援開源的 NKP 方案,讓企業能將核心應用搬上容器化架構,提升…