技術
美國
中小企業/初創企業
「阿里雲協助我們透過單一 API 提供最廣泛的開源模型覆蓋。 隨着 Qwen 模型尺寸系列整合至 TrueForge,我們的用戶可以為每個智能體任務進行適配——從低於十億參數的快速編輯到百萬 Token 的程式碼庫級重構——同時在整個過程中維持單一治理層和一個儀表板。」
Nikunj Bajaj
TrueFoundry 行政總裁兼聯合創辦人
關於 TrueFoundry
TrueFoundry 是一家總部位於三藩市的 AI 基礎設施公司,為 AI 智能體構建生產層。 其旗艦開源產品 TrueForge 為團隊提供構建、部署、除錯及治理生產級 AI 智能體所需的一切——支援在其自有基礎設施內的任何模型及任何 MCP 伺服器。 NetApp 等企業已在 TrueFoundry 上大規模運行生產智能體。▸ TrueFoundry AI Gateway
挑戰
隨着 AI 智能體生態系統日趨成熟,TrueFoundry 識別出團隊從原型過渡到生產時面臨的四個關鍵障礙:● 模型碎片化:並非每個智能體任務都需要最大的模型。 快速編輯檔案不值得調用前沿規模的模型,而程式碼庫級重構則需要最強大的可用模型。 大多數團隊兩者都需要,但拼接不同供應商會產生大量整合開銷。
● 供應商鎖定:大多數受管理的智能體平台通過將團隊鎖定於單一模型供應商來解決生產複雜性。 團隊必須在精簡的智能體構建體驗與對其 AI 技術堆疊的完全掌控之間做出選擇。
● 大規模治理:多個模型通常意味著多個整合、多個儀表板及模糊的成本結構。 缺乏統一治理,團隊將無法掌握其智能體群體的支出、延遲和行為。
● 成本效益:受管理的單一供應商智能體平台存在顯著的成本溢價。 團隊需要一種在維持生產級可靠性的同時降低智能體總營運成本的方法。
為何選擇阿里雲
TrueFoundry 選擇阿里雲 Qwen 作為 TrueForge 開源發佈的創始模型合作夥伴,基於以下幾個關鍵因素:● 最廣泛的開源模型系列:Qwen 提供任何 AI 實驗室中最廣泛的開源模型範圍——從低於十億參數的模型到旗艦級 Qwen3-Coder-480B-A35B,編碼模型具備高達百萬 Token 的上下文。 沒有其他供應商在開源權重系列中提供如此廣泛的覆蓋。
● 家族一致性:所有 Qwen 模型共享統一的家族身份和函數調用格式,因此在不同尺寸之間切換感覺無縫,而非像整合新供應商。
● 生產級能力:Qwen 編碼系列在開源模型中於智能體編碼和工具使用任務上達到頂尖成果,表現可與領先的封閉模型媲美。
● 開源權重理念:Qwen 的開源權重方法與 TrueFoundry 的供應商中立理念一致。 團隊可將 Qwen 模型部署在自己的基礎設施上,不受專有限制。
架構
TrueFoundry 將完整的 Qwen 模型家族整合至其 Agent Harness,創建了一個統一平台,每個模型尺寸都置於一個 API 之後:● 一個 API,所有尺寸:智能體按名稱引用 Qwen 模型,工具會自動處理路由。 將 0.5B 模型換成 480B 旗艦模型只需更改名稱,而非重寫——切換尺寸時無需更改程式碼。
● 網關級治理:每次呼叫均透過AI Gateway運行,無論模型尺寸如何,皆套用相同的可觀測性及支出上限。 每個模型的 Token、成本和延遲匯總至單一儀表板,一個預算即可管理整個範圍。
● 適配工作流程:快速編輯交給小型 Qwen 模型,程式碼庫級重構交給具備百萬 Token 上下文的旗艦模型,中階工作負載交給高效變體(如 Qwen3-Coder-Next)——全部透過相同 API、經相同網關路由、在單一儀表板中可見。
關鍵成果
● 成本優化:與受管理的單一供應商智能體平台相比,智能體總營運成本降低約 50%。● 最廣泛的開源覆蓋:Qwen 的模型系列——從低於十億到 480B 參數——為 TrueForge 用戶提供單一 API 背後最全面的開源模型選擇。
● 零整合切換:在不同模型尺寸之間移動毫無障礙——無需程式碼重寫或重新整合,使適配成為自然習慣。
● 統一治理:一個 API、一個儀表板、一個預算——可觀測性及支出上限一致適用於每個模型尺寸。
● 生產驗證:在擁有數百名活躍用戶的 TrueFoundry 平台上,包括 NetApp 在內的企業已大規模運行生產智能體。
● 開源信任:Apache 2.0 授權及供應商中立性,相對於封閉替代方案建立信任。
未來展望
TrueFoundry 計劃隨着 Qwen 模型家族持續擴展,深化與阿里雲的合作——以新尺寸和專業化功能拓寬模型覆蓋,並透過更多受管理的伺服器和工具豐富 MCP 生態系統。 同時目標是擴展 TrueForge 以滿足企業採用需求,利用阿里雲的全球基礎設施實現全球低延遲存取。
精選產品
全系列、開源、多模態及多功能
在一個安全的阿里雲平台上加速千問、萬相和更多領先模型的部署和擴展
API 網關負責協調及管理各種 API 和 AI 請求,是構建應用程式的關鍵基礎設施。
其他相關案例
Infron
Infron 是一個 AI 閘道,透過一個相容 OpenAI 的 API 服務 400 多個領先模型,在阿里雲上運行其客戶的開源模型工作負載(Qwen、DeepSeek、Kimi、GLM)。 客戶可將工作負載固定至特定區域以滿足延遲及數據駐留要求,Infron 則隨流量增長從共享配額擴展至專用容量。
ReN3
ReN3 是一家總部位於新加坡的智能體 AI 平台,專為受監管的企業而設,借助阿里雲的 Qwen 模型,將 AI 推理成本降低 40%,輸出質量提升 30%,回應時間加快 30%,同時滿足東南亞地區嚴格的數據主權要求。
簡介
TrueFoundry 是一家總部位於三藩市的 AI 基礎設施公司,將阿里雲的 Qwen 整合至 TrueForge,這是一個開源、供應商中立的智能體工具。 這透過單一 API 提供了業界最廣泛的開源模型系列,並具備統一的可觀測性與支出治理,使團隊能夠以比受管理的單一供應商平台低約 50% 的成本構建生產級智能體。
所用產品/解決方案
查看更多解決方案
