技术
美国
中小企业/初创企业
"阿里云帮助我们在单一API背后实现了最广泛的开放模型覆盖。借助集成到TrueForge中的Qwen全规格模型,用户可以按需适配每个智能体任务——从十亿参数以下的快速编辑到百万Token的代码库级重构——同时保持统一的治理层和监控看板。"
Nikunj Bajaj
CEO兼联合创始人,TrueFoundry
关于TrueFoundry
TrueFoundry是一家总部位于旧金山的AI基础设施公司,致力于打造AI智能体的生产层。其旗舰开源产品TrueForge为团队提供构建、部署、调试和管理生产级AI智能体所需的全套工具——支持任意模型和MCP服务器,在自有基础设施内运行。
NetApp等企业已在使用TrueFoundry大规模运行生产环境智能体。
▸TrueFoundry AI 网关
挑战
随着AI智能体生态日趋成熟,TrueFoundry识别出团队从原型到生产面临的四大关键障碍:● 模型碎片化:并非每个智能体任务都需要最大的模型。
简单的文件编辑无需调用前沿级模型,而代码库级重构则需使用最强模型。
多数团队两者都需要,但拼凑多个供应商会产生巨大的集成开销。
● 供应商锁定:大多数托管型智能体平台通过将团队锁定到单一模型供应商来解决生产复杂性。
团队不得不在便捷的智能体开发体验和对AI技术栈的完全自主权之间做出选择。
● 规模化治理:多个模型往往意味着多套集成、多个看板和不透明的成本结构。缺乏统一治理,团队将失去对智能体集群的支出、延迟和行为的可观测性。
● 成本效率:托管型单厂商智能体平台收取高额溢价。团队需要一种既能降低智能体总运营成本、又能保持生产级可靠性的方案。
为什么选择阿里云
TrueFoundry选择阿里Qwen作为TrueForge开源发布的创始模型合作伙伴,主要基于以下几个关键因素:● 最广泛的开放模型谱系:Qwen拥有所有AI实验室中最全面的开放模型系列——从十亿参数以下的模型到旗舰级Qwen3-Coder-480B-A35B,编程模型支持最高百万Token上下文。
没有其他供应商在开放权重家族中提供如此广泛的覆盖面。
● 家族一致性:所有Qwen模型共享统一的家族标识和函数调用格式,不同规格间的切换浑然一体,而非如同集成新供应商。
● 生产级能力:Qwen编程产品线在智能体编程和工具调用任务的开放模型中取得业界领先的成果,性能比肩领先的闭源模型。
● 开放权重理念:Qwen的开放权重策略与TrueFoundry的厂商中立理念高度契合。
团队可在自有基础设施上部署Qwen模型,不受专有限制。
架构
TrueFoundry将完整的Qwen模型家族集成到其Agent Harness中,构建了一个统一平台,所有模型规格通过一个API接入:● 一个API,全规格覆盖:智能体按名称引用Qwen模型,编排框架自动处理路由。
将0.5B模型切换为480B旗舰只需更改名称,无需重写代码——切换规格无需任何代码变更。
● 网关级治理:每次调用均通过AI 网关,不论模型规格大小,均应用统一的可观测性和支出上限。
各模型的Token消耗、成本和延迟汇聚至一个看板,一套预算框架管控全系列模型。
● 规格适配工作流:简单编辑交给小型Qwen模型,代码库级重构交给具备百万Token上下文的旗舰模型,中等负载交给Qwen3-Coder-Next等高效变体——全部通过同一API、经同一网关路由、在一个看板中呈现。
关键成果
● 成本优化:智能体总运营成本较托管型单厂商平台降低约50%。● 最广泛的开放模型覆盖面:Qwen模型谱系——从十亿参数以下到4800亿参数——使TrueForge用户通过单一API获得最全面的开放模型选择。
● 零集成切换:模型规格间的切换毫无阻碍——无需代码重写或重新集成,让规格适配成为自然习惯。
● 统一治理:一个API、一个看板、一套预算——可观测性和支出上限对所有模型规格一视同仁。
● 生产验证:NetApp等企业已在TrueFoundry平台上大规模运行生产级智能体,服务数百名活跃用户。
● 开源信任:Apache 2.0许可证加上厂商中立,相比闭源方案更值得信赖。
展望未来
TrueFoundry计划随着Qwen模型家族的持续扩展,深化与阿里云的合作——引入更多模型规格和专业方向,并通过更多托管服务器和工具丰富MCP生态。同时推动TrueForge的企业级应用,借助阿里云全球基础设施实现全球低延迟访问。
精选产品
其他相关案例
Infron
Infron是一款兼容OpenAI的API网关,通过统一API服务400多个主流模型。Infron在阿里云上为客户运行开源模型工作负载(Qwen、DeepSeek、Kimi、GLM),客户可将工作负载固定到特定地域以满足延迟和数据驻留要求,Infron则随流量增长从共享配额扩展至专属算力。
ReN3
ReN3是一家总部位于新加坡、面向受监管企业的agentic AI平台。利用阿里云Qwen模型,ReN3将AI推理成本降低40%,输出质量提升30%,响应速度加快30%,同时满足东南亚严格的数据主权要求。
