微软Foundry模型路由器扩展至28个区域并更新模型池

默认部署会自动接收模型池的变更,而配置的子集则需手动添加新模型。

微软近日对其Azure AI Foundry的模型路由器进行了重大更新,将支持区域从原先的2个扩展至28个全球标准区域和21个数据区域部署,同时更新了模型池,新增了Claude Opus 4.8和GPT-5.6两款模型,并移除了四个已弃用的模型。此次更新旨在提升企业用户在多区域环境下调用AI模型的灵活性和效率。

模型路由器是Azure AI Foundry中的一项关键功能,它允许开发者在多个模型之间自动路由请求,根据预设策略选择最优模型进行推理。此次区域扩展意味着企业用户可以在更广泛的全球范围内使用这一服务,尤其对于跨国企业而言,这有助于降低推理延迟并满足数据驻留合规要求。新增的Claude Opus 4.8和GPT-5.6是当前业界领先的大语言模型,它们的加入进一步丰富了模型池的选择。

在模型更新机制上,微软明确了两种部署方式的差异。默认部署会自动接收模型池的变更,包括新模型的加入和旧模型的移除,用户无需手动干预即可使用最新模型。而对于配置了特定模型子集的部署,新模型不会自动包含在内,需要用户主动添加。这一设计为需要锁定模型版本或对模型变更敏感的企业提供了控制能力。

此外,微软在技术文档中提示,模型路由器的有效上下文窗口等于模型池中最小的模型上下文长度。这意味着当多个模型混合使用时,系统会以最短的上下文窗口作为统一标准,开发者在设计应用时需对此有所考量,以避免超出上下文限制导致的错误。

此次更新反映了微软在AI基础设施层面的持续投入。通过扩大区域覆盖和动态更新模型池,Azure AI Foundry试图在模型多样性与部署可控性之间取得平衡。对于依赖多模型策略的企业开发者而言,这一变化降低了跨区域调度的复杂度,同时也对模型生命周期管理提出了更高的要求。随着大模型迭代速度加快,如何在灵活性与稳定性之间取舍,将成为企业采用AI服务时的重要决策点。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
开源鸿蒙生态设备突破13亿台,智慧家居行业加速底层系统重构
上一篇 3小时前
从云端到浏览器:WebGPU与Transformers.js推动边缘AI落地
下一篇 3小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部