科大讯飞于9月7日正式发布星火Spark-X2.5多语言文本生成模型。该模型基于全国产平台训练,采用MoE(混合专家)架构,模型参数规模为293B-A30B,支持256K上下文长度。目前,该模型已在讯飞星辰MaaS平台上线,并提供明确的按量计费定价。
星火X2.5在技术架构上采用MoE框架,通过激活30B参数实现高效推理。在模型能力方面,星火X2.5重点提升了代码生成与智能体(Agent)相关能力,同时覆盖超过200种语言,在语言理解、答题、推理等通用任务上保持稳定表现。此次发布延续了科大讯飞在国产算力适配上的投入,模型训练全程未依赖国外算力平台。
定价方面,星火X2.5在讯飞星辰MaaS平台上的收费标准为:输入1.6元人民币/百万词元(Token),输入缓存命中0.24元人民币/百万词元,输出6元人民币/百万词元。这一价格体系与此前国内主流大模型厂商的定价策略基本一致,缓存命中价格显著低于常规输入价格,旨在降低重复调用场景下的推理成本。
科大讯飞在通用大模型领域已有多年布局。此前,讯飞星火系列模型已迭代至X1系列,并逐步在教育和办公场景落地。此次发布的X2.5版本,是讯飞在MoE架构上的重要升级,标志着其在模型规模与推理效率之间寻求平衡的技术路线。MoE架构通过将模型拆分为多个专家子网络,在推理时仅激活部分参数,从而在不显著增加计算成本的前提下扩大模型容量。
从行业背景看,2024年以来,国内大模型市场进入密集发布期,多家厂商相继推出基于MoE架构的新一代模型。MoE架构因其在性能与成本之间的平衡优势,已成为国内头部模型厂商的主流选择。与此同时,国产算力平台的适配与优化也成为行业关注焦点,多家云厂商和AI公司均在推进基于昇腾等国产芯片的模型训练与部署。
科大讯飞此次强调“全国产平台训练”,一方面回应了供应链安全层面的考量,另一方面也显示出其在国产算力生态上的投入力度。该模型的发布,对于依赖国产算力进行大规模模型训练的企业用户而言,提供了一定的参考价值。
讯飞星辰MaaS平台是科大讯飞面向企业提供模型即服务的基础设施,通过该平台,企业用户可直接调用星火系列模型进行应用开发,或在私有环境中部署模型实例。此次X2.5上线后,企业用户可根据自身业务场景选择按量付费或私有化部署方案,降低了从模型训练到应用落地的门槛。
多语言能力是星火X2.5的另一项核心卖点。覆盖200余种语言的能力,使得该模型在跨境电商、国际客服、多语言内容生成等场景具备应用潜力。不过,多语言模型的实际效果仍需结合具体语种和业务场景进行验证,行业用户在选择模型时通常会进行针对性的评测。
从市场格局看,科大讯飞在语音技术和教育领域拥有深厚积累,其星火大模型在中文理解和生成任务上表现稳定。此次X2.5的发布,进一步强化了其在代码生成和智能体领域的竞争力,以应对来自互联网大厂和初创AI公司的竞争压力。国内大模型市场的竞争正从单纯的参数比拼转向能力、价格与落地场景的综合较量。
随着星火X2.5的上线,科大讯飞有望通过MaaS平台触达更多企业级客户。对于开发者而言,该模型在代码辅助、智能客服、内容生成等场景的可用性,将在实际使用中得到检验。未来,讯飞是否会针对特定垂直行业推出定制化版本,以及该模型在国产算力平台上的性能表现如何,值得持续关注。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。