科大讯飞全资子公司词元星火正式推出并开源星火 X2.5-4B 和星火 X2.5-1.7B 两款端侧通用大模型。在上下文能力上,两款模型使用覆盖长篇文档、技术资料等场景的千亿 Token 级高质量数据训练,原生支持 100 万 Token 上下文窗口。星火 X2.5-4B 和 1.7B 均基于全国产算力平台完成全流程训练,使用约 20 万亿 Token 多样化数据进行预训练,并通过高质量监督微调和强化学习持续提升表现。
科大讯飞全资子公司词元星火正式推出并开源星火 X2.5-4B 和星火 X2.5-1.7B 两款端侧通用大模型。在上下文能力上,两款模型使用覆盖长篇文档、技术资料等场景的千亿 Token 级高质量数据训练,原生支持 100 万 Token 上下文窗口。星火 X2.5-4B 和 1.7B 均基于全国产算力平台完成全流程训练,使用约 20 万亿 Token 多样化数据进行预训练,并通过高质量监督微调和强化学习持续提升表现。