READINGiCattge News
iCattge News · 资料整理

科大讯飞发布星火 X2.5-4B和1.7B,重点展示端侧百万级上下文能力与多平台兼容性

根据公开资料,科大讯飞正式发布了词元星火 X2.5-4B和1.7B模型。这两款模型最大的特点是原生支持最长 100 万 Token 上下文窗口,是目前端侧模型中唯一具备此能力的。此外,该系列模型使用约 20 万亿 Token 数据预训练,并已在多个硬件平台及主流推理框架上开放权重和API。

iCattge News · 资料整理

根据一份可追溯的公开资料,科大讯飞发布了词元星火 X2.5-4B和1.7B模型。这些模型的关键特性包括原生支持最长 100 万 Token 的上下文窗口,这使其成为目前端侧模型中唯一具备该量级上下文能力的产品。

在技术背景方面,科大讯飞词元星火 X2.5-4B和1.7B使用了约 20 万亿 Token 多样化数据进行了预训练,并且基于全国产算力平台完成了全流程的训练。这表明了模型背后的数据规模和计算基础。

从实际应用效果来看,科大讯飞词元星火 X2.5-1.7B在Domux智能家居测试集上展现出一定的性能指标,其控制指令端到端执行正确率达到了90.3%,平均响应时间为0.85秒。

模型的兼容性和部署能力是另一个重点。科大讯飞词元星火 X2.5-4B和1.7B支持英伟达、华为、海光及后摩等多个硬件平台,并且兼容vLLM、SGLang、llama.cpp等主流推理框架,这极大地拓宽了其落地场景。

在模型获取方面,科大讯飞词元星火 X2.5-4B和1.7B的模型权重已在Hugging Face和GitHub等平台开放,同时对应的API也已上线讯飞星辰MaaS平台,为用户提供了多维度的使用入口。

时间线信息显示,除了本次发布的X2.5系列模型外,科大讯飞还计划于9月7日正式发布星火 X2.5-293B通用大模型。这构成了一个后续的产品迭代规划。

从技术影响分析的角度看,端侧唯一百万 Token 上下文窗口的特性,意味着该模型在处理需要极长上下文依赖的任务时具有显著优势,例如复杂的文档理解、长时间对话记忆等场景。

读者提示:对于关注本地化部署和资源受限环境的应用开发者而言,星火 X2.5-4B和1.7B对主流推理框架的兼容性以及支持的多种硬件平台是重要的参考点。同时,用户应注意区分本次发布的X2.5系列模型与后续计划于9月7日发布的星火 X2.5-293B通用大模型。

来源限定说明:以上所有信息均基于一份公开资料,仅描述了科大讯飞词元星火 X2.5-4B和1.7B模型的已确认特性、训练背景以及后续计划发布的时间点。任何未在资料中明确提及的性能提升或市场定位均不应作为既定事实。

信息来源

本文基于上述公开资料整理,未使用来源页面的图片、视频或嵌入媒体。