来源: 川观新闻 作者:赵东 2025-4-25 11:06:01
讯飞星火X1全面升级,多方突破展现优异性能
科大讯飞深度推理大模型——讯飞星火X1迎来全新升级。这款基于全国产算力训练的深度推理大模型,升级后的星火X1在数学、代码、逻辑推理、文本生成、语言理解、知识问答等通用任务上效果显著提升,在模型参数比业界同类模型小一个数量级的情况下,整体效果对标OpenAI o1和DeepSeek R1,再次展示了基于国产算力训练的全栈自主可控大模型的实力和潜力。
讯飞星火X1全面升级,多方突破展现优异性能
升级后的星火X1在处理多个任务上展现出优异的性能。
在数学答题和复杂的数理逻辑推理方面,星火X1能够准确识别出复杂的数学公式,不仅给出完整的解题思路,输出结果也严谨清晰;在逻辑推理时全方位思考,思考可能出现的每一种假设,表现出更强的严谨性和准确性。在代码能力上,星火X1不仅提高了代码生成的准确率,对生成代码逻辑理解能力也进一步提升,能够应对更复杂的编程需求,思考问题的多种可能性,帮助开发者快速实现功能。在语言理解方面,模型输出内容、格式更加符合用户指令要求,能够给出更加准确且深度思考的结果,生成内容更加连贯、准确。
此外,星火X1的长思维链能力支持图像输入,可以对输入的图像进行关联思考,对图像中的多种复杂元素探究可能的含义和目的,进行更深层次的信息整合和推理。
讯飞星火X1部署更简便,解决方案能力更强
本次星火X1升级不仅提升了通用能力,也同步增强面向行业的解决方案能力,助力产业智能化转型。由于融入更多场景复杂类型数据,模型的泛化性也取得进步,在多个行业任务上展现出业界领先的能力,在教育、医疗、司法等重点行业进一步扩大领先优势。以司法为例,对于行业专业需求,例如根据材料总结案件事实以及判决理由,升级后的星火X1能够精准把握用户指令,详细分析争议点,快速定位关键信息,并输出准确内容,为行业用户提供专业、可靠的智能支持。
在技术创新和模型部署方面,星火X1首发“快思考、慢思考统一模型”,由一个模型同时支持两种思考模式,提升模型处理不同复杂度任务的能力,满血版星火X1仅需4张卡(华为910B)即可部署,简化了私有化部署流程。
三大核心技术突破,迈向自主可控新阶段
讯飞星火X1的全新升级背后,是一系列独特的技术创新与理念突破。
首先,提出基于问题难度的大规模多阶段强化学习方法,在复杂推理、数学、代码、语言理解等场景全面提升模型效果及泛化性;同时提出强化学习动态更新算法,基于样本采样长度动态调整强化学习更新速度,进一步提升深度思考强化学习效率及效果。
其次,统一模型下的快慢思考混合训练方法,充分发挥快慢思考数据相互促进作用,实现基于系统指令控制模型是否深度思考,支撑下游更高效便捷的部署使用。
最后,实现多项工程技术创新,显存动态卸载技术大幅提升长文本推理并发、训推共卡协同实现高效训推资源转换、推理引擎冬眠机制实现快速拉起和恢复,实现国产算力平台上高效和稳定的强化学习训练全流程。
最近,科大讯飞与华为昇腾联合团队在前期工作基础上再获突破。坚定自主可控算法创新和系统工程创新,使得基于国产算力的星火大模型能够快速迭代进步,在实际应用场景取得显著效能优势,更具战略韧性。
此次讯飞星火X1的全面升级,不仅展示了中国人工智能技术在国产算力平台上的创新突破,也为各行各业数字化转型提供了新的可能。作为基于国产算力训练的大模型代表作,星火X1的表现证明,在技术自主可控的道路上,中国人工智能技术已经进入新阶段。
免责声明: 该文观点仅代表作者本人,Soft6软件网系信息发布平台,Soft6软件网仅提供信息存储空间服务。 未经允许不得转载,授权事宜请联系:support@soft6.com 如对本稿件有异议或投诉,请查看《版权保护投诉指引》