星火X2.5 - 科大讯飞推出的新一代旗舰大模型系列

最新AI资源7小时前发布 AI分享圈
1.2K 00
Lovart

星火X2.5是什么

星火X2.5是科大讯飞推出的新一代旗舰大模型系列,涵盖云端MoE大模型及两款开源端侧小模型。模型基于国产昇腾算力完成训练,强调自主可控,在代码生成、数学推理和Agent协作方面表现突出。端侧版本原生支持百万Token长上下文,可离线处理整本书或长视频,并兼容英伟达、昇腾等多种芯片及vLLM、Ollama等框架,适用信创部署、智能编程和端侧长文本处理等场景。

星火X2.5 - 科大讯飞推出的新一代旗舰大模型系列

星火X2.5的功能特色

  • 国产算力训练:从芯片到模型全部依托国产算力完成,摆脱对海外硬件的依赖。
  • MoE 稀疏架构:总参数 293B、每次只激活 30B,兼顾性能与推理成本。
  • 代码生成强化:代码理解与编写能力大幅提升,在 SWE-Bench 等评测中超过参数量更大的模型。
  • Agent 自主执行:对接 Codex、OpenClaw 等框架,可拆解复杂任务并自主完成多步操作。
  • 数学逻辑推理:在 AIME、高考等高难度数学测评中跻身行业第一梯队。
  • 超长上下文:端侧模型即可原生处理 100 万 Token,为同类端侧产品中独有。
  • 端侧开源轻量:4B 和 1.7B 版本面向手机、IoT 设备优化,小参数也能跑出接近云端的效果。
  • 全平台兼容:适配英伟达、昇腾、海光、后摩等芯片,vLLM、Ollama 等框架可直接部署。
  • 多语言支持:覆盖 200 多种语言,满足跨国交流与全球化落地需求。

星火X2.5的核心优势

  • 全栈自主可控:依托国产昇腾算力完成训练,从底层芯片到模型实现端到端自主,不受外部供应链制约。
  • 推理成本更优:293B 总参数仅激活 30B,用小得多的计算开销逼近更大规模模型的实际表现。
  • 代码能力出众:SWE-Bench 评测成绩超过 9B 级模型,算法实现与代码补全水平行业领先。
  • Agent 深度适配:原生兼容 Codex、OpenClaw 等主流 Agent 框架,能自主规划步骤、调用工具并闭环交付任务。
  • 数学推理顶尖:高考、AIME 等高难度测评成绩稳居第一梯队,逻辑推导能力显著增强。
  • 端侧百万上下文:100 万 Token 长序列处理能力为端侧模型中独家,可整本读书记忆、审查长合同、理解长视频。
  • 端侧高性价比:4B/1.7B 小模型针对手机、IoT 场景优化,以极小体积实现接近云端大模型的任务质量。

星火X2.5的项目地址

  • GitHub仓库:https://github.com/XHToken/Spark-X2.5
  • HuggingFace模型库:https://huggingface.co/collections/XHToken/spark-x25

星火X2.5的操作步骤

  • API 接入:在讯飞开放平台或星辰 MaaS 注册获取密钥,通过 OpenAI 兼容接口直接调用,当前阶段限时免费。
  • 下载权重:从 Hugging Face、ModelScope 或 GitHub 拉取 Spark-X2.5-4B / 1.7B 的模型文件。
  • 本地部署:按硬件选型,NVIDIA 显卡配 vLLM 或 SGLang,昇腾 NPU 用官方 Docker 镜像,苹果芯片直接走 MLX。
  • 免代码启动:借助 Ollama 或 LM Studio 导入模型,无需写代码可在本地跑起对话服务。
  • 微调定制:基于 LLaMA-Factory 加载开源权重做增量训练,快速适配特定行业或业务需求。

星火X2.5的适用人群

  • 软件开发团队:凭借顶尖的代码生成与 SWE-Bench 表现,可充当 AI 程序员,覆盖需求分析到测试部署全流程。
  • 企业自动化与办公人群:深度集成主流 Agent 框架,适合需要多步骤自主规划、跨系统执行业务流程的团队。
  • 端侧/离线场景使用者:端侧模型原生支持百万 Token 上下文,适合在手机、车载等无网设备上读整本书、审长合同、看长视频的用户。
  • 教育与学习群体:数学与逻辑推理能力达行业顶尖,适合需要个性化解题辅导、推理训练的学生和教师。
  • 信创与合规要求高的机构:政府、金融、能源等对数据安全和供应链自主有严格要求的行业,可私有化部署。

星火X2.5的常见问题

Q1:星火X2.5 是什么?

A1:科大讯飞推出的旗舰通用大模型系列,包含云端 MoE 基座模型和两款开源端侧模型(4B、1.7B)。


Q2:星火X2.5 是免费的吗?

A2:云端 API 目前限时免费,可在讯飞开放平台或星辰 MaaS 平台申请密钥使用;端侧模型权重则完全开源免费。


Q3:开源的是哪个版本?使用什么协议?

A3:开源的是端侧模型 Spark-X2.5-4B 和 Spark-X2.5-1.7B,采用 Apache 2.0 协议,可自由下载和商用。


Q4:在哪里可以下载模型?

A4:可在 Hugging Face、ModelScope、GitHub 等渠道搜索 XHToken/spark-x25 获取权重文件。


Q5:支持多少上下文长度?

A5:端侧模型原生支持 100 万 Token 超长上下文,是端侧模型中唯一具备该能力的,可处理整本书或长视频。

© 版权声明

相关文章

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...