推荐Lovart 中文版 - 一站式 AI 设计平台推荐一人企业Vibe Coding社区!热门AI设计工具新品免费AI编程工具 Trae - 智能编码助手Seedance2.5已上线新用户注册即领免费算力
UIED.CN今天偷学哪一招,朋友

阶跃星辰开源 Step3.5 Flash:1960 亿参数 MoE 模型,推理仅激活 110 亿参数

阶跃星辰开源 Step3.5 Flash 模型

国产 AI 公司 阶跃星辰(StepFun) 正式开源 Step3.5 Flash 大模型,该模型采用稀疏 MoE(Mixture of Experts)架构,在保持高性能的同时实现更高能效比。

GitHub 项目:
https://github.com/stepfun-ai/Step-3.5-Flash

Hugging Face 模型:
https://huggingface.co/stepfun-ai/Step-3.5-Flash

该模型的发布进一步丰富了开源大模型生态,也为开发者构建 AI Agent 与应用提供了新的选择。


1960 亿参数 MoE 架构

Step3.5 Flash 的总参数规模达到 1960 亿(196B),属于大规模模型。

但与传统密集模型不同,它采用 稀疏 MoE 架构。

在推理过程中:

  • 总参数:1960 亿
  • 实际激活参数:约 110 亿

这种设计可以在保持模型能力的同时,大幅降低计算资源消耗。


高性能推理速度

在代码任务场景中,Step3.5 Flash 的推理速度表现较为突出。

官方数据显示:

  • 最高推理速度可达 350 TPS(Tokens Per Second)

这一速度对于需要高并发推理的应用非常重要,例如:

  • AI 编程助手
  • 自动化 Agent
  • AI 应用服务平台

在 OpenClaw 中调用量排名前二

Step3.5 Flash 在开源社区中的活跃度也在持续上升。

目前:

  • Hugging Face 下载量超过 30 万次
  • 在 OpenClaw 平台调用量排名全球第二

这一数据表明该模型在实际应用中已经获得不少开发者关注。


为什么 MoE 架构越来越流行?

MoE(Mixture of Experts)架构近年来成为许多大模型的重要设计方案。

其主要优势包括:

  • 在推理时只激活部分专家网络
  • 降低计算成本
  • 提升模型扩展能力

通过这种方式,大模型可以在保持能力的同时提高效率。

许多顶级模型也在采用类似架构。


Step3.5 Flash 的应用场景

Step3.5 Flash 适用于多种 AI 应用开发场景,例如:

  • AI Agent 系统
  • 代码生成与编程助手
  • AI 自动化工具
  • 企业 AI 服务平台
  • AI 研究与实验项目

由于其高效推理特性,也适合部署在需要高并发服务的环境中。


开源生态与开发者机会

随着 Step3.5 Flash 的开源,开发者可以:

  • 下载模型进行本地部署
  • 构建 AI Agent 应用
  • 进行模型研究与实验
  • 集成到 AI 产品中

开源模型的持续发展,也推动了 AI 应用生态的扩展。


总结

阶跃星辰开源的 Step3.5 Flash 模型,通过稀疏 MoE 架构实现 1960 亿参数规模与高效推理能力的结合,在代码任务中推理速度最高可达 350 TPS。

项目地址:

GitHub
https://github.com/stepfun-ai/Step-3.5-Flash

Hugging Face
https://huggingface.co/stepfun-ai/Step-3.5-Flash

对于开发者来说,该模型为构建高性能 AI Agent 和应用提供了新的选择。

文章声明

声明:本站所有文章,如无特殊说明或标注,均为本站作者原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。本文来自作者自媒体,不代表UIED观点和立场。 如若本站内容侵犯了原著者的合法权益,可联系我们进行处理以减少您的损失。

标签

评论 0

最新评论

登录后发布评论并参与互动。

暂无评论,欢迎抢沙发。

推荐阅读

查看更多