来不及解释了,快上车!Step Code 正式开源
Step Code v0.1.0 正式开源!
项目采用 MIT License,源代码现已全部公开。
作为阶跃星辰推出的终端编程智能体(CLI),Step Code 面向真实开发任务,帮助开发者直接在终端中完成代码编写、调试、执行与交付。
高效执行,长程可靠,token 更省
在 Terminal Bench 2.1 评测[1]中,Step Code 任务通过率 80.9%,在参评 Agent 中并列第一;在并列第一的 Agent 中,Step Code 的 Token 消耗更低。

Terminal Bench 2.1:通过率 × token/rollout
在阶跃自建的长程任务基准 Multi-Frame [2]中,Step Code 取得73.3% 的任务通过率,在六款参评前沿 Agent Harness 中排名第一;平均每项长程任务消耗 5.09M Tokens,也是六款产品中最低。

Multi-Frame:通过率 × token/rollout

Harness 对比:各家通过率与 token 消耗
Step Code 更低的 Token 消耗,并非以牺牲任务完成能力为代价。通过持续优化上下文管理和工具调用链路,Step Code 让有限的上下文与 Token 更聚焦于任务推进,减少重复信息和无效调用。在真实开发任务中,节省的不只是 Token,也是实际使用成本。
一键发布静态站点
Step Code 内置 StepPage 发布能力:本地页面构建完成后,只需一条命令即可发布为可访问的静态网站,让开发、调试与交付在同一个终端中完成。
Step Code 现已正式开源,欢迎前往 GitHub 获取源码、提交 Issue、参与共建,也别忘了点亮 Star!
GitHub 源码:https://github.com/stepfun-ai/Step-Code
快速体验(macOS / Linux / WSL):
curl -fsSL https://static-openapi.stepfun.com/stepcode/install.sh | bashWindows:推荐 WSL;PowerShell(beta):
irm https://static-openapi.stepfun.com/stepcode/install.ps1 | iex我们期待与开发者社区共同建设安全、可靠、高性能的 Agent Harness,让模型智能更充分地转化为真实开发生产力。
来不及解释了,先上车,蹬起来,再一起把它造得更好。
Scale up for everyone
注释
[1] Terminal Bench 2.1:共 89 题,Step Code 通过 72 题(80.9%);各家 Agent CLI 以统一口径评测,完整对比见配图。
[2] Multi-Frame:step 自建长程基准,题式类似于 SWE-bMK,共 150 题,Step Code 通过 110 题;5.09M tokens/任务为六家参评 Agent 中最低。
标签






评论 0
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。