# 阶跃星辰发布旗舰模型 Step 5 Preview，AA 指数 44 分跻身全球开源模型前三，10 月 15 日开源

- 来源：IT之家（RSS）
- 发布时间：2026-09-20 11:19
- AIHOT 分数：56
- AIHOT 链接：https://aihot.news/items/cmu996r3103ykro8iq59oxoll
- 原文链接：https://www.ithome.com/1/004/705.htm

## AI 摘要

阶跃星辰发布旗舰模型 Step 5 Preview，面向 AI 编程、软件工程、专业知识和金融场景，将于 10 月 15 日开源完整权重。

## 正文

IT之家 9 月 20 日消息，阶跃今天宣布推出旗舰模型 Step 5 Preview，面向 AI 编程、软件工程、专业知识工作、金融等场景，提升模型执行真实世界 Agentic 任务表现，10 月 15 日开源完整权重。

据介绍，该模型采用稀疏 MoE 混合专家架构，总参数量 600B、激活参数仅 27B，支持 100 万 Token 上下文窗口，原生支持文本与视觉输入。

在全球人工智能权威榜单 Artificial Analysis Intelligence Index（IT之家注：AA 综合智能指数）中，该模型得分 44 分，位居全球开源模型前三。与此同时，该模型的单任务成本仅为 Anthropic Claude Opus 5 的 1/8。

优化方面，阶跃为该模型建立了 StepCodeBench，覆盖 553 个独立代码仓库、9 类任务、20 个应用领域和 33 种编程语言。在测试中，Step 5 Preview 能够覆盖多种编程语言，以及 Bug 修复、功能开发、代码重构、环境配置等真实开发任务。

同时，该模型能根据自然语言需求，自主阅读 ESP32 设备及相关 API 的大量开发文档，将一块 ESP32-S3 开发板改造成支持蓝牙按键与语音输入的 Vibe Coding 键盘。它不仅能写代码，还可以访问串口、获取截图、调用摄像头、模拟鼠标操作，并根据真实设备返回的状态和报错持续修改、运行和调试代码，连续执行超过 3 小时。

在公开和内部评估中，Step 5 Preview 在复杂的软件工程任务（包括长程规划任务）、专业知识工作和金融领域等基准测试中展现出较为均衡的综合能力，并在 Agents' Last Exam 的 CLI 子集 ALE-CLI、金融投资研究评测 FrontierFinance，以及跨领域深度研究评测 DRACO 上仅次于 GPT-6 Astra 或 Claude Opus 5。

该模型从今日起全量开放，官方将于 10 月 15 日释放模型权重，敬请期待。

阶跃发布旗舰模型 Step 5 Preview：向前一步，智能效率的新一代“帕累托前沿”

阶跃星辰开放平台

Step 5 Preview - Intelligence, Performance & Price Analysis | Artificial Analysis
