阶跃星辰(StepFun)是 2023 年 4 月成立于上海徐汇的 AGI 基础大模型公司,创始人兼 CEO 为前微软全球副总裁 姜大昕,董事长 印奇(旷视创始团队),首席科学家张祥雨、CTO 朱亦博为核心班底;位列“国产大模型六小虎”,2026 年初完成超 50 亿元 B+ 轮融资(腾讯、启明、五源及上海国资等参投)。技术路线信奉 Scaling Law,提出“单模态 → 多模态 → 多模理解生成统一 → 世界模型 → AGI”演进路径,主打 Step 系列基座模型 + 全模态 + 端云结合 Agent,多模态模型占已发模型 70%+,是国内基座种类最全的厂商之一。
一、简介与定位
-
成立:2023-04-06,上海阶跃星辰智能科技股份有限公司(2026 改制股份化)
-
核心定位:通用人工智能(AGI)基础大模型 + AI 终端原生 Agent,不是垂直产业模型,而是对标 GPT/Claude 的通用底座
-
标志事件:2026-07 WAIC 发布全球首款通过 L3 认证的智能体手机 STEPX Neo(搭载 Step AOS + 阶跃 Amoo 智能体,跨应用自主编排任务)
-
开源态度:主动开源 Step-3.5 Flash、Step-Video-T2V(联合吉利)、Step-Audio、Step1X-Edit、Step-R1-V-Mini 等,MLLM+DiT 图像编辑、图生视频均向开发者开放
二、核心功能矩阵(Step 系列模型)
|
类别 |
代表模型 |
关键能力 |
|---|---|---|
|
语言 / 推理 |
|
LiveBench 国产基座第一;三档推理强度 low/medium/high;深度研究、数学、代码、Agent 工具调用 |
|
视觉理解 |
|
图表/流程图/UI 截图/PDF 原生解析,无需视觉 MCP 中转;LMSYS Arena 视觉榜国产第一 |
|
图像生成 / 编辑 |
|
文生图、风格迁移、指令编辑,开源 SOTA |
|
视频生成 |
|
300 亿参数 DiT + Video-VAE,204 帧高清,中英双语,全球最大开源视频模型之一 |
|
语音 |
|
产品级开源语音模型,中英日+方言+情感语气,AA 榜单全球第一(2026-01) |
|
终端 Agent |
Step AOS / Amoo / GUI 开源模型 |
端云协同、双域记忆(召回 15ms)、跨 App 任务编排;L3 智能体手机 STEPX Neo |
|
C 端产品 |
阶跃 AI(原“跃问”)、冒泡鸭(已合并) |
对话/生图/视频理解/长文档解析/联网搜索,免费可用 |
📌 模型总数:截至 2025 年已发布 21 款 Step 系列基座,其中多模态占七成以上。
三、用法(开放平台 + API,完全兼容 OpenAI 规范)
路径 A:零代码体验
-
C 端:下载「阶跃 AI」App 或访问 chat.stepfun.com / stepfun.com,直接用跃问做问答、生图、视频理解、文档解析
-
企业:platform.stepfun.com → 体验中心 / 智能体编排 / 文件上传 RAG
路径 B:API 调用(开发者,OpenAI 兼容)
① 开通:platform.stepfun.com 注册 → API Keys 创建密钥(新用户赠 ¥10 体验额度,中国大陆直连)
② 端点与基址
Base URL: https://api.stepfun.com/v1
Chat: POST /v1/chat/completions (OpenAI 格式完全一致)
Images: POST /v1/images/generations
Files: /v1/files/*
③ Python(OpenAI SDK 零改调用)
from openai import OpenAI
client = OpenAI(
api_key="STEP_API_KEY",
base_url="https://api.stepfun.com/v1"
)
resp = client.chat.completions.create(
model="step-3.7-flash", # 或 step-3.5-flash / step-2 / step-1o-vision-32k
messages=[
{"role": "system", "content": "你是由阶跃星辰提供的AI助手"},
{"role": "user", "content": "解释这张财报图表的核心趋势",
# 多模态传图:content 改为 list,加 image_url
}
],
reasoning_effort="medium", # step-3.7/3.5-flash 支持 low/medium/high
stream=True
)
for chunk in resp:
print(chunk.choices[0].delta.content or "", end="")
④ curl 等价写法
curl https://api.stepfun.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $STEP_API_KEY" \
-d '{"model":"step-3.5-flash","messages":[{"role":"user","content":"你好,介绍下阶跃星辰"}]}'
⑤ 多模态传图(兼容 OpenAI content array)
{"role":"user","content":[
{"type":"text","text":"这张图讲了什么"},
{"type":"image_url","image_url":{"url":"https://xxx.jpg","detail":"low"}}
]}
⑥ 当前主力模型名对照
-
step-3.7-flash:旗舰多模态推理(图/视频理解 + Agent 工具调用)✅ 推荐 -
step-3.5-flash:最强开源语言推理基座,MoE 1960 亿 -
step-2/step-2-16k:万亿 MoE 旗舰文本模型 -
step-1o-vision-32k/step-1v-32k:视觉理解 -
step-image-edit-2:文生图 / 图像编辑一体化
⑦ 框架迁移:LangChain(ChatOpenAI 改 openai_api_base + model_name)、TypeScript SDK、Dify 等均直接兼容,把 base_url 指到 https://api.stepfun.com/v1 即可。
💡 接阶跃的常见坑:推理模型务必显式设
reasoning_effort,否则默认 medium 会多烧 token;做 Agent 优先step-3.7-flash,原生工具调用比外挂 Function Calling 稳;视频/语音场景用开源权重自部署更划算。
