跳转至

MaaS_Stepfun

MaaS_Stepfun_step_5_preview_20260920

模型概览

项 值
模型 ID(model) step-5-preview
上下文长度 1M tokens
最大输入 1M tokens
最大输出 64k tokens
输入模态 文本、图片、视频
输出模态 文本
图片 URL 或 Base64。格式 JPG/JPEG、PNG、WebP、静态 GIF。单次最多 60 张。细节级别 low、high
视频 URL、Base64 或 Files API 的 stepfile://。格式 MP4、QuickTime、Matroska。URL 视频单个 MP4 小于 128MB,时长建议小于 5 分钟
推理强度 low、medium、high。Chat Completions 使用 reasoning_effort;Responses 使用 reasoning.effort;Messages 使用 output_config.effort。源文档未说明默认档
提示缓存 支持。源文档未提供独立请求参数。Chat 的 usage.prompt_tokens_details.cached_tokens、Responses 的 usage.input_tokens_details.cached_tokens 返回命中缓存的 token
能力 流式输出、函数工具调用、JSON Mode、JSON Schema。搜索与代码执行由调用方通过工具提供,模型不直接访问外部服务

请求协议

https

参数名 类型 必填 描述
Content-Type string 是 application/json
Authorization string 是 Bearer ${your_AK}

OpenAI Chat Completions

请求 URL

POST https://genaiapi.cloudsway.net/v1/ai/{endpointPath}/chat/completions

请求 Body 参数

参数名 二级参数 三级参数 四级参数 类型 必填 描述
model - - - string 是 固定为 MaaS_Stepfun_step_5_preview_20260920(厂商原始 model:step-5-preview)
messages - - - array[json] 是 迄今为止的用户输入或模型生成消息
role - - string 是 system、user、tool、assistant
content - - string 或 array 或 null 是 system 为文本。user 为文本或图文视频混合列表。tool 为函数执行结果文本。assistant 为文本,可为 null
type - string 否 user 的 multipart 元素。text、image_url、video_url
text - string 否 type=text 时的文本
image_url url string 否 http/https 图片地址,或 data:image/jpeg;base64,${base64_string}。格式 JPG/JPEG、PNG、WebP、静态 GIF。单次最多 60 张
image_url detail string 否 low、high。high 按原图分辨率理解,token 随图片大小变化;low 缩放到固定尺寸,更省 token
video_url url string 否 模型专章支持 URL、Base64 或 stepfile://。格式 MP4、QuickTime、Matroska。URL 视频单个 MP4 小于 128MB,时长建议小于 5 分钟
tool_call_id - - string 条件 role=tool 时必填。上一轮 assistant 返回的函数执行 ID
tools - - - array[json] 否 函数工具列表。仅文档化的类型为 function
type - - string 是 总为 function
function name - string 是 纯英文、数字和 _-,建议不超过 64 个字符
function description - string 否 函数功能描述,供模型选择
function parameters type string 否 一般为 object
function parameters properties object 否 key 为参数名。每个参数含 type(string、number、integer、object、array、boolean)和 description
max_tokens - - - integer 否 生成 token 上限。默认 INF(不作限制,由模型决定)。模型专章最大输出 64k tokens。输入与生成 token 总量受 1M 上下文限制
temperature - - - float 否 采样温度,范围 0.0 到 2.0。默认 0.5
top_p - - - float 否 核采样。默认 0.9
n - - - integer 否 每个输入生成的响应条数。默认 1,最大不限,建议不超过 5
stream - - - boolean 否 是否 SSE 流式返回。默认 false
stop - - - string 或 array 否 命中任一停止字符串后立即停止。默认空
frequency_penalty - - - float 否 按已生成文本中的出现频率降频。默认 0,范围 -2.0 到 2.0
response_format - - - object 否 输出格式。默认 {"type":"text"}
type - - string 是 text、json_object、json_schema。json_object 开启 JSON Mode;json_schema 按 schema 约束结构
json_schema name - string 条件 type=json_schema 时必填。schema 名称
json_schema strict - boolean 否 是否严格遵循 schema。默认 false
json_schema schema - object 条件 type=json_schema 时必填。JSON Schema
reasoning_format
- - - string
否
推理字段格式。默认 general,用 reasoning 返回。deepseek-style 时同时可用 reasoning_content,二者内容一致。可选 general、deepseek-style
reasoning_effort - - - string 否 本模型推理强度:low、medium、high。值越高思考越深,耗时可能更长。源文档未说明默认值

请求示例

curl -X POST 'https://genaiapi.cloudsway.net/v1/ai/{endpointPath}/chat/completions' \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer ${your_AK}' \
  -d '{
    "model": "MaaS_Stepfun_step_5_preview_20260920",
    "messages": [
      {"role": "user", "content": "请用一句话介绍你自己。"}
    ],
    "reasoning_effort": "medium",
    "max_tokens": 1024
  }'

响应示例

{
  "id": "b7b56af0-52a6-483f-a589-948182676a1b",
  "object": "chat.completion",
  "created": 1709893411,
  "model": "MaaS_Stepfun_step_5_preview_20260920",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "我是面向编程与专业知识工作的助手。",
        "reasoning": "用户要求一句话介绍。",
        "reasoning_content": "用户要求一句话介绍。"
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 20,
    "completion_tokens": 30,
    "total_tokens": 50,
    "prompt_tokens_details": {"cached_tokens": 0},
    "completion_tokens_details": {"reasoning_tokens": 8}
  }
}

流式请求示例

curl -X POST 'https://genaiapi.cloudsway.net/v1/ai/{endpointPath}/chat/completions' \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer ${your_AK}' \
  -d '{
    "model": "MaaS_Stepfun_step_5_preview_20260920",
    "messages": [
      {"role": "user", "content": "请用一句话介绍你自己。"}
    ],
    "reasoning_effort": "medium",
    "max_tokens": 1024,
    "stream": true
  }'

SDK 调用方式

from openai import OpenAI

client = OpenAI(
    api_key="${your_AK}",
    base_url="https://genaiapi.cloudsway.net/v1/ai/{endpointPath}",
)

completion = client.chat.completions.create(
    model="MaaS_Stepfun_step_5_preview_20260920",
    messages=[{"role": "user", "content": "请用一句话介绍你自己。"}],
    max_tokens=1024,
    extra_body={"reasoning_effort": "medium"},
)
print(completion.choices[0].message.content)

reasoning_effort 为厂商扩展字段,OpenAI SDK 通过 extra_body 透传。

OpenAI Responses

请求 URL

POST https://genaiapi.cloudsway.net/v1/ai/{endpoint}/responses

请求 Body 参数

参数名 二级参数 三级参数 类型 必填 描述
model - - string 是 固定为 MaaS_Stepfun_step_5_preview_20260920(厂商原始 model:step-5-preview)。Responses 参数页当前列出支持 step-5-preview
input - - string 或 array 是 纯文本等价于一条 role=user 消息;或按时序排列的消息与事件数组
role - string 条件 文本消息角色:user、assistant、system
content - string 或 array 条件 纯文本,或内容块数组
type string 否 内容块:input_text、input_image、input_video。回传项:function_call、function_call_output
text string 否 type=input_text 时的文本
image_url string 或 object 否 图片地址字符串,或 {"url":"...","detail":"high"}。推荐 base64 data URL。detail 按模型专章为 low、high。URL 须可被服务端公网访问
video_url string 或 object 否 视频地址字符串,或 {"url":"...","detail":"low"}。模型专章另支持 Base64 与 stepfile://;格式 MP4、QuickTime、Matroska;URL 的 MP4 小于 128MB,时长建议小于 5 分钟。源文档未单列视频 detail 的全部取值
id - string 条件 type=function_call 时由服务端生成的唯一 ID,多轮须原样回传
call_id - string 条件 function_call 与 function_call_output 的配对 ID
name - string 条件 type=function_call 时的工具名称
arguments - string 条件 type=function_call 时的 JSON 字符串参数
output - string 条件 type=function_call_output 时的工具执行结果,建议为 JSON 字符串
instructions - - string 否 顶层系统级指令
stream - - boolean 否 是否 SSE 流式输出。默认 false
temperature - - float 否 采样温度,范围 0.0 到 2.0。源文档未给出默认值
top_p - - float 否 核采样。源文档未给出默认值与取值范围
max_output_tokens - - integer 否 本次响应最大输出 token,同时限制推理过程与最终输出。预算不足时 status 可为 incomplete,output 可能只有 reasoning 而没有最终 message。模型专章最大输出 64k tokens
reasoning - - object 否 推理配置
effort - string 否 本模型为 low、medium、high。源文档未说明默认值
tools - - array[json] 否 当前仅支持 function
type - string 是 总为 function
name - string 是 建议纯英文、数字和 _-
description - string 否 函数功能描述
parameters - object 否 函数入参的 JSON Schema
strict - boolean 否 开启后,模型输出参数严格匹配 parameters
tool_choice - - string 或 object 否 当前仅支持字符串 "auto"
text - - object 否 文本输出格式
format type string 否 text、json_object、json_schema
format name string 条件 type=json_schema 时必填
format strict boolean 否 type=json_schema 时可用。开启后输出严格匹配 schema
format schema object 条件 type=json_schema 时必填

请求示例

curl -X POST 'https://genaiapi.cloudsway.net/v1/ai/{endpoint}/responses' \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer ${your_AK}' \
  -d '{
    "model": "MaaS_Stepfun_step_5_preview_20260920",
    "input": "请用一句话介绍你自己。",
    "reasoning": {"effort": "medium"},
    "max_output_tokens": 1024
  }'

响应示例

{
  "id": "resp_xxxxxxxxxxxxxxxx",
  "object": "response",
  "created_at": 1772624997,
  "completed_at": 1772624998,
  "model": "MaaS_Stepfun_step_5_preview_20260920",
  "status": "completed",
  "error": null,
  "incomplete_details": null,
  "output": [
    {
      "type": "reasoning",
      "id": "rs_xxxxxxxxxxxxxxxx",
      "summary": [],
      "content": null,
      "encrypted_content": null,
      "status": null
    },
    {
      "type": "message",
      "id": "msg_xxxxxxxxxxxxxxxx",
      "status": "completed",
      "role": "assistant",
      "content": [
        {
          "type": "output_text",
          "text": "我是面向编程与专业知识工作的助手。",
          "annotations": []
        }
      ]
    }
  ],
  "usage": {
    "input_tokens": 14,
    "input_tokens_details": {"cached_tokens": 0},
    "output_tokens": 52,
    "output_tokens_details": {"reasoning_tokens": 0, "tool_output_tokens": 0},
    "total_tokens": 66
  }
}

流式请求示例

curl -X POST 'https://genaiapi.cloudsway.net/v1/ai/{endpoint}/responses' \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer ${your_AK}' \
  -d '{
    "model": "MaaS_Stepfun_step_5_preview_20260920",
    "input": "请用一句话介绍你自己。",
    "reasoning": {"effort": "medium"},
    "max_output_tokens": 1024,
    "stream": true
  }'

SDK 调用方式

from openai import OpenAI

client = OpenAI(
    api_key="${your_AK}",
    base_url="https://genaiapi.cloudsway.net/v1/ai/{endpoint}",
)

response = client.responses.create(
    model="MaaS_Stepfun_step_5_preview_20260920",
    input="请用一句话介绍你自己。",
    max_output_tokens=1024,
    reasoning={"effort": "medium"},
)
print(response.output_text)

Anthropic Messages

请求 URL

POST https://genaiapi.cloudsway.net/{endpoint}/v1/messages

请求 Body 参数

参数名 二级参数 三级参数 四级参数 类型 必填 描述
model - - - string 是 固定为 MaaS_Stepfun_step_5_preview_20260920(厂商原始 model:step-5-preview)。Messages 参数页将其列为已验证示例
max_tokens - - - integer 是 最大生成 token,必须大于 0。模型专章最大输出 64k tokens。源文档未单独给出本协议的数值上限
messages - - - array[json] 是 对话消息,至少一条
role - - string 是 常用 user、assistant
content - - string 或 array 是 纯文本,或 Content Block 数组
type - string 否 text、image、tool_use、tool_result
text - string 否 type=text 时的文本
source type string 否 图片来源。url 或 base64
source url string 条件 source.type=url 时的图片地址
source media_type string 条件 source.type=base64 时的媒体类型,如 image/png
source data string 条件 source.type=base64 时的图片数据
id - string 条件 type=tool_use 时的工具调用 ID
name - string 条件 type=tool_use 时的工具名
input - object 条件 type=tool_use 时传给工具的参数
tool_use_id - string 条件 type=tool_result 时对应的工具调用 ID
content - string 或 array 条件 type=tool_result 时的执行结果
is_error - boolean 否 type=tool_result 时是否执行出错
system - - - string 或 array 否 系统提示词。字符串,或由文本块组成的数组
tools - - - array[json] 否 工具定义
name - - string 是 工具名称
description - - string 否 工具描述
input_schema - - object 否 工具入参的 JSON Schema
output_config - - - object 否 输出配置。Anthropic SDK 通过 extra_body 透传
effort - - string 否 本模型思考深度:low、medium、high。源文档未说明默认值
stream - - - boolean 否 是否流式返回。默认非流式
temperature - - - float 否 采样温度,范围 0 到 2。源文档未给出默认值
top_p - - - float 否 核采样,大于 0 且小于等于 1。源文档未给出默认值
top_k - - - integer 否 范围 0 到 500。源文档未给出默认值
stop_sequences - - - array[string] 否 遇到任一停止序列时停止生成

请求示例

curl -X POST 'https://genaiapi.cloudsway.net/{endpoint}/v1/messages' \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer ${your_AK}' \
  -d '{
    "model": "MaaS_Stepfun_step_5_preview_20260920",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "请用一句话介绍你自己。"}
    ],
    "output_config": {"effort": "medium"}
  }'

响应示例

{
  "id": "msg_xxx",
  "type": "message",
  "role": "assistant",
  "model": "MaaS_Stepfun_step_5_preview_20260920",
  "stop_reason": "end_turn",
  "usage": {
    "input_tokens": 20,
    "output_tokens": 12
  },
  "content": [
    {
      "type": "text",
      "text": "我是面向编程与专业知识工作的助手。"
    }
  ]
}

流式请求示例

curl -X POST 'https://genaiapi.cloudsway.net/{endpoint}/v1/messages' \
  -H 'Content-Type: application/json' \
  -H 'Authorization: Bearer ${your_AK}' \
  -d '{
    "model": "MaaS_Stepfun_step_5_preview_20260920",
    "max_tokens": 1024,
    "stream": true,
    "messages": [
      {"role": "user", "content": "请用一句话介绍你自己。"}
    ],
    "output_config": {"effort": "medium"}
  }'

SDK 调用方式

from anthropic import Anthropic

client = Anthropic(
    api_key="${your_AK}",
    base_url="https://genaiapi.cloudsway.net/{endpoint}/v1",
)

message = client.messages.create(
    model="MaaS_Stepfun_step_5_preview_20260920",
    max_tokens=1024,
    messages=[{"role": "user", "content": "请用一句话介绍你自己。"}],
    extra_body={"output_config": {"effort": "medium"}},
)
print(message.content)