docs: 豆包3模型API文档(doubao-2.1-pro/seedream-5.0/speech-2.0)

This commit is contained in:
yumoqing 2026-07-08 16:00:22 +08:00
parent 5d63b249e0
commit 70678de6db

View File

@ -1845,7 +1845,10 @@ POST /v1/pipeline/submit
| `ky-realesrgan-upscale` | 视觉 | 图像/视频超分辨率 | **异步** | 0.50元/张 |
| `ky-realesrgan-status` | 视觉 | 超分任务状态查询 | 同步 | 0.01元/次 |
| `ky-rvc-convert` | 音频 | 声音克隆/变声 | 同步 | 0.15元/秒 |
| `ky-video-eval-evaluate` | 视频 | 视频质量评估 | 同步 | 0.05元/秒 |
|| `ky-video-eval-evaluate` | 视频 | 视频质量评估 | 同步 | 0.05元/秒 |
|| `doubao-2.1-pro` | 文本 | 豆包大模型2.1 Pro | 同步 | 0.001元/1K tokens |
|| `doubao-seedream-5.0` | 图像 | 豆包图像创作5.0 | **异步** | 0.02元/张 |
|| `doubao-speech-2.0` | 语音 | 豆包语音识别2.0 | 同步 | 0.004元/秒 |
---
@ -2305,6 +2308,81 @@ curl -X POST 'https://token.opencomputing.cn/llmage/v1/pipeline/submit' \
---
---
## 豆包大模型 API
### 豆包大模型2.1 Pro — doubao-2.1-pro
字节跳动自研大模型256K上下文支持文本对话和多模态理解。
通过火山引擎 ARK API 接入。
| 参数 | 类型 | 必填 | 说明 |
|------|------|------|------|
| `prompt` | string | 是 | 用户输入文本 |
| `sys_prompt` | string | 否 | 系统提示词 |
| `max_tokens` | int | 否 | 最大输出 token 数,默认 1024 |
| `stream` | boolean | 否 | 流式输出 |
```bash
curl -X POST 'https://token.opencomputing.cn/llmage/v1/chat/completions' \
-H 'Authorization: Bearer ***' \
-H 'Content-Type: application/json' \
-d '{"model":"doubao-2.1-pro","prompt":"介绍一下你自己","max_tokens":100}'
```
**响应:** OpenAI 兼容格式
```json
{
"id": "chatcmpl-xxx",
"model": "doubao-2.1-pro",
"choices": [{"index": 0, "message": {"role": "assistant", "content": "..."}}],
"usage": {"prompt_tokens": 10, "completion_tokens": 50, "total_tokens": 60}
}
```
### 豆包图像创作5.0 — doubao-seedream-5.0
Seedream 5.0 文生图模型,通过火山引擎 ARK API 接入。
| 参数 | 类型 | 必填 | 说明 |
|------|------|------|------|
| `prompt` | string | 是 | 图像描述文本 |
| `size` | string | 否 | 图像尺寸,默认 `"1024x1024"` |
| `n` | integer | 否 | 生成数量,默认 1 |
```bash
curl -X POST 'https://token.opencomputing.cn/llmage/v1/image/generations' \
-H 'Authorization: Bearer ***' \
-H 'Content-Type: application/json' \
-d '{"model":"doubao-seedream-5.0","catelogid":"t2i","prompt":"a beautiful sunset","size":"1024x1024"}'
```
### 豆包语音识别2.0 — doubao-speech-2.0
Speech 2.0 语音转文字模型,通过火山引擎 ARK API 接入。
| 参数 | 类型 | 必填 | 说明 |
|------|------|------|------|
| `audio_file` | string | 是 | 音频文件URL |
| `language` | string | 否 | 语言代码,默认 `"zh"` |
```bash
curl -X POST 'https://token.opencomputing.cn/llmage/v1/audio/transcriptions' \
-H 'Authorization: Bearer ***' \
-H 'Content-Type: application/json' \
-d '{"model":"doubao-speech-2.0","catelogid":"asr","audio_file":"https://example.com/audio.mp3"}'
```
```json
{"text": "识别文本", "usage": {"audio_seconds": 10.5}}
```
---
## 模型发现
列出所有 KTV Pipeline 可用模型: