diff --git a/wwwroot/api_doc.md b/wwwroot/api_doc.md index c583e49..5e83416 100644 --- a/wwwroot/api_doc.md +++ b/wwwroot/api_doc.md @@ -1845,7 +1845,10 @@ POST /v1/pipeline/submit | `ky-realesrgan-upscale` | 视觉 | 图像/视频超分辨率 | **异步** | 0.50元/张 | | `ky-realesrgan-status` | 视觉 | 超分任务状态查询 | 同步 | 0.01元/次 | | `ky-rvc-convert` | 音频 | 声音克隆/变声 | 同步 | 0.15元/秒 | -| `ky-video-eval-evaluate` | 视频 | 视频质量评估 | 同步 | 0.05元/秒 | +|| `ky-video-eval-evaluate` | 视频 | 视频质量评估 | 同步 | 0.05元/秒 | +|| `doubao-2.1-pro` | 文本 | 豆包大模型2.1 Pro | 同步 | 0.001元/1K tokens | +|| `doubao-seedream-5.0` | 图像 | 豆包图像创作5.0 | **异步** | 0.02元/张 | +|| `doubao-speech-2.0` | 语音 | 豆包语音识别2.0 | 同步 | 0.004元/秒 | --- @@ -2305,6 +2308,81 @@ curl -X POST 'https://token.opencomputing.cn/llmage/v1/pipeline/submit' \ --- + + +--- + +## 豆包大模型 API + +### 豆包大模型2.1 Pro — doubao-2.1-pro + +字节跳动自研大模型,256K上下文,支持文本对话和多模态理解。 +通过火山引擎 ARK API 接入。 + +| 参数 | 类型 | 必填 | 说明 | +|------|------|------|------| +| `prompt` | string | 是 | 用户输入文本 | +| `sys_prompt` | string | 否 | 系统提示词 | +| `max_tokens` | int | 否 | 最大输出 token 数,默认 1024 | +| `stream` | boolean | 否 | 流式输出 | + +```bash +curl -X POST 'https://token.opencomputing.cn/llmage/v1/chat/completions' \ + -H 'Authorization: Bearer ***' \ + -H 'Content-Type: application/json' \ + -d '{"model":"doubao-2.1-pro","prompt":"介绍一下你自己","max_tokens":100}' +``` + +**响应:** OpenAI 兼容格式 + +```json +{ + "id": "chatcmpl-xxx", + "model": "doubao-2.1-pro", + "choices": [{"index": 0, "message": {"role": "assistant", "content": "..."}}], + "usage": {"prompt_tokens": 10, "completion_tokens": 50, "total_tokens": 60} +} +``` + +### 豆包图像创作5.0 — doubao-seedream-5.0 + +Seedream 5.0 文生图模型,通过火山引擎 ARK API 接入。 + +| 参数 | 类型 | 必填 | 说明 | +|------|------|------|------| +| `prompt` | string | 是 | 图像描述文本 | +| `size` | string | 否 | 图像尺寸,默认 `"1024x1024"` | +| `n` | integer | 否 | 生成数量,默认 1 | + +```bash +curl -X POST 'https://token.opencomputing.cn/llmage/v1/image/generations' \ + -H 'Authorization: Bearer ***' \ + -H 'Content-Type: application/json' \ + -d '{"model":"doubao-seedream-5.0","catelogid":"t2i","prompt":"a beautiful sunset","size":"1024x1024"}' +``` + +### 豆包语音识别2.0 — doubao-speech-2.0 + +Speech 2.0 语音转文字模型,通过火山引擎 ARK API 接入。 + +| 参数 | 类型 | 必填 | 说明 | +|------|------|------|------| +| `audio_file` | string | 是 | 音频文件URL | +| `language` | string | 否 | 语言代码,默认 `"zh"` | + +```bash +curl -X POST 'https://token.opencomputing.cn/llmage/v1/audio/transcriptions' \ + -H 'Authorization: Bearer ***' \ + -H 'Content-Type: application/json' \ + -d '{"model":"doubao-speech-2.0","catelogid":"asr","audio_file":"https://example.com/audio.mp3"}' +``` + +```json +{"text": "识别文本", "usage": {"audio_seconds": 10.5}} +``` + +--- + ## 模型发现 列出所有 KTV Pipeline 可用模型: