1. Audio音频
MoYunAPI
  • MoYun API
    • 快速开始
    • 充值与价格说明
    • 接入Agent指南
      • IDE与终端AI(IDE & AI CLI)
        • VS Code配置指南
          • VS Code安装与配置指南
        • JetBrains系列配置指南
          • JetBrains系列IDE下载与安装
        • 国产桌面IDE配置指南
          • IDE 配接 Cline 使用指南
          • CodeBuddy CN IDE 配置指南
          • Trae CN IDE 配置指南
        • AI CLI配置指南
          • Kimi Code CLI
          • MiMo Code CLI 配置指南
          • OpenCode CLI 配置指南
          • Cursor CLI
          • Grok CLI
          • ChatGPT(Codex CLI)配置指南
          • Claude Code CLI配置指南
      • 桌面级Agent(Desktop Agent)
        • WorkBuddy 配置指南
        • QoderWork
        • ZCode配置指南
        • Claude Code Desktop
        • ChatGPT(Codex Desktop)配置指南
        • Grok Desktop配置指南
        • MiniMax Code配置指南
        • Cursor Desktop
        • OpenCode Desktop配置指南
      • 工作流(WorkFlows)
        • n8n 配置使用 MoYunAPI 教程
        • Dify 配置使用 MoYunAPI 教程
      • 自动化工具(Automation)
        • CC Switch 安装与配置教程
      • 开源项目(Open Source)
        • OpenClaw下载与API配接(Windows)
        • OpenClaw下载与API配接(Linux)
    • 提示词指南
      • Seedream 4.0-5.0 提示词指南
    • API 文档
      • Models模型
        • 获取模型列表
      • Chat对话
        • 对话补全 (Chat Completions) — 核心接口
      • Completions文本
        • 文本补全 (Completions)
      • Embeddings向量
        • 文本嵌入 (Embeddings)
      • Images图片
        • Doubao-Seedream 图生图(单图参考)
        • Doubao-Seedream 多图融合生图
        • Doubao-Seedream 文生图
        • Doubao-Seedream 组图生成
        • MiniMax-Image 文生图
        • MiniMax-Image 图生图(人物主体参考)
        • GLM-Image 文生图
        • GLM-CogView 文生图
        • Qwen-Image 文生图
        • Qwen-Image 3.0 图生图/图像编辑
      • Audio音频
        • MiMo-TTS语音系列
          POST
        • 语音合成 (Text-to-Speech)
          POST
        • 语音识别 (Audio Transcription)
          POST
      • Realtime语音对话
        • 实时语音对话 (WebSocket)
      • Moderations内容安全审核
        • 内容安全审核 (Moderations)
      • Rerank文档重排序
        • 文档重排序 (Rerank)
      • Video视频
        • 生成视频 (Video Generation, 异步任务)
        • 查询视频任务状态
    • Images图片
    • 数据模型
      • Error
      • ErrorResponse
      • Usage
      • StyleObject
      • ChatMessage
      • SubjectReference
      • Tool
      • FunctionCall
  1. Audio音频

语音识别 (Audio Transcription)

POST
https://moyunapi.com/v1/audio/transcriptions
Audio
将音频文件转录为文本。请求体为 multipart/form-data,上传音频文件。支持 mp3、mp4、mpeg、mpga、m4a、wav、webm 等格式,文件不超过 25MB。

请求参数

Authorization
Bearer Token
在 Header 添加参数
Authorization
,其值为在 Bearer 之后拼接 Token
示例:
Authorization: Bearer ********************
or
Header 参数

Body 参数multipart/form-data必填

返回响应

🟢200
application/json
成功。响应内容取决于 response_format。
Body

🟠400
🟠401
🟠429
🔴500
请求示例请求示例
Shell
JavaScript
Java
Swift
curl --location 'https://moyunapi.com/v1/audio/transcriptions' \
--header 'Accept;' \
--header 'Authorization: Bearer <token>' \
--form 'file=@"(binary) meeting.wav"' \
--form 'model="whisper-1"' \
--form 'language="zh"' \
--form 'prompt="墨云 API、量子计算"' \
--form 'response_format="verbose_json"' \
--form 'temperature="0"' \
--form 'timestamp_granularities="segment"'
响应示例响应示例
200 - json 格式响应
{
    "text": "欢迎使用墨云 API 语音识别服务。"
}
上一页
语音合成 (Text-to-Speech)
下一页
实时语音对话 (WebSocket)
Built with