Skip to content

DeepSeek ​

Endpoint: https://mmu.vod-qcloud.com/v1인증: VOD ApiToken / Bearer

기본 정보 ​

항목값
호출 주소https://mmu.vod-qcloud.com
인증VOD 애플리케이션에서 발급한 ApiToken / Bearer
출력텍스트 / 구조화된 응답
응답 방식JSON / SSE

지원 프로토콜 ​

규격경로대상
Chat CompletionsPOST /v1/chat/completions아래 모든 모델
MessagesPOST /v1/messages아래 모든 모델

아래 모델 ID에 해당 규격을 사용합니다. 인증과 공통 필드는 API Reference를 따릅니다.

샘플링 옵션 ​

이 문서에 나열된 모든 모델에 공통으로 적용됩니다.

파라미터설정
temperature설정 가능
top_p설정 가능

temperature는 샘플링 온도, top_p는 누적 확률 범위를 지정합니다. 한 가지 방식을 중심으로 조정합니다.

버전별 추론 설정 ​

모델 ID설정 방식비활성화
deepseek-v4.1-flashthinking_enabledfalse
deepseek-v4-prothinking_enabledfalse
deepseek-v4-flashthinking_enabledfalse
deepseek-v3.2thinking_enabledfalse
deepseek-flashthinking_enabledfalse

Chat Completions 기준입니다. 추론 내용은 reasoning_content, 최종 답변은 content에서 읽습니다. 비활성화할 수 없는 버전에는 비활성화 옵션을 전달하지 않습니다.

요청 파라미터 ​

파라미터필수타입설명
model필수String버전별 옵션 표의 모델 ID
messages필수ArrayChat Completions / Messages의 대화 입력
max_tokens선택IntegerChat Completions / Messages의 생성 한도. Messages에서는 필수
stream선택Booleantrue: SSE / false: JSON

요청 예시 ​

Chat Completions ​

json
{
  "model": "deepseek-v4.1-flash",
  "messages": [
    {
      "role": "user",
      "content": "Reply with exactly OK and nothing else."
    }
  ],
  "max_tokens": 2048,
  "stream": false,
  "reasoning_effort": "low"
}

응답 ​

json
{
  "id": "01a0de40-cd17-7102-8a8d-82c46dd1e693",
  "object": "chat.completion",
  "model": "deepseek-flash",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "OK",
        "reasoning_content": "We need answer exactly OK and nothing else. Must comply. Final \"OK\"."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 38,
    "prompt_tokens_details": {
      "audio_tokens": 0,
      "cached_tokens": 0
    },
    "prompt_cached_tokens_details": {
      "audio_tokens": 0
    },
    "completion_tokens": 18,
    "completion_tokens_details": {
      "accepted_prediction_tokens": 0,
      "audio_tokens": 0,
      "reasoning_tokens": 16,
      "rejected_prediction_tokens": 0
    },
    "total_tokens": 56
  }
}

Messages ​

json
{
  "model": "deepseek-v4.1-flash",
  "messages": [
    {
      "role": "user",
      "content": "Reply with exactly OK and nothing else."
    }
  ],
  "max_tokens": 512,
  "stream": false
}

응답 ​

json
{
  "id": "01a0de32-ad83-7af6-97ee-7b98a0bd1513",
  "model": "deepseek-flash",
  "type": "message",
  "role": "assistant",
  "content": [
    {
      "text": "OK",
      "type": "text"
    }
  ],
  "stop_reason": "end_turn",
  "usage": {
    "input_tokens": 38,
    "output_tokens": 17
  }
}

특수 설정 ​

추론과 최종 답변은 각각 reasoning_content와 content에 반환됩니다. 이전 턴의 최종 답변을 assistant.content로 전달해 대화를 이어갑니다. thinking_enabled와 reasoning_effort의 지원은 버전별로 적용됩니다.

함수 호출의 tool_calls.function.arguments는 JSON 문자열입니다. 파싱한 뒤 도구를 실행하고 해당 tool_call_id로 결과를 연결합니다.

基于 VitePress 构建 · 部署于腾讯云 EdgeOne Pages