Skip to content

ChatGPT ​

Endpoint: https://mmu.vod-qcloud.com/v1인증: VOD ApiToken / Bearer

기본 정보 ​

항목값
호출 주소https://mmu.vod-qcloud.com
인증VOD 애플리케이션에서 발급한 ApiToken / Bearer
출력텍스트 / 구조화된 응답
응답 방식JSON / SSE

지원 프로토콜 ​

규격경로대상
Chat CompletionsPOST /v1/chat/completions아래 모든 모델
ResponsesPOST /v1/responses아래 모든 모델
MessagesPOST /v1/messages아래 모든 모델

이 문서에 나열된 모든 ChatGPT 모델은 WAND 게이트웨이의 Responses를 지원합니다. 프로토콜별 입력 필드는 API Reference를 따릅니다.

버전별 샘플링 옵션 ​

모델 IDtemperaturetop_p
gpt-chat-latest미지원미지원
gpt-6-solreasoning.effort=none일 때 설정 가능reasoning.effort=none일 때 설정 가능
gpt-6-lunareasoning.effort=none일 때 설정 가능reasoning.effort=none일 때 설정 가능
gpt-6-astra미지원미지원
gpt-5.6-terrareasoning.effort=none일 때 설정 가능reasoning.effort=none일 때 설정 가능
gpt-5.6-solreasoning.effort=none일 때 설정 가능reasoning.effort=none일 때 설정 가능
gpt-5.6-lunareasoning.effort=none일 때 설정 가능reasoning.effort=none일 때 설정 가능
gpt-5.5reasoning.effort=none일 때 설정 가능reasoning.effort=none일 때 설정 가능
gpt-5.4-pro미지원미지원
gpt-5.4-nano설정 가능설정 가능
gpt-5.4-mini설정 가능설정 가능
gpt-5.4설정 가능설정 가능
gpt-5.3-codex설정 가능설정 가능
gpt-5.3-chat미지원미지원
gpt-5.2-chat미지원미지원
gpt-5.2설정 가능설정 가능
gpt-5.1-chat미지원미지원
gpt-5.1설정 가능설정 가능
gpt-5-nano미지원미지원
gpt-5-mini미지원미지원
gpt-5-chat미지원미지원
gpt-5미지원미지원
gpt-4o설정 가능설정 가능
gpt-4.1설정 가능설정 가능

temperature는 샘플링 온도, top_p는 누적 확률 범위를 지정합니다. 한 가지 방식을 중심으로 조정합니다.

버전별 추론 설정 ​

모델 ID설정 방식비활성화
gpt-chat-latest추론 설정 미지원—
gpt-6-solreasoning.effortnone
gpt-6-lunareasoning.effortnone
gpt-6-astrareasoning.effort비활성화 불가
gpt-5.6-terrareasoning.effortnone
gpt-5.6-solreasoning.effortnone
gpt-5.6-lunareasoning.effortnone
gpt-5.5reasoning.effortnone
gpt-5.4-proreasoning.effort비활성화 불가
gpt-5.4-nanoreasoning.effortnone
gpt-5.4-minireasoning.effortnone
gpt-5.4reasoning.effortnone
gpt-5.3-codexreasoning.effortnone
gpt-5.3-chat추론 설정 미지원—
gpt-5.2-chat추론 설정 미지원—
gpt-5.2reasoning.effortnone
gpt-5.1-chat추론 설정 미지원—
gpt-5.1reasoning.effortnone
gpt-5-nanoreasoning.effort비활성화 불가
gpt-5-minireasoning.effort비활성화 불가
gpt-5-chat추론 설정 미지원—
gpt-5reasoning.effort비활성화 불가
gpt-4o추론 설정 미지원—
gpt-4.1추론 설정 미지원—

Responses 기준 필드는 reasoning.effort입니다. Chat Completions에서는 reasoning_effort를 사용합니다. 비활성화할 수 없는 모델은 해당 버전의 허용 추론 강도를 지정합니다.

버전별 추론 및 토큰 한도 ​

모델 ID추론 강도컨텍스트 토큰최대 출력 토큰
gpt-6-solnone / low / medium / high / xhigh / max1,050,000128,000
gpt-6-lunanone / low / medium / high / xhigh / max1,050,000128,000
gpt-6-astralow / medium / high / xhigh / max1,050,000128,000
gpt-5.6-terranone / low / medium / high / xhigh / max1,050,000128,000
gpt-5.6-solnone / low / medium / high / xhigh / max1,050,000128,000
gpt-5.6-lunanone / low / medium / high / xhigh / max1,050,000128,000
gpt-5.5none / low / medium / high / xhigh1,050,000128,000
gpt-5.4-promedium / high / xhigh1,050,000128,000
gpt-5.4-nanonone / low / medium / high / xhigh400,000128,000
gpt-5.4-mininone / low / medium / high / xhigh400,000128,000
gpt-5.4none / low / medium / high / xhigh1,050,000128,000
gpt-5.3-codex기본 설정400,000128,000
gpt-5.2none / low / medium / high / xhigh400,000128,000
gpt-5.1none / low / medium / high400,000128,000
gpt-5-nano기본 설정400,000128,000
gpt-5-mini기본 설정400,000128,000
gpt-5minimal / low / medium / high400,000128,000
gpt-4o기본 설정128,00016,384
gpt-4.1기본 설정knowledge1,047,576

요청 파라미터 ​

파라미터필수타입설명
model필수String버전별 옵션 표의 모델 ID
messages필수ArrayChat Completions / Messages의 대화 입력
input필수String / ArrayResponses의 입력. messages 대신 사용
max_tokens선택IntegerChat Completions / Messages의 생성 한도. Messages에서는 필수
max_output_tokens선택IntegerResponses의 생성 한도
stream선택Booleantrue: SSE / false: JSON

요청 예시 ​

Chat Completions ​

json
{
  "model": "gpt-chat-latest",
  "messages": [
    {
      "role": "user",
      "content": "Reply with exactly OK and nothing else."
    }
  ],
  "max_tokens": 512,
  "stream": false
}

응답 ​

json
{
  "id": "01a0de31-615d-7014-9372-2ab6ab19e70e",
  "object": "chat.completion",
  "model": "gpt-chat-latest",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "OK"
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "prompt_tokens_details": {
      "audio_tokens": 0,
      "cached_tokens": 0
    },
    "prompt_cached_tokens_details": {
      "audio_tokens": 0
    },
    "completion_tokens": 17,
    "completion_tokens_details": {
      "accepted_prediction_tokens": 0,
      "audio_tokens": 0,
      "reasoning_tokens": 0,
      "rejected_prediction_tokens": 0
    },
    "total_tokens": 31
  }
}

Responses ​

json
{
  "model": "gpt-6-astra",
  "input": "Reply with exactly OK and nothing else.",
  "max_output_tokens": 2048,
  "stream": false,
  "reasoning": {
    "effort": "low"
  }
}

응답 ​

json
{
  "id": "resp_06ba8773e2ed38cf006ab7df36befc8195ab2906ff31076da8",
  "object": "response",
  "model": "gpt-6-astra",
  "status": "completed",
  "output": [
    {
      "id": "msg_06ba8773e2ed38cf006ab7df37be88819585df66bae9e722a1",
      "type": "message",
      "status": "completed",
      "content": [
        {
          "type": "output_text",
          "annotations": ,
          "logprobs": ,
          "text": "OK"
        }
      ],
      "phase": "final_answer",
      "role": "assistant"
    }
  ],
  "usage": {
    "input_tokens": 14,
    "input_tokens_details": {
      "cache_write_tokens": 0,
      "cached_tokens": 0
    },
    "output_tokens": 5,
    "output_tokens_details": {
      "reasoning_tokens": 0
    },
    "total_tokens": 19
  }
}

Messages ​

json
{
  "model": "gpt-chat-latest",
  "messages": [
    {
      "role": "user",
      "content": "Reply with exactly OK and nothing else."
    }
  ],
  "max_tokens": 512,
  "stream": false
}

응답 ​

json
{
  "id": "01a0de34-7483-76a8-a2e6-5f997dc8388c",
  "model": "gpt-chat-latest",
  "type": "message",
  "role": "assistant",
  "content": [
    {
      "text": "OK",
      "type": "text"
    }
  ],
  "stop_reason": "end_turn",
  "usage": {
    "input_tokens": 14,
    "output_tokens": 5
  }
}

특수 설정 ​

Chat Completions는 reasoning_effort, Responses는 reasoning.effort를 사용합니다. 추론 설정은 모델 버전에 맞춰 지정합니다. gpt-6-astra와 Pro 모델은 추론을 끄는 none 대신 해당 버전의 허용 강도를 사용합니다.

Responses의 output에는 추론 항목과 메시지 항목이 함께 들어갈 수 있습니다. type=message의 content에서 type=output_text를 읽습니다. Chat Completions는 choices.message.content를 읽습니다.

GPT-6 Sol의 도구 호출은 Responses 규격을 사용합니다. Chat Completions의 함수 호출은 reasoning_effort=none으로 구성합니다. 네이티브 도구와 게이트웨이 호환 필드는 구분됩니다.

버전별 추가 옵션 ​

gpt-5.4-pro와 gpt-5.3-codex는 Responses 경로로 호출합니다. reasoning.effort로 추론 강도를 지정합니다.

基于 VitePress 构建 · 部署于腾讯云 EdgeOne Pages