싱가포르 International 입력은 100만 토큰당 $0.50, 입력이 256,000을 넘는 요청은 $2다. 베이징은 $0.276에서 $1.101로 뛰며, 구간이 바뀌면 넘긴 부분만이 아니라 그 요청의 모든 토큰에 상위 단가가 적용된다.

출력도 같이 움직인다. 싱가포르는 $3에서 $6, 베이징은 $1.651에서 $6.602다. 1M 컨텍스트를 쓸 수 있다는 사양만 보고 예산을 잡으면 256K 앞에서 단가가 먼저 바뀐다.

이 글은 직접 사용기가 아니다. 2026-09-04에 확인한 Alibaba Cloud Model Studio 모델 페이지와 가격표, 시각 이해 문서로 API ID, 한도, 리전별 기능, 토큰 단가만 정리한다. 공개되지 않은 벤치마크 점수나 체감 품질은 추가하지 않는다.

먼저 답하면

  • 숫자: 싱가포르 0–256K 입력 $0.50 / 출력 $3. 256K 초과 입력 $2 / 출력 $6. 베이징 0–256K 입력 $0.276 / 출력 $1.651, 초과 입력 $1.101 / 출력 $6.602
  • 결론: 256K 아래에서 리전을 고르고, 긴 요청은 구간 점프를 비용에 넣는다
  • 함정: 입력 토큰이 256K를 넘는 순간 그 요청의 입력·출력 전부에 상위 단가가 적용된다. 별칭 qwen3.6-plus와 스냅샷 qwen3.6-plus-2026-04-02는 기능이 같다고 적혀 있지만 캐시·배치 지원은 다르다
  • 기본값: 새 프로젝트의 추천 목록은 qwen3.7-plusqwen3.8-max를 앞에 둔다. Qwen3.6 Plus는 아직도 목록과 가격표에 남아 있는 이전 Plus다

문서에 적힌 모델

항목 Model Studio 문서상 내용
공식 제품명·API ID Qwen3.6 Plus · qwen3.6-plus
현재 동등 스냅샷 qwen3.6-plus-2026-04-02
제품 위치 네이티브 비전-언어 Plus. 모델 페이지는 3.5 대비 에이전트 코딩·프론트엔드·Vibe coding, 일반 객체 인식·OCR·위치 추정이 강화됐다고 적는다
입력·출력 이미지·텍스트·비디오 입력, 텍스트 출력
컨텍스트 윈도우 1,000,000토큰
최대 입력 991,808토큰. thinking 모드 983,616토큰
최대 출력 65,536토큰. thinking 모드도 65,536토큰
최대 chain-of-thought 81,920토큰
기능 함수 호출, 구조화된 출력, 웹 검색, prefix completion. 별칭은 컨텍스트 캐싱 지원. 파인튜닝은 미지원
배치 추론 별칭 기준 China (Beijing)만 지원. Singapore, Frankfurt, Virginia, Tokyo, Hong Kong은 미지원
확인한 리전 China (Beijing), Singapore(International), Germany(Frankfurt), US(Virginia), Japan(Tokyo), Hong Kong(China)

모델 페이지는 qwen3.6-plus가 스냅샷 qwen3.6-plus-2026-04-02와 기능적으로 같다고 적는다. 같은 페이지의 능력 표는 그렇지 않다. 별칭은 컨텍스트 캐싱을 지원하고 베이징에서만 배치 추론을 연다. 스냅샷 ID를 고정하면 확인한 리전에서 캐싱과 배치가 모두 미지원이다. 별칭을 쓰는 이유와 스냅샷을 고정하는 이유를 같은 기능 세트로 취급하면 안 된다.

시각 이해 문서는 qwen3.6-plus의 컨텍스트 1M, 최대 출력 64k, 이미지 최대 256장, 비디오 최대 64개, 함수 호출·내장 도구·구조화 출력을 지원한다고 적는다. 비디오는 최대 2시간 / 2GB 구간에 들어 있다. 구조화 출력은 Qwen3.6 계열의 non-thinking 모드에서 지원된다고 적혀 있으므로 thinking 모드 기본값으로 JSON을 기대해서는 안 된다.

내장 도구는 웹 검색과 코드 실행을 설정 없이 쓸 수 있다고 나와 있다. 함수 호출과 구조화 출력은 에이전트가 화면·문서 근거를 도구에 넘길 때 필요한 조건이다. 실제 도구 성공률이나 OCR 정확도는 공식 수치로 공개되지 않았다.

모델 페이지에 표시된 RPM·TPM은 문서 표기 한도다. 별칭은 베이징 30,000 RPM / 5,000,000 TPM, 싱가포르 15,000 RPM / 5,000,000 TPM이다. 스냅샷은 그보다 낮은 한도로 적혀 있다. 계정과 리전에서 항상 같은 처리량을 보장한다는 문구는 확인되지 않았다.

벤치마크에서 확인되는 위치

확인한 공식 세 페이지에는 Qwen3.6 Plus의 코딩 점수, 비전 벤치마크, 생성 속도, 한국어 품질이 없다. 모델 페이지의 “현재 최상위와 동등”, “3.5 대비 향상” 문장만으로 다른 모델보다 높은 성공률을 계산할 수는 없다.

따라서 이 글에서는 공급사 간 순위나 성능 우위를 만들지 않는다. 도입 판단에는 같은 저장소, 같은 이미지·비디오 입력, 같은 시간 제한으로 돌린 자체 평가가 필요하다. 가격 비교도 같은 Model Studio 가격표에서 직접 맞출 수 있는 항목으로 제한한다.

가장 가까운 대안

시각 이해 문서의 추천 목록은 qwen3.7-plus를 먼저 쓰고, 표에는 qwen3.8-max도 올라 있다. Qwen3.6 Plus는 그 목록과 가격표에 남아 있지만 최신 플래그십이 아니다. 아래 숫자는 2026-09-02 갱신 가격표의 정가다. qwen3.7-plus 칸에는 한시 20% 할인이 따로 적혀 있으므로 할인 후 단가를 상시 가격처럼 쓰지 않는다.

항목 Qwen3.6 Plus Qwen3.7 Plus 정가 Qwen3.5 Plus
컨텍스트 1,000,000 1,000,000 1,000,000
최대 이미지(시각 문서) 256 2,048 256
싱가포르 0–256K 입력 $0.50 $0.40 $0.40
싱가포르 0–256K 출력 $3 $1.60 $2.40
싱가포르 256K–1M 입력 $2 $1.20 $0.50
싱가포르 256K–1M 출력 $6 $4.80 $3
베이징 짧은 구간 입력 $0.276 $0.276 $0.115(0–128K)
베이징 짧은 구간 출력 $1.651 $1.101 $0.688(0–128K)

싱가포르 정가만 보면 Qwen3.6 Plus는 같은 Plus 자리의 3.7·3.5보다 입력과 출력이 더 높다. 256K를 넘는 구간의 격차는 더 크다. 3.5 Plus의 긴 구간 입력은 $0.50로 남아 있고, 3.6 Plus는 $2다. 긴 컨텍스트가 필요해서 3.6을 고르는 선택은 성립하지 않는다. 세 모델 모두 1M이다.

3.7 Plus는 이미지 한도가 2,048장으로 적혀 있다. 화면을 많이 넣는 에이전트라면 단가와 한도를 같이 봐야 한다. 공식 자료에는 세 모델을 같은 과제로 실행한 점수가 없다. 3.6의 코딩·비전 강화 문장이 실제 완료 비용을 낮추는지는 자체 평가로 확인해야 한다.

가격과 실제 선택 조건

가격표의 구간 규칙은 한 요청의 입력 토큰 수로 단가를 고른 뒤, 그 단가를 요청의 모든 토큰에 적용한다. 256,001토큰부터 비싸지는 구조가 아니다. 255,999에서 256,001로 넘는 순간 입력과 출력 전부가 상위 칸으로 간다.

공식 단가를 캐시 미적중 요청에 단순 적용하면 경계가 드러난다.

예시 요청 계산 싱가포르 토큰 비용
입력 255,000 + 출력 10,000 255,000 × $0.50/1M + 10,000 × $3/1M $0.1575
입력 256,001 + 출력 10,000 256,001 × $2/1M + 10,000 × $6/1M $0.5720

입력이 약 1,000토큰 늘었을 뿐인데 토큰 비용은 약 3.6배가 된다. 같은 계산을 베이징에 적용하면 $0.0869에서 $0.3479로 약 4배가 된다. 1M 컨텍스트를 쓰는 에이전트라면 프롬프트 압축이나 파일 분할을 256K 전에 넣어야 비용을 예측하기 쉽다.

리전 차이도 같은 표에 있다. 짧은 구간에서 싱가포르 입력 $0.50은 베이징 $0.276보다 높다. 긴 구간 출력은 반대다. 싱가포르 $6, 베이징 $6.602. 국제 엔드포인트만 쓸 수 있는 팀과 베이징 리전을 쓸 수 있는 팀은 같은 모델이라도 원가가 다르다. 가격표는 이 숫자가 프로모션을 제외한 정가이며, 캐시 단가는 표의 입력 가격에 포함되지 않는다고 적는다.

컨텍스트 캐싱은 가격표 머리글에 명시 캐시 생성이 표준 입력의 125%, 캐시 적중이 10%라고 적혀 있다. 모델 페이지의 별칭 표는 싱가포르 0–256K 기준 명시 캐시 생성 $0.625, 적중 $0.05다. 스냅샷 ID를 고정하면 캐싱 자체가 미지원이므로 이 할인 칸을 예산에 넣으면 안 된다.

배치는 별칭의 베이징 표에만 열린다. Batch File 입력·출력은 실시간의 절반으로 적혀 있고, Batch Chat은 실시간과 거의 같다. 싱가포르를 포함한 확인한 국제·글로벌 리전은 배치 미지원이다. 국제 트래픽에 일반적인 배치 50% 할인을 가정하면 안 된다.

싱가포르 표에는 일부 Plus 모델의 무료 쿼터가 90일, 100만 토큰으로 적혀 있다. 이는 활성화·출시·승인 중 늦은 날짜부터 90일이다. 상시 단가로 계산하면 안 된다.

thinking 모드와 non-thinking 모드의 출력 단가는 확인한 qwen3.6-plus 칸에서 같다. 추론을 켠다고 출력 단가가 따로 뛰지는 않는다. 다만 thinking 모드 최대 입력은 983,616토큰으로 더 작고, chain-of-thought 상한은 81,920토큰이다. 긴 사고를 여는 설정과 1M 컨텍스트를 같은 크기로 읽으면 안 된다.

도입 전 확인할 테스트

직접 사용기가 아니므로 특정 저장소의 완료율이나 응답 시간을 보장할 수 없다. 도입 전에는 다음 작업을 qwen3.7-plus와 같은 권한·시간 제한으로 실행하는 편이 좋다.

테스트 작업 기록할 지표
256K 바로 아래와 바로 위의 같은 과제 적용된 요율 구간, 입력·출력 토큰, 요청 비용
싱가포르와 베이징의 짧은 요청 리전별 단가, 지연, 사용 가능한 기능
별칭과 스냅샷 ID의 캐시 적중 캐시 생성·적중 여부, 스냅샷에서 거절되는지
이미지나 짧은 비디오가 포함된 수정 화면 판독 오류, 도구 호출 횟수, 재시도율
여러 파일 버그 수정 테스트 통과율, 잘못 수정한 파일, 과제당 총토큰

추천 대상 / 비추천 대상

추천

  • 256K 아래에서 이미지·비디오 근거와 함수 호출을 연결하고, 이미 쓰는 Qwen3.6 Plus 별칭을 유지하려는 팀
  • 베이징 리전과 배치 파일 추론을 쓸 수 있어 짧은 구간 단가와 배치 할인 칸을 실제로 열어 볼 수 있는 운영팀
  • 별칭과 스냅샷의 캐시·배치 차이를 명시적으로 정리한 뒤 기존 파이프라인을 점검하려는 팀

비추천

  • 새 프로젝트의 기본 모델을 최신 추천 목록에서 고르려는 팀. 문서는 qwen3.7-plusqwen3.8-max를 앞에 둔다
  • 한 요청을 자주 256K 위로 올리면서 구간 점프를 비용에 넣지 않는 에이전트
  • 싱가포르 국제 리전에서 배치 할인이나 스냅샷 ID의 캐시 적중을 전제하는 대량 작업
  • 공식 코딩·비전 점수와 한국어 실측이 구매 요건인 조직

판단

Qwen3.6 Plus는 1M 컨텍스트와 이미지·비디오 입력을 제공하는 네이티브 비전-언어 Plus다. 공식 문서에서 확인되는 선택 이유는 별칭의 캐싱, 베이징 배치, 함수 호출과 구조화 출력이다. 최신 추천 카드는 아니다.

제약은 가격표에 더 분명하다. 256K를 넘는 입력은 요청 전체를 상위 단가로 보내고, 싱가포르 짧은 구간은 베이징보다 비싸다. 별칭과 스냅샷을 같은 기능으로 보면 캐시와 배치를 잘못 계산한다. 3.7 Plus 정가는 같은 싱가포르 표에서 더 낮다.

기존 별칭을 유지하는 파이프라인이라면 256K 경계와 리전부터 다시 재는 편이 맞다. 새로 기본 모델을 고른다면 추천 목록의 3.7·3.8을 먼저 보고, 3.6 Plus는 이미 붙은 API ID의 비용 함정을 정리하는 글로 읽는 것이 안전하다.

아직 공식 문서에서 확인되지 않은 부분

  • 동일 조건 코딩·비전 벤치마크와 3.7 Plus 대비 과제 완료율
  • 한국어 코드 설명, OCR, 화면 기반 수정 성공률
  • 리전·계정 등급별 실제 지연과 문서 RPM·TPM의 차이
  • 별칭이 가리키는 스냅샷이 바뀌는 일정과 장기 지원 기간
  • 한시 할인·무료 쿼터 종료 뒤의 실효 단가

함께 읽을 글

근거와 출처

  • qwen3.6-plus 모델 문서 — API ID, 스냅샷 동등 표기, 입출력 형식, 1,000,000토큰 컨텍스트, 입력·출력·thinking·CoT 한도, 리전별 캐싱·배치, 정가와 RPM·TPM. Alibaba Cloud Model Studio, 페이지 표시 갱신일 2026-08-26, 확인일 2026-09-04
  • Model Studio 가격표 — 구간 요금이 요청 전체에 적용되는 규칙, Qwen-Plus 싱가포르·베이징 USD 단가, 캐시 125%/10% 안내, 3.7 Plus·3.5 Plus 정가. Alibaba Cloud Model Studio, 페이지 표시 갱신일 2026-09-02, 확인일 2026-09-04
  • 시각 이해 모델 안내 — 추천 목록의 qwen3.7-plus·qwen3.8-max, qwen3.6-plus의 1M 컨텍스트와 이미지·비디오 한도, 내장 도구, non-thinking 구조화 출력. Alibaba Cloud Model Studio, 확인일 2026-09-04

게시: 2026-09-04 09:00 KST 작성 방식: 직접 사용기가 아닌 Alibaba Cloud Model Studio 공식 문서 분석