무엇을 도와드릴까요?
APIMart에게 질문하기
qwen3.8-max-0902
숨겨진 수수료 없는 투명한 요금제. 사용한 만큼만 지불하세요.
100만 토큰당
| 요금 항목 | 골드 가격현재 가격 | 플래티넘 가격 | 다이아몬드 가격 | 공식 가격 | 절약률 |
|---|---|---|---|---|---|
| 입력 | 13.7143~$1.3714 | 13.0286~$1.3029 | 12.3429~$1.2343 | 17.1429~$1.7143 | 20% |
| 캐시된 입력 | 1.7143~$0.1714 | 1.6286~$0.1629 | 1.5429~$0.1543 | 2.1429~$0.2143 | 20% |
| 명시적 캐시 입력 | 1.1429~$0.1143 | 1.0857~$0.1086 | 1.0286~$0.1029 | 1.4286~$0.1429 | 20% |
| 캐시 쓰기 | 17.1429~$1.7143 | 16.2857~$1.6286 | 15.4286~$1.5429 | 21.4286~$2.1429 | 20% |
| 출력 | 41.1429~$4.1143 | 39.0857~$3.9086 | 37.0286~$3.7029 | 51.4286~$5.1429 | 20% |
qwen3.8-max로 긴 컨텍스트 추론 애플리케이션을 구축하세요. 일반 대화와 PDF에는 Chat Completions를, 웹·추출·코드 실행·이미지 검색 도구에는 Responses API를 사용합니다.
50K+
활성 사용자
99.9%
가동률
2x
더 빠름
70%
비용 절감
연동 전에 알아야 할 엔드포인트 동작, 컨텍스트 한도, 추론, 캐싱 및 도구
긴 컨텍스트, 문서 또는 도구 지원 작업에 맞는 엔드포인트를 선택하세요
첫 요청을 보내기 전에 모델과 엔드포인트를 명확히 선택하세요
APIMart 계정을 만들고 API 사용 잔액을 충전합니다.
인증된 Qwen 요청에 사용할 API 키를 생성합니다.
모델을 qwen3.8-max로 설정합니다. 채팅이나 PDF에는 Chat Completions, 내장 도구에는 Responses를 사용하고 Chat 요청에는 stream을 명시합니다.
개발자들이 말하는 Qwen API 평가
“Qwen-Max는 중국어 콘텐츠 생성의 필수 도구입니다. 언어 품질이 타의 추종을 불허합니다.”
Wei Zhang
콘텐츠 리드
“Qwen-Coder가 코드 리뷰 파이프라인을 훌륭하게 처리합니다. 속도와 정확성의 균형이 뛰어납니다.”
Alex Chen
엔지니어링 매니저
“Qwen-VL 모델의 중국어 문서 및 양식 읽기 정확도가 인상적입니다. 개발 기간을 수개월 단축했습니다.”
Sarah Li
프로덕트 매니저
“Qwen-Turbo는 대용량 채팅 애플리케이션에서 놀라운 비용 효율성을 보여줍니다.”
Mike Wang
백엔드 개발자
“Qwen3는 엄청난 도약입니다. 사고 변형이 이전 모델로는 처리할 수 없었던 복잡한 쿼리를 해결합니다.”
Emily Zhou
AI 연구원
“최고의 중영 번역 API입니다. Qwen-MT의 문맥과 관용구 이해력이 놀랍도록 뛰어납니다.”
David Liu
로컬라이제이션 매니저
qwen3.8-max 및 Qwen 모델 제품군 연동 세부 정보
Qwen 제품군 페이지이며 qwen3.8-max를 주요 모델로 다룹니다. 다른 Qwen 모델은 한도, 엔드포인트, 기능이 다를 수 있습니다.
일반 대화와 PDF 입력에는 Chat Completions를 사용합니다. 웹 검색, 웹 추출, 코드 실행, 이미지 검색 같은 내장 도구에는 Responses API를 사용합니다.
OpenAI SDK 연동을 지원하지만 모든 기본 동작이 같다고 가정하면 안 됩니다. Chat Completions의 기본 스트리밍 동작이 다르므로 stream을 명시적으로 전달하세요.
qwen3.8-max에서는 추론이 필수이며 끌 수 없습니다. 추론 토큰은 출력 토큰 사용량과 요금에 포함됩니다.
qwen3.8-max는 최대 983,616개 입력 토큰과 131,072개 출력 토큰을 지원합니다.
가격 영역에서 적용 가능한 입력, 출력, 캐시 및 도구의 현재 가격을 동적으로 불러옵니다. 모델은 암시적 캐시와 명시적 캐시를 모두 지원합니다.
네. Qwen API는 100만 토큰 단위로 과금됩니다. 이 페이지의 가격표에는 모든 사양이 골드 회원 가격(20% 할인)으로 표시됩니다. 플래티넘·다이아몬드 회원은 최대 28%까지 더 절약할 수 있습니다. 성공한 요청에 대해서만 비용이 청구됩니다.
APIMart에 가입한 뒤 대시보드의 API Keys 페이지에서 키를 생성하세요. 하나의 키로 Alibaba Qwen API를 포함한 플랫폼의 모든 모델을 호출할 수 있으며, 구독 없이 사용한 만큼만 결제합니다.
APIMart API 키로 OpenAI 호환 Chat Completions 엔드포인트를 호출하고 모델을 qwen3.8-max로 지정하세요. 웹 검색 같은 내장 도구가 필요하면 Responses API를 사용하세요. 전체 파라미터와 코드 예제는 APIMart 문서(docs.apimart.ai)에서 확인할 수 있습니다.
페이지 오른쪽 하단의 실시간 채팅, [email protected] 이메일, 또는 Discord 커뮤니티를 통해 문의하실 수 있습니다. 최대한 빠르게 답변드리겠습니다.
같은 카테고리의 다른 모델을 탐색하세요.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.