Keluarga Qwen mencakup beban kerja umum dan multimodal. Halaman ini menyoroti qwen3.8-max dengan hingga 983.616 token input, 131.072 token output, penalaran wajib, cache, dan alat bawaan melalui Responses API.
Apa yang ada di pikiran Anda?
Tanya APIMart
qwen3.8-max-0902
Harga transparan tanpa biaya tersembunyi. Bayar hanya untuk yang Anda gunakan.
Per 1 juta token
| Jenis tarif | Harga GoldHarga saat ini | Harga Platinum | Harga Diamond | Harga resmi | Penghematan Anda |
|---|---|---|---|---|---|
| Input | 13.7143~$1.3714 | 13.0286~$1.3029 | 12.3429~$1.2343 | 17.1429~$1.7143 | 20% |
| Input cache | 1.7143~$0.1714 | 1.6286~$0.1629 | 1.5429~$0.1543 | 2.1429~$0.2143 | 20% |
| Input cache eksplisit | 1.1429~$0.1143 | 1.0857~$0.1086 | 1.0286~$0.1029 | 1.4286~$0.1429 | 20% |
| Penulisan cache | 17.1429~$1.7143 | 16.2857~$1.6286 | 15.4286~$1.5429 | 21.4286~$2.1429 | 20% |
| Output | 41.1429~$4.1143 | 39.0857~$3.9086 | 37.0286~$3.7029 | 51.4286~$5.1429 | 20% |
Bangun aplikasi penalaran berkonteks panjang dengan qwen3.8-max. Gunakan Chat Completions untuk percakapan dan PDF, atau Responses API untuk alat web, ekstraksi, eksekusi kode, dan pencarian gambar.
50K+
Pengguna Aktif
99.9%
Waktu Aktif
2x
Lebih Cepat
70%
Penghematan Biaya
Perilaku endpoint, batas konteks, penalaran, cache, dan alat yang perlu diketahui sebelum integrasi
Pilih endpoint yang sesuai untuk alur konteks panjang, dokumen, atau bantuan alat
Pilih model dan endpoint dengan jelas sebelum mengirim permintaan pertama
Buat akun APIMart dan tambah saldo untuk penggunaan API.
Buat API key untuk permintaan Qwen yang terautentikasi.
Atur model ke qwen3.8-max. Gunakan Chat Completions untuk chat atau PDF, Responses untuk alat bawaan, dan tetapkan stream secara eksplisit pada permintaan Chat.
Apa kata developer tentang Qwen API kami
“Qwen-Max adalah andalan kami untuk pembuatan konten Mandarin. Kualitas bahasanya tak tertandingi.”
Wei Zhang
Pemimpin Konten
“Qwen-Coder menangani pipeline code review kami dengan indah. Keseimbangan yang bagus antara kecepatan dan akurasi.”
Alex Chen
Manajer Engineering
“Model Qwen-VL membaca dokumen dan formulir Mandarin dengan akurasi mengesankan. Menghemat berbulan-bulan pengembangan.”
Sarah Li
Manajer Produk
“Qwen-Turbo sangat hemat biaya untuk aplikasi chat volume tinggi kami.”
Mike Wang
Pengembang Backend
“Qwen3 adalah lompatan besar ke depan. Varian thinking menangani kueri kompleks yang tidak bisa ditangani model kami sebelumnya.”
Emily Zhou
Peneliti AI
“API terjemahan Mandarin-Inggris terbaik yang kami temukan. Qwen-MT memahami konteks dan idiom dengan sangat baik.”
David Liu
Manajer Pelokalan
Detail integrasi untuk qwen3.8-max dan keluarga model Qwen
Ini adalah halaman keluarga Qwen dengan qwen3.8-max sebagai model utama. Model Qwen lain dapat memiliki batas, endpoint, dan kemampuan berbeda.
Gunakan Chat Completions untuk percakapan biasa dan input PDF. Gunakan Responses API untuk alat bawaan seperti pencarian web, ekstraksi web, eksekusi kode, dan pencarian gambar.
Antarmukanya mendukung integrasi OpenAI SDK, tetapi jangan menganggap semua default identik. Untuk Chat Completions, kirim stream secara eksplisit karena perilaku defaultnya berbeda.
Penalaran wajib untuk qwen3.8-max dan tidak dapat dinonaktifkan. Token penalaran dihitung sebagai penggunaan dan biaya token output.
qwen3.8-max menerima hingga 983.616 token input dan mendukung hingga 131.072 token output.
Bagian harga memuat harga model terkini secara dinamis, termasuk biaya input, output, cache, dan alat yang berlaku. Model mendukung cache implisit dan eksplisit.
Ya. Qwen API ditagih per satu juta token. Tabel harga di halaman ini mencantumkan semua spesifikasi dengan harga member Gold, diskon 20%. Member Platinum dan Diamond lebih hemat lagi, hingga 28%. Anda hanya membayar permintaan yang berhasil.
Daftar di APIMart, buka halaman API Keys di dashboard, lalu buat key. Key yang sama bisa memanggil Alibaba Qwen API dan semua model lain di platform, dengan sistem bayar sesuai pemakaian tanpa langganan.
Panggil endpoint Chat Completions yang kompatibel dengan OpenAI menggunakan API key APIMart Anda dan model qwen3.8-max. Untuk tool bawaan seperti pencarian web, gunakan Responses API. Parameter lengkap dan contoh kode ada di dokumentasi APIMart (docs.apimart.ai).
Anda dapat menghubungi kami melalui live chat di pojok kanan bawah halaman, email ke [email protected], atau bergabung dengan komunitas Discord kami. Tim kami akan merespons Anda secepat mungkin.
Jelajahi lebih banyak model dalam kategori yang sama.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.