A família Qwen atende cargas gerais e multimodais. Esta página destaca o qwen3.8-max, com até 983.616 tokens de entrada, 131.072 tokens de saída, raciocínio obrigatório, cache e ferramentas integradas pela Responses API.
No que você está pensando?
Pergunte ao APIMart
qwen3.8-max-0902
Preços transparentes, sem taxas ocultas. Pague apenas pelo que usar.
Por 1 milhão de tokens
| Item de preço | Preço OuroPreço atual | Preço Platina | Preço Diamante | Preço oficial | Sua economia |
|---|---|---|---|---|---|
| Entrada | 13.7143~$1.3714 | 13.0286~$1.3029 | 12.3429~$1.2343 | 17.1429~$1.7143 | 20% |
| Entrada em cache | 1.7143~$0.1714 | 1.6286~$0.1629 | 1.5429~$0.1543 | 2.1429~$0.2143 | 20% |
| Entrada em cache explícita | 1.1429~$0.1143 | 1.0857~$0.1086 | 1.0286~$0.1029 | 1.4286~$0.1429 | 20% |
| Gravação em cache | 17.1429~$1.7143 | 16.2857~$1.6286 | 15.4286~$1.5429 | 21.4286~$2.1429 | 20% |
| Saída | 41.1429~$4.1143 | 39.0857~$3.9086 | 37.0286~$3.7029 | 51.4286~$5.1429 | 20% |
Crie aplicações de raciocínio com contexto longo usando o qwen3.8-max. Use Chat Completions para conversas e PDFs, ou a Responses API para ferramentas web, extração, execução de código e busca de imagens.
50K+
Usuários Ativos
99.9%
Tempo Ativo
2x
Mais Rápido
70%
Economia de Custos
Comportamento dos endpoints, limites de contexto, raciocínio, cache e ferramentas para conhecer antes da integração
Escolha o endpoint adequado para cada fluxo de contexto longo, documento ou ferramenta
Escolha claramente o modelo e o endpoint antes da primeira solicitação
Crie uma conta na APIMart e adicione saldo para usar a API.
Gere uma chave de API para autenticar solicitações ao Qwen.
Defina o modelo como qwen3.8-max. Use Chat Completions para chat ou PDF, Responses para ferramentas integradas e defina stream explicitamente nas solicitações de Chat.
O que os desenvolvedores dizem sobre nossa API Qwen
“O Qwen-Max é nossa escolha preferida para geração de conteúdo em chinês. A qualidade da linguagem é incomparável.”
Wei Zhang
Líder de Conteúdo
“O Qwen-Coder lida com nosso pipeline de revisão de código lindamente. Ótimo equilíbrio entre velocidade e precisão.”
Alex Chen
Gerente de Engenharia
“O modelo Qwen-VL lê documentos e formulários em chinês com precisão impressionante. Nos economizou meses de desenvolvimento.”
Sarah Li
Gerente de Produto
“O Qwen-Turbo tem um custo-benefício incrível para nossa aplicação de chat de alto volume.”
Mike Wang
Desenvolvedor Backend
“O Qwen3 é um grande salto adiante. As variantes thinking lidam com consultas complexas que nossos modelos anteriores não conseguiam.”
Emily Zhou
Pesquisador de IA
“Melhor API de tradução chinês-inglês que encontramos. O Qwen-MT entende contexto e expressões idiomáticas notavelmente bem.”
David Liu
Gerente de Localização
Detalhes de integração do qwen3.8-max e da família de modelos Qwen
Esta é uma página da família Qwen com destaque para o qwen3.8-max. Outros modelos Qwen podem ter limites, endpoints e recursos diferentes.
Use Chat Completions para conversas comuns e entradas PDF. Use a Responses API para ferramentas integradas, como busca web, extração web, execução de código e busca de imagens.
A interface permite integração com o SDK da OpenAI, mas nem todos os padrões são idênticos. Em Chat Completions, envie stream explicitamente porque o comportamento padrão é diferente.
O raciocínio é obrigatório no qwen3.8-max e não pode ser desativado. Seus tokens contam no uso e na cobrança de tokens de saída.
O qwen3.8-max aceita até 983.616 tokens de entrada e até 131.072 tokens de saída.
A seção de preços carrega dinamicamente os preços atuais do modelo, incluindo custos aplicáveis de entrada, saída, cache e ferramentas. O modelo aceita cache implícito e explícito.
Sim. A API Qwen é cobrada por milhão de tokens. A tabela de preços desta página lista todas as especificações com o preço de membro Ouro, 20% de desconto. Membros Platina e Diamante economizam ainda mais, até 28%. Você só paga pelas requisições bem-sucedidas.
Cadastre-se na APIMart, abra a página API Keys no painel e crie uma chave. A mesma chave chama a API Alibaba Qwen e todos os outros modelos da plataforma, com pagamento por uso e sem assinatura.
Chame o endpoint Chat Completions compatível com a OpenAI usando sua chave de API da APIMart e o modelo qwen3.8-max. Para ferramentas integradas, como busca na web, use a Responses API. Parâmetros completos e exemplos de código estão na documentação da APIMart (docs.apimart.ai).
Você pode nos contatar pelo chat ao vivo no canto inferior direito da página, enviar um e-mail para [email protected] ou entrar na nossa comunidade do Discord. Nossa equipe responderá o mais rápido possível.
Explore mais modelos da mesma categoria.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.