La famille Qwen couvre les usages généraux et multimodaux. Cette page met en avant qwen3.8-max, avec jusqu’à 983 616 tokens d’entrée, 131 072 tokens de sortie, un raisonnement obligatoire, le cache et les outils intégrés de la Responses API.
À quoi pensez-vous ?
Demandez à APIMart
qwen3.8-max-0902
Tarification transparente, sans frais cachés. Payez uniquement ce que vous utilisez.
Par million de tokens
| Type de tarif | Prix OrPrix actuel | Prix Platine | Prix Diamant | Prix officiel | Votre économie |
|---|---|---|---|---|---|
| Entrée | 13.7143~$1.3714 | 13.0286~$1.3029 | 12.3429~$1.2343 | 17.1429~$1.7143 | 20% |
| Entrée en cache | 1.7143~$0.1714 | 1.6286~$0.1629 | 1.5429~$0.1543 | 2.1429~$0.2143 | 20% |
| Entrée mise en cache explicite | 1.1429~$0.1143 | 1.0857~$0.1086 | 1.0286~$0.1029 | 1.4286~$0.1429 | 20% |
| Écriture en cache | 17.1429~$1.7143 | 16.2857~$1.6286 | 15.4286~$1.5429 | 21.4286~$2.1429 | 20% |
| Sortie | 41.1429~$4.1143 | 39.0857~$3.9086 | 37.0286~$3.7029 | 51.4286~$5.1429 | 20% |
Créez des applications de raisonnement à contexte long avec qwen3.8-max. Utilisez Chat Completions pour les conversations et les PDF, ou la Responses API pour les outils Web, d’extraction, d’exécution de code et de recherche d’images.
50K+
Utilisateurs actifs
99.9%
Disponibilité
2x
Plus rapide
70%
Économies
Comportement des endpoints, limites de contexte, raisonnement, cache et outils à connaître avant l’intégration
Choisissez l’endpoint adapté à chaque flux de contexte long, de document ou assisté par des outils
Choisissez clairement le modèle et l’endpoint avant votre première requête
Créez un compte APIMart et ajoutez un solde pour l’utilisation de l’API.
Générez une clé API pour authentifier vos requêtes Qwen.
Définissez qwen3.8-max comme modèle. Utilisez Chat Completions pour le chat ou les PDF, Responses pour les outils intégrés et définissez stream explicitement pour le Chat.
Ce que disent les développeurs de notre API Qwen
“Qwen-Max est notre référence pour la génération de contenu en chinois. La qualité linguistique est inégalée.”
Wei Zhang
Responsable de contenu
“Qwen-Coder gère magnifiquement notre pipeline de revue de code. Excellent équilibre entre vitesse et précision.”
Alex Chen
Responsable d'ingénierie
“Le modèle Qwen-VL lit les documents et formulaires chinois avec une précision impressionnante. Cela nous a épargné des mois de développement.”
Sarah Li
Cheffe de produit
“Qwen-Turbo est incroyablement rentable pour notre application de chat à haut volume.”
Mike Wang
Développeur backend
“Qwen3 est un énorme bond en avant. Les variantes thinking gèrent des requêtes complexes que nos modèles précédents ne pouvaient pas traiter.”
Emily Zhou
Chercheuse en IA
“La meilleure API de traduction chinois-anglais que nous ayons trouvée. Qwen-MT comprend le contexte et les expressions idiomatiques remarquablement bien.”
David Liu
Responsable de localisation
Détails d’intégration de qwen3.8-max et de la famille de modèles Qwen
Il s’agit d’une page sur la famille Qwen qui met en avant qwen3.8-max. Les autres modèles Qwen peuvent avoir des limites, endpoints et fonctionnalités différents.
Utilisez Chat Completions pour les conversations classiques et les entrées PDF. Utilisez la Responses API pour les outils intégrés tels que la recherche Web, l’extraction Web, l’exécution de code et la recherche d’images.
L’interface permet l’intégration avec le SDK OpenAI, mais tous les réglages par défaut ne sont pas identiques. Pour Chat Completions, transmettez stream explicitement, car son comportement par défaut diffère.
Le raisonnement est obligatoire avec qwen3.8-max et ne peut pas être désactivé. Ses tokens comptent dans l’usage et la facturation des tokens de sortie.
qwen3.8-max accepte jusqu’à 983 616 tokens d’entrée et prend en charge jusqu’à 131 072 tokens de sortie.
La zone de tarifs charge dynamiquement les prix actuels du modèle, notamment les coûts applicables d’entrée, de sortie, de cache et d’outils. Le modèle prend en charge le cache implicite et explicite.
Oui. L'API Qwen est facturée par million de tokens. Le tableau des prix de cette page liste toutes les configurations au tarif membre Or, soit 20 % de réduction. Les membres Platine et Diamant économisent encore plus, jusqu'à 28 %. Vous ne payez que les requêtes réussies.
Inscrivez-vous sur APIMart, ouvrez la page API Keys de votre tableau de bord et créez une clé. La même clé permet d'appeler l'API Alibaba Qwen et tous les autres modèles de la plateforme, avec un paiement à l'usage et sans abonnement.
Appelez l'endpoint Chat Completions compatible OpenAI avec votre clé API APIMart et le modèle qwen3.8-max. Pour les outils intégrés comme la recherche web, utilisez plutôt la Responses API. Tous les paramètres et des exemples de code sont disponibles dans la documentation APIMart (docs.apimart.ai).
Vous pouvez nous joindre via le chat en direct en bas à droite de la page, nous envoyer un e-mail à [email protected], ou rejoindre notre communauté Discord. Notre équipe vous répondra dans les plus brefs délais.
Découvrez d'autres modèles de la même catégorie.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.