Семейство Qwen охватывает универсальные и мультимодальные задачи. Эта страница посвящена прежде всего qwen3.8-max: до 983 616 входных и 131 072 выходных токенов, обязательное рассуждение, кеширование и встроенные инструменты Responses API.
О чем вы думаете?
Спросите APIMart
qwen3.8-max-0902
Прозрачные цены без скрытых комиссий. Платите только за то, что используете.
За 1 млн токенов
| Тип тарифа | Золотая ценаТекущая цена | Платиновая цена | Бриллиантовая цена | Официальная цена | Ваша экономия |
|---|---|---|---|---|---|
| Ввод | 13.7143~$1.3714 | 13.0286~$1.3029 | 12.3429~$1.2343 | 17.1429~$1.7143 | 20% |
| Кэшированный ввод | 1.7143~$0.1714 | 1.6286~$0.1629 | 1.5429~$0.1543 | 2.1429~$0.2143 | 20% |
| Явно кэшированный ввод | 1.1429~$0.1143 | 1.0857~$0.1086 | 1.0286~$0.1029 | 1.4286~$0.1429 | 20% |
| Запись в кэш | 17.1429~$1.7143 | 16.2857~$1.6286 | 15.4286~$1.5429 | 21.4286~$2.1429 | 20% |
| Вывод | 41.1429~$4.1143 | 39.0857~$3.9086 | 37.0286~$3.7029 | 51.4286~$5.1429 | 20% |
Создавайте приложения с длинным контекстом и рассуждением на qwen3.8-max. Для диалогов и PDF используйте Chat Completions, а для веб-поиска, извлечения, выполнения кода и поиска изображений — Responses API.
50K+
Активные пользователи
99.9%
Время работы
2x
Быстрее
70%
Экономия
Поведение эндпоинтов, лимиты контекста, рассуждение, кеш и инструменты, важные для интеграции
Выберите подходящий эндпоинт для длинного контекста, документов или сценариев с инструментами
Осознанно выберите модель и эндпоинт перед первым запросом
Создайте аккаунт APIMart и пополните баланс для использования API.
Создайте API-ключ для аутентифицированных запросов к Qwen.
Укажите модель qwen3.8-max. Для чата или PDF используйте Chat Completions, для встроенных инструментов — Responses, а в Chat-запросах явно задавайте stream.
Что разработчики говорят о Qwen API
“Qwen-Max — наш основной инструмент для генерации китайского контента. Качество языка непревзойдённое.”
Wei Zhang
Руководитель контента
“Qwen-Coder отлично справляется с нашим пайплайном ревью кода. Прекрасный баланс скорости и точности.”
Alex Chen
Инженерный менеджер
“Модель Qwen-VL читает китайские документы и формы с впечатляющей точностью. Сэкономила нам месяцы разработки.”
Sarah Li
Продакт-менеджер
“Qwen-Turbo невероятно выгоден для нашего приложения с высоким объёмом чатов.”
Mike Wang
Бэкенд-разработчик
“Qwen3 — огромный шаг вперёд. Варианты с мышлением решают сложные запросы, с которыми предыдущие модели не справлялись.”
Emily Zhou
AI-исследователь
“Лучший API для китайско-английского перевода. Qwen-MT замечательно понимает контекст и идиомы.”
David Liu
Менеджер по локализации
Подробности интеграции qwen3.8-max и семейства моделей Qwen
Это страница семейства Qwen, где основной моделью является qwen3.8-max. У других моделей Qwen могут отличаться лимиты, эндпоинты и возможности.
Используйте Chat Completions для обычных диалогов и PDF. Responses API предназначен для встроенных инструментов: веб-поиска, веб-извлечения, выполнения кода и поиска изображений.
Интерфейс поддерживает интеграцию с OpenAI SDK, но не все значения по умолчанию совпадают. В Chat Completions передавайте stream явно, поскольку поведение по умолчанию отличается.
Для qwen3.8-max рассуждение обязательно, его нельзя отключить. Токены рассуждения учитываются в расходе и оплате выходных токенов.
qwen3.8-max принимает до 983 616 входных токенов и поддерживает до 131 072 выходных токенов.
Блок цен динамически загружает актуальные цены модели, включая применимые расходы на ввод, вывод, кеш и инструменты. Модель поддерживает неявный и явный кеш.
Да. Qwen API тарифицируется за миллион токенов. В таблице цен на этой странице указаны все конфигурации по цене Золотого уровня — со скидкой 20%. Платиновый и Бриллиантовый уровни экономят ещё больше — до 28%. Оплачиваются только успешные запросы.
Зарегистрируйтесь в APIMart, откройте страницу API Keys в личном кабинете и создайте ключ. Один и тот же ключ подходит для Alibaba Qwen API и всех остальных моделей платформы: оплата по факту использования, без подписки.
Вызовите OpenAI-совместимый эндпоинт Chat Completions с вашим API-ключом APIMart, указав model = qwen3.8-max. Для встроенных инструментов, например веб-поиска, используйте Responses API. Полные параметры и примеры кода — в документации APIMart (docs.apimart.ai).
Вы можете обратиться к нам через чат в правом нижнем углу страницы, написать на [email protected] или присоединиться к нашему сообществу в Discord. Наша команда ответит вам как можно скорее.
Откройте для себя другие модели в той же категории.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.