何かお困りですか?
APIMartに質問
qwen3.8-max-0902
隠れた費用のない透明な料金体系。使った分だけお支払い。
100万トークンあたり
| 料金項目 | ゴールド価格現在の価格 | プラチナ価格 | ダイヤモンド価格 | 公式価格 | 割引率 |
|---|---|---|---|---|---|
| 入力 | 13.7143~$1.3714 | 13.0286~$1.3029 | 12.3429~$1.2343 | 17.1429~$1.7143 | 20% |
| キャッシュ済み入力 | 1.7143~$0.1714 | 1.6286~$0.1629 | 1.5429~$0.1543 | 2.1429~$0.2143 | 20% |
| 明示的なキャッシュ入力 | 1.1429~$0.1143 | 1.0857~$0.1086 | 1.0286~$0.1029 | 1.4286~$0.1429 | 20% |
| キャッシュ書き込み | 17.1429~$1.7143 | 16.2857~$1.6286 | 15.4286~$1.5429 | 21.4286~$2.1429 | 20% |
| 出力 | 41.1429~$4.1143 | 39.0857~$3.9086 | 37.0286~$3.7029 | 51.4286~$5.1429 | 20% |
qwen3.8-max で長いコンテキストを使う推論アプリを構築できます。通常の会話と PDF には Chat Completions、Web、抽出、コード実行、画像検索ツールには Responses API を使用します。
50K+
アクティブユーザー
99.9%
稼働率
2x
高速化
70%
コスト削減
連携前に確認したいエンドポイントの違い、コンテキスト上限、推論、キャッシュ、ツール
長いコンテキスト、文書、ツール支援の各用途に合うエンドポイントを選択
最初のリクエスト前にモデルとエンドポイントを明確に選択
APIMart アカウントを作成し、API 利用残高を追加します。
Qwen リクエストの認証に使う API キーを発行します。
モデルを qwen3.8-max に設定します。チャットや PDF には Chat Completions、組み込みツールには Responses を使い、Chat では stream を明示します。
開発者が語る Qwen API の評価
“Qwen-Max は中国語コンテンツ生成の定番です。言語品質は他の追随を許しません。”
Wei Zhang
コンテンツリーダー
“Qwen-Coder がコードレビューパイプラインを見事に処理してくれます。速度と精度のバランスが素晴らしい。”
Alex Chen
エンジニアリングマネージャー
“Qwen-VL モデルの中国語文書・フォーム読取精度は驚異的です。開発期間を数ヶ月短縮できました。”
Sarah Li
プロダクトマネージャー
“Qwen-Turbo は大量処理のチャットアプリケーションで抜群のコストパフォーマンスです。”
Mike Wang
バックエンド開発者
“Qwen3 は大きな飛躍です。思考バリアントが以前のモデルでは処理できなかった複雑なクエリを解決します。”
Emily Zhou
AI リサーチャー
“最高の中英翻訳 API です。Qwen-MT の文脈や慣用句の理解力は驚くほど優れています。”
David Liu
ローカライズマネージャー
qwen3.8-max と Qwen モデルファミリーの連携詳細
Qwen ファミリーのページですが、qwen3.8-max を中心に紹介しています。他の Qwen モデルでは上限、エンドポイント、機能が異なる場合があります。
通常の会話と PDF 入力には Chat Completions を使用します。Web 検索、Web 抽出、コード実行、画像検索などの組み込みツールには Responses API を使用します。
OpenAI SDK で連携できますが、すべての既定動作が同じとは限りません。Chat Completions では既定の動作が異なるため、stream を明示的に渡してください。
qwen3.8-max では推論が必須で、無効化できません。推論トークンは出力トークンの使用量と料金に算入されます。
qwen3.8-max は最大 983,616 入力トークンと 131,072 出力トークンに対応します。
料金欄では、該当する入力、出力、キャッシュ、ツールの現在価格を動的に読み込みます。暗黙キャッシュと明示キャッシュの両方に対応します。
はい。Qwen APIは100万トークン単位で課金されます。このページの料金表にはすべての仕様が掲載され、ゴールド会員価格(20%オフ)で表示されています。プラチナ・ダイヤモンド会員はさらにお得で、最大28%オフになります。課金は成功したリクエストのみです。
APIMartに登録し、ダッシュボードのAPI Keysページでキーを作成します。同じキーでAlibaba Qwen APIを含むプラットフォーム上のすべてのモデルを呼び出せます。従量課金で、サブスクリプションは不要です。
APIMartのAPIキーを使い、modelにqwen3.8-maxを指定してOpenAI互換のChat Completionsエンドポイントを呼び出します。Web検索などの組み込みツールを使う場合はResponses APIを利用してください。パラメータの詳細とコード例はAPIMartドキュメント(docs.apimart.ai)をご覧ください。
ページ右下のライブチャット、[email protected] へのメール、またはDiscordコミュニティからお問い合わせいただけます。チームができるだけ早くご対応いたします。
同じカテゴリの他のモデルを探す。
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.