Веб-поиск Google
~$14
Плата взимается только при включённом веб-поиске; предоплата корректируется по фактическому использованию.
Число запросов для предоплаты: 1
Семейство моделей Google Gemini — от сверхбыстрого Flash, например Gemini 3.8 Flash API, до мощного Pro, с огромными контекстными окнами и нативным мультимодальным пониманием.
О чем вы думаете?
Спросите APIMart
gemini-3.8-flash
Прозрачные цены без скрытых комиссий. Платите только за то, что используете.
За 1 млн токенов
| Тип тарифа | Золотая ценаТекущая цена | Платиновая цена | Бриллиантовая цена | Официальная цена | Ваша экономия |
|---|---|---|---|---|---|
| Ввод | 6~$0.6 | 5.7~$0.57 | 5.4~$0.54 | 7.5~$0.75 | 20% |
| Кэшированный ввод | 0.6~$0.06 | 0.57~$0.057 | 0.54~$0.054 | 0.75~$0.075 | 20% |
| Вывод | 30~$3 | 28.5~$2.85 | 27~$2.7 | 37.5~$3.75 | 20% |
~$14
Плата взимается только при включённом веб-поиске; предоплата корректируется по фактическому использованию.
Число запросов для предоплаты: 1
~$0.0833
~$1
При создании явного кэша плата взимается один раз с учётом числа токенов и выбранного TTL.
Доступ к полной линейке Gemini — от новейшей Gemini 3.8 Flash и Flash Lite до Gemini 3.1 Pro. Лидирующие в отрасли контекстные окна на 1M+ токенов, нативные мультимодальные возможности и продвинутые режимы мышления.
50K+
Активные пользователи
99.9%
Время работы
2x
Быстрее
70%
Экономия
Почему Gemini — лидер среди мультимодальных ИИ
Как команды используют модели Gemini в продакшене
Начните использовать модели Google за несколько минут
Создайте бесплатный аккаунт APIMart и пополните баланс.
Сгенерируйте API-ключ для программного доступа к моделям Gemini.
Используйте песочницу выше или интегрируйте через OpenAI-совместимый API.
Что разработчики говорят о нашем Gemini API
“Контекстное окно на 1 млн токенов — это революция. Мы обрабатываем целые кодовые базы за один вызов для нашего инструмента код-ревью.”
Alex Chen
Руководитель разработки
“Gemini Flash невероятно быстрый и доступный. Идеален для нашего сервиса перевода в реальном времени.”
Sarah Li
Продакт-менеджер
“Мультимодальные возможности позволили нам построить единый пайплайн для текста, изображений и документов.”
Mike Wang
ML-инженер
“Gemini 2.5 Pro Thinking — наш основной инструмент для сложных аналитических задач. Качество рассуждений отличное.”
Emily Zhou
Дата-сайентист
“Gemini Thinking отлично подходит для нашего исследовательского продукта. Он пошагово анализирует сложную информацию.”
David Liu
Старший разработчик
“Мы используем Flash Lite для массовой суммаризации. Экономия по сравнению с GPT-4 значительная.”
Lisa Zhang
Платформенный инженер
Распространённые вопросы об использовании Gemini API
Мы предлагаем новейшие Gemini 3.8 Flash, 3.7 Flash, 3.6 Flash, 3.5 Flash и 3.5 Flash Lite, а также Gemini 3.1 Pro Preview, Gemini 3 Pro Preview и варианты с мышлением. Более ранние Gemini 2.5 Pro/Flash и 2.0 Flash по-прежнему доступны.
Варианты с мышлением используют расширенную цепочку рассуждений. Вы можете управлять бюджетом мышления (от 128 до 3000 токенов).
Оплата за токены (ввод + вывод). Flash Lite — самый доступный, Flash — средний, Pro — премиум.
Да. Модели Gemini используют стандартный формат chat completions и работают с OpenAI SDK.
Да. Данные API не сохраняются и не используются для обучения. Все запросы зашифрованы.
Gemini 3.5 Flash Lite для массовых и бюджетных задач. Gemini 3.8 Flash для сбалансированной производительности. Gemini 3.1 Pro для максимального качества. Для сложных рассуждений добавьте режим мышления.
Да. Google Gemini API тарифицируется за миллион токенов, при этом входные и выходные токены оплачиваются отдельно. В таблице цен на этой странице указаны все модели и конфигурации, а показанные цены — это цены для участников Gold (скидка 20%). Участники Platinum и Diamond экономят ещё больше — до 28%, и вы платите только за успешные запросы.
Вызовы Gemini 3 API, например Gemini 3 Pro Preview или Gemini 3.8 Flash, тарифицируются за миллион входных и выходных токенов, и у каждой модели свой тариф: Flash Lite — самый доступный уровень, Pro — премиальный. Актуальные цены Gemini API смотрите в таблице цен на этой странице.
Зарегистрируйтесь в APIMart, откройте страницу API Keys и создайте ключ. Один и тот же ключ работает с Gemini API и всеми остальными моделями APIMart: оплата по факту использования, без подписки.
Модели Gemini на APIMart используют OpenAI-совместимый формат Chat Completions. Используйте ключ APIMart, выберите модель Gemini, например Gemini 3 Pro или Gemini 3.8 Flash, и отправляйте сообщения через OpenAI SDK или любой HTTP-клиент. ID моделей, параметры и примеры кода — в документации APIMart (docs.apimart.ai).
Нет. APIMart не предоставляет бесплатной квоты для Gemini API. Модели Gemini оплачиваются по факту использования токенов, списание только за успешные запросы, а участники программы лояльности экономят 20–28% на всех ценах.
Вы можете обратиться к нам через чат в правом нижнем углу страницы, написать на [email protected] или присоединиться к нашему сообществу в Discord. Наша команда ответит вам как можно скорее.
Откройте для себя другие модели в той же категории.
Claude Haiku 5.5
Claude Haiku 5.5 API on APIMart delivers fast, cost-efficient AI, offering responsive conversations, capable coding assistance, and reliable performance for high-volume workflows.
Kimi K3
Kimi-K3 is a next-generation large language model launched by Moonshot AI. It features ultra-long context, multimodal understanding, and strong coding capabilities, making it suitable for complex reasoning, software development, knowledge analysis, and agent automation tasks.
Claude Opus 5
Claude Opus 5 is Anthropic’s next-generation flagship large language model, featuring enhanced capabilities in code development, complex reasoning, knowledge analysis, and agent execution, making it ideal for large-scale project development and professional work scenarios.
Gemini 3.5 Flash Lite
A lightweight multimodal model launched by Google that emphasizes low cost, low latency, and high throughput. It is suitable for document parsing, data extraction, structured output, and large-scale agent workflows, delivering faster response times while maintaining core reasoning capabilities.