Тарифы API

Тарификация Kimi API зависит от расхода токенов; стоимость различается по моделям и функциям.

Основы тарификации

  • Оплата за токены: в каждом вызове API отдельно учитываются входные и выходные токены
  • Единица измерения токенов: 1M = 1,000,000 токенов
  • Цена зависит от модели: чем шире возможности модели, тем выше стоимость за токен — выбирайте модель, которая лучше всего подходит для вашей задачи

Плата за дополнительные функции

ФункцияДополнительная плата
Web Search$0.004 за вызов (не зависит от расхода токенов)

Кэширование контекста

Кэширование контекста позволяет кэшировать часто используемый контекст — например, системные подсказки и справочные документы. Токены, найденные в кэше, тарифицируются со скидкой, что снижает расходы при повторном использовании одного и того же контекста.

Подробные цены на кэширование контекста приведены в официальной документации.

Подробные тарифы

Полную таблицу цен по моделям и правила тарификации см. здесь:

Перейдите на platform.kimi.ai/docs/pricing/chat

Как снизить расходы

  • Задавайте параметр max_tokens с учетом задачи, чтобы не получать неоправданно длинные ответы
  • Используйте кэширование контекста для повторяющихся системных подсказок и контекста
  • Подбирайте модель под сложность задачи — для простых сценариев используйте легкие модели
  • Оптимизируйте подсказки, чтобы сократить лишние входные токены