Тарифы API
Тарификация Kimi API зависит от расхода токенов; стоимость различается по моделям и функциям.
Основы тарификации
- Оплата за токены: в каждом вызове API отдельно учитываются входные и выходные токены
- Единица измерения токенов: 1M = 1,000,000 токенов
- Цена зависит от модели: чем шире возможности модели, тем выше стоимость за токен — выбирайте модель, которая лучше всего подходит для вашей задачи
Плата за дополнительные функции
| Функция | Дополнительная плата |
|---|---|
| Web Search | $0.004 за вызов (не зависит от расхода токенов) |
Кэширование контекста
Кэширование контекста позволяет кэшировать часто используемый контекст — например, системные подсказки и справочные документы. Токены, найденные в кэше, тарифицируются со скидкой, что снижает расходы при повторном использовании одного и того же контекста.
Подробные цены на кэширование контекста приведены в официальной документации.
Подробные тарифы
Полную таблицу цен по моделям и правила тарификации см. здесь:
Перейдите на platform.kimi.ai/docs/pricing/chat
Как снизить расходы
- Задавайте параметр
max_tokensс учетом задачи, чтобы не получать неоправданно длинные ответы - Используйте кэширование контекста для повторяющихся системных подсказок и контекста
- Подбирайте модель под сложность задачи — для простых сценариев используйте легкие модели
- Оптимизируйте подсказки, чтобы сократить лишние входные токены