Kimi+ 会员限时特惠
Kimi K3 · 15 天免费体验
2.8T 前沿模型 · 100 万 token 上下文 · 深度研究
免费 ¥199 / 15 天
  • Kimi K3 无限畅聊:2.8T 参数前沿模型
  • 100 万 token 上下文,超长文档轻松解析
  • Deep Research 深度研究,多格式专业报告
  • Agent Swarm 智能体集群,并行处理任务
  • AI Slides · Sheets · Docs 咨询级办公产出
立即开启 15 天免费体验
Skip to content

在 Hermes Agent 中使用

Hermes Agent 是 Nous Research 开源的自我改进型 AI Agent,内置学习闭环,支持终端、Telegram、Discord 等多种入口。本文介绍如何在 Hermes Agent 中接入 Kimi Code 会员,使用 Kimi 提供的模型推理能力。

准备工作

开始前,请完成以下准备工作。安装和账号相关操作请按照对应的官方指引完成,本文不再展开。

第一步:选择 Kimi Coding Plan 和模型

在终端输入下列指令,运行模型配置向导:

sh
hermes model

在一级菜单选择 Kimi / Moonshot

在一级菜单选择 Kimi / Moonshot

在二级菜单选择 Kimi / Kimi Coding Plan,然后在掩码输入框中粘贴会员 API Key,无需手动填写 Base URL。

在二级菜单选择 Kimi / Kimi Coding Plan

选择默认模型时,向导会列出当前 Key 可用的模型:

向导列出当前 Key 可用的模型

注意:列表中的 kimi-k3 和配置中使用的 k3 是同一个模型

模型上新推荐

K2.8 Preview 现已全量上线 Kimi Code,kimi-for-coding 直接升级、无需修改配置:综合性能接近 K3,支持 low / high / max 三档思考程度与最高 1M 上下文。详见 最新动态

先了解自己的会员档位,再根据下表选择合适的模型,详见 会员权益

会员档位可用模型上下文窗口
Go(新套餐)无 coding 额度
Andante(老套餐)kimi-for-coding1048576
Plus / Moderatok3
k3-256k
kimi-for-coding
k3262144
k3-256k262144
kimi-for-coding1048576
Pro 及以上 / Allegretto 及以上k3
k3-256k
kimi-for-coding
kimi-for-coding-highspeed
k31048576
k3-256k262144
kimi-for-coding1048576
kimi-for-coding-highspeed262144

注意:列表中的 kimi-k3 和配置中使用的 k3 是同一个模型,同时列表里没有 k3-256k,如需使用,选择 Enter custom model name 手动输入 k3-256k,不要加任何前缀。使用超出权限的模型和上下文会触发报错。

选择 Enter custom model name 手动输入模型名

第二步:写入 K3 完整配置

运行:

sh
hermes config edit

hermes config edit 只是用默认终端编辑器打开 ~/.hermes/config.yaml。不习惯 nano/vim 的话,也可以直接用 VS Code 等任意编辑器打开这个文件修改,效果相同。

yaml
custom_providers:
  - name: kimi-coding-plan
    base_url: https://api.kimi.com/coding/v1
    key_env: KIMI_API_KEY
    api_mode: chat_completions
    model: k3-256k
    extra_body:
      reasoning_effort: high
    models:
      k3-256k:
        context_length: 262144
        supports_vision: true

model:
  provider: custom:kimi-coding-plan
  default: k3-256k
  context_length: 262144
  supports_vision: true

agent:
  reasoning_effort: high

auxiliary:
  vision:
    provider: main
    model: k3-256k
    extra_body:
      reasoning_effort: high

编辑完成后保存退��(nano 按 Ctrl+O 回车保存、Ctrl+X 退出;vim 输入 :wq;VS Code 直接保存即可)。

代码块中几个关键字段的说明:

  • reasoning_effort:推理强度,这里显式设为 high。支持 low / high / max,默认 high,映射规则见 模型配置
  • context_lengthsupports_vision:启用 256K 上下文和原生图片理解;auxiliary 区域让图片分析复用同一个主 Provider
  • key_env:对应的 KIMI_API_KEY 就是第一步在向导中粘贴的会员 Key,无需重复配置
  • base_url:只填到 /coding/v1,Hermes 会自动追加 /chat/completions,不要把完整请求地址写进去

说明

如需 1M 上下文的 k3(Allegretto / Pro 及以上档位可用),把上面配置中的 k3-256k 全部替换为 k3,并将两处 context_length 改为 1048576 即可。Moderato / Plus 档位调用 k3 时上下文上限同样为 256K,无需修改。

第三步:启用视频分析

Hermes Agent 内置官方视频分析工具,启用一次即可:

sh
hermes tools enable video

启用后,Hermes 可以调用官方 video_analyze 工具。对于本地视频,该工具会读取完整文件,编码为 data:video/...;base64,...,再以 video_url 内容块发送给模型,不会先在本地使用 FFmpeg 抽帧。

之后在对话中提供视频的绝对路径,并明确要求调用 video_analyze,无需使用 /video 命令:

text