Kimi 시작하기
채팅 상자에 질문을 입력하거나, 파일을 업로드하거나, 필요에 따라 모델을 전환할 수 있습니다. kimi.com을 열고 메시지를 보내 보세요. Kimi에게 인사를 건네는 것부터 시작해 보세요.
모델 선택
Kimi는 여러 모델을 제공합니다. 입력 상자 위의 모델 전환 버튼을 클릭해 전환할 수 있습니다.
| 모델 | 사고 강도 | 적합한 용도 |
|---|---|---|
| K2.6 | 표준 / 높음 | 더 빠른 응답이 필요한 빠른 대화와 Q&A |
| K3 | 낮음 / 높음 / 최대 | 채팅과 Agent 작업; 전반적으로 가장 뛰어난 성능 |
| K3 Swarm | 낮음 / 높음 / 최대 | 대규모 검색과 일괄 처리, 한 번에 완료 |
K2.6은 Chat에서 credit을 소모하지 않습니다(Kimi Work 안에서 K2.6 Agent로 사용할 때는 멤버십 credit을 소모합니다). K3와 K3 Swarm은 credit 기준으로 과금됩니다. 자세한 내용은 멤버십 혜택을 참고하세요.
Kimi K3 소개
Kimi K3는 현재 Kimi의 가장 강력한 모델입니다. 2.8조 개의 파라미터를 갖추고 Kimi Delta Attention(KDA)과 Attention Residuals를 기반으로 구축되었으며, 네이티브 비전과 100만 token 컨텍스트 창을 지원합니다. 세계 최초의 오픈 3T급 모델인 K3는 장기 코딩, 지식 작업, 추론 전반에서 최전선 수준의 지능을 목표로 설계되었으며, 코딩, 장기 실행, 폭넓은 일반 지능 작업에서 선도적인 성능을 보여 줍니다.
내장 도구
별도 설정 없이 바로 사용할 수 있습니다.
| 도구 | 설명 |
|---|---|
| Web Search | 최신 뉴스와 정보를 위한 실시간 웹 검색 |
| 가져오기 도구 | 특정 URL(웹페이지, 문서, 이미지 및 기타 온라인 리소스)에 직접 접근 |
| 이미지 검색 | 시각 콘텐츠를 빠르게 찾기 위한 텍스트-이미지 및 이미지-이미지 검색 |
| IPython | 데이터 분석과 시각화를 위한 Python 코드 실행 |
| 메모리 | 개인 취향과 습관을 기록하는 스마트 메모리 |
시각 및 멀티모달 기능
Kimi K3는 이미지, 동영상, 오피스 문서(PDF/Word/Excel)를 전 시나리오에서 이해할 수 있으며, 덧붙인 OCR이 아닌 네이티브 멀티모달 아키텍처를 사용합니다. 문서 내용을 직접 파싱하고 Excel 수식 작성, PPT 개요/VBA 코드 생성과 같은 중·고급 오피스 작업도 수행할 수 있습니다. 네이티브 비전과 100만 token 컨텍스트 창이 결합되어 더 길고 복잡한 멀티모달 자료도 처리할 수 있습니다.
멀티모달 입력 지원
- 이미지: PNG, JPEG, WebP, GIF 등(URL, Base64 또는 로컬 파일 업로드를 통해)
- 동영상: MP4 등(video_url 또는 이미지 프레임 시퀀스 + fps 파라미터를 통해)
- 문서: PDF, Word, Excel, TXT, Markdown 등
- 온라인 리소스: URL, 글 링크
- 이미지 검색: 이미지를 업로드해 관련 이미지나 유사 이미지를 검색
- 동영상 이해: 동영상 이해를 지원합니다. 화면 녹화를 분석하고 상호작용 로직을 재현할 수 있습니다.
- 비주얼 코딩: 스크린샷이나 화면 녹화를 업로드해 프런트엔드 코드(HTML/Vue/React 등)를 생성할 수 있으며, 디자인 목업에서 웹페이지를 자동으로 재현할 수 있습니다.
출력 형식
- 일반 텍스트 / 텍스트-이미지 혼합: 표준 대화형 답변
- Markdown: 제목, 목록, 표, 링크가 포함된 리치 텍스트
- 코드 블록: HTML/Vue/React/Python/JSON/Mermaid 등(언어 식별자 포함)
- JSON 구조화 데이터: 강제 JSON 모드 출력
- Mermaid 다이어그램: 플로차트, 시퀀스 다이어그램, 마인드맵 등
- LaTeX 수학 수식: 인라인 및 블록 수준 수학 표현식
- 듀얼 모드 출력(Thinking):
reasoning_content(사고 과정)와content(최종 답변)를 모두 반환 - 도구 호출 형식: Function Calling 표준 형식(개발자용)
중요 참고 사항
- 파일 출력: K3는
.pptx,.docx,.xlsx,.pdf와 같은 편집 가능한 문서와 그 밖의 복잡한 산출물을 처음부터 끝까지 생성할 수 있습니다. K2.6은 빠른 Q&A에 중점을 두며 텍스트(PPT 개요, Word 본문, 코드 등)만 출력합니다.
팁: 이미지, 오디오, 동영상을 생성하려면 "+" → Plugin을 클릭하고 해당 기능을 선택한 뒤 K3와 함께 사용하세요. 복잡한 편집 가능 문서를 만들거나 다단계 작업을 실행하려면 온전한 경험을 위해 K3 또는 K3 Swarm을 선택하는 것을 권장합니다.
세션과 대화 턴
"New Chat"을 클릭하는 것은 Kimi와 긴 대화를 새로 시작하는 것이라고 생각하면 됩니다.
| 개념 | 비유 | 기술적 정의 |
|---|---|---|
| 세션 | 처음부터 끝까지 이어지는 하나의 회의 | 시작과 끝이 분명한 완전한 채팅 과정 |
| 턴 | 한 번의 주고받기(사용자가 말하고 Kimi가 답함) | 사용자의 입력과 Kimi의 응답이 하나의 왕복을 이룸 |
주요 차이점
세션
- 연속 메모리: Kimi는 현재 채팅 안의 모든 컨텍스트를 기억합니다.
- 턴 간 컨텍스트: 각 답변은 이전 대화 내용을 다음 턴의 컨텍스트로 참조합니다.
- 명확한 경계: "New Chat" 클릭 = 새로 시작; 이전 컨텍스트가 지워집니다. 턴
- 누적 카운트: 턴 1, 턴 2, … 순서대로 추가됩니다.
- 제한된 메모리: 턴이 너무 많아지면(예: 50개 이상) Kimi가 이전 내용을 "잊을" 수 있습니다. 긴 글쓰기나 엄격한 요구사항이 있는 작업에서는 특히 그렇습니다.
- 컨텍스트 길이 제약: token 수에 의해 �한됩니다. 턴이 쌓이면 가장 앞의 내용이 압축될 수 있습니다.
예외 상황: 한 번의 질문과 답변으로 대화가 끝난다면 1턴 = 1세션입니다.
이 구분이 중요한 이유
하나의 세션 안에서는 새 질문이나 지시를 보낼 때마다 이전 모든 턴을 참고해 답변이 생성됩니다. 턴이 쌓이고 내용이 길어질수록 응답 품질은 서서히 낮아질 수 있습니다.
흔한 상황
상황 1: 주제 전환
- 잘못된 예: 30,000단어짜리 소설을 쓰던 세션에서 "세금 계산을 도와줘"라고 묻기
- 올바른 예: 세금 질문은 새 세션에서 시작하세요. Kimi가 소설 속 인물과 세금 개념을 혼동하지 않도록 할 수 있습니다. 상황 2: 긴 문서 처리
- 수십 턴이 지나면 Kimi가 처음에 정한 규칙이나 파일 요약을 "잊을" 수 있습니다.
- 해결 방법: 작업 중간에 능동적으로 요약을 요청하거나("지금까지의 계획을 요약해 줘"), 새 세션을 시작하세요. 상황 3: 제품 한계 이해
- 컨텍스트 길이 제한은 token으로 측정되지만, 일상적으로는 "턴 수"라고 생각하면 쉽습니다.
- "Start a new chat" 안내가 보이면 현재 세션의 턴이 너무 많다는 뜻입니다.
권장 사용법
작업마다 새 세션을 시작하세요: 에세이 작성, 조사, 디버깅처럼 서로 독립적인 작업은 컨텍스트 간섭을 피하기 위해 각각 별도의 세션에서 진행하는 것이 좋습니다.
긴 세션에서는 주기적으로 요약하세요: 20턴이 넘으면 데이터 손실을 막기 위해 Kimi에게 핵심 정보를 요약해 달라고 먼저 요청하세요.
민감한 정보는 즉시 정리하세요: 채팅 기록은 보관됩니다. 개인 정보를 다룬 뒤에는 세션 전체를 삭제하세요.