Kimi 시작하기

채팅창에 질문을 입력하거나 파일을 업로드하고, 필요에 따라 모델을 전환할 수 있습니다. kimi.com을 열고 메시지를 보내 보세요. Kimi에게 인사를 건네면 됩니다.

Text

모델 선택

Kimi는 여러 모델을 제공합니다. 입력창 위의 모델 전환 버튼을 클릭해 전환하세요.

모델사고 강도적합한 용도
K2.6Standard / High빠른 응답으로 신속한 대화와 Q&A
K3Low / High / Max채팅과 Agent 작업 모두에 강하며, 전반적으로 가장 강력한 모델
K3 SwarmLow / High / Max대규모 검색과 일괄 처리를 한 번에 완료

K2.6은 크레딧을 차감하지 않으며, K3과 K3 Swarm은 크레딧 단위로 과금됩니다. 자세한 내용은 멤버십 혜택을 참고하세요.

Kimi K3 소개

Kimi K3은 현재 Kimi의 가장 강력한 모델로, 2.8조 개의 파라미터를 갖추고 Kimi Delta Attention(KDA)과 Attention Residuals를 기반으로 구축되었으며, 네이티브 비전100만 토큰 컨텍스트 창을 제공합니다. 세계 최초의 개방형 3T급 모델로서 K3은 장기 코딩, 지식 작업, 추론 전반의 프런티어 지능을 위해 설계되었으며, 코딩, 장기 실행, 폭넓은 일반 지능 작업에서 선도적인 성능을 달성합니다.

기본 제공 도구

별도 설정 없이 바로 사용할 수 있습니다.

도구설명
Web Search최신 뉴스와 정보를 실시간으로 검색하는 웹 검색
가져오기 도구특정 URL(웹페이지, 문서, 이미지 및 기타 온라인 리소스)에 직접 접근
이미지 검색텍스트-이미지 및 이미지-이미지 검색으로 시각 콘텐츠를 빠르게 찾기
IPython데이터 분석과 시각화를 위해 Python 코드 실행
메모리개인 선호와 습관을 기록하는 스마트 메모리

시각 및 멀티모달 기능

Kimi K3은 네이티브 멀티모달 아키텍처(덧붙인 OCR이 아님)를 사용해 이미지, 동영상, 오피스 문서(PDF/Word/Excel)를 다양한 상황에서 이해합니다. 문서 내용을 직접 파싱하고 Excel 수식 작성, PPT 개요 생성, VBA 코드 작성과 같은 중급~고급 오피스 작업을 수행할 수 있습니다. 네이티브 비전과 100만 토큰 컨텍스트 창을 결합해 더 길고 복잡한 멀티모달 자료도 처리할 수 있습니다.

멀티모달 입력 지원

  • 이미지: PNG, JPEG, WebP, GIF 등(URL, Base64 또는 로컬 파일 업로드)
  • 동영상: MP4 등(video_url 또는 이미지 프레임 시퀀스 + fps 매개변수)
  • 문서: PDF, Word, Excel, TXT, Markdown 등
  • 온라인 리소스: URL, 기사 링크
  • 이미지 검색: 이미지를 업로드해 관련 이미지나 유사 이미지를 검색
  • 동영상 이해: 동영상 이해를 지원하며, 화면 녹화를 분석하고 상호작용 로직을 재현할 수 있음
  • 시각 코딩: 스크린샷이나 화면 녹화를 업로드해 프런트엔드 코드(HTML/Vue/React 등)를 생성하고, 디자인 목업에서 웹페이지를 자동으로 재현할 수 있음

출력 형식

  • 일반 텍스트 / 텍스트-이미지 혼합: 표준 대화형 답변
  • Markdown: 제목, 목록, 표, 링크를 포함한 리치 텍스트
  • 코드 블록: HTML/Vue/React/Python/JSON/Mermaid 등(언어 식별자 포함)
  • JSON 구조화 데이터: 강제 JSON 모드 출력
  • Mermaid 다이어그램: 플로차트, 시퀀스 다이어그램, 마인드맵 등
  • LaTeX 수식: 인라인 및 블록 수준 수학 표현식
  • 듀얼 모드 출력(Thinking): reasoning_content(사고 과정)와 content(최종 답변)를 모두 반환
  • 도구 호출 형식: Function Calling 표준 형식(개발자용)

중요 참고 사항

  1. 파일 출력: K3은 .pptx, .docx, .xlsx, .pdf와 같은 편집 가능한 문서를 비롯한 복잡한 결과물을 처음부터 끝까지 생성할 수 있습니다. K2.6은 빠른 Q&A에 집중하며 텍스트(예: PPT 개요, Word 본문 텍스트, 코드)만 출력합니다.

팁: 이미지, 오디오, 동영상을 생성하려면 "+" → Plugin을 클릭해 해당 기능을 선택한 뒤 K3과 함께 사용하세요. 복잡한 편집 가능 문서를 만들거나 다단계 작업을 실행하려면 전체 기능을 온전히 경험할 수 있는 K3 또는 K3 Swarm 선택을 권장합니다.

세션과 대화 턴

"새 채팅"을 클릭하면 Kimi와 긴 대화를 새로 시작한다고 생각하면 됩니다.

개념비유기술적 정의
세션처음부터 끝까지 이어지는 하나의 회의시작과 끝이 분명한 완전한 채팅 과정
한 번의 주고받기(사용자가 말하고 Kimi가 답함)사용자의 입력과 Kimi의 응답이 하나의 왕복을 이룸

주요 차이점

세션

  • 연속 메모리: Kimi는 현재 채팅 안의 모든 맥락을 기억합니다
  • 턴 간 맥락: 각 답변은 이전 대화 내용을 다음 턴의 맥락으로 참고합니다
  • 명확한 경계: "새 채팅" 클릭 = 새로 시작, 이전 맥락은 지워집니다
  • 누적 횟수: 1턴, 2턴처럼 순차적으로 추가됩니다
  • 제한된 메모리: 턴이 너무 많아지면(예: 50턴 이상) Kimi가 앞선 내용을 "잊을" 수 있습니다. 특히 긴 글쓰기나 엄격한 요구사항이 있는 작업에서 더 그렇습니다
  • 맥락 길이 제약: 토큰 수에 의해 제한됩니다. 턴이 쌓이면 가장 앞부분의 내용이 압축될 수 있습니다

예외 상황: 한 번의 질문과 답변으로 대화가 끝난다면 1턴 = 1세션입니다.

이 구분이 중요한 이유

하나의 세션 안에서는 새로 보내는 질문이나 지시마다 이전 모든 턴을 참고해 답변합니다. 턴이 쌓이고 내용이 길어질수록 답변 품질은 점차 떨어질 수 있습니다.

흔한 상황

상황 1: 주제 전환

  • 잘못된 예: 30,000단어짜리 소설을 쓰던 세션에서 "세금 계산을 도와줘"라고 묻기
  • 올바른 예: 세금 질문은 새 세션에서 시작하세요. Kimi가 소설 속 인물과 세금 개념을 혼동하지 않도록 하기 위해서입니다 상황 2: 긴 문서 처리
  • 수십 턴이 지나면 Kimi가 처음에 정한 규칙이나 파일 요약을 "잊을" 수 있습니다
  • 해결 방법: 작업 중간에 능동적으로 요약을 요청하거나("지금까지의 계획을 요약해줘"), 새 세션을 시작하세요 상황 3: 제품 한계 이해
  • 맥락 길이 제한은 토큰 단위로 측정되지만, 일상적으로는 "턴"으로 이해하면 됩니다
  • "새 채팅 시작" 안내가 보이면 현재 세션의 턴이 너무 많다는 뜻입니다

권장 사용법

작업마다 새 세션 시작: 글쓰기, 조사, 디버깅처럼 서로 독립적인 작업은 각각 별도 세션에서 진행해 맥락 간섭을 피하세요.

긴 세션에서는 주기적으로 요약: 20턴이 넘으면 데이터 손실을 막기 위해 Kimi에게 핵심 정보를 요약해 달라고 먼저 요청하세요.

민감한 정보는 즉시 정리: 채팅 기록은 보관됩니다. 개인정보를 다룬 뒤에는 전체 세션을 삭제하세요.