Начало работы с Kimi

Вы можете задавать вопросы в чате, загружать файлы и переключаться между моделями в зависимости от задачи. Откройте kimi.com и попробуйте отправить сообщение — поздоровайтесь с Kimi:

Text

Выбор модели

Kimi предлагает несколько моделей. Нажмите кнопку переключения модели над полем ввода, чтобы сменить ее.

МодельМощность рассужденийЛучше всего подходит для
K2.6Standard / HighБыстрого диалога и вопросов-ответов с более оперативными ответами
K3Low / High / MaxЗадач в чате и Agent; самая мощная в целом
K3 SwarmLow / High / MaxМасштабного поиска и пакетной обработки, выполняемых за один проход

K2.6 не расходует кредиты; K3 и K3 Swarm тарифицируются по кредитам. Подробнее см. в преимуществах подписки.

О Kimi K3

Kimi K3 — на сегодня самая мощная модель Kimi с 2,8 триллиона параметров, построенная на Kimi Delta Attention (KDA) и Attention Residuals, с нативным зрением и контекстным окном на 1 миллион токенов. Как первая в мире открытая модель класса 3T, K3 создана для передового интеллекта в задачах длительного программирования, интеллектуального труда и рассуждений и достигает лидирующих результатов в программировании, длительном выполнении задач и широком спектре задач общего интеллекта.

Встроенные инструменты

Доступны сразу, без настройки:

ИнструментОписание
Web SearchПоиск в интернете в реальном времени для получения свежих новостей и информации
Fetch ToolПрямой доступ к конкретным URL-адресам: веб-страницам, документам, изображениям и другим онлайн-ресурсам
Image SearchПоиск по тексту или изображению для быстрого нахождения визуального контента
IPythonВыполнение Python-кода для анализа и визуализации данных
ПамятьУмная память, которая фиксирует ваши личные предпочтения и привычки

Визуальные и мультимодальные возможности

Kimi K3 поддерживает полноценное понимание изображений, видео и офисных документов (PDF/Word/Excel) в самых разных сценариях благодаря нативной мультимодальной архитектуре (а не внешнему OCR-модулю). Модель может напрямую разбирать содержимое документов и выполнять офисные задачи среднего и высокого уровня сложности — например, писать формулы Excel или создавать структуры PPT и VBA-код. В сочетании с нативным зрением и контекстным окном на 1 миллион токенов она справляется с более длинными и сложными мультимодальными материалами.

Поддерживаемый мультимодальный ввод

  • Изображения: PNG, JPEG, WebP, GIF и др. (через URL, Base64 или загрузку локального файла)
  • Видео: MP4 и др. (через video_url или последовательности кадров + параметр fps)
  • Документы: PDF, Word, Excel, TXT, Markdown и др.
  • Онлайн-ресурсы: URL-адреса, ссылки на статьи
  • Поиск изображений: загрузите изображение, чтобы найти связанные или похожие изображения
  • Понимание видео: поддерживает анализ видео — может разбирать записи экрана и воспроизводить логику взаимодействия
  • Визуальное программирование: загрузите скриншоты или записи экрана, чтобы сгенерировать frontend-код (HTML/Vue/React и др.); модель может автоматически воссоздавать веб-страницы по дизайн-макетам

Форматы вывода

  • Простой текст / смешанный текст и изображения: стандартные ответы в диалоге
  • Markdown: форматированный текст с заголовками, списками, таблицами и ссылками
  • Блоки кода: HTML/Vue/React/Python/JSON/Mermaid и др. (с указанием языка)
  • Структурированные данные JSON: вывод в принудительном режиме JSON
  • Диаграммы Mermaid: блок-схемы, диаграммы последовательностей, интеллект-карты и др.
  • Математические формулы LaTeX: встроенные и блочные математические выражения
  • Двухрежимный вывод (Thinking): возвращает и reasoning_content (ход рассуждений), и content (итоговый ответ)
  • Формат вызова инструментов: стандартный формат Function Calling (для разработчиков)

Важные примечания

  1. Вывод файлов: K3 может создавать редактируемые документы от начала до конца (например, .pptx, .docx, .xlsx, .pdf) и другие сложные результаты; K2.6 ориентирована на быстрые вопросы-ответы и выводит только текст (например, структуры PPT, основной текст Word-документов или код).

Совет: чтобы сгенерировать изображения, аудио или видео, нажмите «+» → Plugin, выберите соответствующую функцию и используйте ее с K3. Чтобы создавать сложные редактируемые документы или выполнять многошаговые задачи, рекомендуем выбрать K3 или K3 Swarm для полного опыта.

Сессии и реплики в диалоге

Когда вы нажимаете "Новый чат", считайте, что начинаете долгий разговор с Kimi.

ПонятиеАналогияТехническое определение
СессияВся встреча целиком — от начала до концаПолный процесс общения в чате с четким началом и завершением
РепликаОдин обмен: вы пишете, Kimi отвечаетВаш ввод и ответ Kimi образуют один цикл вопроса и ответа

Ключевые различия

Сессия

  • Непрерывная память: Kimi помнит весь контекст текущего чата
  • Контекст между репликами: каждый ответ опирается на предыдущий диалог как на контекст для следующей реплики
  • Четкие границы: нажатие "Новый чат" = новый старт; предыдущий контекст очищается Реплика
  • Накопительный счетчик: реплика 1, реплика 2 и т. д. добавляются последовательно
  • Ограниченная память: если реплик слишком много (например, 50+), Kimi может "забывать" раннее содержимое, особенно при работе с длинными текстами или задачами со строгими требованиями
  • Ограничение длины контекста: оно определяется количеством токенов; по мере накопления реплик самое раннее содержимое может сжиматься

Пограничный случай: если один вопрос и один ответ завершают разговор, то 1 реплика = 1 сессия.

Почему это важно

В рамках одной сессии каждый новый вопрос или инструкция получают ответ с учетом всех предыдущих реплик. Но чем больше реплик и чем длиннее контент, тем заметнее может снижаться качество ответов.

Типичные сценарии

Сценарий 1: Смена темы

  • Неправильно: спрашивать "помоги мне рассчитать налоги" в сессии, где вы до этого писали роман на 30 000 слов
  • Правильно: создать новую сессию для вопроса о налогах, чтобы Kimi не смешивал персонажей романа с налоговыми понятиями Сценарий 2: Обработка длинного документа
  • После десятков реплик Kimi может "забыть" правила или краткие сведения о файлах, заданные в начале
  • Решение: по ходу работы просите сделать промежуточное резюме ("Суммируй наш план на текущий момент") или начните новую сессию Сценарий 3: Понимание ограничений продукта
  • Ограничения длины контекста измеряются в токенах, но в повседневном смысле удобнее думать о них как о количестве "реплик"
  • Если вы видите подсказку "Начать новый чат", это означает, что в текущей сессии слишком много реплик

Рекомендации

Начинайте новую сессию для каждой задачи: для независимых задач — написания эссе, исследования, отладки — лучше создавать отдельные сессии, чтобы контексты не мешали друг другу.

Периодически подводите итоги в длинных сессиях: после 20+ реплик заранее попросите Kimi кратко изложить ключевую информацию, чтобы ничего не потерять.

Своевременно удаляйте конфиденциальную информацию: история чатов сохраняется; после работы с личными данными удалите всю сессию.

Начало работы с Kimi - Справочный центр Kimi