Начало работы с Kimi
Вы можете задавать вопросы в чате, загружать файлы и переключаться между моделями в зависимости от задачи. Откройте kimi.com и попробуйте отправить сообщение — поздоровайтесь с Kimi:
Выбор модели
Kimi предлагает несколько моделей. Нажмите кнопку переключения модели над полем ввода, чтобы сменить ее.
| Модель | Мощность рассуждений | Лучше всего подходит для |
|---|---|---|
| K2.6 | Standard / High | Быстрого диалога и вопросов-ответов с более оперативными ответами |
| K3 | Low / High / Max | Задач в чате и Agent; самая мощная в целом |
| K3 Swarm | Low / High / Max | Масштабного поиска и пакетной обработки, выполняемых за один проход |
K2.6 не расходует кредиты; K3 и K3 Swarm тарифицируются по кредитам. Подробнее см. в преимуществах подписки.
О Kimi K3
Kimi K3 — на сегодня самая мощная модель Kimi с 2,8 триллиона параметров, построенная на Kimi Delta Attention (KDA) и Attention Residuals, с нативным зрением и контекстным окном на 1 миллион токенов. Как первая в мире открытая модель класса 3T, K3 создана для передового интеллекта в задачах длительного программирования, интеллектуального труда и рассуждений и достигает лидирующих результатов в программировании, длительном выполнении задач и широком спектре задач общего интеллекта.
Встроенные инструменты
Доступны сразу, без настройки:
| Инструмент | Описание |
|---|---|
| Web Search | Поиск в интернете в реальном времени для получения свежих новостей и информации |
| Fetch Tool | Прямой доступ к конкретным URL-адресам: веб-страницам, документам, изображениям и другим онлайн-ресурсам |
| Image Search | Поиск по тексту или изображению для быстрого нахождения визуального контента |
| IPython | Выполнение Python-кода для анализа и визуализации данных |
| Память | Умная память, которая фиксирует ваши личные предпочтения и привычки |
Визуальные и мультимодальные возможности
Kimi K3 поддерживает полноценное понимание изображений, видео и офисных документов (PDF/Word/Excel) в самых разных сценариях благодаря нативной мультимодальной архитектуре (а не внешнему OCR-модулю). Модель может напрямую разбирать содержимое документов и выполнять офисные задачи среднего и высокого уровня сложности — например, писать формулы Excel или создавать структуры PPT и VBA-код. В сочетании с нативным зрением и контекстным окном на 1 миллион токенов она справляется с более длинными и сложными мультимодальными материалами.
Поддерживаемый мультимодальный ввод
- Изображения: PNG, JPEG, WebP, GIF и др. (через URL, Base64 или загрузку локального файла)
- Видео: MP4 и др. (через video_url или последовательности кадров + параметр fps)
- Документы: PDF, Word, Excel, TXT, Markdown и др.
- Онлайн-ресурсы: URL-адреса, ссылки на статьи
- Поиск изображений: загрузите изображение, чтобы найти связанные или похожие изображения
- Понимание видео: поддерживает анализ видео — может разбирать записи экрана и воспроизводить логику взаимодействия
- Визуальное программирование: загрузите скриншоты или записи экрана, чтобы сгенерировать frontend-код (HTML/Vue/React и др.); модель может автоматически воссоздавать веб-страницы по дизайн-макетам
Форматы вывода
- Простой текст / смешанный текст и изображения: стандартные ответы в диалоге
- Markdown: форматированный текст с заголовками, списками, таблицами и ссылками
- Блоки кода: HTML/Vue/React/Python/JSON/Mermaid и др. (с указанием языка)
- Структурированные данные JSON: вывод в принудительном режиме JSON
- Диаграммы Mermaid: блок-схемы, диаграммы последовательностей, интеллект-карты и др.
- Математические формулы LaTeX: встроенные и блочные математические выражения
- Двухрежимный вывод (Thinking): возвращает и
reasoning_content(ход рассуждений), иcontent(итоговый ответ) - Формат вызова инструментов: стандартный формат Function Calling (для разработчиков)
Важные примечания
- Вывод файлов: K3 может создавать редактируемые документы от начала до конца (например,
.pptx,.docx,.xlsx,.pdf) и другие сложные результаты; K2.6 ориентирована на быстрые вопросы-ответы и выводит только текст (например, структуры PPT, основной текст Word-документов или код).
Совет: чтобы сгенерировать изображения, аудио или видео, нажмите «+» → Plugin, выберите соответствующую функцию и используйте ее с K3. Чтобы создавать сложные редактируемые документы или выполнять многошаговые задачи, рекомендуем выбрать K3 или K3 Swarm для полного опыта.
Сессии и реплики в диалоге
Когда вы нажимаете "Новый чат", считайте, что начинаете долгий разговор с Kimi.
| Понятие | Аналогия | Техническое определение |
|---|---|---|
| Сессия | Вся встреча целиком — от начала до конца | Полный процесс общения в чате с четким началом и завершением |
| Реплика | Один обмен: вы пишете, Kimi отвечает | Ваш ввод и ответ Kimi образуют один цикл вопроса и ответа |
Ключевые различия
Сессия
- Непрерывная память: Kimi помнит весь контекст текущего чата
- Контекст между репликами: каждый ответ опирается на предыдущий диалог как на контекст для следующей реплики
- Четкие границы: нажатие "Новый чат" = новый старт; предыдущий контекст очищается Реплика
- Накопительный счетчик: реплика 1, реплика 2 и т. д. добавляются последовательно
- Ограниченная память: если реплик слишком много (например, 50+), Kimi может "забывать" раннее содержимое, особенно при работе с длинными текстами или задачами со строгими требованиями
- Ограничение длины контекста: оно определяется количеством токенов; по мере накопления реплик самое раннее содержимое может сжиматься
Пограничный случай: если один вопрос и один ответ завершают разговор, то 1 реплика = 1 сессия.
Почему это важно
В рамках одной сессии каждый новый вопрос или инструкция получают ответ с учетом всех предыдущих реплик. Но чем больше реплик и чем длиннее контент, тем заметнее может снижаться качество ответов.
Типичные сценарии
Сценарий 1: Смена темы
- Неправильно: спрашивать "помоги мне рассчитать налоги" в сессии, где вы до этого писали роман на 30 000 слов
- Правильно: создать новую сессию для вопроса о налогах, чтобы Kimi не смешивал персонажей романа с налоговыми понятиями Сценарий 2: Обработка длинного документа
- После десятков реплик Kimi может "забыть" правила или краткие сведения о файлах, заданные в начале
- Решение: по ходу работы просите сделать промежуточное резюме ("Суммируй наш план на текущий момент") или начните новую сессию Сценарий 3: Понимание ограничений продукта
- Ограничения длины контекста измеряются в токенах, но в повседневном смысле удобнее думать о них как о количестве "реплик"
- Если вы видите подсказку "Начать новый чат", это означает, что в текущей сессии слишком много реплик
Рекомендации
Начинайте новую сессию для каждой задачи: для независимых задач — написания эссе, исследования, отладки — лучше создавать отдельные сессии, чтобы контексты не мешали друг другу.
Периодически подводите итоги в длинных сессиях: после 20+ реплик заранее попросите Kimi кратко изложить ключевую информацию, чтобы ничего не потерять.
Своевременно удаляйте конфиденциальную информацию: история чатов сохраняется; после работы с личными данными удалите всю сессию.