Kimi Moonshot AI

Семейство Moonshot AI: контекст 256K без доплаты, сильный визуальный кодинг (превращает скриншоты и макеты в рабочий код) и оркестрация агентов. Эндпоинт OpenAI-совместимый, отличается только значение model.

Рассуждения включаются по-разному. kimi-k2.5 по умолчанию работает в режиме Instant, и рассуждения нужно попросить явно — enable_thinking: true. Более новые модели семейства рассуждают всегда, отдельный флаг им не нужен.

Какую выбрать

МодельДля чегоКартинки на входеРассуждения
kimi-k2.5 Универсальная. Единственная, у которой рассуждения выключены по умолчанию — удобно, когда нужен быстрый ответ да по флагу enable_thinking
kimi-k2.6 Самая выгодная в семействе: вход как у K2.5, выход дешевле да всегда
kimi-k2.7-code Заточена под код: рефакторинг, разбор больших репозиториев нет всегда
kimi-k3 Флагман семейства — для задач, где K2.6 ошибается да всегда

Характеристики

ПараметрЗначение
Model IDkimi-k2.5, kimi-k2.6, kimi-k2.7-code, kimi-k3
Контекст256 000 токенов (без доплаты)
РежимыInstant / Thinking / Agent / Agent Swarm
Включение ThinkingУ kimi-k2.5enable_thinking: true (по умолчанию false). У остальных включено всегда
ВходТекст + изображение. Исключение — kimi-k2.7-code: только текст
ВыходТекст
Стриминг / Tool use✓ Поддерживаются

Цены

МодельВходВыходЧтение из кеша
kimi-k2.5 $0.9 / 1M $4.725 / 1M $0.15 / 1M
kimi-k2.6 $0.9 / 1M $3.6 / 1M $0.1516 / 1M
kimi-k2.7-code $1.425 / 1M $5.985 / 1M
kimi-k3 $4.5 / 1M $22.5 / 1M

Ставки указаны итоговые — именно столько списывается с баланса. Полный каталог — в разделе Модели и цены.

Когда включать Thinking

Сценарийenable_thinking
Быстрый диалог / короткие ответыfalse (по умолчанию) — минимальная задержка
Сложные рассуждения, планирование кода, RCAtrue — модель выдаёт трассу рассуждений
Агент со встроенным $web_searchfalse — web_search и Thinking взаимоисключающи

Примеры

Instant (по умолчанию)

curl https://megaapi.ru/v1/chat/completions \
  -H "Authorization: Bearer sk-..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2.5",
    "messages": [{"role": "user", "content": "Представься одним предложением."}]
  }'

Thinking (через extra_body)

from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://megaapi.ru/v1")

response = client.chat.completions.create(
    model="kimi-k2.5",
    messages=[
        {"role": "system", "content": "Ты — полезный ассистент."},
        {"role": "user", "content": "Проанализируй сложность кода и предложи оптимизации."}
    ],
    extra_body={"enable_thinking": True},
)
print(response.choices[0].message.content)

В openai-python поле enable_thinking передаётся внутри extra_body; в Node.js SDK — как поле верхнего уровня тела запроса.

Лучшие практики

Открыть в MegaAPI Chat → Текстовая генерация Все модели