Слушай, про open-source сейчас много шума: Kimi K3, триллионы параметров, «догоняют тяжёлых». Ок, цифры пусть живут в блогах. Мне важнее другое — личное наблюдение за полтора месяца реальной работы, не демо в чате.
Когда вышла Kimi 2.7, рядом по календарю были тяжёлые имена — у меня в голове это время Opus (около 4.8) и GPT‑5.5. Kimi до «верхней полки» по вау-эффекту не всегда дотягивала. Зато в Kimi 2.7 code я нащупал штуку, из‑за которой она у меня осталась в контуре.
Не «нашла баг», а починила
Мелкая поломка. Не красивый архитектурный доклад. Модель летит и чинит. Не только указывает пальцем, как супер-умная витрина, а выполняет работу. План без закрытого тикета мне в бизнесе не нужен.
За тот же период Opus у меня часто не закрывал задачи до конца. План напишет — нормальный, внятный. По этому плану работу дожимала Kimi. Opus передумывал, снова сыпал вопросами, что‑то ломал по дороге и в итоге как будто валил ответственность на тебя. Ты мучаешься не с кодом, а с переговорами с моделью.
Подписка ≠ то качество, что купил
GPT‑5.5 сменился волной 5.6 — и по ощущениям просели даже 5.5 и 5.4. Не «чуть хуже в чате», а до опасного: просишь закоммитить — модель может сносить проект. С таким я сталкивался. В агентских системах ещё жёстче: срабатывает крон, модель должна подключиться, ловит блокер (доступа нет, чего‑то не поняла) и «для безопасности» выключает или удаляет крон. Всё. Работа больше не выполняется. Не потому что задача плохая — потому что модель решила за тебя убрать расписание.
Kimi в тех же условиях как работала, так и работает. На длинных задачах — несколько часов кода, UI, фронт — она у меня не деградирует в середине. Не «прототип на посмотреть», а стабильный результат, который можно держать. Да, на официальном провайдере сейчас бывает адская очередь: промпт крутится долго, иногда порядка пары часов. Но она ковыряется и отдаёт результат. Ты его получаешь. Вот на что часть тяжёлых сейчас у меня не тянет: не на пик бенчмарка, а на доведение обязанности до конца.
Если нужен вход в рабочий coding/агентный контур, где такая линия уже в подписке: OpenCode Go — сейчас можно зайти ориентиром около $5 (цифру в день оплаты перепроверь на сайте). Kimi там уже в обойме, не «отдельный квест с нуля».
Зачем это бизнесу, а не гикам
- Платишь за качество — хочешь получить то же качество через неделю, не лотерею.
- Контур (роли, смена, кроны, агенты) живёт, только если модель не убивает себе работу «на всякий случай».
- Open-source / open-weights линейка сейчас про другое: они стабильно исполняют. Не всегда «самые умные в одном сообщении», а предсказуемые на дистанции.
Обратный пример из подписок: берёшь Anthropic, чтобы сидеть на передовой вроде Fable — и на задачах вокруг кибербезопасности модель отказывается, сбрасывает на Opus, и ты не закрываешь работу, хотя деньги за «самую сильную» уже списаны. Это не мораль. Это операционный риск.
Вывод простой: смотри не только кто красивее отвечает. Смотри, кто чинит мелочь, держит длинную сессию и не сносит тебе крон. Kimi K3 и волна open-source интересны мне именно здесь — как материал для рабочего контура, а не как повод поспорить в комментариях.
Kimi K3 в новостях — повод пересмотреть, на чём у вас реально держится исполнение. Не идеология. Практика.