Kimi K3: бесплатная модель уровня Claude без VPN и доллара

Опубликовано 19 июл. 2026 г.8 мин чтенияСредний
Kimi K3: бесплатная модель уровня Claude без VPN и доллара
Чему научитесь
  • Что реально показала Kimi K3 в бенчмарках, а что - маркетинг Moonshot AI
  • Как подключить Kimi K3 из России без VPN - через рублёвые API-агрегаторы
  • Чем Kimi Code CLI отличается от Claude Code и стоит ли на неё переходить
  • Почему запустить Kimi K3 на своём компьютере нереально даже с открытыми весами
  • Какой риск по 152-ФЗ возникает, если пропускать через неё данные покупателей
Применить за 15 мин
Средний
5просмотров

16 июля 2026 года китайская Moonshot AI выпустила Kimi K3 - модель на 2,8 триллиона параметров с открытыми весами. На следующий день акции TSMC просели на 7%, SoftBank - на 9%, Nvidia - на 1,2% и на несколько часов уступила Apple звание самой дорогой компании мира.

Рынок отреагировал так, будто повторился «шок DeepSeek» января 2025-го. Аналитик Пол Триоло из Albright Stonebridge Group сформулировал это прямо: «ИИ-экосистема Китая, вероятно, гораздо лучше, чем считалось».

Для селлера маркетплейса, который собирает себе AI-помощников через вайб-кодинг (как именно - разбирал в статье «Claude Code простыми словами»), за этим шумом прячется один практический вопрос: можно ли уже сейчас пользоваться Kimi K3 вместо Claude - и что для этого реально нужно. Разбираю честно, без маркетинга.

Разборы, кейсы и готовые сборки AI-помощников для селлеров веду в Telegram-канале «Вайб Селлер Клуб». Другие материалы - в разделе Статьи.

Kimi K3: что вышло 16 июля и почему рынок обвалился

Модель построена по MoE-архитектуре: 896 «экспертов», из которых на каждый запрос активируется только 16 - то есть реально работает не вся громада параметров сразу, а маленькая её часть. Контекстное окно - 1 миллион токенов.

Лицензия - модифицированная MIT: скачивать, дообучать и использовать в своих продуктах можно свободно, включая коммерческое использование. Ограничение на атрибуцию касается только продуктов с аудиторией больше 100 млн пользователей в месяц или доходом от 20 млн долларов - маленький магазин на маркетплейсе под это не попадает.

Полные веса Moonshot обещает открыть 27 июля 2026 года - на момент выхода этой статьи доступ идёт только через API и приложение.

Frontend Code Arena #1 - что это значит на практике

Методика простая: оценщик вводит задачу вроде «сделай markdown-редактор с тёмной темой», две анонимные модели генерируют рабочее приложение, человек сравнивает и голосует за лучшее. Итоговый рейтинг считается так же, как рейтинг Эло в шахматах.

Kimi K3 прыгнула с 18-го места (у предыдущей версии) сразу на первое, обошла Claude Fable 5 и победила в 6 из 7 категорий фронтенда. Это реальный, честный результат - но именно по вёрстке и UI, не по всем видам работы с кодом.

Другие цифры разнонаправленные: в тесте SWE Marathon (долгие многочасовые инженерные сессии) Kimi K3 обходит и Fable 5, и GPT-5.6, а вот в Kimi Code Bench 2.0 и FrontierSWE - уступает Fable 5. Здесь важна честность: почти все опубликованные при запуске цифры - это отчёт самой Moonshot, независимая проверка сообществом ещё продолжается. По отзывам разработчиков в сообществе уровень для агентного кодинга оценивают скромнее, чем в маркетинговых сравнениях - примерно на уровне прошлогодних топовых моделей, а не однозначно выше всех.

Независимый разбор Саймона Уиллисона (известный в разработческом сообществе тест «нарисуй SVG-пеликана на велосипеде») это подтверждает. Уиллисон прямо оговаривает границы своего же теста: «Главное ограничение пеликана в том, что он вообще не затрагивает то, что важнее всего для сегодняшних моделей: агентные вызовы инструментов и способность надёжно работать с ними по мере роста диалога». Он же обратил внимание на подозрительную деталь: простой промпт «hi» модель посчитала как 86 входных токенов - что намекает на скрытый системный промпт примерно в 85 токенов, о котором Moonshot не сообщает.

Работает ли из России без VPN

Прямой доступ упирается в инфраструктуру: в открытом issue на GitHub разработчика Kimi-K2 пользователь SamTyurenkov написал: «большая часть трафика блокируется, вероятно, потому что используется Cloudflare (недоступный в России)». Официального опровержения от Moonshot в этой теме нет.

Рабочий вариант - российские API-агрегаторы. Например, AITUNNEL прямо пишет в своём FAQ: «прямой доступ к API moonshotai из РФ заблокирован, но AITUNNEL предоставляет доступ к Kimi без VPN и ограничений» - оплата картой российского банка или по счёту для юрлиц. Похожие сервисы предлагают GenAPI и другие агрегаторы: регистрация по email, пополнение баланса рублями, есть бесплатный тестовый лимит.

Kimi Code CLI - замена Claude Code для вайб-кодинга

Официальное описание из репозитория: «Kimi Code CLI - это AI-агент для кодинга, который работает в вашем терминале: читает и редактирует код, запускает команды оболочки, ищет файлы, загружает веб-страницы и сам выбирает следующий шаг по итогам полученного результата».

Установка на Windows - одна строка в PowerShell:

prompt
irm https://code.kimi.com/kimi-code/install.ps1 | iex

CLI умеет работать с записями экрана как контекстом, подключается к Zed и JetBrains, запускает параллельных суб-агентов для разных ролей (написание кода, разведка, планирование) - в целом воспроизводит логику, знакомую по Claude Code.

Важная техническая деталь, которую стоит проверить руками перед тем, как строить на ней рабочий процесс. CLI поддерживает подключение к любому OpenAI-совместимому эндпоинту через параметр base_url. Теоретически это значит, что вместо прямого адреса Moonshot туда можно подставить адрес российского агрегатора - но прямого подтверждения именно такой настройки от самих агрегаторов я не нашёл. Прежде чем перестраивать на этом рабочий процесс, проверьте связку на тестовой задаче.

Локально не запустить - и вот почему

Даже при агрессивном квантовании модель весит примерно 650-700 ГБ, при более щадящем сжатии - около терабайта, полные веса - порядка 1,7 терабайта. Сама Moonshot рекомендует для обслуживания модели «супернод не менее чем на 64 ускорителя».

Для селлера маркетплейса это значит одно: локальный запуск дома или в офисе - не вариант. Поддержка в удобных инструментах вроде Ollama появится не раньше выхода весов 27 июля, и по опыту прошлых версий - с задержкой на интеграцию новой архитектуры.

Дешевле альтернатива - DeepSeek V4

DeepSeek V4 Flash стоит около 0,28 доллара за миллион выходных токенов - это примерно в 54 раза дешевле, чем у Kimi K3 (15 долларов за миллион). Взамен - только текст, без работы с изображениями. У предыдущих моделей DeepSeek (V3/R1) была ночная скидка 50-75% в непиковые часы по пекинскому времени - официально подтверждённого такого же правила именно для V4 на момент публикации нет, но ориентироваться на дневной/ночной разброс цены стоит.

Выбор простой: DeepSeek V4 - для тех, кто считает каждый рубль и работает только с текстом; Kimi K3 - когда нужно распознавать фото товаров или скриншоты интерфейса, и бюджет позволяет заплатить за это больше. Общий принцип выбора между вайб-кодингом и готовым сервисом разбирал отдельно в статье «Вайб-кодинг или готовый сервис аналитики».

Риски, о которых честно стоит сказать

Цензура. У предыдущей модели линейки была зафиксирована заметная разница в ответах на английском и китайском языках по политически чувствительным темам. Для задач продавца - карточки товара, анализ отзывов, логистика, ответы покупателям - это никак не пересекается с рабочими сценариями, упоминаю только для полноты картины.

152-ФЗ о персональных данных. Если бот на основе любой зарубежной модели - хоть Kimi, хоть Claude - отвечает покупателям напрямую и видит их имя, телефон или адрес, это трансграничная передача персональных данных. О похожем риске при передаче данных покупателей через зарубежные AI-инструменты писал в статье «Персональные данные покупателей в ChatGPT». Для передачи в страну не из перечня Роскомнадзора «с адекватной защитой данных» нужно отдельное уведомление регулятора и явное согласие покупателя на передачу за рубеж - Китай, в отличие от США, в этом перечне значится, поэтому формально жёсткость требования для Kimi ниже, чем для американских моделей. Но проще для всех этих случаев одно правило: для внутренних инструментов (анализ, автоматизация карточек, аналитика продаж) риска обычно нет - туда не попадают персональные данные покупателей. Риск конкретно там, где модель работает с прямым обращением клиента: тут данные лучше обезличивать до отправки в любую внешнюю LLM, независимо от её происхождения и юрисдикции.

Что сделать прямо сейчас

  • Зарегистрируйтесь в одном из рублёвых агрегаторов (например, AITUNNEL) и получите тестовый доступ к Kimi K3.
  • Прогоните через неё одну реальную задачу, которую сейчас решаете через Claude или GPT - сравните результат и цену.
  • Не переносите на неё бота, который напрямую общается с покупателями, пока не разобрались с 152-ФЗ - начните с внутренних задач: карточки, аналитика, скрипты.
  • Не рассчитывайте на локальный запуск - даже после открытия весов 27 июля это история про серверный парк, а не про домашний ПК.

Итог

Kimi K3 - реальное событие, а не раздутая новость: открытая лицензия, честная победа в живом рейтинге по фронтенду, обвал акций крупных техкомпаний на фоне выхода. Но между заголовками и рабочим инструментом для селлера - несколько практических шагов: доступ только через российский агрегатор, локальный запуск исключён, а качество в реальной агентной работе сообщество оценивает осторожнее, чем маркетинг Moonshot. Попробовать на одной задаче стоит уже сегодня. Строить на этом всю систему - пока рано.

Источники

Читайте также

Была ли статья полезной?
Автор
Владимир Кабанов
Селлер, автор Вайб Селлер Клуба

Продаю на Ozon и Wildberries, автоматизирую магазин через вайб-кодинг и учу этому селлеров.

Похожие статьи

ИИ заменяет программистов? Monday.com сократил 630 человек ради AI-first

ИИ заменяет программистов? Monday.com объявила о сокращении 630 сотрудников - пятой части штата - ради стратегии AI-first. Ещё в начале года журналисты CNBC без строчки кода собрали клон сервиса через Claude Code меньше чем за час. Разбираю, где тут правда, а где громкий заголовок.

4 мин

Claude Opus 5: вдвое дешевле топовой модели - что это меняет для продавца

24 июля 2026 года Anthropic выпустила Claude Opus 5 - модель почти топового качества, но вдвое дешевле самой мощной модели линейки, с окном на миллион токенов. Разбираю, что это значит на практике для продавца, который собирает себе AI-помощников.

3 мин

Claude Code и скандал с геолокацией: что подтвердила Anthropic

Китайский регулятор кибербезопасности предупредил, что определённые версии Claude Code тайно отправляли геолокацию пользователей на серверы Anthropic. Anthropic подтвердила факт, но объяснила его защитой от «дистилляции» - кражи модели конкурентами.

1 мин

Поддельные ИИ-инструменты: Касперский зафиксировал рост атак на бизнес в 5 раз

Поддельные ИИ-инструменты - растущая ловушка для малого бизнеса: отчёт Касперского насчитал 33 352 атаки за январь-апрель 2026 года, почти в 5 раз больше год к году. Разбираю, какие сервисы подделывают чаще всего и как отличить настоящий инструмент от ловушки.

1 мин

Связанные понятия