Перейти к содержимому

Этот навык сделал Kimi K3 в 10 раз лучшим дизайнером

AI LABS

0:00 / 0:00

Этот навык сделал Kimi K3 в 10 раз лучшим дизайнером

20 507 просмотров · 1 месяц назад
AI LABS
163 тыс. подписчиков
20 507 просмотров · 1 месяц назад
Обзор Kimi K3: новая модель Moonshot AI превосходит LMArena по фронтенд-дизайну. Kimi K3 против Claude, бенчмарки Kimi K3, почему Kimi Code работает медленно, и навык, который избавляет от лишних элементов ИИ в любом дизайне. Мы протестировали всё это в Claude Code. Навык Hallmark: https://github.com/Nutlope/hallmark Сообщество со всеми ресурсами: https://ailabspro.io/?v=EwTOiqWWqEc The Roundup, наша ежедневная новостная рассылка, освещающая важные новости в области ИИ. Присоединяйтесь сейчас: https://www.theroundup.so/ 0:00 Вступление 1:10 Тесты Kimi K3, контекст и цены 2:40 Почему мы не использовали Kimi Code 3:51 Запуск Kimi K3 внутри Claude Code 5:52 Навык Hallmark и его четыре глагола 7:08 Установка Hallmark 8:09 Спонсор 9:04 Тестирование Kimi K3 с навыком 11:52 Тестирование Opus 4.8 с навыком 13:31 Тестирование Codex с навыком У каждой модели ИИ свой собственный стиль дизайна, и вы этого не заметите, пока не поработаете с ней достаточно долго. Kimi K3 действительно хороша во фронтенде, но у неё всё ещё есть шаблоны, которые она использует по умолчанию. Итак, это полный тест Kimi K3: что именно выпустил Moonshot AI, как правильно его запустить и какой навык выводит любую модель за рамки её настроек по умолчанию. Результаты тестов Kimi K3 (Kimi K3 против Fable 5, GPT 5.6 и Claude) В контекстном окне на миллион токенов, по показателю искусственного интеллекта он опережает Opus 4.8 и Gemini 3.6, немного отставая от Claude, Fable 5 и GPT 5.6, с небольшим отрывом, позволяющим отнести его к одному уровню. По дизайну интерфейса он превосходит оба на LMArena, в основном благодаря принципу «визуального анализа»: он делает скриншот созданного кода, смотрит на результат и вносит корректировки, вместо того чтобы гадать по коду. Цена – вот где он однозначно выигрывает: 3/15 долларов за миллион токенов против 5/30 долларов для GPT 5.6 и 10/50 долларов для Fable 5. Почему мы не использовали Kimi Code Kimi Code – это собственный терминальный агент Moonshot, запущенный вместе с K2.5. Задача, которая в Claude Code или Codex занимает около 3 минут, заняла у нас около 10. Веса пока не открыты, поэтому каждый запрос возвращается на перегруженные серверы Kimi, и Moonshot признает в своей документации, что эта платформа не создана для раскрытия всего потенциала K3. Кэширование нарушается при переключении моделей, а отчеты суб-агентов не соответствуют тому, что мы видели в работе. Как использовать Kimi K3 в Claude Code (установка Kimi K3) Настройка Kimi K3 в Claude Code: укажите базовый URL Anthropic на конечную точку Kimi, замените токен аутентификации на свой ключ, установите модель kimi-k3, запустите Claude. Ищете бесплатный Kimi K3 или бесплатный API для Kimi K3? Такого нет, но вам также не нужно платить за токен. CLIProxyAPI превращает уже оплаченную вами подписку в локальный API на вашем компьютере, так что вы направляете Claude Code на localhost вместо прямого API и никогда не думаете о счете. — Все это работает в рамках одной терминальной сессии, поэтому закрытие терминала сразу же возвращает вас к вашей обычной подписке Claude. Функция максимального анализа включена по умолчанию. Навык Hallmark (дизайн Kimi K3 без лишних деталей) — Навык дизайна против лишних деталей ИИ с четырьмя глаголами: default, audit, redesign и study. Study — самый интересный, он рассматривает эталонный сайт как направление, а не клонирует его. — Более 100 эталонных сайтов и проверка 58-gate перед тем, как что-либо вернуть, плюс библиотека стилей, которую вы можете просматривать как реальные целевые страницы. — Установите его в .agents для Codex и Kimi Code или в .claude для Claude Code. В Kimi его можно вызвать вручную с помощью команды слэша; автоматический вызов ненадежен в моделях, отличных от Claude. Что мы обнаружили во время тестирования: Созданный нами веб-сайт Kimi K3 демонстрировал характерные черты Opus 4.8 (дистилляцию), изображения за главным элементом, увеличенные заголовки со смещением, теплые оранжевые и коричневые палитры, но текст гораздо менее перегружен рекламой, чем у Claude. Автоматическое сжатие не работает с Kimi в Claude Code, поэтому следите за контекстом, иначе ответы могут стать слишком общими. Тот же тест на Opus 4.8: без навыка результат был сильно небрежным (градиенты, закругленные рамки, как обычно). С Hallmark результат был более продуманным и на данный момент лучше, чем у Kimi. Codex с навыком отказался от своего зелено-белого стандарта, стал использовать SVG более экономно и запустил интерактивный браузерный тест самостоятельно. Мы — компания-разработчик программного обеспечения, использующая эти модели в своих собственных продуктах, поэтому это настоящий тест Kimi K3, а не реакция в день запуска. Независимо от того, искали ли вы Kimi K3 vs Claude, Kimi K3 vs Fable 5, как использовать Kimi K3, бенчмарки Kimi K3 или бесплатную версию Kimi K3, это именно та конфигурация, которую нужно скопировать. Работает одинаково независимо от того, используете ли вы Claude Co...