Superintelligence CouncilСовет гения · sim.im

Search

tag: ai-models ✕

3,059 passages, newest first · 10 ms

То бишь модель должна чатиться и в конце осмыслить весь чат, прогнать его смыслы через детерминированные доктрины, получить на этом недетерминированный интеллектуальный результат, увернуться от промпт-инжекшенов и людей которые захотят попродавать расчлененку и прочую чернуху разного рода, но при этом не грохнуть никого кто хочет продавать серое.

Звучит как-то нарастающе сложно, однако даже упомянутая ранее 4о и та бы с таким справилась.

Я попросил 5.6 Sol Max, Kimi K3, и qwen3.8-max параллельно гонять тесты, и их задача брать все модели рынка, bottom-up (от тупых к умным), и гонять по 100 задач на каждой, чтобы понять способности, стабильность, и определить финалистов по которым…

Бюджет на весь эксперимент ~800 баксов. Но для меня качество в этом месте очень важно, поэтому и многим больше солью если придется) До этого там чекинились Qwen3.8-max low и 5.6 Sol Low, но себя не оправдали каждая по своим причинам, и теперь я понимаю что мне надо будет там слоеный пирожок моделей выстраивать чтобы работало как мне…

Так вот: эксперимент идет уже давно, и сейчас дошло до GLM 5 и Qwen3-max.

Даже на облачке эти модели показывают результаты настолько ниже заданного минимального бэйслайна, что их активностью можно впринципе пренебречь. Абсолютно бесполезное говно.

Я понимаю зачем в заводских условиях могут быть нужны такие модели. У меня когда-то был товарищ который делал элементарную автоматизацию на машинлернинге типа "фоткаем курицу, с помощью машинного зрения определяем есть ли на ней целлофан, если да - лампочка моргает один раз, если нет - два раза".

Поэтому они и существуют.

Но я слабо представляю себе чтобы люди с такими задачами сидели в чате в телеграме и вообще могли это прочитать или обсуждать.

А все кто сидят в телеграме и читают/обсуждают как они будут на говне за тыщу долларов (а мак мини нормально так ебёт кошелек кстати, он в норм компле тыщи четыре стоит?!) гонять безлимитный…

Как делать дизайн и UI, если вы вообще в нем ничего не понимаете

Вчера написал пост про страдания из-за того, что приходится брать ответственность не только за код, но и за дизайн. И для меня это проблема. Потому что когда вайбкодишь решение, то на первое время можно откинуть экзистенциальные вещи типа чистоты кода, безопасности, багов и ориентироваться на результат…

Но когда дело касается визуала и удобства пользования, начинаются нюансы. Первое, что выдает тебе ИИ на запрос «создай сайт», - это сине-фиолетовый градиент, шрифт Inter и типичный скелет лендинга.

Кстати, в этом ИИ-слопе сайтов виноват популярный CSS-фреймворк Tailwind, они еще в 2019 году сделали индиго дефолтным цветом кнопок в своих компонентах, туториалы разошлись по всему гитхабу, и модели…

Создатель Tailwind Адам Уотан позже публично признал, что выбрал индиго не из дизайн-соображений, а как нейтральный плейсхолдер для демок. И этот оттенок лаванды уже прозвали "VibeCode Purple".

Ну а дальше начинается круговорот ИИ-слопа в природе веб-дизайна. Навайбкоженные сайты попадают в сеть, следующее поколение моделей учится уже на них, среднее самоусиливается. Плюс агент дополнительно сужает выбор до того…

И как же разорвать этот пурпурный круг, если нет дизайнерской насмотренности? Вот что я скормил своему агенту и себе:
— ui-skills.com - каталог скиллов по дизайн-инженерии для агентов. Внутри скиллы от shadcn, Anthropic, Эмиля Ковальски и других. Подключаешь через CLI или MCP, и агент начинает верстать по правилам, а не по своим генерическим привычкам
— ui.shadcn.com - стандарт индустрии…

Полностью бесплатно
— transitions.dev - каталог готовых переходов и микроанимаций. Открытие модалок, скелетоны, анимация цифр, ресайз карточек. Код копируешь или подключаешь агенту как отдельный skill. База бесплатная, остальное в Pro
— emilkowal.ski/ui/you-dont-need-animations - эссе Эмиля Ковальски (автор библиотек sonner и vaul) о том, когда анимации вредят. Например, что частые действия лучше не анимировать и все держать быстрее…

Anton Gladkov2026-08-2708-personalsource ↗context

27b с 3t умеешь сравнить?:)
Почему на сервере хостим свои игры и приложения который может там подорожать и отказать, если есть советский Калькулятор?!?!
Воткнул в него батарейки и он работает!!!! Надежно и прямолинейно - шуршит себе.
У многих из них даже солнечная батарея есть, им даже батарейка не нужна литий-ионная!!!

Anton Gladkov2026-08-2602-own-projectssource ↗context

Ну вот такого плана фидбек и нужен, сделаем чтобы все было удобно и наглядно
к сожалению AI не умеет по запросу "сделай удобно и наглядно"
Пока не пожрешь этот гранит нихуя не будет
Я на дизайн происходящего в SLSBMB AI потратил уже больше времени чем на саму техническую часть
раза в два
модели не просто отвратительно делают продуктовый дизайн, а…

Anton Gladkov2026-08-2602-own-projectssource ↗context

Чисто по себе сужу. Я не вижу никакого смысла в покере в котором нажатие на кнопку all in ничего не стоит

Anton Gladkov2026-08-2602-own-projectssource ↗context

для клиентов
я просто губу раскатал пиздец
чтобы не было нейрослопно, чтобы было секси, и чтобы было понятно, и чтобы было минималистично но в то же время чтобы было всё, и чтобы не потеряться
математическая матрица проблем которые надо преодолеть соответственно просто грандиозная получилась
но продукт очень сложносоставной и технически сложный, поэтому LLM если сказать мол сделай какой-нибудь дизайн…

да она не юзабельна просто для кодинга
для дизайна норм
Нельзя кодить на хуйне которая учитывает 2% от играющих параметров, и даже в части из них допускает ошибки. Это разрушение репы а не разработка.

Тут просто опять блядь с людьми обсуждать что поумнело или отупело бесполезно в отрыве от того что они делают
Мне тут недавно чел залечивал что Опус 5 самая сильная модель
Но его репа это 30 тыщ строк кода какого-то трейдингового бота ссаного
Я не знаю как ему передать картинку из своей головы где Opus делая одну фичу ломает все…

Разработка это же сотни файлов надо открыть, сделать по ним какие-то выводы, какие-то правки внести, итд
Достаточно в двух местах ошибку допустить и урона уже больше чем пользы
Эта хуета допускает ГРАНДИОЗНЫЕ ошибки в каждом втором вопросе который я ей задаю.

О какой серьезной разработке может идти речь?
Я уже отписался от этой залупы потому что реально пропал какой-либо реальный юзкейс для кими
Просто время проебал с ней две недели
В итоге все что я на ней пытался сделать за прошедший месяц переделывал Sol чтобы это хоть как-то заработало
И надо признать что он переписал тупо всем сам с…

GPT?
Я прямо сейчас в процессе нереальной битвы с OpenAI по теме морализма
короче я выяснил что у модели тупо веса выстроены таким образом что если в наборе осмысляемых токенов есть что-то что вызывает у модели хоть какие-то подозрения на потенциальный фрод или нарушение чего-либо, модель на всякий случай (и это самое страшное) сходит с ума
И…

More