Superintelligence CouncilСовет гения · sim.im

Search

tag: ai-models ✕

3,059 passages, newest first · 28 ms

Кодить самой Kimi так чтобы она сама принимала решения о том что зачем и как кодить - я практически перестал. Если на GPT становится мало ресурсов - самое время поручить Codex'у перестать кодить своими руками и управлять кодинговыми сессиями Kimi.

Это не идеально, потому что я в какой-то момент накопил достаточно наблюдений чтобы сказать с уверенностью: модели ну очень ебано управляют друг-другом. Однако если на кими дохуя лишних лимитов, то даже если эффективность разработки GPT Sol -> Kimi падает в несколько раз - это терпимее чем выдаивать в ноль Кодекс чтобы потом нахуевертить багов с Kimi, и потом фиксить…

Qwen3.8max - был кстати шикарными руками для Codex, но сплыл, потому что скорость его замедлили примерно в 50 раз, а стоимость токенов подозрительно приблизилась к стоимости токенов по API. Таким образом Qwen стал тупо самым дорогим в природе если использовать его в разработке, by far.

Однако, Qwen3.8max - это самый талантливый литератор, способный писать ЛУЧШЕ БОЛЬШИНСТВА ЛЮДЕЙ. Во всяком случае в руках кого-то кто умеет неплохо писать тоже. А умение так хорошо писать не может существовать само по себе. Он тупо шикарно подготовлен в гуманитарном любом деле, и бесполезным это никак не назовешь.

Это значит что он прекрасный компаньон 5.6 Sol и Kimi для каких-нибудь важных затяжных брейнштормов, судья всего что связано с эмиссией любых слов где-либо какой угодно моделью, формулятор контрактов и принципов для других моделей, итд. Чем дольше я с ним практикуюсь - тем больше и лучше я понимаю как и зачем его использовать в мелочах.

Ещё у Qwen есть в CLI всякие фэнси модели типа GLM и других, которые можно дергать и не завидовать что у кого-то есть кошкожена а у тебя нет.

Mythos сосёт писос.

Ну и конечно не стоит забывать что любая модель - это МАКСИМУМ 50% влияния на результат.

Остальные 50% - это ваш собственный харнесс (Agents.md и прочая матрешка логических контрактов которые ЛЛМки будут исполнять каждую сессию или когда обращаются к конкретным репам), ваш навык (я многому научился на прошлой неделе, а значит ранее этого не умел, хотя вайбдрочу с прошлого сентября), ваша нервная система, усидчивость, итд итп.

Чем больше я общаюсь с разными людьми тет-а-тет о вайбкодинге, тем больше понимаю что разрыв между мной и ими растёт, поскольку я продолжаю сидеть ВЕСЬ ДЕНЬ, а они садятся даже не каждый день, и не проводят в процессе больше нескольких часов.

Слушая их, я понимаю что бросать советы через плечо - не принесёт им никакой пользы, как когда-то я понял про консалтинг..

Пока мы тут уговариваем Kimi дотянуть до рефреша, Машка Садовская (https://t.me/masha_draw) там оказывается по моим любимым местам ультра приключениями автостопными наслаждается. Включил вот этот видос и не смог оторваться:

https://youtu.be/Sv_x2nw1f7U?si=kemA7m-MydQdtJEC

Это может показаться странным, но в кейсе чат-бота где требуется самое лучшее в природе пересечение ума / размера интейка / стабильности отклкиа / скорости ответа / итд - с огромным отрывом лидирует... Sol 5.6 Low.

Medium+ ебейше проседает по скорости.
Всякие Kimi/Qwen вообще ультра не надежные по API. Ответ изи гуляет от 20 до 500 (!!!) секунд на интейке моего размера, Qwen еще и умудряется время от времени ломать JSON на десятках тестов, не сотнях и не тысячах.

Терра тупая как пизда. Opus не надежный и медленноватый на ризонинге который повышает его надежность, Sonnet тупой как говнище ебаное.

В общем 5.6 Sol LOW победил в задаче с таким отрывом что он занимает все места по этой задаче с первого по пятидесятое.

Ну и чатботить через CLI анрил, только API токен. Разница в 100-300% по всем пунктам ответы в интерфейс через CLI-сессию сосать или с токена.

JFYI тем кто думает какой моделью лучше обрабатывать чатики с живыми людьми =)

Забавно что сами OpenAI утверждают что Terra модель для чатов, но бля терра внатуре тупая пизда которую ни один судья консиллиума из сотен проходок даже в таблицу не стал включать)

скорость главное да, но не только
я думаю еще CLI это в любом случае багаж из грузного харнесса поверх всего говна которое и так сыплется модели в голову
И это не может не вносить свой вес
Просто все метрики качества восприятия чатботом "доктрины чаттера" на базе которой работает чат-интервью прыгнули вверх на 100-300% через API токен
До этого…

что Low что High что Max - одна хуйня
Я полагаю у них сейчас все возможные меры борьбы с нагрузкой в ходу из-за ультра перегруза (наверно когда стартап стоимостью (раздутой пиздец) 18 ярдов привлекает к себе внимание рынка на десяток триллионов - так и бывает)
И один из методов подлый адаптив ризонинг в подписке
Типа ты выбираешь Макс но что тебе…

переподключи
грустно если отключили)
У меня крайний раз работало в 4 ночи ~8 часов назад..
И меня заставило заново его подключить
Я типа процедуру прошел этой усиленной киберзащиты ебаной
то что вчера обсуждали где стик надо в комп покупать или два кейчейна
И вот после этого когда я зашел в прошку и к гитхабу обратился меня заставило сначала его переподключить

Anton Gladkov2026-08-1408-personalsource ↗context

единственное что байтит во мне rage от этого поста это что его читать нахуй невозможно и он вообще ничего не сказал в итоге сукин сын
еще и вторую версию говорит напишет)))) Хули давай сразу как Донцова ебашь
Я пивас пил с ним в прошлом году, чуть не утонул в пабе - у чела кукуха так течет что ниагарский водопад отдыхает

могу вам рассказать пацаны откуда берется хайп на кэйвмэны и понитэйлы и как выглядит его ядро
сидим пару дней назад с кентом пьем пиво
он CTO в банке местном Лондонском
Пиздец говорит мы настроили все на клод коде и понитейле и охуенно теперь всё работает!!!!
А что спрашиваю вы делаете на понитейле? И что это вообще такое?
Бля я не…

More