Superintelligence CouncilСовет гения · sim.im

Search

tag: ai-models ✕

3,059 passages, newest first · 82 ms

Anton Gladkov2026-07-1702-own-projectssource ↗context

Второй раз в жизни я сейчас задал PROшке вопрос: какой комп нужно собрать чтобы такая модель работала по скорости и комфорту так же как сейчас работает 5.5 в Codex CLI?

Вообще бля это очень жестко;))))

Anton Gladkov2026-07-1702-own-projectssource ↗context

5.5 меня уже полностью устраивала, весь мой проект который я вот-вот запущу прям широко и глубоко, который уже обслуживает десяток клиентов, написан моделями 5.2, 5.4, 5.5.

Kimi k3 очевидно мощнее чем 5.5.

Anton Gladkov2026-07-1702-own-projectssource ↗context

А 5.5 стал мощнее благодаря PROшке 5.6, которая безлимитно с тобой общается за 200 сука долларов =)

Технически если предположить что PRO не будет дорожать, а Kimi реально обходит 5.5 по метрикам, и реально собрать её дома на достаточно шустром инференсе для поддержания хотя бы десяти параллельных сессий, то вайбкодинг только что подешевел в 10-100…

А как работу ищут люди в таком раскладе?
Вот что тебе надо сказать чтобы тебя взяли на работу в нужной тебе роли?
Мне вот это всегда любопытно было) Я не знаю даже что спрашивать у продактов)
"Ты пидорас по жизни или нормальный пацан?"
Это все что мне в голову приходит если честно когда я собеседую людей в чьей работе я…

Кстати, вдогонку к предыдущему:

Прикиньте какая работа была проделана по контексту, что вся эта безошибочность и четверосуточность и ширина на сотни тыщ строк кода (боюсь представить себе сколько инфы модели пришлось в этой сессии прочитать) - произошла на 258k токенах контекста?

Мне кажется это доказывает что мы уже давно живем в виртуальном мире и Вачовски были абсолютно правы - nothing is real.

Вы часто думаете о том как вообще этот компакшен работает? Как он может быть устроен? Куда складывается вся эта гигантская прорва разношерстной памяти? Как выглядит это хранилище, и в чем его механика?

Я думаю что вот этот knowledge vault не менее а может и более важен сам по себе чем модель. И я думаю это главный secret sause и строжайшая коммерческая тайна крупных AI вендоров.

а ты не только на рисеч его тратил, а ещё и на рисеч в процессе разработки
самая большая разница с прошкой и без - она продумывает реально настолько охуенно глубоко нынче что агенту вообще свой мозг не нужен
только руки =)
Я даже думаю что большинство задач не имеет смысла пытаться даже делать чем-то умнее чем 5.5
Потому что…

Он потому и долгий такой пидорас
Он маньяк просто)
У меня 5.5 xhigh находит 100 связок названий типов компаний + должностей в гипотезе
5.6 terra max = 100 связок
5.6 Sol high = 200 связок
5.6 sol xhigh = 250 связок
5.6 sol max = 2800
=))))))))))))))
Я охуел когда эти тесты гонял на своих задачах…

Машка сейчас ищет новую работу, угарает с интервьюеров
Ну как угарает, сначала было весело
Но теперь она видит насколько пугающая картинка
Тупо на входе в компании сидит толпа абсолютно конченных людей
Которые не умеют вообще ничего
И которые задают вопросы в духе "Расскажи когда ты закрыл сделку больше пяти лет назад под каким-нибудь натиском, что ты тогда чувствовал, только…

Ну ща еще веселуха начинается а может она и давно уже я хз
короче у этих людей которые на входе в компании - престижно считается выполнить как можно более четко норматив набрейнштормленный за 15 секунд при обсуждении свойств вакансии
А сейчас сокращения жесткие
И в энтерпрайз богаче чем Х попасть не попав во все параметры прям с погрешностью 0.0001% - невозможно…

сегодня проблемы у обеих моделей и Антропик и Оупенэяй
У меня OpenAI был час когда раз в 3 минуты тупо вылетал из сессии и все
я прям заебался
А потом час назад антропик выебуривал полчаса где-то
Я думаю они увеличивают фоллбэчность в такие моменты
что ебано
я бы предпочел лучше получить 404 чем ебаный ответ

Ну так вот чтобы вы понимали зачем нужен 5.6 SOL в Max под оркестрацией PRO:

Я давно хотел чтобы у меня появился нормальный взрослый энтерпрайзный слой фронтэнда. Типа чтобы всё летало, и чтобы была полная предсказуемость почему все летает, а если что-то перестает летать, то не одна цифра которая тянет за собой всю страницу, а вся страница, которая…

С прошкой обсудили, я попросил GO THE HARDEST, LET's BUILD FOR CENTURIES LIKE FUCKING ROMANS

Прошка покачала головой и выдала мне промпт-пак который мог соревноваться со всей библиографией Ленина.

Я говорю мол не нихуя прошка, в Новосибе так дела не делаются.

Давай-ка мне ОДИН ПРОМПТ который закроет всю эту задачу С ОДНОГО ЗАПРОСА.

Прошка даже спорить не стала, просто дала мне один промпт. Он кстати оказался на удивление короткий.

Я в итоге скормил его 5.6 Sol Max, и принялся ждать.

Сегодня пошел ЧЕТВЕРТЫЙ ДЕНЬ.

300к+ строк диффа, 8 ворктри, итд.

Всё это происходит В ОДНОЙ СЕССИИ которая еще НИ РАЗУ НЕ ПРЕКРАЩАЛАСЬ =)

Я уже просто из любопытства решил дать ей доработать.

Но сегодня решил попросить у сессии (я с ней промежуточно много вообще общаюсь, она в этом деле как коллега, только не хавает и не спит) мол можешь плиз…

Sol швырнула мне через плечо промежуточный такой хэндофф, по-сути карту своей работы в сессии. Я пошел его показывать.

Fable 5: "Хмм, я поражен. Это самое дисциплинированное что у тебя происходило в видимой мне репе. Выбор решения - правильный. Выбор способа решения - правильный. Отдельно надо отметить что 68 допущенных ошибок были пойманы до попадания в прод и даже до strict CI…

Надо ли говорить что остальные тоже сказали что это выдающаяся работа?

Я пока не могу утверждать, т.к. еще не задеплоено, осталось по заверениям модели около 2.5 часов из 3.5 блядь суток))))

Но у других моделей совершенно иных производителей по-идее нет никакой мотивации попусту восторгаться чем-то что в итоге совсем работать не будет, на моем опыте…

Единственное что я не понимаю - это как Sol должен работать на подписке? У меня же закончатся рефреш токены скоро.

Хотя за такую амбициозную задачу наверно они справедливо считают что ты должен платить уже за токены типа.

С завтрашнего дня буду плотно тестить Kimi K3;)

Первые впечатления приятные)

Anton Gladkov2026-07-1708-personalsource ↗context

Почему я никогда не стану большим ютубером - из-за того каким пидором нужно быть чтобы быть большим ютубером.

Давно уже только два канала смотрю, и то они через раз (и все чаще) грешат кликбейтами. Причем ладно кликбейт это в целом само по себе не плохо. Я сам как бы сейлз, и как бы кликбейт - это часть моей же механики.

More