Второй раз в жизни я сейчас задал PROшке вопрос: какой комп нужно собрать чтобы такая модель работала по скорости и комфорту так же как сейчас работает 5.5 в Codex CLI?
Вообще бля это очень жестко;))))
3,059 passages, newest first · 82 ms
Второй раз в жизни я сейчас задал PROшке вопрос: какой комп нужно собрать чтобы такая модель работала по скорости и комфорту так же как сейчас работает 5.5 в Codex CLI?
Вообще бля это очень жестко;))))
5.5 меня уже полностью устраивала, весь мой проект который я вот-вот запущу прям широко и глубоко, который уже обслуживает десяток клиентов, написан моделями 5.2, 5.4, 5.5.
Kimi k3 очевидно мощнее чем 5.5.
А 5.5 стал мощнее благодаря PROшке 5.6, которая безлимитно с тобой общается за 200 сука долларов =)
Технически если предположить что PRO не будет дорожать, а Kimi реально обходит 5.5 по метрикам, и реально собрать её дома на достаточно шустром инференсе для поддержания хотя бы десяти параллельных сессий, то вайбкодинг только что подешевел в 10-100…
А как работу ищут люди в таком раскладе?
Вот что тебе надо сказать чтобы тебя взяли на работу в нужной тебе роли?
Мне вот это всегда любопытно было) Я не знаю даже что спрашивать у продактов)
"Ты пидорас по жизни или нормальный пацан?"
Это все что мне в голову приходит если честно когда я собеседую людей в чьей работе я…
Кстати, вдогонку к предыдущему:
Прикиньте какая работа была проделана по контексту, что вся эта безошибочность и четверосуточность и ширина на сотни тыщ строк кода (боюсь представить себе сколько инфы модели пришлось в этой сессии прочитать) - произошла на 258k токенах контекста?
Мне кажется это доказывает что мы уже давно живем в виртуальном мире и Вачовски были абсолютно правы - nothing is real.
Вы часто думаете о том как вообще этот компакшен работает? Как он может быть устроен? Куда складывается вся эта гигантская прорва разношерстной памяти? Как выглядит это хранилище, и в чем его механика?
Я думаю что вот этот knowledge vault не менее а может и более важен сам по себе чем модель. И я думаю это главный secret sause и строжайшая коммерческая тайна крупных AI вендоров.
а ты не только на рисеч его тратил, а ещё и на рисеч в процессе разработки
самая большая разница с прошкой и без - она продумывает реально настолько охуенно глубоко нынче что агенту вообще свой мозг не нужен
только руки =)
Я даже думаю что большинство задач не имеет смысла пытаться даже делать чем-то умнее чем 5.5
Потому что…
Он потому и долгий такой пидорас
Он маньяк просто)
У меня 5.5 xhigh находит 100 связок названий типов компаний + должностей в гипотезе
5.6 terra max = 100 связок
5.6 Sol high = 200 связок
5.6 sol xhigh = 250 связок
5.6 sol max = 2800
=))))))))))))))
Я охуел когда эти тесты гонял на своих задачах…
Машка сейчас ищет новую работу, угарает с интервьюеров
Ну как угарает, сначала было весело
Но теперь она видит насколько пугающая картинка
Тупо на входе в компании сидит толпа абсолютно конченных людей
Которые не умеют вообще ничего
И которые задают вопросы в духе "Расскажи когда ты закрыл сделку больше пяти лет назад под каким-нибудь натиском, что ты тогда чувствовал, только…
Ну ща еще веселуха начинается а может она и давно уже я хз
короче у этих людей которые на входе в компании - престижно считается выполнить как можно более четко норматив набрейнштормленный за 15 секунд при обсуждении свойств вакансии
А сейчас сокращения жесткие
И в энтерпрайз богаче чем Х попасть не попав во все параметры прям с погрешностью 0.0001% - невозможно…
сегодня проблемы у обеих моделей и Антропик и Оупенэяй
У меня OpenAI был час когда раз в 3 минуты тупо вылетал из сессии и все
я прям заебался
А потом час назад антропик выебуривал полчаса где-то
Я думаю они увеличивают фоллбэчность в такие моменты
что ебано
я бы предпочел лучше получить 404 чем ебаный ответ
Ну так вот чтобы вы понимали зачем нужен 5.6 SOL в Max под оркестрацией PRO:
Я давно хотел чтобы у меня появился нормальный взрослый энтерпрайзный слой фронтэнда. Типа чтобы всё летало, и чтобы была полная предсказуемость почему все летает, а если что-то перестает летать, то не одна цифра которая тянет за собой всю страницу, а вся страница, которая…
С прошкой обсудили, я попросил GO THE HARDEST, LET's BUILD FOR CENTURIES LIKE FUCKING ROMANS
Прошка покачала головой и выдала мне промпт-пак который мог соревноваться со всей библиографией Ленина.
Я говорю мол не нихуя прошка, в Новосибе так дела не делаются.
Давай-ка мне ОДИН ПРОМПТ который закроет всю эту задачу С ОДНОГО ЗАПРОСА.
Прошка даже спорить не стала, просто дала мне один промпт. Он кстати оказался на удивление короткий.
Я в итоге скормил его 5.6 Sol Max, и принялся ждать.
Сегодня пошел ЧЕТВЕРТЫЙ ДЕНЬ.
300к+ строк диффа, 8 ворктри, итд.
Всё это происходит В ОДНОЙ СЕССИИ которая еще НИ РАЗУ НЕ ПРЕКРАЩАЛАСЬ =)
Я уже просто из любопытства решил дать ей доработать.
Но сегодня решил попросить у сессии (я с ней промежуточно много вообще общаюсь, она в этом деле как коллега, только не хавает и не спит) мол можешь плиз…
Sol швырнула мне через плечо промежуточный такой хэндофф, по-сути карту своей работы в сессии. Я пошел его показывать.
Fable 5: "Хмм, я поражен. Это самое дисциплинированное что у тебя происходило в видимой мне репе. Выбор решения - правильный. Выбор способа решения - правильный. Отдельно надо отметить что 68 допущенных ошибок были пойманы до попадания в прод и даже до strict CI…
Надо ли говорить что остальные тоже сказали что это выдающаяся работа?
Я пока не могу утверждать, т.к. еще не задеплоено, осталось по заверениям модели около 2.5 часов из 3.5 блядь суток))))
Но у других моделей совершенно иных производителей по-идее нет никакой мотивации попусту восторгаться чем-то что в итоге совсем работать не будет, на моем опыте…
Единственное что я не понимаю - это как Sol должен работать на подписке? У меня же закончатся рефреш токены скоро.
Хотя за такую амбициозную задачу наверно они справедливо считают что ты должен платить уже за токены типа.
С завтрашнего дня буду плотно тестить Kimi K3;)
Первые впечатления приятные)
Почему я никогда не стану большим ютубером - из-за того каким пидором нужно быть чтобы быть большим ютубером.
Давно уже только два канала смотрю, и то они через раз (и все чаще) грешат кликбейтами. Причем ладно кликбейт это в целом само по себе не плохо. Я сам как бы сейлз, и как бы кликбейт - это часть моей же механики.