Не от рамок зависит то что модель за несклько часов тупо не пишет код
я первый раз в жизни вижу модель которая за 3 часа делает 2к строк кода, это о чем-то же говорит при том что я уже год сижу и непрерывно гляжу в монитор
Да ладно за 3 часа 2к
У меня сегодня днем была задача которую…
Search
2,235 passages, newest first · 64 ms
да блядь мы внутри такого жесткого эксперимента на самом деле что вообще не понятно нихуя
мы же видим как OpenAI абсолютно молча делает так что модели то в 10 раз больше хавают то в 10 раз меньше
то стабильнее работают то вообще пизда
то дольше то быстрее
итд
проблема в том что они это делают не на тестовых полигонах
а…
они ничего не дают, им цена ноль
Потому что сегодня все иначе уже, причем во всех аспектах
А как так блядь сохранять менталку, если ты не можешь рассчитывать на инструмент ни в одном из его параметров
я как раз ценил 5.5 все это время за то что он был самым стабильным AI тулом в природе
Теперь я хуй знает…
Так блядь кодеры которые мне наяривают свою санта-барбару в личку по итогу развернувшейся в чате драмы - ИДИТЕ НАХУЙ.
Некоторым из вас ошибочно показалось что я заинтересован в том чтобы выслушивать ваше мнение о том как кодерам на самом деле трудно живется, и насколько я не справедлив к вам. Блядь ИДИТЕ НАХУЙ.
Вы отвлекаете меня от дел гораздо более важных чем ваши сука НИКОМУ НЕ ВСРАВШИЕСЯ переживания. Если я пишу в канале или в группе - я поверьте это делаю не для вас, а для себя. Ваше мнение или эмоции по этому поводу выражайте в группе друг-дружке, на карточку закидывайте, пиздец я не знаю отправьтесь в Антарктиду и нассыте там желтой струей…
Реально щас мне блядь неизвестные гривастые будут мямлить о выражаемом в самых маленьких простых числах, а мне бы вот сидеть и эту хуету выслушивать.
Вы реально свое время на помойке нашли походу =(((
Лучше заносите мне филки, охуенные рекомендации для вайбдрочеров, чудесное настроение и бескрайние блага!!!
Ну я кстати вообще не согласен с Theo (кент выше который проливал слезы на Ultra) по поводу его отношения к реализации V2 агентов в Codex.
Его тейк заключается в том что тупо что все агенты делят контекст между собой мол потому что это жрет токены.
Ну бля а раньше это жрало меньше токенов зато агенты были внатуре вреднее чем без них!!!!!!!!!!!!!
Сейчас у тебя агенты гуляя по репе хотя бы (в теории) не предоставят заспаунившему их решале ложные или противоречивые данные, т.к. противоречие разрешается именно за счет прозрачности размышлений о каждом прочитанном пикселе сразу всей агентской братией.
Так же я не понимаю пиздостраданий о невозможности выбрать reasoning level субагентов.
Бля а нахуя тебе субагенты которые тупее чем модель которая будет потом на базе их рисеча и РИЗОНИНГА пилить ультимативное решение? Давайте даунов нанимать и просить их собирать сведения для парочки гениев.
Это мне чем-то напоминает инвертированную картинку ценностей в отделах продаж, порожденную слишком большим удалением владельцев компании от операционки (в любой корпорации это происходит).
Самая сложная работа требующая самого большого effort и самой большой смекалки и скиллсета - это заведение новых знакомств для бизнеса и закрытие НОВЫХ клиентов.
Старых клиентов продолжать доить может и обезъяна ебучая.
При этом в компаниях типа Google спустя десятилетия от создания система выстроилась таким образом что люди которые бегают по рынку и закрывают новые сделки (сложная работа) считаются джунами и у них самая низкая зарплата. А сейлзы которые нихуя не делают, просто раз в квартал пишут "Привет вот вам инвойс", и лениво отвечают…
Причем если SDRов посадить на Key Accounts инвойсы слать - либо ничего не изменится, либо чек начнет расти.
Если Key Account Managers в поля отправить - продажи новому бизнесу до нуля упадут)
С агентами происходит такая же подмена ценностей. В отличие от материнской LLM, агент считается ютуб "экспертами" тем ценнее чем больше шума он наделал за как можно более низкий прайс…
Но бля на деле это не более низкий прайс, а у тебя дорогущая материнская LLM ризонит хуйню вместо того уровня правды на который она способна, потому что материал на входе в неё - хуйня.
Тут уж чтобы сэкономить проще тогда запрещать спаунить агентов в принципе.
А если есть лавэ или потребность в ультра скорости из-за чего-то. Например залатываем дыры или релиз надо не проебать. Тогда надо просить спаунить как можно больше абсолютно мощнейших субагентов макс модели на макс ризонинге.
Я не понимаю почему бля это вообще не обсуждается-то нигде и никем? Это элементарно же
Хаха решил попробовать поюзать GPT PRO в чате который встроили в Codex.
Это оказалось ультра классной штукой. По-сути проектируешь с этим GPT PRO, и когда ты уже прям совсем-совсем уверен в себе, и GPT PRO подготовил кроме контекста целиком задачу для 5.6 Sol Max, жмякаешь кнопку и весь контекст из беседы с GPT PRO улетает по-сути…
Все ещё коряво пиздец по сравнению с тем что мы бы просто ставили задачу GPT PRO в кодексе, а он там уже сам решал какие модели что будут делать, но лучше чем раньше, когда связи в принципе никакой не было, и приходилось условные промпт-паки прошкой генерить и доставлять в клювике в кодекс.
ОДНАКО, я даже не знаю как к этому относиться, но GPT PRO 5.6 разумеется стал умнее чем 5.5, и он не только поражает воображение, но и.... первый документ который он написал как КИК ОФФ нашего проектирования был на 8600 слов или ~1200 строк.md файла.
Причем он был не проходным полотном текста. Если честно - это был абсолютно гениальный текст, который можно прямо сейчас нести в какой-нибудь Манн-Иванов-Фербер и публиковать как книгу, и никто никогда в жизни не догадался бы что это нихуя не книга.
Я в итоге прочитал эту дуру, и ответил прошке на 16 открытых пиздец каких подробных вопроса, на это у меня ушло полтора часа, которые я думал что просплю, но я вообще губу довольно часто по жизни раскатываю.