Superintelligence CouncilСовет гения · sim.im

Search

tag: ai-models ✕

3,059 passages, newest first · 87 ms

А ощущение утратилось об длительность итераций, с которыми теперь работает GPT в кодексе.

Fable вообще нахуй пошел. Он просто сразу переключается на Opus, поэтому в мире подписок я лично считаю что его за пределами Claude Design просто больше не существует, пока кто-то не докажет обратное.

А вот GPT существует, но... Во-первых я не могу больше предсказать сколько он будет работать над задачей. ВООБЩЕ.

Сейчас над одной задачей GPT 5.6 Sol Max (без Ultra) у меня работает около 32х часов.

Было когда Sol хуярил больше 40 часов.

Раньше я понимал что задача займет от 30 минут до ну МАКСИМУМ 5 часов. В среднем 1.5 для ультра сложных задач на ультра гигантской репе.

Сейчас я больше ничего не могу предсказать и это пугает.

Это пугает и потому что я больше не понимаю как планировать свой день. На стадии когда твоя репа уже приносит тебе деньги и ты только улучшательствами занимаешся - это наверно меньший урон. И то тебе надо что-то кому-то обещать, но ты не можешь. Раньше я мог точно сказать клиенту: я пофикшу это за пару часов. И если даже я…

Теперь я вообще не знаю что отвечать. Может сегодня, а может до конца месяца блядь. Потому что GPT хоть и стал в сто раз умнее, утверждать что он понимает меня как я сам, и что он ваншотит таски - я бы не стал.

То бишь он может рандомно 2 дня работать над хуйней которая раньше бы у меня заняла 3 часа, и после этого я еще не знаю придется ли мне закидывать по этой же задаче следующий промпт или нет.

Уже несколько раз приходилось, и элементарную как мне казалось вещь он хуярил снова 11 часов. Слава Богу что закончил успешно.

Но это же уже не вайбкодинг.

И я практически уверен гайз что в этом на самом деле нет никакой нужды. В смысле - я четко понимаю что это фикция, смена парадигмы, экономия на инференсе, что угодно - но не технологическое ограничение.

Модель сегодня на моих глазах по нескольким задачам на ТРЕТЬЕМ ЧАСУ работы внесла меньше 68 строк правок в код репы.

Ну а хули она там делала? Там не было никаких многоуровневых запросов к другим нейронкам. Там не было никаких я хуй знает глубоких исследований. Это была задача именно про разработку. В итоге на 16м часу я вижу что она уже…

Но 5.5 мог внести +5000 строчек кода за 15 минут за нехуй срать.

На самом деле я сейчас нахожусь в одном крайнем вечере от того чтобы перестать пользоваться новыми моделями, и начать юзать их только если я в отчаянии по какой-то причине, хотя я не могу себе представить почему бы я в нем оказался. На 5.5 я…

За сегодняшний день я не смог добавить ни одной задачи, и уже дважды переключал подписку. То бишь третий недельный лимит пошел за сутки, на двух сессиях, котоые so far сделали меньше кода чем я раньше делал за ~5 часов в четырех сессиях 5.5.
Надо пойти поставить свечку против ебучего FOMO. Ведь именно оно орет в оба уха: бля ты…

Anton Gladkov2026-07-1401-market-scansource ↗context

Ебать короче я же уже неделю занимаюсь этой ультра задачей - сделать так чтобы рисеч + копирайтинг + бизнес-ризонинг + (там длинный список) автоматом отрабатывали для ЛЮБОЙ задачи...

В итоге был момент когда Fable вроде что-то вменяемое сделал. Я уж думал было всё.

Anton Gladkov2026-07-1401-market-scansource ↗context

Но потом вышел Sol, и я решил погрузиться в это в четвертый раз, хотя это наверно самая болезненная задача которую я когда-либо делал. Но сука fomo что можно еще лучше не отпускало, и я потратил получается еще несколько дней, все выходные в частности, по 16 часов в день на эту хуйню. В процессе SOL сошел с ума, и сегодня…

Anton Gladkov2026-07-1401-market-scansource ↗context

На момент 6:50pm 13 июля я вам клянусь - 5.5 + Opus делали эту хуйню (и проектирование и реализацию) гораздо лучше чем 5.6 Sol Max Tripple Giga Ultra Think Zalupa nyam nyam, и гораздо лучше чем Fable 5... Они вообще перестали понимать детали задачи. Я им говорю что угодно, и они тупо за это цепляются и водят вокруг…

Anton Gladkov2026-07-1401-market-scansource ↗context

Модели конечно уже деградировали на моей памяти, но так чтобы в десятки-сотни раз туда-сюда - не припомню такого)

Это все равно что если тебе надо миллион гвоздей забить, а у тебя в руке молоток непрерывно меняет свой молекулярный состав, и он довольно редко становится твердый, и надо умудриться ударить по гвоздю именно тогда)))) Сука как так можно работать...

Anton Gladkov2026-07-1401-market-scansource ↗context

Причем я уверен что это чувствуют исключительно люди у которых гигантская репа. Наверняка лендосик оно сделает нормально, или какую-нибудь автоматизацию с тремя кнопками.

Я на фб только и вижу как люди гордятся тем что они црмку сделали в которой можно карточки сука мышкой перетаскивать (один промпт GPT 5.1 мог такое сделать).

Anton Gladkov2026-07-1401-market-scansource ↗context

Если у вас очень сложносоставная репа, и вы в отчаянии, знайте - вы не одиноки.

Если до конца дня я не оседлаю эту ХУЙНЮ, начинаю снова бухать и курить. Nothing really matters.

Так ну я короче все лучше начинаю понимать. Кроме того что сейчас сложно делать какие-то выводы о чем-либо т.к. каждые два часа модель - это совершенно разная штука с разными весами-джусями-пусями, они ещё и переизобрели по-сути сам кодекс.

В стремлении играться с бесполезным бессмысленным пре-альфа-прототипом Ultracode, я заигнорил прошку, которую они частично встроили в интерфейс кодекса, и связали с кодекс-сессиями через кнопку "Add to task".

Новая прошка абсолютно неадекватно ебанутая. Если вам предыдущие прошки казались умными, то эта тогда мыслит на вообще межгалактическом уровне. Как и должно быть, по сравнению с ней 5.6 Sol Max кажется просто недоразвитым. Это по-сути возвращает нас в мир "до GPT 5.5", где PRO гораздо умнее была чем топовый ризонинг обычной модели.

В 5.5 был момент когда обычная модель поравнялась и даже местами обогнала PRO, и это лично меня возмущало, т.к. бесит когда не понятно нихуя что и зачем нужно, и нужно ли.

Так вот: я уже пять тасков кручу по такой мехаике:

More