Superintelligence CouncilСовет гения · sim.im

Search

topic: 05-ai ✕

2,501 passages, newest first · 435 ms

В итоге что мы имеем на сегодняшний день:

Ultracode пользоваться нельзя вообще. Простые вещи (30 минут для 5.5 xhigh) он делает по 7-14 часов.

Сложные - я даже не знаю сколько бы он делал, мне пришлось прервать на 40-м часу работы две сессии, которые я думаю уже никогда бы не завершились.

Но самое страшное это что произошло внутри этих 40-часовых сессий.

Чем ближе к началу отматываешь - тем разумнее телеметрия. В поздней середине (когда перевалило за сутки) - модель уже вела себя довольно странно. В конце - просто бред сумасшедшего, какие-то странные допущения, рандомные надергивания самых разных кусков контекста и прикладывание одного к другому. В целом мне кажется я теперь знаю как…

В итоге когда соседняя сессия SOL и Fable 5 по-отдельности изучили работу этого 40+ часового раннинга, они сказали одно и то же:

"Бля бро вырубай, это пиздец".

Ну и диагноз - то что раньше хорошо работало на 2к строк 5.6 Sol усложнил местами до 100к+ строк каких-то нагромождений инструкций, которые в целом модель для которой он эти инструкции…

Интересно когда вернут что-нибудь хотя бы между тем как было в начале и тем что есть сейчас. Мне кажется сейчас на большой репе GPTхой кодить тупо невозможно. Это иммитация деятельности и палево нервов и токенов хуй пойми зачем)

Я всё думал, зачем они так делают.

Может быть, это всё, конечно, чисто лавэшка. Это нам кажется: модель сегодня чуть умнее, завтра чуть глупее. А для них разница может быть между одним миллиардом в день и тремя миллиардами в день =)

Но мне думается, что дело не только в деньгах. Дело ещё и в тренировке модели.

Надо помнить, что мы уже очень давно и есть её data. Интернет давно прочитан, голод по данным абсолютен. На нас будут учиться её детишки, которые потом придут радовать нас следующими великими релизами.

Если модель тупо делает именно то, что нам нужно, это мило, конечно, но это всего лишь эксплуатация уже пройденного тренинга. Учиться здесь особенно нечему. Повторение не мать учения для модели, которая и так способна бесконечно выдавать результат 2 по формуле 1 + 1.

Другое дело, когда ты управляемо хуяришь метрики во все стороны и смотришь, как шесть миллионов задохликов пытаются к этому приспособиться.

Как они корректируют запросы, действия, подходы и расписание. Как меняют количество и качество девайсов. Как перестраивают риторику, эмоциональное состояние и рабочие процессы. Как злятся, привыкают, сдаются, изобретают костыли и снова начинают верить.

Перед OpenAI разворачивается немыслимая уйма факторов. Не просто наши запросы, а почти вся механика нашей адаптации. Душа пользователя, разложенная по логам.

И если смотреть с этой точки зрения, получается, что задача фронтирного AI-вендора направлена почти в противоположную сторону относительно задачи его пользователя.

Нам нужно, чтобы всё получалось сразу, стабильно и без лишнего мышления.

А им ценнее тот мир, в котором результат получается через жопу, через боль, коррекцию и несколько новых попыток.

Не обязательно потому, что они хотят наших страданий. Просто наши страдания производят гораздо больше ценных данных, чем наше бесшовное счастье.

И, возможно, именно эта эссенция однажды позволит AI выйти за пределы сухой математики и начать понимать не только правильный ответ, но и существо, которое до него добирается.

7 сессий на одной подписке?
Даже 5 нет смысла пускать, не апп так модель начнет выкидывать по capacity
Аккаунты задушены. Для лучших результатов больше 3х подписок нет смысла юзать) Они 5h лимит убрали чтобы в одной гипертрофированной агентами сессии можно было находиться успешно, а не для того чтобы люди 100 сессий запускали)))

40 строк кода тебе и haiku нахуярит если попросишь 40к строк кода
Ну хотя ладно мне нельзя сейчас разговаривать про GPT
У меня просто задача важная, а он мне 1 ДЕНЬ 20 ЧАСОВ уже по ней мозги ебет
Я ему по ебалу хочу свиснуть
ебаный ультракод больше никогда не нажму блядь))
Фиолетовый кал

я думаю надо либо ехать на Бали косынки плести и продавать людям на eBay (скамить на стоимости доставки обязательно для сверхприбылей)
Либо ехать в Усолье Сибирское заниматься рэкетом на трассе
Ну еще если ты сладенький то можно попытаться оказать платные секс услуги

Слушай а помог уже) Я когда первые 5 страниц А4 промпта написал преисполнился уверенностью что с такой детализацией мне и GPT 5.2 сделает то что мне нужно при желании.
А уверенность известный седатив)
Я думаю мне просто обидно стало что модели такие дохуя умные типа выходят а технически мне принципиально проще чем на GPT 5.2 вайбкодиться не стало…

Ну и короче две вещи получается
1) Любить себя и позволить своему вкусу быть ценным, не быть нулем
2) Не быть обоссанным лентяем
Люди которые умеют охуенно рисовать - им не с неба все падает
А нам - кто не умеет, и подавно
Надо садиться и пиздеть с Claude Design часами, смотреть что получается, критиковать
Тебе не обязательно всегда говорить что именно…

мне кажется бро проще чем Claude Design просто не существует в природе
И эффективнее для нулевого уровня
Все эти скиллы итд - это уже требует навыков. Фреймворки там всякие плюс дизайн-системы. Если бы Claude Design не было в природе - тогда да
Но я реально в Claude Deisgn даже ПДФки казенные заполняю уже)
Слишком просто = то что надо)

Это не похоже на правду
У меня сейчас то что я фэйблом сделал четыре дня назад полностью переделывается на рельсы openai 5.6
И уже 20 часов эксперименты гоняются по разным моделям всех ризонинг эффортов
Могу точно сказать что даже Sol Max сильно (на 8-12% мощнее) чем Sol xhigh
А Терра и Луна бьют все модели предыдущих схожих по…

Все что им надо произвести на самом деле - это достаточно мощный AI, который избавит мир от хуевых интерфейсов) Мы настолько близко к этому, что можно сказать уже там:))

Блин короче я все пытался понять что не так с приходом 5.6 Sol. Что-то изменилось, но я не понимал что.

И вот я понял:

Модель теперь делает задачи куда шире и глубже, один промпт вместо 10-30-50, и при этом он лупит куда быстрее чем эта плеяда, но все равно 3-6 часов. И много сессий-то…

More