Superintelligence CouncilСовет гения · sim.im

Search

from: 2026-01-01 ✕

6,354 passages, newest first · 90 ms

Хз пацаны, последняя модель которая могла дойти до состояния "я не вижу чего улучшать" на моей памяти была GPT 5.5 xhigh.

Sol'у можно было кормить один и тот же кусок работы снова и снова, и он всегда находил там чего улучшать. Причем 5.6 Sol прошка могла поставить какому-то куску оценку 9.8 из 10, что выглядит…

Для меня способность LLM найти баги вообще не показатель, потому что она их найдет абсолютно всегда.

Причем она по кругу их гоняет.

Условно: "база плохо отвечает, надо проставить индексы" легко перетекает в "базу надо перекроить" в "от базы надо отъебаться" в "база плохо отвечает, надо проставить индексы".

Тупо можно 100 раз у нее спросить пора ли заканчивать работать с базой и переходить дальше, и она если так вопрос сформулировать обязательно скажет "конечно пора, надо уже двигаться дальше", даже если база нихуя не пашет по задаче. Но если настоять мол давай доделаем базу-то блядь, то она скажет что это реально way to go, и она слишком поторопилась…

По анализу GPT 6 Astra Pro я не вижу никаких существенных улучшений в этом моменте) Она мне сказала то же что я уже сто раз видел раньше, и какого-то чуда в духе "Окей бро я просканила все что вы делали раньше с долбаебками до гениальной меня, и сейчас наконец помогу тебе сделать все как надо с первого раза" – я…

А то что она в блендере вам там модели какие-то пиздатые нарисовала.. Ну это классно конечно, но хули вы с ними там делать будете в мире безработных не особо понятно)

Хочется чтобы она таки обычные саасики научилась доделывать для начала =)

Но это не то что я кидаю кирпич в ебало Астре, может она сейчас допилит таски за которые раньше 5.6 Sol брался уже двадцать раз без хэппи энда, и я охуею с того как все классно теперь после этого работает. Скоро увидим =)))

Anton Gladkov2026-09-0607-businesssource ↗context

это экономика, а значит лично Бог, ведь именно он её создал, как и всю остальную хуйню

сложно спорить с тем что никакие успехи в блендере никому не принесут вообще нихуя в деньгах даже если очень-очень-очень сильно постараться

Anton Gladkov2026-09-0607-businesssource ↗context

А мир становится все дороже, я хуею с того насколько

Мы вот съездили на МАШИНЕ не пересекая никаких границ, еще и шерили AirBnB на две семьи типа. Казалось бы - чип трип.

Жрали в пабах и из магазина. И то и другое вроде как дешево.

Anton Gladkov2026-09-0607-businesssource ↗context

Не купили вообще нихуя, не было настроения, просто по нулям, ноль левых покупок. Ну ладно я одну шоколадку взял в каком-то месте за 10 фунтов ща вот нашел в рюкзаке)

Как жестко надо трахнуть блендер чтобы окупить хотя бы такую жалкую автомобильную поездку по UK?

Anton Gladkov2026-09-0607-businesssource ↗context

Я бы тоже может сидел книжки писал в свое удовольствие, но надо быть реалистом - я не знаю никого кто написал бы книгу и заработал на этом нормальное лавэ.

А лайки чтоб заработать можно как Саня просто рилсы про дудя ебашить, для этого LLM не нужна никакая даже. Но надо зарабатывать не лайки а филки, а всем кто этого не понимает…

Anton Gladkov2026-09-0608-personalsource ↗context

нет никакого смысла юзать сол при живой астре, как не было никакого смысла юзать 5.5 при живом соле

каждый раз когда не хочется юзать текущую модель надо не возвращением совка заниматься, а просто давать задачу на медиум или лоу ризонинге, добавляя к промпту "делай сам без субагентов", и все

Anton Gladkov2026-09-0608-personalsource ↗context

это будет очень дешево и гораздо умнее предыдущих моделей один хуй

я возвращался на 5.5 сам, но потом потестил 5.6 sol на low/medium и стало понятно что это одновременно дешевле чем 5.5 на xhigh и лучше чем 5.5 xhigh значительно чтобы больше не возвращаться на 5.5 =)

Anton Gladkov2026-09-0608-personalsource ↗context

прям ща я вот вижу что единственная разница между GPT 6 max и GPT 6 Medium это невозможность GPT 6 max завершить задачу пока там каждый пиксель не будет проверен и отпидорен

не прерываю просто чтобы посмотреть насколько сильно она уйдет в оверинжиниринг и отойдет от изначальной задачи

Anton Gladkov2026-09-0608-personalsource ↗context

пока что кстати вообще не отошла

просто она находит там какие-то микроизъяны и фиксит их

возможно это даже полезно

хз у меня шестерка на лоу не жрет нихуя вообще)

Макс да - жрет как сукин сын

вообще в отличие от сола я теперь еще сильнее вижу разницу между уровнями ризонинга

Anton Gladkov2026-09-0608-personalsource ↗context

медиум доделывает и завязывает тогда когда доделал. High дополнительно прогоняет какие-то тесты и из-за этого лупит дольше. Xhigh вот чем от Max отличается я не вижу - и та и другая ебенят до победного

Anton Gladkov2026-09-0608-personalsource ↗context

мне думается что надо просто гонять задачи через план моуд

где план модель стоит в конфиге Max

И потом просто снова запускать план моуд и просить проверить все ли ок

скорее всего тот же объем работ который голый макс сделает за сутки итерационка с руками medium сделает за скажем 8 часов

Anton Gladkov2026-09-0608-personalsource ↗context

да у меня кстати астра тоже на доки хуй клала, это точно будет проблемой

вообще медиум это самое близкое по ощущениям к родненькой 5.5, только с новыми навыками в инструментарии и более широкими взглядами на вещи =)

Anton Gladkov2026-09-0608-personalsource ↗context

но что вот плохо это то что она не меняет масштаб туда-сюда

она получается делает проверку - находит одну хуйню - фиксит ее - по-новой проверяет

хотя она должна отдаляться и смотреть на все глобально

Anton Gladkov2026-09-0608-personalsource ↗context

в итоге т.к. она не пишет список а идет по одной хуйне чинить это и растягивается на много суток

двачую что приятно что модель архитектурно не ведет себя опять абсолютно по-новому

я бы охуел понимать что и зачем происходит снова две недели =)

Anton Gladkov2026-09-0608-personalsource ↗context

кстати я чето ща подумал что я ни разу не догадывался... попросить в промпте прям не делать одно исправление а смотреть на весь скоуп видимых исправлений и приступать к одному исправлению за раз только если это единственное которое требуется до финиша. А тесты гонять когда предыдущий весь список был сделан чтобы прям все скопом сразу тестить, и не срываться фиксить…

More