Superintelligence CouncilСовет гения · sim.im

Anton Gladkov · 2026-09-06 · 08-personal · source ↗

нет никакого смысла юзать сол при живой астре, как не было никакого смысла юзать

нет никакого смысла юзать сол при живой астре, как не было никакого смысла юзать 5.5 при живом соле

каждый раз когда не хочется юзать текущую модель надо не возвращением совка заниматься, а просто давать задачу на медиум или лоу ризонинге, добавляя к промпту "делай сам без субагентов", и все

это будет очень дешево и гораздо умнее предыдущих моделей один хуй

я возвращался на 5.5 сам, но потом потестил 5.6 sol на low/medium и стало понятно что это одновременно дешевле чем 5.5 на xhigh и лучше чем 5.5 xhigh значительно чтобы больше не возвращаться на 5.5 =)

прям ща я вот вижу что единственная разница между GPT 6 max и GPT 6 Medium это невозможность GPT 6 max завершить задачу пока там каждый пиксель не будет проверен и отпидорен

не прерываю просто чтобы посмотреть насколько сильно она уйдет в оверинжиниринг и отойдет от изначальной задачи

пока что кстати вообще не отошла

просто она находит там какие-то микроизъяны и фиксит их

возможно это даже полезно

хз у меня шестерка на лоу не жрет нихуя вообще)

Макс да - жрет как сукин сын

вообще в отличие от сола я теперь еще сильнее вижу разницу между уровнями ризонинга

медиум доделывает и завязывает тогда когда доделал. High дополнительно прогоняет какие-то тесты и из-за этого лупит дольше. Xhigh вот чем от Max отличается я не вижу - и та и другая ебенят до победного

мне думается что надо просто гонять задачи через план моуд

где план модель стоит в конфиге Max

И потом просто снова запускать план моуд и просить проверить все ли ок

скорее всего тот же объем работ который голый макс сделает за сутки итерационка с руками medium сделает за скажем 8 часов

да у меня кстати астра тоже на доки хуй клала, это точно будет проблемой

вообще медиум это самое близкое по ощущениям к родненькой 5.5, только с новыми навыками в инструментарии и более широкими взглядами на вещи =)

но что вот плохо это то что она не меняет масштаб туда-сюда

она получается делает проверку - находит одну хуйню - фиксит ее - по-новой проверяет

хотя она должна отдаляться и смотреть на все глобально

в итоге т.к. она не пишет список а идет по одной хуйне чинить это и растягивается на много суток

двачую что приятно что модель архитектурно не ведет себя опять абсолютно по-новому

я бы охуел понимать что и зачем происходит снова две недели =)

кстати я чето ща подумал что я ни разу не догадывался... попросить в промпте прям не делать одно исправление а смотреть на весь скоуп видимых исправлений и приступать к одному исправлению за раз только если это единственное которое требуется до финиша. А тесты гонять когда предыдущий весь список был сделан чтобы прям все скопом сразу тестить, и не срываться фиксить сразу после теста, а записывать в дальнейший план и двигаться такими более широкими итерациями. Можно прям такое в таску ща докинуть и посмотреть как пойдет)))

она сучка на самом деле даже знает что проблем целый список, просто она реально решает по одной и это поэтому так медленно пиздец

вот Владимир дело говорит. Я ща тоже правильную штуку выше написал очевидно по тому что происходит после того как я это докинул

И у меня возникла мысль которая позволит нам всем друг-другу помочь раз и навсегда (ну или до AGI:))))

Ради таких идей и стоит гонять в отпуск! Ща распишу смысл постом и призову остальных поучаствовать

все эти харнессы скиллы и прочая залупа хайповая от пиздоболов нахуй не нужна, нам нужно совершенно другое

а как человек который утверждает про ignores понял это?

тогда эта фича только появилась в ультра экспериментальном режиме в конфиге

хотя с другой стороны меня настолько устраивало как medium через план моуд работает

что раз это игнорировалось всегда - значит может и нахуй этот план на максе )))

я правда настолько не вижу разницы в качестве создаваемого плана что могу предположить что сила модели не влияет в приниципе на план, а влияет какой-то встроенный в харнесс скилл, поэтому и игнорится эффорт левел из томла

так-то макс по-идее должен делать план в бесконечное число минут дольше чем медиум, ввиду разницы в уровне задротства между этими двумя левелами ризонинга

но я не вижу вообще никакой разницы

у меня макс может планировать 2 минуты и медиум может планировать 20 минут