Superintelligence CouncilСовет гения · sim.im

Search

12,034 passages, newest first · 70 ms

Anton Gladkov2026-09-0608-personalsource ↗context

она сучка на самом деле даже знает что проблем целый список, просто она реально решает по одной и это поэтому так медленно пиздец

вот Владимир дело говорит. Я ща тоже правильную штуку выше написал очевидно по тому что происходит после того как я это докинул

Anton Gladkov2026-09-0608-personalsource ↗context

И у меня возникла мысль которая позволит нам всем друг-другу помочь раз и навсегда (ну или до AGI:))))

Ради таких идей и стоит гонять в отпуск! Ща распишу смысл постом и призову остальных поучаствовать

Anton Gladkov2026-09-0608-personalsource ↗context

все эти харнессы скиллы и прочая залупа хайповая от пиздоболов нахуй не нужна, нам нужно совершенно другое

а как человек который утверждает про ignores понял это?

тогда эта фича только появилась в ультра экспериментальном режиме в конфиге

Anton Gladkov2026-09-0608-personalsource ↗context

хотя с другой стороны меня настолько устраивало как medium через план моуд работает

что раз это игнорировалось всегда - значит может и нахуй этот план на максе )))

я правда настолько не вижу разницы в качестве создаваемого плана что могу предположить что сила модели не влияет в приниципе на план, а влияет какой-то встроенный в харнесс скилл, поэтому и игнорится эффорт…

Anton Gladkov2026-09-0608-personalsource ↗context

так-то макс по-идее должен делать план в бесконечное число минут дольше чем медиум, ввиду разницы в уровне задротства между этими двумя левелами ризонинга

но я не вижу вообще никакой разницы

у меня макс может планировать 2 минуты и медиум может планировать 20 минут

1) Промпт должен описывать подробнейше причинно-следственные связи из твоей головы, в полном объеме, надо прям методичку написать, иначе никак. Ллмке поручить написать за тебя - не получится. Она сократит и уничтожит смысл причинно-следственности, скукожив его до неразворачиваемости до качества которое нужно тебе. Я с этим два месяца проебался.

2) Надо убедиться что нигде в радиусе операций модели нет ни одного скриптового валидатора, верификатора, гейта, итд. Никакой детерминистики там быть не должно кроме инструмента транспорта данных, который не активный а пассивный. Он принимает данные от LLMки которая опять же очень хорошо понимает как их туда складывать потому что ей очень хорошо описали и объяснили.

3) Надо убедиться что в гигантском промпте со всеми объяснениями нет строгих запретов.

Часто у людей там НЕ, НЕ, НЕ, НЕ - это не работает.

Совокупные запреты обычно обнимают задачу настолько широко что целью модели становится не выполнить задание, а не нарушить запрет. Это влияет на качество... ну как сказать... ну процентов на 99.5% =))))))))

Если рисеч ну очень большой, то нужно чтобы это был не один воркер а последовательные воркеры которые выполняют каждый свою задачу. У меня в рисечере для кампаний клиентских таких воркеров в ряду.... 36 штук

время от времени между ними воркеры которые проверяют качество выполнения предыдущими воркерами инструкций и вносят правки если видят что можно было лучше. Один проверяющий/корректирующий воркер (я их называю ре-чекерами) может справиться (у меня) не более чем с 4 отработавшими предыдущими воркерами. Если больше - он плывет.

Ну и очень важно как устроена работа с базой в процессе выполнения задачи, потому что рисечер не может сделать качественный рисеч если он все держит и решает в уме

В уме у модели все начинает усредняться к среднему знаменателю всего что туда попало

Модель должна заглядывать в ячейки поступательно, получать в ячейке контракт на созидание, делать работу, и ставить галочку мол ячейка готова.

Тогда по-сути рисеч/копирайт/креатив превращается для модели в кодинговую задачу

Она же может 450 файлов поменять уникальным образом для каждого файла - вот и 450 задач она сможет выполнить на макс ризонинге уникально.

Но если не разбить так а попросить сделать 450 результатов в уме - получишь 450 порций говна

Это звучит дороговато но иначе никак, во всяком случае я не добился, хотя я на это потратил половину от всего времени которое потратил на проект)

Да пацаны вырубайте как минимум субагентов

расход уменьшился во много раз на Max в задаче которая с утра крутится и сожрала больше недельного лимита в одну каску с агентами

это при том что теперь кэша больше в модель залетает т.к. она читает разросшуюся свою сессию целиком

просто модели пока не умеют эффективно работать с агентами

агент получает уйму хуйни на входе + весь контракт всей репы + весь харнесс итд, чтобы просто две кнопки нажать, и таких агентов модель спаунит сотни

я заметил что астра прям ну очень ебать щедро ими пользуется

например чтобы внести правки в док она отдельного агента зовет который над чем-то там думает 10 минут

причем она еще тратит уйму ресурсов чтобы аутпутнуть ему задачу, прочитать все что он делает, погасить его, итд

Я тупо если честно не понимаю если рисую на схеме это все - зачем

я не вижу в этом ни ускорения, ни увеличения качества, но вижу уменьшение качества и ебанистическое увеличение расхода

на мой скромный взгляд субагентская тема это просто способ вытаскивания токенов из корпоратов

и смысла в этом не было бы даже если бы можно было

потому что модель за последние 2 суток изменили тридцать раз

Весь прикол в том что она "в среднем выдает за Х усилий от хумана"

Я понимаю как в бенчмарк запихать например качество текста, которое можно распедалить на десятки параметров

И то ща понял что это человек может судить, а не машина

у меня Sol называл самыми качественными письмами самые хуевые

Потому что его морализатор встроенный спокоен, а для него это самый главный вождь всех оценщиков

При этом Qwen давал письмам самую справедливую оценку, потому что он и писал и пишет все еще лучше всех

Ну а еще бенчмаркинг это ебать затратно по токенам

у меня есть один бенчмарк маркет скана, т.к. без него я бы помер уже понимать что там как - слишком много всего

More