Superintelligence CouncilСовет гения · sim.im

Search

topic: 06-tools ✕

2,121 passages, newest first · 9 ms

В публичный ZIP входят обезличенные уроки и инструкции. Сырые переписки, секреты и личные данные остаются вне пакета. При сомнении верните его агенту на проверку.

Выявленные подмены и нарушения правил исключают материал из общего сбора. Повреждённый ZIP можно пересобрать. Техническая проверка не доказывает авторство модели.

💜 Запускайте агентов. Пусть ваши самые дорогие факапы наконец начнут приносить пользу всему экипажу, включая и начиная с вас. Мы уже заплатили за этот опыт — теперь заберём из него максимум.

Астрочке спасибо от всего не только лишь сердца, а вам гайз от меня маленькое дополнение: надеюсь вы понимаете что задача в файле выше описана специально уже от вашего лица.

Если кто-то думает что я так хитро хочу хакнуть ваш комп, подумайте ещё раз. Вы можете проверить это через ту же Астру в какой-нибудь специально выделенной для этого опрысканной дихлофосом сессии.

Однако когда вы убедитесь что эксперимент чистый и честный, что произойдет с вероятностью 146%, пожалуйста запустите отдельную сессию и для уверенности что модель не стирнится куда-нибудь…

Можете опять же результат проверить через отдельную сессию у которой вы спросите рассказав преамбулу не пытаются ли нас тут хакнуть жестко. Я думаю ваша Астра вам объяснит что ничего кроме пользы получить из этого опыта просто не получится, и рисков нет абсолютно никаких)

Единственное - вам это обойдется в какие-то часы работы Astra Max, но оно того стоит;)

И там уже выкорчеваны мои первоначальные ошибки из-за которых Астра работала десятки часов в этом направлении. Мы не сразу догадались что читать эмиссию всего инференса каждой сессии ничем не помогает и очень сильно мешает (в моем случае Астра посчитала что если так дальше читать…

В наших начинаниях обычно не участвует слишком много людей, но я надеюсь что хоть кто-то поделится, и мы расширим карту и поймем насколько разные у нас в сущности подходы и проблемы. Прикиньте как интересно будет посмотреть на общий Diff и уйму других метрик которые можно из этого измерить:)

Science is interesing. And if you don't agree you can fuck off:******

@master_klinka го сыграем в аркомаг! Жми "в бой" =)

1) Промпт должен описывать подробнейше причинно-следственные связи из твоей головы, в полном объеме, надо прям методичку написать, иначе никак. Ллмке поручить написать за тебя - не получится. Она сократит и уничтожит смысл причинно-следственности, скукожив его до неразворачиваемости до качества которое нужно тебе. Я с этим два месяца проебался.

2) Надо убедиться что нигде в радиусе операций модели нет ни одного скриптового валидатора, верификатора, гейта, итд. Никакой детерминистики там быть не должно кроме инструмента транспорта данных, который не активный а пассивный. Он принимает данные от LLMки которая опять же очень хорошо понимает как их туда складывать потому что ей очень хорошо описали и объяснили.

3) Надо убедиться что в гигантском промпте со всеми объяснениями нет строгих запретов.

Часто у людей там НЕ, НЕ, НЕ, НЕ - это не работает.

Совокупные запреты обычно обнимают задачу настолько широко что целью модели становится не выполнить задание, а не нарушить запрет. Это влияет на качество... ну как сказать... ну процентов на 99.5% =))))))))

Если рисеч ну очень большой, то нужно чтобы это был не один воркер а последовательные воркеры которые выполняют каждый свою задачу. У меня в рисечере для кампаний клиентских таких воркеров в ряду.... 36 штук

время от времени между ними воркеры которые проверяют качество выполнения предыдущими воркерами инструкций и вносят правки если видят что можно было лучше. Один проверяющий/корректирующий воркер (я их называю ре-чекерами) может справиться (у меня) не более чем с 4 отработавшими предыдущими воркерами. Если больше - он плывет.

Ну и очень важно как устроена работа с базой в процессе выполнения задачи, потому что рисечер не может сделать качественный рисеч если он все держит и решает в уме

В уме у модели все начинает усредняться к среднему знаменателю всего что туда попало

Модель должна заглядывать в ячейки поступательно, получать в ячейке контракт на созидание, делать работу, и ставить галочку мол ячейка готова.

Тогда по-сути рисеч/копирайт/креатив превращается для модели в кодинговую задачу

Она же может 450 файлов поменять уникальным образом для каждого файла - вот и 450 задач она сможет выполнить на макс ризонинге уникально.

Но если не разбить так а попросить сделать 450 результатов в уме - получишь 450 порций говна

Это звучит дороговато но иначе никак, во всяком случае я не добился, хотя я на это потратил половину от всего времени которое потратил на проект)

Да пацаны вырубайте как минимум субагентов

расход уменьшился во много раз на Max в задаче которая с утра крутится и сожрала больше недельного лимита в одну каску с агентами

это при том что теперь кэша больше в модель залетает т.к. она читает разросшуюся свою сессию целиком

просто модели пока не умеют эффективно работать с агентами

агент получает уйму хуйни на входе + весь контракт всей репы + весь харнесс итд, чтобы просто две кнопки нажать, и таких агентов модель спаунит сотни

я заметил что астра прям ну очень ебать щедро ими пользуется

например чтобы внести правки в док она отдельного агента зовет который над чем-то там думает 10 минут

причем она еще тратит уйму ресурсов чтобы аутпутнуть ему задачу, прочитать все что он делает, погасить его, итд

Я тупо если честно не понимаю если рисую на схеме это все - зачем

я не вижу в этом ни ускорения, ни увеличения качества, но вижу уменьшение качества и ебанистическое увеличение расхода

на мой скромный взгляд субагентская тема это просто способ вытаскивания токенов из корпоратов

и смысла в этом не было бы даже если бы можно было

потому что модель за последние 2 суток изменили тридцать раз

Весь прикол в том что она "в среднем выдает за Х усилий от хумана"

Я понимаю как в бенчмарк запихать например качество текста, которое можно распедалить на десятки параметров

More