У нас на текущий момент нет никаких данных пользовательских которые имеют для нас большое значение. Я думаю это важно. Что угодно можно править/удалять/проводить с данными опасные операции - это никак не возбраняется. На данном этапе нам важен только код рабочих элементов, причем самая последняя стабильная его продуктовая версия. Повторяю - даже если кажется что какие-то пользовательские данные есть и…
Search
146 passages, newest first · 6 ms
Ты действуешь сразу и в Senser и Mailboxes репозиториях, на обоих их серверах.
__
Ты уже сделал несколько волн, в первой из них создал леджер, заполненный прогрессом по задачам.
https://github.com/XXXXXX
Давай двигаться к следующему отрезку =)
бери целиком следующую задачу, и если что-то к ней нужно подготовить, то и это.
ускорь процесс если можешь, можно скипнуть формальности которые носят реально больше церемониальный чем глубоко практический характер)
Я короче понял еще на той неделе что меня ДИКО тормозило и создавало УЙМУ лишнего кода то что ЛЛМка не знает насколько мы на слабоумии и отваге двигаемся
И ей кажется что если хоть одна буква есть которую можно назвать "пользовательские данные"
То ЛЛМка…
Тэкс, ну короче гайз как вы знаете я занимаюсь некрофилией поебывая свой давно уже отрафированный вайбкодингом мозг уже как говорят историки "с незапамятных времен".
Сегодня я хвастался сам перед собой воистину грандиозным прорывом: я добился такого качества маркет скана, которое выше чем то что я когда-либо делал собственными руками. Я даже за 100к долларов не смог бы потратить достаточно…
Это ровно то что мне нужно для того чтобы в ближайшем будущем зарелизить мой self-serve SLSBMB AI, к чему я так яростно стремлюсь последние несколько месяцев.
Сказать что я неоднократно запускал тесты на разные модели чтобы понять на каких моделях маркет скан отрабатывает лучше всего - ничего не сказать. Думаю что я спалил десятки миллиардов токенов на эти эксперименты.
В пике безумие доходило до того что один маркет скан ДЛЯ ОДНОГО ПРОДУКТА использовал ~290-500 ПОСЛЕДОВАТЕЛЬНЫХ СЕССИЙ БЛЯДЬ. Рекордный такой ран занимал изи 2.5 дня.
В итоге мне удалось зарефайнить макулатуру на которой живет маркет скан и все раны таким образом, что достаточно 4 последовательных сессий: Research (до 50 минут), Writer (до 50 минут), Market Arms (как называются…
Я уже сказал что я делаю конкретно эту систему несколько месяцев, и она выпила всю мою кровь, а так же сперму, пропитку тканей слезных желез, и секрет простаты.
Я занимаюсь этим круглосуточно, и меня это порядком заебало.
Но я не сдаюсь.
И вот сегодня я получил колоссальные результаты, и осталось В КОТОРЫЙ СУКА РАЗ провести эксперимент не на конкретном сете моделей в которые я верю, а на разных моделях, и сравнить каждый сегмент меж собой, чтобы понять какой из раннеров пускать на какой модели для максимальной комбинаторной эффективности.
По-сути мне надо было просто прогнать весь маркет скан (все 4 его сессии) на каждой из моделей, несколько раз, и получить средние значения, которые можно будет считать репрезентативными.
Опять же, поскольку я это делаю не первый и не третий десяток раз, я думаю что результат реально репрезентативный, а не то что "кто-то что-то сделал и посчитал это…
Я бы хуйню вам рандомную после таких мучений показывать не стал, потому что мне потом еще отвечать за это когда я начну кому-то из вас продавать этот солюшен за сука филки;))))))
Следующим сообщением прилетит обезличенный но достаточный для понимания разницы между моделями в креативном поле итог этого гигантского теста, который занял весь сегодняшний день. Вы увидите средние значения за…
Единственное что я не смогу вам показать - это Fable 5 и Opus 5, поскольку их уже нет в моем ростере, но я не грущу по ним абсолютно, поскольку я уже и так знаю на базе ДЕСЯТКОВ экспериментов как бы они себя показали. Fable показал бы себя хуже чем Opus. Fable вообще весьма посредственен на текущем поле в вопросах глубины креатива…
Я в итоге конкретно по Writing юзаю QWEN3.8MAX с фоллбеком на GPT 5.5 xhigh, где фоллбек хитрый - они обе будут всегда писать контент, просто судья должен будет выбрать из двух, и в 30% случаев он выбирает 5.5 xhigh, что невероятно крутой результат для модели которой уже много месяцев.
Ну а лидера по остальным критериям я думаю вы легко увидите. Многие думают что Fable конкурент Sol, но в рисеч задачах Fable показывает В 5 И БОЛЕЕ РАЗ ниже цифры чем Sol. На моих этих вот креативных задачах это просто факт. Fable рядом с Kimi. Sol Max где-то в космосе.
Еще бы эта пизда умела кодить без ухода в безумие, цены бы не было. На рисеч и райтинг задачах Sol Max удивительным образом не уходит в безумие. Он реально сам доделывает всю работу и закругляется за 50 минут (против 17 минут 5.5 xhigh). На кодинговых задачах он не закругляется в целом никогда, во всяком случае я ни разу не…
Я понимаю что нихуя не понятно из текста выше, но это потому что вы не утрудились скормить это своей GPT или Claude и поговорить об этом =)
GPT 5.5 xhigh находит 26 гипотез там где GPT 5.6 Sol Max находит 28, что говорит о том что GPT 5.5 xhigh невероятная модель всё еще на сегодняшний день, однако…
А маркет скан нет смысла делать снова и снова - ты его делаешь раз в жизни чтобы запланировать работу на весь следующий год.
То бишь GPT 5.5 Xhigh дает тебе по тем же гипотезам Total Addressible Market capacity ~ в 4-5раз ниже чем GPT 5.6 Sol Max.
И все это стоит просто лишних 20-30 минут заебистого рассуждения модели.
Вы не в моей нише, поэтому вы не понимаете насколько это важно, но это блядь важно просто шо пиздец)
И другие цифры там есть веселые которые можно трактовать занятным образом, оставляю вас гадать на них. Когда я релизну свой продукт я думаю все в итоге объяснится его же…
Резюмируя: в мелочах кажется что модели недалеко друг от друга ушли, но правда в том что GPT 5.6 Sol Max ушел от GPT 5.5 xhigh настолько далеко, что он выдает в бизнес выражении контента за лишние 15 минут рассуждения как разница между 1 годом и 10 годами скурпулезной работы отдела продаж по рисечу.
Это реально кроме шуток ускорение отдела продаж в 8 раз на десятилетнем отрезке, за лишние 20 минут копеечного палева токенов.
Это сравнение для самых маленьких. Если там копаться в деталях, мы легко найдем ещё бОльшее ускорение, а так же вещи которые предыдущими моделями просто в принице были недостижимы, типа определенных игрищ текстовыми конструкциями, но сегодня нет сил расписывать это)