Superintelligence CouncilСовет гения · sim.im

Search

topic: 01-market-scan ✕

146 passages, newest first · 6 ms

Anton Gladkov2026-08-2101-market-scansource ↗context

У нас на текущий момент нет никаких данных пользовательских которые имеют для нас большое значение. Я думаю это важно. Что угодно можно править/удалять/проводить с данными опасные операции - это никак не возбраняется. На данном этапе нам важен только код рабочих элементов, причем самая последняя стабильная его продуктовая версия. Повторяю - даже если кажется что какие-то пользовательские данные есть и…

Anton Gladkov2026-08-2101-market-scansource ↗context

Ты действуешь сразу и в Senser и Mailboxes репозиториях, на обоих их серверах.

__

Ты уже сделал несколько волн, в первой из них создал леджер, заполненный прогрессом по задачам.

https://github.com/XXXXXX

Anton Gladkov2026-08-2101-market-scansource ↗context

Давай двигаться к следующему отрезку =)

бери целиком следующую задачу, и если что-то к ней нужно подготовить, то и это.

Anton Gladkov2026-08-2101-market-scansource ↗context

ускорь процесс если можешь, можно скипнуть формальности которые носят реально больше церемониальный чем глубоко практический характер)
Я короче понял еще на той неделе что меня ДИКО тормозило и создавало УЙМУ лишнего кода то что ЛЛМка не знает насколько мы на слабоумии и отваге двигаемся
И ей кажется что если хоть одна буква есть которую можно назвать "пользовательские данные"
То ЛЛМка…

Anton Gladkov2026-08-0901-market-scansource ↗context

Тэкс, ну короче гайз как вы знаете я занимаюсь некрофилией поебывая свой давно уже отрафированный вайбкодингом мозг уже как говорят историки "с незапамятных времен".

Сегодня я хвастался сам перед собой воистину грандиозным прорывом: я добился такого качества маркет скана, которое выше чем то что я когда-либо делал собственными руками. Я даже за 100к долларов не смог бы потратить достаточно…

Anton Gladkov2026-08-0901-market-scansource ↗context

Это ровно то что мне нужно для того чтобы в ближайшем будущем зарелизить мой self-serve SLSBMB AI, к чему я так яростно стремлюсь последние несколько месяцев.

Сказать что я неоднократно запускал тесты на разные модели чтобы понять на каких моделях маркет скан отрабатывает лучше всего - ничего не сказать. Думаю что я спалил десятки миллиардов токенов на эти эксперименты.

Anton Gladkov2026-08-0901-market-scansource ↗context

В пике безумие доходило до того что один маркет скан ДЛЯ ОДНОГО ПРОДУКТА использовал ~290-500 ПОСЛЕДОВАТЕЛЬНЫХ СЕССИЙ БЛЯДЬ. Рекордный такой ран занимал изи 2.5 дня.

В итоге мне удалось зарефайнить макулатуру на которой живет маркет скан и все раны таким образом, что достаточно 4 последовательных сессий: Research (до 50 минут), Writer (до 50 минут), Market Arms (как называются…

Anton Gladkov2026-08-0901-market-scansource ↗context

Я уже сказал что я делаю конкретно эту систему несколько месяцев, и она выпила всю мою кровь, а так же сперму, пропитку тканей слезных желез, и секрет простаты.

Я занимаюсь этим круглосуточно, и меня это порядком заебало.

Anton Gladkov2026-08-0901-market-scansource ↗context

Но я не сдаюсь.

И вот сегодня я получил колоссальные результаты, и осталось В КОТОРЫЙ СУКА РАЗ провести эксперимент не на конкретном сете моделей в которые я верю, а на разных моделях, и сравнить каждый сегмент меж собой, чтобы понять какой из раннеров пускать на какой модели для максимальной комбинаторной эффективности.

Anton Gladkov2026-08-0901-market-scansource ↗context

По-сути мне надо было просто прогнать весь маркет скан (все 4 его сессии) на каждой из моделей, несколько раз, и получить средние значения, которые можно будет считать репрезентативными.

Опять же, поскольку я это делаю не первый и не третий десяток раз, я думаю что результат реально репрезентативный, а не то что "кто-то что-то сделал и посчитал это…

Anton Gladkov2026-08-0901-market-scansource ↗context

Я бы хуйню вам рандомную после таких мучений показывать не стал, потому что мне потом еще отвечать за это когда я начну кому-то из вас продавать этот солюшен за сука филки;))))))

Следующим сообщением прилетит обезличенный но достаточный для понимания разницы между моделями в креативном поле итог этого гигантского теста, который занял весь сегодняшний день. Вы увидите средние значения за…

Anton Gladkov2026-08-0901-market-scansource ↗context

Единственное что я не смогу вам показать - это Fable 5 и Opus 5, поскольку их уже нет в моем ростере, но я не грущу по ним абсолютно, поскольку я уже и так знаю на базе ДЕСЯТКОВ экспериментов как бы они себя показали. Fable показал бы себя хуже чем Opus. Fable вообще весьма посредственен на текущем поле в вопросах глубины креатива…

Anton Gladkov2026-08-0901-market-scansource ↗context

Я в итоге конкретно по Writing юзаю QWEN3.8MAX с фоллбеком на GPT 5.5 xhigh, где фоллбек хитрый - они обе будут всегда писать контент, просто судья должен будет выбрать из двух, и в 30% случаев он выбирает 5.5 xhigh, что невероятно крутой результат для модели которой уже много месяцев.

Anton Gladkov2026-08-0901-market-scansource ↗context

Ну а лидера по остальным критериям я думаю вы легко увидите. Многие думают что Fable конкурент Sol, но в рисеч задачах Fable показывает В 5 И БОЛЕЕ РАЗ ниже цифры чем Sol. На моих этих вот креативных задачах это просто факт. Fable рядом с Kimi. Sol Max где-то в космосе.

Anton Gladkov2026-08-0901-market-scansource ↗context

Еще бы эта пизда умела кодить без ухода в безумие, цены бы не было. На рисеч и райтинг задачах Sol Max удивительным образом не уходит в безумие. Он реально сам доделывает всю работу и закругляется за 50 минут (против 17 минут 5.5 xhigh). На кодинговых задачах он не закругляется в целом никогда, во всяком случае я ни разу не…

Anton Gladkov2026-08-0901-market-scansource ↗context

Я понимаю что нихуя не понятно из текста выше, но это потому что вы не утрудились скормить это своей GPT или Claude и поговорить об этом =)

GPT 5.5 xhigh находит 26 гипотез там где GPT 5.6 Sol Max находит 28, что говорит о том что GPT 5.5 xhigh невероятная модель всё еще на сегодняшний день, однако…

Anton Gladkov2026-08-0901-market-scansource ↗context

А маркет скан нет смысла делать снова и снова - ты его делаешь раз в жизни чтобы запланировать работу на весь следующий год.

То бишь GPT 5.5 Xhigh дает тебе по тем же гипотезам Total Addressible Market capacity ~ в 4-5раз ниже чем GPT 5.6 Sol Max.

Anton Gladkov2026-08-0901-market-scansource ↗context

И все это стоит просто лишних 20-30 минут заебистого рассуждения модели.

Вы не в моей нише, поэтому вы не понимаете насколько это важно, но это блядь важно просто шо пиздец)

И другие цифры там есть веселые которые можно трактовать занятным образом, оставляю вас гадать на них. Когда я релизну свой продукт я думаю все в итоге объяснится его же…

Anton Gladkov2026-08-0901-market-scansource ↗context

Резюмируя: в мелочах кажется что модели недалеко друг от друга ушли, но правда в том что GPT 5.6 Sol Max ушел от GPT 5.5 xhigh настолько далеко, что он выдает в бизнес выражении контента за лишние 15 минут рассуждения как разница между 1 годом и 10 годами скурпулезной работы отдела продаж по рисечу.

Anton Gladkov2026-08-0901-market-scansource ↗context

Это реально кроме шуток ускорение отдела продаж в 8 раз на десятилетнем отрезке, за лишние 20 минут копеечного палева токенов.

Это сравнение для самых маленьких. Если там копаться в деталях, мы легко найдем ещё бОльшее ускорение, а так же вещи которые предыдущими моделями просто в принице были недостижимы, типа определенных игрищ текстовыми конструкциями, но сегодня нет сил расписывать это)

More