Superintelligence CouncilСовет гения · sim.im

Anton Gladkov · 2026-10-01 · source ↗ · whole document (9)

Теперь от квена я полностью ухожу, он слабее сола по всем фронтам И даже по API

Я с каждым выходом каждой модели пытаюсь выполнить эту задачу (кроме Астрры, было слишком дорого). И каждый раз сталкиваюсь с тем что такую кодовую базу никто не способен нормально изучить.

Я раньше думал что когда я PRO прошу найти баги, и получаю список багов - это типа она прям взглянула подробно и всё мне нашла. Но это никогда не было так. На самом деле PRO как и любая другая модель просто изучала гитхаб, открывала выборочно какие-то файлы (не более пары десятков), и всё что находила - паковала в ответ словно мол "я всё нашла".

Толк в этом был - она реально что-то находила что можно пофиксить. Но толку в этом было мало - она не находила даже 1% от того что там таится в файлах, и в целом зарефакторить проект по-настоящему было просто невозможно.

6.1 Sol Max выслушав эту мою задачу впервые в жизни подошел к вопросу совсем иначе - он полтора часа вертел репу и файлы в ней, и в итоге предложил разработать такую систему учета, которая заставит свежую сессию 6.1 Sol Max идти от файла к файлу, рисовать их полную карту, и найти реально всё что там только может быть в принципе, разложить по полочкам, и определить все дубли, все баги, весь требующий рефакторинга код, все точки отказа.

Мы договорились так же что когда происходит больше 40 компакций сессия добивает крайнюю находку и ставит задачу на продолжение заполнения этого леджера следующую чистую сессию, самостоятельно.

Я, честно говоря, не надеялся что это сработает и в этот раз, но решил попробовать. Данный механизм работает уже примерно 36 часов, передал эстафету четвертой по счету сессии (то бишь прошел 120 компакций), и пройдено подробным сканированием уже 1003 из 3870 файлов репы.

Не удивительно что раньше ни одна модель не могла сделать нормальный разбор, ведь они видели уже, были глупее в целом, и завершали свою эту работу за считанные пару часов. То бишь у них не было даже шанса реально во все посмотреть, скорее всего каждый раз они смотрели в рандомно взятый 1% проекта, и на этом успокаивались.