Superintelligence CouncilСовет гения · sim.im

Anton Gladkov · 2026-10-01 · 09-general · source ↗

Теперь от квена я полностью ухожу, он слабее сола по всем фронтам И даже по API

Теперь от квена я полностью ухожу, он слабее сола по всем фронтам

И даже по API на моих продовых раннерах сол в 5 раз лучше и в 2 раза дешевде

Один маркет скан на квене стоит порядка 200-250 баксов а на соле до 100 баксов

При том что сол выдает в два-три раза больше аутпута за эти деньги (маркет скан получается в три раза качественнее)

Когда я понял сколько нынче стоит 6.1 Sol Max на пятисотой подписке, и пока это не понерфили, я вернулся к задаче своей мечты - прокрыжить весь свой продукт на предмет всех возможных багов и расхождений и устаревшего кода и дубликатов итд.

Я с каждым выходом каждой модели пытаюсь выполнить эту задачу (кроме Астрры, было слишком дорого). И каждый раз сталкиваюсь с тем что такую кодовую базу никто не способен нормально изучить.

Я раньше думал что когда я PRO прошу найти баги, и получаю список багов - это типа она прям взглянула подробно и всё мне нашла. Но это никогда не было так. На самом деле PRO как и любая другая модель просто изучала гитхаб, открывала выборочно какие-то файлы (не более пары десятков), и всё что находила - паковала в ответ словно мол "я всё нашла".

Толк в этом был - она реально что-то находила что можно пофиксить. Но толку в этом было мало - она не находила даже 1% от того что там таится в файлах, и в целом зарефакторить проект по-настоящему было просто невозможно.

6.1 Sol Max выслушав эту мою задачу впервые в жизни подошел к вопросу совсем иначе - он полтора часа вертел репу и файлы в ней, и в итоге предложил разработать такую систему учета, которая заставит свежую сессию 6.1 Sol Max идти от файла к файлу, рисовать их полную карту, и найти реально всё что там только может быть в принципе, разложить по полочкам, и определить все дубли, все баги, весь требующий рефакторинга код, все точки отказа.

Мы договорились так же что когда происходит больше 40 компакций сессия добивает крайнюю находку и ставит задачу на продолжение заполнения этого леджера следующую чистую сессию, самостоятельно.

Я, честно говоря, не надеялся что это сработает и в этот раз, но решил попробовать. Данный механизм работает уже примерно 36 часов, передал эстафету четвертой по счету сессии (то бишь прошел 120 компакций), и пройдено подробным сканированием уже 1003 из 3870 файлов репы.

Не удивительно что раньше ни одна модель не могла сделать нормальный разбор, ведь они видели уже, были глупее в целом, и завершали свою эту работу за считанные пару часов. То бишь у них не было даже шанса реально во все посмотреть, скорее всего каждый раз они смотрели в рандомно взятый 1% проекта, и на этом успокаивались.

Когда я вчитался в эти 78 найденных находок, я был очень приятно удивлен. Там практически нет галлюцинаций или спорных выводов. С прошкой можно теперь про каждую находку общаться, выяснять когда это возникло, что было до этого, почему так вышло, итд. И искать самое надежное решение в рамках наших задач и особенностей.

Пока дешево рекомендую всем с огромными репами проделать нечто подобное, потому что потом полагаю что-то такое снова станет стоить десятки тысяч долларов в токенах, и желания поубавится =)