Superintelligence CouncilСовет гения · sim.im

Anton Gladkov · 2025-12-07 · 06-tools · source ↗

Проверил Opus 4.5 в бою, выводы не утешительные: Короче я сейчас занимаюсь полны

Проверил Opus 4.5 в бою, выводы не утешительные:

Короче я сейчас занимаюсь полным рефакторингом платежного гейткипинг бота из нашего разговорного чатика, который так же собирал донейшены и делал по-мелочи уйму вещей на 7832 строки кода.

Хитро выебанный в несколько слоев GPT5.1PRO сделал мне мега-гипер промпт для Codex, который Codex обрабатывал.... 1 час 47 минут.

В итоге у меня теперь вместо одного файла 7 файлов, по которым настолько равномерно насколько это возможно размазана вся логика бота. Максимальный файл теперь около 2к строк. Минимальный около 300 строк. Можно дышать свободно.

Разумеется такие таски НИКОГДА не проходят без ошибок, хотя бы потому что Gpt-5.1-codex-max xhigh раз работал почти два часа, он разумеется компакт контенту делал хуеву тучу раз за это время, и мы короче с вами это уже много раз обсуждали...

НО в итоге на удивление ошибок было совсем мало. Немножко в хэндлерах, немножко расхождений с имеющейся логикой DB (и то потому что я еблан схему левую подсунул, в которой 4 поля из базы в принципе не было лол), и маленько не правильно реализован Airwallex, который собирает бабло в баксах.

GPT5.1PRO просканил всё и нашел все эти проблемы, которые я сейчас буду выкорчевывать.

ОДНАКО

Я решил дать ровно такую же задачку OPUS 4.5, проверить всю кодовую базу старой и новой реализации, и рассказать есть ли какие баги/косяки/неточности.

1) OPUS 4.5 обладает потрясающе мелким контекстом в Claude Code.

Codex на этапе чтения кодовой базы даже 20% контекстного окна не въебал, тогда как Opus первый раз компакт контекста провернул еще на этапе чтения кода старого бота, который он не смог переварить одним разом даже, а разбил на чанки (32к токенов, а максимально Claude через Claude Code может открыть не больше 25к токенов).

2) Единственная задача которую я поставил OPUS на вывод: сделать файлик в репозитории текстовый со всеми наблюдениями, найденными косяками, и указаниями по ним.

Нам с вами известно что у меня как минимум в 3х местах проблемы, и Airwallex это пиздец какая критическая проблема, да и хэндлеры тоже половину функционала как бы отключают своим лжесуществованием.

Резюме OPUS 4.5 вы можете видеть на скриншоте.

Пошел он нахуй =)
Но надо отдать должное PRщикам Anthropic. Они бесконечно отстали от OpenAI / Google по моим ощущениям где-то месяца 2,5 назад, и с тех пор разрыв очевидно только ускоряется. Однако, таинственным образом, они смогли так заразить своим брендом кодеров, что уровень лояльности в кодерской среде безукоснительный, что очень хорошо видно из всех разговоров об кодерских LLMках в нашей группе.

Вот что таргетный пиар животворящий делает