Anton Gladkov · 2025-12-08 · source ↗ · whole document (7)
Проверил Opus 4.5 в бою, выводы не утешительные: Короче я сейчас занимаюсь полны
Разумеется такие таски НИКОГДА не проходят без ошибок, хотя бы потому что Gpt-5.1-codex-max xhigh раз работал почти два часа, он разумеется компакт контенту делал хуеву тучу раз за это время, и мы короче с вами это уже много раз обсуждали...
НО в итоге на удивление ошибок было совсем мало. Немножко в хэндлерах, немножко расхождений с имеющейся логикой DB (и то потому что я еблан схему левую подсунул, в которой 4 поля из базы в принципе не было лол), и маленько не правильно реализован Airwallex, который собирает бабло в баксах.
GPT5.1PRO просканил всё и нашел все эти проблемы, которые я сейчас буду выкорчевывать.
ОДНАКО
Я решил дать ровно такую же задачку OPUS 4.5, проверить всю кодовую базу старой и новой реализации, и рассказать есть ли какие баги/косяки/неточности.
1) OPUS 4.5 обладает потрясающе мелким контекстом в Claude Code.
Codex на этапе чтения кодовой базы даже 20% контекстного окна не въебал, тогда как Opus первый раз компакт контекста провернул еще на этапе чтения кода старого бота, который он не смог переварить одним разом даже, а разбил на чанки (32к токенов, а максимально Claude через Claude Code может открыть не больше 25к токенов).
2) Единственная задача которую я поставил OPUS на вывод: сделать файлик в репозитории текстовый со всеми наблюдениями, найденными косяками, и указаниями по ним.
Нам с вами известно что у меня как минимум в 3х местах проблемы, и Airwallex это пиздец какая критическая проблема, да и хэндлеры тоже половину функционала как бы отключают своим лжесуществованием.
Резюме OPUS 4.5 вы можете видеть на скриншоте.
Пошел он нахуй =)