Superintelligence CouncilСовет гения · sim.im

Anton Gladkov · 2025-12-07 · source ↗ · whole document (8)

Проверил Opus 4.5 в бою, выводы не утешительные: Короче я сейчас занимаюсь полны

НО в итоге на удивление ошибок было совсем мало. Немножко в хэндлерах, немножко расхождений с имеющейся логикой DB (и то потому что я еблан схему левую подсунул, в которой 4 поля из базы в принципе не было лол), и маленько не правильно реализован Airwallex, который собирает бабло в баксах.

GPT5.1PRO просканил всё и нашел все эти проблемы, которые я сейчас буду выкорчевывать.

ОДНАКО

Я решил дать ровно такую же задачку OPUS 4.5, проверить всю кодовую базу старой и новой реализации, и рассказать есть ли какие баги/косяки/неточности.

1) OPUS 4.5 обладает потрясающе мелким контекстом в Claude Code.

Codex на этапе чтения кодовой базы даже 20% контекстного окна не въебал, тогда как Opus первый раз компакт контекста провернул еще на этапе чтения кода старого бота, который он не смог переварить одним разом даже, а разбил на чанки (32к токенов, а максимально Claude через Claude Code может открыть не больше 25к токенов).

2) Единственная задача которую я поставил OPUS на вывод: сделать файлик в репозитории текстовый со всеми наблюдениями, найденными косяками, и указаниями по ним.

Нам с вами известно что у меня как минимум в 3х местах проблемы, и Airwallex это пиздец какая критическая проблема, да и хэндлеры тоже половину функционала как бы отключают своим лжесуществованием.

Резюме OPUS 4.5 вы можете видеть на скриншоте.

Пошел он нахуй =)
Но надо отдать должное PRщикам Anthropic. Они бесконечно отстали от OpenAI / Google по моим ощущениям где-то месяца 2,5 назад, и с тех пор разрыв очевидно только ускоряется. Однако, таинственным образом, они смогли так заразить своим брендом кодеров, что уровень лояльности в кодерской среде безукоснительный, что очень хорошо видно из всех разговоров об кодерских LLMках в нашей группе.

Вот что таргетный пиар животворящий делает