### Kimi k3 max
Strong second writer and style challenger. Good breadth on Connectro and Revopush and good copy self-audits. Operational caveat: one first-attempt quota/auth failure on Revopush before successful retry, so capacity preflight matters.
Search
3,059 passages, newest first · 36 ms
### GLM5.2 max via Qwen CLI
Completed all three validated outputs after retry, but should stay a tertiary fallback / compact independent check. It was narrower, route attestation was less clean, and Connectro first hit Qwen API data inspection before the successful retry.
## Operational Chronicle
- Full matrix was launched as a local sidecar with max parallelism; production stayed untouched.
- Primary full matrix initially completed 13/15.
- Revopush/Kimi first attempt failed on a Kimi profile usage/auth quota before final files; single-cell retry completed: 11 segments, 275 arms, 11 packs, 55 touches.
- Connectro/GLM first attempt failed with Qwen API 400 data…
## What To Open
- Human index: index.html
- Markdown index: index.md
- Machine roll-up: report-data.json
- Scorecard data: model-scorecard.json
- Full outputs: runs/<client>/<model>/market_scan.md and market_scan.json
- Raw transcripts: runs/<client>/<model>/raw-transcript.log
## Caveats
This benchmark answers writer interchangeability. It does not prove production routing, paid/provider sourcing totals, lead purchase quality, deliverability, or Kimi judge acceptance. A production split-model Market Scan would need a small governed implementation: preserve Qwen as baseline, add explicit stage routing, keep deterministic validation to JSON/transport/math only, then compare with Kimi judge and a bounded…
GPT 5.5 xhigh находит 26 гипотез там где GPT 5.6 Sol Max находит 28, что говорит о том что GPT 5.5 xhigh невероятная модель всё еще на сегодняшний день, однако SOL MAX достаточно заебистый чтобы найти ~2300 связок названий компаний и должностей там где GPT удовлетворяется на ~450.
А маркет скан нет смысла делать снова и снова - ты его делаешь раз в жизни чтобы запланировать работу на весь следующий год.
То бишь GPT 5.5 Xhigh дает тебе по тем же гипотезам Total Addressible Market capacity ~ в 4-5раз ниже чем GPT 5.6 Sol Max.
И все это стоит просто лишних 20-30 минут заебистого рассуждения модели.
Вы не в моей нише, поэтому вы не понимаете насколько это важно, но это блядь важно просто шо пиздец)
И другие цифры там есть веселые которые можно трактовать занятным образом, оставляю вас гадать на них. Когда я релизну свой продукт я думаю все в итоге объяснится его же…
Это реально кроме шуток ускорение отдела продаж в 8 раз на десятилетнем отрезке, за лишние 20 минут копеечного палева токенов.
Это сравнение для самых маленьких. Если там копаться в деталях, мы легко найдем ещё бОльшее ускорение, а так же вещи которые предыдущими моделями просто в принице были недостижимы, типа определенных игрищ текстовыми конструкциями, но сегодня нет сил расписывать это)
А ну и ещё смотрите как задушили Qwen3.8max, это жестко.
Я вам клянусь, Qwen выдавал по этому куску моего бенча примерно /1.3-1.8 от SOL ранее. Сейчас он выдает /5-10 в зависимости от проекта.
То бишь ему не только урезали токенов в 50 раз, но еще и изменили то что он выдает за эти токены.
Он же был самой ультра быстрой моделью? Теперь он в 3 раза медленнее GPT 5.5 и в 4 раза медленнее kimi.
При этом за это черепашье время он выдает в 5-10 раз меньше чем выдавал на той неделе...
Это типа очень жесткая смерть через карапупу.
вот я хочу попробовать русалочную историю сделать менее мертво-снэпшотной, а динамической
типа чтобы она не просто отображала мол на момент Х дела обстоят Y, а чтобы она нонстоп отображала дела, как меняется репа, и кто где орудует, пунктиром чтоб дорисовывалось то что вообще раньше отсутствовало и новое реализуется. Красным мигало то что меняется Х на Y, зеленым то что…
МОжет не так - но как-нибудь так чтобы я мог открывать перед собой репу визуализированную, и видеть над какими узлами работают какие модели, и даже как-нибудь заказывать работу прямо из этого визуального слоя
Типа выделил модуль, и дал по нему задачу во всплывашке
Этого очень очень очень сильно не хватает
Когда репа меньше чем Х в целом похуй все…
а нафига тебе кими вообще? че не gpt-5 на gpt-5?
хаха ну бро потому что кими меньше токенов хавает на дозу аутпута
а кодинг это аутпут
при этом кодит отменно если говорить ему точно что надо сделать
то бишь 1 GPT + 3 KIMI = 800 баксов
А в токенах кодинга это = 2000+ баксов, если сравнивать с 4…
Я пока даже не пробовал
Видишь у меня есть супер способность наработанная с годами агентства
Я управлял 80 людьми в десятках проектов помня что где надо делать и где что происходит
У меня никогда не было системы визуализации всего этого, все в голове
И даже не было мысли что это можно куда-то переложить
Я в какой-то момент научился…
Как же конечно Codex вот этим вот пидорством заебал..............
Просишь сделать одно, он к этому присобачивает по каким-то своим соображениям ещё 80 слоёв нахуй никому не нужной работы.
В этом и есть его проблема.
Причем зарефайнить до идеала базовый запрос не помогает - он тогда к этим 80 слоям придёт в процессе работы над твоим простым и прямолинейным запросом. В целом нет разницы как с ним работать - он найдет способ проебать время.
А Kimi еле дышит (но норм как руки Codex'а, с помощью одной Kimi можно по-сути подписку на OpenAI умножать в 2.5 раза).
А Qwen не способен думать шириной репы, и стоит как Боинг, а GLM оч плох в бизнес-фичах, а Опус опущенный)
По-сути на сегодняшний день единственное что остается это сидеть смотреть в монитор и как только видишь что хуйня пошла - steer в кодексе. Я не знаю что ещё можно делать на большой репе чтобы куда-то двигаться. Вот так уже два дня сижу, и куда-то начали двигаться реально)
Но это конечно минус вайб)
Годы будут мелькать на календаре, и будут находиться все новые люди которые будут советовать установить Superpowers блядь
Его ставишь и вообще что-либо перестает происходить
Superpowers это такой прикол своего рода
Им даже GPT 5.2 можно было превратить в SOL
Устанавливаешь и нихуя больше никогда не произойдет в репе