Superintelligence CouncilСовет гения · sim.im

Search

tag: ai-models ✕

3,059 passages, newest first · 36 ms

Anton Gladkov2026-08-0901-market-scansource ↗context

### Kimi k3 max
Strong second writer and style challenger. Good breadth on Connectro and Revopush and good copy self-audits. Operational caveat: one first-attempt quota/auth failure on Revopush before successful retry, so capacity preflight matters.

Anton Gladkov2026-08-0901-market-scansource ↗context

### GLM5.2 max via Qwen CLI
Completed all three validated outputs after retry, but should stay a tertiary fallback / compact independent check. It was narrower, route attestation was less clean, and Connectro first hit Qwen API data inspection before the successful retry.

Anton Gladkov2026-08-0901-market-scansource ↗context

## Operational Chronicle

- Full matrix was launched as a local sidecar with max parallelism; production stayed untouched.
- Primary full matrix initially completed 13/15.
- Revopush/Kimi first attempt failed on a Kimi profile usage/auth quota before final files; single-cell retry completed: 11 segments, 275 arms, 11 packs, 55 touches.
- Connectro/GLM first attempt failed with Qwen API 400 data…

Anton Gladkov2026-08-0901-market-scansource ↗context

## What To Open

- Human index: index.html
- Markdown index: index.md
- Machine roll-up: report-data.json
- Scorecard data: model-scorecard.json
- Full outputs: runs/<client>/<model>/market_scan.md and market_scan.json
- Raw transcripts: runs/<client>/<model>/raw-transcript.log

Anton Gladkov2026-08-0901-market-scansource ↗context

## Caveats

This benchmark answers writer interchangeability. It does not prove production routing, paid/provider sourcing totals, lead purchase quality, deliverability, or Kimi judge acceptance. A production split-model Market Scan would need a small governed implementation: preserve Qwen as baseline, add explicit stage routing, keep deterministic validation to JSON/transport/math only, then compare with Kimi judge and a bounded…

Anton Gladkov2026-08-0901-market-scansource ↗context

GPT 5.5 xhigh находит 26 гипотез там где GPT 5.6 Sol Max находит 28, что говорит о том что GPT 5.5 xhigh невероятная модель всё еще на сегодняшний день, однако SOL MAX достаточно заебистый чтобы найти ~2300 связок названий компаний и должностей там где GPT удовлетворяется на ~450.

Anton Gladkov2026-08-0901-market-scansource ↗context

А маркет скан нет смысла делать снова и снова - ты его делаешь раз в жизни чтобы запланировать работу на весь следующий год.

То бишь GPT 5.5 Xhigh дает тебе по тем же гипотезам Total Addressible Market capacity ~ в 4-5раз ниже чем GPT 5.6 Sol Max.

Anton Gladkov2026-08-0901-market-scansource ↗context

И все это стоит просто лишних 20-30 минут заебистого рассуждения модели.

Вы не в моей нише, поэтому вы не понимаете насколько это важно, но это блядь важно просто шо пиздец)

И другие цифры там есть веселые которые можно трактовать занятным образом, оставляю вас гадать на них. Когда я релизну свой продукт я думаю все в итоге объяснится его же…

Anton Gladkov2026-08-0901-market-scansource ↗context

Это реально кроме шуток ускорение отдела продаж в 8 раз на десятилетнем отрезке, за лишние 20 минут копеечного палева токенов.

Это сравнение для самых маленьких. Если там копаться в деталях, мы легко найдем ещё бОльшее ускорение, а так же вещи которые предыдущими моделями просто в принице были недостижимы, типа определенных игрищ текстовыми конструкциями, но сегодня нет сил расписывать это)

А ну и ещё смотрите как задушили Qwen3.8max, это жестко.

Я вам клянусь, Qwen выдавал по этому куску моего бенча примерно /1.3-1.8 от SOL ранее. Сейчас он выдает /5-10 в зависимости от проекта.

То бишь ему не только урезали токенов в 50 раз, но еще и изменили то что он выдает за эти токены.

Он же был самой ультра быстрой моделью? Теперь он в 3 раза медленнее GPT 5.5 и в 4 раза медленнее kimi.

При этом за это черепашье время он выдает в 5-10 раз меньше чем выдавал на той неделе...

Это типа очень жесткая смерть через карапупу.

Anton Gladkov2026-08-0803-cold-outreachsource ↗context

вот я хочу попробовать русалочную историю сделать менее мертво-снэпшотной, а динамической
типа чтобы она не просто отображала мол на момент Х дела обстоят Y, а чтобы она нонстоп отображала дела, как меняется репа, и кто где орудует, пунктиром чтоб дорисовывалось то что вообще раньше отсутствовало и новое реализуется. Красным мигало то что меняется Х на Y, зеленым то что…

Anton Gladkov2026-08-0803-cold-outreachsource ↗context

МОжет не так - но как-нибудь так чтобы я мог открывать перед собой репу визуализированную, и видеть над какими узлами работают какие модели, и даже как-нибудь заказывать работу прямо из этого визуального слоя
Типа выделил модуль, и дал по нему задачу во всплывашке
Этого очень очень очень сильно не хватает
Когда репа меньше чем Х в целом похуй все…

а нафига тебе кими вообще? че не gpt-5 на gpt-5?
хаха ну бро потому что кими меньше токенов хавает на дозу аутпута
а кодинг это аутпут
при этом кодит отменно если говорить ему точно что надо сделать
то бишь 1 GPT + 3 KIMI = 800 баксов
А в токенах кодинга это = 2000+ баксов, если сравнивать с 4…

Я пока даже не пробовал
Видишь у меня есть супер способность наработанная с годами агентства
Я управлял 80 людьми в десятках проектов помня что где надо делать и где что происходит
У меня никогда не было системы визуализации всего этого, все в голове
И даже не было мысли что это можно куда-то переложить
Я в какой-то момент научился…

Как же конечно Codex вот этим вот пидорством заебал..............

Просишь сделать одно, он к этому присобачивает по каким-то своим соображениям ещё 80 слоёв нахуй никому не нужной работы.

В этом и есть его проблема.

Причем зарефайнить до идеала базовый запрос не помогает - он тогда к этим 80 слоям придёт в процессе работы над твоим простым и прямолинейным запросом. В целом нет разницы как с ним работать - он найдет способ проебать время.

А Kimi еле дышит (но норм как руки Codex'а, с помощью одной Kimi можно по-сути подписку на OpenAI умножать в 2.5 раза).

А Qwen не способен думать шириной репы, и стоит как Боинг, а GLM оч плох в бизнес-фичах, а Опус опущенный)

По-сути на сегодняшний день единственное что остается это сидеть смотреть в монитор и как только видишь что хуйня пошла - steer в кодексе. Я не знаю что ещё можно делать на большой репе чтобы куда-то двигаться. Вот так уже два дня сижу, и куда-то начали двигаться реально)

Но это конечно минус вайб)

Годы будут мелькать на календаре, и будут находиться все новые люди которые будут советовать установить Superpowers блядь
Его ставишь и вообще что-либо перестает происходить
Superpowers это такой прикол своего рода
Им даже GPT 5.2 можно было превратить в SOL
Устанавливаешь и нихуя больше никогда не произойдет в репе

More