Superintelligence CouncilСовет гения · sim.im

Search

topic: 05-ai ✕

2,501 passages, newest first · 608 ms

С 23:30 Понедельника Fable работал НЕПРЕРЫВНО. Хотите верьте, хотите нет, но я реально не дал ему ни разу отдохнуть. Ну ладно, около 3х часов он не работал когда заканчивалась через ~5 часов задача которую я поставил перед сном, а сплю я типа по 8 часов;)

Такими темпами Fable очень медленный, по ощущениям даже медленнее чем GPT 5.5 xhigh.

Но качество его суждений выше всяких похвал, тот же GPT 5.5 xhigh после 2х суток работы фэйбла проанализировал 157 сделанных им коммитов и сказал что это все безупречно. Я попросил его дать какие-то рекомендации и он дал рекомендации в духе "надо в документации прописать…

Принудительный безагентный подход получается делает так что Fable не дороже чем GPT 5.5 xhigh, во всяком случае недельным лимитом в подписке.

Ещё забавно то что на моих многочисленных экспериментах с текстами Fable показал довольно средненькие результаты.

Из мэйнстрим моделей по сложносоставным текстам с по истине гигантским количеством data points to consider хуже всех выступил Grok. А лучше всех - Opus 4.8 high и GPT 5.5 xhigh. Fable был где-то посерединке, наравне с Sonnet 5, который кстати на удивление справился заметно хуже даже чем GPT 5.4.

Мы говорим сейчас не про один эксперимент, а про сотни тысяч сгенерированных текстов сотнями проходок, где один и тот же промптпак скармливался всем моделям на всех уровнях ризонинга и проверялись результаты как умозрительно мной, так и Fable 5 по сложносоставному списку оценочных параметров которые он для этой задачи изобрел.

Почему его братики отсосали в тексте он кстати не знает, но предполагает что Overthinking который заложен в модель для допытывания до более глубоких логических проблем не идет на пользу изложению мысли, где надо балансировать между старанием и похуизмом, где Fable 5 явно не так силен как "более слабые модели" =)))))

Единственное что надо отметить по затратам Fable: он в отличие от GPT 5.5 постоянно засыпает и ждет когда его какой-то скрипт который он запустил разбудит. То бишь его инференс работает совершенно иначе, и в нём прям заложено стремление как можно меньше жечь токенов и как можно чаще ложиться спать чтобы их не тратить. Хотя возможно это происходит когда…

А бля ещё последнее: на ютубе уйма пиздоболов.

Они сами нихуя не вайбкодят, потому что столько контента в день выкладывать на ютуб и вайбкодить действительно серьезно чтобы понимать глубоко все механики которые они пытаются осбуждать - невозможно. Они по-сути пересказывают чей-то опыт, друг-дружку, свои разговоры теоретические о вайбкодинге с ChatGPT, итд.

Ну окей они конечно что-то там вайбкодят, но хуйню. И поэтому они как крысы распространяют огромное количество высосанных из члена слухов, которые правдой не являются.

Один из них - что надо использовать максимум High, а xhigh и Max на антропике это якобы даже ХУЖЕ делает любую задачу, и нужно лишь для каких-то там космических блядь исследователей =))))

Чего только ни скажешь конечно когда ты родился пиздоболом.

Ну короче я не увидел никакой инверсии от роста ризонинга.

На 5.5 каждый следующий уровень ризонинга строго лучше чем предыдущий. xhigh от high в среднем в текстах и подготовке knowledge-пакета для текста из inputs - xhigh просто прыгнул в стратосферу относительно high. Medium вообще даже с 5.4 high нельзя…

На Opus 4.8 заметил что конкретно в текстах просто прекращается рост качества. От High до Max сквозь xhigh - нет никакой разницы. Будто этот переключатель тупо фиктивный. Этого можно ожидать именно от обоссанного Антропика. В целом это самые конченные бляди как показал весь таймлайн их существования.

Но если вы присмотритесь к девушкам среднего кодера, то вам в целом причина популярности Антропика в кодерской среде станет предельно понятной)

Короче если вы юзаете Medium потому что вам так сказали на ютубе - вы стреляете себе в ногу. А то что у вас когда-то на каком-то отрезке времени на xhigh не получалось - у вас бы и на medium…

Все реальные пацаны копили эти 4 резета для этого момента)))
Еще бы только выпустили не в 12 дня сука по Сан Франциско, а например через полчасика =)

мне нахуй не нужен русский язык - это раз
два - все модели понимают русский язык
три - я разумеется попробовал все Gemini на всех ризонинг эффортах, и они не котируются
на один вопрос Gemini тебе может настрогать текста который выглядит человечьим
Но если ты хочешь скормить ему облако сведений в котором ОЧЕНЬ ВАЖНО

1) не ошибиться
2) связать сведения между собой логически
3) понять на лету в любой момент времени развесовку этих сведений и приоритет

итд...
То Gemini просто лупит наугад
Хуже только Grok
Grok плох тем что он не только лупит наугад как Gemini, но ещё и.... сочиняет вообще всё в рандомные моменты на 360 градусов
Я так и не понял прикол…

ЛОЛ

Утром я попросил GPT 5.5 xhigh проанализировать всю работу Fable с понедельника, и сказать мне во всех разрезах как вообще там чего.

GPT 5.5 xhigh не нашел в принципе до чего доебаться, и практически все оценил в 10/10.

5.6 Sol получил тот же промпт...
Антропик теперь не только не убирает Fable 5 из списка моделей, но и делает его бесплатным:DDD

Некоторые люди и в разговорке и мне в личку пытаются угадать правильный краткий пересказ моего длинного поста выше.

Вот так правильно:

Каким бы залупным вам ни казался ваш промпт, он сработает ЛУЧШЕ чем причесанная LLM его версия.

Дополнение:

LLM если спросить мол как лучше вот как у меня было подзалупно написано или вот эта причесанная версия?

LLM ответит: конечно же причесанная версия.

Ответит так по той же причине по которой причесанная версия сработает хуже подзалупной.

Но если показать LLM мой пост и спросить бля как думаешь реально что ли в итоге мои 15 слов настолько же хорошо будут реализованы LLMкой как и если промежуточная их раздует в 500 слов?

Она тогда вспомнит что умна и скажет: а хули ты хотел?
@alexanderbespalikov какие люди:) Приветики)

More