б) это то за что антропиков всю дорогу хвалили с пеной у рта
Да, бывает она чего не может, но дизайн-то она делает ну просто блядь вооооооооо
2,501 passages, newest first · 109 ms
б) это то за что антропиков всю дорогу хвалили с пеной у рта
Да, бывает она чего не может, но дизайн-то она делает ну просто блядь вооооооооо
абсолютно не
не успел еще
сейчас походу попробую
потому что я глядя на результаты и на то что мне говорит опус в ответ на критику думаю что мне придется эту задачу делать другой моделью
опус мне литералли сказал что он ОТКАТЫВАЕТ все что они сделали за 4 часа
Потому что чистый лист лучше чем ошибки в проде
это благородно конечно…
не оказался а внезапно стал, но мы привыкли же правда?)
Утверждения без проверки это прям фича/паттерн опус5
как так работать им хз
он мне только что доказывал что Kimi сессия к нему не ходила и он прям уверен что она галлюцинирует
И он расписал мне длиннющий какой-то ризонинг на эту тему
В итоге я попросил его сходить в…
Ну вот теперь можно в нее поиграть в play.mountkendall.com
Может подебажить придется, я еще ни разу не запускал, но может и сразу заработало)))
Там еще дизайн к ней нарисовал свежий image gen 2
Qwen восторгался им
Я еще не видел, интересно что там =)
Кстати гайз я уверен что давным-давно появились 3rd party реализации claude.ai/design в которые можно воткнуть любую модельку, и которые сильно пизже чем сам Claude Design.
Кто что видел? Кто что тестил? Делитесь, и я наконец нарисую нормальный дизайн для play.mountkendall.com:)
Ты мне лучше скажи нахуя OpenAI атлас свой решили грохнуть уроды)))
Я с таким кайфом на нем сидел эти полгода...
он был лучше чем хром =)
ну на данный момент лучше кими нет ничего
нет ничего даже близко
не по ответу на один вопрос, а по сложной поставленной задачи на стабильность её выполнения
ютуб гудит за опус 5, мол убийца всего, но кими нашла значительно больше косяков в моем процессе восстановления после отката репы чем опус
Хотя дизайн опус 5 делает просто отменный в claude.ai…
Кто что видел? Кто что тестил? Делитесь, и я наконец нарисую нормальный дизайн для play.mountkendall.com:)
Upd ни один из сверхинтеллектов не догадался просто что у меня есть бэкапы базы, и считали что бэкапиться невозможно поскольку просто откатывать гит без базы и снэпа серверного не комильфо.
Волнующая инфа в том что нужный мне бэкап протух бы через 4 часа пздц) Свезло так свезло.
Придется мне теперь строить этот мой завод который я упоминал - раз. Продолжать кодить связкой 5.5 + kimi/qwen - два.
Фэйбл и сол я к своей репе теперь подпущу когда массово люди начнут говорить какие вах охуенные это стали модели.
Хотя если бэкап без задоринки встанет и я реально откочусь на досольную эпоху - то будет мой первый в жизни откат, и будет еще менее стремно экспериментировать;)
Кент задает справедливый вопрос который требует небольшого рассуждения:
Я за прошедшие несколько дней попробовал наверно не все возможные конфигурации кто кем и как может рулить, но очень много.
И получилось так:
Fable и Sol очень плохо рулят другими сессиями. Технически они просто распространяют свое безумие или свой беззубый похуизм на эти другие сессии. Фэйбл даже без отката выдавал перлы в духе:
–Ориентировочно нам надо еще 18 часов до завершения подготовки V4.
–Но фэйбл, если я просто дам скоуп задач Qwen он сделает максимум за час. Что такого происходит у него с…
Короче Фэйбл на мой взгляд умеет реально управлять только своими ультра дорогими субагентами, а оркестрация чужими хэдлесс CLI сессиями заставляет его страдать какой-то совершенно дикой хуйней.
Я еще поймал его на том что он вообще выдумывает консилиум из разных моделей. Делает вид что запустил разные CLI и обсуждает с ними прогресс, а потом признается что он просто прикинулся всеми…
Qwen сам как оркестратор плох тем что он очень силен в чрезвычайно быстром написании очень качественного на единицу скорости кода, но слаб именно в принятии решений и настойчивости. Ему харнесса не хватает который бы заставлял его переосмыслять хотя бы разочек свои действия как в процессе так и в итоге.
Он конечно лучше действует если запромптить его пропускать свои решения через 3rd party модель, т.к. она таки вносит какую-то лепту, но когда и как он решит больше к ней не обращаться - ты никогда не угадаешь, а он обязательно так сделает, и в итоге один хер придется идти к 5.5 и проходить этот ритуал "возьми номер сессии…
В итоге получилось так что если просить 5.5 xhigh планировать вместе с Qwen, выполняя роль скучного администратора движения к цели, тогда как Qwen должен делать идеэйшен и разработку идеэйшен делает одна модель, разработку по идеэйшену уже можно распедаливать на 3-5 паралелльных сессий, потом эта же модель которая делала идеэйшен проверяет всю работу всех сессий и соотносит с реализацией…
По-сути роль 5.5 xhigh в новом мире вылупляющихся выгодных и быстрых китайцев именно в том чтобы привнести стабильность в мир более умных быстрых и креативных моделек, которые делают работу на 99% классно но во-первых этот недостающий 1% убивает смысл их творчества, во-вторых они могут запросто сделать 99% от 300% или от 1000%. На моей памяти Qwen…
Поэтому на данный момент я прошу GPT 5.5 xhigh управлять Qwen, а не наоборот, и не Qwen управлять другими Qwen'ами.
Kimi я к сожалению пока в этой роли не тестил потому что у меня как Allowance закончился так и только через 17 часов возобновится, а новую подписку мне пока не продали, waitlist.
А ну и кстати... Прошки это тоже касается. Я чето разочарован в 5.6 PRO.
Она шикарная в плане того сколько всего она видит итд. Но она такой же маньяк как и 5.6 Sol Max.
5.5 + Qwen вместе ризонят лучше чем GPT PRO потому что они не высасывают уйму несуществующих проблем (создавая их таким образом) из пальца.