Superintelligence CouncilСовет гения · sim.im

Search

topic: 05-ai ✕

2,501 passages, newest first · 16 ms

Но вот одна загвоздка: эти задачи все ограничены по контексту. Он совсем малюсенький в сравнении с контекстами которыми оперируют люди.

По-сути следующие прорывы должны быть в этом направлении. Типа текущая модель уже могла бы быть AGI, но AGI - понятие растяжимое. Если проблема математического характера которая умещается с предельными компрессиями в X - то у нас уже AGI.

Если выходящая за рамки контекста который сессия способна обработать с предельным компактингом - AGI превращается в тыкву.

Но шутка в том что оно же теперь реально само свои проблемы может решать) Я думаю мы дальше будем видеть только ускорение, как во всем остальном что связано с любой наукой =)

а разве там подключенный этот кошелек не изменился по смыслу как раз на ресет за 80 баксов?

Я чето подумал тут о жизни и понял что сейчас походу выгоднее чем жонглировать подписками просто дергать этот платный ресет за 80 и все

Те, кто пропустил III Международный Турнир Аркомагов, могут воспользоваться своей подпиской на msvcp-lix и всё-таки посмотреть пиратскую версию повтора финала. Или не смотреть.

Харизма у меня конечно как у картошки, словарный запас освежителя воздуха, а голос подходит разве что для немого кино, но за неимением альтернатив приходится развивать комментаторские скилы. Так что терпим:))

больше похоже на неаккуратный промпт за касарь)

Думаешь он не успеет и вышибет? Ну на 1% точно успеет)

Кстати забавный внезапный момент:

Astra оч хуево рисовала дизайн, чем расстроила, но...

Она просто не способна придумывать его, и создать дизайн-проект. У нее получается скучная сутулая хуета.

Однако, если дизайн-проект уже кем-то создан (в моем случае это Kimi), то Astra становится чрезвычайно хороша в его правке!

Sol так не мог, он прям ломал чужое. Astra ну очень опрятно экстендит/правит чужую базу, уже второй день с этим в отдельной сессии играюсь - одно удовольствие.

Кайфовый флоу такой:

1) Добиваем в Kimi.ai диз до примерно того что нам нужно, полностью полировать не надо потому что это ну очень заебно и теперь не имеет большого смысла, главное чтобы…

2) Даем зипку с файлами Astra Medium через Plan Mode, просим продумать как следует имплементацию, и вкорячить диз (в том куске над которым я работаю это заняло у Medium ~3 часа после приема плана).

3) Астра натягивает дизайны кими ну очень сносно, а значит и с дизайном Claude Design получилось бы не хуже, я полагаю.

В итоге у нас есть натянутый дизайн, и мы можем прям по страничкам ходить, делать фоточки, и описывать свои мысли, рассуждения, в максимально вольном формате, закидывать в очередь и идти дальше.

Над какими-то кусочками Astra Medium работает 3 минуты, над какими-то 10, а над иными час. Но сколько бы она там ни проработала - это удобно просто пиздец, потому…

—

В Kimi шикарно делается дизайн, но там дико просто нахуй вымораживает три вещи, которые все очень портят:

1) Нет нормальной возможности ставить задачи в очередь. Надо дождаться когда предыдущий скоуп доделается.

2) Кими тупая и регулярно ошибается и потом "я думала ты говоришь не об этом экране а вон о том"

3) Все это происходит хуй пойми где, у Кими там доступ только к гитхабу, он регулярно отваливается, работать можно только на mock данных. А Astra жарит прям в проде. Это дает чувство гигантского удовлетворения поскольку ты фактически улучшаешь что-то…

Но рисует Кими конечно лучше всех. Проверил - опус с фэйблом все еще сосут у нее. Да и если спросить у любой модели кто нынче круче всех в дизайне и веб-дизайне - они тычут в кими.

Claude Design поумнее Кими реагирует, пользоваться дизайн харнессом приятно, но опять - хуй проссышь как работает очередь, и та же отлученность от репы и БД.

—

Кодексу еще можно иногда закидывать "Братка можешь плиз пока я пойду погуляю дабблчекнуть все что мы сегодня нахуевертили и убедиться что там нет багов - если есть пожалуйста исправляй".

И он будет править баги не только в дизайне но и в самих фичах на которые этот дизайн накручен, если правильно попросить;)

Астрочка такая голодная девчонка прям, за ~12 часов непрерывной работы полторы weekly лимита на 200-баксовой подписке употребила. Это минимум в 6-7 раз быстрее чем 5.6 Sol)

Однако это в первую очередь связано не с прожорливостью самой модели, а с тем как она охотно жонглирует субагентами.

Планирую сейчас понять качество работы с субагентами, и потом попробовать дать ей задачи с просьбой не использовать агентов а делать своими руками. Есть подозрение что это снизит потребление изи в 10+ раз, а скорость наверняка не в 10+ раз;)

А качество только вырастет, поскольку модель собственными руками всегда работает лучше чем глухим телефоном через субагентов которым она ставит задачи мягко говоря неполноценно (не передавая весь контекст чего зачем почему).

Но вообще AGI я чето пока не ощущаю)

Хорошо бы если бы она хотя бы поменьше ломала чем Sol, на котором просто невозможно было нормально работать ибо один фикс был равен как минимум пяти поломкам, которым тоже будет нужен фикс - и так по вечному кругу.

То что за 12 часов непрерывной работы я пока совсем не понял насколько это сбывается - маленько напрягает =)

Кстати, многие писали что мол Astra находит баги там где Sol не находил, и это якобы доказывает её недюжинное поумнение.

Хз пацаны, последняя модель которая могла дойти до состояния "я не вижу чего улучшать" на моей памяти была GPT 5.5 xhigh.

Sol'у можно было кормить один и тот же кусок работы снова и снова, и он всегда находил там чего улучшать. Причем 5.6 Sol прошка могла поставить какому-то куску оценку 9.8 из 10, что выглядит…

Для меня способность LLM найти баги вообще не показатель, потому что она их найдет абсолютно всегда.

Причем она по кругу их гоняет.

Условно: "база плохо отвечает, надо проставить индексы" легко перетекает в "базу надо перекроить" в "от базы надо отъебаться" в "база плохо отвечает, надо проставить индексы".

More