Друзья, по нейросетям положняк такой:
- самая мощная модель для кода — opus 5.5 от Anthropic, она читает-пишет код сильно быстрее и качественнее чем OpenAI, а еще подписки хватает на больше
- при этом, computer use в Codex все еще на голову лучше чем в Claude, оно справляется в интернете почти со всем — регистрации, настройки админок, заказы; я перестал страдать про плохие интерфейсы в вебе — я их больше не вижу! и общается она приятнее
Несколько недель назад казалось, что у Anthropic серьезные проблемы с серверными мощностями, а у OpenAI компьют практически неограниченный, но вот сегодня с opus 5.5 уже Claude всем хватает, а OpenAI не дает купить тарифный план за 200 долларов (20х объема от базового тарифа) новым пользователям.
Главная интрига: представит ли OpenAI завтра, на своей ежегодной конференции Devdays, новую модель для программирования, сильнее opus 5.5 или нет.
На рынке ИИ-ассистентов уже больше сотни игроков, многие мои знакомые в США пользуются Instinct (все общение через iMessage и смс), а рекламой Muse от Меты (Фейсбука) увешано все нью-йоркское метро.
Ещё вся тусовка обсуждает, что движение за ограничение ИИ по составу участников совпадет с друзьями проститутки-и-дата-сайнтистки Aella, но я тут недавно узнал, что канал читает моя старшая дочка и ее друзья, так что не буду пересказывать.

Vladimir Kharitonov
так. а где будешь? надо какое-то тайное место обустраивать!
👍️7
Samat Galimov
Ты про НЙ? Уже вернулся домой :)
🤗️
Vladimir Kharitonov
я про это!
Alexander Bareyko
Opus 5.5 добавляет скрытые ИИ вотермарки, больше втихаря не повайбкодишь
👍️
Eugene Sergueev
кто нибудь понимает хайп вокруг muse?
Samat Galimov
Ахаха, от них не скроешься
Неограниченный рекламный бюджет
И дистрибуция, которой нет ни у кого в мире (ну может быть кроме Microsoft и Google)
И неплохой продукт
Almaz M
А есть инвайт на Instinct?
Vitály Magyari
Пора заводить онлифанс "Запуск Завтра"
👀️💯️3🤝️
Norio Wakamoto
Аэлла норм, я с ней в дискорде сижу
❤️
Vitály Magyari
Вообще за этим постом задумался, что по рынку онлайн секс-услуг ИИ нанёс примерно такой же удар как по программистам. С кем ни окажешься внезапно в одной лодке 🤷
💯️2
Как ДС норм или как кам-гёрл? Спрашиваю для друга... 😇
Norio Wakamoto
На самом деле, общего у этих людей - комьюнити Lesswrong
👍️3
И то и другое
🔥️
Delisted Account
https://github.com/amyodov/yet-another-agentic-chat
Ваши проблемы решены
🥰️
Samat Galimov
Про него и речь!
Daniil Nuzhdin Gelfand
Интересно, что у меня пока что ощущения от gpt 6 Sol / Astra всё же приятнее, чем от opus 5.5 в области производительности, сейчас оптимизировал код, opus говорит из серии "вот предел, дальше не получится", где-то в 2 раза ускорил. Дальше никак. Даю Sol, там вышло ещё х1.5-2.5. И по дизайну Sol более приятные исправления делает, чем opus
💯️2🔥️
Anton
- новая лучшая модель от OpenAI
- новая лучшая модель от Anthropic
- новая лучшая модель от OpenAI
- новая лучшая модель от Anthropic
- сейчас вы здесь 🥱
👍️
Andrei Moiseev
Лучше по ощущениям или по эвалам?
Steven Nikolaev
Здесь много говорят про удивительный мир ИИ, но слабо видно реальный эффект. При быстрой разработке стало ли больше багов в проме? Как быстро долетают фичи? Растет ли обращайка от клиентов? Может кто-нибудь поделиться своим опытом, или мб есть под рукой статьи/доклады/конференции?
Gennady Lebedev
со скоростью «переписать 4 модуля по спекам и тестам» в 5ч этот вопрос актуален только для чего-то совсем эзотерического и критичного, наподобие ядра бирж
все остальное либо покрыто спеками и тестами по сценариям в 5 слоев, либо не нуждается в безбажном проде
Steven Nikolaev
Ну т.е. максимально покрываешь код тестами и анализаторами и молишься богу?
Gennady Lebedev
эээ, нет!
пишешь сценарии, ассампшны, гэпы, дизайн - как доки/артефакты/базу с которыми ллм может работать
строишь трубу как от этих доков зависит код (маппинги, матрицы покрытия, вот это все) и особенно какие тесты какие сценарии покрывают
и богу молиццо не надо (слава Маркову, «дедушке ML» и критику цервки), а контролировать что сценарии актуальные, доки меняются по цепочке, гэпы ищутся, ассампшны учтены
то же самое что и раньше, только не через людей и с опцией заполнить наконец ту простыню доков до которой у живой команды никогда ни рук, ни голов, ни терпения не хватало
ну и бонусом - запросы на чейндж становятся дешевле, а результат анализа оседает не на серверах клода и локальной памяти на машине разраба
💯️
Steven Nikolaev
И как это влияет на итоговое качество? Чем это поможет с накопившейся очередью на приемку? На последующее сопровождение?
Gennady Lebedev
слэнг везде, если речь про «очередь готовых фиксов/доработок, которые мы не можем выкатить потому что их не приняли» то почти ничем, это ж организационная проблема (зовите, если это она, там есть простые варианты как развязать такие боттлнеки)
на последующее сопровождение влияет очень позитивно, когда сверху донизу цепочка есть остается обсуждать только мякотку - сценарии какие мы поддерживаем в системе, ассампшны с которыми живем и гэпы которые заметили (1-3 страницы в плотной нотации на модуль), а не технобуллшит про контроллеры и правильный стиль кода
полу-автоматическая разработка уже здесь, пару дет назад ставил против ии, но в 2026 дозрело и стало понятно как именно использовать, за $100-200-1000 субсидируемых это просто не переплюнешь именно по TCO
ps. сам из идейных, 15 лет стажа в разработке и лидстве, люблю ддд и упороться в дизайн, не раз делал HL/HA mission critical с чужими деньгами
Steven Nikolaev
А есть все-таки что почитать подробнее про то, что вы говорите?
Gennady Lebedev
м, тут сложно
я построил по срезу ITIL/ITSM под проект - пачку инструкций (наполовину это шаблоны таблиц) и пару хуков
пытал модели, самое близкое из распространенного - spec-driven development и ADR, но они не очень подходят для накопления пачки фичей под релизы
спрашивал вокруг, пока как будто все ищут и строят под себя, готовые скиллы очень быстро разочаровывают
Steven Nikolaev
Спасибо за ваши комментарии, но либо нас унесло немного не в ту степь, либо у меня лыжи не едут:)
Все-таки хотелось узнать какие последствия возникли от применения ИИ и как решали
Gennady Lebedev
прикладных:
- обсуждаем сценарии, а не код
- тесты стали обязательными и автоматическими (их просто выичтывать на соотвтествие сценариям, тут стало порогово лучше, ту же муть с LocalDateTime.now() честно проверяет по границам а не игнорит, например)
код стабильно до прода доезжает и не болит
Steven Nikolaev
Тесты сами пишете или в паре с ИИ, или ИИ сам себя тестит? Всплески багов при более быстрой выкатке фич не ловили? Есть ли ревью и как устроено?
Ну и для контекста - юзаете топовых искинов или практикуете локальных?
Gennady Lebedev
на ревью все завязано, полу-автомат (никаких коммитов/мерджей от ллм, за общее состояние отвечает человек)
драфт, первое ревью и фикс запускаю на автомате, дальше головой и глазками, зачастую в этом месте гэпы могут быть интересные, вплоть до переформулировать план (тоже док) и начать с нуля
как закончили - перелив из плана и ревью в общую доку по модулям того что должно осесть, собственно финальный мердж идет как готовая фича-ветка
много в параллели не висит, дрифт чистится перед мерджом
пользуюсь клодом, локальные тоже работают (m3max 48gb qwen/gemma, на фичи пыхтит но делает, вот изначальную спеку по проекту пока не было он пол-дня строил, а так работает)
после наполнения доков всплеска багов не было, скорее наоборот
👍️
Steven Nikolaev
Ревьюверы не выгорают?
Gennady Lebedev
неа, но читать там правда дофига)
Steven Nikolaev
Понятно:)
В общем-то эти все вопросы - ровно то с чем столкнулись мы и не только. Много идёт разговоров про ИИ-кодинг (не буду уж говорить вайб), но практически никто - про все остальное. Как будто бы все живут тихонько в своем болоте, а ведь там самое интересное. Но я допускаю, что скорее сам нахожусь в каком-то информационном вакууме, поэтому задаю вопросы всем подряд.
Еще раз спасибо за ваши комментарии
🤝️