Пересел с Claude Code на Codex и модель 5.6 Sol от OpenAI.
Пишет короче и внятнее, чем Opus 5, почти без набивших оскомину конструкций «это не Х, это Y» и прочих. Заметно быстрее Claude Code.
Гораздо более крутая интеграция с Chrome (умеет сразу несколько профилей и управлять мышкой в фоне), и гораздо меньше блокеров типа «данные банковской карты я не буду вводить ни в каком случае, даже если это одноразовая карта с лимитом в 10 долларов».
А ещё он единственный смог найти по короткому описанию 20-летний мем, то есть интернет-поиск у него исключительно мощный.
Ощущение апгрейда в помощи с бытовыми задачами, как когда Opus 4.x вышел и внезапно стало можно прогать нормально с помощью нейросетей. Очень рекомендую.
Nikian
аааа, меня не одного сводит с ума эта хрень "это не Х, это Y". в гпт это тоже живёт.
💯️6
Denis
"не используй антитезы"
Ilya Lotnik
да, Sol в режиме ультра это просто зверь. Жаль они снова ввели 5 часовые лимиты, и теперь нельзя за пару часов потратить недельные, но зато сразу закрыть задачу)
💯️13
Nikian
да ему пофиг на эти инструкции
dmgritsan - CTO & Co-founder with AI tools
А ещё он круто умеет в swarm из subagents
💯️
Denis
клоду чтоли? ну мб) жпт получше становится
Michael Kokin
Fable 5 идеально работает в браузере. А опус не очень, да(
По ощущениям, Codex лучше держит контекст и, еще важней, фокус на задаче. Я с ним проектирую personal OS и выполняю рутинные штуки — например, перенести данные с Яндекс диска на гугл драйв или отсмотреть старую почту и найти конкретные письма и добавить их в базу знаний.
А вот сайты проектирую с Fable 5. https://failforward.cc — вот клод код собрал мне сайт за вечер. От макета и иллюстраций до покупки домена (попросил на гоудедди купить самый дешевый). Я только CSV-код ввёл от карты.
Прогресс в дизайне + автономность работы прокачали очень сильно. Месяц назад такое было не сделать.
Это я тестировал новую фишку клод дизайна — редактируемый канвас и работу по референсам.
все иллюстрации клод сам делал в..чатгпт (через браузер)
https://aigency.michaelkokin.com/en/news/failforward-case — кейс сделал со всеми шагами и скриншотами (вдруг кому-то интересно).
❤️👍️6
Mikhail Metlov
А я думал, у меня одного такое ощущение! Но как будто бы она и дороже (юзаю из Cursor)
Vasil N
Вы как то специально меняли скиллы, для codex?
Mies He
После того как они выставили 5 часовые лимиты для которых три сообщения в сол легко закрывают лимит и дальше сидишь куришь бамбук - ощущения двоякие.
👍️3
Roman
каждый раз удивляюсь насколько большинство вайбкодеров игнорируют джемини) типо не настолько понтово чтоли ею пользоваться)
https://codingfleet.com/blog/gemini-3-7-flash-vs-gpt-5-6-terra/
тем временем кодекс в несколько раз медленнее джемини (около 110 токенов в секунду против примерно 300 в секунду). при этом по тестам на умность джемини где-то обходит gpt 5.6 terra, где-то чуточку уступает.
ну sol конечно вероятно будет более умной, для каких-то более сложных задач думаю есть смысл в ней конечно.
🤣️3
Павел Ломовцев
У меня обратный опыт по кодингу: там где опус 4.8 за один промпт не только выполнял задачу, но и раскрывал мне то, о чем я сам даже не подумал, с солом приходится доуточнять-доделывать ещё в пару промптов
👍️💯️3
Alexander
В нашем полку прибыло)
С весны не пользовал клод)
Разработка на кодексе, кросс-чек джемини.
Ivan
Сегодня обратил внимание, что Клод стал работать сильно быстрее. Те задачи, которые он пилил по час+ сегодня стал делать за минут 10-15
Опус и Фейбл ускорились либо я что то раньше делал не так и оно научилось оптимизировать мои тасочки
Alexander
Прошка очень клевая, но в agy она сожрала недельный лимит за 40 минут. Я в шоке от такого аппетита. Либо у них опять глюк какой-то с подсчетом
💯️
Roman
gemini 3.7 flash во многом уже мощнее прошки, и она кстати очень экономная по использованию токенов. давно стоит попробовать её.
Alexander
Да? Я пробовал 3.6 флеш - ваще не то. Видно прям что не хватает ризонинга. Надо будет погонять 3.7)
❤️👍️
Тимофей Грушко
Мужики если есть совет как найти это волшебное расширение для Codex в Chrome - буду благодарен
Так открывается ссылка из настроек того же кодекса
Ilya Artamonov
Только пользоваться джемини не так просто, как клодом и/или chatgpt, ребята искусно выставляют заграждения чтобы ни один человек из неподдерживаемого региона не просочился 😀
💯️5
Denis Pushkarev
Я больше поржал с того, что claude не мог по своему же дизайну UI для девайса сделать. Упорно твредил, что все уже итак по дизайну (хотя там были заметные расхождения). Только общие моменты повторял. А codex смог. Но лимиты чот очень быстро уходят, вообще не замена клоду (который в целом устраивает)
❤️
Daren Evans
Если взять Sol 5.6 и Fable взять видео 10 секунд на котором будет изображен сложный дизайн с 3д/анимацией/сложным скролом
Попросить сделать раскадровку ffmpeg и повторить весь дизайн и механику
Сильно удивитесь насколько Fable будет лучше
В целом странно сравнивать Opus 5 и Sol 5.6
👍️
Gleb
Читаю комменты и не понимаю - это боты, люди, или люди с ботами?
👍️2
Aliaksandr
Всё нейросети, интернет мёртв 🙂
❤️
Victor Novikov
Аналогичный опыт
Dmitry Valetin
А еще Sol знатный overengineer. Цепляется за любую закорючку и делает из нее синхрофазотрон. Он у меня в монолите построил permission checker с цифровой подписью - мол раз resolver подписал - значит ну точно можно использовать. Приходится его постоянно заставлять искать места оверинжениринга.
👍️2
Ivan
Хз чего пытались добиться этим сравнением, но зачем никому не нужная терра сравнивается с никому не нужным джеминай? 😏
Луна как воркер отлично справляется, особенно под руководством Сол. Даже Тибо сам продвигал этот сетап.
А если нужна флешка, то вон, глм 5,3 флеш по цене намного интереснее
Владимир Федан
а нет ощущения что все топовые модели где-то рядом, просто время от времени одна вырывается чуть в перед, но в следующем цикле другая наверстывает и в свою очередь тоже вырывается и так постоянно и как будто нет принципиальной разницы между ними и можно продолжать сидеть на антропиках или опенАИ без фомо?
👍️4💯️2
Михаил
Я довольно далек от вайбкодинга (если что-то и вайбкодил, то на естественном языке и простейших настройках) и для меня комментарии под этим постом буквально "смотря какой
fabricagent, смотря какиеdetailsskills"👍️2🤝️
Vanya
Я часто с телефона взаимодействую и у Клауд очень Крутая инфраструктура чисто из-за нее пользуюсь Клауд код в облаке это супер
У кодекс такого нет насколько знаю а если есть не такое удобно
Semyon Pupkov
Это лудоманы
💯️
Roman
можно научиться читать тексты перед тем как отвечать, тогда сразу понятнее может стать. что там по скорости у этой glm 5.3? основной разговор шёл за инференс.
я уж не говорю о том что на всех твоих скриншотах glm 5.3 flash проигрывает по очкам gemini 3.7 flash. цена это мелочь когда можно за подписку юзать модель по очень хорошим лимитам.
Ivan
Давай дальше сиди на джеминай)
👎️
K K
А с кем этот текст написан?
Roman
сказать то что хотел в итоге? я то пойду сидеть, а твоего тейка пока особо понять не получается. кроме того что ты очень хотел влезть и тоже понтануться чем-нибудь.
Ivan
Внимательно смотри скриншоты, ответ в принципе там и есть
Roman
я посмотрел. glm дешевше, на этом собственно всё что можно из её плюсов выделить.
Tobi
У меня в кодексе баг через раз. Как будто писали вайбкодеры. Не сказал бы что он чем-то лучше клода
Ivan
Давай определимся что сравниваем.. цена/скорость/качество? А може всё сразу?
Если и сравнивать модели, то только из одного класса, а не брать от балды Терру, и говорить, какая она медленная и дорогая по сравнению с флешкой 😏
❤️
Alex Ilizarov
Фигово луна справляется и тупит. Терра норм пашет, сол не юзал (не было необходимости).
ssh доступ к домашнему ноуту прокидываешь и юзаешь че хочешь в терминале, приложения не нужны.
Vanya
Ну а в Клауде у тебя без домашнего ноута это есть)
Виртуальные сервера по сути предоставляет на которых можешь все запускать
Alex Ilizarov
Я так же думал пока нормально нейронки не поюзал фронтирные 🤷
Оказалось что они уже дофига умные и большую часть кода за меня пишут и быстрее.
Работает через жопу и ненадежно. А ssh к домашнему ноуту это еще возможность быстренько окружение подправить. Не запускать же нейронку на хостовой системе.
Michael Kokin
Этот ручками)
Джеминай офигенно копирует стиль. Этого у нее не отнять. Ну и как ассистент в почте/доках хорошая моделька
Ivan
Единственное что могу подтвердить по Луне — она медленная, в принципе по стэпам бенчмарков это подтверждается, но вот Терру похоронили после -80% стоимости на Луну. Поэтому по условному профиту за 1 токен, особенно в контексте подписки — она мастхэв
Roman
так это модель среднего класса для ежедневной работы, в смысле брать балды. джемини флеш как раз с нею и соревнуется по степени точности выполненной работы, даже на скриншотах которые ты же сам скинул, это видно.
терра обходит джемини по качеству в некоторых тестах (далеко не во всех), но делает это медленнее, собственно в этом и был посыл.
изначальное мое сообщение всё это уже раскрыло на самом деле. я сейчас просто повторяюсь.
Alex Ilizarov
Как она может быть медленной если это самая легкая и тупая моделька?
А что есть люди которые не на подписке сидят, а за токены платят? У меня подписка
Ivan
Сори, прочёл только первый абзац и дальше всё понял.. воспользуйся любой ЛЛМкой, закинь статью и спроси, что в этом сравнении может быть не так, божет так дойдёт лучше
Alex Ilizarov
Вы этот профит как считаете? Кто то иллюзорный бенчмарк сделал? У меня луна тупит на простейших вещах иногда.
Ivan
Я ведь написал — по стэпам
Alex Ilizarov
По каким стэпам?
Ivan
Бенчмарк "тупит на простейших вещах" принял к сведению, исправлюсь в следующий раз ✍🏻
См выше, внимательней
Alex Ilizarov
Я понимаю что рандомные люди сделали рандомный бенч который вы никак не верифицировали. Но я одну и туже модель на одном и том же проекте гонял и луна у меня забывает иногда простейшие вещи сделать.
Dubrovskiy.M
Все просто, гемини - кал
Vladimir Kharitonov
а я говорил…
Jonny D
так же автор канала использует ботов для прямых вопросов в личку по поводу своих курсов
V P
про карты фигня какая-то, у меня несколько ботов в клоде выкупают онлайн заказы в магазинах США, все они прекрасно вбивают. и paypal платят, и картами и даже таблицы с гифт-картами ведут. логин в магазины, парсинг личных кабинетов, все работает. смешно про 10 долларов, ей богу
FILTERED
расскажите пожалуйста, что значит "работает с браузром" в контексте cli тула(codex)?
Maksim Lebedev
, но противопостовляй
Ваня
Меня очень задолбал Клод своим нечеловеческим языком. Раньше было лучше.
Сначала я подумал, что это мой английский скатился, но он порой такие всратые конструкции переусложненные и такие слова вворачивает, что потом минут пять предложение раскурить пытаешься
💯️
Джемини очень быстрый, но гораздо хуже кодит и подсказывает по кодингу. Каждый раз когда пробовал, плевался и возвращался на клод
Roman
думаю стоит ещё раз попробовать, 3.7 по тестам сильно вышла вперед. причём в некоторых тестах она даже другие модели теперь просто обходит.
по скорости она кстати тоже прям реально быстрой стала только с версии 3.5, до этого инференс был гораздо более медленный.
как пример. с миллионным контекстом теперь лучше всех умеет обращаться джемини, причём отрыв у неё в 22% от второй модели - gpt 5.6 sol. т.е. при больших задачах гугловская модель будет забывать и терять детали в гораздо меньших количествах, чем другие модели.
https://contextarena.ai
Gleb Azarov
Это с output=Concise? Вроде бы неплохо этим костылём починили в cc
👀️
Alexandr Pogorelov
похоже я один использую Grok 4.6 для рутинных задач. Сравнивал его с 5.6 sol, ощутимой разницы не увидел, но может у меня задачи простые попадались. sol в некоторых относительно простых задачах в оверинжиниринг уходил, приходилось его в момент тормозить
Ваня
Я чет разочаровался в гугловских моделях: они каждый свой релиз сопровождали разгромными бенчмарками, потом пробуешь — полная фигня (с 3 по 3.5). Но как-нибудь попробую, когда стошнюсь в очередной раз от лексики клода
Не слышал про это, попробую, спасибо!
Imaskar
1. Гугл не надёжен как провайдер - имеет большую историю отрубания бизнес аккаунтов без возможности оспорить.
2. Конкретно джемини замечена в наибольшем количестве системного промта, полного повестки и кто знает чего ещё. Хотелось бы, чтобы инструмент делал то, что пользователь хочет, а не провайдер.
А потом данные пользователей поисковиками индексируются.
Roman
здравствуйте, банят сейчас все провайдеры за всё подряд. может разве что оспорить у других легче, да.
остальное даже обсуждать смысла не вижу, что там и кем было замечено, на рентв тоже много про что рассказывают, будто это жить мешает.
Imaskar
Как сравнивается кост? По корпоративной апи подписке? Интересно, как это отражается в модели, когда каждый провайдер продаёт пакет за 20 (/100) евро, условно выравнивая косты.
Да, разница именно в оспаривании ложных срабатываний.
По второй части - кто-то упирается в ограничения, кто-то получает не то, что хотел, а кто-то и не замечает разницу. Тут индивидуально.
Сам на работе использовал джемини одно время, пока отключили кодекс, а клод ещё не включили. Опыт был ужасный - ни с чем не справлялась. Но то была ещё 3.5, если не более ранняя.
Ivan
Даже если и делать поправку на пакеты, то ОпенАИ субсидирует больше остальных
Roman
Подписку нужно взять не для индусов за 6 баксов и будет запросов побольше. На про тарифах токенов залейся. Еще и спарк с отдельными лимитами. И прошка - самый топ с возможностью вообще без траты токенов крутить там большие задачи, а потом в кодекс перекинуть чат с контекстом и дожать в нем (сильно уж проша медленная)
Так что не надо врать про лимиты мелкие. Это у секты антропика яйца зажаты и все закручено. Кодекс еще и сбрасывает эти лимиты чуть ли не каждую неделю. А антропики вроде никогда. О расходе токенов вообще молчу. Про тарифы самый топ на рынке, ну если о фронтире речь. А не о сраных китайцев, которые в чате доку создать до сих пор не могут и распознать аудио больше 3 мин (привет Квену)
Я не кодер если что)))
Mies He
да у антропиков и расход не прозрачен и лимиты ограничены. но я сравнивал два тарифа 20 долларов а не про тарифы. на про и у антропика лимита хватает. на опенаи не пробовал, но видимо надо пробовать.
🕊️
у меня тоже не коды а документы)))
Roman
я вообще хейтером чатагпт был полтора года, а потом потестил два новых уровня ризонинга который они открывают на про тарифе и фронтирку в виде Про и все. в августе взял макс с фаблей, погонял параллельно сутки фаюлю с прошкой и рефанд запросил. Удручающе низкий уровень у фабли (не в айтишке)
К чести антропиков в тот же день бабло вернули, им в секте недовольные не нужны)))
Mies He
меня вполне устраивал опус. у него своеобразный тип рассуждений и он мне ментально ближе. чатгпт слишком размазывает и долго очевидно рассуждает, пишет что он делает, куда лезет, где он считает нужно исправить. опус делал молча и эффективно. оставалось посмотреть результат и дать вердикт. при этом я сравнивал прошлую подель чатгпт и новую опуса. опус был явно сильнее. фэйбл был неумолимо силен. но его сразу отобрали и лимит он жрал как голодный зверь. и вот сравнение чатгпт до лимитов и после мне явно не нравится. для 20 долларовой подписки это слишком мало. для про уже неочевидно избыточно. но и у антропиков за 20 долларов ты получаешь два вопроса и лимит.
Roman
я по до документам сейчас делаю скрипты и прочее с сол, а дальше уже процессы когда начинаются - луна тащит хорошо. у антропика один плюс - весь ризонинг можно получить и за 20 долларов (как много это другой вопрос), а у гпт за 20 долларов получаешь какаху, с обрезанным мозгом. я лично подписку взял после того как на бизнесе 10 запросов прошки юзанул и понял, что такой уровень охеренный того стоит
ну и потолок не ограничивает, на бизнесе лимиты таяли и прямо давили мозг. а на про когда токенов горы можешь потратить не задумываясь это с тз креатива оч раскрепощает)
❤️
Mies He
Какая то скрытая реклама опенаи))). Замануха. Но блин 100 долларов это 100 долларов.
Roman
ахаха, ну самый тупой хомяк уже меньше 60к даже не рассматривает. а тут за 10к отсыпают столько, что не унести))) и уровень не тупого исполнителя, а четко. у меня сотрудница руками делает месячный отчет из 4 недельных. 3 часа делает. там в каждом отчете по 30-50 страниц со скринами и разными категориями. ну от она по ним растаскивает, тасует по ряду параметров еще внутри каждой группы.
я чтобы лимиты не жечь на сол, отдал прошке - просто 4 файла и итог как образец и надикторанный промпт. Потратил 3 минуты. прошка через 110 минут выплюнула идеальный отчет! причем параллельно делала сотрудница и у нее оказалась ОШИБКА.
да если бы прошка такой отчет сделала через 3 часа, вообще пофиг, крутит там чет, меня же не отвлекает. да еще и спасибо Сэму токены чат не жрет))))
звучит и правда рекламно, но просто у чатгпт маркетинг плохой)))) я не Альтман, если чО)))))
Mies He
у меня задачи глубже и значительно. но я попробую. приходится модель крутить по 10 итераций одного документа и то не всегда выходим на результат. в итоге я все равно получаю желаемое, но довольно долго работается.
🔥️
Roman
могу нейтральное что-то забросить крутиться, если что кидайте в личку
alph
Пересел с Claude code 4.8 на Grok 4.6. Те же наблюдения. Стало сильно лучше и быстрее.
Imaskar
Это вы про что? Sol ultra доступен на 20 баксах.
Roman
Мы про 5.6 Pro, который в чате. Ультра в ворке и кодексе сидит зажатая промптами харнесса. Я ворком, например, не пользуюсь, он генерит корпоративный буллшит - заточили под офис, а бороться лень с ним. Ну и мелочь бонусная, что в чате безлимит, а в ворке юсадж жрется(((