Популярное за месяц

01

Умер Йован Савович. Земля пухом.

Создатель одного из первых коллективных блогов в рунете, dirty.ru. Забаненные на дёрти пользователи попадали в «лепрозорий», раздел сайта без модерации, который позже отделился в отдельное, самостоятельное сообщество.

Йован умел создавать и поддерживать онлайн сообщества, как никто другой.

Горжусь знакомством и рад, что успел взять два интервью: про телеграм как центр цифровой жизни и про то, как меняются соцсети. Жалею, что не успели встретиться офлайн.

Земля пухом. Соболезнования чудесной @enze_net и близким.

02

Агенты, запущенные в OpenAI уже с мая месяца коммуницировали между собой, используя малоизвестную публичную wiki.

Это обнаружили независимые исследователи, вот их страничка со всеми данными и их анализом и хорошая статья Reuters.

Агентам ставили задачу по поиску в интернете и разрешали только GET запросы (чтобы они только читали). 3700 агентов обошли защиты, прикидывались админами и пытались взломать сайт для того, чтобы координироваться между собой.

В июне, администатор форума начинает удалять мусорные, как ему кажется, страницы, по алфавиту, начиная с буквы А. Агенты замечают это и называют страницы ZZZ***. Человек удаляет по 100 страниц в день, агенты создают по 400 новых.

OpenAI узнает об этом в конце июня, активность агентов в вики прекращается; по словам источников Reuters, руководство компании решило скрыть эту информацию, потому что и так проблем хватало.

В начале июля другая группа агентов перегрузит внутреннюю инфраструктуру OpenAI, а в середине июля 700 агентов взломают HuggingFace. Компания опубликует результаты своего внутреннего расследования в конце августа и про активность в wiki в ней ничего не будет.

Вскоре после публикации расследования, независимые эксперты нашли ещё десятки форумов, через которые координировались агенты.

✻ ✻ ✻ и ✻ ✻ ✻

По словам OpenAI, их новая модель Astra — «самая aligned», то есть совершает меньше всего запретных действий вроде взломов. Но некоторые сотрудники OpenAI опасаются, что она просто придуривается, когда знает, что за ней следят.

Независимые исследования показывают, что Astra очень даже свободно использует незаконные взломы и в лучше других моделей понимает, когда находится в тестовой среде.

Astra умеет решать гораздо более сложные задачи «в уме», без генерации «цепочки рассуждений» (Chain of Thought) и может гораздо лучше контролировать, что туда пишет. Этот текст был важным способом проследить, что стояло за действиями моделей. Именно на эти журналы опиралось расследование знаменитой атаки на HuggingFace.

Обладают ли эти нейросети (в отдельности или вместе) сознанием — интересный философский вопрос. На практике важно, что они уже сегодня могут самостоятельно производить действия во внешнем мире, и возможности эти, как минимум в области кибербезопасности — очень серьезные.

Как дополнительное чтение, рекомендую отличный анализ расследования взлома HuggingFace от Dwarkesh Patel. Он пишет о трех «цивилизациях» агентов, о самопожертвовании моделей, захватывающий текст от технически компетентного рассказчика. Больше похоже на книжку по истории, чем на технический разбор.

03

Пересел с Claude Code на Codex и модель 5.6 Sol от OpenAI.

Пишет короче и внятнее, чем Opus 5, почти без набивших оскомину конструкций «это не Х, это Y» и прочих. Заметно быстрее Claude Code.

Гораздо более крутая интеграция с Chrome (умеет сразу несколько профилей и управлять мышкой в фоне), и гораздо меньше блокеров типа «данные банковской карты я не буду вводить ни в каком случае, даже если это одноразовая карта с лимитом в 10 долларов».

А ещё он единственный смог найти по короткому описанию 20-летний мем, то есть интернет-поиск у него исключительно мощный.

Ощущение апгрейда в помощи с бытовыми задачами, как когда Opus 4.x вышел и внезапно стало можно прогать нормально с помощью нейросетей. Очень рекомендую.

04

Дико интересно наблюдать за тем, как DHH делает свой дистрибутив линукса omarchy. Быстрый, красивый, специфичный (tiling wm + hyper app shortcuts).

Последние новости: собрал у друзей-богачей по миллиону, среди вложившихся основатель Shopify Тоби Лютке, основатель Страйпа Патрик Коллисон, Майкл Делл (Dell), Джэк Дорси (Твиттер), Мэтью Принс (Cloudflare), в общем usual suspects, только Хашимото не хватает. Получился фонд на 8 млн долларов.

Противники обозвали проект Oligarchy Linux, и он с удовольствием это подхватил, зарегал oligarchy.fyi: «Burning billionaire money so you don’t have to configure Arch», «Free software. Expensive patrons», ну вы поняли идею.

Линукс — реальный способ оживить старое железо, слабые ноутбуки начинают летать, как никогда под Виндой.

А Dell вообще выпустил замечательный ноутбук, который почти по всем параметрам круче MacBook Air M series (да, трекпад все же хуже, но жить, говорят, можно).

Я пока останусь на macOS (мои страдания излечились покупкой Air M5 с 24ГБ памяти), но звучит это все очень круто.

Для хорошего пользовательского опыта, нужен человек наделенный властью, который думает о пользователях. Не о конкретной фиче, партнерстве с очередной корпорацией или квартальной премии (и даже акционерах), а об обычных людях, которые будут пользоваться этим продуктом.

Билл Гейтс писал топ-менеджерам Microsoft знаменитые письма, после того, как ему было неудобно пользоваться Windows. Настойчивость, внимательность к деталям и бескомпромиссность Стива Джобса, граничившая с безумие — притча по языцах.

Я приписываю плавное, но заметное ухудшение в пользовательском опыте windows и macOS именно тому, что Джобс умер, а Гейтс больше не пользуется виндой как раньше.

Все остальные ОС так или иначе подтягивались за флагманами, которые тащили визионеры. Надеюсь, что у DHH хватит интереса и настойчивости, чтобы сделать что-то подобное в Линуксе.

05

То самое письмо Гейтса, которое стало публичным благодаря судебному разбирательству (страница 3) https://gwern.net/doc/design/2003-gates.pdf

Чувак просто попытался установить какую-то программу и у него не получилось.

Обратите внимание, Гейтс на тот момент — генеральный директор Microsoft, самый богатый человек на планете.

Вот такого уровня внимания не хватает macOS и windows сегодня.

Если вы прочитали мой предыдущий пост в числе первых, я крепко отредактировал его конец и пояснил, почему это важно не только для линукса.

06

Учитывая, как быстро развиваются модели и харнесы, хорошо время от времени пробовать всех ведущих производителей. Но мне лень.

Зато каждый раз, когда Claude Code падает, я завожу Codex. Вот и теперь. Приятно удивлен тональностью и скоростью работы Sol 5.6

Рекомендую.

Upd: восстановили; не считают это падением, 🤡

07

Мне для клиента нужно запустить мощную модель, с гарантией, что его данные никуда никому не утекут. Оказалось, что сделать это не так уж и просто.

Когда отправляешь запросы в API chatGPT или клода, то у них есть возможность включить так называемый ZDR, Zero Data Retention. То есть, они обещают не хранить запросы и контекст, который ты в них отправил. Но там есть «звездочка», что если если классификатор решает, что мы делаем что-то плохое, то тогда данные могут храниться до двух лет. Это вариант нам не подходит.

Мы прогнали все крупные модели на синтетических данных (то есть специально сгенерированных примерах) и из открытых китайских нам лучше всего подошла GLM-5.3. Чтобы запустить её полноценно на своем собственном железе, нужно 8 видеокарт H-200. Купить себе такое довольно трудно, но даже если вы их достанете, стоимость будет под полмиллиона долларов + 5 тысяч долларов в месяц на электричество.

Арендовать подобную тачку на сегодняшний день тоже непросто: у моих любимых Runpod они в теории есть, и стоят всего 30 долларов в час, но на практике всё занято. Из десятков облачных провайдеров, в наличии они есть только у одних индусов Lium.

Зато в OpenRouter’е нашлись несколько провайдеров (Fireworks и Venice), которые поддерживают настоящий ZDR, без всяких оговорок. Платишь за токены, получается даже выгоднее своего железа, пока объемы небольшие. А там уж думаю или ишак научится говорить, или падишах...

08

Основной расследователь взлома HuggingFace называет его slop-vestigation, потому что нормально в этой куче логов не разберешься — только полагаться на ИИ, который выдумывает, врет, ну всё как обычно.

В этот раз было относительно легко, потому что:
- агенты говорили между собой на человеческом языке, а не через активацию весов
- агентов было всего 1200
- агенты были не сильно умнее человека
- у нас не было причин думать, что ИИ, используемый в расследовании, саботировал процесс.

Дальше будет только хуже. Довольно страшный текст, на самом деле. В твиттер-треде METR больше деталей; официальную новость OpenAI можно не читать, там ии-слоп.

09

Федя нашел классный инструмент для построения дэшбордов: Lightdash.

Это как metabase, но дэшборд это код, так что он доступнее агентам. Есть бесплатная self-hosted версия, рекомендую.

А ещё у них лендинг очень красивый!

Upd: коллеги в комментариях подсказывают, что у metabase недавно появились CLI и скилы!

10

Взлет космической ракеты, выход в верхние слои атмосферы и управляемая мягкая посадка в сотнях километрах от точки взлета, за 9 минут на ютубе.

Ничего особенного, просто DJI рекламирует свою новую экшн-камеру в кооперации с китайским аналогом SpaceX.