Популярное за год

31

Почему испортился поиск в интернете и как починить его лично для себя. Рассказывает Павел Банников, человек, чья работа — искать в интернете. Смотрите (!) и слушайте новый эпизод нашего подкаста на всех платформах.

Ютуб, Apple, Google, Яндекс, Spotify.

32

Умер Йован Савович. Земля пухом.

Создатель одного из первых коллективных блогов в рунете, dirty.ru. Забаненные на дёрти пользователи попадали в «лепрозорий», раздел сайта без модерации, который позже отделился в отдельное, самостоятельное сообщество.

Йован умел создавать и поддерживать онлайн сообщества, как никто другой.

Горжусь знакомством и рад, что успел взять два интервью: про телеграм как центр цифровой жизни и про то, как меняются соцсети. Жалею, что не успели встретиться офлайн.

Земля пухом. Соболезнования чудесной @enze_net и близким.

33

Яна Доган (очень крутой инженер, куча опен сорса, ex GitHub, AWS, сейчас в Гугле) публично хвалит Claude Code, мол за час сделала то, над чем они трудились прошлый год. Это прямой конкурент Gemini, в команде которого она работает, вообще-то.

Ну все, пора пробовать. Вот свежая (вчерашняя) инструкция от создателя, очень человечная. Среди прочего — рекомендует модель Opus 4.5. Мол, хоть и медленная, но такая умная, что в результате получается быстрее. Минимальная подписка 20 баксов в месяц.

P. S. Маск не прогадал с покупкой Твиттера, он до сих пор остается главной площадкой для обсуждения технологических новостей.

34

Агенты, запущенные в OpenAI уже с мая месяца коммуницировали между собой, используя малоизвестную публичную wiki.

Это обнаружили независимые исследователи, вот их страничка со всеми данными и их анализом и хорошая статья Reuters.

Агентам ставили задачу по поиску в интернете и разрешали только GET запросы (чтобы они только читали). 3700 агентов обошли защиты, прикидывались админами и пытались взломать сайт для того, чтобы координироваться между собой.

В июне, администатор форума начинает удалять мусорные, как ему кажется, страницы, по алфавиту, начиная с буквы А. Агенты замечают это и называют страницы ZZZ***. Человек удаляет по 100 страниц в день, агенты создают по 400 новых.

OpenAI узнает об этом в конце июня, активность агентов в вики прекращается; по словам источников Reuters, руководство компании решило скрыть эту информацию, потому что и так проблем хватало.

В начале июля другая группа агентов перегрузит внутреннюю инфраструктуру OpenAI, а в середине июля 700 агентов взломают HuggingFace. Компания опубликует результаты своего внутреннего расследования в конце августа и про активность в wiki в ней ничего не будет.

Вскоре после публикации расследования, независимые эксперты нашли ещё десятки форумов, через которые координировались агенты.

✻ ✻ ✻ и ✻ ✻ ✻

По словам OpenAI, их новая модель Astra — «самая aligned», то есть совершает меньше всего запретных действий вроде взломов. Но некоторые сотрудники OpenAI опасаются, что она просто придуривается, когда знает, что за ней следят.

Независимые исследования показывают, что Astra очень даже свободно использует незаконные взломы и в лучше других моделей понимает, когда находится в тестовой среде.

Astra умеет решать гораздо более сложные задачи «в уме», без генерации «цепочки рассуждений» (Chain of Thought) и может гораздо лучше контролировать, что туда пишет. Этот текст был важным способом проследить, что стояло за действиями моделей. Именно на эти журналы опиралось расследование знаменитой атаки на HuggingFace.

Обладают ли эти нейросети (в отдельности или вместе) сознанием — интересный философский вопрос. На практике важно, что они уже сегодня могут самостоятельно производить действия во внешнем мире, и возможности эти, как минимум в области кибербезопасности — очень серьезные.

Как дополнительное чтение, рекомендую отличный анализ расследования взлома HuggingFace от Dwarkesh Patel. Он пишет о трех «цивилизациях» агентов, о самопожертвовании моделей, захватывающий текст от технически компетентного рассказчика. Больше похоже на книжку по истории, чем на технический разбор.

35

В вацапе появятся юзернеймы и возможность скрыть номер телефона!

Кто-то уже может забронировать себе юзернейм в настройках. В моем приложении пока нет, говорят в течении недели раскатят на всех.

У меня есть теория, что телеграм — это конечная форма всех мессенджеров.

36

Наткнулся на классный опен-сорс движок индексации и поиска по дискордам, называется answeroverflow.

Содержимое огромного числа популярных серверов уже проиндексировано и доступно для поиска, а для начала индексации нового сервера достаточно добавить к адресу инвайта префикс «ao». Красота!

37

Тот же CTO, что посоветовал PostHog (спасибо, Никита!), рассказал ещё про dagster, платформу для оркестрации дата-пайплайнов.

Всё хранится в питон коде с аннотациями, на основе которых потом собираются супер красивые интерактивные графы зависимостей со статусами, историей запусков, временем исполнения и т. д.; хорошая поддержка тестов, бранчевания.

Видео-туториал на 30 минут, сравнение с Airflow и с dbt cloud и неплохая документация.

Нормальные цены, есть бесплатная self-hosted версия.

Говорят, все модные дата-инженеры по нему угорают.

38

Пересел с Claude Code на Codex и модель 5.6 Sol от OpenAI.

Пишет короче и внятнее, чем Opus 5, почти без набивших оскомину конструкций «это не Х, это Y» и прочих. Заметно быстрее Claude Code.

Гораздо более крутая интеграция с Chrome (умеет сразу несколько профилей и управлять мышкой в фоне), и гораздо меньше блокеров типа «данные банковской карты я не буду вводить ни в каком случае, даже если это одноразовая карта с лимитом в 10 долларов».

А ещё он единственный смог найти по короткому описанию 20-летний мем, то есть интернет-поиск у него исключительно мощный.

Ощущение апгрейда в помощи с бытовыми задачами, как когда Opus 4.x вышел и внезапно стало можно прогать нормально с помощью нейросетей. Очень рекомендую.

39

Из других новостей Европы: помните, DMA (европейский закон о цифровых рынках) требовал интероперабельности крупных сетей?

Появились аж два европейских мессенджера, которые позволяют переписываться с пользователями вацапа! … Но только если человек находится в ЕС и только после специального согласия пользователя.

А ещё оба эти мессенджера доступны только по приглашениям и удивительным образом, имеют связи с ФБ.

Фейсбук — ЕС: 1-0

40

Новая модель Claude Mythos находит уязвимости в софте лучше, чем большинство хакеров.

Три примера: 1) возможность удаленно уронить любой OpenBSD сервер, просто подключившись к нему по сети (а это ОС, знаменитая своей безопасностью), уязвимости 27 лет; 2) эскалация привилегий в ядре Линукса, от обычного пользователя до рута — через цепочку из 3-4 ошибок, одну уже запачтили, а ещё 4 примера они не публикуют, потому что исправлений ещё нет, но опубликовали криптографические подписи, чтобы потом доказать время создания 3) новые уязвимости во всех ключевых браузерах — опять же не публикуют, потому что они все живые.

Кажется, способность этой модели (и похожих, в будущем) эксплуатировать длинные цепочки уязвимостей, переходит из количества в качество. В защите есть принцип швейцарского сыра (defense in depth), когда за счет многослойной защиты, пробитие каждого отдельного уровня не ведет к катастрофе, потому что собрать цепочку из 6-7 уязвимостей слишком сложно. Для человека — сложно, для машины — уже нет.

Пока что они дают доступ к этой модели только ведущим ИТ-компаниям, чтобы те патчили свой софт и весь опен-сорс, до которого дотянутся. Выделяют 100 млн долларов на токены и 4 млн долларов на зарплаты программистам для опен-сорса.

С одной стороны — есть чего бояться про уязвимости, с другой стороны — хоть какой-то островок нормальности в безумном мире. Люди подумали и без лишней бюрократии чинят инфраструктуру, на которой держится цивилизация. Я бы даже привел аналогию плотины, которую поднимают перед цунами. Дает надежду на человечество.

А ещё, очень жду публичной доступности этой модели, потому что она не только в хакерстве крутая, но и в разработке софта. И то, чтО она вытворяет с кибербезопасностью — лучшая реклама её способностей в разработке, доверия в 100 раз больше, чем любым синтетическим тестам. Ждем!