будни

Сайт Кремля меж тем не выдерживает трафика и отдает видео со скоростью 35КБ/с 🤷‍♀️

Так хочется продолжать писать про прикольные штуки, которые мы делаем, про технологии, про продукты, инструменты и гэги индустрии, но это всё чувствуется таким неважным, таким искусственным на фоне происходящего :(

Эти месяцы я молчал, теперь попробую продолжить то, что делал до февраля; у меня в запасах пара сотен ссылок и историй, буду потихоньку их публиковать. Возможно, это поможет вернуть нормальность в жизнь.

Господи, поскорее бы всё это закончилось :/

Мы в компании «Федя и Самат» проводим эксперимент.

Пробуем 4-дневную рабочую неделю.

Мотивация простая: всё равно больше 4 дней нормально думать, именно думать, не просто клавиши нажимать — не получается. Раз так — что время зря терять? Лучше с толком отдохнуть.

Предложил Федя, провели в пятницу общую встречу про это. Отзывы команды:
— «мы и так раньше не следили за рабочим временем и коммуникация почти вся асинхронная, какая разница»;
— «я так всегда и работал»;
остальные отреагировали настороженно, но это в зуме.

У нас через пару недель оффлайн слёт — обсудим там первые впечатления подробнее.

Больше всего я боялся непонимания клиентов. По идее, для них ничего не изменится, просто не будем назначать встречи по пятницам, но всё равно страшно. Пока полет нормальный.

Эксперимент продлится 2-3 месяца. Федя обещает регулярно отчитываться публично у себя в канале, а я, наверное, буду как обычно время от времени байки травить и отчитаюсь в конце.

Краткий список литературы (я сомневаюсь в её валидности): свежая статья от Harvard Business Review, английская википедия, красивый лендос и аж целое НКО.

Хотел прикупить себе рекламы в телеграме, зарегистрировался в личном кабинете рекламодателя. Всё просто и понятно, как обычно в телеге. Рекламировать можно только контент внутри самого телеграма, на внешние сайты ссылку не дашь.

Встречали это «вечное противостояние» между продактами и разрабами? Каждый думает, что лучше знает, что делать с продуктом:

— нам нужно сделать такую фичу, срок такой
— сорян, у нас всё сыпется, надо технический долг отдавать, сделаем через три недели
— тогда летят наши квартальные цели
— а у нас всё сыпется

Раньше я думал, это — «здоровый производственный конфликт». Теперь я считаю, что это — признаки «бытовой неустроенности», того, что с разработкой в компании есть проблемы. К сожалению, 90% команд живёт в этом состоянии.

До конца недели я буду отвечать на вопросы о разработке в телеграм-канале «продуктовая культура». Если вопрос будет касаться взаимодействия продакта и разработки, отвечу я. Если вопрос со стороны технических специалистов про продукт, продуктовые циклы и всё это — ответит Валерия Розова, основательница курса «менеджер продукта».

Я приму участие в этом курсе — но об этом в следующий раз.

Сегодня общался с клиентом, который хочет знать, сколько стоит сделать маркетплейс.

Трагедия в том, что предыдущий подрядчик уже взял кучу денег и потратил полгода клиента «на разработку», не задав базовые вопросы о бизнесе. Честно говоря, у него и не было шанса запуститься вовремя.

Пускай это жёсткий пример, но история классическая:
1. заказчик описывает задачу и просит назвать сроки и цены;
2. подрядчики называют сроки и цену и берут проект;
3. начинаются работы по проекту, и что-то идёт не так;
4. к дедлайну нужного результата нет, все недовольны. Но проект надо доделать.

И эта проблема не только у аутсорсеров — такая же динамика есть и во многих продуктовых компаниях.

Почему так происходит?

- 💼 заказчики живут в реальном мире: если продукт не начнет продаваться или решать другие задачи вовремя, то экономика бизнеса не сойдется и можно закрываться — поэтому они требуют четких сроков и смет;
- 🙏 подрядчики вынуждены комититься в сроки и деньги без детальной проработки проекта. Иначе проект возьмет более сговорчивый конкурент, и команда останется без зарплаты;
- 🛠️ разработчики в команде мечтают работать над сложными проектами уровня Яндекса, но вынуждены пилить такие кривые задачи, как будто их ставили некомпетентные дураки.

На самом деле все хотят как лучше.

Одна из причин проблем — устойчивая иллюзия, что разработка — это простой процесс: берешь задачу и составляешь по ней инструкции для машины на подходящем языке программирования. Такая по сути механическая работа.

Почему это иллюзия?
Потому что разработка — это перевод очень нечетких хотелок и смутных желаний заказчика в супер строгий, не допускающий никакого двойственного толкования язык программирования. Это как с мыслями: всё очевидно, пока крутишь их в голове. Но стоит сесть и попытаться записать их, как выходит полная хрень.

(Этот пост я написал с третьей попытки, а потом понял, что потребуется целая серия постов. Так что я знаю, о чём говорю.)

💡 Для того чтобы управлять сроками, качеством и стоимостью разработки, нужно действовать контринтуитивно: уметь находиться в состоянии неопределенности, выдерживать её — и методично её прояснять.

На старте проекта бессмысленно требовать от заказчика четкости: вообще самое плохое, что можно сделать — это заставить его написать техническое задание (если он умеет писать ТЗ — то он и программирует неплохо). Вместо этого мы вначале 70-90% времени работаем исследователями — разбираемся, какую бизнес-задачу заказчика решаем и какие ресурсы и ограничения у нас есть.

Следующим постом хочу поделиться, как мы проясняем задачу. Но для этого важно сначала признать тот факт, что прояснить задачу заказчика сложнее, чем кажется на первый взгляд.

Это случилось: наша админка (монитор) очень сильно интегрирована со слеком и прямо сейчас у слека проблемы. Из-за этого проблемы у нашего монитора. Но это ещё не всё — проблемы ещё и у нашей системы сбора ошибок Bugsnag. Ой-вей, SaaS мир. Задача на следующий год — сделать прокси-сервис для всех внешних зависимостей.

Я записываю все зум-звонки по умолчанию. Зум напомнил в письме, что за три года я использовал 1,3Тб — 27406% из 5 гигабайт, включенных в тарифный план. Раньше он просто напоминал, а теперь обещает отключить запись, если не заплатить или не удалить лишнее.

Терабайт хранилища в зуме стоит 100 долларов в месяц, следующий шаг — уже 5 терабайт за 500$ в месяц. Облачные хранилища — довольно дорогая штука, но есть замечательный Backblaze, 2ТБ в котором стоят 10$ в месяц. Решено, перегоню все записи в него.

В интернете есть много скриптов, которые переносят записи из зума в другие облака, но они 1) сложны в администрировании 2) рассчитаны на поточное использование, а не на массовый переезд.

За пару вечеров я написал скрипт, который прямо сейчас переносит весь мой архив — 3000 записей. Средняя скорость — 1,3ГБ/минуту. Скрипт можно дергать сколько угодно раз и использовать даже для автоматического переноса всех новых записей. Пользуйтесь на здоровье.

А вы записываете зум звонки?

Да, по умолчанию5%
Изредка39%
Нет56%
3 733 ответов

Если говорить про бизнес в целом — то всё слава Богу, только вот регулярно отказываю потенциальным клиентам, потому что не хватает рук и голов :(

Хочется нанять ещё человек 5, но найм — это история не быстрая, а учитывая наши требования к сознательности программистов, их одновременному интересу к продукту, умению хорошо прогать и при этом давать и выдерживать обещания — то совсем жесть.

Мы ищем фронтендеров (у нас Vue 3) и бэкендеров (питон) — как мидлов, которые хотят прокачаться, так и опытных специалистов.

Предлагаем интересные задачи, ответственности и свободы сколько возьмете, классных коллег и среду для роста. Пишите Феде!

Если хотите, чтобы такие вот прекрасные ребята работали над вашими проектами — пишите мне. Программировать прямо сейчас не начнем, но обсудить, подумать и забронировать слот — можно.

Похвастаюсь. И извините, сейчас будут два поста подряд.

Позавчера, впервые отказал клиенту вот так:

К(клиент): нам нужно, чтобы вы запрогали Х за 2 месяца.
Я: к сожалению, мы не успеем. Там работы больше, чем на 2 месяца, успеем только Y.
К: ну, тогда, видимо, заканчиваем сотрудничество.
Я: да, заканчиваем.

Горжусь собой, что у меня не включился мой обычный рефлекс «договориться любой ценой, пообещав чуть больше, чем реально».

Мы с Федей делаем в программирование такие штуки, которые мало кто может, но всё равно, я часто обещаю чуть больше, чем способны мы. Какие бы крутые результаты мы не показали — до обещаний они всё равно не дотягивают. Клиент разочаровывается, мне стыдно, мы доделываем работу без доплаты и теряем деньги, ну и на дальнейшее сотрудничество это влияет так себе. И вот, наконец, я сделал по-другому.

Я и раньше отказывал клиентам, но только когда у меня прям совсем не было ресурсов их взять. А тут я теоретически могу их взять, но отказался, потому что договариваться придётся на малореальный результат.

Слава богу, что клиентов достаточно и я могу научиться не врать. Слава богу. И горжусь Федей, нашими программистами, Дари и собой, что у нас это получается!

Всё, похвастался. :)

Очень интересно про ИИ-чипы и стоимость инференса.

Вопрос не теоретический: мы планируем продолжать работу с клиентом, для которого проводили аудит огромной старой кодовой базы, и если в прошлый раз вся работа с нейросетями влезла в 200-долларовую подписку, то теперь, когда github copilot просит денег за каждый токен, такая же работа встанет в 2 тысячи долларов.

Ребята недавно провели эксперимент и выяснили, что личные подписки на клод в 20, 100 и 200 долларов дают сжечь токенов на 400, 2000 и 8000 долларов в месяц соответсвенно. Для тарифов OpenAI, коэффициент ещё выше — 700, 3500 и 14000 долларов в месяц (до 70x!).

Насколько сильно субсидированы эти подписки? Какая маржинальность у продажи токенов крупным потребителям? От этого зависит, сохраним ли мы текущий уровень доступа к ведущим моделям или мы с вами живем короткий «золотой век ИИ». Учитывая, что и Anthropic и OpenAI готовятся к выходу на биржу, верить никому нельзя :(

Тут конечно все вспоминают бум строительства железных дорог, или пузырь доткомов. Большинство компаний, которые строили железные дороги или прокладывали оптоволоконные кабели обанкротились, но рельсами и оптоволокном мы пользуемся до сих пор. Поживем — увидим.

⁕ ⁕

На пятки этим SOTA моделям наступают китайские open-source и open-weight аналоги GLM-5.2, Minimax M3, Kimi K2.6. Последние месяцы они неустанно приближаются по качеству к ведущим производителям, но зазор всё ещё есть. Доступ к ним по API можно купить в разы дешевле, потому что они меньше, более оптимизированы и конкуренция между провайдерами выше.

Интересный аспект: китайским пользователям, так же и как и россиянам, официальный доступ к клоду и chatgpt закрыт, так что есть десятки спекулянтов, которые регистрируют сотни и тысячи аккаунтов, покупают на них подписки и перепродают доступ к ведущим американским моделям.

Ходят слухи, что эти «арбитражники ИИ-подписок» в Китае зарабатывают в два конца. Сохраняют всю переписку пользователей с нейросетями (ведь все запросы проходят через них) и продают эти логи создателям китайских моделей. А те потом используют эти логи для дообучения своих моделей.

Вообще, если ты можешь задавать вопросы мощной модели, обучение которой стоило десятки миллионов долларов, можно за небольшую долю этих денег произвести так называемую «дистилляцию», и обучить маленькую модель быть почти такой же умной, как и большая. Именно в этом сегодня Anthropic обвинил китайского гиганта Алибабу.

⁕ ⁕ ⁕

Третья часть этого поста — про будущее.

Вчера OpenAI представила первый кастомный чип, который, якобы, на 50% оптимальнее для инференса, чем чипы от NVIDIA. Печатает их TSMC, проектирует Broadcom, стандартный комплект.

Энтузиаст недавно прошил microGPT прямо на FPGA. Это такие процессоры, логику работы которых можно поменять за несколько секунд-минут (перепрошить). У них относительная низкая тактовая частота (сотни и даже десятки мегагерц против гигарец современнных процессоров), зато если получится уложить весь алгоритм в «железную логику», то чип начинает выдавать готовый ответ на каждый такт, то есть миллионы раз в секунду. FPGA используют для обработки видео, сигналов, на ракетах и в радарах — в приложениях, где важна скорость и надежность. Есть много экспериментов, когда в них укладывали небольшие модели.

Компания TAALAS пошла дальше всех и разработала чип, который реализует Llama 3.1 8B прямо в кремние. Это приличная open source модель 2 летней давности, пусть и с небольшим контекстом (6 тысяч токенов против привычных сотен тысяч сегодня). Самая крутая ИИ-карта Nvidia B200 дает 353 токена в секунду на пользователя в этой модели, а аппаратная реализация TAALAS — 16 тысяч токенов в секунду. Попробовать самому можно на сайте chat jimmy. А теперь представьте, что это нормальная взрослая модель и используется для разработки софта. Дух захватывает.

P. S. Параллельно развиваются специализированные локальные модели, которые работают на компьютерах и телефонах пользователей (тут впереди всех Apple) и есть отдельное движение за децентрализованный инференс (как у криптовалют), у его апологетов я недавно брал интервью, но это уже совсем отдельная история.