В истории про «замедление развития ИИ ради безопасности всего человечества» (две ведущие лаборатории просят национализировать себя и принять законы, контролирующие все разработки в этой сфере) есть важный контекст, который упускают массовые медиа, когда перепечатывают пресс-релизы.
Следующий логичный шаг для OpenAI и Anthropic, в логике успешного бизнеса и капитализма — первичное размещение акций на бирже, но для этого им придется раскрыть свою финансовую отчетность и показатели доходности, которой нет. Обе компании обещают трансформацию экономики и триллионы прибыли, но какая нафиг прибыль, если китайские open source модели: а) можно скачать бесплатно б) работают на гораздо более слабом железе в) наступают на пятки по качеству?
И время поджимает, потому что непонятно, как долго американские компании смогут сохранять лидерство в сравнении с китайцами, да и инвестиции в железо совершенно безумные, на сколько им ещё хватит денег инвесторов?
И вот теперь «это слишком опасная технология, которую нужно а) ограничить, чтобы не выросли новые конкуренты и б) оплачивать из бюджета, как Манхэттенский проект».
Вообще, последние публичные взломы систем моделями — это уголовные преступления, за которые должны отвечать их создатели , и что-то вроде section 230, который в свое время защитил интернет-компании от исков по контенту, размещенного на платформах, был бы очень кстати.
А ещё можно выступить бессребрениками, которые пекутся о человечестве!
Одни профиты, а риски в случае провала серьезные. Неудивительно, что PR-компания такая мощная. Как проверка: Google и Meta, которые зарабатывают на рекламе и в фин. схемы OpenAI не замешаны, в ней не участвуют.
P. S. Дарио Амадеи — мальчик из басни, который кричал: «Волки!». Первую свою публичную статью «это слишком мощная технология…» он приурочил к выходу GPT-2, так что тут интереснее реакция Альтмана, который уж точно в заботе о человечестве не замечен.
Torino
именно так
👍️
Andrey K
тоже такого мнения.. just a business.. маск, конечно, зря к компашке присоединился, только-только курсор ведь купил с "почти китайскими" моделями..
Alex
то, что можно скачать бесплатно, и запустить на слабом железе, отличается по качеству драматически.
В добавок к этому, китайские фронтир-модели поймали на перенаправлении запросов в Claude, чтобы казаться confident. Так что рановато пока говорить про классных китайцев, которые “ничего не стоят, но как OpenAI”
👍️8💯️19
Vladislav Sheikо́ ™
Подскажите пожалуйста, Какая китайская нейронка такая же как астра6 ?
👍️4💯️
Alex
вот и у меня такой же вопрос)
Даня Жеренков
Так у Альтмана и Ко стратегия противположная, хоть и нацеленная в конечном итоге тудаже. Они уверяют что они сделают AGI до конца 2026го.
То есть "ну да, Китайцы, да там экономика не сходится, но подожи-подожи, все это фигня мы ведь почти AGI сделали! Кто еще AGI сделал, а?! Что такое AGI? Ну как это что, что это вообще за вопросы? Как можно не знать что такое AGI? Это всем очень важно и нужно, давай не придумывай тут."
😁️16
Да хотя бы как Опус 👀
bama^boy
Спасибо, что подсветили.
Если Дарио прям серьезно настроен замедлить развитие ИИ, пусть переносит компанию в Европу.
😁️43
Denis N
Конспирология на мой взгляд и вы сами то этими могучими китайскими моделями на своем железе пользовались?
👍️
Andrei Kopysov
Откуда информация что китайские работают на более слабом железе? Насколько я знаю характеристики оборудования для закрытых моделей нет.
Alex
про манхэттенский проект в точку: там бюджет дал монополию, а тут просят то же самое, только конкуренты уже открытые лежат на гитхабе
0x4F6D6E6F6D6E6F6D 🦒
лучшее - враг хорошего, квен 3.8 кажется глупее чем фабл 5.1, а что на счет если сравнивать его с опусом 4.6 с которого начался большой взрыв?
Илья Кошарский
у меня другой вопрос: насколько можно доверять правительствам в вопросе защиты человечества? не зря ты Манхэттенский проект вспомнил
😁️4
Alex Yumashev
в статье вроде нет про национализацию ничего
👍️
Samat Galimov
это он в face the nation сказал, прицеплю потом ссылку
👍️
Gennady Lebedev
вы еще спросите, чем государства отличаются от рэкетиров - от каких хочет угроз, от таких и защищает, по тому прайсу который сможет с тебя содрать
Baïr
https://x.com/Polymarket/status/2099330309179204072#m
Этот туда же
Vitály Magyari
Если замедлить копилот, Win11 просто встанет 😁
Alex Yumashev
а причем тут "слабое железо"? всем насрать на домашних задротов с локальными gpu и мак-мини.
Важен энтерпрайз, который сейчас массово строит сервера с тремя-четырьмя H200 и гоняют на них GLM 5.3 которая почти не хуже Opus 5
Samat Galimov
мне кажется важно, что китайцы научились строит ДЦ полностью на своем железе, помнишь новый релиз kimi неделю давали бесплатно
💯️2
Igor Mamaev
Самат, читали? Мне кажется это уже далеко не "мальчик, который кричал волки"
😁️
Samat Galimov
книжку не читал, но с творчеством Элизера конечно знаком
https://x.com/TheChiefNerd/status/2099159049975570655
sherzod
Необычный стиль для автора канала. Это что тесты реакций?
🤝️
Ну то есть да зерно есть, но сравнение это чуть провокационно конечно
Max 💁
Вау.
Не помню тут публикаций, где хочется оспорить каждый тезис.
Пожалуйста, если интересуетесь темой, посмотрите подкаст с Ajeya Cotra из METR
https://youtu.be/X50zezLFWWI
Полугодовое отставание китайских и опенсорс моделей это не мало, если не говорить о темпах даже.
❤️
Технарь
Доходность есть, ибо маржинальность фронтир-моделей (мифос, астра) выше 80%, и даже у предыдущего поколения (опус, сол) вполне солидные для айти-бизнеса 40+% на собственном железе. У антропика, как известно, в этом году был прибыльный квартал (UPD: FT буквально сегодня написала, что уже два прибыльных квартала подряд), но обе фронтир-лабы вкладывают все деньги в будущий рост посредством масштабирования компьюта, и рост в результате реально потрясающий, беспрецедентный! Рынок это всё отлично знает и готов к первичному размещению на бирже с плюс-минус триллионными оценками.
Однако существующая бизнес-модель сломается, если прогресс ИИ замедлится, потому что современные фронтир-модели станут меньше отличаться от поделий китайских дистилляторов, которые ныне могут конкурировать лишь с фронтир-моделями 4-месячной давности и более. Ровно поэтому и гонка — экономически лабам нельзя замедляться, Альтману и Амодеи нет никакого смысла выступать против бизнес-интересов собственных компаний.
Очень смешно выглядят конспиролухи, которые два месяца назад говорили, что взлом HF — это маркетинговая операция, чтобы расхайпить IPO, а теперь, игнорируя все появившиеся пруфы, что агенты действительно ломали по собственной инициативе вопреки промтам, в ответ на признание Альтмана, что IPO вынужденно откладывается из-за safety/misalignment, вместо признания собственной неправоты переобулись в полёте и утверждают, что IPO мешают какие-то там финансовые проблемы
Samat Galimov
ну просто очень красивый сюжет
и msm просто перепечатывает пресс-релизы anthropic и openai
я ведь не в вакууме пишу
METR — это вась-вась антропиковский :(
❤️👍️
Nikita K
Как раз недавно думал про эту басню. И что ее можно интерпретировать немного отлично от классического способа — мальчик долго предупреждал людей про проблему волков, но люди с ней ничего не делали, пока волки мальчика не съели.
Даже менее продвинутые версии LLM несколько лет назад дали гигантские возможности для массового спама, пропаганды, срезания углов где важно подумать, а не только сделать что сказала модель и т.д.
Для не языковых моделей тоже большое пространство для злоупотребления — как пример revenge porn.
Текущие версии уже позволяют делать очень-очень много небольшими группами людей или даже в одиночку.
А еще, помимо проблемы rouge AI, есть проблема evil actor. Модель может быть еще не может делать какие-то ужасные вещи полностью самостоятельно. Но люди используя модель могут.
Проблема AI aligment на самом деле проблема human aligment, которую не решили.
Ящик пандоры уже открыт. Большинство людей не научились использовать доступные модели на полную мощь. Так же как большинство людей не умели эффективно пользоваться google.
Дарио последовательно много лет пишет подробные эссе с описанием реальных проблем. И не он один. Про это пишут десятки лет. Но люди продолжают думать на основе новостных заголовков и привычных моделей восприятия мира аля "это все только ради денег".
👍️2
K L
Откуда цифры про маржинальность и остальное ? По оценкам ramp 1% компаний делают 80% выручки. Это может показаться очень сильным risk exposure
Некоторые люди сжигают по 2-3 подписки (200$ каждая) на астру за день-два, потом сидят ждут ресетов, при том что подписки по сути субсидируются (то есть реально сжигают токенов на несколько тысяч $).
👍️
Технарь
Я ориентируюсь на SemiAnalysis, но вообще куча оценок есть в интернете, погуглите сами или делегируйте агенту! Не вижу никакой проблемы с 1% компаний — это компании, которые готовы переплачивать, они всегда будут покупать самые лучшие решения на рынке и никогда не уйдут на модели с открытыми весами, потому что те всегда будут хоть немного, но отставать.
Субсидируются подписки только относительно рыночных цен на токены, но не относительно себестоимости инференса на собственном железе (на чужом железе, конечно, дороже). Куча людей и компаний покупают подписку, но не исчерпывают даже четверти лимита, так что в среднем всё совсем не так плохо. Размен инференса дороже себестоимости (пусть и с умеренной маржой) на ценные для дальнейшего обучения токены для лаб очень даже выгоден
K L
Во-первых ничего «гуглить» я не буду. Значит цифр нет. Во-вторых, «рыночные цены» на токены это нонсенс
Конечно субсидируется инференс
Технарь
Один клик буквально)
Рыночные цены есть на любой продукт, продаваемый на рынке, как и себестоимость. Это всегда две разные величины
Представьте, что себестоимость нового смартфона для компании Pear — 100 долларов, а рыночная стоимость — 1000, при этом есть подписка, по которой вы можете один раз купить его за 500. Субсидируется ли продажа этих смартфонов по подписке? Да! Выгодна ли она для Pear? Тоже да! Тут нет никакого противоречия
K L
Клик куда? Где ссылка не на саммари от ллм?
Технарь
Вперёд, раз вы такой ленивый https://www.google.com/search?ie=UTF-8&q=margin%20on%20tokens%20frontier%20labs (я просто не знаю, блокируются ли тут внешние ссылки)
K L
Рынка токенов нет, не надо ничего придумывать.
🤡️
Технарь
Есть ли рынок новых айфонов?
K L
Проблема в том, что треть уйдет на селф-хост (уже достаточно хорошие для многих зада) и выручка упадает на 25%
Это неинтересный разговор
Технарь
Потому что вы просто не понимаете рыночную экономику
На открытые модели уходят чувствительные к цене клиенты, на которых и так много не заработать
K L
Ты считаешь, что токен от антропика равен токену от GLM и думаешь они образуют общий рынок, но это не так.
Технарь
Смартфон от эпл не равен смартфону от самсунга, но это не отменяет того факта, что рыночная цена на новые айфоны — это та цена, по которой эпл их продаёт
K L
Мой поинт в том, что если за инференс было заплачено 10$, а я по факту заплатил 10 центов, то эта модель долго жить не будет и маржинальность 80% требует какой-то другой модели
Технарь
Если:
1) стоимость инференса по API — $10;
2) стоимость инференса по подписке в среднем по всем подписчикам — $5;
3) стоимость инференса по подписке в случае достижения лимита — $3;
4) себестоимость инференса — $2;
то это самый выгодный бизнес в истории человечества
K L
Прости, но я не понимаю твою мысль. Может я тупой, но как можно субсидировать рыночную цену и зачем, если себестоимость не требует субсидирования я не понимаю
Технарь
Спрос на токены такой большой, что предложение не может его удовлетворить, из-за этого рыночная цена сильно выше себестоимости. Если аналогия со смартфонами вам непонятна, попробую набросать аналогию с бензином в России (цифры условные):
— себестоимость производства бензина на НПЗ около 30 рублей;
— рыночная стоимость литра бензина около 90 рублей;
— государство субсидирует бензин, чтобы люди могли покупать его по 60 рублей. Это выше себестоимости, но ниже рыночной цены. Так понятно?
Субсидия всегда применяется к рыночной цене, не к себестоимости! Себестоимость — это внутреннее дело производителя, она не влияет на цены напрямую
Ivan Onushkin
посылать в гугл это конечно такое себе. Сколько-нибудь достойных источников о маржинальности в 80% нет. Все статьи что я видел выглядят как гадание на кофейной гуще и прогрев перед IPO.
🗿️
K L
Спрос на токены большой? Нонсенс
🤡️
Ivan Onushkin
Государство субсидирует с понятной целью и к тому же их тех денег которые само забирает. Зачем субсидировать антропику с опенай когда по вашим словам, из-за большого спроса у них купят любой объем токенов решительно непонятно. Но факт есть, субсидирование подписок мы наблюдаем.
А теперь внимание вопрос. Не роняет ли это субсидирование итоговую цену близко/ниже себестоимости?
Технарь
Я же выше уже написал: "для дальнейшего обучения". Токены, которыми строят реальный сложный софт — самые ценные
Stopthefire01
Поздравляю, вы в секте антропика)
K L
Training != inference. Кто тебе даст код от сложного софта, который реально ушел в прод? Ты продолжаешь что-то выдумывать на пустом месте
Данные для обучения уже давно кончились, поэтому они режут ценные редкие книги. Тренить на новом коде из гитхаба, который часто сам ими же и написан, будто data poisoning. Аутпут модели и «сложный код», ушедший в прод - не одно и то же. Сложный код не каждый будет выкладывать на гитхаб.
Технарь
Если вы покупаете обычную подписку, то вы по умолчанию соглашаетесь на то, чтобы на ваших данных обучали следующее поколение моделей — вы не в курсе? ZDR доступен либо по API, либо по специальным партнёрским соглашениям. И куча людей пушит в прод код, сгенеренный в Claude Code по подписке, это общеизвестно
Вот именно, что большая часть кода не выкладывается на гитхаб, но попадает к антропикам благодаря подпискам
K L
Нет. Это зависит от провайдера и подписки.
https://privacy.claude.com/en/articles/10023580-is-my-data-used-for-model-training
https://privacy.claude.com/en/articles/7996868-is-my-data-used-for-model-training
Почти то же самое у openai
Max 💁
Спасибо, а вы получается в какой?
Dmitry Valetin
Тут очень важно понимать причину и следствие. На мой взгляд основная причина по которой китайские модели приближаются к фронтир лидерам - дистилляция. Совсем перекрыть кран дистилляции лидеры не смогут. Но и модели сопоставимого качества на дистиленных данных создать не очень получится - слишком много синтетики. По объему инвестиций видно что Китайцы не очень много вкладываются в собственно дообучение людьми - дообучают именно через дистилляцию: это проще и дешевле. А значит останови разработку OpenAI или Claude и точно наступит плато у китайцев. Второй тезис про экономику токенов: тут все сложнее, но консенсус сводится к тому что подписки оплачивают не сами производители моделей, а их Энтерпрайз потребители, платящие за токены. Главный вопрос: достаточно ли разрыва между топ моделями и их дистиллятами чтобы полатить премию за качество или нет? И в какой момент будет дешевле купить свой кластер и до обучить условный квен на своих данных…
Ivan Onushkin
А вот откуда уши про 80% margin
Anthropic’s gross margins are above 80 per cent before accounting for revenue shared with distribution partners, including Amazon, and the cost of training its models, according to two of the people.
Отлить в граните.
https://www.ft.com/content/4564e6a5-69e9-40a6-bf0f-a888f2f4f002
🤣️
Kirill Zagoskin
Ну все так!
Denis Zolotarev
Да нет, просто китайцы начнут наконец вливать туда деньги
Позиция догоняющего в данный момент очень выгодная. Американские лаборатории 70% работы делают за них
👍️