Модели Anthropic начали вшивать в текст секретные водяные знаки.
Текст можно переписать огромным числом вариантов, просто меняя синонимы. Теперь, модели выбирают эти синонимы не случайно, и в последовательности этих не-случайностей зашит сигнал, что текст сгенерирован нейросетью.
Лингвистическую стеганографию (тайное письмо за счет замены синонимов) обсуждали ещё в начале 2000-х, но в 2022 ученый из OpenAI описал, как это можно недорого сделать в нейросетях.
Такая маркировка начинает работать примерно со 150 слов, и не работает, если у модели недостаточно свободы в выборе синонимов — при генерации кода или таблиц с цифрами. Водяной знак переживает незначительную редактуру текста, но не серьезный рерайт.
В 2024 такую маркировку вшил в свои модели Гугл под названием SynthID, а закон ЕС требует маркировать контент, сгенерированный нейросетями, начиная со 2 августа 2026. 190 компаний уже подписали с Евросоюзом договор, как именно они будут реализовывать эту маркировку.
Для детектирования маркировки нужно знать секретный ключ (если все знают ключ — то маркировку очень легко стереть или подделать). То есть для проверки нужно будет загрузить свой текст производителю модели.
Это, наверно, моя личная штука, но я всерьез задумался о том, чтобы переключиться с API на локальный инференс, когда он станет достаточно хорошим. Просто неприятно, что модели будут заниматься этой фигней за мои деньги, вместо полезной работы.
Artem Borzilov
бот удаляет каменты со ссылками а зря
Andrey
Только не модели, а конкретно клаудкод же?
А, это я читаю жопой
👍️
А то там параллельная история развивается с этим
Boris
интересно как это переживет стартап pangram
Nikian
Эт хорошая новость
Alexey M
Интересно как скоро модели ии начнут использовать эту стенограмму для общения между собой так чтобы человек не замечал их взаимодействие
🔥️7🤔️2
Ivanhoe w
Ну можно написать сильной моделью текст. А отредачить через китайскую, чтобы перетереть эти цепочки)
👍️4
Leo
Синонимы придумали для выражения оттенков. Если ИИ будут подставлять их исходя из маркировки, а не по смыслу, то мы сильно потеряем в лингвистике и размышлениях в долгосроке.
Особенно, если речь касается детей, у которых лучший друг теперь ИИ чат и у которого они учатся использовать слова для контекста
💯️14
Samat Galimov
А какой был? Потюню
Разрешил все ссылки, у них видимо по умолчанию слишком жесткий классификатор
Artem Borzilov
Было предложение написать в канал про https://stolen-thoughts.com/, там угар
👍️
Samat Galimov
Очень прикольно!
Владислав Кузнецов
Изображения тоже "подписываются" — причём речь о самом массиве пикселей. Вот сгенерированное "чёрный контур на белом фоне" изображение. В идеале его гистограмма должна содержать два ярких пика шириной в 1 - и небольшой фон промежуточных значений. Но в реальности отчётливо видно, что ширина белого пика — около 4. Конечно, там есть шум "диффузии" (хотя у OpenAI не совсем диффузионные артефакты) — но есть и вотермарка (стеганографическая подпись).
Yaroslav Shakula
Если у детей ИИ чат - лучший друг и учитель, синонимы - не самая большая из их проблем
Владислав Кузнецов
Уже было исследование (не сохранил ссылки), которое показало, что Nano Banana наносит ватермарку в Фурье-спектре изображения.
Подпишут соглашения с вендорами — и всё, делов-то.
Iwann
Через какое-то время дети незаметно для себя будут сразу писать с этими вотермарками и вся технология пойдёт
полесом)😁️4🥰️
Leo
Да все мы уже, нет?) Я уже год как замечаю что пишу как ИИ временами. А письмо это в том числе средство мышления. Подводных не вижу)
Samat Galimov
Я специально читаю антислоп, илиаду например, четко резетит мозг, гекзаметром говорить начинаю
❤️😁️3
Vitaly Vinogradov
Тут мужик еще про ИИ говорит, что не везде встретишь, свои прогнозы подтвержает 2 летней и более давности - взгляд с другой стороны.
https://t.me/theworldisnoteasy/2518
Сейчас люди наконец-то научатся нормальные цельные ТЗ писать с этим ИИ, не как раньше заказчик с аналитиком для программистов)
👍️
Artem Borzilov
хз j-space это кафе в ереване, ну прикольное конечно но обслуживание оч медленное, 12-балльного шторма не заметил
amik
https://github.com/wiltodelta/remove-ai-watermarks вот штука удаляет вотермарки с картинок