К содержанию
Фонтум Искусственный интеллект Урок 19 / 24 Все уроки

Главная · Курсы · Искусственный интеллект · Программа курса · Модуль VI. Что идёт не так · урок 19 из 24

Дипфейки, копирайт и регулирование ИИ

Копирайт без ответа, дипфейки и регламент, сроки которого пришлось сдвигать

Дипфейк это синтетическая запись, изображающая реального человека говорящим или делающим то, чего не было: технически обычная генерация, отличается цель, узнаваемое лицо или голос. Ответ регуляторов это машиночитаемая маркировка, признак внутри файла, который читает программа, а не подпись в углу картинки. Метка помогает добросовестным и бессильна против умысла: её снимают пересохранением файла или пересъёмкой экрана, а отсутствие метки не говорит ничего.

Регламент ЕС об ИИ, июнь 2024. Пакет поправок, май 2026. Приватность и обучающие данные по §10.3 базы фактов · 22 мин · обновлено 12.09.2026

После урока вы сможете

  • Различать вопрос о том, как устроено, и вопрос о том, что об этом договорились люди
  • Знать, что у спора об обучении на защищённых текстах устоявшегося ответа на 2026 год нет
  • Понимать, почему сроки регламента ЕС правились и что это говорит о темпе регулирования
  • Обращаться с рабочим текстом, вставленным в чат-бот, как с текстом, покинувшим периметр

Представьте, что вы написали книгу. Через несколько лет появляется система, которая по просьбе «напиши абзац в стиле такого-то автора» выдаёт нечто узнаваемо ваше. В обучающий корпус книга попала, согласия у вас никто не спрашивал, и спрашивать было некому: такие корпуса собирают не по одной книге.

Вопрос «законно ли это» звучит просто и готового ответа не имеет. Точнее, ответ зависит от страны, от того, что именно делали с текстом, и от того, чем кончатся разбирательства. Иски поданы, практика складывается прямо сейчас, и на 2026 год устоявшегося ответа нет.

Этот урок целиком о скоропортящемся, и такой он в курсе один. Остальные объясняют механизмы, которые от года к году не меняются, и датированное появляется там отдельными фразами. Здесь же речь о законах, исках и сроках, а они меняются, пока курс читают.

Оговорка сразу, чтобы не вышло недоразумения. Урок не даёт юридических советов и не заменяет консультацию: право различается по странам и меняется со временем. Задача у него другая. Он показывает устройство спора и учит спрашивать дату, стадию и первоисточник.

Пометка, без которой урок читать нельзя

Всё написанное дальше описывает состояние на 2026 год. Не «в наши дни» и не «на сегодняшний день», а именно 2026-й. Дата названа затем, чтобы через два года вы не приняли описание прошлого за описание настоящего.

Оборотов «в наши дни» и «на сегодняшний день» в курсе нет вовсе, а помета «на 2026 год» стоит в десяти уроках из двадцати четырёх. Разница между недатированным оборотом и датой принципиальная. Механизм не портится: градиентный спуск работает так же, как работал в 1986 году, и объяснение к нему не стареет. Состояние дел портится быстро, а написанное о нём стареет молча, не подавая никаких знаков.

Отсюда правило чтения, полезное далеко за пределами этого урока. У любого утверждения о положении дел спрашивайте дату, а если даты нет, считайте её неизвестной. Утверждение без даты не становится вечным, оно перестаёт быть проверяемым.

на заметкуЧто перепроверить, если вы читаете это позже

Четыре пункта, и все четыре названы в базе фактов курса как скоропортящиеся: сроки европейского регламента об ИИ, исходы судебных исков об обучении на защищённых текстах, состояние надёжности агентов и не появилось ли решение проблемы инъекций из урока 18. Если хотя бы по одному пункту вы нашли свежую новость, считайте соответствующий кусок урока историей, а не описанием положения дел.

Копирайт: два разных вопроса

Спор о копирайте выглядит одним вопросом, а вопросов внутри два, и путать их не стоит. Первый касается входа: можно ли обучать модель на защищённых текстах и изображениях без разрешения правообладателя. Второй касается выхода: кому принадлежит и что нарушает то, что модель произвела.

Про вход спорят так. Одна сторона говорит, что обучение это анализ, похожий на чтение: человек тоже читает книги и потом пишет свои. Другая отвечает, что копию всё-таки сделали, что масштаб несопоставим с человеческим и что результат конкурирует с источником на том же рынке.

Про выход спорят иначе, и здесь важен один установленный факт. Модели иногда воспроизводят фрагменты обучающих данных почти дословно, и показано это измерениями, а не догадками. Значит, довод «модель ничего не хранит, она только обобщает» верен не всегда, и спор из-за этого не закрывается.

Полезно заметить, чего в этом споре нет. Нет разногласий о том, как устроено обучение: обе стороны описывают устройство одинаково. Спорят о другом, о том, как назвать это устройство на языке права: копированием, анализом или чем-то третьим. Ради такого различения урок и вынесен отдельно: вопрос механизма решён, вопрос названия не решён.

Ни один из двух вопросов на 2026 год окончательного ответа не имеет. Разные страны отвечают по-разному, часть дел не рассмотрена, часть кончилась соглашениями сторон без общего правила. Курс поэтому фиксирует не ответ, а состояние: спор открыт, и его исход надо проверять отдельно и по свежим источникам.

Дипфейки и маркировка

Вторая область, где право догоняет технику, охватывает поддельные изображения, голос и видео. Словом дипфейк называют синтетическую запись, изображающую реального человека говорящим или делающим то, чего не было. Технически это та же генерация, что и картинка по описанию. Отличается цель: узнаваемое лицо конкретного человека.

Ответом, к которому пришли регуляторы, стала маркировка синтетического контента. Сгенерированный материал предлагается помечать так, чтобы метку читала программа: не подпись в углу картинки, а признак внутри файла. Тогда площадки и поисковые системы смогут отличать одно от другого без участия человека и в любом количестве.

Приём разумный и хрупкий одновременно, и обе половины надо назвать честно. Метка помогает добросовестным: с ней сгенерированное не спутаешь с записанным по невнимательности. Против злого умысла метка бессильна: её снимают пересохранением файла, обходят пересъёмкой экрана или просто берут инструмент, который меток не ставит.

Второй ответ, кроме маркировки, состоит в том, чтобы распознавать подделку по самой записи. Работает он ненадёжно и стареет быстро: каждое улучшение генерации обесценивает прежние признаки подделки. Получается гонка, в которой проверяющая сторона всегда на шаг позади. Поэтому регуляторы и делают ставку на метку у источника, а не на разоблачение после публикации.

Отсюда следует вывод, о котором забывают чаще прочего. Наличие метки кое-что говорит, отсутствие метки не говорит ничего. Строить проверку подлинности на рассуждении «метки нет, значит запись настоящая» нельзя ни при каком качестве маркировки.

Регламент ЕС: как двигали сроки

Самым разобранным примером регулирования служит европейский регламент об искусственном интеллекте, известный как EU AI Act. Принят он в июне 2024 года и устроен по уровням риска: чем больше возможный вред от применения, тем больше обязанностей у того, кто систему поставляет. Обязанности вступают в силу не разом, а по расписанию.

Уровней в регламенте несколько, и различать их полезно. Часть применений запрещена прямо, часть отнесена к высокому риску и обвешана обязанностями, остальное регулируется мягко или не регулируется вовсе. Обязанности при высоком риске это оценка, документация, требования к данным и надзор человека, а не запрет работы. Отсюда берётся и разнобой в заголовках: «запретили» и «разрешили» описывают разные полки одного закона.

Расписание и оказалось самой интересной частью. Сначала сроки отстояли: в июле 2025 года Комиссия отказалась их двигать и заявила, что паузы не будет, потому что сроки записаны в законе. Через четыре месяца она сама предложила пакет поправок. Соглашение о нём достигли в мае 2026 года, и в силу он вступил 27 июля.

Сдвинулись два срока. Обязательства для систем высокого риска, работающих самостоятельно, перенесены с августа 2026 года на декабрь 2027-го. Для встроенных в регулируемые изделия срок уехал с августа 2027-го на август 2028-го. Создание национальных регуляторных песочниц, то есть мест, где новую систему обкатывают под надзором, перенесено с августа 2026 года на август 2027-го.

А вот обязанность помечать синтетический контент машиночитаемо не переносили вовсе: она действует с августа 2026 года. Отсрочку до декабря 2026-го получили только системы, уже стоявшие на рынке к этому сроку. Отсрочка для существующих систем и перенос обязанности означают разные вещи, и в пересказах их путают чаще всего.

Важно здесь не расписание, а его судьба. Сроки сначала публично подтвердили, а через четыре месяца предложили сдвинуть, и уехали не все обязанности, а те, что требуют готовой оснастки. Это и есть содержание урока: перед нами измерение того, с какой скоростью договорённости успевают за предметом.

июнь 2024принятавгуст 2026срок до правокмаркировка осталась здесьпесочницыавгуст 2027высокий рискдекабрь 2027перенесли не всё: обязанность маркировки осталась на августе 2026 года
Что сдвинулось и что осталось: расписание регламента после поправок 2026 года

Почему сроки двигают

Разбирать сдвиг стоит без злорадства и без возмущения, потому что причины у него понятные. Закон обязан назвать свой предмет, а предмет за время написания менялся: регламент задумывали до ноября 2022 года, а дописывали, когда языковые модели стали массовым явлением. Определения приходилось переделывать по ходу работы.

Вторая причина в том, что обязанность должна быть выполнимой. Чтобы помечать синтетический материал машиночитаемо, нужны согласованные технические стандарты, а стандарты пишут дольше, чем закон. Срок, к которому стандарта нет, превращает требование в невыполнимое, и это понимают обе стороны.

Третья причина это давление в обе стороны, и оно не скрывается. Одни просят отсрочки, потому что не готовы к проверкам и отчётности. Другие требуют ускориться, потому что вред, о котором идёт речь, происходит уже сейчас. Сдвиг сроков и есть компромисс между этими доводами, а не победа одной из сторон.

Что из этого следует читателю новостей. Между «регламент принят» и «правило действует» лежит расписание, и оно может измениться ещё раз. Спрашивать надо не «принят ли закон», а «какая именно обязанность и с какого числа», и проверять ответ заново.

ловушкаКак читать заголовок «в Европе запретили ИИ»

Регламент почти ничего не запрещает целиком: он раскладывает применения по уровням риска и вешает обязанности, такие как оценка, документация, надзор человека. Из заголовка нельзя понять ни уровень, ни обязанность, ни дату вступления в силу. Полезно завести привычку доставать три вещи: о какой категории систем речь, что именно требуется и с какого числа это работает.

Приватность: чат-бот как канал утечки

Последняя тема урока ближе всего к повседневности. Сотрудник вставляет в чат-бот кусок внутреннего договора или незакрытый отчёт, чтобы получить короткий пересказ. Задача решается за десять секунд, и вместе с ней делается кое-что ещё.

Текст покинул периметр организации в момент отправки. Дальше он хранится у поставщика услуги, обрабатывается по условиям договора и доступен тем, кому положено по этим условиям. Попадёт ли он в обучение следующей модели, зависит от настроек и тарифа, а не от догадок отправителя.

Оценивать это как «страшно» или «нормально» урок не берётся: ответ зависит от того, что за текст и чей он. Важнее увидеть механизм: утечка состоит уже в самой передаче, а не в каком-то последующем происшествии. Контроль над документом теряется в ту секунду, когда нажата кнопка отправки.

Организации отвечают на это по-разному, и способы стоит знать заранее. Одни запрещают внешние сервисы и ставят модель внутри собственного контура. Другие берут тариф, в котором переписка не идёт в обучение, и закрепляют это договором. Третьи учат сотрудников простому приёму: обезличивать текст до отправки, убирая имена, суммы и номера.

Отсюда практическое правило, которое не устареет вместе с сервисами. Спросите себя, согласны ли вы отправить этот текст подрядчику, о котором знаете немного. Если ответ «нет», то и в окно чата его вставлять не стоит, каким бы удобным оно ни было.

миф«Написанное в чат-бот остаётся между мной и программой»

Программа не стоит у вас на столе: запрос уходит на чужие серверы, сохраняется там и обрабатывается по условиям, которые вы приняли не читая. Часть сервисов по умолчанию использует переписку для улучшения моделей, другая часть обходится без этого, и различие спрятано в настройках. Проверять надо не ощущение приватности, а конкретный пункт условий и конкретную настройку.

Что здесь не устареет

Урок помечен датой, но кое-что в нём переживёт любую правку расписания. Первым идёт различение двух вопросов: как устроено и что об этом решили люди. У первого ответ измеримый, у второго только договорной, и второй меняется голосованием.

Второе место занимает привычка спрашивать дату и стадию. Предложено или принято, вступило в силу целиком или частями, какая обязанность работает с какого числа. Разница между этими стадиями в новостях обычно теряется, а именно в ней всё дело.

Третье это понимание, откуда берётся отставание. Договариваться люди умеют медленнее, чем техника меняется, и это свойство устройства, а не чья-то нерасторопность. Три срока, уехавшие разом, дают самое наглядное подтверждение этому, какое можно было получить.

Четвёртым стоит умение не путать вопрос о вреде с вопросом о законности. Вред бывает и там, где ничего не нарушено, а нарушение бывает без всякого вреда. Смешивать их удобно в споре и вредно в рассуждении, поэтому лучше разводить их сразу.

Что дальше

На этом кончается модуль о том, что идёт не так. Три поломки оказались разной природы: одна сидит в данных, вторая в конструкции, третья в скорости, с какой общество договаривается. Ни одна из трёх не чинится одним лишь программированием.

Дальше начинается модуль о больших спорах, где у курса позиции нет. Урок 20 спрашивает, понимает ли машина, и разбирает три ответа: китайскую комнату, стохастических попугаев и то, что удалось разглядеть внутри моделей. Вердикта там не будет, и это не уклонение, а точное описание состояния вопроса.

Полезно взять туда привычку, добытую здесь. У всякого сильного утверждения спрашивайте, факт это, договорённость или прогноз. У второго и третьего требуйте даты, а у первого ищите измерения.

Ключевые работы и результаты

Регламент Европейского союза об искусственном интеллекте (EU AI Act)2024Принят в июне 2024 года. Раскладывает применения по уровням риска и назначает обязанности поставщикам. Обязанности вступают в силу по расписанию, а не одновременно с принятием.
Пакет поправок к регламенту ЕС: предварительное соглашение2026Пакет поправок, предложенный в ноябре 2025 года и вступивший в силу 27 июля 2026-го: обязательства для самостоятельных систем высокого риска перенесены с августа 2026 года на декабрь 2027-го, для встроенных в регулируемые изделия с августа 2027-го на август 2028-го, а национальные регуляторные песочницы уехали на август 2027-го.

Что подтвердилось, а что нет

спор открытУ обучения на защищённых текстах есть установленный правовой статус.

Тексты попадали в обучающие корпуса без согласия авторов, и это стало предметом разбирательств. На 2026 год исходы не сложились в устойчивую практику: разные страны отвечают по-разному, часть дел не рассмотрена, часть завершилась соглашениями без общего правила. База фактов курса помечает этот пункт как требующий перепроверки перед переизданием.

мифРегламент принят, значит, правила уже действуют.

Принятие и вступление в силу это разные события, разделённые расписанием. Европейский регламент принят в июне 2024 года, но обязанности включаются по частям, и пакет поправок 2026 года сдвинул часть из них: системы высокого риска на декабрь 2027-го, песочницы на август 2027-го. Обязанность маркировки при этом не переносили вовсе. Спрашивать нужно про конкретную обязанность и конкретное число.

мифНаписанное в чат-бот остаётся между вами и программой.

Текст уходит на серверы поставщика услуги, хранится там и обрабатывается по условиям, которые пользователь обычно принимает не читая. Использование переписки для дообучения зависит от тарифа и настроек, а не от ожиданий отправителя. Утечка состоит уже в самой передаче: контроль над документом теряется в момент отправки.

Термины

дипфейкdeepfake
Синтетическая запись, изображающая реального человека говорящим или делающим то, чего не было. Технически это обычная генерация, отличается целью: узнаваемое лицо или голос.
синтетический контентsynthetic content
Материал, произведённый моделью, а не записанный с натуры: текст, изображение, звук, видео.
машиночитаемая маркировкаmachine-readable marking
Признак внутри файла, по которому программа определяет, что материал сгенерирован. В отличие от видимой подписи рассчитан не на человека, а на площадки и поисковые системы.
регламент ЕС об ИИEU AI Act
Принятый в июне 2024 года европейский закон, раскладывающий применения по уровням риска. Обязанности вступают в силу по расписанию, и пакет поправок мая 2026 года его уже сдвинул.
система высокого рискаhigh-risk system
Категория регламента для применений с большим возможным вредом: отбор персонала, доступ к образованию и кредиту, работа критической инфраструктуры. Требования к ним отложены до декабря 2027 года.
регуляторная песочницаregulatory sandbox
Режим, в котором новую систему обкатывают под надзором регулятора с временными послаблениями. Создание национальных песочниц перенесено на август 2027 года.
воспроизведение обучающих данныхmemorization
Случаи, когда модель выдаёт фрагмент обучающего текста почти дословно. Показано измерениями и потому осложняет довод «модель ничего не хранит, она только обобщает».
дата срезаas-of date
Дата, на которую верно утверждение о положении дел. Утверждение без неё не становится вечным, оно перестаёт быть проверяемым.

Практикум · Досье на одно утверждение с датой

Навык этого урока состоит в умении обращаться со скоропортящимся так, чтобы оно не портилось незаметно. Приём один и тот же для новости о законе, о суде и о новой обязанности. Разбор занимает полчаса, а привычку ставит надолго.

  1. Возьмите свежую новость о регулировании ИИ или об иске к разработчику модели. Выпишите из неё одно конкретное утверждение о положении дел, без оценок и эпитетов.
  2. Найдите дату события, а не дату публикации новости. Если в тексте её нет, ищите первоисточник. Если не нашли, пометьте утверждение как непроверенное и дальше так с ним и обращайтесь.
  3. Определите стадию: предложено, принято, вступило в силу, применяется. Для закона выпишите отдельно, какая обязанность и с какого числа она работает.
  4. Проверьте по первоисточнику хотя бы один факт из новости. Для европейского регламента годится официальный текст, для иска подойдёт карточка дела в суде.
  5. Запишите вывод одной строкой и поставьте дату проверки. Через полгода вернитесь и посмотрите, что изменилось: именно это и есть навык обращения со скоропортящимся.

Вопросы для самопроверки

Вопрос 1

Почему в этом уроке дата стоит прямо в тексте, а не только в реестре?

  • Так принято оформлять любые юридические тексты: без даты ссылка на норму считается недействительной
  • Потому что урок написан позже остальных
  • Чтобы отделить европейские правила от правил других стран: дата показывает, о какой юрисдикции речь
  • Потому что содержание урока устаревает, и читателю нужна точка отсчёта
Вопрос 2

Что известно о правовом статусе обучения моделей на защищённых текстах?

  • Обучение признано законным повсеместно
  • Практика складывается прямо сейчас: иски поданы, устоявшегося ответа на 2026 год нет
  • Обучение запрещено европейским регламентом
  • Вопрос решён соглашением компаний и издателей
Вопрос 3

Регламент ЕС об ИИ приняли в июне 2024 года, после чего сроки правились. Что это показывает?

  • Что регламент отменили
  • Что закон был написан неверно и его переписывают заново: сдвиг сроков означает отмену прежнего текста
  • Что регулирование догоняет технологию, а расписание остаётся предметом пересмотра
  • Что маркировку синтетического контента признали технически невозможной и требование из регламента убрали
Вопрос 4

Сотрудник вставил в чат-бот кусок внутреннего договора, чтобы получить краткий пересказ. Что произошло?

  • Канал утечки: текст покинул периметр организации в момент отправки
  • Ничего: модель не сохраняет присланные запросы
  • Договор попал в обучающую выборку следующей модели
  • Произошло нарушение европейского регламента об ИИ
Вопрос 5

Регуляторы требуют помечать сгенерированный материал. Что именно предлагается ставить?

  • Водяной знак, который видно на изображении глазом: по нему читатель сразу понимает происхождение картинки
  • Признак внутри файла, который читает программа, а не человек
  • Обязательную подпись автора под каждым опубликованным текстом с перечнем использованных инструментов
  • Запрет на публикацию сгенерированных изображений

Ответы и разбор открываются в самопроверке урока: она считает результат и отмечает урок пройденным. Пройти самопроверку.

Что читать

  • Регламент ЕС об искусственном интеллекте, официальный текст: Читать выборочно: полезны определения, перечень применений высокого риска и статьи о сроках. Видно, что закон описывает не «интеллект», а системы по способу применения.
  • Nicholas Carlini и соавторы, работы об извлечении обучающих данных из языковых моделей: Технические статьи о том, как из модели достают куски обучающего корпуса. Для копирайтного спора важны тем, что переводят вопрос из области интуиции в область измерения.
Все курсы и разделы школы
Фонтум

Открытая школа: университетские программы и практикумы на русском. Целиком, бесплатно, без регистрации.

Курс «Искусственный интеллект»

ВАШ СЛЕДУЮЩИЙ ВОПРОС

Что хотите понять?