Роскомнадзор потребовал от операторов ИИ раскрывать источники обучающих данных
Новый регламент вступит в силу с 1 января 2027 года.

Роскомнадзор опубликовал проект регламента, обязывающего операторов больших языковых моделей раскрывать состав обучающих датасетов и подтверждать правомерность их использования. Документ направлен на общественное обсуждение до 1 сентября.
Регламент распространяется на модели, обслуживающие более 500 тысяч пользователей в России. Компании должны будут вести реестр источников и по запросу правообладателя удалять данные из следующих итераций обучения.
В отраслевых ассоциациях документ восприняли неоднозначно: крупные игроки заявили о готовности выполнить требования, а разработчики open-source моделей опасаются, что нормы окажутся невыполнимыми для небольших команд.
Штраф за нарушение регламента составит до 1% годовой выручки оператора, но не менее 3 миллионов рублей. Повторное нарушение может привести к блокировке сервиса на территории РФ.
Все статьи по этой теме
· ИИАЙТИ·ВЕСТНИК
demoРассылка
demoГлавные новости технологий раз в день. Без спама, отписка в один клик.
Специальный корреспондент. Расследования, эксклюзивы и репортажи из-за кулис индустрии.
Читайте также

OpenAI представила GPT-6: модель с собственной памятью и автономными агентами
Новая версия флагманской модели OpenAI получила долговременную память и способность планировать многошаговые задачи без участия человека.

Google DeepMind научил роботов готовить ужин по фотографии холодильника
Модель RT-3 справляется с задачами планирования на уровне человека-повара.

Минцифры обяжет маркировать сгенерированный нейросетями контент с 2027 года
Законопроект предусматривает штрафы до 700 тысяч рублей за отсутствие маркировки.

Anthropic привлекла $8 млрд от Amazon на разработку Claude 5
Сделка делает Anthropic второй по стоимости ИИ-компанией мира после OpenAI.
