АБД предложила стандарт синтетических данных для ИИ-моделей

Документ объединяет нейросетевые методы синтеза данных, техники управления приватностью и метрики оценки качества.

Ассоциация больших данных (АБД), в которую входят крупные IT-компании, разработала совместно с Национальным технологическим центром цифровой криптографии временный стандарт по использованию синтетических данных, узнал РБК.

Речь идет о данных, которые сгенерировали искусственно, они воспроизводят синтетические характеристики и взаимосвязи с настоящими данными. Главное отличие — они не содержат информации о реальных людях или объектах.

Синтетические данные используют для обучения ИИ-моделей как альтернативу реальным обезличенным данным. Еще такие данные применяют при тестах информсистем. В разработанном АБД стандарте описаны процессы синтеза данных и установлены требования к их качеству.

Бизнес отбился от обязательной маркировки ИИ-контента

Как отмечает представитель ассоциации, такой стандарт необходим для создания суверенных моделей искусственного интеллекта. Благодаря ему разработчики смогут использовать большие массивы информации, которые ранее оставались недоступными.

В одном документе авторы стандарта объединили три направления. Это нейросетевые методы синтеза данных, техники управления приватностью и метрики оценки качества. Представитель АБД назвал новый стандарт одним из самых передовых в мире. По его словам, международная стандартизация в этой области идет медленно и пошагово.

Параллельно АБД направила предложение Минцифры, в котором попросила разрешить использовать персональные данные граждан без их разрешения для обучения ИИ-моделей. В ассоциации указывают, что при правильном применении технологии повышения приватности риски раскрытия личности конкретных людей минимальны.

Новости партнеров

На главную