Создание такого перечня госданных позволит установить единые правила доступа российских разработчиков к необходимой информации с соблюдением требований безопасности и защиты персональных данных. Предложение обсудили на форуме «Цифровые решения» в рамках профильной секции «Национальная система данных для ИИ: как создать».
Предложение станет частью работы по формированию национальной системы данных для искусственного интеллекта. Её задача — обеспечить отечественным разработчикам легальный и безопасный доступ к информации, которая сегодня хранится в государственных структурах, научных организациях и компаниях.
Для этого предстоит определить, какие государственные данные могут использоваться для обучения ИИ, а также установить прозрачные условия их предоставления. Правовую основу работы системы обеспечат законодатели.
Руководитель Центрального исполкома «Единой России», председатель комитета Госдумы по цифровому развитию и искусственному интеллекту Александр Сидякин отметил, что профильный комитет возьмёт на себя сопровождение подготовки подзаконных актов. В первую очередь речь идёт о правилах доступа к государственным базам данных.
«Государство располагает огромными массивами данных, которые могут помочь российским разработчикам создавать новые технологии. Мы считаем, что доступ к государственным данным для обучения искусственного интеллекта нужно предоставлять только суверенным и национальным моделям. При этом правила должны быть понятными и одинаковыми для всех, кто соответствует установленным требованиям, – и для крупных компаний, и для небольших команд. Наш комитет будет участвовать в подготовке этих правил. Нам важно, чтобы разработчики могли получать необходимые данные, а личная информация граждан была надёжно защищена», — подчеркнул Александр Сидякин.
Доступ к качественным наборам данных необходим для развития отечественных ИИ-технологий в различных отраслях. Они используются для обучения систем, которые помогают врачам выявлять заболевания на ранних стадиях, беспилотным автомобилям — безопасно ориентироваться на дорогах, а промышленным предприятиям — предотвращать аварии на производстве.
При этом значительные массивы информации сегодня разрознены и хранятся в разных организациях. Создание национальной системы данных и закрепление единых правил доступа к ним позволит российским IT-командам находить необходимые сведения и безопасно использовать их для разработки и обучения отечественных ИИ-моделей.
«Представьте конструктор: чтобы собрать новую модель, нужны подходящие детали. Для искусственного интеллекта такими деталями служат качественные наборы данных. Сегодня они уже накоплены у государства, научного сообщества, врачей и бизнеса. Наша задача – выстроить механизм, при котором российские IT-команды смогут легко находить нужные массивы и безопасно с ними работать», — рассказал исполнительный директор Совета по инновационному и технологическому развитию «Единой России» Илья Семин.