Президент Владимир Путин объявил о создании Национальной базы генетической информации, куда ежегодно будет поступать около 10 петабайт данных. Решение обсуждалось на заседании Совета по науке и образованию и затрагивает сразу растениеводство, животноводство и смежные с ними отрасли биотехнологий.
От поручения до постановления
Формально проект объявлен только сейчас, но история его началась гораздо раньше. Поручение создать подобную базу президент давал ещё в 2020 году. Правительство закрепило эту инициативу постановлением лишь в январе 2024 года, утвердив создание государственной информационной системы в области генетической информации. Оператором проекта назначен Курчатовский институт.
До сих пор в стране не существовало единой системы, которая агрегировала бы машиночитаемые большие генетические данные. База объединит сведения о животных, растениях и микроорганизмах, а также данные о людях, вирусах и других биообразцах. Для отрасли, где сбор и обработка генетической информации долгое время были разрознены между отдельными институтами и компаниями, появление такого централизованного ресурса меняет саму логику работы с данными.
Изначально систему планировали запустить к 1 сентября 2025 года. Но весной этого года правительство пересмотрело сроки, сдвинув запуск на 1 сентября 2027 года. Речь идёт именно о технической разработке архитектуры, программного обеспечения и защиты данных. Наполнение базы реальными сведениями и выход на полноценную работу потребуют дополнительного времени уже после технического запуска.
Ускорение вместо повторной расшифровки
Практическая ценность проекта для отрасли складывается из нескольких направлений. В растениеводстве и животноводстве единая база позволит учёным обращаться к уже секвенированным и оцифрованным данным без необходимости повторно расшифровывать геномы, если это уже было сделано ранее. Это напрямую влияет на скорость селекционной работы, которая сейчас нередко упирается именно в дублирование уже выполненных исследований.
Отдельная тема касается зависимости от импорта в семеноводстве и племенном животноводстве. Централизованный доступ к генетическим данным способен ускорить поиск исходных форм для скрещивания, помочь адаптировать иностранные сорта к российским условиям и в перспективе создавать собственные разработки без постоянной оглядки на зарубежные источники.
Заметный эффект ожидается и в животноводстве, где целенаправленная племенная работа, включая генотипирование, позволяет на ранних стадиях оценивать потенциал животного, выявлять предрасположенность к заболеваниям и прогнозировать продуктивность. Для хозяйств, ведущих системную селекционную работу, это означает возможность принимать решения о разведении на основе данных, а не только визуальной оценки и родословной.
Также в базу войдут данные о микроорганизмах, что открывает дорогу для развития смежных секторов, в частности создания новых кормовых добавок и биопрепаратов. Это направление напрямую связано с задачей снижения зависимости от иностранных штаммов, которая уже обсуждалась на уровне Минсельхоза как одна из точек уязвимости в биотехе.
Искусственный интеллект и вопрос доступа
База задумана и как технологическая основа для дальнейших инноваций, включая обучение моделей искусственного интеллекта. Такие модели способны анализировать сложные генетические закономерности, прогнозировать результаты скрещивания и решать другие задачи, которые вручную требуют значительно больше времени и ресурсов.
В долгосрочной перспективе создание базы рассматривается и как элемент продовольственной безопасности, снижающий риски ограничения доступа к зарубежным генетическим ресурсам и агротехнологиям. Учитывая, что многие сегменты АПК до сих пор зависят от иностранной селекционной и генетической базы, такой ресурс может стать основой для более устойчивой независимости отрасли.
При этом остаются открытые вопросы, которые напрямую касаются будущих пользователей системы. Пока неясно, насколько полнофункциональным будет доступ для разных участников. Планируется разделить его на открытый, конфиденциальный и специальный уровни, и от того, как именно распределят эти категории, будет зависеть, смогут ли агрокомпании и биотех-стартапы полноценно использовать базу в повседневной работе. Формально система должна заработать в 2027 году, но по-настоящему масштабной и полезной она станет позже, по мере того как научные центры, агрокомпании и стартапы подключатся к ней и начнут регулярно передавать собственные данные.
Источник: «АПК Эксперт»