30 октября на площадке Геномного центра Межвузовского кампуса состоялась презентационная сессия «Языки и культурное наследие Башкортостана: сбор данных и возможности их применения в сфере ИИ». Организаторами мероприятия выступили Правительство Республики Башкортостан, Фонд по сохранению и развитию башкирского языка, телеканал БСТ и Уфимский университет науки и технологий.
Встреча объединила более 200 участников из самых разных сфер: студентов, журналистов, госслужащих, писателей, педагогов, общественников и предпринимателей. Главной темой дискуссии стала интеграция языков народов республики в технологии искусственного интеллекта. Эксперты искали ответы на вопрос – как сделать башкирский язык полноценным участником цифровой среды и какие механизмы для этого необходимы. Сессия стала важным этапом в консолидации усилий науки, государства и общества, задав вектор для дальнейшей работы по созданию интеллектуальных продуктов на башкирском языке.
Проректор по цифровой трансформации УУНиТ Айнур Хайбуллин подробно остановился на правовых аспектах формирования башкирской ИИ-модели, подчеркнув важность легитимности и безопасности данных. В свою очередь, начальник управления цифровой трансформации регионального Минцифры Сергей Степанов наглядно продемонстрировал «жизненный цикл» языковых датасетов – от сбора первичных материалов до их превращения в готовые алгоритмы, понятные нейросетям.
Особое внимание уделили качеству контента. Генеральный директор ИД «Республика Башкортостан» Зульфия Рахматуллина рассказала о работе издательства по систематизации терминологического аппарата, что является фундаментом для обучения качественных языковых моделей. Практическую часть сессии дополнил мастер-класс общественного деятеля и разработчика Айгиза Кунафина «От архива к живому применению: как открытые данные о языке и культуре Башкортостана превращать в образовательные, медийные и цифровые продукты сегодня». Спикер на прикладных примерах показал, каким образом работать с архивными материалами, оцифровывать их и эффективно использовать при создании современного медиаконтента и образовательных инструментов. В ходе обсуждения эксперты неоднократно подчеркивали необходимость насыщения ИИ параллельными текстами – на русском и башкирском языках. Своим опытом поделилась педагог Ляля Сафина, рассказавшая об использовании нейросетей на уроках башкирского языка и литературы. Она отметила, что, несмотря на большие возможности, ИИ пока нуждается в дообучении, так как часто путает родственные тюркские слова.
Итоги встречи подвел Первый заместитель Премьер-министра Правительства РБ, председатель Комиссии при Правительстве РБ по реализации Закона «О языках народов Республики Башкортостан» Урал Кильсенбаев. Он подчеркнул, что проект по внедрению национальных языков в ИИ – это стратегический шаг для укрепления культурного кода региона. Обращаясь к участникам, он поблагодарил всех, кто участвует в данном проекте и призвал присутствующих стать соратниками в масштабном деле.
– Наша рабочая группа – это настоящие энтузиасты, которые поставили перед собой три задачи. Первая – понять, в правильном ли направлении мы движемся и насколько это востребовано. Сегодняшний полный зал доказывает: мы на верном пути, – отметил Урал Тагирович. – За полгода мы апробировали видео- и текстовые форматы, оценили качество перевода и озвучки в датасетах. Вторая задача – понять уровень вовлеченности аудитории. Мы видим, как инструменты ИИ начинают использовать учителя, полилингвальные гимназии, радио и СМИ. Это работа, которая нужна нашему обществу, и мы будем её продолжать. Но она должна стать не одной группы, а всеобщей, если мы хотим, чтобы наши родные языки были достойно представлены в цифровой среде, чтобы они стали языком театров, музеев и современных технологий. Мы видим в каждом из вас единомышленников. Это просто, полезно и приятно – вспомнить свою малую родину, любимые места: поляну, рощу, гору, речку – и внести их в базу данных. В будущем мы поставим перед вами более сложные задачи: чтобы парень или девушка из любого района нашей республики могли общаться с искусственным интеллектом на своем диалекте и чтобы мы могли оцифровывать шежере – всё это в наших руках.
Станьте соавтором УУНиТ! Присылайте свои новости в наш чат-бот в Telegram. Не забудьте прикрепить фото- или видео- материалы.












