

Мероприятие пройдет в 15:00 в Геномном центре Межвузовского студенческого кампуса (г. Уфа, ул. Заки Валиди, 32/2Б). Приглашаются студенты, представители СМИ, госслужащие, писатели, педагоги, общественные деятели, предприниматели, члены комиссии по языкам РБ и все заинтересованные лица. Трансляция будет доступна в прямом эфире на платформах «ВКонтакте» и Rutube.
Организаторами выступили АНО по сохранению и развитию башкирского языка, Уфимский университет науки и технологий, Министерство цифрового развития РБ и телеканал «БСТ» при поддержке правительства Республики Башкортостан.
Программу откроет Айнур Хайбуллин, проректор УУНиТ по цифровой трансформации, который расскажет о правовых основах пополнения башкирской ИИ-модели и представит тему «Чистые данные — цифровой язык». Сергей Степанов, начальник управления цифровой трансформации регионального министерства, подробно разберет процесс создания языковых датасетов от исходных материалов до готового продукта. Также с докладом выступит Зульфия Рахматуллина, генеральный директор ОАО «Издательский дом „Республика Башкортостан“».
Отдельное внимание будет уделено практическому применению собранных данных. Айгиз Кунафин, общественный деятель и разработчик, проведет мастер-класс «От архива к живому применению: как открытые данные о языке и культуре Башкортостана превращать в образовательные, медийные и цифровые продукты сегодня». Батыр Галимов, видеомейкер, поделится опытом создания контента на башкирском языке.
Педагог образовательной организации расскажет об использовании искусственного интеллекта на уроках башкирского языка и литературы. Речь пойдет о конкретных методах работы с архивными материалами: их оцифровке, преобразовании в цифровые данные и использовании при создании учебных пособий, медиаконтента и иных продуктов.
Завершит программу дискуссия с участием Урала Кильсенбаева, первого заместителя премьера правительства РБ, председателя Комиссии при правительстве РБ по реализации Закона РБ «О языках народов Республики Башкортостан».
Для эффективного обучения языковых моделей требуются обширные массивы данных: тексты, переводы, аудиозаписи, речевые материалы, публикации СМИ, а также образовательные и культурные ресурсы. Чем больше качественных данных на родном языке подготовлено для машинной обработки, тем шире возможности их интеграции в современные технологии.
«Сегодня для развития языка важно не только сохранять уже созданные тексты, книги, аудиозаписи и другие материалы, но и готовить их к использованию в цифровой среде. Языковые модели обучаются на данных, поэтому от того, какие тексты, записи речи и другие материалы мы соберём и насколько качественно их подготовим, напрямую зависит, какие возможности получит язык в технологиях», — прокомментировала Гульназ Юсупова, директор АНО по сохранению и развитию башкирского языка.
Ранее сообщалось, что башкирский язык внедрили в нейросеть GigaChat и чат «СберБанк Онлайн».
Источник: БАШИНФОРМ