Контакты:
-
Неруссков Дмитрий ОлеговичПреподаватель
Целью настоящего курса является изучение методов создания фундаментальных инструментов (словарей и датасетов) с помощью больших языковых моделей (LLM).
Курс направлен на формирование и развитие у обучающихся общепрофессиональных и профессиональных компетенций, соответствующих требованиям ФГОС ВО по направлению «09.04.01 Информатика и вычислительная техника», Интеллектуальные системы.
Общепрофессиональные компетенции: ОПК-2, ОПК-3, ОПК-4.
Профессиональные компетенции: ПК-1, ПК-2, ПК-3.
Специальные компетенции: СК-1, СК-2.
В результате освоения курса студенты должны:
Знать:
1. Основные типы и структуры тональных словарей и датасетов.
2. Классические и современные методы их построения.
3. Принципы работы и особенности больших языковых моделей для решения задач генерации и классификации текста.
4. Методы и метрики для оценки качества созданных лингвистических ресурсов.
Уметь:
1. Проводить сравнительный анализ существующих методов и ресурсов для анализа тональности.
2. Формулировать промпты и управлять LLM для генерации и аннотирования текстовых данных.
3. Разрабатывать и реализовывать программные пайплайны для автоматизированного создания тональных словарей и датасетов.
4. Проводить эксперименты по оценке эффективности предложенных методов.
Владеть:
1. Опытом анализа научной литературы в области NLP и анализа тональности.
2. Навыками программирования на Python с использованием библиотек для работы с LLM.
3. Методами обработки данных и статистического анализа для валидации результатов исследования.