Контакты:

Целью настоящего курса является изучение методов создания фундаментальных инструментов (словарей и датасетов) с помощью больших языковых моделей (LLM).

Курс направлен на формирование и развитие у обучающихся общепрофессиональных и профессиональных компетенций, соответствующих требованиям ФГОС ВО по направлению «09.04.01 Информатика и вычислительная техника», Интеллектуальные системы.

Общепрофессиональные компетенции: ОПК-2, ОПК-3, ОПК-4.

Профессиональные компетенции: ПК-1, ПК-2, ПК-3.

Специальные компетенции: СК-1, СК-2.

В результате освоения курса студенты должны:

Знать:

1.    Основные типы и структуры тональных словарей и датасетов.

2.    Классические и современные методы их построения.

3.    Принципы работы и особенности больших языковых моделей для решения задач генерации и классификации текста.

4.    Методы и метрики для оценки качества созданных лингвистических ресурсов.

Уметь:

1.    Проводить сравнительный анализ существующих методов и ресурсов для анализа тональности.

2.    Формулировать промпты и управлять LLM для генерации и аннотирования текстовых данных.

3.    Разрабатывать и реализовывать программные пайплайны для автоматизированного создания тональных словарей и датасетов.

4.    Проводить эксперименты по оценке эффективности предложенных методов.

Владеть:

1.    Опытом анализа научной литературы в области NLP и анализа тональности.

2.    Навыками программирования на Python с использованием библиотек для работы с LLM.

3.    Методами обработки данных и статистического анализа для валидации результатов исследования.