Офлайн

Align, Forget, Repeat Meetup

Коли

20 серпня, 18:00

Де

Офлайн у Львові

Формат

Офлайн

Вартість

Благодійний донат від 500 грн на БО «Реактивна Пошта»

 pc

Про мітап:

На мітапі поговоримо про сучасні дослідження у сферах AI Alignment та Machine Unlearning. Розберемося, чому традиційні методи навчання LLM, зокрема RL і RLHF, не гарантують alignment, яку небажану поведінку можуть демонструвати великі мовні моделі та які підходи допомагають зробити їх безпечнішими, надійнішими й керованішими. Також обговоримо, чи можуть LLM «забувати» небажану інформацію, як оцінити ефективність такого «розучування» та над якими викликами AI Safety сьогодні працюють дослідники.

Для кого:

  • ML/AI Engineers
  • Data Scientists
  • AI Researchers
  • PhD-студенти
  • Software Engineers, які інтегрують LLM у продукти
  • AI-ентузіасти

Щоб взяти участь:

  • Заповніть реєстраційну форму
  • Після нашого підтвердження задонатьте від 500 грн на БО «Реактивна Пошта»

Що отримаєте:

  • Розуміння того, як сьогодні досліджують AI Alignment і чому ця сфера є ключовою для розвитку великих мовних моделей.
  • Розбір реальних кейсів небажаної поведінки моделей — від sycophancy до alignment faking — і причин їх виникнення.
  • Уявлення про сучасний стан Machine Unlearning, коли моделям потрібно «забувати» і як оцінити успішність цього процесу.
  • Нетворкінг та спілкування з дослідницями AI Alignment і AI Safety.
  • Ознайомитеся з ключовими викликами AI Safety та сучасними напрямами досліджень.

Спікери:

Марія Королюк
Марія Королюк

Research Fellow у LASR Labs

Марія працювала Data Scientist у Lyft, де займалася розробкою ML-рішень. Після знайомства з дослідженнями у сфері AI Alignment вирішила зосередитися на вивченні поведінки великих мовних моделей. Наразі вона проводить дослідження в межах Research Fellowship у LASR Labs, присвячені поведінковому скеруванню LLM та формуванню цінностей моделей під час навчання з підкріпленням (RL).

Вікторія Маковська
Вікторія Маковська

Research Engineer у Lapa LLM, PhD-дослідниця УКУ

Вікторія має понад 7 років досвіду в software engineering, після чого перейшла до досліджень великих мовних моделей і відповідального штучного інтелекту. Зараз вона працює над machine unlearning, mechanistic interpretability та методами оцінювання ефектів «розучування» — чи справді модель перестала відтворювати небажані наративи або поведінкові патерни, а не втратила загальні здібності внаслідок втручання.

Програма:

Реєстрація
18:00 – 18:40

Як скерувати поведінку LLM через внутрішню будову моделі?
18:40 – 19:10
Марія Королюк

Як формується поведінка мовних моделей, чому alignment не виникає автоматично та як дослідники працюють із внутрішньою структурою LLM для створення більш безпечних моделей.

Чи можна навчити LLM забувати і навіщо це потрібно?
19:30 – 20:00
Вікторія Маковська

Як працює Machine Unlearning, чи можна видалити знання з моделі без втрати її можливостей та чому це одна з найактуальніших тем AI Safety.

Нетворкінг
20:00 – 21:00

Поширені запитання: