← Events
Fundamental Upcoming

2026 Fall — Fundamental Reading Group

Explore AI alignment, safer training, evaluations, interpretability, and AI control through a semester of guided discussions.

reading-groupfall-2026fundamentals

About|活動介紹

Explore AI alignment, safer training, evaluations, interpretability, and AI control through a semester of guided discussions.

從 AI alignment 出發,循序討論 RLHF、可擴展監督、安全評估、可解釋性與 AI Control,建立對 AI 安全技術與挑戰的整體認識。

Organizing Team|帶領團隊

  • Track leads: Jasper, Jonathan
  • Track co-host: Teddy

Schedule|活動時程

WeekDate & TimeTopic / EventHostCo-host
W109/28AI alignment: Why can’t we build safe AI?TeddyJasper
W210/05Training Safer Models Part I: RLHFJasperTeddy
W310/12Training Safer Models Part II: Scalable OversightTeddyJonathan
W410/19Connection Dinner / Speaker Event
10/26Midterm
W511/02Detecting Danger: Evaluations & Red teamingJonathanTeddy
W611/09Understanding AI Part I: InterpretabilityJonathanJasper
W711/16Understanding AI Part II: Interpretability in practiceTeddyJonathan
W811/23Minimising Harm Part I: AI ControlJasperTeddy
W911/30Minimising Harm Part II: AI Control – Chain of ThoughtTeddyJasper
W1012/07Speaker Event
W1112/14Connection Dinner
12/21Final

課程參考:BlueDot Impact — Technical AI Safety

Participation Details|參加資訊

  • Regular sessions|固定時間: Every Monday / 每週一,19:00–21:00
  • Reading group venue|讀書會地點: 臺大資訊工程學系德田館(教室待公布)

Registration|活動報名

註:讀書會的三個組別採共用報名表單,無論報名一個或多個組別,都只需填寫一次。

Stay Connected|更多資訊