LLM Basics Update: Kapitel 1.5, Safeguards, Nanny-State und Jailbreaks
Tja... die Basics-Slides brauchten mal wieder ein Update. Dieses Mal schauen wir uns an, wie die Wurst eigentlich gemacht wird. Wir reden über Pre-Training, RLHF, warum die großen Cloud-Modelle sich oft wie ein Nanny-State verhalten und wie man sie mit ein bisschen Roleplay und Base64 trotzdem in die Mangel nimmt. Willkommen in Phase 01.5.