
De Databar 36 - De J-space en hoe reasoning-modellen écht werken
In deze aflevering duiken Cees, Florian, Mitch en Daniel in nieuw interpretability-onderzoek van Anthropic: de J-space. Onderzoekers vonden een klein, apart deel van de interne activaties van LLMs dat zich anders gedraag








