AI & ML interests

Safe and aligned AI research. We research situational awareness, deception, and hidden reasoning in language models.

Recent Activity

JCocola  updated a dataset 1 day ago
truthful-ai/story-imprinting
JCocola  published a dataset 4 days ago
truthful-ai/story-imprinting
levm  updated a dataset 25 days ago
truthful-ai/story-imprinting
View all activity