AI & ML interests

Safe and aligned AI research. We research situational awareness, deception, and hidden reasoning in language models.

Recent Activity

JCocola  updated a dataset 5 days ago
truthful-ai/story-imprinting
JCocola  published a dataset 8 days ago
truthful-ai/story-imprinting
levm  updated a dataset 29 days ago
truthful-ai/story-imprinting
View all activity