I write about responsible AI use, emerging risks and views on research papers.
My research interests are: Deceptive Alignment, chain-of-thought faithfulness, LLM monitoring and verification for frontier AI regulation.
Available for
Technical writing, research work and any opportunity around it.