Projects

Research in practice.

A project-oriented view of the methods and questions represented in my publication record.


  • Privacy
  • Membership inference

Automatic Calibration for Membership Inference

Research on automatically calibrating membership inference attacks for large language models.

  • Unlearning
  • Token-level analysis

Not All Tokens Are Meant to Be Forgotten

Work investigating token-aware approaches to forgetting in large language models.

  • AI safety
  • In-context learning

Adversarial In-Context Learning

Research examining how adversarial demonstrations in context can hijack large language models.

  • Safety alignment
  • Reasoning models

Safety Alignment in LRMs

Ongoing work on deceptive safety alignment and counter-aligned few-shot conversation exposure in large reasoning models.

Manuscripts under review
  • Security
  • Data poisoning
  • IEEE BigData 2026

Downstream Manipulation

Research on poisoning large language models during training for downstream behavioral manipulation.