AI & ML interests
Trustworthy & explainable AI. Neuro-explicit and neurosymbolic methods. Statistical ML.
Recent Activity
View all activity
Papers
RogueAI: A Reverse Turing Test for Detecting Licensed AI Deception in Dialogue
Blending adversarial training and representation-conditional purification via aggregation improves adversarial robustness
ailab-units 's models
None public yet