Aditya Menon
amenon-blr
ยท
AI & ML interests
AI alignment, jailbreak detection, red teaming, model robustness, safety evaluation
Recent Activity
liked a model 2 days ago
Alignment-Lab-AI/OpenVoice upvoted a paper 2 days ago
RRSI: Regularized Recursive Self-Improvement of Agent Harnesses liked a dataset 3 days ago
JailbreakBench/JBB-BehaviorsOrganizations
None yet