Lena Prasad
lprasad21
AI & ML interests
AI alignment, jailbreak detection, red teaming, model robustness, safety evaluation
Recent Activity
liked a model about 13 hours ago
tourist800/LLM-Hallucination-Detection-complex-mathematics upvoted a paper about 13 hours ago
AdviSD: Learning to Advise Frontier LLMs via Targeted Multi-Turn Self-Distillation liked a model 2 days ago
mradermacher/Qwen3-1.7B-Jailbreak-reasoning-GGUFOrganizations
None yet