ls ./research

Research

Directions

01 / internals
Reverse-engineering learned behaviors through circuits and representations.
02 / alignment
Understanding and mitigating misalignment.
03 / safety
Reducing anthropomorphic risks in machines.

Publications

[01] Mechanistic Analysis of Alignment Algorithms in Language Models

pre-print · 2026

Aarush Sinha, Ishan Garg, Veeraraju Elluru, Arth Singh, Kushal Garg

[02] Mechanistically Interpreting Compression in Vision-Language Models

ICML MI Workshop · 2026

Veeraraju Elluru, Roberto Aguero, Arth Singh, Ajay Agarwal, Debojyoti Das, Hreetam Paul

[03] Lie Algebra-Based Semantic Flow for Incompleteness Detection

PRICAI-PKAW · 2025

Manikandan Ravikiran, Veeraraju Elluru, Karrtik Iyer, Prasanna Pendse, Shayan Mohanty

[04] Bias-Aware Machine Unlearning

ICCV U&ME · 2025

Sai Siddhartha Chary Aylapuram, Veeraraju Elluru, Shivang Agarwal

[05] Unsupervised Latent Representations for Cattle Image Segmentation

ANSC Journal · 2025

Veeraraju Elluru, Ahmed Sallam, Anderson Alves, Tiago Bresolin