AI/ML & Robotics Engineer in Progress | Deep Reinforcement Learning | Applied AI
B.Tech – Mathematics & Computing
- Mathematics & Computing undergraduate focused on AI, Machine Learning and Robotics
- Building intelligent systems using Deep Reinforcement Learning
- Experienced with PPO, SAC, hierarchical control and classical feedback controllers
- Interested in combining learning-based control with physics-based simulation
- Currently focused on Robotics, Reinforcement Learning and Applied AI
IEEE ICC 2027 - Under Review
- First-author research work investigating fault-tolerant hover control for the Crazyflie nano-quadrotor.
- Benchmarks PID, SAC and Domain-Randomized SAC under progressive actuator degradation.
ACODS 2026 - Accepted
- Co-authored research on a ROS 2 framework for resilient quadrotor swarms.
- Combines firmware-level fault injection with dynamic topology reconfiguration.
Core: Policy Optimization · Reward Shaping · Curriculum Learning · Domain Randomization · Fault Injection
Robotics: Robot Manipulation · Quadruped Locomotion · Quadrotor Control
Control: Kinematics · PID · PD Control · Torque Control · Joint Position Control · Trajectory Control
Simulation: Physics Simulation · Fault-Tolerant Control
Deep Learning · Neural Networks · Supervised Learning · Computer Vision · Model Evaluation
RAG · Information Retrieval · BM25 · Document Processing · LLM Integration · Grounded Generation
Git · REST APIs · FastAPI · Web Applications · Model Deployment
- Vision-free pick-and-place control for a 7-DOF Franka Panda
- Hierarchical PPO + PID control in MuJoCo
- Compared learning-based control against classical IK + PID
- PPO-based locomotion controller for Unitree A1
- Joint-level PD torque control with PyBullet
- Extended to uneven terrain using curriculum learning
- Goal-conditioned SAC for actuator fault-tolerant hover control
- Custom Gymnasium + PyBullet environment with motor fault injection
- Domain-randomized control evaluated against PID and SAC baselines
- Vector-database-free document Q&A using BM25 retrieval
- Section-aware chunking and deterministic reranking
- React + FastAPI + Groq deployment with source citations
Deep Reinforcement Learning · Robotics · Robot Control · Autonomous Systems
Quadruped Locomotion · Robot Manipulation · Quadrotor Control · Fault-Tolerant Robotics
Applied Machine Learning · Generative AI · Retrieval-Augmented Generation
Looking for opportunities in:
Deep Reinforcement Learning · Robotics · AI/ML Engineering · Autonomous Systems · Robotics Software
Open to internships, research roles, and applied engineering opportunities.


