San Jose, CA
Kunj Shah

Large Language Models: architecture, pre-training, and alignment safety.

I am a deep learning engineer focused on optimizing model capability, safety frameworks, and scaling efficiency. I research transformer pre-training architectures and develop safety-critical alignment frameworks to prevent prompt injections and tool exploitation.

Core Areas

Pre-training & Adaptation

Pre-training medical and domain-specific transformers using SwiGLU, Grouped Query Attention, and Rotary Embeddings. Architecting memory-efficient adaptations using LoRA/QLoRA on cloud clusters.

Alignment & Model Safety

Implementing alignment feedback loops (SFT, DPO, GRPO) for safety and instruction compliance. Building multimodal input/output guardrails for VLM applications — chain-of-thought safety classification served at sub-200ms via vLLM, with false-negative-rate diagnostics per policy category.

© 2025 Kunj Shah · Built with curiosity · San Jose, CA