SHUBHAM
AI & LLM Portfolio Β· 2026
βœ‰ πŸ“ž in ↑
Available for Remote Work Β· Delhi, India
SHUBHAMNA
AI & LLM Trainer Prompt Engineer AI Safety & Red Teaming Linguistics Expert Data Analyst

3+ years training LLMs for Google, Meta, Scale AI & more. Bilingual English-Hindi, C2 Proficient. Specialized in RLHF, SFT, adversarial prompts & AI safety.

9+
Platforms
3+
Years Active
8+
Certifications
C2
English Level
Scroll
RLHFΒ·Prompt EngineeringΒ·SFT SpecialistΒ·Factuality QAΒ·Red TeamingΒ·Gemini TrainingΒ·Meta LLMsΒ·Scale AI ResearchΒ·Bilingual AIΒ·Adversarial PromptsΒ·Python Β· Java Β· JSΒ·C2 EnglishΒ·Cultural AwarenessΒ· RLHFΒ·Prompt EngineeringΒ·SFT SpecialistΒ·Factuality QAΒ·Red TeamingΒ·Gemini TrainingΒ·Meta LLMsΒ·Scale AI ResearchΒ·Bilingual AIΒ·Adversarial PromptsΒ·Python Β· Java Β· JSΒ·C2 EnglishΒ·Cultural AwarenessΒ·
01

Key Projects

01 β€” Google
Gemini Factuality & Speech QA
Outlier AI + Invisible Technologies
Hallucination flagging, factuality evaluation, speech-text alignment, and instruction tuning for Google Gemini. Rated LLM outputs for truthfulness, fluency, and safety via RaterHub & CrowdCompute.
FactualitySpeech QARLHFRaterHub
02 β€” Meta
Meta LLM Alignment
Alignerr Β· Quality Assurance Analyst
Tuned Meta LLM responses for alignment, coherence, and factual correctness. AI Audio Reviewing β€” tone, clarity, speech-text alignment. Bilingual multi-turn conversation testing in English & Hindi.
SFTMulti-turn QAAudio ReviewAlignment
03 β€” Scale AI
Adversarial AI Research
Scale AI Β· AI Researcher Β· 2 yrs 8 mos
Designed culturally grounded adversarial prompts to test model reasoning, safety, and accuracy across Hindi, Hinglish, and English. Red-teaming for AI safety and bias detection at scale.
Red TeamingAdversarialLinguisticsHindi-English
04 β€” DeepLLMData
Multilingual Prompt Engineering
DeepLLMData Β· Prompt Engineer Β· Aug 2025–Present
Adversarial AI evaluation and multilingual training for LLMs. Designing prompts to test model reasoning, safety, cultural awareness, and robustness. Prompt-quality assessment and red-teaming.
Prompt EngineeringCultural AIGenerative AI
05 β€” Abaka.AI
Visual Content AI Training
Abaka.AI Β· Advance AI Data Trainer Β· Sep 2025–Present
Multimodal task evaluation and annotation for advanced AI systems. Reviewing, evaluating, and reasoning about visual and textual content under structured guidelines with high quality standards.
MultimodalVisual QAAnnotation
06 β€” RWS / Telus
Speech & Linguistic Annotation
RWS Group + Telus International AI
Factuality and speech assessments for the Callisto project. FT Studio linguistic annotation for academic and voice datasets. Hindi-English corpora with cultural nuance verification.
Speech QAFT StudioCallistoBilingual
02

Work Experience

SEP 2025 β†’ Present Β· 9 mos Β· Remote
Abaka.AI
Advance AI Data Trainer β€” Visual Content
Generalist AI Trainer. Development, evaluation, and improvement of advanced AI systems through multimodal tasks. Reviewing, evaluating, annotating, and reasoning about visual and textual content.
Multimodal AIVisual QAAnnotation
AUG 2025 β†’ Present Β· 10 mos Β· Remote
DeepLLMData
Prompt Engineer
Adversarial AI evaluation and multilingual LLM training. Designing culturally grounded prompts to test model reasoning, safety, and factual accuracy across Hindi, Hinglish, and English datasets.
Prompt EngineeringRed TeamingCultural AwarenessAdversarial
JAN 2025 β†’ Present Β· 1 yr 5 mos
Invisible Technologies
Advanced AI Data Trainer | QC & Contributor
Reviewed and rated LLM outputs (Google Gemini) for truthfulness, fluency, and safety via RaterHub & CrowdCompute. Factuality and instruction-following checks on high-volume multi-turn conversations.
Gemini QAFactualityRLHFRaterHub
FEB 2023 β†’ SEP 2025 Β· 2 yrs 8 mos Β· Delhi Β· Remote
Scale AI
Artificial Intelligence Researcher
Bilingual (English–Hindi) annotation, linguistics, and adversarial/stumping prompt design. Evaluated responses for linguistic quality, cultural awareness, alignment, robustness. Identified hallucinations and bias.
LinguisticsBilingual AnnotationAdversarial DesignAI Safety
JAN 2024 β†’ JUL 2025 Β· 1 yr 7 mos
Alignerr
Quality Assurance Analyst + AI & LLM Data Trainer
QA Analyst and LLM Trainer. Python, JavaScript, Java, C++, Data Annotation. Tuned Meta LLM responses. Annotation, data annotation, and 7+ skills across roles at Alignerr.
PythonJavaScriptC++JavaData Annotation
SEP 2024 β†’ MAY 2025 Β· 9 mos
RWS Group
AI Data Trainer
Factuality and audio reviewing for the Callisto project. Annotation QA across 2 experiences at RWS Group evaluating AI trainer outputs and ensuring annotation consistency.
AnnotationAI TrainerCallisto
MAY 2024 β†’ Present
Outlier AI
AI Data Trainer | Prompt Engineer | QC
Trained Gemini model with real-time speech and text data. Factuality QA, speech annotation, prompt construction. RLHF and SFT loops. Bilingual output annotation and review.
Gemini SpeechSFTPrompt WritingRLHF

CoreSkills

3+ years, 9+ platforms. LLM training, multilingual NLP, AI safety, adversarial evaluation β€” certified and verified.

AI & LLM Specializations
RLHF & SFTPrompt EngineeringFactuality & Reasoning AnalysisLLM Data Annotation & EvaluationRed TeamingAdversarial / Stumping Prompt DesignModel Alignment & Safety EvaluationHallucination DetectionGenerative AIQC & Rubric-Based Review
Linguistics & Language
Bilingual English–Hindi AnnotationLinguisticsSpeech & Text QACultural AwarenessTranslation QATranscription AlignmentTone & Emotion TaggingRegional Nuance Verification
Technical / Programming
PythonJavaScriptJavaC++Data AnalysisMicrosoft ExcelData ModelingData MiningData ManagementGDPR
Platforms & Tools
RaterHubCrowdComputeFT StudioAppen PortalOneformaOutlier PlatformAlignerrScale AIDeepLLMDataAbaka.AI
05

About Me

Delhi,India

AI & LLM Data Trainer, Linguistics expert, Language specialist, Prompt Engineer, AI Safety & Red Teaming specialist, and Data Analyst β€” currently at Abaka AI.

3+ years across 9+ platforms including Google (Gemini), Meta, Scale AI, DeepLLMData, and Invisible Technologies. I make AI systems safer, more accurate, and culturally aware.

Bilingual English (C2 Proficient, EF SET 83/100) and native Hindi speaker. Technical expertise in Python, JavaScript, Java, and C++ combined with deep linguistic precision.

English β€” C2 Proficient Hindi β€” Native
Master's Degree in Commerce
Bundelkhand University β€” Jhansi, India
May 2019 – April 2021
Professional Certificate in Data Science
Simplilearn β€” Remote
April 2021 – March 2022
Prompt Engineering for ChatGPT
Great Learning
Completed May 2026
Advanced AI Data Trainer Certification
micro1 Β· May 2026
Issued May 2026