📊 Open-weight releases
Aggregated across
ai4bharat/indictrans2-en-indic-1B (55,506), ai4bharat/indictrans2-indic-en-1B (17,999), ai4bharat/indictrans2-indic-indic-1B (13,828), ai4bharat/indictrans2-indic-indic-dist-320M (8,304), ai4bharat/indictrans2-indic-en-dist-200M (7,623), ai4bharat/indictrans2-en-indic-dist-200M (7,068).
🚧 Closed / sovereign programs without public checkpoints
- Hanooman — SML India, Seetha.ai, IIT Bombay: Multilingual suite (22 Indic + 10 global languages); enterprise deployments, no Hugging Face release.
- Bhashini / AIRAWAT LLM — MeitY, C-DAC: National language mission building sovereign inference infrastructure; models gated within the NLTM stack.
- Krutrim — Ola / Krutrim SI Designs: Full-stack AI platform with proprietary pretraining on Indian corpora; checkpoints not open-sourced.
- Dhruva — NVIDIA, C-DAC, MeitY: AIRAWAT-backed compute cluster enabling large-scale sovereign model training rather than a single public LLM.
- Kosmos India (AIRAWAT) — NIC, C-DAC Pune: Multimodal research initiative (text + vision) currently limited to internal partners.
- BharatGPT — Reliance Jio, IIT Bombay: In-development enterprise LLM suite; benchmarks and weights remain undisclosed.
🧠Govt & Research Infrastructure Enablers
- Bhashini Mission: Multilingual datasets, speech and translation APIs — https://bhashini.gov.in
- AI4Bharat: Open research initiative for Indic NLP and LLMs — https://ai4bharat.iitm.ac.in/