印度Sarvam AI开源105B大模型,主打AI主权
导语:2026年2月18日,在“2026年印度AI影响力峰会”的第三天,班加罗尔AI初创公司Sarvam AI发布了两款“从零构建”的MoE架构大语言模型——Sarvam-30B与Sarvam-105B,并以开源权重形式提供。这是印度本土大模型在国际舞台上的高光时刻,也被视为新兴市场走“AI主权”路线的标志性事件。
事件详情
两款模型定位分明:较小型号Sarvam-30B采用30B-A1B的MoE设计,在16T token数据上预训练,支持3.2万token上下文窗口,面向需要低延迟的实时应用场景;规模更大的Sarvam-105B采用105B-A9B设计,支持12.8万token上下文窗口,面向要求更为严苛的复杂推理用例。
据Sarvam宣称,105B模型在本地化的印度语言基准测试中优于谷歌Gemini 2.5 Flash等竞争对手;在更广泛的工作负载上,“大多数基准测试中优于DeepSeek R1,许多基准测试中优于谷歌Gemini Flash”。30B模型则在印度从零开始训练,支持22种印度语言,包括印地语、泰米尔语、泰卢固语、卡纳达语、孟加拉语、马拉地语等,在通用推理和编码基准上可与Gemma、Mistral、Qwen等同量级开源模型相当。
两款模型即将在Hugging Face上以开源权重形式提供,API访问与仪表盘支持随后推出,采用支持商用的开放许可。Sarvam还宣布与高通、博世、诺基亚等全球科技公司建立合作伙伴关系,推进产品集成与部署。
除模型外,Sarvam还推出了“Pravah”——一家“AI代币工厂”,以及面向初创公司的Sarvam Launch计划,提供免费API积分。值得一提的是,此次发布是Sarvam“14天-14发”计划的一部分,前一天它刚刚发布了AI眼镜Kaze。公司首席执行官Pratyush Kumar在发布会上表示:“这将使每个人都能以极低的成本使用人工智能。”
背景分析
Sarvam的发布恰逢印度AI战略的高潮期。在同一届峰会上,L&T宣布与英伟达合作建设主权吉瓦级AI数据中心,高通承诺向印度AI与技术初创公司投资1.5亿美元,NPCI与英伟达合作推进数字支付生态的主权AI能力。印度正在举国家之力构建自主AI栈:算力、模型、应用,一个都不能少。
“从零构建”是Sarvam最核心的叙事。与许多基于开源模型微调的地区性玩家不同,Sarvam强调预训练完全自主完成,数据、架构、训练流程都掌握在自己手中。这背后是“数据主权”的考量:一个14亿人口国家的语言、文化、政务与商业数据,不应长期依赖他国模型处理。
另一个关键词是成本。Sarvam把“极低成本推理”作为核心卖点:30B模型通过更少的token实现高效推理,Pravah代币工厂瞄准工业级token生产。在价格敏感的新兴市场,推理成本往往比基准测试分数更能决定模型的生死。
影响展望
Sarvam的路径为新兴市场提供了一个范本:不盲目追逐万亿参数的“大力出奇迹”,而是聚焦本土语言、主权数据与低成本推理,在巨头相对忽视的战场上建立优势。如果105B的基准宣称经得起独立验证,印度将拥有第一个真正意义上的本土前沿模型。
当然,挑战依然艰巨:16T token的预训练只是起点,持续的模型迭代、生态建设、开发者 adoption 都需要长期投入;与高通、博世、诺基亚的合作能否转化为真实的部署量,也有待观察。
但无论如何,当班加罗尔的初创公司开始谈论“从零构建”并推出105B模型时,全球AI版图正在发生变化:创新的中心不再只属于硅谷。数据主权时代的地方性大模型,或许正是下一波AI浪潮的起点。