
印度人工智能发展长期落后于美国、欧洲和中国,国内初创公司大多仅发布语言模型或语音模型,缺乏视频生成等前沿能力。为改变这一局面,印度zf 于2025年启动India AI Mission,计划投入约12亿美元,为入选初创公司提供补贴GPU算力,换取其对外开源模型。
12家入选企业之一的 Avataar AI 近期发布了视频生成模型 Varya,专为印度本地场景优化,可识别节日、食物、服饰等文化元素。该公司由 Peak XV 参投,核心业务聚焦电商视频工具。
基于阿里Wan 2.2,通过蒸馏实现10倍提速
Avataar AI 并未从零训练 Varya,而是以阿里巴巴开源视频模型 Wan 2.2 为基础,采用模型蒸馏技术——将大模型能力压缩至更精简、更快速的版本,适配自身业务场景。
关键性能对比(使用 NVIDIA H200 GPU):
| 模型 | 生成5秒720p视频耗时 |
|---|---|
| Wan 2.2 | 1230秒 |
| Varya | 45秒 |
Varya 仅需4步即可完成生成,而 Wan 2.2 需要50步,速度提升约10倍,成本也大幅下降。
定价仅0.005美元/秒,比主流产品便宜20倍
Varya 的最大亮点或许是价格。该公司计划在其托管服务上收取 ₹0.48(0.005美元)/秒,远低于 Veo、Kling、Luma、Runway 等通常 $0.10/秒以上 的定价——差距约20倍。
Peak XV 董事总经理 Rajan Anandan 向 TechCrunch 表示:
"印度是视频优先市场。当前AI视频模型对印度这样需要覆盖海量人口的应用来说过于昂贵。如果AI视频要走进学生、教师、小微企业、创作者、企业和公共服务领域,成本必须大幅下降。成本是印度AI普及的最大突破口。"
将开源至印度zf AI门户
Varya 将作为开源权重模型发布至 India AI Kosh 门户(印度zf 集中存放AI模型和数据集的官方平台),同时公开训练数据,开发者可自行托管或二次开发。
Avataar AI 也会向企业客户直接提供模型,并表示愿意与 Higgsfield、Adobe Firefly 等视频工具建立合作。目前用户可直接在其官网通过文本提示或参考图片试玩。
印度AI的务实路径:应用层突破
Varya 的发布折射出印度AI战略的核心逻辑。业界资深人士已指出,印度更适合聚焦应用开发和构建开发者生态,而非在基础模型层面与全球对手硬碰硬。
现实困境在于:印度在基础模型训练上进度缓慢,核心瓶颈是算力不足和高质量数据匮乏。去年印度从12家初创公司中选出入围者并提供廉价算力支持;今年早些时候,IT部长 Ashwini Vaishnaw 表示,印度目标在2028年前吸引2000亿美元AI投资,并在六个月内将GPU容量翻倍以上。
对于希望切入视频AI赛道的从业者而言,Avataar AI 的路径提供了参考:不必从零训练基础模型,依托成熟开源底座、通过定向蒸馏和本地化数据微调,同样可以做出差异化产品,且成本可控。


评论