荣耀贵利发布微博称倒计时 3 天,#MagicOS11先锋品鉴会# 惊喜不止一点点。这条微博把大家的注意力直接拉到了 8 月 6 日的北京——荣耀 M...
2026-08-05 1
文丨山海
本文为深度观点解读,仅供交流学习
特别声明:本文内容均引用权威资料结合个人观点进行撰写,文末已标注文献来源及截图,请知悉。
大家好,欢迎观看【山海点评】印度AI圈因一场乌龙成为全球AI界的笑谈。
2月18日,班加罗尔AI初创公司SarvamAI推出两款大语言模型,一个300亿参数模型和一个1050亿参数模型,并高调表示其1050亿参数的巨型模型“在大多数测试中击败了DeepSeekR1”。
联合创始人PratyushKumar在德里AI峰会上兴奋地宣称:“这款1050亿参数模型的性能超越了去年发布的6000亿参数DeepSeekR1,为印度AI技术书写了历史新篇章。”
本土媒体纷纷报道,Sarvam一时间炙手可热。这场声势浩大的宣传很快被全球开发者拆穿,全程堪称“翻车手册”。
事实证明,Sarvam的105B模型存在多个硬伤。尽管模型参数看似“硕大无比”,但实际激活参数仅90亿,和DeepSeek的6000亿参数R1根本不在一个量级。
这款模型的上下文窗口仅为12.8万token,与DeepSeekR1的1M窗口相比几乎“缩水至看不见”。模型架构也未展现出任何创新,反而与DeepSeek高度雷同:同样采用MoE(混合专家)架构、类似的路由机制、相似的训练策略。
更离谱的是,所谓“击败R1”的测试结果,特意挑选的是DeepSeekR1的初版性能,而忽视了发布后多轮技术升级。
被扒出这一系列“造假操作”后,Sarvam迅速修改宣传措辞,不敢再碰瓷DeepSeek最新版本的性能。
更具讽刺意味的是,外界推测Sarvam此举或许意在博取印度政府的资金支持。有报道称,印度政府今年正资助国内12家企业研发主权AI,而Sarvam的高调宣传可能是为争抢补贴。这一猜测至今缺乏实锤证据。
原本这件事已沉寂,然而7月31日再度成为话题焦点。原因很简单:同一天,DeepSeek正式发布了号称“革命性”的V4-Flash大语言模型,其无与伦比的性能和极致低价,让Sarvam所谓的“突破”看起来颇为可笑。
DeepSeek-V4-Flash保留了284B总参数规模,每次任务仅激活13B参数,拥有1M上下文窗口。这看似与以往版本差别不大,但通过新一轮后训练,模型在四个核心维度上实现了重大突破。
超高速度震撼开发者
许多开发者对V4-Flash发布后第一时间进行了测试,中国AI开发者张泽在体验其API时表示:“相同任务下,V4-Flash+Hermes只用40秒,而GPT-5.6Sol+Codex花了1分47秒。
虽然Codex的质量稍高,但V4-Flash已经达到了实用水准。”对需要高频调用AI接口的创业团队,这种速度提升意味着迭代周期缩短、用户体验改善,直接带来了产品竞争力的提升。
堪称白菜价的成本
DeepSeek这次将调用API的成本直接砍到历史新低。百万tokens输入收费仅1元,输出2元;缓存命中时输入可降至0.02元。
即便峰谷定价,调用成本仅为GPT-5.6Sol的1/50到1/100。一个典型的中型AI项目,一个月调用千万tokens带来的开销,从几十万元直降到几千元。这样的价格策略,不仅让开发者直接受益,也极大降低了行业入场门槛。
算力压缩突破极限
除了快和便宜,V4-Flash在算力需求上的优化同样亮眼。尽管性能更强,但推理所需算力仅为前代模型的10%,KVCache占用减至7%。
经过Q8量化后,模型甚至可以用162GB显存运行,让单张八卡H100能够轻松部署。无需昂贵的超大算力集群。
仅配备高性能工作站或消费级GPU的团队,也能部署运行这种高性能大模型。这种“轻量+高效”的组合,彻底颠覆了传统“高算力堆叠=强性能”的行业思维。
性能不降反升
V4-Flash在多项性能测试中都交出了亮眼成绩。在AgentLastExam终极测试中获得25.2分,接近顶级闭源模型Opus-4.8的25.7分。
在DeepSWE测试中一骑绝尘,从预览版的7.3分直线飙升至54.4分。更快、更省、更轻的同时还能做到更加智能,这正是整个平台发布后引起行业轰动的原因。
Sarvam的翻车让人唏嘘,但从另一角度看,这也印证了中国AI技术对全球开发者的深刻影响。Sarvam所谓“从零训练”的模型,被扒出几乎是完全复制DeepSeek的开源架构。
如果没有DeepSeek的大量技术公开,Sarvam根本不可能“抄作业”抄得如此精准。这不仅说明中国的技术方案实用可靠,也印证了DeepSeek开源策略的深远意义,通过MIT协议,全球开发者可以自由构建自己的技术体系。
同时,这次中国AI技术的表现也从侧面削弱了美国芯片制裁的影响力。虽然美国试图通过限制GPU供应来打压中国计算资源,但V4-Flash却用10%的推理算力完成了与前代模型相当的任务。
即便在有限的硬件条件下,中国依旧能够用软件优化抵消这一制约,甚至让未来的主权AI直接适配国产算力卡,迅速完成去“美国化”的过程。
这种开源与创新结合的路径,为整个AI行业提供了新思路:技术进步不一定需要闭门造车,也不一定靠硬件堆叠。全链条的优化,同样能打造出具备行业颠覆性的解决方案。
这种影响力并未止步于中国国内,而是逐步渗透全球市场。
当开发者能以1/50的成本获得接近顶级性能的AI输出、中国开源架构被世界争相模仿时,我们有理由再次确认:开源战略不仅能让技术“走出去”,更能让其产生无远弗届的力量。
这一次,印度公司的“碰瓷式模仿”虽然让人觉得搞笑,但从更深的层面来看,它其实成为中国从科技跟跑者转变为领跑者的重要注解。
正如V4-Flash用极限性能展示的,也许曾经的AI行业是个“谁有资源谁说了算”的游戏,但未来的AI科技版图将由高效、开放和创新的力量决定主导权,这才是最核心的“时代改写者”。
由于平台规则,只有当您跟我有更多互动的时候,才会被认定为铁粉。如果您喜欢我的文章,可以点个“关注”,成为铁粉后能第一时间收到文章推送。
信息来源:DeepSeek发布V4 Flash正式版,性能远超V4 Pro预览版;儿童的说话方式可以预示他们未来出现心理健康问题的风险 | 环球科学要闻丨环球科学丨2026-08-03
信息来源:AI startup Sarvam launches two made-in-India large language models丨Feb 18 2026丨business-standard
相关文章
荣耀贵利发布微博称倒计时 3 天,#MagicOS11先锋品鉴会# 惊喜不止一点点。这条微博把大家的注意力直接拉到了 8 月 6 日的北京——荣耀 M...
2026-08-05 1
2024年被业界视为“超级应用元年”。在OpenAI推出自家超级应用并承认其体验“相当混乱”之际,微软CEO萨提亚·纳德拉正式确认,一款面向Copil...
2026-08-05 2
无需打开直接搜索微信:本司针对手游进行,选择我们的四大理由: 1、软件助手是一款功能更加强大的软件!无需打开直接搜索微信: 2、自动连接,用户只要开启...
2026-08-04 72
作者 | Srini Penchikala, Savannah Kunovsky, Anthony Alford 等 译者 | 平川 策划 | 丁晓昀...
2026-08-04 10
文丨山海本文为深度观点解读,仅供交流学习特别声明:本文内容均引用权威资料结合个人观点进行撰写,文末已标注文献来源及截图,请知悉。大家好,欢迎观看【山海...
2026-08-04 3
您好:这款游戏可以开挂,确实是有挂的,很多玩家在这款游戏中打牌都会发现很多用户的牌特别好,总是好牌,而且好像能看到-人的牌一样。所以很多小伙伴就怀疑这...
2026-08-04 52
您好:这款游戏可以开挂,确实是有挂的,很多玩家在这款游戏中打牌都会发现很多用户的牌特别好,总是好牌,而且好像能看到-人的牌一样。所以很多小伙伴就怀疑这...
2026-08-04 50
无需打开直接搜索微信:本司针对手游进行,选择我们的四大理由: 1、软件助手是一款功能更加强大的软件!无需打开直接搜索微信: 2、自动连接,用户只要开启...
2026-08-04 76
发表评论