首页 景点排名文章正文

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

景点排名 2026年08月04日 23:48 3 aa
果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

文丨山海

本文为深度观点解读,仅供交流学习

特别声明:本文内容均引用权威资料结合个人观点进行撰写,文末已标注文献来源及截图,请知悉。

大家好,欢迎观看【山海点评】印度AI圈因一场乌龙成为全球AI界的笑谈。

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

2月18日,班加罗尔AI初创公司SarvamAI推出两款大语言模型,一个300亿参数模型和一个1050亿参数模型,并高调表示其1050亿参数的巨型模型“在大多数测试中击败了DeepSeekR1”。

联合创始人PratyushKumar在德里AI峰会上兴奋地宣称:“这款1050亿参数模型的性能超越了去年发布的6000亿参数DeepSeekR1,为印度AI技术书写了历史新篇章。”

本土媒体纷纷报道,Sarvam一时间炙手可热。这场声势浩大的宣传很快被全球开发者拆穿,全程堪称“翻车手册”。

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

事实证明,Sarvam的105B模型存在多个硬伤。尽管模型参数看似“硕大无比”,但实际激活参数仅90亿,和DeepSeek的6000亿参数R1根本不在一个量级。

这款模型的上下文窗口仅为12.8万token,与DeepSeekR1的1M窗口相比几乎“缩水至看不见”。模型架构也未展现出任何创新,反而与DeepSeek高度雷同:同样采用MoE(混合专家)架构、类似的路由机制、相似的训练策略。

更离谱的是,所谓“击败R1”的测试结果,特意挑选的是DeepSeekR1的初版性能,而忽视了发布后多轮技术升级。

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

被扒出这一系列“造假操作”后,Sarvam迅速修改宣传措辞,不敢再碰瓷DeepSeek最新版本的性能。

更具讽刺意味的是,外界推测Sarvam此举或许意在博取印度政府的资金支持。有报道称,印度政府今年正资助国内12家企业研发主权AI,而Sarvam的高调宣传可能是为争抢补贴。这一猜测至今缺乏实锤证据。

原本这件事已沉寂,然而7月31日再度成为话题焦点。原因很简单:同一天,DeepSeek正式发布了号称“革命性”的V4-Flash大语言模型,其无与伦比的性能和极致低价,让Sarvam所谓的“突破”看起来颇为可笑。

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

四大维度改写AI行业规则

DeepSeek-V4-Flash保留了284B总参数规模,每次任务仅激活13B参数,拥有1M上下文窗口。这看似与以往版本差别不大,但通过新一轮后训练,模型在四个核心维度上实现了重大突破。

超高速度震撼开发者

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

许多开发者对V4-Flash发布后第一时间进行了测试,中国AI开发者张泽在体验其API时表示:“相同任务下,V4-Flash+Hermes只用40秒,而GPT-5.6Sol+Codex花了1分47秒。

虽然Codex的质量稍高,但V4-Flash已经达到了实用水准。”对需要高频调用AI接口的创业团队,这种速度提升意味着迭代周期缩短、用户体验改善,直接带来了产品竞争力的提升。

堪称白菜价的成本

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

DeepSeek这次将调用API的成本直接砍到历史新低。百万tokens输入收费仅1元,输出2元;缓存命中时输入可降至0.02元。

即便峰谷定价,调用成本仅为GPT-5.6Sol的1/50到1/100。一个典型的中型AI项目,一个月调用千万tokens带来的开销,从几十万元直降到几千元。这样的价格策略,不仅让开发者直接受益,也极大降低了行业入场门槛。

算力压缩突破极限

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

除了快和便宜,V4-Flash在算力需求上的优化同样亮眼。尽管性能更强,但推理所需算力仅为前代模型的10%,KVCache占用减至7%。

经过Q8量化后,模型甚至可以用162GB显存运行,让单张八卡H100能够轻松部署。无需昂贵的超大算力集群。

仅配备高性能工作站或消费级GPU的团队,也能部署运行这种高性能大模型。这种“轻量+高效”的组合,彻底颠覆了传统“高算力堆叠=强性能”的行业思维。

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

性能不降反升

V4-Flash在多项性能测试中都交出了亮眼成绩。在AgentLastExam终极测试中获得25.2分,接近顶级闭源模型Opus-4.8的25.7分。

在DeepSWE测试中一骑绝尘,从预览版的7.3分直线飙升至54.4分。更快、更省、更轻的同时还能做到更加智能,这正是整个平台发布后引起行业轰动的原因。

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

中国开源AI的全球影响力

Sarvam的翻车让人唏嘘,但从另一角度看,这也印证了中国AI技术对全球开发者的深刻影响。Sarvam所谓“从零训练”的模型,被扒出几乎是完全复制DeepSeek的开源架构。

如果没有DeepSeek的大量技术公开,Sarvam根本不可能“抄作业”抄得如此精准。这不仅说明中国的技术方案实用可靠,也印证了DeepSeek开源策略的深远意义,通过MIT协议,全球开发者可以自由构建自己的技术体系。

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

同时,这次中国AI技术的表现也从侧面削弱了美国芯片制裁的影响力。虽然美国试图通过限制GPU供应来打压中国计算资源,但V4-Flash却用10%的推理算力完成了与前代模型相当的任务。

即便在有限的硬件条件下,中国依旧能够用软件优化抵消这一制约,甚至让未来的主权AI直接适配国产算力卡,迅速完成去“美国化”的过程。

这种开源与创新结合的路径,为整个AI行业提供了新思路:技术进步不一定需要闭门造车,也不一定靠硬件堆叠。全链条的优化,同样能打造出具备行业颠覆性的解决方案。

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

这种影响力并未止步于中国国内,而是逐步渗透全球市场。

当开发者能以1/50的成本获得接近顶级性能的AI输出、中国开源架构被世界争相模仿时,我们有理由再次确认:开源战略不仅能让技术“走出去”,更能让其产生无远弗届的力量。

这一次,印度公司的“碰瓷式模仿”虽然让人觉得搞笑,但从更深的层面来看,它其实成为中国从科技跟跑者转变为领跑者的重要注解。

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

正如V4-Flash用极限性能展示的,也许曾经的AI行业是个“谁有资源谁说了算”的游戏,但未来的AI科技版图将由高效、开放和创新的力量决定主导权,这才是最核心的“时代改写者”。

由于平台规则,只有当您跟我有更多互动的时候,才会被认定为铁粉。如果您喜欢我的文章,可以点个“关注”,成为铁粉后能第一时间收到文章推送。

信息来源:DeepSeek发布V4 Flash正式版,性能远超V4 Pro预览版;儿童的说话方式可以预示他们未来出现心理健康问题的风险 | 环球科学要闻丨环球科学丨2026-08-03

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

信息来源:AI startup Sarvam launches two made-in-India large language models丨Feb 18 2026丨business-standard

果然太高调坏大事!印度吹嘘超过中国:结果套壳大模型被扒光底裤

发表评论

长征号 Copyright © 2013-2024 长征号. All Rights Reserved.  sitemap