日本电商巨头乐天集团(Rakuten)创办人兼CEO三木谷浩史高调发布Rakuten AI 3.0,对外定位为“日本最大高效能AI模型”,以Apache 2.0协议免费开源。公告宣称其在多项日语基准测试中超越GPT-4o,但发布不到几小时,社群就在HuggingFace上翻出一个尴尬细节:模型config.json中明确写着model_type: deepseek_v3、architectures: DeepseekV3ForCausalLM。
参数配置完全复制DeepSeek V3:总参数量671B,推理激活37B,上下文窗口128K tokens。乐天仅以“充分利用开源社群最优成果”一笔带过基础模型来源,并未点出DeepSeek。严格来说,DeepSeek V3采用Apache 2.0开源协议,商用和微调在法律上无问题,但“合法”与“诚实公开��是两回事。
日本政府资助项目竟用中国底座模型
更值得关注的是Rakuten AI 3.0的身份背景。该模型是日本经济产业省(METI)与新能源产业技术综合开发机构(NEDO)联合推进的GENIAC计划(Generative AI Accelerator Challenge)成果,日本政府为其提供了部分训练算力资助。乐天拿着政府补贴的算力,在中国开源模型上跑微调,再贴上自主品牌发布,这层关系让外界议论不止。
DeepSeek V3实力:训练成本仅为GPT-4的5%
DeepSeek V3于2024年12月发布,是深度求索推出的开源旗舰模型,训练成本仅约500至600万美元,比GPT-4便宜超过20倍,多项基准测试打平甚至超越顶级闭源模型。Apache 2.0授权允许任何人商用与重新发布,这也解释了乐天为何能直接拿来用——但宣传时完全不提底座来源,被讽刺为“贴牌发布”。
这次事件再次印证:DeepSeek不做营销,却成了开源圈最硬的广告。其影响力已渗透到日本国家级AI项目中。

