乐天高调发布“日本最大AI模型”,社群扒出内核竟是DeepSeek V3微调版

乐天高调发布“日本最大AI模型”,社群扒出内核竟是DeepSeek V3微调版

N
News Editor 01
2026-07-23 06:15:16
乐天集团发布Rakuten AI 3.0,号称日本最大自研模型,数小时后被社群发现config.json显示model_type为deepseek_v3,实为DeepSeek V3日语微调版,日本政府资助背景引关注。
乐天DeepSeek V3AI模型开源日本

日本电商巨头乐天集团(Rakuten)创办人兼CEO三木谷浩史高调发布Rakuten AI 3.0,对外定位为“日本最大高效能AI模型”,以Apache 2.0协议免费开源。公告宣称其在多项日语基准测试中超越GPT-4o,但发布不到几小时,社群就在HuggingFace上翻出一个尴尬细节:模型config.json中明确写着model_type: deepseek_v3architectures: DeepseekV3ForCausalLM

参数配置完全复制DeepSeek V3:总参数量671B,推理激活37B,上下文窗口128K tokens。乐天仅以“充分利用开源社群最优成果”一笔带过基础模型来源,并未点出DeepSeek。严格来说,DeepSeek V3采用Apache 2.0开源协议,商用和微调在法律上无问题,但“合法”与“诚实公开��是两回事。

日本政府资助项目竟用中国底座模型

更值得关注的是Rakuten AI 3.0的身份背景。该模型是日本经济产业省(METI)与新能源产业技术综合开发机构(NEDO)联合推进的GENIAC计划(Generative AI Accelerator Challenge)成果,日本政府为其提供了部分训练算力资助。乐天拿着政府补贴的算力,在中国开源模型上跑微调,再贴上自主品牌发布,这层关系让外界议论不止。

DeepSeek V3实力:训练成本仅为GPT-4的5%

DeepSeek V3于2024年12月发布,是深度求索推出的开源旗舰模型,训练成本仅约500至600万美元,比GPT-4便宜超过20倍,多项基准测试打平甚至超越顶级闭源模型。Apache 2.0授权允许任何人商用与重新发布,这也解释了乐天为何能直接拿来用——但宣传时完全不提底座来源,被讽刺为“贴牌发布”。

这次事件再次印证:DeepSeek不做营销,却成了开源圈最硬的广告。其影响力已渗透到日本国家级AI项目中。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。