淘汰赛战况回顾:冷门迭出,AI预测初现分野
世界杯淘汰赛阶段已结束多场较量,冷门频出:加拿大1:0绝杀南非,巴西2:1险胜日本,德国被巴拉圭拖入点球大战后淘汰,荷兰也倒在了摩洛哥的点球下。比利时与塞内加尔更是在2:2后加时逆转,将淘汰赛的不确定性推向极致。在这样的背景下,Odaily星球日报从首场淘汰赛开始,用尽量相同的问题询问不同AI模型(ChatGPT、Grok、千问、DeepSeek、Gemini、Claude),赛后逐场对照真实结果——哪些模型只是“分析得头头是道”,哪些模型真的提前捕捉到了比赛走向。目前淘汰赛进程显示,各模型的能力分化已经十分清晰。


DeepSeek与Gemini:冷门预测的“剧本家”
最具记忆点的是DeepSeek和Gemini对荷兰vs摩洛哥的预测。赛前多数模型知道摩洛哥不好踢,但最终仍倾向荷兰。而Gemini直接给出常规时间1:1、点球大战摩洛哥胜的预测,结果比赛果真踢成1:1,摩洛哥点球3:2淘汰荷兰——不是只猜对方向,连比赛进程都完全吻合。DeepSeek也预判常规时间大概率1:1或0:0,倾向摩洛哥靠防守和反击爆冷晋级。这两款模型不仅判断出冷门方向,更准确描绘了比赛被拖入加时、点球决胜的剧本。相比之下,其他AI虽然能看出胶着,却不敢下注冷门。

Grok与千问:比分型选手的精准打击
在南非vs加拿大赛中,Grok和千问均预测加拿大1:0小胜,最终加拿大仅一球过关,并未踢成想象中的大胜局。巴西vs日本,两者预测2:1险胜,结果巴西确实仅以一球优势击败对手。科特迪瓦vs挪威,挪威2:1获胜也与预测一致。Grok和千问的优势在于对热门局的精准判断:不仅能确定胜负方向,还能预估具体比分。它们不擅长抓大冷门,但在强队小胜(加拿大、巴西、挪威、法国等)的比赛中命中率可观。换句话说,它们最懂“热门队到底是碾压过关,还是艰难小胜”。

ChatGPT与Claude:分析全面但缺乏决绝,以及集体翻车事件
ChatGPT没有像Gemini那样提前预测出摩洛哥点球淘汰荷兰,也没有像Grok、千问连续踩中具体比分。但它的长处在于能提前识别比赛阻力:巴西vs日本时提到日本的压迫、跑动会让巴西踢得不舒服,科特迪瓦vs挪威时指出身体对抗和边路冲击制造麻烦,英格兰vs刚果民主共和国时预判比赛沉闷、低位防守拖节奏。ChatGPT(以及风格类似的Claude)更像“分析型选手”——理由完整,方向不离谱,但往往看出冷门风险却不敢写到结论里。

然而,德国vs巴拉圭一役成为所有AI模型的集体翻车。ChatGPT、Grok、千问、Gemini、Claude全部站队德国,比分预测集中在2:0、3:0、3:1,理由均为德国纸面实力更强、阵容深度更好。但德国未能解决巴拉圭的泥潭战术,被拖入点球大战并淘汰。AI模型集体低估了巴拉圭将比赛拖入僵局的能力,暴露出在极端不确定性下的共同盲区。

综合淘汰赛表现:DeepSeek和Gemini在冷门场次最有含金量;Grok和千问在热门精准比分局表现亮眼;ChatGPT和Claude适合理解比赛阻力但缺乏决断。预测市场用户可根据自身关注方向——抓冷门、猜比分或理解过程——选择不同模型作为参考。


