当前位置:首页 > 探知 > 集体押注世界杯,AI为何要扮演“懂球佬”

集体押注世界杯,AI为何要扮演“懂球佬”

2026-06-17 23:14:08 [知识] 来源:DooPrime德璞资本官网

  每经记者 温梦华 每经编辑 张益铭

  2026年美加墨世界杯才刚刚推开帷幕,而赛场外的集体AI(人工智能)赛事研判、实力比拼,押注演早已先行打开。世界

  日前,何扮国产大模型Kimi(月之暗面)称将通过Agent(智能体)集群同时调度300个子Agent,懂球佬公开预测104场世界杯赛事结果,集体并提出德国队或爆冷夺冠。押注演Kimi同时上线了一场“押注”活动:奖池中有1万亿Tokens(词元),世界用户选队后球队赢了就可以瓜分Token,何扮将体育赛事与AI用户运营深度绑定。懂球佬

  《每日经济新闻》记者(以下简称每经记者)注意到,集体千问也紧随其后上线了相关活动。押注演每经记者实测发现,世界豆包、何扮元宝、DeepSeek(深度求索)、文心一言等国产大模型在被问及“2026年世界杯谁会夺冠”时,多数预测答案为“西班牙队”,判断逻辑也高度趋同。

  繁华之下,Kelly Bench(一个大模型评估测试平台)最新数据却显示,包括ChatGPT等在内的顶级模型在足球赌盘上表现惨淡。

  Kimi、千问等AI大模型为何要“押注”世界杯?这背后,实际上是AI大模型行业的集体焦虑:当写诗、做题、对话的极致竞争走到尽头,各家厂商急于证明自己的产品能够理解繁琐、动态、充满不确定性的现实世界。

  借高关注度赛事制造用户体验入口

  面对世界杯的宏伟流量,一众品牌早已摩拳擦掌,这一次下场“押注”除了传统赞助商,还有手握万亿Tokens的AI大模型。

  近日,Kimi发文称,将通过Agent集群同时调度300个子Agent公开预测赛事结果,并在每轮赛前公开预测、赛后复盘。

  Kimi的预测策略并没有完全随大流。它并未否认当前多数主流模型将西班牙队和法国队列为夺冠最大热门,同样认为两者的夺冠概率位居前列,但它提出了另一个关注点:德国队的夺冠概率可能被市场低估。

  当网友们热议“AI预测究竟准不准”“AI懂不懂球”时,Kimi在一 开始就坦承“我们的预测很可能是错的”,并称期望通过这次尝试,把分析过程、预测结果和赛后复盘放在同一个透明框架中。

  此外,Kimi还拿出1万亿Tokens,用户预测冠军队、挑选的球队每次获胜就可以参与瓜分Token。截至6月11日18时,Kimi App(应用程序)显示,实时排行的队伍拥护率TOP5离别为阿根廷、法国、西班牙、巴西、葡萄牙,有43.33%的参与用户选择了阿根廷。

  那么,Kimi“押注”世界杯并豪掷万亿Tokens,究竟是能力展示,还是一次品牌营销?

  长期关注世界杯等知名赛事的体育咨询专家、关键之道创始人张庆告诉每经记者,Kimi此次活动类似于春晚抢红包、集福瓜分奖金等互联网平台常用打法,更像一种营销活动。

  “每一届世界杯都是宏伟的流量池,各个企业都期望有机会参与,获得更多曝光、引流机会。而大模型天然适合做这类数据分析和预测。”张庆向每经记者指出,当下,大模型竞争激烈,尤其是用户注意力和使用频次的竞争,通过世界杯一方面会加持品牌声量,另一方面也有利于提升大模型的数据用户积累和活跃度。

  深耕人工智能产业多年的技术专家王岩(化名)在接纳每经记者采访时坦言,大模型预测世界杯冠军,是体育热点、Token补贴和Agent展示叠加形成的传播事件。

  王岩认为,热点借势只是入口,真正的竞争点在于谁能把抽象模型能力转化为用户可感知的结果。这意味着,AI大模型企业在品牌传播上,不再只发布参数、榜单和技术报告,转为借高关注度赛事制造用户体验入口。而在商业竞争上各家模型争夺的则是用户心智、使用频次、社交传播和开发者注意力。

  截至目前,多少用户参与了Kimi“押注”世界杯的活动?通过用Agent集群预测世界杯冠军,Kimi又将获得哪些方面的能力提升?Kimi方面向每经记者表示:“暂无回应”。

  多款大模型预测西班牙队夺冠

  不只Kimi,其他AI大模型玩家也试图“分一杯世界杯的羹”。例如,千问也推出“决战美加墨,与千问一起预测,赢万元现金”的活动,加入这场AI“秀肌肉”争夺战。

  “我前两天也用DeepSeek、豆包预测了今年世界杯冠军,想对比它们谁分析的有道理,但我看到它们给出的预测结果和相关理由都有明显局限性。”张庆向每经记者分享道。

  在国产大模型眼中,谁是今年的冠军队伍?每经记者实测DeepSeek、Kimi、豆包、元宝、千问、文心一言、智谱清言后发现:DeepSeek押宝法国队,Kimi看好阿根廷队,而千问、豆包、元宝、文心一言、智谱清言5款国产大模型则均拥护西班牙队。

  每款AI大模型给出的理由略有不同。值得注意的是,拥护西班牙队的AI大模型判断逻辑高度趋同,核心理由之一均为“权威数据模型、机构高度一致看好”。

  大模型的预测到底准不准

  上海财经大学特聘教授胡延平向每经记者表示,AI大模型已经初步展露出基于全局动态信息和深度繁琐推理的特定预测能力。“但足球是圆的,预测的胜利率、精准度方面还有待观察。”

  “世界杯冠军预测无疑是展示模型与智能体水准的一个绝佳机会,不过预测的效果也是一把双刃剑。个人预期这届世界杯,水准最高的预测模型,胜利率能达到60%~80%。”胡延平说。

  不过,Kelly Bench在2023~2024年赛季英格兰超级联赛的模拟中显示,其评估的每个前沿模型在整个赛季都亏损了,并且许多都经历了破产。

  “AI更多的是一个辅助工具,基于战队历史战绩、世界杯排名、赔率、国际足联等大量数据的多维度预测,AI大模型呈现了客观数据统计,所以作为参考工具还是有意义的,但我不会完全依赖它的结果。”一位长期关注世界杯的资深球迷告诉每经记者。

  在上述球迷看来,相比大模型的预测,每个球迷都更青睐自己喜爱的球队,喜好也会占一大部分判断,而且越到决赛越是球员临场发挥和心理上的博弈,不确定性太多了。

  预测冠军是Agent能力的公开测试

  当大模型争先恐后地给出夺冠热门队伍时,这场看似娱乐化的“AI押注战”背后,大家究竟想“秀”什么?又在集体“卷”什么?

  “本轮大模型预测世界杯冠军,是生成式AI从问答工具走向公共事件运营的典型样本。”王岩向每经记者指出,公众看到的是冠军预测,企业展示的是Agent协同、长上下文处理、实时检索、概率解释和高并发服务能力,商业上争夺的则是用户时长、付费转化和资本叙事。

  当下,AI大模型的竞争早已不局限于单纯的参数榜单,而是从“会聊天”转向“能办事”,从“比模型”转向“比场景”。然而,一项全球研究显示,在调研全球1250多家企业后,仅5%的公司实现了AI价值的规模化应用。Gartner(美国一家信息技术研究分析公司)数据也显示,截至2025年底,嵌入真正AI Agent的企业应用占比不足5%。

  胡延平观察到,大模型和智能体正从对话走向任务,从预训练走向继续学习,从数据语料走向继续多维的现实感知。“预测世界杯冠军这类探索项目会加速这个进化过程。未来行动智能体所需要的能力体系,也是在走向‘感知—交互—决策—协同’这个方向。”

  不过,王岩坦言,世界杯冠军预测可以成为Agent能力的公开压力测试,但不能自动证明Agent能力提升,大模型在这场“押注”中训练和检验的是长任务组织、概率校准和用户交互能力。

  “Kimi的300个Agent代表分析覆盖面增加,不直接代表预测准确率提升。相关Agent任务Token花费研究显示,同一任务的Token花费可相差几十倍,更多Token并不必然带来更高准确率。”王岩向每经记者进一步分析。

  正如王岩所言:“当前Agent的最大缺口,正在从‘能否给出合理计划’转向‘能否稳定完成长周期真实任务’。”这意味着,谁能率先落地“实战能力”,谁就将有机会在愈发激烈的争夺赛中脱颖而出。

点击进入专题: 2026美加墨世界杯

(责任编辑:{typename type="name"/})

推荐文章
  • 甲状腺是怎么一步步罢工的?全过程拆解→

    甲状腺是怎么一步步罢工的?全过程拆解→ 今天25日)是世界甲状腺日。甲状腺,这个位于颈部的小小蝴蝶状腺体,却是人体重要的内分泌腺。当这个精密的内分泌工厂长期超负荷运转时——熬夜、压力等不良因素持续刺激,它就会通过结节、功能异常等方式发出警报 ...[详细]
  • 遵从玩家心声!《红色沙漠》开发团队:不刻意做规划

    遵从玩家心声!《红色沙漠》开发团队:不刻意做规划 今年3月上线的开放世界单机大作《红色沙漠》,凭借高自由度的探索玩法与流畅爽快的战斗手感,飞速获得全球玩家青睐。开发商Pearl Abyss近日公布,游戏发售未满一个月销量便突破500万份,还获得韩国国 ...[详细]
  • 无人机违规闯入高铁空域 多起典型案例敲响安全警钟

    无人机违规闯入高铁空域 多起典型案例敲响安全警钟 近年来,国内无人机保有量大幅增长,不少爱好者和从业者在铁路周边航拍、进行农林作业。部分操作人员安全意识薄弱、操作不规范,擅自闯入高铁管控空域、飞越铁路上空,严重扰乱运输秩序,直接威胁高铁行车安全。公安 ...[详细]
  • 2025年旅居竞争力榜单:老年人成为海外康养主力

    2025年旅居竞争力榜单:老年人成为海外康养主力 旅居,在人口流动谱系中,介于旅游和移民之间。相比旅游,旅居耗时更长,且伴随异地第二居所的购买或长期租赁行为。但相比移民,旅居多具备返回常住地的意图,且与常住地维持原有的社会关系,同时与旅居地保持浅层次 ...[详细]
  • 今年我国养老机器人市场规模将破百亿元

    今年我国养老机器人市场规模将破百亿元 今天26日),中国软件评测中心发布了《智能养老服务机器人产业演进与未来趋势研究》报告。报告显示,我国养老服务机器人产业已初步形成体系,正在从“技术验证”阶段向“规模化应用”过渡的关键期,但技术与复杂养 ...[详细]
  • 北京集中清理废弃非机动车 公示天无人认领直接拖走

    北京集中清理废弃非机动车 公示天无人认领直接拖走 5月1日,新版《北京市非机动车管理条例》正式实施,北京市同步加大废弃非机动车清理整治力度。今日,市交通委、市城管执法局、市公安交管局在牛街、广安门内、安定门内等区域进行联合执法,对废弃车辆进行专项检查 ...[详细]
  • Q1中国电视市场数据:75英寸连续两年成为最受迎接尺寸

    Q1中国电视市场数据:75英寸连续两年成为最受迎接尺寸 洛图科技数据显示,2026年Q1中国电视市场整机出货量806.5万台,同比降8.8%,零售量640万台,降11.4%,已连续四个季度下滑,短期难回暖。但大屏彩电趋势明显:一季度平均尺寸达64.3英寸, ...[详细]
  • 《大长今》女主李英爱近照曝光:54岁容貌宛如大学生

    《大长今》女主李英爱近照曝光:54岁容貌宛如大学生 近日,因经典韩剧《大长今》女主角而为亚洲观众熟知的韩国演员李英爱,在出席音乐会时被拍下近照。现年54岁的她状态依旧惊艳,肌肤紧致透亮,气质清新自然,引发网友热议,更被赞“宛如大学生,看不出 ...[详细]
  • 安陆:闻令而动 向险而行

    安陆:闻令而动 向险而行 5月24日晚以来,安陆市遭遇特大暴雨。本轮强降雨中,安陆市平均降雨量231.2毫米,最大点雨量达403.7毫米,77座中小水库超汛限,解放山水库开12孔泄洪。极端雨情给全市防汛工作带来严峻考验。汛情就 ...[详细]
  • 你只管收麦,剩下的河南人替你想着!

    你只管收麦,剩下的河南人替你想着! 开镰了。河南8500万亩小麦由南向北陆续成熟,进入大规模机收的关键时期,有些地方却遭遇了连续阴雨天气。此时,最怕的不是收麦的辛苦,而是麦子在地里等不起。北方有句俗语,叫收麦如救火。小麦成熟的窗口期本来 ...[详细]
热点阅读