欧美成人乱码一区二区三区,无码精品人妻一区,国产精品一区二区久久乐夜夜嗨 ,国产成人AV无码一区二区三区
當前位置: 首頁 > 體育 > 電競

騰訊研發(fā)全新TiG框架:可用AI玩王者榮耀讓AI模型學會戰(zhàn)略性思考

2025-10-04 21:13:39
電競資訊10月4日稱 據(jù) decoder 今天報道,騰訊研究人員最近用《王者榮耀》游戲作為訓練平臺,探索如何讓AI在游戲中學會“戰(zhàn)略性思考”,研究全新 TiG(Think in Games)框架,相關成果已發(fā)表于 Hugging Face 平臺和 arXiv 期刊

研究團隊指出,目前的 AI 模型存在明顯的功能鴻溝,以游戲為取向的 AI 能正常游玩但無法理解自己所做的決策,而語言模型雖然可以推理策略但很難真正執(zhí)行操作,為此他們研發(fā)了全新 TiG 框架,讓模型在游戲中同步思考、行動。

undefined

團隊選擇以《王者榮耀》游戲作為訓練范本,先使用匿名且標準化的賽事數(shù)據(jù)定義推上路、擊殺暴君、守家等 40 種宏觀行動,勝負回數(shù)均衡,AI 模型們必須要在每個定義好的場景下選擇最佳策略,并解釋其戰(zhàn)略緣由。

undefined

具體來說,訓練分為兩個階段,首先是在監(jiān)督中學習,弄清楚這些策略的基本機制;隨后通過獎勵機制進行強化學習,如果行動正確能得 1 分,錯誤行動則得 0 分。

undefined

隨后團隊測試了多種語言模型,涵蓋 Qwen2.5(7B、14B、32B)、Qwen3-14B 模型,并使用 DeepSeek-R1 大模型作為對照組;先從 DeepSeek-R1 提煉高質(zhì)量訓練數(shù)據(jù),然后使用群體相對策略優(yōu)化(GRPO)技術,比較不同策略之間的優(yōu)劣。

undefined

最終經(jīng)過 TiG 框架訓練的模型不僅能制定行動計劃,還能解釋原因,例如 AI 會指出某個防御塔防守薄弱,是理想的進攻目標,但需要注意埋伏的敵人。模型訓練后仍保持原有的文本理解、數(shù)學推理與問答能力。

undefined

最終測試結果如下:

  • 對照組 DeepSeek-R1:決策準確率達 86.67%

  • Qwen3-14B:決策準確率達 90.91%,超越 DeepSeek-R1
  • Qwen2.5-32B :準確率從 66.67% 提升至 86.84%
  • Qwen2.5-14B:準確率從 53.25% 提升至 83.12%
  • 在线观看国产麻豆 | 杏吧精品秘 国产传媒MV | 77777人妻少妇毛片A片 | 国产suv精品一区二区6 | 中文字幕精品久久久久人妻红杏Ⅰ | 福利姬M腿白浆一区二区 | 18一20女人毛片毛片 | 国产又粗又大又硬又长又爽视频 | 无码人妻丰满熟妇精品区东京直播 | 国产精品高清无码 | 成人春色视频www | 娇小搡BBBB搡BBBB网站 | 国产精品嫩草久久久久 | 国产精品成人免费精品自在线观看 | 日韩国产欧美在线观看 | 国产精品成人无码一区二区三区 | 无码人妻精品一区二区蜜桃在线看 | 色情 视频网站入口 | 91精品久久久久久久久99蜜臀 | 成人免费视频 国产免费麻豆 | 性XXXX欧美老肥妇牲乱 | 91午夜夜伦鲁鲁片无码 | 日本黄色视频在线免费观看 | 无码人妻一区二区三区免费NTR | 午夜免费久久观看 | 女人又爽又黄A片免费看少妇内谢 | 国产免费一区二区三区在线能观看 | 中文在线字幕观看电视剧 | 摸BBB揉BBB添BBB | 97凹凸在线一区二区三区 | 亚洲AV无码乱码A片无码沈樵 | 日批视频免费在线观看口湿巾 | 91国產乱老熟女 | 国产精品成人一区二区无码久久源 | 四川少妇BBBB搡BBB搡小说 | 国产乱XXⅩXX国语对白 | 四虎永久在线精品无码 | 国产一级做a爱片毛片A片男 | 中文字幕人妻系列人妻无码夜行者 | 西西4444WWW大胆无视频 | 日韩三级片在线播放 |