王者荣耀
《漫威斗魂》官方承认 PC 版首发表现令人失望,将全力挽回玩家信任_我的网站

一 | 8 月 25 日消息,据外媒 VGC 今天(25 日)报道,《漫威斗魂》开发商亚克系统承认,PC 版首发表现令人失望后,重新赢得玩家信任将“极具挑战”,并向受到影响的玩家表达歉意。 8 月 24 日消息,据外媒 Phys.org 今天(24 日)报道,卡迪夫大学和墨尔本大学的一项新研究发现,生成式人工智能(GenAI)目前还无法像人类教师一样可靠地评判学生的书面作业。《漫威斗魂》制作人山中丈嗣称,团队对主机版获得的积极反响感到非常高兴,也清楚 PC 玩家目前面对的问题:“游戏发售已经两周,我们很感谢玩家对游戏内容本身给予相当积极的评价,也能看到核心格斗玩家每天都在对战、练习、研究新的连招,并把成果发布到社交媒体上。

二 | PC 版确实有很多玩家遇到游戏问题,我们对此向所有玩家表示歉意。研究人员使用 ChatGPT 的两个版本,对 50 篇生物科学专业本科生论文进行评分,以测试大模型评估学生作业的能力。团队目前正全力修复问题,已经连续推出两个紧急补丁,最新补丁大幅改善了 CPU 负载问题,剩余问题也还在继续处理。”据了解,《漫威斗魂》在 Steam 首发时获得“褒贬不一”的评价。

三 | 发售前后,同时在线玩家峰值一度超过 2.4 万人;SteamDB 数据显示,目前每日同时在线玩家约为 4000 人。被问及如何挽回 PC 版问题造成的信任损失时,山中丈嗣坦言,把已经流失的玩家重新争取回来将极具挑战。“这确实是一项非常艰巨的任务。我们希望拿出全部努力,为玩家创造一个能够正常体验这款团队投入大量心血打造的游戏的环境。

四 | ChatGPT 需要按照 7 项标准批改这些论文,研究人员还采用了 4 种不同的提示方式,随后将大模型与人工评分的平均分和分数波动情况进行比较。图源:Pexels卡迪夫大学生物科学学院威廉 · 凯博士指出:“研究结果显示,模型给出的分数波动很大,无法准确预测人工评分。

五 | 生成式 AI 与人类批改同一批论文时存在明显差异。只看论文总分,两者给出的结果相对接近;一旦具体到每项评分标准和每一篇论文,大模型与人工评分之间的差距就相当明显。我们也很有信心,只要能够正常体验,游戏本身会给玩家带来真正的乐趣。”除一种情况外,AI 模型给出的平均分普遍高于人工评分。

六 | 平均分方面,AI 模型与人工评分的最大差距达到 16.1 分;具体到单篇论文,最大差距达到 40 分。”“我们知道 PC 版的问题给玩家造成了很多困扰,对此真的非常抱歉。获悉,威廉 · 凯还发现,AI 往往会压低高分论文的成绩,又把低分作业的成绩抬高,最终使分数系统性地向中间集中。

七 | 我们可以保证,团队一直在持续改进,也希望玩家愿意继续陪伴我们,让《漫威斗魂》获得更多活力。研究结果说明,至少现阶段,即使经过大量训练,AI 仍无法可靠地对主观性较强的书面作业给出与人类相当的分数。”“我还想真心感谢每一位在首发前后购买游戏的玩家。

八 | 尤其是那些愿意购买 PC 版,却因为这些问题无法获得应有的游戏体验,可能暂时离开甚至已经退款的玩家,我想为他们遇到的所有问题表达诚挚歉意。“我们测试的大模型目前并不适合取代教师,为学生预测作业成绩。”研究人员指出,高等教育领域确实很关注大模型能否利用模式识别能力,让学生作业评分更加客观,同时提高批改效率、减轻教职人员压力。重新赢回因此失去的信任绝对不会容易,但团队正在正面解决问题,并会继续竭尽全力改善游戏,让玩家能够流畅游玩。我认为,这就是我们现在能做的最大努力。

九 | 但这项研究表明,目前并不适合这么做。此外,未经学生明确同意便把作业提交给 AI 工具,本身还涉及伦理问题;大模型也不能、也不应该被依赖来给学生的长篇书面作业评分。团队会继续齐心协力,希望最终提供一款比首发版本更值得玩家享受的游戏。我们只能尽最大努力,也希望玩家能够感受到我们的诚意。“随着大模型继续发展,未来模仿人类判断的能力可能会提高。但从这项研究来看,要让 AI 给出的分数与人工评分真正保持一致,恐怕并不容易。
Current article:http://x5cn.xiadiaosengchengcun.shop/list_jvbeh/j30z5x.html
Published on:09:28:55
