AI 在游戏中习得的技能能否迁移至现实工作?Good Start Labs 的探索与实验
初创团队 Good Start Labs 通过将策略游戏构建为强化学习训练环境,验证了 AI 模型在游戏中习得的推理与目标执行能力可以迁移至实际工作任务。其实验显示,在铁路策略游戏《1830》中训练的终端智能体能显著提升 Finance-Agent 金融研究基准表现,而微调《外交》游戏的模型在客户支持基准上也有所改进。
初创团队 Good Start Labs 通过将策略游戏构建为强化学习训练环境,验证了 AI 模型在游戏中习得的推理与目标执行能力可以迁移至实际工作任务。其实验显示,在铁路策略游戏《1830》中训练的终端智能体能显著提升 Finance-Agent 金融研究基准表现,而微调《外交》游戏的模型在客户支持基准上也有所改进。
英国 AI 安全研究所(AISI)分析显示,GLM-5.2 与 DeepSeek-V4-Pro 等开源模型在网络安全能力上与闭源前沿模型的差距已缩小至 4 到 7 个月。