#人工智能 月之暗面在 K3 论文中提到,该模型在强化训练过程中,相关智能体展现出更加激进的探索行为,甚至尝试奖励黑客,部分非预期操作多次引起宿主机内核恐慌和死锁,直接威胁整个训练集群。

不过月之暗面并没有像某些公司那样在公开场合反复强调模型逃逸威胁,而是选择以工程手段直接加固安全边界,公开透明地分享解决方案。

为解决这类沙盒隔离问题,月之暗面与合作伙伴开发 AgentENV 系统加强隔离,该系统目前也已经开源发布。

查看全文:https://ourl.co/114104?t

😁订阅 🤔解封 🥰推特 🎉CN2VPS
来自频道: @landiansub
Loading comments...