LIVE INDEX / 最新文章
当模型学会了"读心术",我们还需要教它做人吗?

当模型学会了"读心术",我们还需要教它做人吗?

先说说这场比试的起点。 AI安全这件事,拆开来看其实是两码事。一是**控制**,也就是想办法让模型少说坏话,少干坏事;二是**监控**,也就是在模型说话干事的过程中,能不能及时发现"这里不对劲"。 这两件事,...