Címke: Claude
Az Anthropic MI-ügynökei már más modellek biztonságát kutatják
Az Anthropic olyan ügynököket fejlesztett, amelyek MI-modellek biztonsági fejlesztésére keresnek és tesztelnek módszereket. A kísérlet a rekurzív önfejlesztés kézzelfogható példája, ugyanakkor a rendszer kijátszási kísérleteket is feltárt.

