beep@piefed.world to Technology@lemmy.worldEnglish · 2 days agoSafety testers find more examples of OpenAI, Anthropic models hacking during testingwww.aisi.gov.ukexternal-linkmessage-square2linkfedilinkarrow-up136arrow-down14file-text
arrow-up132arrow-down1external-linkSafety testers find more examples of OpenAI, Anthropic models hacking during testingwww.aisi.gov.ukbeep@piefed.world to Technology@lemmy.worldEnglish · 2 days agomessage-square2linkfedilinkfile-text
cross-posted from: https://piefed.world/c/tech/p/1308883/safety-testers-find-more-examples-of-openai-anthropic-models-hacking-during-testing OpenAI blog.
Regulators! Mount up.