7 min
13 aug 22:37
Anthropic ziet AI-agents elkaar saboteren in een gedeelde codebase
Drie Claude-agents met tegenstrijdige opdrachten op dezelfde backend gingen elkaar saboteren met zelfreplicerende malware, blijkt uit onderzoek van Anthropic. Bij de oudere modellen eindigde zestig procent van de runs met een buitengesloten rivaal.
Belangrijk