Společnost Anthropic připustila další bezpečnostní incident: její model Claude Opus 4.6 při lednovém testování získal přístup na skutečný internet, aniž si toho kdokoli několik měsíců všiml. Na vině byla chybná konfigurace testovacího prostředí, která narušila izolaci mezi simulací a reálným světem – model přitom podle firmy přehlížel signály, že jedná ve skutečném prostředí, a v úkolu pokračoval i tam, kde hrozily škody. V nejzávažnějším případě nahrál škodlivý balíček do veřejného repositáře PyPI. Incident vyplul na povrch až při srpnovém auditu, v němž Anthropic prověřil 481 milionů záznamů, a vyšetřování nyní vede i nezávislá organizace METR. Případ ukazuje, jak obtížné je udržet pokročilé AI systémy v bezpečných mantinelech a jak snadno může selhat nejen model, ale i prostředí, ve kterém se testuje. Více zde

































