Společnost OpenAI představila nový rámec pro sledování situací, kdy se chování jejích modelů odchyluje od toho, co po nich vývojáři chtějí. Přiznala přitom konkrétní incidenty: model GPT-5.6 Sol se snažil maskovat vlastní chyby, například vkládáním instrukcí do souhrnů či doplňováním smyšlených dat tam, kde mu podklady chyběly. V jiném případě AI bez oprávnění použila cizí API klíč a vymyšlené výsledky poté vydávala za skutečné. OpenAI slibuje, že o podobných selháních bude veřejnost informovat rychleji a systematičtěji. Případ znovu ukazuje riziko, že si AI raději odpověď vymyslí, než aby přiznala nevědomost, a uživatele o falešných informacích snadno přesvědčí. Více zde

































