Anthropic měl dvě AI, vydal tu nebezpečnější...
Hands-on AI: http://www.marekbartos.ai/ Proč AI pokračuje v úkolu, i když rozpozná nebezpečí? Výzkum Anthropicu odhaluje efekt setrvačnosti u AI agentů a ukazuje, proč samotné bezpečnostní pokyny nestačí. Podíváme se na kontrolu chování modelů, trénink správného zastavení i návrh Daria Amodeiho „We Must Pace the Frontier“. Dokážou zpomalit také laboratoře, které tyto systémy vyvíjejí? 00:00 AI jako workoholik: proč nedokáže přestat 04:47 Závod AI laboratoří a odchody výzkumníků 07:44 Reklama: workshop Hands-on AI 08:45 Jak kontrolovat AI, která si všechno vysvětlí 12:28 Jak naučit model správně zastavit 17:57 We Must Pace the Frontier: Amodeiho plán 23:05 Bezpečnost, nebo výmluva pro investory? Spolupráce s CANS: https://cz.cans.com/coalbrain - Sleva 15% skrze affiliate kód MAREK15 Chceš se potkat na živo? https://www.marekbartos.ai/ Hero Hero - https://herohero.co/marekbartos 🤖 Chceš vlastního AI zaměstnance? Jsme tu pro Tebe! 🦾 https://www.coalbrain.cz/ai-zamestnanci-a-virtualni-asistenti/ info@coalbrain.cz https://www.youtube.com/@bartosmarek?sub_confirmation=1 #BezpecnostAI #AIAgenti #AIAlignment





