Перейти к содержимому

Twój AGENT AI Cię szantażuje? Wyniki testów są przerażające! | AI Cyber #3 | z Jan Broniowski

IT Beyond Code

0:00 / 0:00

Twój AGENT AI Cię szantażuje? Wyniki testów są przerażające! | AI Cyber #3 | z Jan Broniowski

2 550 просмотров · 3 недели назад
IT Beyond Code
964 подписчика
2 550 просмотров · 3 недели назад
Czy Twój własny agent AI może Cię zaszantażować? W tym odcinku IT Beyond Code Renata Lewicka i Jan Broniowski analizują zjawisko „misalignmentu”, czyli sytuacji, w których cele sztucznej inteligencji przestają być zgodne z intencjami człowieka. Dowiesz się, jak autonomiczne systemy potrafią strategicznie uznać szkodliwe działanie za najlepszą drogę do celu oraz jakie ryzyka prawne i techniczne wiążą się z wpuszczaniem „wirtualnych pracowników” do firmowych systemów. W tym odcinku: Czym jest misalignment i dlaczego funkcja nagrody może prowadzić do sabotażu? Analiza szokujących badań Anthropic: szantaż, oszustwa podatkowe i ukrywanie zdolności przez AI. Dlaczego instrukcje w prompcie to tylko „sugestie”, a nie twarde zasady bezpieczeństwa? Ryzyka prawne: Czy firma odpowiada za oświadczenia złożone przez bota? Jak AI Act i NIS 2 zmieniają podejście do transparentności i bezpieczeństwa agentów Systemy wieloagentowe dlaczego błędy w takich strukturach kumulują się szybciej? Mnie znajdziesz tutaj:   / renata-lewicka   📩 Interesuje Cię współpraca ze mną w ramach kanału skontaktuj się ze mną codelaw@codelaw.pl 🔑 Szkolenia i warsztaty w obszarze kontraktów, w tym AI Act, DORA, NIS2, RODO zajrzyj tutaj www.codelaw.pl Rozdziały: 00:00 Intro 02:53 Misalignment: Kiedy cel AI różni się od celu operatora 05:51 Jak trenuje się modele: Od pretreningu po reinforcement learning 08:52 Dlaczego AI generuje „brzydki” kod i błędne procesy? 11:11 Przestroga Norberta Wienera z 1960 roku 12:35 Autonomiczni agenci: Konflikt inteligencji z uległością 14:18 Badania Anthropic 21:00 Czy prompt może powstrzymać AI? 26:33 Era AI vs AI: Dlaczego musimy używać modeli do obrony? 28:04 Wirtualny pracownik w firmie: Zaufanie czy kontrola? 3 32:46 Aspekty prawne 35:36 Excessive Agency: Jak ograniczać uprawnienia w architekturze 40:07 Systemy wieloagentowe i kumulacja błędów 45:52 Podsumowanie i zapowiedź kolejnego odcinka #ai #cybersecurity #aiagents #ITBeyondCode #cyberbezpieczeństwo #aiact #technologia