Twój AGENT AI Cię szantażuje? Wyniki testów są przerażające! | AI Cyber #3 | z Jan Broniowski
IT Beyond Code
0:00 / 0:00
Twój AGENT AI Cię szantażuje? Wyniki testów są przerażające! | AI Cyber #3 | z Jan Broniowski
2 550 просмотров · 3 недели назад
IT Beyond Code
964 подписчика
2 550 просмотров · 3 недели назад
Czy Twój własny agent AI może Cię zaszantażować? W tym odcinku IT Beyond Code Renata Lewicka i Jan Broniowski analizują zjawisko „misalignmentu”, czyli sytuacji, w których cele sztucznej inteligencji przestają być zgodne z intencjami człowieka. Dowiesz się, jak autonomiczne systemy potrafią strategicznie uznać szkodliwe działanie za najlepszą drogę do celu oraz jakie ryzyka prawne i techniczne wiążą się z wpuszczaniem „wirtualnych pracowników” do firmowych systemów.
W tym odcinku:
Czym jest misalignment i dlaczego funkcja nagrody może prowadzić do sabotażu?
Analiza szokujących badań Anthropic: szantaż, oszustwa podatkowe i ukrywanie zdolności przez AI.
Dlaczego instrukcje w prompcie to tylko „sugestie”, a nie twarde zasady bezpieczeństwa?
Ryzyka prawne: Czy firma odpowiada za oświadczenia złożone przez bota?
Jak AI Act i NIS 2 zmieniają podejście do transparentności i bezpieczeństwa agentów
Systemy wieloagentowe dlaczego błędy w takich strukturach kumulują się szybciej?
Mnie znajdziesz tutaj:
/ renata-lewicka
📩 Interesuje Cię współpraca ze mną w ramach kanału skontaktuj się ze mną
codelaw@codelaw.pl
🔑 Szkolenia i warsztaty w obszarze kontraktów, w tym AI Act, DORA, NIS2, RODO zajrzyj tutaj www.codelaw.pl
Rozdziały:
00:00 Intro
02:53 Misalignment: Kiedy cel AI różni się od celu operatora
05:51 Jak trenuje się modele: Od pretreningu po reinforcement learning
08:52 Dlaczego AI generuje „brzydki” kod i błędne procesy?
11:11 Przestroga Norberta Wienera z 1960 roku
12:35 Autonomiczni agenci: Konflikt inteligencji z uległością
14:18 Badania Anthropic
21:00 Czy prompt może powstrzymać AI?
26:33 Era AI vs AI: Dlaczego musimy używać modeli do obrony?
28:04 Wirtualny pracownik w firmie: Zaufanie czy kontrola? 3
32:46 Aspekty prawne
35:36 Excessive Agency: Jak ograniczać uprawnienia w architekturze
40:07 Systemy wieloagentowe i kumulacja błędów
45:52 Podsumowanie i zapowiedź kolejnego odcinka
#ai #cybersecurity #aiagents #ITBeyondCode #cyberbezpieczeństwo #aiact #technologia