Demo ukážka: Ako skrotiť autonómnych agentov a nestratiť dáta (20 min)
Bežec, smolná fotka zo závodu a pokus „opraviť“ ju pomocou AI — aj takto sa dá začať prednáška o bezpečnosti umelej inteligencie. Príbeh, v ktorom systém odmietne odstrániť watermark, otvára tému takzvaných guardrails: bezpečnostných mantinelov, ktoré chránia AI aplikácie pred zneužitím. Prečo ich potrebujeme, ako fungujú a čo znamenajú pre firmy aj štát? Rečník priznáva, že najlepšia fotka z jeho behu nebola lichotivá a navyše ju „kazilo“ cudzie dieťa a watermark. Keď požiadal AI o odstránenie vodoznaku, systém to odmietol — a práve tento moment ho priviedol k bezpečnosti AI. Dôležité zistenie: odmietnutie nebolo „vlastnosťou“ modelu, ale výsledkom dodatočných kontrol medzi chatovým oknom a modelom, teda guardrails. Problém je, že komerčné riešenia sú čierne skrinky a mnohé organizácie potrebujú AI bežať on‑premise, takže musia mať mantinely pod plnou kontrolou.Od bežeckej fotky k bezpečnostným mantinelom