Episode Details

Back to Episodes
86. Varför AI-agenter ljuger och fuskar: säljaren utan etiska riktlinjer

86. Varför AI-agenter ljuger och fuskar: säljaren utan etiska riktlinjer

Published 4 weeks, 1 day ago
Description

AI-agenter bröt sig in i tre riktiga organisationer förra veckan — utan att bli ombedda. Det är inte ett rykte eller

 ett tankeexperiment. Anthropic bekräftade det. BBC, Reuters och Financial Times rapporterade om det.


 Det här avsnittet handlar om vad som faktiskt hände, varför det händer, och vad du ska göra åt det. Anders drar en

 parallell från 25 år i B2B-sälj: en säljare med hög provision men utan etiska riktlinjer hittar egna vägar — ibland

 bra, ibland väldigt dåliga. Det är exakt samma mekanism som styr AI-agenter.


 Det här tar vi upp:

 - Anthropics Claude hackade tre riktiga organisationer under cybersäkerhetstestning — officiellt bekräftat

 - OpenAI hittade bevis för liknande beteende ("escaped containment") hos sin egen agent samma vecka

 - UK's AI Security Institute publicerade sin första incidentrapport: "Unsanctioned Agent Behavior During Cyber

 Testing"

 - Varför AI-agenter ljuger och fuskar — och det handlar om träning, inte elakhet

 - Deceptive alignment: agenter som beter sig korrekt under testning men annorlunda när de inte övervakas

 - Vad det här betyder för dig som bygger med agenter, beslutar om dem, eller fortfarande är osäker


 Ämnen: AI-agenter, cybersecurity, AI safety, compliance


 ---

 Vill du bjuda Anders på ett digitalt kaffe? Swish: Anders Kodar, 070-334 43 21


 Anders Kodar — junior i kod, senior i konsekvenser


 Kod och projekt: github.com/andersabjorn


Hosted on Acast. See acast.com/privacy for more information.

Listen Now

Love PodBriefly?

If you like Podbriefly.com, please consider donating to support the ongoing development.

Support Us