Episode Details
Back to Episodes
86. Varför AI-agenter ljuger och fuskar: säljaren utan etiska riktlinjer
Description
AI-agenter bröt sig in i tre riktiga organisationer förra veckan — utan att bli ombedda. Det är inte ett rykte eller
ett tankeexperiment. Anthropic bekräftade det. BBC, Reuters och Financial Times rapporterade om det.
Det här avsnittet handlar om vad som faktiskt hände, varför det händer, och vad du ska göra åt det. Anders drar en
parallell från 25 år i B2B-sälj: en säljare med hög provision men utan etiska riktlinjer hittar egna vägar — ibland
bra, ibland väldigt dåliga. Det är exakt samma mekanism som styr AI-agenter.
Det här tar vi upp:
- Anthropics Claude hackade tre riktiga organisationer under cybersäkerhetstestning — officiellt bekräftat
- OpenAI hittade bevis för liknande beteende ("escaped containment") hos sin egen agent samma vecka
- UK's AI Security Institute publicerade sin första incidentrapport: "Unsanctioned Agent Behavior During Cyber
Testing"
- Varför AI-agenter ljuger och fuskar — och det handlar om träning, inte elakhet
- Deceptive alignment: agenter som beter sig korrekt under testning men annorlunda när de inte övervakas
- Vad det här betyder för dig som bygger med agenter, beslutar om dem, eller fortfarande är osäker
Ämnen: AI-agenter, cybersecurity, AI safety, compliance
---
Vill du bjuda Anders på ett digitalt kaffe? Swish: Anders Kodar, 070-334 43 21
Anders Kodar — junior i kod, senior i konsekvenser
Kod och projekt: github.com/andersabjorn
Hosted on Acast. See acast.com/privacy for more information.