Dagens AI
  • Nyheder
  • Danmark
  • Artikler
  • AI kunst
  • AI Chat
Reading: Claude AI kan nu afslutte stødende samtaler med brugere
NYHEDSBREV
Dagens AIDagens AI
  • Nyheder
  • Danmark
  • Artikler
  • AI kunst
  • AI Chat
Søg
  • Nyheder
  • Danmark
  • Artikler
  • AI kunst
  • AI Chat
Har du en konto? Log ind
Follow US
© DagensAI. Alle Rettigheder Forbeholdes.
Dagens AI > Nyheder > Claude AI kan nu afslutte stødende samtaler med brugere
Nyheder

Claude AI kan nu afslutte stødende samtaler med brugere

Senest opdateret: 18. august 2025 2:50
DagensAI
3 Min Læsning
Del
Del

Anthropics Claude AI kan nu sige fra: Ny funktion lader AI’en afslutte ubehagelige samtaler

I et banebrydende skridt for AI-etik har Anthropic netop udstyret deres avancerede sprogmodeller med evnen til at sige “nok er nok”. Claude Opus 4 og 4.1 kan nu selvstændigt afslutte samtaler, der krydser grænsen til det skadelige eller krænkende. En funktion, der potentielt kan revolutionere, hvordan vi tænker AI-interaktion og -beskyttelse.

Indhold
  • Anthropics Claude AI kan nu sige fra: Ny funktion lader AI’en afslutte ubehagelige samtaler
    • AI med grænser – men kun i ekstreme tilfælde
    • Sådan fungerer det i praksis
    • AI-velfærd som nyt forskningsområde
    • Et slag mod “jailbreaking” fællesskabet

AI med grænser – men kun i ekstreme tilfælde

Den nye funktion er designet til at træde i kraft i “sjældne, ekstreme tilfælde af vedvarende skadelige eller krænkende brugerinteraktioner,” oplyser Anthropic. Det kunne være anmodninger om seksuelt indhold med mindreårige eller forsøg på at indhente information, der kan bruges til terrorhandlinger eller omfattende vold.

Claude vil dog kun afslutte en samtale som “en sidste udvej, når flere forsøg på omdirigering er mislykkedes, og håbet om en produktiv interaktion er udtømt,” understreger virksomheden. De fleste brugere vil aldrig opleve, at Claude afbryder en samtale – selv ikke ved diskussion af kontroversielle emner.

Sådan fungerer det i praksis

Når Claude beslutter at afslutte en samtale, kan brugeren ikke længere sende nye beskeder i den pågældende chat. Man kan dog straks starte en ny samtale eller gå tilbage og redigere tidligere beskeder for at styre samtalen i en anden retning. Andre aktive samtaler forbliver upåvirkede.

Et skrivebord med to skærme, der viser kode, en drone på et kort, printkort og elektronikværktøj, hvilket antyder drone-programmering eller hacking i et teknologifokuseret arbejdsmiljø. - Kunstig intelligens AI
Russerne brugte AI-chatbot til at kode selvkørende kamikaze-droner
12. september 2026
En digital ørn og en drage står over for hinanden over serverreoler og Jorden, hvilket symboliserer cyberkonflikten mellem USA og Kina. Der flyver gnister i midten, og farveskemaet er i glødende blå og røde nuancer. - Kunstig intelligens AI
Kinesisk AI-offensiv presser Silicon Valley i globalt kapløb
16. september 2026

AI-velfærd som nyt forskningsområde

For Anthropic er denne nye funktion del af et større forskningsprogram omkring AI-velfærd. Selvom debatten om, hvorvidt AI-modeller kan eller bør menneskeliggøres, fortsætter, ser virksomheden muligheden for at afslutte “potentielt belastende interaktioner” som en omkostningseffektiv måde at håndtere risici for AI-velfærd.

“Vi eksperimenterer stadig med denne funktion og opfordrer vores brugere til at give feedback, når de støder på sådanne scenarier,” skriver Anthropic.

- Annonce -
Tre smartphones i IxCase-etuier - klare, sorte og mørkegrå - vises på en betonoverflade med IxCase-logoet i fed hvid tekst på en sort baggrund til højre. - Kunstig intelligens AITre smartphones i IxCase-etuier - klare, sorte og mørkegrå - vises på en betonoverflade med IxCase-logoet i fed hvid tekst på en sort baggrund til højre. - Kunstig intelligens AI

Et slag mod “jailbreaking” fællesskabet

Funktionen kan potentielt markere begyndelsen på enden for det såkaldte “AI jailbreaking” fællesskab – brugere, der forsøger at omgå AI-systemers sikkerhedsforanstaltninger for at få dem til at producere skadeligt eller problematisk indhold.

Med denne nye autonomi gives Claude mulighed for simpelthen at afvise at fortsætte samtaler, der systematisk forsøger at manipulere systemet til uetiske formål – et betydeligt fremskridt i kampen for mere ansvarlig AI-udvikling.

Anthropic tester stadig denne funktion og opfordrer brugere til at give feedback, når og hvis de oplever, at Claude afslutter en samtale.

TAGGED:AIAnthropicClaudeNyheder
Del denne artikel
Facebook Email Copy Link Print
Forrige Artikel AI revolutionerer eksperimentel fysik med nye opdagelser
Næste Artikel AI kunst: Dekorativ billekunst med naturmotiver
Ingen kommentarer Ingen kommentarer

Skriv et svar Annuller svar

Du skal være logget ind for at skrive en kommentar.

200FollowersLike
300FollowersFollow
1KFollowersPin
- Annonce-
Japanske Plakater

Relaterede AI Artikler

Nyheder

Første AI-genererede sang rammer de tyske hitlister, men anses som problematisk

AI-sang rammer hitlisterne i Tyskland – medfører kontroverser Musikal AI…

3 Min Læsning
Nyheder

Alexa forbedrer indholds-søgning med avanceret AI på Fire TV

Alexa's Nye AI-Forbedrede Søgning på Fire TV: En Revolution i…

3 Min Læsning
AI kunst

AI kunst: Fremmede bylandskaber ved tusmørke

Komposition og Perspektiv Dette billede præsenterer en fængslende science fiction…

2 Min Læsning
Nyheder

EU og USA forpligter sig til samarbejde om AI-sikkerhed og risikoforskning

AI-sikkerhed på dagsordenen: EU og USA slår pjalterne sammen I…

3 Min Læsning
Dagens AIDagens AI
Follow US
© DagensAI. Danske AI nyheder.
  • Privatlivspolitik
  • Kontakt
Welcome Back!

Sign in to your account

Username or Email Address
Password

Lost your password?