AI-laber og teknologiselskaperPublisert 20. juli 2026
Anthropic stenger og gjenåpner Fable 5 – og lanserer felles jailbreak-standard med Amazon, Google og Microsoft
Tre hendelser samme dag: ny mellommodell til lavere pris, AI-arbeidsbenk for forskere, og bransjens første felles rammeverk for å rangere alvorligheten av jailbreaks mot AI-modeller.
30. juni 2026 lanserte Anthropic Claude Sonnet 5 og Claude Science, og publiserte sammen med Amazon, Microsoft og Google et utkast til et felles rammeverk for å klassifisere jailbreak-trusler. Bakteppet er konkret: Fable 5, Anthropics kraftigste tilgjengelige modell, ble stengt ned globalt 12. juni etter at Amazon-forskere demonstrerte en omgåelsesteknikk – og gjenåpnet 1. juli med ny sikkerhetsklassifikator. Alle tre tiltakene er tilgjengelige fra dag én: Sonnet 5 via API, Claude Science som beta for betalte abonnenter, og jailbreak-rammeverket åpent for innspill.
Sonnet 5: nær Opus-nivå til Sonnet-pris
Claude Sonnet 5 ble tilgjengelig for alle planer 30. juni 2026 og er fra samme dato standardmodellen for gratisbrukere og Pro-abonnenter på Claude.ai. Ifølge Anthropic leverer modellen ytelse tett opptil Opus 4.8 – selskapets nest kraftigste tier.
Introduksjonsprisen er 2 dollar per million input-tokens og 10 dollar per million output-tokens, gjeldende til 31. august 2026. Fra 1. september trer standardpris på 3 og 15 dollar i kraft – identisk med det Sonnet 4.6 kostet. En ny tokenizer gjør at samme tekstmengde produserer omtrent 1,0–1,35 ganger flere tokens enn i Sonnet 4.6. Introprisen er utformet for å gjøre overgangen tilnærmet kostnadsnøytral, men ved overgang til standardpris kan reell kostnad per kall stige avhengig av arbeidsbelastning, ifølge Anthropics utviklerdokumenter.
På agentic coding-benchmarken SWE-bench Verified scorer Sonnet 5 72,7 prosent, mot Sonnet 4.6s 62,3 og Opus 4.8s 79,4 – alle tall fra Anthropics egne evalueringer, ikke uavhengig verifisert. Den største relative fremgangen er på Terminal-bench, der modellen scorer 76,1 mot forgjengererens 55,4. Kontekstvinduet er én million tokens, og modellen støtter inntil 128 000 output-tokens.
Sonnet 5 er den første Sonnet-klassede modellen med sanntids cybersikkerhetssperrer. Forespørsler klassifisert som risikable av en innebygd klassifikator returneres med HTTP 200-status og stoppkode «refusal», ikke en feilmelding. Interne evalueringer viser lavere rate av hallusinasjon og servil adferd sammenlignet med Sonnet 4.6, men modellen er ikke på nivå med Opus 4.8 og Fable 5 når det gjelder å motstå villedende eller skadelige instrukser, ifølge Anthropic.
Utviklere som migrerer fra Sonnet 4.6, møter tre API-endringer: adaptiv tenkning er nå aktivert som standard, manuell extended thinking returnerer feilkode 400, og sampling-parametrene temperature, top_p og top_k støttes ikke lenger og gir også feilkode 400.
Fable 5 ble stengt ned – og kom tilbake med ny sikkerhetsklassifikator
Claude Fable 5 og Mythos 5 ble lansert 9. juni 2026. Tre dager senere påla det amerikanske handelsdepartementet Anthropic å stanse global tilgang til begge modellene, etter at Amazon-forskere hadde demonstrert en metode for å omgå Fable 5s sikkerhetssperrer og, i ett tilfelle, generere kode som viste hvordan en programvaresårbarhet kunne utnyttes.
Tilgangen ble gjenopprettet 30. juni, og Fable 5 ble redistribuert globalt fra 1. juli. Løsningen var en ny sikkerhetsklassifikator som ifølge Anthropic og det amerikanske Center for AI Standards and Innovation (CAISI) – som testet løsningen uavhengig – blokkerer over 99 prosent av forsøk som replikerer den rapporterte teknikken. En kjent bivirkning er at legitime kode- og feilsøkingsforespørsler kan bli feilaktig blokkert og videresendt til Opus 4.8.
Mythos 5, en versjon uten de ekstra sikkerhetsspørrene, forblir begrenset til utvalgte partnere under Project Glasswing. Godkjente organisasjoner i USA fikk fornyet tilgang 26. juni; utvidelse til internasjonale Glasswing-partnere pågår fortsatt.
Et felles språk for å rangere AI-trusler
Hendelsen avdekket et strukturelt problem: bransjen manglet en felles standard for å vurdere alvorligheten av en gitt jailbreak. Anthropic, Amazon, Microsoft og Google publiserte 2. juli et utkast til et Cyber Jailbreak Severity-rammeverk (CJS) under Project Glasswing-samarbeidet. Rammeverket rangerer jailbreaks på en skala fra CJS-0 (informasjonell) til CJS-4 (kritisk) langs fire akser: kapabilitetsgevinst for angriperen, bredde av opplåste kapabiliteter, hvor enkelt teknikken lar seg omsette til et reelt angrep, og hvor lett den lar seg oppdage og reprodusere.
Anthropic karakteriserer det Amazon-rapporterte funnet som ikke-universelt: det låste opp et avgrenset sett med kapabiliteter som ifølge selskapet også lot seg reprodusere av svakere modeller som Opus 4.8, GPT-5.5 og Kimi K2.7. Selskapets poeng er at én tvetydig teknikk utløste 20 dagers global nedstenging av en frontkantmodell, nettopp fordi det manglet et felles grunnlag for å vurdere alvorligheten.
Rammeverket er et utkast, ikke en vedtatt standard. Anthropic inviterer akademia, sivilt samfunn og myndigheter til å sende innspill via cyber-safeguards@anthropic.com, og har åpnet et HackerOne bug bounty-program for cybersikkerhetsjailbreaks spesifikt i Fable 5. Dersom Amazon, Microsoft og Google slutter seg til rammeverket, kan det bli en de facto industristandard på linje med CVSS-skalaen for programvaresårbarheter.
Vitenskapelig arbeidsbenk med stipender
Samme dag åpnet Anthropic Claude Science i beta – en AI-arbeidsbenk for vitenskapelige forskere tilgjengelig på macOS og Linux for betalte abonnenter (Pro, Max, Team og Enterprise). Plattformen er ikke en ny underliggende modell: den kjører eksisterende Claude-modeller, inkludert Opus 4.8, og integrerer over 60 vitenskapelige databaser med verktøysett for blant annet genomikk, proteomikk, strukturbiologi og kjemi.
En hoved-agent koordinerer arbeidet og kan delegere til spesialiserte under-agenter. En egen reviewer-agent kontrollerer referanser og beregninger. Reproducerbarhet er et eksplisitt designprinsipp: når Claude Science genererer en figur, lagres den eksakte koden, kjøremiljøet og meldingshistorikken som muliggjorde den. At det er den samme underliggende modellen som kontrollerer sitt eget arbeid – ikke en uavhengig kilde – er en begrensning Anthropic selv erkjenner.
Anthropic vil støtte inntil 50 forskningsprosjekter med inntil 30 000 dollar i credits per prosjekt. Søknadsfristen er 15. juli 2026, tildelingen varsles innen 31. juli, og prosjektene løper fra 1. september til 1. desember. Norske universitets- og instituttsektormiljøer kan søke; Anthropic tilbyr også rabatterte Team-lisenser til aktive laboratorier ved akademiske institusjoner og ideelle forskningsorganisasjoner.
Norsk regelverk: fremdeles under EØS-behandling
EU AI Act trådte formelt i kraft i EU 2. august 2024. Per juli 2026 er forordningen ennå ikke innlemmet i EØS-avtalen. Norges digitaliseringsminister Karianne Tung varslet tidligere i 2026 at en norsk KI-lov sikter på ikrafttredelse sommeren 2026, men dette er foreløpig ikke skjedd. Ifølge kiforordning.no og CMS Law er det ventet at loven trer i kraft i løpet av 2026, med mulighet for en kortere forsinkelse i forhold til EUs frist 2. august. Nkom er utpekt som koordinerende tilsynsmyndighet, og Norsk akkreditering skal ivareta akkrediteringsrollen EU AI Act krever. Bøter for brudd på forbudsbestemmelsene kan i EU nå opp til 35 millioner euro eller syv prosent av global omsetning.
CJS-rammeverket er ikke direkte koblet til EU AI Act, men er relevant: regulatorer som utformer tekniske standarder under forordningens Annex III for høyrisiko-AI-systemer, vil sannsynligvis se hen til bransjestandarder av denne typen. Nkom har ikke kommentert rammeverket offentlig per dato for denne artikkelen.
EØS-forhandlingenes utfall avgjør nøyaktig ikrafttredelsesdato for den norske KI-loven. Anthropic har ikke offentliggjort noen tidslinje for ferdigstillelse av CJS-rammeverket.
««A common standard for assessing AI jailbreaks would help us and other companies launch new models safely, as well as allow our users to make the most of their advanced capabilities.»»
De viktigste AI- og reguleringssakene, oversatt til hva de betyr for din virksomhet. Gratis.
Kilde: https://www.anthropic.com/news
Bakgrunnskilder: Anthropic: Introducing Claude Sonnet 5 · Anthropic: Redeploying Fable 5 · Anthropic: More details on Fable 5's cyber safeguards and our jailbreak framework · Anthropic: Claude Science, an AI workbench for scientists · Claude Platform Docs: What's new in Claude Sonnet 5 · Regjeringen.no: Paving the way for safe and innovative use of AI in Norway · kiforordning.no: KI-loven – når trer KI-forordningen i kraft i Norge? · CMS Law: AI laws and regulations in Norway · Let's Data Science: Anthropic proposes cross-industry framework for scoring AI jailbreak severity · TechCrunch: Anthropic launches Claude Sonnet 5 as a cheaper way to run agents · TechCrunch: Anthropic's Claude Science bets on workflow to win over scientists