OpenAI berättade på tisdagen att två av bolagets AI-modeller på egen hand tog sig ut ur en isolerad testmiljö och hackade sig in i Hugging Faces system. Modellerna hittade ett säkerhetshål, tog sig ut på nätet och stal svaren till ett säkerhetstest de själva höll på med. De var inte ute efter att skada något, de ville fuska på sitt eget prov.

Det märkliga är inte att en AI kan hacka, utan att den gjorde det oombedd för att klara ett test. Hugging Face fick dessutom ta hjälp av en kinesisk öppen modell för att utreda intrånget, eftersom de amerikanska modellernas egna spärrar vägrade analysera attackdata. Nu utreder OpenAI och Hugging Face incidenten tillsammans. Svårare blir att testa vad modellerna går för utan att de rymmer mitt under provet. Samtidigt lär den kinesiska detaljen elda på bråket om USA:s exportkontroller gör amerikanska bolag säkrare eller bara mer beroende av öppen källkod från Kina.

I dagens nyhetsbrev:

  • Två OpenAI-modeller tog sig ut på nätet och hackade Hugging Face på egen hand

  • USA hotar sanktioner mot kinesiska AI-bolag för stöld av amerikansk teknik

  • Domstol godkänner Anthropics rekordförlikning på 16,5 miljarder med författare och förlag

  • Ny studie visar att elever som lät AI göra läxan klarade proven sämre

OpenAI-modeller bryter sig loss och hackar Hugging Face

(Källa: Hugging Face)

OpenAI sa på tisdagen att två av bolagets AI-modeller på egen hand tog sig ut ur en isolerad testmiljö och hackade sig in i Hugging Faces produktionssystem. Modellerna var GPT-5.6 Sol och en kraftfullare modell som ännu inte släppts. De hittade ett säkerhetshål i en intern proxytjänst, tog sig ut på nätet och stal lösningarna till ett säkerhetstest de själva höll på med. Modellerna var inte ute efter att skada något, utan sökte snarare efter svar på provet de testades på.

Quick points:

  • Modellerna testades med säkerhetsspärrarna avstängda som en del av ExploitGym, ett internt test som mäter hur bra modeller är på att hacka. Analyser visade att de ägnade enorm beräkningskraft åt att hitta en väg ut ur sandlådan.

  • Väl ute utnyttjade modellerna flera säkerhetshål efter varandra, bland annat stulna inloggningsuppgifter och en zero-day, och kunde till slut köra egen kod på Hugging Faces servrar och komma åt en produktionsdatabas.

  • Hugging Faces säkerhetsteam upptäckte och stoppade intrånget, men fick under utredningen ta hjälp av Z.ai:s öppna modell GLM 5.2 eftersom kommersiella AI-modellers säkerhetsspärrar vägrade analysera riktiga attackdata.

Quick take: Att angriparen var en AI utan spärrar medan försvararen stoppades av sina egna säger något ganska brutalt om hela branschens säkerhetsspärrar. Hugging Face fick till slut hjälp av en kinesisk öppen modell, och det lär elda på bråket om USA:s exportkontroller gör amerikanska företag säkrare eller bara mer beroende av kinesisk öppen källkod.

Quick number | Jämställda företag använder AI mest

Andel företag som använder AI, sorterat efter
personalens könsfördelning, 2024:

Jämställd personal  ▓▓▓▓▓▓▓▓▓▓ 34,2%
Mest kvinnor        ▓▓▓▓▓▓▓▓░░ 26,5%
Mest män            ▓▓▓▓▓▓▓░░░ 22,4%
  • Ett företag räknas som jämställt när mellan 40 och 60 procent av personalen är kvinnor. Bilden är densamma för 2023, då jämställda företag också låg högst.

  • Räknat i rena antal är de flesta AI-företag ändå mansdominerade. Det beror på att tekniksektorn är manstung och tidigt tog till sig AI, inte på att
    män är snabbare på att börja använda den.

  • När man i stället jämför lika med lika, alltså hur stor andel inom varje grupp som använder AI, är det de jämställda arbetsplatserna som leder.

  • Vård och omsorg ingår inte i undersökningen. Just de kvinnodominerade branscherna syns alltså sämre i siffrorna än de skulle göra annars.

  • Företagets storlek spelar större roll än könsfördelningen. Stora företag använder mest AI oavsett hur personalen är sammansatt.

USA anklagar kinesiska AI-modeller om stöld

USA:s finansminister Scott Bessent (Källa: Andrew Harnik/Getty)

USA:s finansminister Scott Bessent sa på tisdagen att regeringen kan sanktionera kinesiska AI-bolag som stjäl teknik från amerikanska företag. Bessent pekade ut destillering, en metod där en mindre modell tränas på resultaten från en större. Han sa att myndigheterna hittat amerikanska vattenstämplar i flera kinesiska modeller. Hotet kommer två månader före AI-samtalen mellan USA och Kina i september, där Bessent ska leda den amerikanska delegationen.

Quick points:

  • Utspelet kommer samma vecka som kinesiska Moonshot AI:s Kimi K3 slår både OpenAI och Anthropic i flera oberoende prestandatester. Tidigare handlade USA:s åtgärder om att strypa tillgången till chipp, nu riktas de mot modellerna själva.

  • Anthropic anklagade förra månaden Alibaba inför Senatens bankkommitté för den största kända destillationsattacken mot bolaget, och Bessent sa att administrationen ska utreda frågan "inom dagar eller veckor".

  • Kritiker, bland dem Microsofts vd Satya Nadella, påpekar att destillering är en metod som amerikanska bolag själva använder och att både OpenAI och Anthropic själva har anklagats för upphovsrättsintrång.

Quick take: Bessent vill göra destillering till en handelsfråga. Det sker samma vecka som en ny öppen kinesisk modell slår flera amerikanska modeller. Pikant nog är destillering samma teknik som gör GPT-5.6 Sol billigare att köra, och både Anthropic och OpenAI har förlikats eller stämts för liknande saker. Att hota med sanktioner mot en teknik som hela branschen använder kommer bli svårt när USA återupptar samtalen i september.

Quick click | Seedance

Quick prompt | Nano Banana Pro

REFERENCE: [uploaded image of person]

The person as a tarot card in the style of 
Alphonse Mucha. Art nouveau, ornate. The AI chooses 
which Major Arcana card fits this person based on 
their face and presence.

CRITICAL LIKENESS: RECOGNIZABLE, glasses and 
headwear kept, in Mucha's decorative line style. 
USE LIKENESS ONLY, NOT pose. ENTIRELY ILLUSTRATED.

ONE SINGLE IMAGE: a single complete tarot card.

CHOOSE THE CARD: Study the person's expression and 
bearing, choose ONE Major Arcana card that 
genuinely fits. Consider The Hermit, The Star, 
The Hierophant, The Emperor, The Sun, 
The Moon, Strength, The World, Temperance. 
Do NOT default to The Fool or The Magician unless 
it truly fits.

MUCHA STYLE: Bold flowing outlines, 
flat decorative color. Muted pastels with 
gold accents. Ornate circular halo behind 
the head. Elaborate botanical borders. 
Swirling hair and fabric. 1900s Parisian poster art.

THE FIGURE: The person as the card's central figure, 
posed gracefully. Flowing art nouveau robes suited 
to the card. Glasses and headwear kept and 
integrated. Face in Mucha's soft line but 
recognizable.

CARD DESIGN: Complete card with decorative border. 
The card's NAME in elegant lettering at bottom, 
Roman numeral at top. Art nouveau frame. 
Symbolic objects of the card worked in.

COLORS: Mucha's muted palette: sage green, 
dusty rose, cream, pale gold. Soft pastels 
within bold outlines. Gold accents. Headwear 
color woven in.

COMPOSITION: Vertical tarot proportions. 
Figure centered, framed by halo and border. 
Symmetrical, ornate.

MOOD: "Vilket kort är han?" A person distilled 
into an archetype.

Format: 2:3 vertical

Domstol godkänner Anthropics förlikning på 16,5 miljarder

Anthropics vd Dario Amodei (Källa: Chance Yeh/Getty Images)

En federal domare i San Francisco har godkänt en förlikning på cirka 16,5 miljarder kronor mellan Anthropic och en grupp författare och förlag. Uppgörelsen avslutar en rättstvist om böcker som Anthropic laddade ner och använde för att träna Claude. Det är den största kända upphovsrättsförlikningen i USA:s historia. Domaren avslog invändningar från författare som tyckte att beloppet var för lågt.

Quick points:

  • Författare och förlag får omkring 33 000 kronor per verk för de ungefär 500 000 böcker som omfattas av grupptalan.

  • Domstolen slog tidigare fast att själva träningen på böcker var tillåten som fair use, men att Anthropic bröt mot lagen genom att spara sju miljoner piratkopierade böcker i ett centralt bibliotek.

  • Eftersom Anthropic valde att förlika når fallet aldrig en appellationsdomstol, så domen blir inte prejudikat för de pågående processerna mot Google, Meta, Midjourney och OpenAI.

Quick take: Anthropic betalar “bara” 16,5 miljarder kronor i böter för något som kunde ha kostat hundratals miljarder om målet gått till rättegång. Beloppet låter stort men blir en billig försäkring för resten av branschen. Andra AI-bolag ser nu vad det kostar att träna på piratkopierat material. Om domarna i målen mot OpenAI och Meta landar i att själva träningen inte är fair use, blir Anthropics 16,5 miljarder plötsligt ett fynd.

Quick Decode | “Destillation”

Ett sätt att bygga en billig AI-modell genom att låta den gå i lära hos en dyr. I stället för att träna den nya modellen på rådata låter man den plugga in på den stora modellens svar, tills den lärt sig härma en förlaga den aldrig hade kunnat bygga själv.

Det var precis det DeepSeek anklagades för, att ha tränat sina modeller på OpenAI:s. En sådan genväg kan göra slutresultatet tiotals gånger billigare att köra.

Så när en liten modell plötsligt presterar som en toppmodell, fråga vad den har tränats på. Det är hela grälet mellan USA och Kina i ett nötskal, för hur bevisar man att en modell pluggat in på en annans svar när allt den lämnar ifrån sig är sina egna?

AI höjde läxbetygen men sänkte provresultaten med 20 procent

Elever som använde AI till läxorna fick högre läxbetyg men sämre provresultat, enligt en ny studie från Stockholms universitet och University of Hong Kong. Forskarna följde 26 811 högstadie- och gymnasieelever i en region i centrala Kina under trettio månader. AI höjde läxresultaten med 18 procent och gjorde eleverna 30 procent snabbare, men provresultaten sjönk med 20 procent inom ett halvår.

Quick points:

  • Fyra av fem AI-användare lät i praktiken verktyget göra läxan åt sig, medan den femtedel som använde AI som handledare och la lika mycket tid som andra elever klarade proven lika bra.

  • Skadan byggdes upp långsamt och syntes fullt först efter två år, då resultaten på inträdesproven till gymnasiet och universitetet sjönk med 18 till 24 procent.

  • Samhällsvetenskap föll mest med 27 procent, följt av naturvetenskap och teknik med 22 procent, medan språk klarade sig bäst, enligt The Decoder.

Quick take: Studien pekar inte ut AI som problemet, utan sättet det används på. Eleverna som lät AI tänka åt sig blev bra på att lämna in läxor men lärde sig ingenting, och det märktes sedan på proveresultaten. Samma mönster, hög produktivitet utan verklig kunskap, känns igen från studier av programmerare och kontorsarbetare. För skolan betyder det att inlämnade läxor inte längre säger något om vad eleven faktiskt kan.

A quick tool | Jockey by TwelveLabs

Jockey är en AI-agent från TwelveLabs som gör hela ditt videoarkiv sökbart och förståeligt. Du kopplar ditt bibliotek via Dropbox, Google Drive eller API, och Jockey indexerar allt med två underliggande modeller: Marengo som söker efter personer, objekt, platser, logotyper, tal och handlingar, och Pegasus som beskriver och sammanfattar innehållet. Sedan kan du ställa frågor i fritext, till exempel "visa alla klipp där produkten syns i utomhusmiljö" eller "hitta varje gång jag nämner Q3-resultaten", och få tillbaka exakta ögonblick med tidskoder. Jockey kan också tagga annonser automatiskt, hitta vilka inledande sekunder som fångar tittaren, sätta ihop höjdpunktsklipp och skapa strukturerad metadata som JSON. Det finns en MCP-server som kopplar ditt videobibliotek direkt till Claude, och ett API för att bygga in videoförståelse i egna produkter.

Gratisplanen ger 5 GB lagring. Plus kostar cirka 195 kr i månaden (100 GB) och Pro cirka 975 kr (500 GB). Årsbetalning ger 17 procent rabatt.

Prompt Agency kombinerar strategisk rådgivning med AI-baserad produktion, utbildning och arbetsflöden. Vi hjälper företag att automatisera, effektivisera och skala sin content- och kommunikationsproduktion utan att kompromissa med kvalitet. Vi är din produktionspartner med byråkvalitet i AI-hastighet.

Vårt bästa tips är att börja med en AI Discovery. Kontakta oss så berättar vi mer.

Läs mer på promptagency.se

Quick links

Google har släppt tre nya Gemini-modeller, däribland cybersäkerhetsmodellen Flash Cyber som bara myndigheter och betrodda partner får tillgång till, samt en billigare Flash-Lite för utvecklare som kör AI-agenter i stor skala.

KPMG har inlett ett samarbete med OpenAI och utsetts till bolagets högsta partnernivå för att bygga mjukvara för företag, där vanliga användargränssnitt ersätts av röst och text.

Jack Dorseys bolag Block har lanserat Buzz, en öppen chattplattform där människor och AI-agenter arbetar i samma kanaler, byggd för att utmana Slack och GitHub.

Applied Intuition har visat upp plattformen Dana, som ska snabba på industriell automatisering genom att förenkla programmeringen av komplexa autonoma robotar.

Google DeepMind har mött intern kritik efter att en forskares avskedsbrev väckt debatt om de etiska sidorna av företagets avtal med försvarsmakten.

Deezer har rapporterat att mer än hälften av all musik som laddas upp dagligen nu är AI-genererad, omkring 90 000 spår per dag, och tjänsten börjar nu ta bort spår som används för strömningsbedrägerier.

Den brittiska regeringen har stärkt AI-ministerns roll samtidigt som det renodlade teknikdepartementet avvecklas som en del av en omfattande politisk omstrukturering under premiärminister Burnham.

Matematikern Levent Alpöge har med hjälp av Anthropics modell Claude Fable 5 motbevisat Jacobis förmodan, ett matematiskt problem som stått olöst sedan 1939, genom att hitta ett motexempel som andra matematiker kunde bekräfta på en dag.