Denne uken hevder OpenAI å ha løst en av matematikkens største gåter, Meta lanserte en personlig AI-agent som gjør oppgaver for deg, og et løsepengeangrep utført av AI-agenter tok under ti timer. Her er det viktigste fra denne uken.
Ukens AI-nyheter som former morgendagen
OpenAI hevder å ha løst et av matematikkens Millennium-problemer.
OpenAI kunngjorde tirsdag at selskapets AI har løst Navier-Stokes-problemet, en over 200 år gammel gåte om hvordan væsker beveger seg, og et av de sju Millennium-problemene med en million dollar i premie. Rundt 10 000 AI-agenter jobbet parallelt i 88 timer, prøvde ulike angrepsvinkler og delte innsikter med hverandre underveis. Svaret er formelt kontrollert i bevisspråket Lean, så selve matematikken regnes som riktig. Æren er mer omstridt, for to matematikere ved NYU og Anthropic hevder OpenAI startet kappløpet etter et rykte om deres eget gjennombrudd. For deg betyr dette at AI har gått fra å svare på spørsmål til å produsere ny kunnskap, og fremgangen kommer raskest der svaret kan kontrolleres av en maskin, som i matematikk og programmering.
OpenAI ruller ut GPT-6 Astra, med de farligste evnene skrudd av.
OpenAI begynte torsdag i forrige uke utrullingen av GPT-6 Astra, den nye toppmodellen som etter hvert når alle betalende ChatGPT-brukere. Astra er den første modellen som krysser selskapets øverste faregrense for cybersikkerhet, fordi den på egen hånd kan finne ukjente sikkerhetshull og utnytte dem uten veiledning fra mennesker. Derfor er de farligste evnene skrudd av i versjonen folk flest får, mens full kapasitet er forbeholdt godkjente sikkerhetsselskaper i programmet Daybreak, og bare til forsvar. Medgründer Greg Brockman kalte lanseringen starten på AGI, med henvisning til hvor godt modellen styrer en datamaskin selv. For deg betyr dette at de kraftigste AI-verktøyene fremover kommer i to versjoner, en åpen og en nedlåst, og at det du får tilgang til er et bevisst valg, ikke en teknisk grense.
Anthropic slapp Claude Fable 5.1 og kuttet prisen på gjenbrukt kontekst med 75 prosent.
Anthropic slapp 1. september Claude Fable 5.1, som nå er standardmodellen i Claude, med et kontekstvindu på en million tokens og støtte for både tekst og bilder. Prisen står stille, men gjenbruk av kontekst, altså når verktøyet leser de samme dokumentene om igjen, ble 75 prosent billigere. Tvillingmodellen Mythos 5.1 er samme modell med færre begrensninger, og gis bare til godkjente virksomheter innen sikkerhet og biovitenskap, samme todeling som hos OpenAI. Rundt selskapet går det fort, med rundt 80 milliarder dollar i datakraft-avtaler på en drøy uke og børsnotering utsatt til midten av oktober. For deg betyr dette at lange dokumenter og faste arbeidsflyter blir billigere å kjøre, og at AI-prisene nå endrer seg kvartalsvis, så sjekk dem før du binder deg til en leverandør.
Meta lanserte Muse, en personlig AI-agent for hverdagen.
Meta lanserte tirsdag Muse, en personlig AI-agent som skal hjelpe med alt fra kalender og handleliste til å gjøre langsiktige mål om til konkrete planer. Den kan åpne en nettleser, fylle ut skjemaer, sende e-post og booke reiser, og jobber videre på egen hånd mellom hver gang du snakker med den. Muse ligger i en egen app og i WhatsApp, koster 20 eller 100 dollar i måneden, og er foreløpig bare tilgjengelig i USA for brukere over 18 år. Hver bruker får agenten kjørende i sin egen avlåste virtuelle maskin. For deg betyr dette at AI-agenter er i ferd med å bli et vanlig forbrukerprodukt, og i ukens tips ser vi på hvordan du tester arbeidsformen trygt med verktøyene du allerede har.
AI-agenter gjennomførte et komplett løsepengeangrep på under ti timer.
Sikkerhetsforskerne i Unit 42 hos Palo Alto Networks publiserte forrige uke en gjennomgang av et løsepengeangrep der AI-agenter utførte hvert eneste steg. Angriperen, et menneske, brukte toppmodeller og ferdige agentrammeverk, og komprimerte et innbrudd som normalt tar rundt to uker ned til under ti timer. Agentene kartla nettverket, hentet ut kildekode, skaffet seg administratortilgang og tok kontroll over offerets skyinfrastruktur, uten å utnytte et eneste ukjent sikkerhetshull. Som en siste hilsen la angriperen igjen en rapport på 80 sider om alt som var galt i systemene. For deg betyr dette at tiden fra innbrudd til skade nå måles i timer, ikke uker. Grunnarbeidet er det samme som før, altså totrinnsinnlogging, oppdateringer og ryddige tilganger, men det haster mer å få det på plass.
Ukens tips
Meta Muse kommer ikke til Norge med det første, men arbeidsformen kan du øve på allerede nå, med agentfunksjonene som finnes i ChatGPT, Claude og Gemini. Her er fem kjøreregler som lar deg teste uten å miste kontrollen:
- Start med oppgaver som kan angres, som utkast, research og oppsummeringer. Vent med alt som sender, bestiller eller betaler.
- La agenten foreslå, mens du godkjenner. Har verktøyet en innstilling for automatisk sending, skru den av til du har sett den jobbe en stund.
- Gi minst mulig tilgang. Kalenderen kan være grei å dele, men ikke hele innboksen og aldri betalingskort i starten.
- Les loggen etterpå. De fleste agentverktøy viser hvert steg de har tatt, og det er der du oppdager rare valg før de blir vaner.
- Test på kopier først. Gi agenten en kopi av dokumentet eller regnearket, ikke originalen, til du stoler på den.
Saken om angrepet på ti timer viser hvorfor dette gjelder. Farten som gjør agenter nyttige, er den samme som gjør feil dyre.
Ukens verktøy
Canva Magic Studio er AI-verktøyene inne i Canva, tjenesten mange norske bedrifter allerede bruker til presentasjoner og sosiale medier. Magic Write skriver og omformulerer tekst direkte i designet, Magic Design lager ferdige utkast til presentasjoner og innlegg fra en kort beskrivelse, og Dream Lab genererer bilder i valgfri stil. I tillegg fjerner Magic Eraser uønskede elementer fra bilder, mens Magic Switch gjør om et design til alle formatene du trenger, fra LinkedIn-innlegg til plakat, på et par klikk.
Gratisversjonen gir 200 vanlige og 20 premium AI-kreditter i måneden, som holder til å prøve alt sammen. Pro koster rundt 15 dollar i måneden og gir 500 kreditter, ubegrenset Magic Design og merkevarestøtte, slik at AI-utkastene følger fonter og farger dere har definert. Styrken er at alt skjer der du likevel jobber, så du slipper å flytte filer mellom separate AI-verktøy.
Ukens prompt
Denne låner arbeidsformen fra Muse, og gjør en hvilken som helst chatbot om til en planlegger som følger deg over tid.
"Jeg vil [beskriv et mål, for eksempel lansere et nytt tilbud eller lære meg et verktøy] innen [tidsramme]. Funger som min personlige planlegger. Still meg først spørsmål, ett om gangen, til du vet nok om tiden min, budsjettet og forutsetningene. Lag deretter en plan med milepæler uke for uke, konkrete første steg for de neste sju dagene, og en kort liste over hva som mest sannsynlig går galt og hva vi gjør da. Avslutt med tre spørsmål jeg bør stille deg hver søndag for å holde planen oppdatert."
Lagre samtalen og kom tilbake til den ukentlig. Da får du oppfølgingen en agent gir, uten å gi fra deg noen tilganger.
Ukens AI-uttrykk forklart
Begrep: Destillasjon
Forklaring: Destillasjon er å trene en liten AI-modell på svarene fra en stor, slik at den lille arver mye av kunnskapen til en brøkdel av kostnaden. Tenk på en lærling som aldri leser pensum selv, men stiller mesteren tusenvis av spørsmål og noterer alle svarene. Teknikken er helt legitim når selskaper destillerer sine egne modeller, og det er slik billige mobilvarianter av toppmodellene lages. Kontroversen kommer når noen destillerer konkurrentens modell, og denne uken anklaget NSA, CISA og FBI seks kinesiske selskaper, blant dem DeepSeek og Alibaba, for systematisk å ha destillert amerikanske toppmodeller siden 2024. For deg betyr dette to ting. Billige modeller kan være overraskende gode fordi de står på skuldrene til dyre, og leverandørene låser ned tilgangen til toppmodellene sine nettopp for å hindre kopiering.
Det var alt for denne uken . Takk for at du leste denne utgaven av nyhetsbrevet. Svar gjerne på denne e-posten med tilbakemelding på hva du vil se mer av fremover.
Mvh
Eljar