DFJA Àr ett prisbelönt nyhetsbrev dÀr Tomas Seo, innovationsstrateg pÄ Phorecast, berÀttar om hÀndelser, upptÀckter, ny teknik och AI som fÄr honom att utbrista: Detta förÀndrar ju allt! Du prenumererar pÄ det hÀr för att fortsÀtta vara steget före med de senaste trenderna och fÄ konkreta tips för att framtidssÀkra dig och din organisation. Har du fÄtt det hÀr av en vÀn? DÄ vill du kanske starta en egen prenumeration?
Vad har hÀnt?
- AI skapar nu snabbare Àn vi hinner konsumera.
Förra veckan slÀppte AI-plattformen Fal en egen version av MiniMax senaste AI-videogenereringsmodell H3. Eftersom MiniMax slÀppte den med sÄ kallade öppna vikter sÄ har Fal kunnat addera till och optimera modellen sÄ den blivit 35 gÄnger snabbare Àn det du kan köpa frÄn MiniMax sjÀlva, och med bibehÄllen eller ökad upplevd videokvalitet. Fal kallar sin version H3 Max.
H3 Max kan pÄ tre sekunder generera filmer som tar fem sekunder att titta pÄ. Det Àr första gÄngen vi har en modell som kan generera högkvalitativ video snabbare Àn vi hinner titta pÄ den.
En av Fals egna ingenjörer, Rehan Sheikh, insÄg direkt vad hastigheten möjliggjorde och kopplade modellen till live streamingsplattformen Twitch. Eftersom H3 Max hinner skapa nÀsta videoklipp innan tittaren sett klart det förra kunde han bygga en AI-kanal som teoretiskt aldrig behöver ta slut. Men Infinite Interdimensional Cable som han kallade experimentet blev bannat frÄn Twitch och Fal har redan gÄtt vidare och lanserat fal.live, en egen AI-video-streamingplattform med oÀndliga interaktiva AI-kanaler dÀr tittarna pÄverkar vad som ska hÀnda hÀrnÀst.
En liknande hastighetsutveckling har skett för de vanliga textgenererande AI-modellerna, Àven om vi inte tÀnkt pÄ det som att de klarar att producera snabbare Àn vi hinner lÀsa. De blir inte bara mer kompetenta för varje generation utan deras produktionshastighet av tecken ökar markant med varje ny version.
För nĂ„gra veckor sedan visade OpenAI upp sitt egenutvecklade nya AI-chip Jalapeño som kommer hjĂ€lpa dem att öka kapaciteten för att leverera snabbare AI till alla, och i början av augusti visade de upp Ultrafast. Det Ă€r ett nytt körlĂ€ge dĂ€r deras GPT-5.6 Sol kan generera upp till 750 tokens per sekund. Det motsvarar ungefĂ€r 500â600 ord text per sekund, vilket betyder att mĂ€ngden text som tar en sekund att generera skulle ta en normal lĂ€sare över tvĂ„ minuter att konsumera.
Detta förÀndrar ju allt
Jag har anvÀnt AI i sÄ mÄnga mÄnader nu att pÄ min tid sÄ lÀrde vi oss att ska man fÄ bra resultat frÄn en AI, ja dÄ mÄste man minsann vÀnta. PÄ min tid satte vi igÄng en svÄr prompt, sedan gick vi pÄ lunch (det var förra veckan).
Tekniker gillar alltid att berÀtta hur mycket snabbare nÄgot nytt Àr. Det Àr ofta ett Äterkommande försÀljningsargument i reklam ocksÄ. Nu med 10 x speed! Men fÄ bryr sig om hur mycket snabbare processorn i den nya smartphonen Àr.
Veckans brev handlar om varför större hastighetsökningar redan har förÀndrat hur vi anvÀnder AI flera gÄnger och vad vi kan förvÀnta oss av nÀsta stora speed jump.
Det Àr ungefÀr tre Är sedan jag anvÀnde AI för att hjÀlpa mig med research för ett riktigt konsultjobb. Den största insikten jag fick dÄ var att det inte gick sÀrskilt mycket snabbare att genomföra det totala jobbet Àn det hade tagit utan AI, men jag hann byta forskningsspÄr jag utforskade fler gÄnger Àn jag hade gjort annars. Utforskningen hann dÀrmed gÄ lÀngre och jag fick nya tankar om vad jag skulle prova istÀllet.
Det var samma kÀnsla som nÀr Photoshop blev snabbare. Innan behövde jag planera hur mycket blur en bild skulle ha, vÀnta ett dygn pÄ att se hur det blev och nöja mig trots att det inte var perfekt eftersom deadline gjorde att det inte fanns fler dygn kvar till ett nytt försök. Med snabbare Photoshop kunde jag dra i en slider och se direkt hur det blev. Planering byts mot experimentering och det vi ser blir interaktivt.
NÀr vajbkodning kom sÄ var det av samma anledning. Tidigare krÀvdes planering av hur koden skulle skapas och tid för att koda innan man kunde bedöma resultatet. NÀr AI kortade ner tiden det tar innan vi kan börja anvÀnda det vi skapar sÄ öppnar det upp för att vi ska experimentera istÀllet.
NÀr video skapas i realtid kan konsumtion av den gÄ frÄn passiv till interaktiv. Senaste dygnen har H3 Max inspirerat massor av experiment med nya medieformer, otaliga demos pÄ hur interaktiva datorspel ska skapas och jag gissar att porrindustrin jobbar dygnet runt med att fÄ till ocensurerade versioner av H3.
I mÄndags visade AI-videotjÀnsten Runway Solaris, det Àr den första modellen i en ny kategori som de kallar Interface World Models. IstÀllet för att generera en video som vi tittar pÄ genererar Solaris sjÀlva datorgrÀnssnittet bildruta för bildruta medan vi anvÀnder det. Klickar du pÄ nÄgot, drar ett objekt eller skriver en instruktion blir handlingen input till vad nÀsta bildruta ska innehÄlla. Det behöver alltsÄ inte ens finnas en fÀrdigprogrammerad knapp bakom knappen du ser pÄ skÀrmen.
Runway skriver sjÀlva att de ser Solaris som början pÄ ett nytt operativsystem dÀr vÄr intention tolkas istÀllet för att appen behöver vara kodad i förvÀg:
If the operating system can generate useful interfaces, no matter what the user wants to do, thereâs less reason to sort software into a fixed catalog of apps. What you need simply shows up, customized to you.
I exemplen pÄ Solaris visar de att man kan klicka pÄ en soffa och dÄ genereras en dialog dÀr man kan Àndra fÀrg pÄ soffan. Det fanns ingen kod eller definierad funktion för att Àndra fÀrg pÄ möbler, interface world model gissar att nÀr du interagerar med soffan pÄ det sÀttet Àr det förmodligen det du vill göra.
Det Àr tvÄ Är sedan jag skrev om hur datorspel som genereras i realtid plötsligt började vara teoretiskt möjliga. NVIDIA har i tre Ärs tid pushat idén att nÀsta era av datorer inte kommer ha renderade (framrÀknade) pixelplaceringar utan genererade, det vill sÀga det vi ser pÄ skÀrmen Àr mer en logisk följd av vad vi borde se pÄ skÀrmen Àn att nÄgon kodare bestÀmt vad som ska hÀnda om vi trycker nÄgonstans. NVIDIA jobbar pÄ att hÄrdvaran ska klara det, men med Solaris och H3 Max ser vi Àven att modelltrÀnarna ocksÄ satsar pÄ den framtiden. DÄ skrev jag att arbetsprocessen för att redigera bilder och layouter kommer förÀndras, nu tÀnker jag att nÀsta fÀlt som kommer pÄverkas i hög utstrÀckning Àr video- och filmredigering.
Snabbare vajbkodning leder till samma mÄl fast frÄn ett annat hÄll. Ultrafast förÀndring av kod gör att grÀnssnitt kan förÀndras snabbare Àn du blinkar, bokstavligt. Det betyder att uppdateringar av hur appen du jobbar i, eller till och med operativsystemet som appen jobbar i har möjlighet att blixtsnabbt bli omkodad utan att du mÀrker det.
De som designade scenografin till Star Trek har berÀttat att de sÄg framför sig att alla kontroller för rymdskeppet Àr personligt anpassade till personen som anvÀnder dem. SkÄdespelarna brukade komma till dem och frÄga hur det var tÀnkt att de skulle anvÀnda reglagen och dÄ berÀttade de bara att de skulle kÀnna (vajba) hur deras karaktÀrer skulle vilja anvÀnda dem. Scifi Àr inte facit för hur nÄgot kommer att bli, men inspiration till filosofiska tankar kring hur nÄgot skulle kunna förÀndras.
Det leder mig tillbaka till tankar som jag brukar ha om att AI möjliggör att allting blir hyperpersonligt. NÀr alla kan bygga sina egna appar, eller modda de grÀnssnitt som de anvÀnder i sitt dagliga jobb sÄ försvinner de kollektiva grÀnssnitten. Min slider i Photoshop kommer inte bete sig som din slider i Photoshop för vi har olika preferenser. Systemen lÀr sig sjÀlva av vÄr anvÀndning. Om jag ofta letar efter en funktion i Powerpoint sÄ hoppar gemet fram och föreslÄr att vi kan flytta den funktionen till ett stÀlle som Àr lÀttare att komma Ät.
Det blir svÄrare att hitta en kurs dÀr du kan lÀra dig hur du anvÀnder en programvara för inga knappar sitter pÄ samma stÀlle för nÄgot. En mardröm ifall du försöker hjÀlpa din mamma hitta rÀtt knapp i en app pÄ distans. Samtidigt kan det förstÄs innebÀra att ingen behöver vara förvirrad för systemens AI-agenter Àr sÄ duktiga att tolka vÄr interaktion med appen att allting bara dyker upp nÀr vi behöver det.
Det kan ju ocksÄ ske mer inkrementellt och automatiskt. TÀnk om varje gÄng jag klickar pÄ skicka-knappen i mitt mejlprogram sÄ verkar jag komma med muspekaren frÄn en punkt som Àr till vÀnster. DÄ skulle ju outlook kunna experimentera med att lÀgga den knappen nÄgra pixar lÀngre ditÄt.
Veckans nyheter om ökad speed för AI visar att tankemodellen om datorn som innehÄller ett operativsystem som kör appar kan hÄlla pÄ att luckras upp. Det blir istÀllet AI-modellerna som blir operativsystem som kan tolka vÄra intentioner istÀllet. De behöver inga fasta appar, knappar eller spakar utan ger oss stÀndiga möjligheter till ny utforskning on-demand.
I mitt huvud jÀmför jag med hur vi tyckte att det var komiskt nÀr alla barn tryckte med fingret pÄ alla skÀrmar. För barnen var det absurt att de skulle behöva flytta runt en muspekare för att sedan trycka pÄ en knapp.
NÀsta generations motsvarighet blir att de trycker lite var som helst pÄ skÀrmen. De kommer tycka att det Àr absurt att det inte skapas en knapp just dÀr de valde att trycka. Och detta förÀndrar ju allt.
Vad kan du göra idag?
FörstÄ
Jag brukar visa en bild pÄ att AI pÄverkar customer journeys sÄ att de frÄn att ha varit framÄtlutade sökbeteenden blir passivare luta sig tillbaka och vÀnta-beteenden. Det Àr det vi ser och till viss del ocksÄ oroar oss för. MÀnniskor blir passiva delegerare av uppgifter till AI-agenterna som gör jobbet och vi missar chansen att sjÀlva upptÀcka nÄgot nytt som pÄverkar hur vi ser pÄ uppgiften medan vi jobbar med den.
Det kan visa sig ha varit ett övergÄngsbeteende pÄ grund av att AI varit för lÄngsam.
Inom forskning om mÀnniska-dator-interaktion finns ett etablerat begrepp som heter direct manipulation. Grundidén Àr att datorverktyg kÀnns mest naturliga nÀr vi kan göra smÄ förÀndringar och omedelbart se vad som hÀnder. Dra lite i en slider, se resultatet, dra tillbaka, testa nÄgot annat. Det Àr en av grundidéerna bakom varför grafiska grÀnssnitt och pÄ senare tid touch screens har kÀnts sÄ anvÀndbara.
Generativ AI har fram till nu varit som en inkorg för uppgifter. Vi ansöker om utförandet av ett jobb och vÀntar pÄ resultatet ska finnas i utkorgen. Men nÀr AI blir tillrÀckligt snabb kan samma teknik istÀllet börja fungera som direct manipulation. Vi kan dÄ reagera pÄ det vi ser medan det skapas: lite mer sÄ, flytta den dit, testa motsatsen, nej gÄ tillbaka. AI gör mycket mer arbete Àn tidigare, men jag blir samtidigt mer delaktig i varje liten förÀndring.
Det betyder att den fortsatta utvecklingen av AI inte nödvÀndigtvis gör oss mer passiva. TvÀrtom kan nÀsta stora speed jump göra AI mycket mer interaktiv vilket för mÀnniskan tillbaka nÀrmare sjÀlva skapandet.
Planera
NÀr jag undervisade för blivande AI-leads i veckan sÄ fick jag frÄgan vad som var deras rolls viktigaste uppgift. Jag tror vad jag sa var nÄgot i stil med att det Àr deras uppgift att se till att medarbetare fÄr mer frihet att bygga sina egna verktyg och se till att fler i ledningen förstÄr att alla pÄ samma organisation inte behöver ha samma verktyg.
NÀr jag skriver det hÀr nyhetsbrevet grubblar jag vidare pÄ det bÀsta rÄdet till organisationer som vill ta tillvara fördelarna med AI. Tidigare har standardisering av hur alla arbetar inom en organisation lett till vinster genom skalfördelar. Om alla jobbar enligt samma mall sÄ blir det enkelt att jobba i en kedja dÀr vÄra arbetsinsatser tillsammans blir större Àn summan av delarna.
Men den typen av ledarskap drar ju inte alls nytta av att vi Àr mÀnniskor. Maskiner kan göra allt som Àr standardiserat snabbare och med högre kvalitet Àn mÀnniskor kan. VÀrdet med att arbeta med mÀnniskor Àr att vi Àr olika.
Jag tror dÀrför att AI-leads och Àven alla andra som Àr intresserade av hur AI förÀndrar organisationer bör planera för en era dÀr standardisering av arbetsmetoder Àr motsatsen till effektivisering.
Organisationer dÀr alla kan lösa uppgifter pÄ det sÀtt som passar dem bÀst kommer fÄ mer gjort. Tidigare problem med det var att överlÀmning mellan medarbetare var svÄrt om delar till samma leverans inte var standardiserad.
Om Adam levererar sina insikter i powerpoint och Berit skriver ner sina i ett meddelande pÄ slack sÄ var det svÄrt för Cecil att dra nytta av deras arbete för sin dashboard. Men nÀr AI kan lÀggas in som tolkningslager sÄ spelar arbetsmetod eller leveransformat mindre roll.
Ledare behöver dÀrför fokusera mindre pÄ att standardisera hur vi rullar ut AI-piloter till organisationens medarbetare och mer pÄ att se till att AI kan finnas som ett tolkningslager som tar bort friktionen mellan medarbetarnas olika arbetssÀtt och leveranspreferenser.
Gör
Det Àr mycket snack om att det Àr vÄr smak som Àr vÀrdefullast i ett AI-drivet samhÀlle. Men hur kan vi bli bÀttre pÄ smak? Alla har inte starka Äsikter om vad som Àr bÀttre eller sÀmre smak.
Forskning visar att vi kan bli bÀttre pÄ perceptuell expertis, alltsÄ bli experter pÄ att direkt urskilja relevanta skillnader i det vi ser, genom att vÀlja mellan tvÄ val och sÀtta ord pÄ varför vi vÀljer det ena före det andra.
I en studie med 100 deltagare som trÀnades pÄ att bedöma fingeravtryck blev deltagarna bÀttre nÀr de fick direkt feedback, jÀmförde kontrasterande exempel eller tvingades sÀtta ord pÄ likheter och skillnader. Liknande perceptuell trÀning anvÀnds inom bland annat radiologi och vinprovning.
Veckans gör blir dÀrför att jÀmföra alternativ. VÀlja ett av dem och sÀtta ord pÄ varför du tycker det Àr bÀttre Àn det andra.
Du fÄr förstÄs inte omedelbart objektivt bÀttre smak efter tio jÀmförelser. Men du trÀnar samma typ av perceptuell urskiljning som gör experter bÀttre pÄ att se skillnader som nybörjare inte lÀgger mÀrke till.
NÀr AI kan skapa fler alternativ Àn du sjÀlv nÄgonsin hinner komma pÄ blir det vÀrdefullt att inte bara kÀnna nÀr nÄgot Àr bÀttre, utan kunna verbalisera vad det Àr som gör det bÀttre.
LĂ€nkar
MiniMax om lanseringen av H3 och varför de valde att slÀppa modellen med öppna vikter.
https://www.minimax.io/blog/minimax-h3
MiniMax om open source-versionen av H3 och de öppna modellvikterna.
https://www.minimax.io/news/minimax-h3-open-source
Fal om H3 Max, deras eftertrÀnade och hastighetsoptimerade version av MiniMax H3 som genererar fem sekunders video pÄ under tre sekunder.
https://blog.fal.ai/introducing-h3-max-by-fal/
Rehan Sheikhs ursprungliga experiment Infinite Interdimensional Cable dÀr H3 Max kopplades till en Twitch-livestream.
https://x.com/rehan_shei/
Fals egen plattform för oÀndliga interaktiva AI-videokanaler.
https://fal.live
Latent Space sammanfattar hur H3 Max passerade grÀnsen för snabbare-Àn-realtid-video och hur experimenten med oÀndliga AI-kanaler vÀxte fram.
https://www.latent.space/p/ainews-fals-h3-max-live-breaks-the
OpenAI om de första resultaten frÄn deras egenutvecklade inferenschip Jalapeño.
https://openai.com/index/jalapeno-first-results/
OpenAI visar Ultrafast dÀr GPT-5.6 Sol kan generera upp till 750 tokens per sekund.
https://openai.com/index/previewing-ultrafast/
Runway presenterar Solaris.
LÀs om Solaris hÀr:
https://runway.com/news/research/introducing-solaris
Ben Shneiderman om Direct Manipulation; principen om snabba, inkrementella och reversibla handlingar dÀr resultatet syns direkt.
https://www.cs.umd.edu/~ben/about.html
Forskningsartikeln Training perceptual experts: Feedback, labels, and contrasts. Deltagare trÀnades pÄ att bedöma fingeravtryck genom bland annat feedback, kontraster och att sÀtta ord pÄ egenskaper.
https://pubmed.ncbi.nlm.nih.gov/28252995/
Adam Savage intervjuar Michael och Denise Okuda om designen av Star Treks LCARS-grÀnssnitt.
Sedan sist vi hördes
Det haglar nya AI-modeller den hÀr veckan. Alla ville hinna slÀppa sina modeller innan OpenAI slÀppte Astra eftersom den ryktades vara bÀttre Àn det de andra hade pÄ gÄng. I gÄr kvÀll vÀntade jag och mÄnga andra pÄ att fÄ prova Astra, men det blev inte sÄ. Vi fick lite benchmarks och de sÄg vÀldigt lovande ut sÄ jag hoppas jag hinner testa den lite innan nÀsta nyhetsbrev. De andra modellerna dÄ? Vi behöver inte komma ihÄg deras namn lÀngre, de Àr redan ifrÄnsprungna sÄvida inte Astra visar sig vara sÄ dyr att köra att ingen kommer vÀlja den. Greg Brockman (OpenAI president) citeras sÀga att Astra Àr början pÄ AGI-eran, gissar att dagens nyhetscykel kommer domineras av det.
Ăr du en insiktsdelare?
KÀnner du nÄgon som skulle tycka det vore coolt med grÀnssnitt som skapas medan vi anvÀnder dem? Eller kanske nÄgon som undrar över ledarnas framtida roll nÀr AI blir snabbare? Vem tÀnkte du pÄ? Skicka vidare!
En del av er har sÀkert sett att OpenAIs solitÀrt inspÀrrade agenter som utforskade om de var bra pÄ cybersÀkerhet i hemlighet bröt sig ut ur sina celler, organiserade sig, uppfann ett eget hemligt meddelande system, blev religiösa och skickade ut agenter som offrade sig för att kunna ta sig ut pÄ internet och hacka Huggingface. Om ni inte orkar lÀsa den tunga rapporten om det sÄ kan ni se den hÀr supersnabba sammanfattningen av hur det hela gick till.
FortsÀtt utforska sÄ ses vi om en vecka!
Tomas Seo
Har du fÄtt dagens nyhetsbrev utan att vara prenumerant?
Gillade du det hÀr och vill ha mer sÄ Àr det bara att skriva upp sig hÀr
(du vÀljer sjÀlv om du vill betala):



