RSS Amplifier

Peter Rosdahl · Nov 21, 2025

Den absolut bästa språkmodellen

0
Sign in to vote or save

Peter Rosdahl · Peter Rosdahl

👋 Hej alla 632 prenumeranter!

Idag tänkte jag skriva om det stundade kulturkriget mellan olika språkmodeller. det är väldigt många där ute som håller just sin modell eller plattform som mest kär. Väldigt många har också döpt sin favoriserade LLM. Min ChatGPT kallar jag för Chattis men många kallar sina för exempelvis Chatte eller Kajsa är namn jag har hört. Vad har du döpt din favoriserade LLM till?

Get a Mac var en kampanj som Apple körde mellan 2006 till 2009 när fler och fler började gå över till PC till Mac. Samma sak tycker jag man ser precis just nu men om språkmodeller. Det där tråkiga tonläget i diskussioner där folk försvarar sitt verktyg som om det vore en religiös uppfattning. “ChatGPT är så mycket fler och bättre funktioner!” mot “Men Claude skriver ju som en människa!” jämfört med “Grok har ju tillgång till all X-data!”. Och visst får man ha egna preferenser, men låt också andra ha sina favoriter. Jag uppmuntrar alla att testa sig fram och hitta rätt om möjligheten för det finns.

Det här tänkte jag skriva lite om idag. Lite förenklat och jag kommer ganska långt ifrån ta upp alla funktioner per plattform. Jag kommer inte ens nämna ord som connectors, MCPs, skills eller appar. Det här är bara en överblick.

Vi har varit här förut. Men då var det Mac vs PC. Man minns nästan de där laddade diskussionerna på kontor och i kommentarsfält där folk kunde bli personligt kränkta om någon föredrog det andra alternativet. Argumenten var lika laddade då som nu; prestanda kontra användarvänlighet, ekosystem kontra öppenhet, pris kontra kvalitet.

Nu håller samma debattmönster på att ta form kring språkmodeller. På sociala medier och i olika forum eller nyhetsbrev dyker det allt oftare upp passionerade försvar av olika språkmodeller, bildgenereringsverktyg och videomodeller, där användare inte bara diskuterar tekniska skillnader utan börjar identifiera sig med sina val av verktyg. Det är inte längre bara att man använder exempelvis Claude för en specifik uppgift utan snarare att man identifierar sig som en Claude-användare.

Det här är ju såklart inte helt oförståeligt. AI-verktygen blir allt mer integrerade i vårt arbete och våra dagliga rutiner. När något blir en så central del av hur vi lever, arbetar och skapar så börjar vi naturligt nog utveckla preferenser och lojaliteter. Precis som Mac-användare kunde försvara sitt val med att “det bara fungerar” så hör man nu Claude-användare säga att modellen förstår större kontext bättre eller Midjourney-användare påpeka att deras bilder har den där specifika estetiken.

Skillnaden mot Mac vs PC-debatten är dock att utvecklingstakten inom AI är exponentiellt snabbare. Där det tog flera år mellan större uppdateringar av operativsystem medan nya versioner av språkmodeller, bildmodeller och videomodeller lanseras i en helt annan takt. Claude 4.5 Sonnet släpptes i slutet av september, GPT-5.1 kom 12 november och Gemini 3 dök upp 19 novmeber. Modellerna uppdateras, förbättras och förändras så snabbt att det för väldigt många är omöjligt att hänga med om man inte följer det lika slaviskt som jag gör.

För bildgenerering ser vi samma mönster. Den ena veckan är Midjourney ohotad i sin förmåga att skapa visuellt tilltalande bilder med hjälp av stilreferensbibliotek. Veckan efter släpper Reve en uppdatering som ger bättre kontroll över redigeringen. Sedan kommer Nano Banana Pro och kör över alla. Och plötsligt dyker det upp ett nytt kinesiskt verktyg som gör något ingen annan klarar av. Och så här håller det på. Vecka efter vecka. Samma sak med videomodellerna.

Detta borde egentligen göra debatterna meningslösa. Varför engagera sig emotionellt i vilket verktyg som är “bäst” när rangordningen kan ändras inom några veckor? Men det verkar inte hindra folk från att välja sida.

Det har blivit ett kulturkrig kring vilken modell som är överlägsen, vilken bildgenerator som är mest autentisk, eller vilket videoverktyg som representerar framtiden bäst. Vi behöver inte fler debatter om vilket verktyg som vinner - vi behöver fokusera på att gå framåt. En dag är något bäst, sen körs det om av någon annan. Det är så här det fungerar nu, och det är så här det kommer fortsätta fungera.

Själv hoppar jag friskt mellan olika modeller och plattformar för att få fram de svar jag behöver. Ibland använder jag Perplexity för snabba faktakontroller, ibland Claude för längre skrivuppgifter, ibland Gemini när jag behöver färsk information men min vardags-go to-modell är ChatGPT som så många andras. För bilder kan det vara Midjourney ena dagen och Reve andra dagen och Nano Banana Pro precis just nu. Men det är helt beroende på vad jag ska skapa. Det är inte lojala val, det är praktiska val. Och framförallt testar jag modellerna kontinuerligt för att förstå vad de klarar av och var deras begränsningar finns.

Men det är lätt för mig som individ att hoppa mellan verktyg. När det kommer till att implementera dessa system i större organisationer ser verkligheten helt annorlunda ut. Då behöver man faktiskt bestämma sig för ett verktyg som passar just er organisation - och börja med det. Man kan inte ha tio olika AI-plattformar och förvänta sig att medarbetarna ska hitta rätt själva.

Det är däremot en helt annan sak att testa saker som privatperson eller egenföretagare som mig och implementera en modell i ett större företag. När man väljer verktyg för en större organisation handlar det inte bara om vilken modell som presterar bäst på benchmarks. Det handlar om tre avgörande faktorer: syfte, användarnas vana och förväntad output. Men det handlar också om något mer grundläggande - juridik, säkerhet och användarvänlighet.

Syfte är det mest grundläggande. Vad ska verktyget faktiskt göra? En marknadsavdelning som behöver producera korta, engagerande texter för sociala medier har andra behov än en juristfirma som ska sammanfatta långa avtal. En designstudio som tar fram konceptbilder arbetar ofta annorlunda än ett produktionsteam som behöver skapa videomaterial för kampanjer.

Användarnas vana är den faktor som ofta underskattas mest. Det spelar ingen roll hur tekniskt överlägsen en modell är om era medarbetare inte förstår hur de ska använda den. Om ditt team redan är vant vid att arbeta i ChatGPT och har byggt upp prompts, arbetsflöden och förståelse för hur verktyget fungerar, då är kostnaden för att byta till en “bättre” modell inte bara ekonomisk - det är också tid, frustration och produktivitetsförlust.

Förväntad output är den tredje faktorn. Olika modeller har olika styrkor när det gäller vad de producerar. Om er contentstrateg behöver strukturerade artikelutkast med tydliga avsnitt och god röd tråd, då kan det vara värt att använda en modell som är stark på det - även om en annan modell kanske är “smartare” enligt tekniska mått.

Men innan ni ens kommer till dessa överväganden måste ni säkerställa det som är absolut grundläggande: att verktyget ni väljer faktiskt får användas i er organisation. Det betyder att ni måste se till så att de exempelvis har rätt datahantering inom EU, att de följer GDPR och de ISO-standarder som gäller för er verksamhet och kanske till och med för er bransch. Det är ofta inte förhandlingsbart.

För många svenska och europeiska organisationer betyder det att vissa verktyg helt enkelt inte är ett alternativ, oavsett hur bra de är tekniskt. Om data processeras utanför EU utan rätt avtal på plats, om villkoren inte lever upp till GDPR:s krav på personuppgiftsbiträdesavtal (puh! långt ord), eller om leverantören inte kan visa upp rätt certifieringar - då spelar det ingen roll hur imponerande modellen är.

Det handlar ofta inte om att vara konservativ utan det handlar om att kunna sova gott om natten och veta att ni inte äventyrar känslig information eller bryter mot lagar.

Sen måste det också vara tillräckligt enkelt att komma igång. Det spelar ingen roll hur kraftfullt ett verktyg är om det tar sex månader att implementera och kräver dedikerade tekniska resurser för att sättas upp. Den interna adaptionen och viljan måste finnas där från början. Om medarbetarna upplever verktyget som komplicerat, klumpigt eller svårt att förstå så kommer det inte att användas oavsett hur mycket organisationens ledning pushar för det.

Det är därför användarvänligheten ofta är viktigare än marginalskillnader i prestanda. Ett verktyg som medarbetarna faktiskt använder och får värde ur är bättre än det “bästa” verktyget som ingen orkar lära sig.

Ett praktiskt sätt att arbeta med detta är att använda olika modeller för olika syften inom samma organisation men bara när organisationen växt till sig och lärt sig grunderna först. Använd kanske Claude för kortare brainstormingsessioner där man känner sig bekväm med den outputen. Använd ChatGPT Projekt och delade chattar för att arbeta tillsammans där ni behöver bygga upp kunskapsbaser och arbeta iterativt med stora textmängder. Eller att använda Perplexity, Grok eller Gemini när man behöver färsk information kopplad till realtidsdata.

Poängen är att det inte finns ett “rätt svar”. Det finns bara rätt verktyg för rätt uppgift, vid rätt tidpunkt, för rätt team. Och det kan vara helt olika verktyg för olika delar av er organisation.

Så kan vi sluta debattera vilket verktyg som är “bäst” och istället fokusera på att bygga smarta arbetsflöden där vi använder styrkorna hos olika modeller? Kan vi acceptera att det som är bäst idag kommer vara nummer två imorgon, och att det inte spelar någon roll så länge vi får jobbet gjort?

En dag är något bäst, sen körs det om av någon annan. Det är verkligheten nu. Dags att sluta bråka om det och börja jobba med det istället.

  • OpenAI lanserar nu gruppchattar globalt efter ett kort test på ett fåtal markander. De lyfter också svenska Scania som ett case för hur de har implementerat ChatGPT Enterprise i organisationen.

  • Grok 4.1 lanseras och visar markant förbättrad emotionell intelligens, kreativ förmåga och lägre hallucinationsgrad än tidigare versioner av Grok, enligt xAI själva i alla fall.

  • Midjourney släpper Style Creator i beta vilket gör att man kan skapa stilreferenser baserat på andra srefs på ett enkelt sätt. De släppte också nyligen profilsidor så man kan ha sin egna profil på Midjourney. Kan det vara en väg att skapa mer social funktionalitet?

  • Google släppte Nano Banana Pro igår. Och oj vad bra det är för hantering av text, för att förstå ganska specifika prompter och kunna producera den typen av bild man faktiskt vill DEt kändes som att nivån höjdes ett snäpp till men ser ändå fram emot Flux 2 som enligt rykten släpps ganska snart. Redan nu kan man omöjligtvis se med blotta ögat vad som är verkligt och inte.

  • Google släppte också sin nya språkmodell Gemini 3 i förrgår. Där släppte de också en IDE som de kallar för Antigravity som är en direkt konkurrent till Cursor. Enligt mina första tester så är den betydligt bättre än andra modeller att designa och få fram en känsla av användbarhet, men det kanske bara är en känsla jag har. Måste testa Gemini 3 lite till känner jag.

  • Perplexity släpper sin webbläsare Comet till Android vilket är kul att se att vi snart med stor sannolikhet får ett par alternativ till Chrome och Safari som verkligen ägt mobilmarknaden senaste åren. På samma ämne så lanserade också OpenAI sin webbläsare Atlas stöd för vertikala flikar, något som jag älskade att Arc hade före de slutade utveckla den för att fokusera på Dia enbart.

  • Lovable har missat den pikanta detaljen att betala moms. Det är väldigt mycket snack om ARR och tillväxttakt men ganska lite om att det är en del avhopp bland anställda som jag ser lite här och där som bara varit där ett par månader. Det känns som att det skakar en hel del om man tittar utifrån men jag vet egentligen inte. Ser man på värderingen så kommer det uppgifter om att närma sig att passera 50 miljarder SEK vilket är strax under exempelvis Axfoods eller Getinges börsvärde.

PS. Om du byggt något eller testat något spännande AI-verktyg eller skapat en häftig automatisering eller gjort något kreativt med AI den här veckan, svara gärna och berätta! Jag är alltid nyfiken på vad ni pysslar med. 🎈

Ha det så fint så ses vi snart igen 👋

Du får gärna gilla, dela och kommentera! Svarar man på detta mailet så kommer det rakt till min inbox och mailrespons är alltid den finaste responsen 💌

Read the original on pr.substack.com

Comments

Nothing yet. Say the first thing.

    Sign in to join the conversation.