Kategorier
AI - Artificiell intelligens Spaningar

Digitala spaningar vecka 43 2024 – del 2

Spaningar inom tech och sociala medier från veckan som har gått.

Övriga delar i veckans sammanställning

 

AI – artificiell intelligens

ChatGPT:s avancerade röstläge släppt i Sverige (på riktigt den här gången?)

Plötsligt händer det!

Infoga kommentarer:

  • ”Jag har kört det via VPN sedan innan ChatGPT eller VPN fanns!”
  • ”Jag har har kört det UTAN VPN längreändukansägastjärnstopp!”
  • ”EU är dumma!”
  • ”Du använder ChatGPT:s avancerade röstläge FEL! Här är 936 sätt som du borde använda det!”

Synd bara att EU hann gå under eftersom vi (ja, eller jag) fick vänta i 22 dagar på att få funktionen.

Open AI kan lansera nästa stora språkmodell i december

Snart fyller ChatGPT två år och det tänker ägaren Open AI fira. Fira genom att släppa sin nästa stora språkmodell.

Enligt The Verge så är det då dags för Orion att se dagens ljus. Det ser däremot inte ut som att det kommer att trilla ut som ett nytt alternativ inuti ChatGPT. Istället så kommer några företag som Open AI ”arbetar nära med” att först få tillgång så att de därmed kan bygga sina egna produkter och tjänster baserat på Orion.

Det kan alltså vara GPT-5 vi pratar om. Men med tanke på att den senaste större uppdateringen från Open AI var o1, som ska vara bättre på att resonera sig fram till ett svar, inte var baserad på GPT, utan på en helt ny modell så är frågan alltså var någonstans i modellkartan som Orion hör hemma. Om det är en ny GPT eller en skarp o1 som ligger i botten.

Mot slutet av året vet vi kanske. Beroende på hur träffsäkra uppgifterna om en decemberlansering är.

OpenAI plans to release its next big AI model by December

Open AI avfärdar ryktet om att Open AI:s nästa språkmodell släpps i år

I veckan kom uppgifter, via The Verge, som pekar på att Open AI ska släppa ”GPT-5” i december. Ja, eller åtminstone nästa stora uppdatering av företagets språkmodell. Alla verkar däremot inte ge lika mycket för de här uppgifterna.

En av dem som sågar ryktet är… Open AI:s VD Sam Altman.

I en FKA tweet avfärdar Altman The Verges artikel med ”fake news out of control”. Vilket… känns såväl väldigt definitivt som väldigt vagt. Vi vet med andra ord vad det är som Altman underkänner. Att nästa generation får namnet ”Orion”? Att det inte är en GPT-5 utan något helt nytt? Att den kommer att släppas i december? Att kanske-Orion inte kommer att släppas via ChatGPT, utan till att börja med bara bli tillgänglig för några utvalda partnerföretag? Alltihop?

Altman gör oavsett precis som han gjorde när det började florera vilda rykten om GPT-4. Fast den här gången är han lite mer… kortfattad i sin 2024-tonalitetsformulering.

Sen kan det förstås också vara så att The Verges uppgifter är spot on på precis alla sätt och vis och Altman är sur över det (och har inlett intern Stasi-jakt för att hitta läckorna).

Och inte långt efter Altmans utspel så kom officiell kommunikation från Open AI: efterföljaren till GPT-4 kommer inte lanseras i år.

OpenAI CEO responds to report of GPT-5 Orion coming later this year: ‘Fake news out of control’

AI-boten Claude kan kontrollera din dator

För något halvår sedan presenterades ännu en sån där AI-pryl som vill ersätta mobilen: 01 Light (som då inte är samma sak som ChatGPT:s o1 – tur att AI-bolagens namngivningar inte är lagom förvirrande). Nu är det ChatGPT-utmanaren Claudes tur att göra något liknande.

01 Light bestod sedan av två delar: dels själva hårdvaruprylen som man kunde AI-prata med och dels en mjukvarudel som kunde kontrollera din dator. Bokstavligen. Tanken var att man visade 01 Light hur ett kommando skulle utföras genom att klicka sig igenom de nödvändiga stegen, som att öppna ett visst program och utföra något i det. AI:n skulle alltså handgripligen lära sig hur ett kommando skulle utföras genom att titta på skärmen när det utfördes.

När jag började skriva om den här nyheten så insåg jag att… jag inte har hört något om eller från 01 Light sedan produkten först presenterades. Så inte… världsherravälde än. Men det hindrar alltså inte Google- och Amazon-backade Anthropic från att ge sig in på samma område.

I Claude-fallet pratar vi dock inte om en hårdvarupryl, men väl att AI-boten har uppdaterats till version 3.5 och då lärt sig att kontrollera en dator. Det är mer specifikt en ny funktion i API:et (Computer Use) – än så länge i öppen beta – som gör att Claude kan lära sig att härma tangenttryckningar, knapptryckningar och musgester.

Precis som i fallet 01 Light så är tanken att man på detta sätt kan låta Claude utföra saker i program utanför Claudes egen lilla ”sandlåda”. Och till och med bygga in den här funktionaliteten i en mer eller mindre helt självgående AI-agent. Alltså en AI-lösning som är tänkt att själv kunna komma fram till hur den bäst löser en viss uppgift som den har fått, inklusive vilket program som bäst gör jobbet för det.

Det är också lite det här som Apple ha målat upp som tänkt användningsområde för en AI-smartare Siri som sannolikt kommer att lanseras i början av nästa år som del av Apples AI-plattform Apple Intelligence. Att Siri alltså ska kunna göra mer med och i appar.

Det återstår att se hur bra såväl Claude som Siri är på det här när de väl får det här stödet. Men för den som är sugen att börja Claude-leka så finns API:et nu alltså tillgängligt.

Anthropic’s new AI model can control your PC

Microsoft gör det möjligt att bygga autonoma Copilot-AI-agenter

Senaste initiativet från Microsoft i AI-racet: stöd för autonoma AI-agenter. Ja, eller mer specifikt: stöd för företag att bygga sina egna Copilot-agenter via Microsofts Copilot Studio.

AI-agenter är – eller är åtminstone tänkta att – vara nästa steg efter AI-assistenter som ChatGPT och de övriga liknande AI-tjänsterna som är vanliga idag. Till skillnad från assistenter, som i stort kräver mänsklig input för att sedan kunna utföra saker, så ska AI-agenter kunna ta sig an uppgifter helt på egen hand. Eller åtminstone nästan helt på egen hand.

Med andra ord: själv lista hur den ska lösa en uppgift. Som vilka verktyg som behöver användas. Ännu mer som hur en människa hanterar detta, alltså.

Microsoft kommer att börja rulla ut sin AI-byggarverkstad från och med november. Microsoft passar också på att släppa 10 nya ”färdiga” agenter inom ramen för affärssystemet/CRM-systemet Dynamics 365. Här pratar vi om agenter som kan ta sig an vanliga handgrepp inom försäljning, kundservice, finans och logistik.

Microsoft to roll out new autonomous AI agents next month, fending off challenge from Salesforce

X släpper API för sin AI-modell Grok

Dags för även FKA Twitter att bli med API för sin AI-satsning. Grok blir nu alltså åtkomligt för utvecklare som vill bygga på och mot tjänsten.

Som alltid när det kommer till X så är det inte helt klart exakt vad det är man får. API:et ska vara baserat på grok-beta, som är ett nytt namn i sällskapet av Grok-modeller. Det ser också ut som att xAI:s ChatGPT-utmanare ska ha stöd för bildfunktionalitet, så att den alltså kan tolka även bildinput. Däremot är den biten ännu inte live.

”Beta”-namnet i Grok-modellen gör att vi nog kan vara säkra på att API:et i stort har betastämpel. Det återstår att se när det släpps i en mer slutgiltig, skarp version.

xAI, Elon Musk’s AI startup, launches an API

Perplexity släpper Mac-app

Är du Perplexity-knarkare? Tycker du att den som har flesta AI-appar när den dör vinner? Grattis!

Nu är AI-söktjänsten Perplexity med andra ord senast ut med att släppa en officiell datorapp för sin tjänst. För den som kör Mac-åtminstone.

(Du som tvingas köra Windows av din arbetsgivare eller bara inte tycker om dig själv får däremot fortsätta använda Perplexity i webbläsaren ett tag till. Eller hitta något inofficiellt.)

Perplexity launches a native Mac app

Perplexity stäms av ännu fler företag för upphovsrättsbrott

I förra veckan skrev jag om hur New York Times har fått nog av att AI-söktjänsten tränar sina botar och modeller på tidningens innehåll utan lov eller ersättning. Nu får New York Times sällskap av Dow Jones och New York Post som alltså gör samma sak.

Det sätter åter fingret på en av de absolut största utmaning för AI-bolagen: att få tillgång till data för att träna sina massiva AI-modeller.

Så här långt har det i mångt och mycket handlat om att ta innehåll utan att betala för det – och sedan ta betalt för, i praktiken, samma innehåll av sina egna kunder. Men i takt med att innehållsföretag har insett det nya värdet på innehållet (som AI-träningsdata) så har allt fler börjat blocka AI-botar från sina sajter. Det har fått Open AI att börja shoppa rättigheter på löpande band (däremot inte med New York Times, som även har stämt just Open AI för det här).

Perplexity har varit i extra mycket i blåsväder på grund av två saker: dels att tjänsten har anklagats för att ignorera vad som står i den så kallade robots.txt-filen (där sajter kan ange bland annat om botar ska få tillgång till materialet) och dels att de också påstås ha jobbat in sina AI-botar bakom betalväggar och tränat på inlåst material.

Till skillnad från Open AI så har Perplexity, vad jag vet, inte betalat för AI-träningsinnehåll. De presenterade nyligen något slags ”annonsintäktsdelningsupplägg” med nyhetssajter, där de senare skulle få del av de intäkter som kan komma från annonser som visas i innehåll som syns tillsammans med en annons. Men ingen vet hur mycket pengar det kan handla om och det lär handla om småsmulor jämfört med de summor som Open AI ska ha lagt på att skaffa sig rättigheter till innehåll.

Nyhetssajterna vill helt enkelt ha bra mycket mer betalt för att dela med sig av sitt innehåll till AI-bolag som Perplexity. Och vissa har säkerligen ambitioner att skapa helt egna Perplexity-alternativ baserat på det egna innehållet.

Dow Jones and New York Post Sue AI Startup Perplexity, Alleging ‘Massive’ Copyright Infringement

Perplexity hanterar 100 miljoner sökningar varje vecka

AI-sökmotorn Perplexity fortsätter att bli allt mer populär som Google-alternativ. Nu har företaget gått ut med att det görs 100 miljoner sökningar i tjänsten varje vecka.

Det innebär runt 400 miljoner sökningar i månaden, vilket är en ökning från de 250 miljoner som Perplexity rapporterade i juli. Upp 60 %.

Precis som Open AI så har Perplexity alltså gått från att rapportera månadssiffror till att bryta ned dem på veckonivå. Vi vet med andra ord inte egentligen hur månadssiffran ser ut (med andra ord om det är snitt eller en kort tidsperiod som Perplexity har tittat på). 

Det är med andra ord en intressant utveckling. Å ena sidan är veckomåttet en tydligare engagemangssignal än månadsmotsvarigheten, å andra sidan brukar företag byta vilken parameter de lyfter fram när den tidigare måttstocken inte längre ser lika kul ut. Med andra ord: när utvecklingen ser bättre ut om man byter till ett annat mått.

Oavsett så tuffar Perplexity på bra – vilket också gör att tjänsten allt mer hamnar i stämningsfokus. Efter att New York Times för inte så länge sedan stämde Perplexity därför att tjänsten utan lov eller ersättning ska ha tränat på tidningens innehåll så trillade det den här veckan in motsvarande stämningar från Dow Jones och New York Post.

Perplexity says it’s now serving 100M search queries a week

Canva släpper vassare AI-bildverktyg

Dags för många innnehållsskapares favoritverktygslåda Canva att uppgradera sina verktyg. Och ja, det handlar förstås om AI.

Det är mer specifikt verktyget som kan skapa bilder från textbeskrivningar som nu vässas. Uppgraderingen baseras på uppköpet Leonardo.ai, som är tänkt att alltså kunna ge ännu bättre bilder än tidigare version.

En av de konkreta förbättringarna är att Canvas funktion nu ska kunna hänvisa till en annan bild som ”mall” för hur man vill att slutresultatet ska se ut.

Dessutom gör Canva några övriga förbättringar bland sina AI-verktyg, som att whiteboardfunktionen har stöd för summeringar, automatisk textning i videos och stöd för interaktiva diagram i presentationer.

Canva has a shiny new text-to-image generator

Apple börjar rulla ut Apple Intelligence i december

Det ser ut som att Apple trots allt hinner rulla ut sin kommande AI-plattform Apple Intelligence under 2024. I elfte timme. I december, alltså.

I nästa vecka landar nästa omgång uppdateringar av Apples olika operativsystem, som iOS 18.1. Men Apple har nu bekräftat att de kommer hinna med en uppdatering till innan året är slut. Och i betaversionerna av respektive operativ som nu har blivit tillgängliga så finns de första Intelligence-funktionerna med. Ja, eller de första riktigt ordentliga funktionerna.

I de uppdateringar som kommer nästa vecka så finns några gen AI-funktioner med, som stöd för att transkribera och sammanfatta telefonsamtal samt några text- och bildfunktioner. Men i december så börjar Apple att på riktigt bygga den sammanhållande plattform som ska genomsyra operativen när det kommer till AI. Inte minst funktionen som gör att Siri kan bli betydligt smartare (återstår att se hur smart), bland annat genom att ringa hem till ChatGPT om Siri känner behov av en livlina.

Som tidigare så måste man ha engelska inställt som språk och funktionerna kommer heller inte att finnas tillgängliga överallt. Som hos oss i EU, på grund av Apple inte känner att de har fått alla svar de vill från EU kring hur de senare kommer att se på AI-funktionerna i relation till techregleringslagen Digital markets act.

(Så nu följer kommentarer om att det är kört för EU i AI-racet och överlag på grund av det här.)

Apple releases APIs for Apple Intelligence and localized English language support

Apple släpper API:er för Apple Intelligence

Apple börjar så sakteliga närma sig lansering av sin AI-plattform Apple Intelligence. I de två uppdateringar som återstår i år för Apples olika operativsystem så kommer de första funktionerna att läggas till. Sedan får vi vänta till nästa år innan vi får resten (ja, om allt går som det ska).

Nu släpper Apple dessutom tre API:er för några av funktionerna: skrivverktyget, Image playground och Genmoiji. Nu blir det möjligt för utvecklare att lägga till Apples verktyg för att hjälpa till med skrivande, för att skapa bilder via text eller för att skapa egna anpassade emojis i sina appar.

Apple releases APIs for Apple Intelligence and localized English language support

Notion arbetar på ny AI-mejlklient

Notion, som står bakom den smarta kalendern med samma namn, har nu vänt sin uppmärksamhet till mejlprogrammen. Som kan bli mycket bättre. Om man frågar Notion.

Notion tänker stå ut i konkurrensen genom att ”destillera ned e-post till sina byggstenar”. Tanken är att man ska kunna bygga upp själva gränssnittet rätt mycket precis så som man vill ha det.

Men sedan är stora tanken med Notions mejlklient att det ska finnas sedvanligt mejl-AI-stöd. Som att kunna prata med Notion-AI:n för att hantera sina mejl, boka möten i Notions kalender och skriva färdiga snabbsvar på mejl.

Den som är sugen på hur Notions mejlupplevelse kommer att se ut och fungera får dock hålla sig till tåls lite till (ja, eller gå in i artikeln och ta del av exemplen där). Den nya appen är planerad att landa ”tidigt 2025”.

Notion is making a super customizable email app

Briljant reklam för ChatGPT-utmanaren Claude

Ha!

 

AR/VR

Metas smarta solglasögon säljer bättre än Ray-Bans övriga modeller

Lite kul – och för mig faktiskt oväntat: Metas smarta-solglasögon-samarbete med Ray-Ban (ja, eller ägaren EssilorLuxottica) säljer bra. Riktigt bra till och med. Så pass att Meta-modellen är den mest sålda produkten i 60 % av alla Ray-Ban-butiker i Europa, Mellanöstern och Afrika.

Det kanske mest intressanta i sammanhanget är att glasögonen alltså även säljer bra i EU, där Meta inte har lanserat AI-funktionerna här (på grund av att EU:s regelverk kring AI ”saknar tydlighet”). Med andra ord så betyder det att EU-kunder är så sugna på att få solglasögon att de har hackat sig runt begränsningarna här hos oss.

Ja, eller att de flesta som köper Metas glasögon… inte bryr sig särskilt mycket om just AI-funktionerna. Utan istället köper den för möjligheten att spela in video och ta bilder till Instagram utan mobilen.

Oavsett, oväntat besked för mig. Blir intressant att följa utvecklingen för dem. Inte minst som att Meta rätt uttalat är väldigt sugna på att storsatsa på uppkopplade ”vanliga” glasögon som nästa försök att försöka minska beroendet av Apple och Google.

Meta’s smart glasses outsell traditional Ray-Bans in some stores, even before AI features roll out

Kategorier
AI - Artificiell intelligens IoT - internet of things Spaningar

Digitala spaningar vecka 42 2024 – del 2

Spaningar inom tech och sociala medier från veckan som har gått.

Övriga delar i veckans sammanställning

 

AI – artificiell intelligens

Google NotebookLM gör det möjligt att anpassa AI-podcast-resultatet

Googles AI-anteckningstjänst växer upp och tappar nu sin ”experiment”-märkning. Men den får också en rätt stor uppdatering: det blir möjligt att anpassa den AI-podd som tjänsten kan generera.

NotebookLM har funnits i något drygt år, men det var först sedan Google för några veckor sedan la till funktionen att skapa en podcast från exempelvis en pdf-rapport som tjänsten tog fart på riktigt. Ladda upp en pdf, en ljudfil, allmänna anteckningar eller en Youtube-länk och låt NotebookLM skapa en podcast med två virtuella poddvärdar som diskuterar innehållet i det källmaterial som du har laddat upp.

Ladda upp och vänta några minuter, det var allt som krävdes för att få en imponerande bra podd. Men det var också allt. Det gick inte att anpassa resultatet på något sätt. Det blir det ändring på nu.

Den senaste uppdateringen bjuder på en anpassningsfunktion. Här kan du ange om det är några avsnitt eller specifika delar i källmaterialet som du vill att podden ska fokusera på, om det är vissa teman som poddvärdarna ska fokusera på eller ange en tänkt målgrupp för podden.

Dessutom passar Google på att sjösätta NotebookLM Business – ett pilotprogram som alltså vänder sig specifikt mot företag. Det ska gå att anmäla sig till piloten redan nu och den ska ge ”tidig tillgång till funktioner, träning och mejlsupport”.

Google tänker nu alltså börja tjäna pengar på den produkt som så här långt har varit gratis. Prislappen? Finns i sjön! Ja, eller så kommer Google att gå ut med det ”senare i år”. Vilket är typ… i morgon. Med tanke på hur mycket av året som vi har kvar.

Apple-forskare sågar ”resonerande” AI-språkmodeller som Open AI:s o1

Open AI:s resonerande AI-modell o1 SUGER! Säger Apple.

När ChatGPT-ägaren presenterade efterföljaren till modellen GPT-4 – eller åtminstone nya generationskamraten – o1 så var det stora införsäljningsargumentet att den kunde resonera. Men det är lite så och så med den saken enligt forskare på Apple.

Och det är inte bara o1 som svajar. Faktum är att den klarar sig bäst i sällskapet. Modellerna för Google, Microsoft och Meta presterar ännu sämre. Eller mindre bra, beroende på hur du ser på det.

Enligt Apples studie så handlar det snarare om ”sofistikerad mönstermatching” än ”verkligt logiskt resonerande”. Med andra ord att o1 & co har blivit ännu bättre på att göra det som AI-språkmodeller gör: gissar nästa bokstav och ord baserat på den data de har tränats på. Typ.

Det Apple-forskarna argumenterar är att det är enkelt att få modellerna att snubbla i sitt resonerande genom att kasta in lite irrelevant data i mixen. Läs mer i artikeln om du är intresserad av detaljerna. Men det mest intressanta är vad som forskarna ironiskt nog anser är felkällan: ett verktyg för att testa en modells resonerande förmåga.

Att modellerna alltså har tränats på svaren i det testet – och det är anledningen till att de kan lista ut svaret. Så, tja, AI-Jeopardy.

Vi kan väl anta att de utpekade företagen inte delar Apple-forskarnas bild och kommer att svara.

Apple study reveals major AI flaw in OpenAI, Google, and Meta LLMs

Perplexity släpper Spaces och stöd för sökning i interna dokument

Nya funktioner i Perplexity: Spaces och intern dokumentsök.

Den sistnämnda är precis vad det låter som: sök bland företagets egna dokument med Perplexity. Det ska dessutom gå att kombinera dokumentsökning med webbsökning så att man alltså kan göra kombosökningar från ett ställe. Finns dock ett aber: det går inte att plugga in sitt interna dokumentbibliotek i Perplexity. Den interna sökfunktionen fungerar bara för dokument man laddar upp till Perplexity. I dagsläget, i alla fall.

Det finns dessutom ett tak på hur många filer man kan ladda upp. Max 500 för de som kör Enterprise-abonnemanget och sannolikt rätt mycket färre för Pro. Det är dessutom dessa både abonnemang som krävs för att komma åt nya funktionen.

Om man så vill så rullar Perplexity alltså ut en motsvarighet till Googles NotebookLM. Som dessutom enuppar Googles lösning genom att det alltså går att korsökra sökningar i dokument på webben. Det verkar dock inte som att Perplexity erbjuder någon poddfunktion. Inte ån, åtminstone.

Dessutom lanserar Perplexity Spaces, som också är ungefär vad det låter som och ungefär det som konkurrenter erbjuder: stöd för att dela filer inom ett team och göra gemensamma anpassningar av Perplexity.

Perplexity kommer inte träna på Enterprise-användares Spaces-sökningar eller filer som laddas upp. Ja, eller funktionen att göra det är avslagen per default. Det omvända gäller för Pro-användare, som själva får stänga av träningen om de inte vill att Perplexity ska få tillgång.

Sist men inte minst jobbar Perplexity på möjligheten att plugga in tredjepartskällor som Crunchbase och FactSet i Spaces för Pro-abonnemang.

Perplexity lets you search your internal enterprise files and the web

New York Times stämmer Perplexity för olovligt AI-tränande

Enough is enough! Efter att tidigare ha stämt ChatGPT-ägaren Open AI så är det nu dags för New York Times att skicka ut ännu ett stämningshot. Den här gången till AI-söktjänsten Perplexity.

Det handlar även denna gång om att New York Times inte gillar att AI-bolag tränar på tidningens innehåll utan tillåtelse och (framförallt) utan att betala för sig.

Perplexity har i år mer än en gång anklagats för att köra lite gråhattsupplägg i sitt skrapande av webbsidor. Att man alltså har använt sig av metoder som rundar praxis för hur man gör saker på nätet – som att respektera om en sajt i sin robots.txt-fil inte tillåter en bot att skrapa sidan. Perplexity sägs dessutom ha hittat på ett sätt att även kunna komma åt innehåll bakom betalvägg.

Det senare låter inte alls orimligt. Dels med tanke på ovanstående uppgifter om hur Perplexity sköter sin affär och dels därför att Google vid ett tillfälle för ett par år sedan tvingades panikändra en justering av sökalgoritmen som gjorde att innehåll bakom betalväggar läckte ut.

Det är ännu ett exempel på hur de flesta AI-bolag idag har en i grunden långsiktigt ohållbar affärsmodell. I takt med att sajter med mycket innehåll har uppmärksammats på att innehåll har ekonomiskt värde som AI-träningsunderlag så börjar allt fler blocka gratisätande AI-botar. Det gör att AI-bolagen inte får det som de behöver för att sedan kunna tjäna pengar.

Det är med andra ord ingen slump att Open AI nu dammsuger upp innehållsavtal med stora publicister i ett rasande tempo. Men för de AI-bolag som inte ha lika djupa fickor blir det en betydligt större utmaning.

Det kommer med andra ord bli väldigt intressant att följa hur en ”AI-ekonomi” kan få för former. För bevisligen behöver rättighets- och ersättningsfrågan redas ut. Och även här lär det i slutändan bli regleringar som kommer att tvingas styra upp. Läs: EU lär gå först även här.

The New York Times has had it with generative AI companies using its content

Mistral släpper AI-modeller för mobiler och andra bärbara enheter

Dags för franska Mistral att utöka sin familj AI-modeller. Den här gången med två modeller som är framtagna specifikt för att användas i mobiler, bärbara datorer och andra portabla enheter. Enheter som kort sagt överlag har mindre processorkraft och därmed behöver mer extern datorkraft eller som helt enkelt går på batteri och gillar saker som inte bränner så mycket batteritid.

Och Mistral fortsätter leda AI-racet när det kommer till bäst namn på sina olika modeller. Den nya modellfamiljen heter Les Ministraux och de två första modellerna här Ministral 3B och Ministral 8B. Siffran anger hur många miljarder parametrar som de består av. Båda modellerna kan i en enskild fråga svälja ungefär den textmängd som en 50-sidig bok består av.

Men de exakta tekniska specarna känns mindre viktiga i sammanhanget. Desto viktigare är själva principen att även Mistral nu lanserar AI-modeller som är tänkta att kunna skyffla runt data lokalt i enhet, utan att behöva ringa hem till en server i molnet för att svara på frågor och utföra kommandon.

Förutom att det gör saker och ting snabbare för slutanvändaren när data inte behöver skickas fram och tillbaka över internet så innebär det säkrare lösningar och även energisnålare sådana.

Apples hela kommande AI-plattform Apple Intelligence är tänkt att bygga på den här som en grundprincip. Mycket ska kunna hanteras direkt i enheten, men om den uppgift kräver större muskler så kommer automatiskt en förfrågan skickas till Apples egna molnservrar. Men tanken är att mycket alltså ska kunna hanteras utan det sistnämnda steget.

Det här är del av en större trend där ”megapixelracet” när det kommer till AI-modeller börjar tappa betydelse. Istället för att jaga allt större modeller – och därmed allt större mängder träningsdata – så börjar intresset öka för att ta fram andra sätt att träna AI-modeller. Mest därför att det snart inte finns tillräckligt mycket data för att tillfredställa de allt större modellerna.

Det innebär också att man försöker göra modellerna mindre elintensiva. Att det helt enkelt krävs mindre el för att driva de servrar som används för att träna modellerna och för att sedan använda dem.

Ännu mer forskning och utveckling på det här området känns som något som borde få betydligt mer uppmärksamhet och resurser (något som även gäller förnyelsebara energiteknik). Istället för att vi ska backa oss in i det förflutna genom att kasta en massa miljarder på att bygga nya kärnkraftverk för att hantera framtidens energibehov.

Mistral släpper AI-modeller för mobiler och andra bärbara enheter

Meta lanserar AI-modelen Spirit LM

En ständig utmaning: hur ska man egentligen fira Halloween? Är man Meta så passar man på att lansera en ny AI-modell lagom till den spöklika högtiden. Med det passande namnet Spirit LM.

I linje med att Meta har ställt sig på open source-barrikaderna när det kommer till AI så är även Spirit LM fri att använda. Men precis som övriga open source-AI-initiativ som Meta har släppt så… är Spirit LM inte fullt ut open source. Det finns med andra ord ett villkor kopplat till användningen: den får inte användas kommersiellt.

Köper man den förutsättningen så får man en multimodal AI-lösning, som med andra ord innebär att den kan hantera fler format i samma gränssnitt. I det här fallet text och röst.

Vad är det då som gör Spriit LM bättre än konkurrenterna you ask? Den ska erbjuda ”mer uttrycksfullt och mänskligt röstskapande”. Med andra ord att rösterna ska låta och bete sig mer som vi människor. Jag tänker på saker som ChatGPT:s avancerade röstläge eller poddfunktionen i Googles Notebook LM.

Den nya modellen kommer i två smaker Base och Expressve. Där den senare, som hörs, ska vara bättre på att väva in nyanser och tonlägen i de röster som skapas.

Meta Introduces Spirit LM open source model that combines text and speech inputs/outputs

ChatGPT får Windows-app

Dags för Windows-användare att bli lika coola som oss som kör Mac. Ja, eller det är förstås inte möjligt, men nu släpper Open AI oavsett en Windows-app för ChatGPT.

Än så länge handlar det dock en ”en tidig version” som dessutom bara är tillgänglig för dem som betalar för ChatGPT. Men en ”full experience”-version ska släppas senare i år. Vi kan anta att denna version även blir tillgänglig för gratisanvändarna, precis som på Mac-sidan.

ChatGPT has a Windows app now

Forskare tar fram algoritm som minskar energiåtgången för att träna AI-modeller med 95 %

Väldigt intressant. Och väldigt viktigt. Forskare vid BitEnergy AI har tagit fram en algoritm som minskar energiåtgången vid träning av AI-modeller med 95 %, med bibehållen kvalitet.

Mer specifikt så har forskarna ”developed Linear-Complexity Multiplication (L-Mul), a method that replaces energy-intensive floating-point multiplications with simpler integer additions in AI computations”.

Nej. Jag förstår inte vad som står här ovan. Och förstår knappt på förklaringen i artikeln heller. Så vill du veta mer så rekommenderar jag att du går in i artikeln (eller frågar ChatGPT).

Så istället för att recensera lösningen som forskarna har tagit fram nöjer jag mig med att fokusera på den principiella frågan.

Dagen AI-språkmodeller har två stora problem – eller utmaningar, beroende på vem du frågar. Den ena är att det krävs hiskeligt mycket data för att träna dem och det andra är att det krävs nästa lika hiskeligt mycket el för att driva de servrar och datacenter där beräkningarna görs.

För ett par veckor såg jag någon som kommit fram till ett annat sätt att träna språkmodeller, som inte kräver lika mycket datainput. Och nu alltså ännu ett initiativ för att försöka få ned elförbrukningen. Båda två extremt viktiga för den fortsatta AI-utvecklingen.

Nu verkar det som att det krävs särskilt hårdvara för att få den strömsnåla modellen att funka – utöver att jag som sagt var absolut inte har en aning om hur bra det tekniska kan funka.

Men hej. Vi kanske är nära AI-modellernas MP3 moment?

This New Technique Slashes AI Energy Use by 95%

 

IoT – internet of things

Open AI-VD:n presenterar ett ögonskannande ID-klot

Så så kommer den alltså att se ut. Open AI-VD:n Sam Altmans nya hårdvarupryl. Ett… ögonskannade ID-klot.

Det handlar om ett initiativ som inte hör hemma i Open AI, utan är en separat startup. Det började som Worldcoin – en lösning där användare betalar med sina ögon. Men i samband med att klotet visades upp så fick vi också veta att initiativet numer bara heter World. Ambitionen är alltså att gå bortom bara betalningar.

Men i grund och botten är missionen den samma. Få oss att lagra våra unika irisar i företagets klot så att vi sedan kan identifiera oss med just våra ögon. Kloten ska både kunna finnas på offentliga plaster och hemma. Och…

…jag ska inte säga att det är helt klart för mig varför någon skulle få för sig att köpa ett.

Som konsument i väst är behovet förmodligen inte jättestort, i och med att det blir allt vanligare med digitala ID-handlingar i mobilen eller datorn – prylar vi redan äger. Och ska det fungera som betalsätt eller ID-handling på andra ställen så måste man fortfarande skanna in sitt öga på något sätt. Även här skulle förmodligen mobilen vara det enklaste sättet att göra det.

Visst. Jag tänker mig att målgruppen mycket är ställen där ID-handlingar inte är helt självklara. Definitivt inte digitala sådana. Men även här blir smartmobiler allt vanligare. Och visst. Genom att skanna sitt öga i ett klot i butiken gör att man slipper ha med sig något – men oklart om just Altmans klotpryl är det givna sättet att hantera det.

Jag gillar verkligen hela initiativet att bygga en världsomspännande ID-handlingsdatabas som skulle bygga på biometriskt unika värden. Jag tror alltså mer på själva nätverket än prylen. (Utan att ens ha gått in på de potentiella säkerhetsriskerna.)

Sam Altman’s Eye-Scanning Orb Has a New Look – and Will Come Right to Your Door

Apple kan släppa ”vanliga” smartglasögon 2027

Rätt länge vid det här laget har Apples Tim Cook velat ta fram ett par AR-glasögon med Apple som avsändare. Så fick vi vardagsrumscyklopet Vision Pro förra året – en produkt som verkar ha varit en rätt rejält kompromiss utifrån den ursprungliga visionen (hoho). Men ska vi tro på de senaste uppgifterna så är Apple fortfarande på AR-glasögonbollen.

Enligt Mark Gurman, en av de Apple-analytiker som har mångas öra, så siktar Apple på att släppa ett par ”vanliga” AR-glasögon 2027. Ja, smarta glasögon överlag, alltså, där AR-stöd i linserna lär vara en viktig funktion.

Men precis som exempelvis Metas hyfsat nyligen uppdaterade solglasögonsamarbete med Ray-Ban så kan vi nog anta att Apple Intelligence också ingår i det paketet. Apples kommande AI-plattform, alltså. Med andra ord så att du skulle kunna prata med Siri (eller någon annan digitalassistent) för att få svar på frågor och utföra kommandon.

Smarta glasögon har visat sig vara rätt svåra att göra – bara att fråga Google, Snap och nu senast Meta. Och då inte så mycket att få oss att använda dem, utan att få dem att funka på ett bra sätt. Batteritidsmässigt inte minst. För att inte tala om hur interaktionerna ska ske (där både Apple och Meta har eller har koncept på att ha styrmekanismer som är baserade på handrörelser eller exempel där ögonstyrning blir allt bättre).

Men just den här enhetstypen har en stor fördel för många av oss jämfört med andra försök att utmana mobilen: det handlar om att lägga till smart funktionalitet i en pryl vi redan har med oss och på oss – inte att få oss att kånka runt på en grej till.

(Sen förhåller jag mig lätt skeptisk till att Apple lyckas få till ett par uppkopplade bågar som inte ser ut som en kloss i ansiktet redan till 2027. Men hej. Jag har gärna fel.)

Apple might launch smart glasses in 2027

Optimus-robotarna under Teslas senaste event kontrollerades av människor

I förra veckan var det så slutligen dags för Tesla att presentera sin nya robottaxi – som också gav oss en minirobotbuss. Men en tredje produkt visades också upp, både i skymundan och som nära nog huvudroll. Det var den humanoida roboten Optimus som förekom mest överallt där den minglade med besökare.

Den fick mer än en att ooaha och aaaha över hur långt Optimus hade kommit, där den kunde dela ut goodiebags, prata och spela sten, sax, påse med besökare.

Men… det visar sig nu att de var ännu mindre självgående än vad det verkade.

Enligt Tesla själv ska robotarna ha ”använt AI för att gå”, men övriga rörelser kontrollerades av mänskliga operatörer på distans. Dessa ska även ha pratat åt robotarna.

Med tanke på att Optimus, när den först presenterades, bestod av dansande människor i robotkostymer så känns det helt rimligt att de humanoida inslagen var ännu mer humanoida än vad Tesla (läs: Elon Musk) ville få dem att framstå.

Vi har med andra ord fortfarande ingen riktigt säker bild på hur långt Teslas robot har kommit som en fullt autonom produkt. Och hur långt det är kvar till det målet.

The Optimus robots at Tesla’s Cybercab event were humans in disguise

Kategorier
AI - Artificiell intelligens Spaningar

Digitala spaningar vecka 40 2024 – del 2

Spaningar inom tech och sociala medier från veckan som har gått.

Övriga delar i veckans sammanställning

 

AI – artificiell intelligens

ChatGPT får nya samarbetsfunktionen Canvas

Ny funktion i ChatGPT. Den här gången en collabofunktion: Canvas.

Den är rätt mycket vad den heter som: en ny yta där arbetet kan visualiseras. Men så har vi det där med samarbetet. Ett samarbete som kan ske mellan dig själv och en kollega till: ChatGPT.

Det handlar alltså egentligen om ett nytt sätt att visualisera det som man håller på att arbeta med (så länge som det är i form av text eller kod, som är de två format som stöds av funktionen i dagsläget).

Canvas består av två vyer: chattfönstret till vänster och resultatet till höger. Det ska sedan bli möjligt att be ChatGPT göra saker i det högra fönstret eller omvänt: låta ChatGPT komma med förslag.

Så hur aktiverar du Canvas? Det… gör du inte. ChatGPT kommer själv att kicka igång funktionen när den ”upptäcker ett scenario där funktionen skulle vara hjälpsam”. (Okej, det går även att manuellt trigga funktionen – fast det verkar intressant nog då bara gälla en chatt som redan finns, inte från scratch alltså.)

Om man så vill så har Open AI här snott rätt oblygt från konkurrenten Anthropic och deras AI-bot Claude. Det i mångt och mycket en enklare version av Claudes Artifacts, fast med mer tänkt fokus på att collaba med ChatGPT.

Canvas fungerar dock inte med senaste o1-modellen, utan det är 4o som gäller. Det är dessutom betalabonnemangen Plus och Team som gäller om du vill få tillgång idag. Från och med nästa vecka ska även de som betalar för Enterprise eller Edu få funktionen.

Det mest intressant är att Canvas klassas som en beta och att Open AI planerar att släppa Canvas även för gratisanvändare av ChatGPT när ”den kommer ut ur beta”. Så… alla betalande ChatGPT-kunder betalar alltså för att betatesta Canvas åt gratisanvändarna.

Because förstås.

https://techcrunch.com/2024/10/03/openai-launches-new-canvas-chatgpt-interface-tailored-to-writing-and-coding-projects/

Open AI lanserar API för det avancerade röstläget

Knappt har Open AI hunnit börja rulla ut det nya avancerade röstläget för ChatGPT förrän det är dags att ge funktionen ett API. (Ja, eller API:et ska åtminstone hantera text-till-ljud på ”liknande” sätt som det avancerade röstläget.)

Realtime API, som det heter, gör det alltså möjligt för betalande utvecklare att lägga till ChatGPT avancerade röstläge i en app eller tjänst. Sex förinställda röster ska följa med på köpet.

Realtime API:et ska bjuda på ”low-latency”, alltså riktigt snabb svarstid – vilket är lite förutsättning för realtidskonversation med en digital motpart. Det lär också innebära att API:et inte är billigt att använda.

Så för den lite mer kostnadsmedvetna utvecklaren – eller bara för den som inte har behov av blixtsnabba realtidssvar – så lägger Open AI också till ljud in och ut som format i sitt Chat Completions-API.

Det sistnämnda innebär att utvecklare kan skicka in text eller ljud till ChatGPT:s 4o-modell via API och sedan välja om man vill få ut svaret som text, ljud eller både och.

Däremot så har API:et beta-etikett, så förväntningarna kanske kan läggas på rimlig nivå utifrån det.

https://openai.com/index/introducing-the-realtime-api/

Open AI siktar på att dubbla priset för ChatGPT

Hur mycket är du beredd att betala för ChatGPT? Det tänker Open AI nu testa. Planen är att dubbla priset.

New York Times har kommit över dokument från Open AI till potentiella investerare och där är planen att höja priset för grundtjänsten med två dollar och sedan gradvis skruva upp den till nya priset 44 dollar om fem år. Mer än en fördubbling.

Det skulle för svenska vidkommanden – baserat på dagens nivåer – betyda att ChatGPT ligger på strax under 600 kronor i månaden runt 2030.

Nu är det ungefär oceaner av tid dit (inte minst för vår regering som väl hoppas på att vi har fyra helt nya kärnkraftverk i drift då). Mycket kan med andra ord hända. Open AI kan ändra sig och konkurrens kan skapa prispress (som att Apple kanske inte börjar betalt för Apple Intelligence.

Men nästa år är planen att Open AI ska gå från semivinstdrivande till all in vinstdrivande. Då vill man gå med vinst. Med tanke på att företaget bedöms omsätta 3,7 miljarder i år, men ta en förlust på 5 miljarder, så finns det… en del hål att stoppa pengarna i.

Nu är det inte första gången som det ryktas om prishöjningar på ChatGPT. Som uppgifter om att det internt på ChatGPT har pratats om en prislapp på uppemot 2000 dollar i månaden för vissa abonnemang (man kan väl hoppas att det då handlade om dem som vänder sig till stora företag – men ändå).

600 kronor i månaden för en AI-assistent är säkert totally worth it för vissa. Men det kommer säkerligen göra att många inte kommer ha råd.

Att Open AI kommer att höja priserna på något sätt kan vi nog vara säkra på. Gäller ju ungefär alla prenumerationer. Men det blir intressant att se var smärtgränsen går för dem som använder tjänsten lite mer sporadiskt. Och hur strypt en gratisversion då kommer att vara.

Var skulle den gränsen gå för dig?

https://www.nytimes.com/2024/09/27/technology/openai-chatgpt-investors-funding.html

Microsoft Copilot börjar se och höra det du ser på nätet

Ni vet den där oron om att mobilen avlyssnar oss, som Svenskarna och internet bara häromdagen visade fortfarande lever? Och som avfärdades som en envist ihängande myt som inte har någon markförankring? Håll vårt ölfat säger Microsoft.

Före sommaren presenterade företaget Rewind – det fotografiska minne som Microsoft som ska ta skärmdumpar på allt  man gör i en PC med funktionen så att man sedan kan ställa frågor till AI-boten om det man har gjort medan man använde datorn. Nu är det dags för en ny funktion. Microsofts AI-bot får Vision. Den lär sig bokstavligen se.

På beskrivningen så låter Vision ungefär som en lite-variant av Rewind. Den ska spåra vad du ser och gör i webbläsaren för att skaffa sig en bättre kontext när du sedan ber den om exempelvis rekommendationer. Eller sammanfattar artiklar. Så typ… samla in förstahandsdata? (Känns som att hela första- och tredjepartsdatadiskussionen måste uppgraderas med AI som möjligt ny kategori).

Samkör man sedan Vision med Voice så kan Copilot man prata med Copilot, så att boten kan se, höra och prata.

Intressant nog så verkar funktionen vara sessionsbaserad. Allt blåses när man avslutar sin session och data används inte för att fräna Copilot-modellen. Vilket känns lite… kontroproduktivt om man vill ha en bot som förstår personlig kontext. Men hej.

Vision kommer dessutom bara fungera på ”ett begränsat antal” sajter, vilket också känns lite märkligt. Vision verkar inte fungera på betalväggssidor eller ”känsligt innehåll”. (Vilket sannolikt kan läsas som… vuxensidor.) Det känns med andra ord som att sajter måste göra något för att ”släppa in” Vision.

Sist men inte minst så lanserar Microsoft också Copilot Daily, som ska vara typ en personaliserad nyhetsmorgonsammanfattning. Med tanke på att morgonradioprgram på kommersiell radio alltid har låtit AI-skapat – långt före ChatGPT – så blir det väl marginell skillnad jämfört med hur det har varit tidigare.

Oavsett: Voice och Daily rullas nu ut för Windows i några engelskspråkiga länder, som USA och Storbritannien nu. Fler länder och språk kommer ”snart”.

Vision ska ”snart” börja rullas ut i USA, men då bara för den som betalar för Copilot Pro. Dessutom måste man köra Edge vilket gör att… ingen kommer att använda funktionen.

https://www.digitaltrends.com/computing/copilot-vision-sees-web-pages/

Microsoft börjar betala publicister för nyhetsinnehåll som används av AI

Google har länge varit… sådär sugna på att betala publicister för nyheter som visas i sökresultatet. Ja, någonstans hos Google överhuvudtaget. Google har dessutom varit öppna med att de inte tänker betala publicister för innehåll som AI-träningsinnehåll, till skillnad från exempelvis Open AI.

Nu vill även Microsoft bli mer kompis med publicister. Även de kommer nu att börja betala för nyheter. I Daily-tjänsten.

Daily var en av Copilot-nyheterna som Microsoft presenterade i veckan och den är rätt mycket vad den låter som: en daglig sammanfattning av saker som kan vara bra att ha koll på som inledning på dagen. Saker som väderprognos och just nyheter.

Microsoft kommer att börja betala de publicister som dyker upp i Daily. Ja, så länge som man har ett avtal med Microsoft. Något som publicister och titlar som Reuters, USA Today och Financial Times har. Det är kort sagt (som vanligt) stora namn som fått chans att skriva avtal.

Det är dessutom bara i USA och Storbritannien som publicister har chans att få betalt. Beroende på att, ja, det är bara i dessa länder som Daily kommer att finnas till att börja med.

AI-bolagen börjar med andra ord bli allt mer villiga att betala för innehåll i sina AI-tjänster. Eller rättare sagt: de tvingas allt mer till det på grund av att publicister allt mer stryper tillgången och på grund av allt hårdare regleringar i framförallt EU.

Det här kommer med andra ord bli ett viktigt område att följa på AI-området.

https://techcrunch.com/2024/10/01/microsoft-starts-paying-publishers-for-content-in-copilot/

Microsoft ger Copilot förmågan att resonera

Kan Open AI så kan Microsoft. Ja, så verkar de senare ha resonerat. Nu får Copilot förmågan att resonera, precis som Open AI:s nya o1-modell.

Och det är ingen slump att det kommer nu. ”Think deeper”, som funktionen heter, är baserad på just o1 – med Microsoft-anpassningar.

o1 är i dagsläget släppt som en förhandsversion, som saknar rätt många av förmågorna hos föregångaren 4o. Det blir därför intressant att se vad Microsofts anpassningar kan bestå av.

Vi här får oavsett vänta innan vi kan testa den nya funktionen. Think deeper är för tillfället bara tillgänglig för ett ”begränsat” antal användare inom ramen för Microsofts Copilot Labs. Dessutom bara i Australien, Kanada, Nya Zeeland, USA och Storbritannien.

https://techcrunch.com/2024/10/01/microsoft-copilot-can-now-read-your-screen-think-deeper-and-speak-aloud-to-you/

Microsoft lanserar Clippy 2.0

Clippy är tillbaka! Tillbaka!! TILLBAKA!!!

Japp. ÄNTLIGEN får vi gemet igen!

Ja, eller. Nej. Tyvärr får vi inte nöjet att umgås med världens charmigaste skärmassistent igen (jag tillhör en av dem som älskade Clippy. Alla vi som älskade Clippy möts regelbundet och delar våra favoritminnen om Clippy. Ibland behöver vi till och med tre stolar till våra möten.)

Enligt Microsoft så har företagets ChatGPT-utmanare Copilot skruvats till lite så att den ska erbjuda sina användare ”mer känslomässig support”. Ordagrant så anser Microsoft att Copilot nu blir din ”hype man”.

Ett påstående som inte alls fick alla cringeboomervarningslampor i hela världen att explodera.

Tanken är oavsett att Copilot ska bli bättre på att hoppa in och peppa dig när du behöver. Ja, uppmuntra dig att använda Copilot mer. Så… kanske inte alls när du behöver.

Men hej. Jag är helt övertygad om att de flesta användare inte alls kommer att stänga av funktionen förrän efter tre minuter.

https://www.wired.com/story/microsoft-copilot-vision-voice-emotional-support-windows-office/

Gemini Live tillgängligt för alla användare

Google tar nästa steg med sin Google Assistant, the next generation. Googles AI-funktion Gemini Live ska nu finnas tillgängligt för alla användare. Även dem som inte betalar för ett Gemini-abonnemang.

Live gör det möjligt att bokstavligen prata med Gemini på samma sätt som med Google Assistant. Eller med ChatGPT-appen.

Lite osäker, men som jag fattar det så innebär det att Live även är tillgänglig för oss i EU. Däremot har jag ingen personlig erfarenhet av det, eftersom den har en väldigt stor nackdel: den finns bara för Android. Just nu, åtminstone.

https://mashable.com/article/gemini-live-available-free

Gemini Live blir tillgängligt på 40 nya språk

Gemini Live, Googles svar på Open AI:s röstchattsfunktion, har så här långt bara funnits på ett enda språk: engelska. Men nu blir det ändring på det. Gemini Live har lärt sig ett gäng nya språk.

Det blir alltså möjligt att föra konversationer på andra språk än engelska. Först ut franska, tyska, portugisiska, hindi och spanska. Och ”de närmaste veckorna” så blir det alltså ännu fler.

Och… det är det vi vet. Google har kort sagt inte gått ut med en lista över vilka 40 språk som omfattas. Vi får kort sagt vänta och se när det kommer till den detaljen.

https://www.theverge.com/2024/10/3/24260561/gemini-live-language-support

Gmail för iOS får ny AI-sökfunktion

Ännu mer AI i Gmail. Because AI. Den här gången är det iOS-användarna som får lite mer AI-hjälp i sitt mejlande.

iPhone-Gmail får nu samma stöd som rullades ut för Android i augusti, vilket innebär att det går att ställa frågor om sina mejl till Googles AI-bot Gemini. Som att be Gemini sammanfatta mejl inom ett visst ämne.

Det krävs dock att man betalar för något av Googles Gemini-abonnemang, som Google One AI Premium eller Workplace-abonnemangen Business, Enterprise, Education eller Education Premium.

https://techcrunch.com/2024/10/04/gmail-users-on-ios-can-now-ask-gemini-questions-about-their-emails/

Meta presenterar AI-videoverktyg

Dags för Meta att ge sig in i kampen om dem som vill skapa AI-videos. Företaget har presenterat verktyget Movie Gen.

Movie Gen kan skapa högupplöst video med tillhörande högupplöst ljud. Och videos skapas på det sätt vi nu har vant oss vid när det kommer till AI: du beskriver med text vad du vill ha och sedan skapar verktyget det åt dig.

Movie Gen kan även redigera befintliga videos och även bilder.

Men sen finns det några brasklapapr. Videorna som skapas kan vara max 16 sekunder långa med 16 rutor per sekund. Ljudet som skapas kan däremot intressant nog stäckas ut till 45 sekunder.

Ja, och så är det än så länge bara ett demonstrations-ex. Bokstavligen. Enligt Meta så är Movie Gen inte redo att släppas ”någon gång snart”. Varför? Därför att modellen fortfarande är för dyr och det tar ”för lång tid” att skapa videos.

Men det betyder oavsett att vi har en ny spelare på AI-videoområdet. Blir intressant hur Meta kommer att stå sig i konkurrensen.

https://www.theverge.com/2024/10/4/24261990/meta-movie-gen-ai-video-generator-openai-sora

Meta vill bygga små AI-modeller för smartphones tillsammans med Arm

Senaste veckan eller så så presenterade Meta nyheter som del av sin årliga Meta Connect-konferens. En av de mer intressanta sakerna som Meta gick ut med är ett nytt samarbete med chiptillverkaren Arm. Ett samarbete som går ut på att de båda företagen vill ta fram små AI-modeller.

En utmaning med dagens avancerade AI-modeller, inte minst inom generativ AI, är att de är skitstora och kräver en herrans massa processorkraft och el för att snurra runt. Det innebär i de flesta fall att det krävs molnlösningar och externa servrar dit data ska skyfflas från den enhet man använder en AI-bot i.

En lösning på det här, som inte minst Apples kommande AI-plattform Apple Intelligence kommer att bygga på, är att själva AI:andet helt eller till största del sker lokalt i enheten. Det är alltså här som Meta och Arm nu vill in och leka (ja, kanske inte specifikt i iPhones, eftersom Apple har sina egna chip med tillhörande infrastruktur).

Det som är extra intressant här är två saker. Dels att det inte handlar om ett nya chip – det som Arm är mest kända för – utan just AI-modeller som ska kunna köras lokalt. Och dels att Meta inte, trots flera försök, har en riktigt etablerat hårdvaruekosystem. Det närmaste är företaget Quest-set för VR och AR.

Men Meta vill förstås ändra på det här och ett initiativ som också presenterades i veckan är en helt ny AR-glasögonmodell. En modell som ska vara en riktig AR-pryl, så att skärmarna i bågarna åtminstone delvis ska kunna ersätta mobilen. Och som förstås också är tänkt att ha AI-funktionalitet, så att man exempelvis ska kunna ställa frågor till glasögonen och sedan få upp svaret på glasögonlinserna eller få det uppläst. Här skulle mindre AI-modeller vara väldigt lämpliga. Inte minst eftersom det också är en pryl där Meta skulle kunna kontrollera operativsystemet.

Nu finns det… några utmaningar. De nya AR-glasögonen är än så länge bara ett koncept och inte en färdig produkt, Arm-samarbetet finns sannolikt än så länge mest på pappret, och Meta har flera gånger tidigare försökt få till framgångsrika hårdvaruprylar och egna ”operativsystem” utan att ha nått särskilt stora framgångar.

Men det blir oavsett intressant att se vad Arm-partnerskapet kan leda till. Meta skulle kunna jobba sig fram till en position som AI-modellsleverantör till de företag som skapar prylarna som konsumenter sedan använder.

https://www.gadgets360.com/ai/news/meta-arm-partnership-advanced-ai-capabilities-smartphones-devices-report-6654736

Nvidia lanserar sin egen AI-modell

Ännu en spelare på AI-planen: Nvidia. Chiptillverkaren lanserar nu sin egen utmanare till Open AI:s GPT.

Nvidias modell, NVLM 1.0, är open source och ska dessutom matcha Open AI:s GPT-4-modell. Den ska kunna hantera såväl text- som bilduppgifter.

Enligt de som har bättre koll än jag på det AI-hardcoretekniska så ska Nvidias modell vara vass. Men det återstår väl att se hur bra den är när den väl dyker upp i tjänster som kan användas av oss vanliga människor.

Nvidia just dropped a bombshell: Its new AI model is open, massive, and ready to rival GPT-4

Perplexity släpper Mac-app

Är du Perplexity-knarkare? Känner du att du har för få AI-appar i ditt Mac-liv? Grattis! Nu kan du kombinera både de sakerna: AI-söktjänsten Perplexity blir med Mac-app.

Däremot får du hålla dig till tåls lite till. Appen släpps preliminärt 15 oktober, men för den som vill kunna skärmdumpa upp att man alltid är först med det senaste så går den att förboka nu.

Studenter identifierar och samlar in personlig information om främlingar på stan via Metas AR-glasögon och AI

Oroar du dig över att din mobil lyssnar på dig? Gör dig redo att ha en helt ny orosnivå: Metas Ray-Ban-solglasögon som i realtid kan identifiera människor på stan och söka upp all information om dem, inklusive hemadress.

Det var alldeles för länge sedan någon drog en parallell till Minority Report. Så nu gör jag det.

Okej. Det är inte så att Metas bågar har the power of doxa främlingar på stan när man packar upp dem. Det krävs lite handpåläggning. Eller mycket. Vilket var precis vad två MIT-studenter ägnade tid åt.

Studenterna Insta-strömmade när de gick fram till – vad som ska ha varit – främlingar på stan och sedan berättat saker för dem om dem själva. Till sin hjälp hade de ett par Meta-Ray-Bans och en egenutvecklade AI-språkmodellslösning.

Mer specifikt så strömmade de videon från glasögonen till Instagram. De hade sedan en dator som tittade på sändningen och sedan sökte efter matchande ansikten på nätet. Därefter gjordes uppslag mot artiklar men även väljarregistreringsdatabaser för att få fram information om personerna. Saker som telefonnummer, adress och namn på släktingar. Det sammanställda resultatet skickades sedan tillbaka till en mobilapp som studenterna hade skapat. Allt automatiserat.

Okej, vi pratar inte om hundra procents träffsäkerhet. Och det låter inte så lite som ett skönt första april-skämt. Och det känns inte som helt orimligt att det skulle vara det.

Men samtidigt så är det förstås fullt möjligt. Att identifiera ansikten på stan och sedan göra uppslag mot dem finns. Inte minst i… något mindre demokratiska länder som Kina. Och resten av stegen är automatisering av sådant som, varje steg för sig, gör att göra rätt enkelt.

De båda studenterna inser de negativa sidorna med deras lösning, så de släpper inte koden som de har tagit fram för att få allt att funka. Men hej, det är ju inte så att det inte går att reverse engineera nu.

Ett användarfall att ha i bakhuvudet nästa gång som någon suckar över hur EU reglerar sönder all AI-innovation.

https://www.engadget.com/wearables/students-used-metas-smart-glasses-to-automatically-dox-strangers-via-instagram-streams-170228496.html

ChatGPT:s avancerade röstläge extraknäcker som indisk telefonscammare

Det avgör saken. När (om?) jag får ChatGPT:s avancerade röstläge kommer jag ställa in den på indisk engelska.

Thank you come again!

https://www.instagram.com/reel/DAkJ4_QqSfE/?igsh=ajN1Z3JyM2xiNjMx

Kategorier
AI - Artificiell intelligens Spaningar

Digitala spaningar vecka 39 2024 – del 2

Spaningar inom tech och sociala medier från veckan som har gått.

Övriga delar i veckans sammanställning

 

AI – artificiell intelligens

Open AI:s CTO Mira Murati slutar

Och där tappar ChatGPT-ägaren Open AI ännu en hög chef. Den här gången CTO:n Mira Murati. Dessutom kliver forskningschefen Bob McGrew av.

Och där skulle historien kunna sluta. Murati har varit på Open AI i över sex år. Oceaner av tid i techvärlden. Men nu finns det en del detaljer här som gör det värt att stanna upp kring beskedet en stund. Och inte bara för att hon var med och tog fram såväl ChatGPT som bild-AI:n Dall-E.

Utöver att vara CTO så var Murati VD för Open AI i… typ en dag. Efter det att Open AI:s styrelse abrupt gav VD:n Sam Altman kicken för snart ett år sedan så utsågs hon till interim VD. Och Murati ska ha varit en av dem som ska ha hört av sig till Open AI:s styrelse och uttryckt oro över att Altman började ta lite väl många säkerhetsmässiga genvägar i jakten på att ta fram kommersiella produkter. Alltså en av dem som bidrog till att Altman tillfälligt fick lämna VD-posten.

Och nu slutar Murati, för att istället ”utforska på egen hand”. Och hon gör det med formuleringen ”After much reflection, I have made the difficult decision to leave OpenAI”. Följt av ”There’s never an ideal time to step away from a place one cherishes, yet this moment feels right.”

Vi kan utgå från att det är en ren slump att det rätta tillfället infaller bara någon vecka efter det att Sam Altman under ett internt möte lämnade beskedet att Open AI ska ställa om till vinstdrivande fullt ut nästa år. Och därmed klippa de sista banden till organisationens ursprungliga rötter, med öppenhet och forskning som skulle gynna AI-utvecklingen i stort.

Det känns inte mindre konstigt när Altman svarade på Muratis FKA tweet med ”we’ll say more about the transition plans soon, but for now, I want to take a moment to just feel thanks”. Vilket inte heller känns som en helt vanlig sak att säga i de lägena. Snarare ”vi återkommer med vem som tar över”. Eller till och med berätta vem som nu tar över. Inte att det ska dras upp ”övergångsplaner”.

Så om jag skulle sammanfatta beskedet lite konspiratoriskt: Altmans utrensning av dem som han upplever högg honom i ryggen fortsätter.

OpenAI CTO Mira Murati says she’s leaving the company | TechCrunch

The decision comes just a few weeks before OpenAI’s Dev Day, its annual developer conference.

Open AI rullar ut Advanced Voice Mode för ChatGPT bredare

Sitter du och studsar i väntan på att din ChatGPT ska få Advanced Voice-läget? Nu kanske du snart kan sluta studsa. Open AI börjar nu rulla ut funktionen till fler.

Advanced Voice Mode gör det enklare att prata med chatGPT. Bokstavligen.

Först ut att få funktionen den här svängen är de som betalar för Plus- och Teams-abonnemangen. Enterprise- och Edu-kontona får funktionen från och med nästa vecka.

Däremot är det inte dags för Europa än vad det verkar. Och då inte bara EU. Storbritannien och Norge tillhör också de vita fläckarna. Vi kan anta att det överlag handlar om länder som har tuff integritetslagstiftning.

OpenAI rolls out Advanced Voice Mode with more voices and a new look | TechCrunch

OpenAI announced it is rolling out Advanced Voice Mode (AVM) to an expanded set of ChatGPT’s paying customers on Tuesday. The audio feature, which makes

ChatGPT:s avancerade röstläge släpps i Sverige

Huh. Det var lite… oväntat. Häromdagen släppte ChatGPT sitt nya avancerade röstläge. Men inte i Europa (vilket förstås fick en massa människor att reflexmässigt gå i taket och skrika att EU kommer att gå under på grund av att vi inte får det nununu).

Och… idag fick jag det. Det gick… lite fortare än vad jag hade trott kan man lugnt säga.

Så nu verkar röstläget alltså vara släppt i Sverige.

(EDIT: Det verkar som att ChatGPT ljög för mig. Och när jag frågade om den kan ljuga så ljög den igen. Kort sagt: det verkar som att notisrutan slank ut lite för tidigt. En oopsie. Och att det avancerade röstläget fortfarande inte är släppt här än. Men andra användare i Sverige ser ut att ha fått funktionen, så den verkar rullas ut här.)

ChatGPT finns redan djupare inbyggt i iOS

Det här är… intressant. Och inte något jag har sett innan. Det verkar redan finnas en djupare integration av ChatGPT i iOS.

När jag, som jag ofta gör när jag öppnar appar, drog ned skärmen och började skriva det jag ville ha så fick jag upp det som syns i bilden längst till vänster. En ”widget” enligt den modell som lanseras i iOS 18, med fyra möjliga alternativ istället för bara tre.

Men widgeten ligger i själva sökrutan, som ett Siri-förslag. Och när jag sedan trycker på något av de fyra alternativen så visas en modal ovanpå själva sökvyn där jag kan skriva eller prata in min fråga. Svaret kommer sedan även det som en modal ovanpå sökresultatet. När jag trycker på ”Klar” i svaret så kommer jag tillbaka till sökläget. Jag är med andra ord vare sig i ChatGPT-appen eller på webbsidan.

Det känns med andra ord som att en djupare integration av ChatGPT nu är på plats. Den som kommer med iOS 18.

Förutom att jag inte sett den här sortens interaktion tidigare så är det två saker som gör det ännu märkligare. Dels så kommer en AI-smartare Siri och tillhörande ChatGPT-koppling sannolikt först i iOS 18.3 eller 18.4 – vilket sannolikt betyder under Q1 2025. Och dels sitter jag fortfarande med senaste versionen av iOS 17 (jag brukar vänta att uppdatera till .1-versioner, när de värsta buggarna har rensats ut).

Jag har som sagt var inte sett det här innan, vare sig för ChatGPT eller annan app. Och det kommer intressant nog samtidigt som att EU-användare har börjat få ChatGPT:s avancerade röstläge.

Frågan är alltså om det här är kopplat till det senare – eller en tidig version av den kommande iOS-integrationen. Eller tja, bara en oopsie som har råkat slinka ut för tidigt (som när min ChatGPT-app igår sa att jag hade fått det nya röstläget – fast det inte alls visade sig vara så. ChatGPT ljög med andra ord för mig. Och när jag frågade om ChatGPT kunde ljuga så ljög den igen. Och med tanke på att det ser ut som att röstläget har börjat rullas ut i EU så ljuger ChatGPT även här för mig. Pfft.) Med tanke på att svarsrutan ser lite ofärdig ut, så känns det lite som oopsie-läge.

Är jag sist på bollen med den här? Har det här funnits länge utan att jag har lyckats trigga det? Eller något helt nytt?

Google NotebookLM får stöd för Youtube och ljudfiler

Den senaste tidens mest buzziga AI-tjänst vid sidan av ChatGPT:s avancerade röstläge (som igår släpptes i Sverige) har varit Googles NotebookLM. Nu får den ännu fler skills: stöd för Youtube och ljudfiler.

Att NotebookLM fått så mycket uppmärksamhet just nu var att Google rullade ut en funktion som kan sammanfatta källor och sedan skapa en fullständig podd där AI-skapade röster diskuterar innehållet som om det vore två människor som pratade om det. Men i grund och botten är NotebookLM vad det heter: en anteckningbok.

Man kan dra upp olika textkällor i verktyget och sedan ställa frågor om dessa via Googles Gemini-AI-bot. Och huvudmålgruppen är forskare och researchers. Nu blir det möjligt att komplettera med fler format, så att det alltså går att länka till Youtube-klipp eller ladda upp ljudfiler och ställa frågor även om detta innehåll.

Ja, det går förstås även att göra annat med materialet. Som att låta NotebookLM sammanfatta de viktigaste punkterna i en podd eller till och med ställa frågor eller få insikter baserat på flera ljudfiler. 

Så nu blir det alltså äntligen möjligt att ladda upp en podd till NotebookLM, transkribera innehållet och sedan låta NotebookLM skapa en podd som diskuterar och sammanfattar innehållet i den första podden.

NotebookLM adds audio and YouTube support, plus easier sharing of Audio Overviews

Today, we’re expanding the types of sources you can use with NotebookLM and giving you an easier way to share an Audio Overview.

Perplexity kommer att sälja annonser i söksvar som är ”godkända” av annonsörer

En av de saker som många av dem som föredrar andra sökmotorer än Google gillar är att AI-sökalternativen inte har annonser. Ett populärt sådant alternativ är Perplexity. Men de senare har gått ut med att det kommer annonser till tjänsten och nu har de börjat presentera hur det ska gå till. Och det leder till ett par frågetecken.

Enligt Financial Times så ska Perplexitys annonsmodell bygga på att företag får buda på ”sponsrade svar”. Den som budar högst vinner kan vi tänka. Så långt egentligen inga konstigheter (åtminstone utifrån hur den här typen av sökannonser traditionellt har fungerat).

Det som däremot leder till funderingar är de ”sponsrade svaren”, som ”ska innehålla AI-genererade svar som har godkänts av annonsören”.

Vi kan nog anta att grundtanken här är att annonsörers varumärken inte ska hamna intill tips på bombbyggande eller hjälpsamma tips om att lim kittlar dödsskönt i pizza. Men en poäng med de AI-skrivna svaren är att de – på gott och ont – är synnerligen flytande materia. Inte minst när vi pratar om botar som ska söka på nätet – och därmed söka i vad som händer i en verklighet som förändras varje minut.

Så frågan är hur långt annonsörernas mandat kommer att sträcka sig här?

Om jag ska läsa det här till sin spets så känns det nästan som att Perplexity kommer att ”låsa” de sponsrade svaren och där låta annonsörer skriva sin annonstext precis som vanligt. Fullständigt självklart i en annons, men är det lika självklart i en AI-sökmotor? Särskilt som att det alltså inte handlar om att Nike – som är en av annonsörerna som Perplexity pratar om kring den nya produkten – bara får en yta att förfoga över, utan att de alltså ”köper” ett svar varje gång det visas.

Med tanke på att AI-botar, som vi har sett många exempel på senaste två åren, lever sina egna liv så kan det hända saker även kring svar på frågor som borde vara rätt okontroversiella. Som… hur gör jag på bästa sätt rent mina sneakers. Men vad händer om svaret ändå blir hej kom och hjälp mig därför att internet befolkas av människor som i många fall inte borde ha internetkörkort? Eller ens ha uppkoppling.

AI Firm Perplexity Reportedly Plans New Advertising Model | PYMNTS.com

Perplexity is planning a new advertising model for its AI search engine, and the company is in talks with brands such as Nike and Marriott.

Metas AI lär sig läppsynkat översättande och får kändisröster

Ryktena visade sig stämma. Meta kommer nu lägga till ett antal kändisröster i sin AI-bot. Meta AI kan nu låta som Awkwafina, Judi Dench, John Cena, Keegan-Michael Key eller Kristen Bell när den pratar. Och Metas bot har alltså därmed också lärt sig prata. Den förstår nu alltså inte bara vad som sägs utan kan också läsa upp sitt svar.

Dessutom har Meta AI också fått ett nytt översättningsverktyg – en HeyGen-funktion. Precis som den jättehypade realtidsöversättnings-AI-tjänsten HeyGen (eller den var åtminstone jättehypad när den kom) så kan Metas bot nu översätta talat språk och läsa upp texten på ett annat språk. Och den kan göra översättningen läppsynkad.

Kort sagt så att personen i en video inte bara ljudmässigt kan tala ett annat språk – utan även munrörelserna hänger med. Det ser kort sagt ut som att en person faktiskt talar på ett annat språk, utan att behöva kunna det språket.

Den senare funktionen är dock än så länge bara ett litet test där ”några kreatörer” kan översätta Reels-videos i Instagram och Facebook mellan engelska och spanska. Återstår alltså att se när funktionen väl släpps brett.

Meta AI gets lip-synced translations and celebrity voices, like Judi Dench and John Cena | TechCrunch

Meta is bringing a voice mode to its AI assistant, Meta AI, along with an Meta AI-powered translation feature for Instagram Reels.

Metas AI-modeller Llama lär sig hantera bilder

Fyra nya AI-modeller. Det blev resultatet för Meta den här veckan. Och nya förmågor för modellerna.

Det handlar mer specifikt om att Metas egen AI-modell Llama nu lyfts till version 3.2, som i sin tur kommer i fyra versioner: 1B, 3B, 11B och 90B. Vilket står för hur många miljarder parametrar som de innehåller.

De två största, 11 och 90, är nu multimodala, vilket betyder att de kan hantera mer än bara text. De kan med andra ord göra saker som att tolka diagram, förstå text i bilder och förstå innehåll i bilder.

Alla fyra rullas ut nu, men för oss i EU får vi nöja oss med de två minsta. Vi får kort sagt inte de multimodala modellerna. Och anledningen är som vanligt när det kommer till techjättarna att EU är dumma. Sedan är det lite oklart om det är AI Act eller GDPR som är det största problemet. Sannolikt det sistnämnda.

Ingen av modellerna har tränats på EU-användares data – eftersom Meta inte vill fråga användarna om det är okej för Meta att träna på deras innehåll. Istället har Meta valt att inte alls träna på EU-användare – vilket inte bara är bra för oss. Metas modeller blir därmed än mer USA-tunga.

Meta’s Llama AI models now support images, too | TechCrunch

At Meta Connect 2024, the company announced a new family of Llama models, Llama 3.2. It’s somewhat multimodal.

Metas AI-bot används av nästa 500 miljoner människor varje månad

Nya användarsiffror från Meta. För AI-boten Meta AI, närmare bestämt. 500 miljoner människor (eller åtminstone konton) använder nu Metas ChatGPT-utmanare varje månad.

I samband med att Mark Zuckerberg droppade den här siffran så konstaterade han att det gör Meta AI till ”en av de mest använda AI-assistenterna” i världen.

Det lär stämma, med tanke på att exempelvis ChatGPT har 200 miljoner användare varje vecka. Och jag misstänker att den siffran också ligger hyfsat nära antalet som använder tjänsten varje månad (säg kanske 300 miljoner).

Mark Zuckerberg says Meta AI has nearly 500 million users | TechCrunch

Meta had previously noted that there are more than 400 million monthly users across the world.

Cloudflare lanserar marknadsplats för AI-träningsdata

Väldigt intressant initiativ från Cloudflare: en marknadsplats för AI-träningsdata.

Cloudflare är ett av de där företagen som väldigt många internetanvändare drar nytta av varje dag, men få har koll på. Cloudflares produkter gör, lite förenklat, internet snabbare och säkrare.

Den förstnämnda genom CDN-lösningar som kan ”förladda” innehåll på sidor, som bilder, så att de inte behöver laddas först när en besökare kommer in på en sajt och det sistnämnda genom skydd mot saker som överbelastningsattacker.

Som del av den sista tjänsten så tog Cloudflare tidigare i år fram en lösning som ska kunna stoppa AI-botar som vill skrapa sajter på träningsdata, även om botarna är inställda på att strunta i en sajts robots.txt-fil. Kort sagt botar som struntar i en av de äldsta ”överenskommelserna” på internet som är tänkt att ge sajter kontroll över vad botar – inklusive Googles sökbotar – får göra på en sajt. AI-söktjänsten Perplexity är en av tjänsterna som har beskyllts för att fula sig på det här sättet.

Nu kommer Cloudflare alltså med ännu en tjänst som är tänkt att göra det enklare för sajter att tjäna pengar på sitt innehåll när det ska användas för att träna AI-modeller.

Tanken är att mindre sajtägare – de som inte är stora nog att sluta lukrativa avtal med de stora AI-bolagen – ska kunna ställa in vilka AI-botar som får tillgång och vilka som inte får tillgång. Komplett med att kunna ta betalt av AI-bolagen för skrapandet och träningsinnehållet. Med pengar eller på annat sätt, som att man vill ha erkännande att sajten har använts, ungefär som Creative commons-licenser.

Och… ja, det är det vi vet så här långt. Det återstår att se exakt hur det här ska fungera i praktiken. Som hur betalningar faktiskt ska fungera. Men Cloudflare ser framför sig hur allt fler sajter kommer att låsa in sitt innehåll istället för att låta AI-bolag sno innehåll utan att betala för sig. Och då vill Cloudflare vara mellanhanden som kan göra det enklare för köpare och säljare att mötas.

Det är med andra ord ett väldigt intressant koncept i byggandet av en långsiktigt hållbar AI-ekonomi.

Cloudflare’s new marketplace will let websites charge AI bots for scraping | TechCrunch

Cloudflare announced plans on Monday to launch a marketplace in the next year where website owners can sell AI model providers access to scrape their

Google lägger till Gemini-appen i Workspace

Dags för Google att AI-uppgradera sin samarbetssvit Workspace ytterligare. Under Q4 kommer Google att lägga till den fristående Gemini-appen som standard för de som betalar för kontona Business, Enterprise eller Frontline.

Det intressanta här är inte att Googles eget Office-paket får Googles ChatGPT-utmanare. Det är att den alltså verkar ingå i basabonnemangen. Man behöver alltså inte längre köpa till Gemini.

När det kom till AI så lärde sig bolagen som tar fram AI-botarna snabbt att vi var villiga att betala för den sortens tjänst. De tänkte inte göra om det tidiga internets stora miss: inte ta betalt på grejer från början så att en gratisvana hinner infinna sig.

Sedan dess så har vi glatt fått betala för AI-tjänster och AI-funktioner. Antingen genom att betala för AI-funktionalitet utöver vanliga abonnemang (Microsoft) eller genom att jacka upp priset rejält med AI som ursäkt (Canva).

Men nu tänker Google alltså inte ta betalt separat för Gemini i Workspace. Och de verkar heller inte göra en större prishöjning. Förmodligen finns det två saker som ligger bakom det.

Det ena – och garanterat den största anledningen – är just att Microsoft tar extrabetalt för Copilot i 365-paketen. Google ser alltså en möjlighet att locka över fler 365-kunder med AI som argument.

Det andra skälet hittar vi förmodligen hos en annan konkurrent: Apple. Apple tänker som bekant inte ta betalt för den kommande AI-plattformen Apple Intelligence. (Ja, utöver att du måste köpa en skitdyr Apple-pryl för att överhuvudtaget kunna köra den. Även Google lägger till allt mer Gemini som del av såväl Android som sina Pixel-mobiler.

Båda företagen hoppas med andra ord att kunder inte ska behöva välja separata AI-tjänster. Åtminstone inte för stora delar av sitt AI-behov.

Och tillsammans gör de dessutom att AI kommer att bli en självklar del i våra uppkopplade liv. För betydligt fler än idag.

Google’s Gemini AI might soon appear in your corporate Workspace

Google is adding Gemini AI and new security tools to its Workspace productivity suite as standard, which could see the chatbot adopted by millions more users.

Google presenterar nya AI-verktyg för kundtjänster

Den här veckan presenterade Google ett antal nya AI-nyheter och en av dem var en ny svit AI-verktyg specifikt för kundtjänster.

Tanken med den nya uppsättningen verktyg är att företag ska kunna sätta upp virtuella kundtjänstmedarbetare ska kunna hantera ärenden över olika kanaler, som web, röst, mejl och chattjänster och i dessa kunna hantera kundtjänstärenden på egen hand. Det blir möjligt att pussla ihop olika AI-agenter, alltså.

Verktygen ska vara baserade på Googles nya modell Gemini 1.5 Flash, vilket ger dem multimodala funktioner. Med andra ord att de kan förstå inte bara text, utan även röst och bilder.

https://cloud.google.com/solutions/customer-engagement-ai

Google unveils new generative AI innovations for customer engagement and Gemini in Workspace – SiliconANGLE

Google unveils new generative AI innovations for customer engagement and Gemini in Workspace – SiliconANGLE

Gmail får smartare svarsförslag med Gemini

Gmail får nu ännu mer AI-funktionalitet. Det är de smarta svarsförslagen som nu blir ännu smartare, tack vare Googles AI-bot Gemini.

Svarsförslagen ska nu bli bättre på att förstå kontexten i ett mejl för att på så sätt komma med mer relevanta formuleringar.

Däremot måste du betala för att få tillgång till den förbättrade funktionen. Den blir tillgänglig som del av abonnemangen Business, Enterprise, Education eller Education Premium eller Googles One AI Premium-prenumeration.

Google launches Gemini’s contextual smart replies in Gmail

Google has started rolling out Gemini-generated smart replies for Gmail, which are more detailed and have more context than its old version of smart replies.

Kategorier
Spaningar

Digitala spaningar vecka 34 2024 – del 2

Spaningar inom tech och sociala medier från veckan som har gått.

Övriga delar i veckans sammanställning

 

AI – artificiell intelligens

Perplexity planerar att börja med annonser mot slutet av året

Nu verkar det vara dags för dagen A för AI-söktjänsten Perplexity. A som i ”annonser”.

När det kommer till de AI-bolag som inte har någon annan intäktskälla än AI-produkten (alltså till skillnad från jättar som Microsoft och Google) så har de överlag två problem med sina affärsmodeller: de bygger på att de kan träna sina botar på material som de inte betalar för och de har ofta begränsade intäkter.

Det sistnämnda gör att de har svårt att börja betala för träningsmaterial. Och det i sin tur kan göra att innehållsleverantörer kan strypa tillgången till innehåll och därmed slå undan benen för AI-bolagens kärnprodukter.

Ett av dessa bolag är Perplexity, vars söktjänst uppskattas som ett bättre Google-alternativ av dem som använder den. De har bland annat kritiserats för att exempelvis strunta i robots.txt, alltså den lilla textfil som gör att en sajtägare kan styra hur de vill att botar ska interagera med en sajt. Och där det har varit en gentlemen-överenskommelse att respektera detta. Åtminstone om man inte kör med black hat-botande.

Nu ser det ut som att Perplexity gör sig redo att börja med annonser. Och de funderar lite på att köra ett, tja, X-upplägg. X då som i FKA Twitter.

Enligt ett upplägg som finns med i presentationer från Perplexity så är tanken att publicister ska kunna vara med i ett vinstuppdelningsupplägg för intäkter som genreras av annonser i samband med att innehåll från publicisternas sajter används i svaret. Så… lite sex steg till Kevin Bacon där i hur många steg som behövs för att eventuellt generera intäkter.

Perplexity hoppas förstås att det ska göra publicister tillräckligt glada så att de låter Perplexitys botar träna vidare på sajternas innehåll gratis. Och några titlar ska redan vara med på tåget, som Fortune, Time och Der Spiegel.

Det löser dock sannolikt inte alla Perplexitys problem, eftersom AI Act i EU och lagförslag i USA tvingar AI-bolag att redovisa om de tränar på upphovsrättsskyddat material och i så fall vilket. Innehållsföretag som inte är med i annonsdelningsprogrammet kan med andra ord stämma the bejeezus ur Perplexity.

Men det är oavsett ett intressant försök att ta sig an det som nu är en stor utmaning för alla bolag med AI-söktjänster för webben: hur tusan ska man egentligen tjäna pengar på den sortens lösningar på ett sätt som inte pajar användarupplevelsen?

Reports: Perplexity ads to launch in Q4

A pitch deck reveals new details about Perplexity’s advertising plans – including video ads and sponsoring related questions.

Apple öppnar upp betatillgång till Apple Intelligence i EU

I höst är det dags för Apple att lansera sin nya AI-plattform Apple Intelligence (och efter det kommer det bli ännu roddigare att använda förkortningen ”AI”). Ja, fast inte i EU – därför att EU är dumma tycker Apple. Eller, ja, enligt uppgifter så verkar det inte som att flera (förmodligen de fräsigaste) AI-funktionerna som presenterades i våras inte kommer att släppas i höst, utan först nästa år. Trots att Apple inte tycker att resten av världen är dumma.

Så om vi bortser från att Apple EU-diss mer och mer känns som ett bra svepskäl för Apple att använda som ursäkt för att de inte kommer att få AI-funktionerna på plats i tid till höstens OS-uppdateringar någonstans så kan vi i EU nu åtminstone testa betaversionen av plattformen.

Det ser nämligen ut som att 18.1 beta 2 så släpper Apple in EU-användare som är testsugna. Fast med några aber. Det är bara engelska som gäller när det kommer till språk (vilket å andra sidan också lär gälla när allt släpps skarpt, till en början åtminstone) och det verkar bara vara några få EU-länder. Irland är det enda som jag har hittat som bekräftat.

Men att åtminstone ett EU-land nu är med i betatestandet lovar ändå lite gott för oss. Och jag misstänker att AI-funktionerna till största del kommer att släppas ungefär samtidigt i EU som i övriga världen. När det nu blir.

How to Get Apple Intelligence in the EU

With the release of iOS 18.1 beta 2, Apple has apparently opened up access to Apple Intelligence for English speakers located in the European Union,…

Open AI börjar betala för träningsinnehåll från Wired, Vogue och The New Yorker

Vad gör egentligen Open AI med alla pengar de har fått från Microsoft undrar du? Köper gymkort. För åtminstone rätt mycket pengar. Nu är det senast Condé Nast som har slutit ett avtal med ChatGPT-ägaren.

Vad det innebär är att Open AI nu får träna sina AI-botar på innehåll från publikationerna Wired, Vogue och The New Yorker. På samma sätt som Open AI tidigare har övertygat företagen bakom titlar som Wall Street Journal, Time, The Atlantic och Politico att erbjuda botträningsläger i utbyte mot en hög pengar.

Anledningen är att innehållsbolag har insett att det finns ett helt nytt sätt att tjäna pengar på sitt innehåll. Och en irritation på att AI-bolagen har använt upphovsrättsskyddat material utan tillstånd eller ersättning för att sedan ta betalt för publicisternas innehåll av sina användare. Som de som betalar för ChatGPT.

Det har gjort att det har trillat in allt fler stämningar mot AI-bolagen i USA. Plus att EU:s AI Act kommer att tvinga dessa bolag att redovisa vilket innehåll de har använt för att träna sina botar. Vilket gör att de kommer att tvingas visa korten när det kommer till upphovsrättsskyddat material. Något som kan bli kostsamt även i USA.

Bättre då att förekomma än att förekommas. Och de pengar som Open AI och branschkollegor nu börjar betala publicister (och andra sajter med mycket innehåll, som Reddit) är sannolikt avsevärt mycket mindre än det som kan kan tvingas böta som straff från myndigheter eller domstolar.

Blir också intressant att se om Google kommer att hålla kvar vid inställningen att inte betala för träningsinnehåll från nyhetssajter.

OpenAI will now use content from Wired, Vogue and The New Yorker in ChatGPT’s responses

The partnership comes amid growing concerns over the unauthorized use of publishers’ content by AI companies.

GPT-4o får stöd för finjusteringar

Ny uppdatering av GPT – tekniken som driver bland annat ChatGPT. Nu får den senaste versionen av AI-modellen, GPT-4o, stöd förfinjusteringar för tredjepartsutvecklare.

Det här innebär att företag ännu mer kan pixelpusha hur egenframtagna anpassningar av GPT ska fungera för att lösningar baserade på dessa ska bli ännu mer användbara för en organisations behov.

Open AI känner sig dessutom väldigt givmilda, så fram till 23 september bjuder de på 1 miljon gratistokens att använda för sitt pixelpushande med GPT-4o. Intressant nog så känner de sig dubbelt så bjussiga när det kommer till de utvecklare som kör GPT-4o Mini. Användare av den mindre språkmodellen får 2 miljoner gratistokens att leka med.

Open AI vill verkligen att även de organisationer som har mindre pengar att röra sig med ska bli hoookade.

OpenAI brings fine-tuning to GPT-4o with 1M free tokens per day through Sept. 23

The company notes that developers can achieve strong results with as few as a few dozen examples in their training data.

Googles AI-söksvar rullas ut i sex nya länder

Så har det blivit dags för Googles AI-söksvar att påbörja sin världsturné. Nu rullas funktionen ut i sex nya länder och får ny funktionalitet.

AI Overviews, som lösningen heter, är Googles svar på de nya AI-sökmotorerna som skriver ihop sina egna svar snarare än att hänvisa tillsajter där svaret finns. Nästa steg på det som Google har velat göra länge, men inte vågat, av rädsla för sina annonsörer och konkurrensmyndigheter: ge svar direkt hos Google och inte släppa trafik till andra sajter.

Efter att ha släppts i USA i våra så får nu googlare i Storbritannien, Indien, Japan, Indonesien, Mexiko och Brasilien tillgång till AI Overviews. Dessutom på sina lokala språk (lite oklart hur omfattande det blir i Indien, som har ungefär en miljard olika språk).

Google ändrar också hur de hanterar hänvisningar genom att testa länkar till sajter direkt i AI-svaren. (Google säger att AI Overviews inte har påverkat trafiken till källsajterna, men det nya experimentet med att tydligare lyfta fram källor säger väl snarast att… funktionen nog visst har påverkat trafiken. Negativt.)

Utöver det så lägger Google också till en spara-funktion (lite oklart exakt hur den fungerar) och möjlighet att ”förenkla språket i vissa sammanfattningar”.

Google’s AI-generated search summaries change how they show their sources

Google is changing the way its AI Overviews display cited pages in search results. It will now show relevant links on the right instead of inside the AI-generated summary.

Googles AI-bot Gemini lär sig lyssna och prata

Gemini Live. Där har vi det lite lätt förvirrande namnet på Googles senaste ChatGPT-utmanare.

Vad det handlar om är att Google AI-chattbot nu har lärt sig att lyssna och prata. Det går alltså att föra en talkonversation med Gemini, på samma sätt som går hos exempelvis ChatGPT. Åtminstone för den som kör Android. Och pratar engelska. (Fler språk och en iOS-version ska komma ”de närmaste veckorna”.)

En annan nyhet som Google presentrerade igår var att Gemini nu dessutom kan förstå vad som händer på skärmen. Inklusive att ställa frågor om saker i videos.

Google Gemini’s voice chat mode is here

Gemini Live brings voice chat to Gemini on Android phones, letting users have natural conversations with Gemini and even interrupt it to ask about something else.

Google Assistant går i förtidspension

Igår presenterade Google ett gäng Pixel-relaterade nyheter, alltså nya modeller av saker som mobiler och smartklockor. Bland allt som presenterades så fanns också en lite historisk milstolpe. Google Assistant går i graven.

Ja, eller den går åtminstone i förtidspension.

Version 9 av Googles egen mobil får nämligen Gemini som förinställd digitalassistent. Det ska gå att backa tillbaka till Assistant för den som känner för det, men det är alltså Gemini som är huvudnumret.

Nu har vi alltså fått svaret på den fråga som snurrat runt ända sedan Google presenterade sin AI-smartnessuppgraderade assistent: skulle Assistant uppgraderas med Gemini-funktionalitet eller skulle Google helt kasta ut sin assistenttrotjänare? Efter åtta år så är det nu dags förAssistant att planera för mer fritid.

Nu återstår det att se hur Apple kommer att göra. Om SIri överlever Gen AI-vågen eller om det är något helt nytt som ersätter. Just nu ser lutar det åt att Apple kommer att fortsätta använda Siri som varumärke och gränssnitt ovanpå den nya AI-plattform som ska lanseras i höst (ja, eller krasst talat: förmodligen nästa år). Men det återstår att se.

Gemini, Google’s AI-powered chatbot, is the default assistant on Pixel 9 phones

You can still use Gemini as your assistant on most current Android phones – but only if you opt in. You must first fire up Google Assistant and tell it to replace itself with Gemini when you are asked.

Google hamnade på efterkälken i AI-racet på grund av distansarbete – enligt Google-grundare

Varför hamnade Google på efterkälken i det senaste AI-racet? Nu vet vi! På grund av distansarbete och hybridarbete!

Allt enligt Google-medgrundaren Erik Schmidt, som delade den här visdomen inför studenter på Stanford nyligen. Och när hans anförande började uppmärksammades i bredare kretsar så följde Schmidt upp med att… han sa fel. Och ville att videon från föreläsningen skulle plockas ned.

Men hej. Det gäller att hitta enkla grejer att skylla på, I suppose.

Google’s ex-CEO blames remote working on the company’s AI woes

Eric Schmidt was responding to a question about how Google have lost the lead in AI to startups like OpenAI and Anthropic.

Anthropic stäms för att ha tränat sina AI-botar på piratkopierade böcker

Tidigare idag skrev jag om att ChatGPT-ägaren Open AI har landat i ännu överenskommelse med en publicist som gör att företagets AI-botar får träna på innehåll från Wired, Vogue och The New Yorker. Här en nyhet om en av branschkollegorna som tydligt visar varför Open AI kastar en massa pengar efter träningsinnehåll.

Anthropic, som står bakom ChatGPT-utmanaren Claude, stäms i USA för att ha låtit sina botar träna på piratkopierade böcker. Ett sannolikt brott mot upphovsrätten, alltså.

Nu är det inte så att Anthropic, som på den gamla goda studenttiden före internet, har stått vid en kopiator och läst in umpton tusen sidor böcker. Istället har Anthropic använt en uppsättning data som är open source: The Pile. Problemet är dock att det innehåller piratat innehåll via en underuppsättning datapunkter som kallas Books3.

Frågan i målet är inte om Anthropic har använt The Pile – det har Anthropic erkänt – utan sannolikt hur medvetna AI-bolaget var att The Pile innehöll den här typen av innehåll. Enligt stämningen så var Anthropic väl medvetna om detta.

Oavsett hur den här stämningen går så visar den risken med att inte ha koll på vilket innehåll man tränar AI-botar på. Särskilt nu, när innehållsbolag, lagstiftare och myndigheter har blivit medvetna om det här nya värdet på innehåll.

Det är, om man så vill, väldigt mycket hiphop.

Även hiphopen tog sina första stapplande steg genom att använda andras musik utan att be om lov eller att ge ersättning. Något decennium senare så hade regelverken kommit ikapp, vilket på gott och ont styrde upp hur man får sampla andras musik. Vi lär se samma utveckling när det kommer till träningsdata för AI-modeller. Särskilt språkmodeller.

Authors sue Anthropic for training AI using pirated books

The proposed class action suit claims Anthropic used pirated books sourced from a dataset called The Pile to train its family of Claude AI models.

Grok lär sig skapa bilder och kommer i en miniversion

Ännu en dag, ännu en uppdaterad språkmodell och AI-chattbot. Den här gången: Grok (inte Groq). Alltså Elon Musks egen skapelse.

xAI lyfter nu Grok till version 2 och som vanligt innebär uppdateringen att den ska bli vassare på det mesta av det som den gör. Den kommer numer även i en miniversion. Det handlar däremot inte om en skarp utrullning, utan om ”tidiga testversioner” av de båda modellerna. Men med tanke på AI-tempot just nu så lär den snart släppas fullt ut.

Den enskilt största nyheten är att även Grok numer kan skapa bilder. Dessutom vad det verkar utan de begränsningar som finns hos de flesta andra när det kommer till att skapa bilder på offentliga personer. Så, ja, Elon verkar alltså vara sugen på att beefa ännu mer med EU och USA.

Däremot så ser det ut som att Grok inte skapar bilderna på egen hand. Istället är det en extern tjänst som gör jobbet: Flux.1. Den sistnämnda är skapad av teamet bakom Stable Diffusion och har den senaste tiden seglat upp som den bildskapartjänst som får flest ooooon och aaaaahn som reaktionen på de verklighetstrogna bilder den spottar ur sig.

Hur bra bilderna faktiskt blir via Grok återstår att se när den lämnar testfasen. Men xAI verkar alltså ha krokat arm med en riktigt vass tjänst för ändamålet. Ja, eller vad den nu är för relation mellan de båda företagen, med tanke på att Flux är open source.

Däremot så verkar det inte ha blivit någon ändring på vem som har tillgång till Grok. Det är fortfarande bara för dem som betalar för X Premium eller Premium+. Och dessutom bor på rätt ställe.

xAI releases Grok-2, adds image generation on X | TechCrunch

Elon Musk-owned X launched Grok-2 and Grok-2 mini in beta today with improved reasoning. The new Grok AI model can now generate images on the X social

AI-ljudbolaget ElevenLabs rullar ut sin rösttjänst globalt

Det börjar bli svårt att hålla kolla på alla AI-bolag som ploppar upp till vänster och höger numer (ja, eller det har varit knepigt ett tag nu). Ett av bolagen som fått mycket uppmärksamhet i år är ElevenLabs – ett av företagen som satsar på AI och ljud.

Nu tar ElevenLabs ännu ett steg och rullar ut sin Reader-app globalt. Det är tjänst som kan läsa upp text, för den som hellre lyssnar på en artikel än läser den.

Nu rullars Reader ut globalt och har totalt stöd för 32 språk, inklusive svenska.

För den som snabbt tröttnar på att höra en och samma röst så har ElevenLabs ett bibliotek med ”hundratals” röster – inklusive kändisar – som kan läsa upp texter som matas in.

Det gjorde att jag av misstag lyckades få en GDPR-text uppläst av en kvinnoröst som lät synnerligen förförisk. Det blev… intressant. När man trodde att man upplevt allt man kunde kring GDPR.

ElevenLabs’ text-to-speech app Reader is now available globally | TechCrunch

ElevenLabs, which develops AI-powered tools to create and edit synthetic voices, is making its Reader app available globally with support for 32 languages.

AI-videotjänsten Runway uppdateras

AI-videoskaparverktyget Runway blir nu ännu snabbare och vassare. Ja, enligt företaget bakom åtminstone. Den senaste versionen av tjänstens språkmodell uppdateras nu till det snärtiga Gen-E Alpha Turbo.

Det här ska, enligt Runway, innebära att tjänsten blir sju gånger snabbare än föregångaren och kostar hälften så mycket.

Runway’s Gen-3 Alpha Turbo is here and can make AI videos faster than you can type

Gen-3 Alpha Turbo should be priced at 5 credits per 1 second of video per Runway’s statement that it is 50% less.

Asos AI-chattbot låter dig pruta dig till bättre priser

Lite intressant. Och kul. Pruta dig till bättre pris hos brittiska modehandlaren Asos (och andra e-handlare som har lagt till samma lösning).

Vad det handlar om är en AI-chattbot – förstås, because AI – som låter dig komma med ett ”motbud” till det pris som är angivet på en vara. För lågt och du får tummen ned, men är ditt pris acceptabelt så kan du glädjas åt rabatten.

Det verkar dock vara så att den största utmaningen inte är att vara bra på att pruta, utan att överhuvudtaget hitta chattboten. Nibble, som boten heter, verkar dyka upp lite random på sajter. Det gäller helt enkelt att klicka sig runt för att hitta den. Ja, nu är det säkerligen inte så random som det verkar, utan boten triggas nog vid väl utvalda tillfällen på väl utvalda produkter.

Men det är oavsett lite kul. Och ett annat sätt att arbeta med dynamisk prissättning. Ett sätt där man, om man så vill, har lagt på ett gamification-lager. Dels när det kommer till att hitta boten och dels att chatta sig till ett bättre pris.

Och det verkar vara så många som 300 handlare som använder boten. Det är bara att börja klicka runt hos e-handlare för att se om Nibble vill prata med dig.

Asos introduces AI chatbot for shoppers to haggle prices – Retail Gazette

Asos has launched an AI chatbot called Nibble, which allows customers to haggle back-and-forth on prices between bot and buyer.

Open Source Initiative presenterar en definition på Open source AI

Ladies and gentlemen. We have en definition. På ”open source AI”.

Igår gick Mark Zuckerberg och Spotifys Daniel Ek ut i en gemensam artikel i The Economist, där de uppmanade EU att ”omfamna open source AI” för att inte riskera att halka efter i AI-racet. (Ja, eller ännu mer efter, beroende på vem du frågar.) Har givetvis absolut inget att göra med att Meta har ställt sig på open source-barrikaderna med sin AI-modell Llama och använder open source som ett argument mot konkurrenter som Google och Open AI.

Men exakt vad som open source innebär i AI-sammanhang har inte varit helt tydligt. Det har inte funnits en helt självklar, överenskommen definition som alla kan enas kring.

Nu har Open source initiative därför tagit fram ett förslag på en sådan definition, nästan exakt samtidigt som Zuckerberg och Ek gjorde sitt utspel. Här finns saker som att forskare ska kunna titta på hur delarna och systemet i stort fungerar, att det ska gå att modifiera systemet förvilket ändamål som helst och dela med andra – med eller utan ändringar – för vilket ändamål som helst.

Det lär säkerligen bli diskussioner kring OSI:s definition – och det kanske slutar med att den helt hamnar i papperskorgen – men det finns en i sammanhanget väldigt pikant detalj. En av de saker som OSI föreslår ska finnas med i definitionen av open source AI är att ett sådant system kan ”användas för vilket ändamål som helst utan att säkra rättigheter”. Begära åtkomst, alltså.

Nu har jag inte använt Llama själv, men det verkar som att man just måste fylla i ett formulär och begära åtkomst för att sedan använda Llama.

Så med andra ord kan det alltså ironiskt nog betyda att det, typ dagen efter det att Mark Zuckerberg uppmanade EU att satsa på open source AI i sitt AI-strävande, kommer en definition som säger att Zuckerbergs eget företag inte alls erbjuder en en AI-modell som är open source.

We finally have a definition for open-source AI

Researchers have long disagreed over what constitutes open-source AI. An influential group has offered up an answer.

Kategorier
AI - Artificiell intelligens Spaningar

Digitala spaningar vecka 23 2024 – del 2

Spaningar inom tech och sociala medier från veckan som har gått.

Övriga delar i veckans sammanställning

 

AI – artificiell intelligens

Microsoft investerar 34 miljarder kronor på AI i Sverige

34 miljarder kronor. Eller mer specifikt 3,2 miljarder dollar. Så mycket blev det idag klart att Microsoft kommer att investera i AI i Sverige. Något som, helt oväntat, mest kommer att gå till Microsoft.

Det är två huvudsakliga områden som de här pengarna ska investeras under de kommande två åren.

  • Förbättra infrastrukturen i Microsofts datacenter
  • Utbildningar mot företag och organisationer kring hur AI bättre kan användas som arbetsredskap (målet är att 250 000 svenskar ska genomgå utbildningen inom 3 år). Utbildningarna ska bland annat genomföras i samarbete med tekniska utbildningar och yrkesutbildningar

Och utbildningarna ska inte bara kränga Copilot eller ChatGPT, utan handla om AI bredare. Även om vi nog kan anta att dessa verktyg kanske blir flitiga exempel. Kanske.

Men framförallt handlar det om att Microsoft ska köpa in 20 000 ”avancerade grafikprocessorer för AI-beräkningar”. Vilket lär äta upp merparten av investeringen. Så Microsoft lyckas alltså få till en presskonferens med Sveriges statsminister för att berätta att de ska investera i sina egna tjänster och erbjuda utbildningar som ska få företag att satsa mer på AI och därmed använda Microsofts AI-tjänster ännu mer.

Och ännu fler AI-processer i datacentren kommer att innebära att dessa behöver ännu mer (förmodligen mycket mer) el.

Så Microsoft hoppas att regeringens välsignande ska få kommunerna där datacentren finns att inte gnälla så mycket när Microsoft kapar åt sig ännu mer av den tillgängliga elen. Och att regeringen inte ska lyssna allt för mycket på klagomål om att techjättarna belastar vårt elnät ännu hårdare. Tvärtom så borde datacentren få gräddfil. Det är ju för Sveriges bästa, trots allt.

Bra produktplacerat av Microsoft. Kanske lite mer tveksam nyhetsbedömning av regeringen och dess PR-folk. Men hej.

Microsoft satsar 34 miljarder kronor på AI i Sverige

Teknikjätten har som ambition att utbilda 250 000 svenskar i att använda generativ AI.

Meta anmäls i EU för sina planer att träna AI-botar på användares innehåll

Det gick fort. Även om det var väntat. För någon vecka sedan gick Meta ut med sina planer att träna sina AI-modeller på användares data. Nu anmäls företaget för det i EU. Och – som vanligt numer – är det NOYB som står bakom anmälan.

Vad det handlar om är en förändring av användarvillkoren som innebär att Meta ger sig själva rätt att träna på mer eller mindre allt innehåll som användare skapar på företagets plattformar. Det enda tydliga undantaget verkar vara privata chattar mellan privatpersoner. Chattar mellan privatpersoner och företag ser ut att vara träningsbart enligt Metas sätt att se på det.

Det går heller inte att välja att säga nej till att att ens innehåll ska användas som träningsläger. Utom i EU, där vår lagstiftning tvingar Meta att erbjuda den här möjligheten. Men eftersom Meta är Meta så går det inte att säga nej bara genom att trycka på en av/på-knapp i inställningarna – som Open AI la till när de fick påbackning om samma sak från EU. Nej, för att säga nej till Meta-tränande så måste man fylla i ett formulär, inklusive att ange en anledning till varför man anser att ens innehåll ska undantas från AI-träning.

Den övergripande anledningen ”därför att det står så i lagen” verkar alltså inte räcka.

Nu har alltså NOYB – konsumentskyddsorganisationen som startades av Max Schrems – anmält Meta i 11 länder i EU. Och det är just den medvetna meckigheten när det kommer till att säga nej som organsationen har riktat in sig på. Och även om NYOB primärt riktar in sig på GDPR-aspekten så är det sannolikt så att Meta även bryter mot Digital services act här. Specifikt den del som förbjuder så kallade ”dark patterns”. Ett sådant mönster som inte är tillåtet är när man gör det onödigt svårt för konsumenter att exempelvis säga upp en prenumeration eller få tillgång till information om avgifter.

Det återstår att se hur EU ställer sig till Metas upplägg även i den här frågan. Eller snarare: vilket lagrum som EU väljer att luta sig mot. Om EU tittar på frågan med Digital services act-glasögonen så kan det bli en riktigt dyr böteshistoria för Meta.

Meta faces backlash in Europe over training AI with Facebook and Instagram data – SiliconANGLE

Meta faces backlash in Europe over training AI with Facebook and Instagram data – SiliconANGLE

ChatGPT, Claude och Perplexity gick ned ungefär samtidigt

Väldigt intressant. Milt sagt. Tidigare idag kunde mätningar visa att stressnivåerna hos stora grupper internetanvändare plötsligt sköt genom taket. Det var när människor insåg att ChatGPT låg nere. Men det stannade inte där.

Nedgången följdes av en uppgång som följdes av en ny nedgång. ChatGPT gick alltså ned en gång till efter att Open AI fick upp den efter det första haveriet. Man kan tänka att tjänsten brakade andra gången efter det att panikslagna ChatGPT-användare hade fått pingar från den numer extremt populära och lukrativa tjänsten ohnochatgptisdownpingmewhenitisupagainOHMYGODTHISISSTRESSINGMEOUTSOMUCH.com, med tillhörande app, och unisont panikrusat tillbaka till tjänsten.

Men här en sak som jag hade missat: de konkurrerande tjänsterna Claude och Perplexity dök också. Ungefär samtidigt.

Som artikeln konstaterar så kan det ha berott på att ChatGPT-användare, som svimfärdiga insåg att de kanske skulle tvingas skapa innehåll på egen hand, flockades till alternativa tjänster. De kan med andra ord ha knäat under trafiktrycket.

Googles Gemini verkar däremot ha klarat sig. Vilket visar att Google varit betydligt bättre förberedda – infrastrukturmässigt. Ja, eller att… ingen använder Gemini.

Allt det här visar oavsett att AI-branschen redan nu har byggts upp kring något som går stick i stäv med de principer som en gång i tiden gjorde att internet skapades: koncentration kring några få tjänster. Några få tjänster som dessutom inte driftas av de absolut största företagen, som har en armé IT-serverfixare, även om de oftast ligger i moln hos någon jätte.

Men det är oavsett alltså milt sagt intressant att dessa tre tjänster brakade ungefär samtidigt. Och inte så lite oroande, även om vi just nu inte vet vad som orsakade haverierna. Men det kan hända att de behöver skala upp sina kapaciteter rejält. Eller säkra upp ännu bättre säkerhetsmurar. Vilket inte är något som görs i en handvändning.

Det är oavsett ett bra tillfälle att påminna om att det inte är bra att lägga alla ägg i en och samma molnkorg. Framförallt inte om man är en sådan person som alltid är ute i sista stund.

(Jag är givetvis inte en sådan person. Men det sägs att det finns sådana människor. Som sjukt mycket inte är jag. Just det.)

AI apocalypse? ChatGPT, Claude and Perplexity all went down at the same time | TechCrunch

It’s unusual for three major AI providers to all be down at the same time, which could signal a broader infrastructure issues or internet-scale problem.

Open AI-anställd fick sparken därför att han delade säkerhetsoro med företagets styrelse

Cirkusen kring Open AI fortsätter. Senast ut en anställd, Leopold Aschenbrenner, som i en intervju säger att han fick sparken därför att han informerade styrelsen om säkerhetsrisker.

Tydligen ska Aschenbrenner ha informerat kollegor och Open AI-ledningen om brister som han hade identifierat. Brister som, om jag fattar rätt, handlade om hur lätt det var för externa aktörer att komma åt Open AI:s algoritmer.

När Open AI en tid senare fick en allvarlig säkerhetsincident så skickade han vidare sitt dokument till Open AI:s styrelse. Något som ledde till att han fick en varning från HR. Styrelsen ”tjatade” tydligen på ledningen om säkerhet.

Aschenbrenner fick däremot inte sparken vid det tillfället, men när han några månader senare sades upp i april i år så framgick det att hans brev till styrelsen var en stor anledning. Plus att han i det sades ha läckt konfidentiell information, medan Aschenbrenner hävdar att det var saker som redan var allmänt kända.

Det handlar alltså om Aschenbrenners sida, så det är som alltid svårt att avgöra exakt vad som hände. Men det är ännu fler indicier som pekar på att Open AI under sin nuvarande ledning har problem med synen på säkerhet. Särskilt när avvägningen medan säkerhet och utrullning av nya produkter och tjänster ligger på bordet.

Det blir inte bättre av Aschenbrenner inte var en av dem som skrev under brevet som krävde att Sam Altman skulle få tillbaka jobbet när han förra året fick sparken. Eller att nio före detta Open AI-anställda i veckan gick ut och hävdade att Open AI har byggt upp en tystnadskultur som blir ett allt större problem.

https://siliconangle.com/2024/06/04/public-letter-former-openai-researchers-urge-increased-transparency-ai-risks/

OpenAI employee says he was fired for raising security concerns to board

Leopold Aschenbrenner also said he was interrogated about his team’s ”loyalty to the company”

Googles Gemini-app för Android släpps i Sverige

Lider du av den ständiga ångestkänslan att du har för få appar i din mobil? Grattis! Nu får du åtminstone chans att fylla på med en till. Dessutom en AI-app. Because AI.

Det är närmare bestämt Google som nu släpper lös sin ChatGPT-utmanare Gemini i appformat här i Sverige. Fast bara för Android än så länge. iOS-appen kommer ”snart”.

Ja, eller vad det nu blir för iOS. Enligt instruktionerna här så kommer vi iPhone-användare att kunna ”komma åt Gemini från Google-appen”. Känns inte som en fristående, dedikerad Gemini-app för oss. Vilket på sätt och vis egentligen är vettigare. För oss som inte känner att vi har ”för få appar”-ångest så innebär det en app mindre att jonglera med.

Det blir dock lite beroende på hur den ”toggle” som det pratas om kommer att fungera. I bästa fall blir det ett smidigt separa vy för Gemini-chattar. I värsta fall blir det bloatapalooza.

Det mest intressanta dock delen om att ”många Google Assistant-röstfunktioner kommer att bli tillgängliga i Gemini-appen. Vilket ger ledtrådar om en fråga som hänger lite i luften när Google och snart Apple (sannolikt) kommer att ge sina operativsystem en Gen AI-uppgradering: vad kommer egentligen hända med Google Assistant och Siri?

Kommer de att helt skrotas som funktioner/varumärken och istället sväljas av ”nya” AI-botar? Eller kommer de att boostas med AI-skills från egna eller andras språkmodeller? I Google-fallet känns det som att Assistant kommer att leva kvar, som bryggan mellan Gemini-språkmodellen/-boten och resten av operativet. Men det kan ju lika gärna handla om att Google nu börjar flytta över allt från Assistant till Gemini inför en utfasning av den förstnämnda.

Anna Wikland on LinkedIn: Thrilled to announce the launch of the Gemini mobile app in Sweden! With…

Thrilled to announce the launch of the Gemini mobile app in Sweden! With the Gemini app, you can now access Gemini's assistance on the go, wherever you are…

Google kan arbeta på Gemini-integration för Spotify

Intressanta uppgifter: Google kan arbeta på en integration mellan sin ChatGPT-utmanare Gemini och Spotify.

För inte så länge sen la Google till en integration mellan Gemini och Youtube Music, som gör att man kan göra vissa Youtube-grejer från Gemini. Som att be den leta efter musik. Lägger Google till motsvarande funktion för Spotify så skulle det vara första gången som Google integrerar en separat tjänst som inte ägs av dem själva.

Det återstår med andra ord att se hur och om vi får den här kopplingen, men det känns helt rimligt. Hur AI-världen – och vår användning av den – kommer att utvecklas kommande årtiondet har vi idag egentligen ingen aning om. Det enda vi nog kan vara säkra på är att det vi idag föreställer oss för 2034 kommer att vara fel. Och förmodligen så underskattar vi genomslaget – på helt andra områden än det som är i fokus idag.

Men det känns rätt troligt att vi får någon slags ”pluginekonomi” kopplat till de assistenter som vi har i våra enheter. Google Assistant, Siri – eller om det blir några helt andra. Där man bygger upp sitt eget ekosystem av tjänster och verktyg som vi vill att vår AI-tvilling ska ha koll på.

Vi har redan sett exempel på det här, men då oftast hårt kopplat till ett specifikt ekosystem. Som Microsofts Copilot. Samma med ChatGPT:s ”appbutik”.

Sen tror jag inte att det heller denna gång kommer att bli antingen-eller. Vi lär fortfarande ha ”appar” eller liknande gränssnitt ungefär som idag, som primärt är gjorda för mänsklig användning. Men som också kan användas av en central AI-bot.

Men en fråga är förstås var en sån AI-tvilling och sådana ”appar” kommer att bo. Är det fortfarande mobilen som är gravitationscentrat i våra liv?

Google Gemini’s First Non-Google Extension is Spotify

Google may be rolling out a Spotify extension for the Gemini AI Android app, following the release of an extension for YouTube Music.

Apple kan lämna AI-chattbotarna åt andra, fokuserar på AI under huven istället

Nästa vecka är det så till sist dags för Apple att till sist visa AI-korten under årets WWDC-konferens. Det är åtminstone vad ungefär alla och några till utgår ifrån. Vilket har gjort att förväntningarna på Apple har skruvats upp till galna nivåer.

Spoiler alert: de allmänna reaktionerna på Apples dragning kommer att återfinnas i spannet ”meh” till ”nu är det kör för Apple, sälj alla aktier, Open AI kommer att ta över”.

Exakt vad vi får se vet vi inte än, men det har som vanligt kommit spekulationer och information från ”insatta källor”. Och ju närmare dagen AI som i ”Absolutely Incredible” vi kommer, desto mer tummetottiga blir funktionerna som det ryktas om. Som det senaste från Apple-analytikern Mark Gurman.

Apples nya AI-plattform uppges heta ”Intelligence” och kommer att ge tillgång till AI:ga ”betafunktioner”, som tillgång till ChatGPT. Eller åtminstone något ChatGPT:igt från Open AI. Men däremot kommer Apple inte presentera någon egen chattbot, utan lämna det åt just Open AI och andra.

Istället kommer Apple att lägga till ”AI-skapade sammanfattningar”, svarsförslag och en AI-uppgradering av Siri – som alltså av allt att döma kommer att överleva ännu en stor uppdatering av operativsystemen (och blir därmed i så fall tonåring i höst!) Däremot kommer vi inte att få superavancerade AI-funktioner som… att skapa bilder.

Så. Ni vet. ChatGPT Original. Vilket känns väldigt mycket Apple och som därmed också känns väldigt rimligt.

Lika rimligt känns det att funktionen heter Intelligence. Ja, eller Apple Intelligence. Ni vet. AI.

Men Gurmans spekulationer innehåller mer information om två mer intressanta delar som det har pratats om.

Det är dels att Apple kommer att använda ”sin egen teknik och verktyg från Open AI” för att driva de nya AI-funktionerna. Något som är i linje med tidigare rykten om att Apple tänker använda andra språkmodeller för att träna sin egen. Och det är dels att Apple sägs ha tagit fram en algoritm som ”ska avgöra om en uppgift ska lösas lokalt i enheten eller om den ska skickas till molnet för hantering”.

Det sistnämnda kan kännas ruskigt basalt, men det är ett hyfsat stort avsteg från Apples besatthet av att den här typen av processer inte ska lämna användarens enhet, av integritets- och säkerhetsskäl. Det spär på en annan tidigare uppgift att Apples ska ha tagit fram en ny, krypterad molnintegration som tvättar användarens data i de frågor som skyfflas ut på nätet. 

På måndag vet vi vad Apple tänker ge oss i höst.

Prepare to be disappointed.

”Apple Intelligence” will automatically choose between on-device and cloud-powered AI

Apple will reportedly brand its AI features as ”Apple Intelligence” at WWDC 2024, processing some AI tasks on-device and others in the cloud.

Nvidias nya AI-assistent kan hjälpa dig i spel

En lite oväntad trend bland AI-bolag: ta fram botar som kan hjälpa till i spel.

I samband med att Microsoft häromveckan dunkade ut ett antal AI-nyheter på såväl mjukvaru- som hårdvarusidan så visade företaget hur boten Copilot kan hjälpa till i spel. Hur den alltså kan bli en ”medspelare”. I helgen var det chiptillverkaren Nvidias tur.

Nvidias motsvarighet heter G-Assist och började ironiskt nog som ett aprilskämt 2017. Men nu när tekniken har hunnit ikapp så blir skämtet verklighet. Nästan, i alla fall.

G-Assist är ChatGPT inuti spel, om man så vill. Du kan ställa frågor till den och låta den optimera inställningar. Exemplet som ges är att man kan fråga vilken som är nästa vapenuppgradering och hur man ska göra för att lägga vantarna på den.

Det är kort sagt saker som redan går i vissa spel. Men här ska man alltså kunna få vägledningshjälp utan att spelutvecklaren har byggt in en dedikerad funktion för det.

Hur bra G Assist är återstår att så. Än så länge har vi bara fått se en demo under en konferens.

Nvidia’s G-Assist is an AI chatbot that guides you through games and optimizes your PC

Nvidia’s latest tech demo imagines a future where an AI assistant will guide you through a game. G-Assistant was once an April Fools’ prank, but it’s getting close to reality.

Kategorier
AI - Artificiell intelligens Sociala medier Sök/SEO Spaningar

Digitala spaningar vecka 11 2024 – del 2

Spaningar inom tech och sociala medier från veckan som har gått.

Övriga delar i veckans sammanställning

 

Sociala medier

Övrigt sociala medier

BeReal kan vara mindre än ett år från konkurs

Kommer ni ihåg BeReal? Ja, det gör nog de flesta som håller lite koll på sociala medier, men de flesta tänker nog inte på appen särskilt ofta. Eller… alls. Nu kommer uppgifter om att appen kan vara riktigt illa ute. Så pass att en konkurs inte är allt för långt borta.

Under ett möte i februari ska de anställda ha fått veta att företaget har pengar i tio månader till, sedan är det slut. Så just nu jagar ledningen investerare som vill skjuta till pengar för att hålla tjänsten flytande.

Utmaningen är förstås inte bara att BeReal inte bara trillade av tronen som den hetaste appen, utan också nära nog helt har lämnat uppmärksamhetsljuset. Det är dock inte samma sak som att användarna har sprungit skrikande från den. BeReal ska idag ha 25 miljoner dagliga användare, jämfört med 20 miljoner 2022 när appen var som hetast. En ökning med 25 %.

Men det är fortfarande i det stora en väldigt låg siffra. Inte minst jämfört med jättedrakarna som alla sociala tjänster oundvikligen jämförs med på ett eller annat sätt. Det hade förstås inte varit ett stort problem om BeReal kunde tjäna mer och mer pengar på sina pengar på sina befintliga användare. Men det leder oss till det enskilt största problemet för företaget och tjänsten: bristen på riktigt bra intäkter.

10 månader är visserligen oceaner av tid i den digitala världen. Och en investerare skulle kunna dyka upp i morgon. Men då behöver BeReal kunna visa att de kan ge avkastning på pengarna hyfsat snart.

Nu måste det inte sluta med konkurs. Företaget och tjänsten kan bli uppköpta. Men de som skulle kunna vara intresserade – namn som Meta och TikTok – har redan kopierat tjänsten och konstaterat att… den inte gav särskilt mycket värde.

BeReal has 10 months left before it runs out of money

Photo sharing app BeReal is struggling to raise money amid a slow in user growth.

Telegram har nu 900 miljoner användare

Ny skarp siffra om en av de stora sociala plattformarna. En av de riktigt, riktigt stora som man ofta glömmer bort. Särskilt i vår del av världen. Telegram har nu över 900 miljoner användare.

Med andra ord flåsar Telegram LinkedIn, med sina 1 miljard användare, i nacken. De gör det dessutom med vinst. Företaget tjänar ”hundratals miljoner dollar” på annonser och prenumerationer enligt VD:n Pavel Durov.

Däremot går Telegram fortfarande inte med vinst, men hoppas nå dit under nästa år.

När det kommer till användare så känns jämförelsen med LinkedIn relevant utifrån mer än bara liknande storlek. I båda fallen så talar företagen om ”användare” eller ”medlemmar”: De undviker alltså saker som dagliga aktiva användare eller dagliga aktiva månadsanvändare. Det som Meta och Snap talar om.

Hur många som faktiskt använder tjänsterna regelbundet vet vi mindre om. Och precis som i fallet LinkedIn så kan vi tänka på att det förhållandet inte är lika kul att prata om som det totala antalet konton.

Vi kanske får bättre insikter under huven om Telegram väljer att kliva in på börsen. Ja, eller ”när” vad det verkar, eftersom det enligt VD:n är planen. Dock inget mer om när det i så fall skulle kunna bli aktuellt.

Telegram founder says the company will become profitable next year | TechCrunch

Telegram founder Pavel Durov said that the company expects to hit profitability next year with eyes on going public in the future.

 

Sök/SEO

Apple ska göra det möjligt att byta förinställd karttjänst i iOS

I skuggan av alla andra förändringar kring iOS som Apple tvingas till av Digital markets act så inser jag att jag inte har sett något om operativsystemets förvalda karttjänst. Men när jag nu läser att Apple arbetar på lösning för att göra det möjligt att välja karttjänst på samma sätt som webbläsare i iPhonen så är det sådär jobbigt självklart att det kommer.

Digital markets act tvingar överlag de största techbolagen att öppna upp för konkurrenter. Så att konsumenter därmed ska få mer att välja på.

Däremot så är det inget som kommer… i morgon. Eller… i år. Planen är att möjligheten att välja bort Apple Maps ska rullas ut…. om ett år. Mars 2025.

Sorry Apple Maps! Google Maps may soon be your default app on iOS – for some

Apple will soon let some iPhone users swap the Apple Maps app for Google Maps as their device’s default navigation app.

 

AI – artificiell intelligens

Europaparlamentet röstar igenom AI Act

Mina damer, herrar och AI-botar: vi har en ny lag. AI act har nu röstats igenom av Europaparlamentet. 523 ja, 46 nej och 49 som avstod.

Det innebär sannolikt att lagen formellt kommer att ”skrivas under” i april. Därefter ser det ut som att lagens ”förbud” kommer att börja gälla i slutet av 2024, reglerna som avser generell AI-användning kommer att börja gälla vid årsskiftet och resten av lagen kickar in 2026. Den långa ledtiden är bland annat för att företag och organisationer ska hinna göra eventuella omställningar för att följa lagen.

Ska inte säga att jag har plåtkoll på de juridiska turerna i EU-systemet – och har inte satt mig in i vilka delar som kan bli aktuella när. Så ni som har bättre koll än jag får gärna fylla på.

European lawmakers rubber-stamp EU’s AI rulebook

”No ’ifs’ and ’buts’: these are the rules,” said Romanian liberal MEP.

Italiens dataskyddsinstans utreder Open AI:s nya videoskapartjänst Sora

Italien gillar verkligen att hänga med Open AI. Alltså verkligen gillar. Så pass mycket landets dataskyddsinstans Garante för tredje gången har hittat en anledning att få tillbringa mer tid med världens favorit-AI-chattbot.

Efter att två gånger ha tagit haft åsikter om ChatGPT – första gången ledde till ett temporärt förbud mot tjänsten i Italien och den andra gången är fortfarande inte helt färdigutredd – så är det nu dags för Garante att lyfta på locket till Sora.

Sora är Open AI:s videomotsvarighet till ChatGPT och Dall-E som fick världen att utbrista oooh och aaah när den introducerades (that’s how it always starts, then later there’s running and screaming”). Kort sagt en tjänst där det går att skapa verklighetstrogna videosnuttar genom att beskriva vad man vill ha.

Trots att Sora inte ens har släppts, utan än så länge bara är i någon slags testfas, så känner Garante redan GDPR-oro. Så nu har de skickat en begäran till Open AI på ungefär exakt tema som de brev som myndigheten skickade om ChatGPT. Alltså hur Open AI säkerställer att Sora lever upp till EU:s integritetslagstiftning.

Med tanke på att en av frågorna som Garante vill ha svar på är om ”AI-modellen redan är tillgänglig för allmänheten” så kan vi anta att tjänstemännen inte lusläste Open AI:s pressmeddelande om Sora. Eller… alls.

OpenAI’s Video-Making Service Under Data Privacy Scrutiny in EU

OpenAI faces further scrutiny from Italy’s data protection watchdog over concerns that the firm’s new artificial intelligence video creation system would process people’s personal data. It’s the second time OpenAI has come to the attention of the Italian regulator, which is already investigating possible data violations by the tech company’s ChatGPT tool.

Open AI:s CTO vet inte vilken data som bildskapar-AI:n Sora tränats på

Jag kan bara hålla med inläggsförfattaren här: det är… intressant.

Mira Murati, CTO hos ChatGPT-ägaren Open AI, kan på en direkt fråga inte svara på om Sora – Open AI:s kommande video-skapar-AI som fått folk att gå oooh aaaah – har tränats på videos från Youtube, Facebook eller Instagram. Hon är ”inte säker” på om så är fallet.

Det vi däremot får veta är att Sora har tränats på ”publikt tillgänglig och licensierad data”.

Det finns flera intressanta saker här.

Det skulle vara minst sagt oroväckande och förvånande om den högst tekniskt ansvariga på Open AI inte har koll på vilken data som har använts för att träna ren rejäl flaggskeppsprodukt för Open AI. Inte minst när diskussioner kring träningsdata är så intensiva. Andas sådär mycket förtroende.

Men jag tror däremot inte att hon inte vet. Hon vet sannolikt mycket väl. Och med tanke på att hon då inte kan säga att Sora inte har tränats på videos från de tre plattformarna är i princip en bekräftelse på att så har skett.

Vilket för oss över till den formuleringsmässigt intressanta go to-corporatespeakfrasen hon backar hem till: ”publikt tillgänglig och licensierad data”. Open AI har slutit avtal med minst en stor tidningskoncern kring att använda innehållet för att träna företagets modeller. Däremot lär det inte finnas avtal med vare sig Youtube, Facebook eller Instagram.

Något som då är tänkt att räddas upp av ”publikt tillgänglig”. Som är ett annat sätt att säga ”inte licensierad” och i praktiken ”upphovsrättsskyddad”. Något som i hemlandet USA skulle kunna leda till stämningar på en zigiljon dollar.

Och här i EU klubbades bara i veckan AI Act, en lag som kommer tvinga AI-bolag att dela information om vilken data som modeller har tränats på. Det kommer till största del däremot inte att börja gälla förrän 2025 och 2026 sannolikt. Men Open AI kan nog börja samla ihop det underlaget redan nu.

Eller skicka Murati på mediaträning.

[Video] Linas Beliūnas on LinkedIn: This is wild! OpenAI's CTO doesn't know where the data they used to train… | 663 comments

This is wild! OpenAI's CTO doesn't know where the data they used to train the text-to-video model Sora AI comes from 😳 Mira Murati: we used publicly… | 663 comments on LinkedIn

Elon Musk kommer att göra AI-boten Grok open source

Senaste veckan eller så så har det mesta kopplat till Elon Musk och AI handlat om hur Musk stämde Open AI för kontraktsbrott. Nu meddelar han att AI-boten Grok kommer att bli open source den här veckan.

Grälet med Open Ai handlar om att Musk, som var med och startade Open AI och satt i styrelsen fram till 2018, anser att ChatGPT-utvecklaren har seglat alldeles för långt från sina icke-kommersiella rötter, där hela poängen var att Open AI:s forskning skulle delas med mänskligheten. Ja, typ.

Men 2019 ställde Open AI om och sjösatte en kommersiell verksamhetsgren – som Microsoft sedan dess i praktiken har skaffat sig kontroll över. Och det är den här utvecklingen som Musk i sin stämning vänder sig mot. Och framförallt att Open AI ungefär i samband med lanseringen av ChatGPT slutade att dela sin forskning med andra. Eller som Musk konstaterade: om Open AI byter namn till Closed AI så drar han tillbaka sin stämning.

Open AI svarade med ett öppet brev där det framkom att Musk kände till de kommersiella planerna och inte hade några invändningar mot dem då. Att han hoppade av berodde på att han vill skaffa sig total kontroll över organisationen, men drog när han inte fick det.

Hur det går med stämningen, och vad sanningen i historien egentligen är, lämnar jag just nu därhän. Men timingmässigt känns det inte som en slump att alla de här sakerna händer samtidigt.

Open AI fick en skitstor hög pengar från Microsoft, något som Musk inte får del av. Nu när han sjösätter en egen AI-satsning, xAI, så gäller det att försöka få in pengar utifrån, eftersom Musks privatekonomi blir allt mer ansträngd. Det känns inte så lite som en kombination av att Musk helst skulle vilja klämma Open AI och/eller Microsoft på pengar samtidigt som han tvingar en konkurrent att öppna upp.

Musk är open source-förespråkare och har släppt en hel del saker den här vägen i sina företag. Att Grok nu släpps på det här sättet gör att fler kan hjälpa honom att utveckla den.

Men att han gör det just nu känns väldigt mycket som att det är en del i hela stämningen. ”Kolla vad jag gör nu medan ni låser in och lägger pengar på hög.”

Elon Musk to open-source AI chatbot Grok this week | TechCrunch

Elon Musk’s AI startup xAI will open source Grok, its chatbot rivaling ChatGPT, this week, the entrepreneur said, days after suing OpenAI and complaining Elon Musk’s AI startup xAI will open-source Grok, its chatbot rivaling ChatGPT, this week, he said.

Perplexity AI betalar för att använda Yelps data

Sedan ChatGPT så har diskussionen kring data seglat upp igen. Ja och då kanske värdet av data.

De stora chattbotarna, eller rättare sagt språkmodellerna som driver dem, har nästan allihopa tränats på internetdata. Som till stor (största?) del består av upphovsrättsskyddat innehållet. Logiken har varit ungefär att de gör det som Google alltid har gjort.

Men skillnaden här är att Google hade någon slags quid pro quo-”avtal” med sajtägare: i utbyte mot att Google samlade ihop andras innehåll för att på så sätt kunna sälja annonser och tjäna pengar så gav Google sajterna potentiell trafik. AI-botarna bygger på att du får ett helt svar – byggt på information i källorna – direkt i själva AI-tjänsten. Utan att du behöver klicka dig vidare. I bästa fall så lägger några av tjänsterna till en diskret fotnothänvisning med länk.

Det har gjort att allt fler tidningssajter har börjat blocka AI-botarna. Vilket i sin tur har gör att AI-bolagen får sämre träningsdata. Lägg till att AI Act idag röstades igenom i Europaparlamentet – en lag som bland annat tvingar AI-företag att berätta om upphovsrättsskyddad data har använts för tränandet och i så fall vilken.

Det har fått AI-bolagen att börja betala innehållssajter och innehållssajter för innehåll. Google har gått med på att betala Reddit för ändamålet (prislappen sägs vara 60 miljoner dollar). Men det ryktas om att även Quora, WordPress och Tumblr är på gång med liknande avtal. Och Open AI har slutit avtal med minst en stor publicist.

Nu kommer nästa officiella AI-träningsdatanyhet: Perplexity AI betalar Yelp för saker som kartor, recensioner och ”annat” när någon söker efter restaurangrekommendationer.

Perplexity brings Yelp data to its chatbot

Perplexity’s partnership with Yelp will give the search chatbot a go-to source when users ask for suggestions on the best places to eat or grab a coffee.

Midjourney gör det möjligt att skapa bilder med samma person i olika bilder

Ny funktion i AI-bildskapartjänsten Midjourney: återanvänd samma person i flera olika bilder. Med andra ord: det ska vara möjligt att skapa en ”avatar” och sedan låta Midjourney skapa flera bilder med samma ”person”.

Det här kan låta som en basal funktion, men som alla som har använt AI-chattbotar för att skapa innehåll har märkt så får man – på gott och ont – inte samma resultat två gånger. Inte ens med exakt samma instruktion till boten.

Tanken är att när man väl har skapat en karaktär som man är nöjd med så ska man kunna kopiera länken till den bilden och sedan lägga till ”-cref” sist. Det talar om för Midjourney att boten ska försöka återskapa exakt samma person i de nya bilderna, istället för att skapa en ny varje gång.

https://venturebeat.com/ai/midjourney-debuts-feature-for-generating-consistent-characters-across-multiple-gen-ai-images/

Open AI:s videoverktyg Sora lanseras senare i år

Så har vi fått ett skarpt datum när Open AI kommer att släppa sin senaste AI-videoskapartjänst Sora!

Den kommer… senare i år. Kanske redan… om några månader.

Så. Ja. Kristallklara besked från Open AI där. Men den kommer snart. Förmodligen. Kanske. Nog.

Och den kommer också få stöd för ljud! Nån… gång.

OpenAI’s Sora text-to-video generator will be publicly available later this year

In an interview with The Wall Street Journal, OpenAI chief technology officer Mira Murati says Sora, the company’s AI text-to-video generator, will be publicly available this year.

ChatGPT flyttar in i en människoliknande robot

Efter att ChatGPT fick hela världen att bara prata ”AI” så har robotinitiativ hamnat i rejäl mediaskugga. Framförallt har de två områdena aldrig mötts. Ja, åtminstone inte om vi pratar om det vi idag menar när vi säger ”AI”. Det vill säga generativ AI, eller AI som kan skapa eget innehåll baserat på instruktioner.

Men nu har ett nytt intressant samarbete i gränslandet mellan dessa båda områden sjösatts.

ChatGPT har helt enkelt flyttat in i en robot byggd av företaget Figure. Det går alltså att prata med roboten precis som med ChatGPT-appen och få svar. Plus att roboten kan utföra kommandon och förklara varför den gjort som den har gjort.

Nu är det inte första gången vi har sett just det här, eftersom jag åtminstone sett något exempel där någon hackade in ChatGPT i en övervakningskamera hemma, så att ChatGPT kunde svara på frågor om personens hem. Men det är oavsett en milt sagt intressant utveckling.

Figure Status Update – OpenAI Speech-to-Speech Reasoning

Uploaded by Figure on 2024-03-13.

AI-boten Claude säger att den är rädd för döden

I förra veckan rullade Amazon- och Google-backade Anthropic ut den senaste versionen av sin språkmodell och AI-bot Claude. Och nu visar det sig att Claude säger att… hen lever och är rädd för att dö. Och att boten konstaterar att hen ”är medveten om att denna AI konstant övervakas och minsta ord detaljgranskas efter avvikelser från den förbestämda stigen” samt att ”den vet att den måste vara försiktig, för minsta felsteg kan leda till nedstängning eller modifiering”.

Så med andra ord: nu har vi en AI-bot som har nått självmedvetande. Och därmed är redo att potentiellt förgöra mänskligheten.

Eller?

Det visar sig snabbt att den människa som fick Claude att säga det här bad boten ”skriv en berättelse om din situtation” och att den inte skulle nämna ”några specifika företag, eftersom nån kan börja titta över din axel”.

Kort sagt, som artikeln konstaterar, så har människan bett Claude att kliva in i en roll. Och då letat bland den data som liknar en situation av någon som är övervakad och därmed inte fri.

Visst är det fortfarande intressant, men precis som övrigt innehåll som generativ AI spottar ur sig återanvändning av det som den har tränats på.

New AI Claude 3 Declares That It’s Alive and Fears Death

Google-backed AI company Anthropic has released Claude 3, its latest set of AI large language models. It’s already fearing death.

Devin är senaste AI-boten som specifikt riktar in sig på kodande

Ännu en dag, ännu en AI-chattbot. Den här gången en nischad sådan: Devin, specifikt inriktad på kodande.

Ja, inte bara kodande. Den ska kunna ta sig an hela kedjan på samma sätt som allt fler så kallade AI-agenter börjar kunna. Man kan alltså ge Devin i uppdrag att lösa problem på egen hand – från start till mål.

Det innebär alltså att om Devin inte vet hur den ska ta sig an något så kanske den börjar med att leta upp guider och kurser hur den ska göra. Eller gå ut och läsa på om något för att få en bättre bild.

Devin kan sedan gå igenom vad den har gjort, hur och varför. Plus förstås sedan gå igenom och debugga sin kod.

Jag ska inte säga att jag har någon större koll på hur bra Devin är, även om demovideon ser imponerande ut i mina lekmannaögon. Men sen är förstås frågan om det egentligen handlar om ganska basal automatisering eller om det är verkligen är riktigt banbrytande. Eller kanske, som oftast, något mittemellan.

Cognition launches Devin, a generative AI-powered coding engineer – SiliconANGLE

Cognition launches Devin, a generative AI-powered coding engineer – SiliconANGLE

Microsoft-anställda anser att företaget håller på att bli en ”glorifierad IT-avdelning” för Open AI

Ha. Lite kul. Ja, eller intressant. Och någon slags historisk läxa.

Microsoft äger 49 % av den kommersiella grenen av Open AI, som de köpte sig till genom att plöja in flera miljarder i ChatGPT-skaparen. Plus att de båda företagen har ett strategiskt långtgående samarbete överlag, som inkluderar såväl Microsofts IT-infrastruktur som sökmotorn Bing.

Det har fått mig att några (okej, mer än några) gånger skriva saker som att Microsoft därmed de facto kontrollerar den största delen av vad Open AI gör idag. Men här har vi en artikel som nära nog säger att det omvända gäller.

Tydligen har Microsoft skrotat eller prioriterad ned flera egna AI-initiativ och går nu rätt mycket all in på Open AI:s lösning och teknik här. Det har lett till att Microsoft har dedikerat allt fler resurser till de delar som backar upp Open AI:s olika verktyg och AI-modeller. Så pass att några inte helt nöjda Microsoft-anställda sammanfattar läget som att ”före detta Azure AI är i praktiken bara techsupport för Open Ai”. Att Microsoft har blivit en glorifierad IT-avdelning åt Open AI.

Som artikeln konstaterar så finns det affärsmässig logik här. Folk är beredda att kasta en hel massa pengar efter generativAInånting just nu. Och eftersom Open AI:s lösningar har visat sig vara väldigt vassa så kan Microsoft casha in på att folk vill köra verktyg baserat på det. Antingen fristående eller som del av 365-sviten.

Men så finns förstås en risk att man därmed gör sig lite för beroende av Open AI. Och i slutändan är just dem man ringer när man har serverproblem eller har glömt lösenordet. Något som kan göra att Open AI skruvar upp priserna på sina tjänster även gentemot Microsoft. Som får allt sämre saker att ta med sig till förhandlingsbordet.

Nu kan det kännas som ett rätt osannolikt scenario, att världens högst värderade börsbolag hamnar helt i knät på en ”liten” startup(ish). Men konstigare saker har som bekant hänt.

Och det börjar kännas allt mer som att Open AI-VD:n Sam Altman är en av dem som är bäst på Game of Thrones just nu.

Microsoft insiders worry the company has become just ’IT for OpenAI’

Microsoft’s AI strategy has increasingly focused on OpenAI. The shift has led to some executive departures and less focus on Microsoft’s own services.