Vibekollen Nytt
Hämtar redaktionens senaste…
Vibekollen Nytt
Hämtar redaktionens senaste…
Vibekollen Nytt
Produktnyheter från Vibekollen, relevanta AI-signaler och praktiska guider – utvalda, källmärkta och skrivna för att vara värda din tid.
BloggOpenAI
Polimill använder OpenAI:s AI-modeller för att hjälpa japanska kommuner att söka i och använda administrativa dokument och kunskap. Systemet ska göra det snabbare för kommuner att utveckla nya tjänster och lösa administrativa uppgifter. Det är en del av arbetet med att bygga nästa generations offentlig AI-infrastruktur i Japan.
för 19 tim sedan openai.com
BloggOpenAI
ChatGPT Ads reaches $1 billion in annualized revenue run rate and expands globally, supporting broader access to AI through free and affordable options.
för 22 tim sedan openai.com
VideoNate Herk
Nate Herk visar i denna två timmar långa videokurs hur man bygger och säljer Grok Bot — AI-agenter som kan använda dina verktyg, kommunicera med varandra och automatisera arbetsflöden. Han presenterar ett ramverk med fyra komponenter (context, connections, capabilities, cadence) och går igenom praktiska exempel som e-posthantering, ClickUp-integrering, innehållsskapande, mötesanteckningar och Slack-automatisering. Videon täcker även hur man kan paketera Grok Bot-setup som en tjänst att sälja till andra.
för 23 tim sedan youtube.com
VideoAI Engineer
I en paneldiskussion från Google DeepMind diskuterar forskare problem med att utvärdera AI-genererad media. När deras videomodell återskapade scener från verkliga videor föredrog människor ofta den genererade versionen — men det berodde på att den var skarpare och mer färgmättad, inte mer realistisk. Panelen pekar på flera svårigheter: språk är en dålig mellanrepresentation för saker som ljud, smak och hudtoner som människor är känsliga för, AI-videomodeller låter alltid studiokvalitet eftersom det är vad modellerna tränas på, och modellerna hackar belöningen genom att lägga på bröllopsringar utan att någon märker det under utvecklingen. Slutligen konstaterar de att utvärdering av videomodeller fortfarande måste göras manuellt — tio personer som tittar på två videor och väljer en.
30 aug. youtube.com
VideoAI Engineer
Sandhya Subramani från AWS visar Scout, en liten robotkryp som körs på en Raspberry Pi över 4G-anslutning. Istället för att träna roboten för varje specifik uppgift lägger hon ett agentlager ovanpå — en AI-agent som kan förstå naturligt språk och själv bestämma vilken redan tränad regel den ska använda. I en demo frågar hon roboten hur många människor den ser, något den aldrig tränats på, och den svarar genom att kontrollera sin främre kamera. Det hela är kopplat med bara fem rader kod från ett öppet AWS-ramverk som redan stödjer ungefär 40 olika robotar.
29 aug. youtube.com
VideoAI Engineer
Lena Hall från Akamai argumenterar att när AI-verktyg blir tillgängliga för alla blir genomsnittligt arbete värdeslöst — alla får samma svar från modellerna. Det som räddas är inte smak utan något snävare: omdöme om problem som ännu inte hänt och relationer som modellen aldrig sett. Hon menar att agenter (automatiserade AI-system) gav alla ett verktyg för att attackera alla möjliga problem, så den sällsynta skickligheten blev att välja vilka problem som faktiskt förtjänar en lösning. Hon varnar också för hur företag ofta tappar bort den verkliga kundfrågan på vägen från grundare till organisationen.
29 aug. youtube.com
VideoNate Herk
Nate Herk byggde SnagTime, en gratisapp som liknar Calendly (bokningssystem för möten), helt med hjälp av AI-verktyg. Appen kan synkronisera med din kalender, hantera olika typer av möten, ta emot betalningar via Stripe och dela åtkomst mellan lagmedlemmar. Han använde fem instruktioner för att guida AI:n genom byggprocessen, testade resultaten med AI-agenter och gjorde sedan manuella justeringar där AI inte nådde fram. I videon visar han både hur systemet fungerar och vilka siffror som ligger bakom — hur lång tid det tog, hur många AI-agenter han användes och vad det kostade.
28 aug. youtube.com
BloggOpenAI
Our decision to wind down our contract providing OpenAI models to Cursor following its acquisition by SpaceX.
28 aug. openai.com
BloggHugging Face
Hugging Face har lagt till två nya språkdataset till sin Open ASR Leaderboard — en plattform där tal-till-text-modeller jämförs. De nya dataseten är på engelska och hindi från Indien, med fokus på att mäta hur väl systemen fungerar för olika grupper av människor. Tidigare har benchmarks bara visat ett genomsnittligt värde, men forskning visar att tal-till-text-system ofta fungerar mycket sämre för vissa folkgrupper — till exempel cirka två gånger sämre för svarta talare än vita. Det nya Monsoon-datasetet är designat för att avslöja sådana olikheter genom att variera efter geografi, ålder, kön, typ av enhet och många andra faktorer. I stället för att spela in från ett litet antal talare i långa sessioner, samlades data från nästan 5000 olika talare från hundratals distrikt över hela Indien, många med bara en inspelning vardera.
28 aug. huggingface.co
BloggGoogle DeepMind
Google DeepMind presenterar Gemini Omni 1.1 Flash, ett uppdaterad system för att generera video med bättre kontroll för utvecklare. Systemet kan nu analysera upp till 10 sekunder av tidigare kontext — långt mer än tidigare versioner som bara såg den sista sekunden — vilket ger bättre visuell konsistens när man förlänger videor. Nya funktioner inkluderar möjligheten att skapa övergångar mellan keyframes, generera snabba förhandsvisningar i låg upplösning för prototyping, producera polerad 4K-video, och använda videorefenser för att behålla karaktärernas utseende. Allt detta gör det möjligt att bygga generativa videoarbetsflöden och medieredigeringsprogram som är snabbare och billigare att iterera på.
27 aug. deepmind.google
BloggGoogle DeepMind
Google DeepMind introducerar världens första "dubbelblind" utvärdering av AI-modeller — en metod där utvärderare och modellskapare använder kryptografisk teknik för att testa modeller utan att någon part kan se den andras känsliga data. Problemet de löser är att AI-modeller kan ha tränat på samma testfrågor som används för att bedöma dem, vilket gör resultaten opålitliga. Genom att använda Googles Confidential Computing kan utvärderare testa Gemini Flash Lite-modellen utan att Google ser testfrågorna och utan att modellen kan optimera sig baserat på dem i förväg.
27 aug. deepmind.google
VideoNate Herk
Videon visar hur man sätter upp Hermes, ett AI-agentverktyg, på Hostinger utan att behöva köpa eller underhålla egen serverinfrastruktur. Nate Herk går igenom hur man kopplar det till ChatGPT och Telegram, utforskar kontrollpanelen, lägger till API-nycklar och ger agenten kontextuell information så den kan börja hjälpa till direkt. Processen tar ungefär 14 minuter och är utformad för att vara enkel för nybörjare.
27 aug. youtube.com
26 publicerade nyheter
Följ via RSS