The Next Medium: Why Real-Time Interactive Video Changes Everything — Ahmed Ahres, Reactor
Ahmed Ahres argumenterar att realtidsinteraktiv video inte bara är snabbare utan en helt ny medium — ungefär som GPS förändrade navigering och viewfinder förändrade filmmaking.
Han definierar world models som video som genereras så snabbt att du kan styra den medan den skapas, vilket han demonstrerar genom att prompta in en katt i en scen medan den fortfarande genereras. Detta öppnar tre möjligheter: kontrollutrymmen där du får omedelbar feedback, världar där AI-karaktärer kan träna robotar eller användas i utbildning, och live-avatarer (som han medger fortfarande inte fungerar bra). Tekniskt kräver det helt nya system — istället för att skicka filer tillbaka måste servrar strömma pixlar i realtid, varje session måste minnas vad som hände, och latensen måste under 100 millisekunder.
Sammanfattningen är skriven av Vibekollen utifrån källans egen publicering. Innehållet tillhör AI Engineer.
Mer från AI Engineer
SOTA Generative Media Panel — Dumitru Erhan, Shane Gu & Nicole Brichtova, Google DeepMind
AI Engineer 30 aug.
Tell the Robot What You Want — Sandhya Subramani, AWS
AI Engineer 29 aug.
The Signal Layer: What to Build When Anything Can Be Built — Lena Hall, Akamai
AI Engineer 29 aug.
Tribal Dungeons of Global Shipping: AI Agents at Global Scale — Dmitry Buykin, Maersk
AI Engineer 29 aug.