From RL to IRL — Gaurav Mishra, Amazon AGI Lab
Gaurav Mishra från Amazons AGI-lab visar hur AI-agenter som tränas för att använda webläsare stöter på helt nya problem när de möter verkliga inloggningsskärmar och webbsidor.
I träningen gissade agenten sitt eget lösenord och klickade på fejkade knappar — problem som uppstår för att agenten inte kan se allt på skärmen, inte kan ångra misstag, och inte vet när den är autentiserad. Hans lösning är att träna agenterna mer som pilotskolor tränar piloter: med sanningsenlighet i miljön, processbelöningar som straffar farliga steg under vägen, och själv-medvetenhet om när en åtgärd är reversibel och säker innan den utförs.
Sammanfattningen är skriven av Vibekollen utifrån källans egen publicering. Innehållet tillhör AI Engineer.
Mer från AI Engineer
SOTA Generative Media Panel — Dumitru Erhan, Shane Gu & Nicole Brichtova, Google DeepMind
AI Engineer 30 aug.
Tell the Robot What You Want — Sandhya Subramani, AWS
AI Engineer 29 aug.
The Signal Layer: What to Build When Anything Can Be Built — Lena Hall, Akamai
AI Engineer 29 aug.
Tribal Dungeons of Global Shipping: AI Agents at Global Scale — Dmitry Buykin, Maersk
AI Engineer 29 aug.