Your Agent Didn't Fail. Your Harness Did. — Vinoth Govindarajan, OpenAI
Videon handlar om fel som uppstår inte i AI-modellen själv utan i systemet omkring den — det som kallas "harness failures".
Problemet är att agenter kan svara självsäkert från gammal data medan två processer skriver över varandra utan att krascha, eller när ett verktyg anropas men aldrig får svar. Lösningen är att se det som: modellen föreslår, systemet genomför, och en kvittans bevisar att det faktiskt hände. Föreläsaren visar vanliga misstag som felaktig tillåelse, saknade deadlines och state som aldrig sparas, och presenterar fem frågor man bör ställa för varje incident: vad startade det, vilken state ärvde det, vilken behörighet användes, vad kördes, och vilken bevis finns kvar.
Sammanfattningen är skriven av Vibekollen utifrån källans egen publicering. Innehållet tillhör AI Engineer.
Mer från AI Engineer
SOTA Generative Media Panel — Dumitru Erhan, Shane Gu & Nicole Brichtova, Google DeepMind
AI Engineer 30 aug.
Tell the Robot What You Want — Sandhya Subramani, AWS
AI Engineer 29 aug.
The Signal Layer: What to Build When Anything Can Be Built — Lena Hall, Akamai
AI Engineer 29 aug.
Tribal Dungeons of Global Shipping: AI Agents at Global Scale — Dmitry Buykin, Maersk
AI Engineer 29 aug.