OpenAI heeft een vernieuwde versie van zijn Agents SDK uitgebracht, gericht op ontwikkelaars die AI-agents willen bouwen die zelfstandig complexe taken kunnen uitvoeren. De update legt nadruk op praktische inzetbaarheid en introduceert onder meer een geïntegreerde sandboxomgeving en een uitgebreidere basis voor langdurige en meerstapsprocessen.
Deze ontwikkeling sluit aan bij een bredere trend waarin partijen als OpenAI en Anthropic concurreren om bedrijven te voorzien van tools voor zogenoemde agentic AI. Met de nieuwe SDK kunnen agents niet alleen tekst genereren, maar ook bestanden verwerken, code uitvoeren en systeemcommando’s aanroepen. Hierdoor verschuift de rol van AI van een assistent naar een uitvoerend systeem dat binnen een gecontroleerde omgeving taken afhandelt.
Volgens OpenAI ontbrak het ontwikkelaars tot nu toe vaak aan een consistente infrastructuur om dit soort toepassingen betrouwbaar in productie te brengen. Een belangrijk onderdeel is de zogenaamde harness, de laag die de interactie tussen model, tools en data organiseert. Deze term verwijst naar alle componenten rondom het model die nodig zijn om een agent te laten functioneren, zoals ook door TechCrunch wordt toegelicht. De nieuwe versie is beter afgestemd op de werking van geavanceerde modellen, wat moet bijdragen aan stabielere prestaties bij complexere taken.
Daarnaast introduceert OpenAI standaard ondersteuning voor sandbox execution. Agents opereren in een afgeschermde omgeving waarin ze veilig code uitvoeren en met bestanden werken zonder directe toegang tot gevoelige systemen. Dit is van belang omdat agents soms onvoorspelbaar gedrag kunnen vertonen. Binnen de sandbox werken ze geïsoleerd in een specifieke werkomgeving met alleen toegestane data en tools.
De update speelt in op het spanningsveld tussen open frameworks en gesloten systemen. Generieke frameworks bieden flexibiliteit, maar benutten de mogelijkheden van geavanceerde modellen niet volledig. Tegelijkertijd zijn tools van modelaanbieders vaak minder transparant, terwijl volledig beheerde oplossingen beperkingen opleggen. OpenAI positioneert de SDK als een middenweg die controle en gebruiksgemak combineert.
De infrastructuur is bedoeld voor zogenoemde long-horizon taken, waarbij agents meerdere stappen doorlopen en verschillende tools combineren. Dit vereist dat het systeem over langere tijd consistent blijft functioneren. De scheiding tussen de logica van de agent en de rekenomgeving speelt ook een rol in beveiliging en schaalbaarheid. Gevoelige gegevens blijven buiten de uitvoeromgeving en taken kunnen worden hervat als een omgeving uitvalt. Dit maakt het mogelijk om agents langdurig te laten draaien en werk te verdelen over meerdere omgevingen.
Volgens bedrijven die de SDK testten, maakt de update het mogelijk om processen te automatiseren die eerder te complex of te foutgevoelig waren. Dit betreft niet alleen het extraheren van informatie, maar ook het correct interpreteren van context in omvangrijke datasets. De nieuwe functionaliteit is beschikbaar via de API en wordt aangeboden volgens het bestaande prijsmodel. Voorlopig is de SDK alleen beschikbaar in Python, met ondersteuning voor TypeScript in ontwikkeling. OpenAI werkt aan verdere uitbreidingen, waaronder samenwerking tussen meerdere agents en diepere integraties met externe systemen.
Reacties
Geef een reactie
Vereiste velden zijn gemarkeerd met *