OpenAI zegt op 6 september een eigen mijlpaal voor geautomatiseerd onderzoek te hebben bereikt: AI kan afgebakende opdrachten uitvoeren die een ervaren onderzoeker enkele dagen zouden kosten. Mensen bepalen nog steeds welke vragen aandacht krijgen en welke resultaten verder worden uitgewerkt. Het gaat om onderzoek binnen het bedrijf, onder menselijke leiding.

Parallel aan het werk

Halverwege augustus registreerde OpenAI in totaal 3,1 werkdagen aan agentactiviteit per menselijke werkdag van acht uur. Agents kunnen tegelijk draaien. Dat cijfer bewijst daarom geen verdrievoudiging van de productiviteit: de onderzoekers noemen onder meer beschikbare rekenkracht en moeilijk automatiseerbare taken als mogelijke knelpunten.

Hulp blijft nodig

In de afgelopen zes maanden was bij meer dan de helft van de geslaagde opdrachten die een mens naar schatting vier tot acht uur zouden kosten, minstens één menselijke ingreep nodig. OpenAI beschrijft de metingen als voorlopig en werkt nog aan betere manieren om onderzoeksvooruitgang te meten.

Verder bij de bron

De feiten en aankondigingen achter deze Nxt-brief.

Zelfstandig geformuleerde uitleg, gemaakt met behulp van AI op basis van de genoemde bronnen. Zo werken we.