2026 suite: inbox, AI, boekhouding.App openen
← Workspace369 Onderzoek

Gegevens, met de getoonde werkzaamheden.

Benchmarks voor AI-productiviteit en tijdbesparing

Vergelijk experimentele AI-resultaten voor schrijven, consulting en coderen, met model-era limieten, gemeten versus waargenomen resultaten en reproduceerbare tijdsindexberekeningen.

De korte versie

2026 editie

Belangrijkste conclusies

Elke afhaalmaaltijd linkt naar zijn canonieke gegevensrij. Gerapporteerde cijfers behoren toe aan hun geciteerde producent; gemodelleerde resultaten worden gelabeld als berekeningen.

  1. Schrijexperiment: lagere taaktijd met AI-assistentie: 40% (2023 experiment; gepubliceerd juli 2023).MIT / Noy en Zhang
  2. Schrijexperiment: hogere geëvalueerde uitvoerkwaliteit: 18% (2023 experiment; gepubliceerd juli 2023).MIT / Noy en Zhang
  3. Consultingexperiment: toename van voltooide subtaken: 12,2% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
  4. Consultingexperiment: ongeveer hogere kwaliteit bij de innovatieoefening: 32% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
  5. Strategietaak: correcte antwoorden zonder AI: 84,5% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
  6. Strategietaak: correcte antwoorden met GPT-4 toegang: 70,6% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
  7. Strategietaak: correcte antwoorden met GPT-4 en promptoverzicht: 60% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
  8. Copilot-experiment: verminderde voltooiingstijd voor één codeeropdracht: 55,8% (15 mei–20 juni 2022).Peng, Kalliamvakou, Cihon en Demirer
  9. METR begin 2025 experiment: langere voltooiingstijd met AI toegestaan: 19% (februari-juni 2025).METR
  10. METR-deelnemers: waargenomen AI-versnelling na het experiment: 20% (februari-juni 2025).METR

Helpt AI bij korte professionele schrijftaken?

Het sch Experiment vond minder tijd besteed en hogere geëvalueerde kwaliteit met assistentie. De opdrachten vereisten niet de volledige feitelijke precisie of de organisatorische context van veel echte klantgerichte documenten.

Benchmarks voor AI-productiviteit — Experimenten 2022–2025; institutionele updates gecontroleerd tot september 2026. Studie-specifieke werving; geen representatieve wereldwijde werknemerssteekproef.
Resultaat versus controleGerapporteerde wijziging
Reductie in taaktijd40%Gerandomiseerd experiment
Toename in geëvalueerde kwaliteit18%Gerandomiseerd experiment

Kwaliteitsscoreverbetering en tijdsreductie zijn verschillende resultaten en mogen niet worden opgeteld.

Primaire bron: MIT / Noy en Zhang — 14 juli 2023

Kan AI één consultingtaak verbeteren en een andere schaden?

Ja. De studie scheidt taken die het model kon afhandelen van een strategisch probleem waarop het onbetrouwbaar was. Productiviteit op de eerste set vestigt geen nauwkeurigheid op de tweede.

Benchmarks voor AI-productiviteit — Experimenten 2022–2025; institutionele updates gecontroleerd tot september 2026. Studie-specifieke werving; geen representatieve wereldwijde werknemerssteekproef.
Resultaat en voorwaardeGerapporteerd percentage
Meer subtaken voltooid tijdens de innovatieoefening12.2%Gerandomiseerd experiment
Hogere kwaliteit bij de innovatieoefening, ongeveer32%Gerandomiseerd experiment
Correcte strategie-antwoord: geen AI84.5%Gerandomiseerd experiment
Correcte strategie-antwoord: GPT-4-toegang70.6%Gerandomiseerd experiment
Correcte strategie-antwoord: GPT-4 plus promptoverzicht60%Gerandomiseerd experiment

De kwaliteitschatting is bij benadering. Dit is historisch GPT-4-bewijs, geen benchmark van de huidige modellen.

Primaire bron: Harvard Business School AI Institute / Dell’Acqua en collega's — 9 april 2026

Waarom rapporteren codeerstudies verschillende productiviteitseffecten?

Een op zichzelf staande codeeropdracht en onderhoud binnen een volwassen repository zijn verschillende taken. De studies gebruikten ook verschillende modelgeneraties en wervingsmethoden. Hun resultaten moeten gescheiden blijven in plaats van gemiddeld te worden.

Benchmarks voor AI-productiviteit — Experimenten 2022–2025; institutionele updates gecontroleerd tot september 2026. Studie-specifieke werving; geen representatieve wereldwijde werknemerssteekproef.
Studie en resultaatGerapporteerde wijziging
Copilot-toewijzing: reductie in voltooiingstijd55.8%Gerandomiseerd experiment
METR: toename in werkelijke voltooiingstijd19%Gerandomiseerd experiment
METR: verwachte versnelling vóór het werk24%Perceptie van deelnemers
METR: waargenomen versnelling na het werk20%Perceptie van deelnemers

METR's latere follow-up meldde ernstige selectie- en tijdmeetproblemen. De auteurs beschouwen de follow-up niet als een betrouwbare schatting van het huidige effect; de historische vertraging is geen claim over alle ontwikkelaars in 2026.

Primaire bronnen: Peng, Kalliamvakou, Cihon en Demirer — 13 februari 2023 · METR — 10 juli 2025 · METR — 24 februari 2026

Wat betekent elke gemeten tijdsverandering op dezelfde basislijn?

Een basisindex maakt de rekenkunde gemakkelijker leesbaar zonder de studies te combineren. Elke controlevoorwaarde krijgt dezelfde startindex; de resulterende geassisteerde index verwijst nog steeds alleen naar zijn eigen experiment.

Benchmarks voor AI-productiviteit — Experimenten 2022–2025; institutionele updates gecontroleerd tot september 2026. Studie-specifieke werving; geen representatieve wereldwijde werknemerssteekproef.
ExperimentGeassisteerde tijdsindex; controle = 100
Schrijexperiment60Genormaliseerde berekening
Copilot-toewijzing44.2Genormaliseerde berekening
METR repository taken119Genormaliseerde berekening

Workspace369-normalisatie, geen nieuw waargenomen resultaat. Lager betekent minder tijd. Een tijdsreductie is niet hetzelfde procentuele toename van de doorvoer, en er wordt geen doorvoerschatting geclaimd.

Primaire bronnen: MIT / Noy en Zhang — 14 juli 2023 · Peng, Kalliamvakou, Cihon en Demirer — 13 februari 2023 · METR — 10 juli 2025

Hoe moet een bedrijf AI-tijdsbesparingen testen?

Definieer een herhaalbare taak en een acceptatiestandaard voordat geassisteerd en niet-geassisteerd werk wordt vergeleken. Neem promptvoorbereiding, feitencontrole, beoordeling en herstelwerk op. Houd klantgegevens toegang en menselijke goedkeuringsvereisten ongewijzigd tijdens de vergelijking.

Volg zowel tijd als kwaliteit. Pas geen percentage van de schrijftaak toe op een volledige salarisadministratie en ga niet uit van hetzelfde resultaat voor een autonome agent.

Hoe dit rapport is opgebouwd

Methodologie en beperkingen

  1. Dit is een geselecteerde bewijsvergelijking, geen systematische review of meta-analyse. Studies werden opgenomen voor identificeerbare taken, bewijs van de oorspronkelijke producent en duidelijk gedefinieerde uitkomstdefinities.
  2. De schrijf- en consultancycijfers gebruiken de openbare samenvattingen van gepubliceerde studies van hun onderzoeksinstellingen. Het codeerpapier en het METR-rapport bieden gedetailleerde originele experimentele informatie. Werkdocumenten en gepubliceerde versies worden niet gemengd.
  3. Gemeten resultaten en waargenomen versnellingen hebben afzonderlijke bewijslabels. De tijdindexberekening maakt alleen gebruik van gemeten wijzigingen in de voltooiingstijd; enquêteopvattingen zijn hierin uitgesloten.
  4. Modelversies en studiedata blijven aan de bevindingen gekoppeld. We hebben de METR-follow-up gecontroleerd en de waarschuwing over de betrouwbaarheid van nieuwere schattingen behouden.

Wat deze cijfers u niet kunnen vertellen

  • Geselecteerde experimenten kunnen geen universele AI-rendement op investering vaststellen. Verschillende taken, controlevoorwaarden, deelnemers en kwaliteitstests verhinderen een verdedigbaar samengevoegd percentage.
  • De steekproefgroottes beschrijven de reikwijdte van de studie, geen onafhankelijke replicaties. De betrokkenheid van leveranciers bij de Copilot-studie is relevant voor de interpretatie.
  • Historische resultaten vestigen niet de capaciteiten van de huidige modellen. De normalisatie omvat geen implementatiekosten en toont geen duurzame jaarlijkse besparingen aan.

Actualiteit en correcties

Onderhouden door het redactieteam van Workspace369. Beoordeel per kwartaal en wanneer een geciteerde producent een vervangende studie publiceert. Volgende redactionele beoordeling: december 2026. Bewaar historische modelversies en observatiedata. De edatiedatum verandert alleen wanneer het bewijs of de inhoud substantieel wordt beoordeeld; het verandert de onderliggende observatieperiode niet.

Eerste editie: . Gegevensverzameling, bronvermelding en berekeningen gecontroleerd voor deze editie. Er wordt geen onafhankelijke peer review geclaimd.

Een fout of een nieuwere primaire release gevonden? Stuur een correctie met de bron en het betreffende statistiek. Gecorrigeerde gegevens moeten worden vastgelegd in de revisiegeschiedenis voordat ze opnieuw worden gepubliceerd.

Primaire bronnen en herkomst

Elke gerapporteerde numerieke cel linkt rechtstreeks naar de producent. De downloads bevatten exacte tabel- of werkmap locators, observatieperiodes, toegangsdates, formules en inputreferenties.

  1. MIT / Noy en ZhangMIT-onderzoeksmededeling voor het gepubliceerde Science schrijfexperiment ↗Gepubliceerd op 14 juli 2023. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.
  2. Harvard Business School AI Institute / Dell’Acqua en collega'sTerug naar het begin van AI op het werk: institutionele beoordeling van het gepubliceerde consultingexperiment ↗Gepubliceerd op 9 april 2026. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.
  3. Peng, Kalliamvakou, Cihon en DemirerDe impact van AI op de productiviteit van ontwikkelaars: bewijs van GitHub Copilot, arXiv v1 ↗Gepubliceerd op 13 februari 2023. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.
  4. METRHet meten van de impact van AI begin 2025 op de productiviteit van ervaren open-source ontwikkelaars ↗Gepubliceerd op 10 juli 2025. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.
  5. METRWe wijzigen ons ontwerp voor experimenten met ontwikkelaarsproductiviteit ↗Gepubliceerd op 24 februari 2026. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.

Gemaakt om te controleren, daarna te citeren

Hoe dit rapport te citeren

Voor een op bronnen gebaseerde statistiek, vermeld de oorspronkelijke uitgever en link naar de exacte rij hier bij het gebruik van onze compilatie. Voor een gemodelleerd resultaat, citeer Workspace369 en neem de aannames op. Het linken naar deze pagina maakt ons niet de oorspronkelijke producent van gegevens van derden.

Workspace369. (2026-09-12). AI Productiviteit en Tijdsbesparing Benchmarks. https://workspace369.com/research/ai-productivity-time-savings-benchmarks/. Primaire bronnen en observatieperioden zoals vermeld in het rapport.

De downloads zijn referentiedatasets in het Engels, ook op vertaalde pagina's. De rechten van de bron blijven bij de makers. Vermeld de compilatie en berekeningen van Workspace369; raadpleeg de hergebruiksvoorwaarden van elke bron.