De korte versie
2026 editieBelangrijkste conclusies
Elke afhaalmaaltijd linkt naar zijn canonieke gegevensrij. Gerapporteerde cijfers behoren toe aan hun geciteerde producent; gemodelleerde resultaten worden gelabeld als berekeningen.
- Schrijexperiment: lagere taaktijd met AI-assistentie: 40% (2023 experiment; gepubliceerd juli 2023).MIT / Noy en Zhang
- Schrijexperiment: hogere geëvalueerde uitvoerkwaliteit: 18% (2023 experiment; gepubliceerd juli 2023).MIT / Noy en Zhang
- Consultingexperiment: toename van voltooide subtaken: 12,2% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
- Consultingexperiment: ongeveer hogere kwaliteit bij de innovatieoefening: 32% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
- Strategietaak: correcte antwoorden zonder AI: 84,5% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
- Strategietaak: correcte antwoorden met GPT-4 toegang: 70,6% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
- Strategietaak: correcte antwoorden met GPT-4 en promptoverzicht: 60% (Studie voor het eerst gepubliceerd in 2023; samenvatting van gepubliceerde studie april 2026).Harvard Business School AI Institute / Dell’Acqua en collega's
- Copilot-experiment: verminderde voltooiingstijd voor één codeeropdracht: 55,8% (15 mei–20 juni 2022).Peng, Kalliamvakou, Cihon en Demirer
- METR begin 2025 experiment: langere voltooiingstijd met AI toegestaan: 19% (februari-juni 2025).METR
- METR-deelnemers: waargenomen AI-versnelling na het experiment: 20% (februari-juni 2025).METR
Helpt AI bij korte professionele schrijftaken?
Het sch Experiment vond minder tijd besteed en hogere geëvalueerde kwaliteit met assistentie. De opdrachten vereisten niet de volledige feitelijke precisie of de organisatorische context van veel echte klantgerichte documenten.
| Resultaat versus controle | Gerapporteerde wijziging |
|---|---|
| Reductie in taaktijd | 40%Gerandomiseerd experiment |
| Toename in geëvalueerde kwaliteit | 18%Gerandomiseerd experiment |
Kwaliteitsscoreverbetering en tijdsreductie zijn verschillende resultaten en mogen niet worden opgeteld.
Primaire bron: MIT / Noy en Zhang — 14 juli 2023
Kan AI één consultingtaak verbeteren en een andere schaden?
Ja. De studie scheidt taken die het model kon afhandelen van een strategisch probleem waarop het onbetrouwbaar was. Productiviteit op de eerste set vestigt geen nauwkeurigheid op de tweede.
| Resultaat en voorwaarde | Gerapporteerd percentage |
|---|---|
| Meer subtaken voltooid tijdens de innovatieoefening | 12.2%Gerandomiseerd experiment |
| Hogere kwaliteit bij de innovatieoefening, ongeveer | 32%Gerandomiseerd experiment |
| Correcte strategie-antwoord: geen AI | 84.5%Gerandomiseerd experiment |
| Correcte strategie-antwoord: GPT-4-toegang | 70.6%Gerandomiseerd experiment |
| Correcte strategie-antwoord: GPT-4 plus promptoverzicht | 60%Gerandomiseerd experiment |
De kwaliteitschatting is bij benadering. Dit is historisch GPT-4-bewijs, geen benchmark van de huidige modellen.
Primaire bron: Harvard Business School AI Institute / Dell’Acqua en collega's — 9 april 2026
Waarom rapporteren codeerstudies verschillende productiviteitseffecten?
Een op zichzelf staande codeeropdracht en onderhoud binnen een volwassen repository zijn verschillende taken. De studies gebruikten ook verschillende modelgeneraties en wervingsmethoden. Hun resultaten moeten gescheiden blijven in plaats van gemiddeld te worden.
| Studie en resultaat | Gerapporteerde wijziging |
|---|---|
| Copilot-toewijzing: reductie in voltooiingstijd | 55.8%Gerandomiseerd experiment |
| METR: toename in werkelijke voltooiingstijd | 19%Gerandomiseerd experiment |
| METR: verwachte versnelling vóór het werk | 24%Perceptie van deelnemers |
| METR: waargenomen versnelling na het werk | 20%Perceptie van deelnemers |
METR's latere follow-up meldde ernstige selectie- en tijdmeetproblemen. De auteurs beschouwen de follow-up niet als een betrouwbare schatting van het huidige effect; de historische vertraging is geen claim over alle ontwikkelaars in 2026.
Primaire bronnen: Peng, Kalliamvakou, Cihon en Demirer — 13 februari 2023 · METR — 10 juli 2025 · METR — 24 februari 2026
Wat betekent elke gemeten tijdsverandering op dezelfde basislijn?
Een basisindex maakt de rekenkunde gemakkelijker leesbaar zonder de studies te combineren. Elke controlevoorwaarde krijgt dezelfde startindex; de resulterende geassisteerde index verwijst nog steeds alleen naar zijn eigen experiment.
| Experiment | Geassisteerde tijdsindex; controle = 100 |
|---|---|
| Schrijexperiment | 60Genormaliseerde berekening |
| Copilot-toewijzing | 44.2Genormaliseerde berekening |
| METR repository taken | 119Genormaliseerde berekening |
Workspace369-normalisatie, geen nieuw waargenomen resultaat. Lager betekent minder tijd. Een tijdsreductie is niet hetzelfde procentuele toename van de doorvoer, en er wordt geen doorvoerschatting geclaimd.
Primaire bronnen: MIT / Noy en Zhang — 14 juli 2023 · Peng, Kalliamvakou, Cihon en Demirer — 13 februari 2023 · METR — 10 juli 2025
Hoe moet een bedrijf AI-tijdsbesparingen testen?
Definieer een herhaalbare taak en een acceptatiestandaard voordat geassisteerd en niet-geassisteerd werk wordt vergeleken. Neem promptvoorbereiding, feitencontrole, beoordeling en herstelwerk op. Houd klantgegevens toegang en menselijke goedkeuringsvereisten ongewijzigd tijdens de vergelijking.
Volg zowel tijd als kwaliteit. Pas geen percentage van de schrijftaak toe op een volledige salarisadministratie en ga niet uit van hetzelfde resultaat voor een autonome agent.
Hoe dit rapport is opgebouwd
Methodologie en beperkingen
- Dit is een geselecteerde bewijsvergelijking, geen systematische review of meta-analyse. Studies werden opgenomen voor identificeerbare taken, bewijs van de oorspronkelijke producent en duidelijk gedefinieerde uitkomstdefinities.
- De schrijf- en consultancycijfers gebruiken de openbare samenvattingen van gepubliceerde studies van hun onderzoeksinstellingen. Het codeerpapier en het METR-rapport bieden gedetailleerde originele experimentele informatie. Werkdocumenten en gepubliceerde versies worden niet gemengd.
- Gemeten resultaten en waargenomen versnellingen hebben afzonderlijke bewijslabels. De tijdindexberekening maakt alleen gebruik van gemeten wijzigingen in de voltooiingstijd; enquêteopvattingen zijn hierin uitgesloten.
- Modelversies en studiedata blijven aan de bevindingen gekoppeld. We hebben de METR-follow-up gecontroleerd en de waarschuwing over de betrouwbaarheid van nieuwere schattingen behouden.
Wat deze cijfers u niet kunnen vertellen
- Geselecteerde experimenten kunnen geen universele AI-rendement op investering vaststellen. Verschillende taken, controlevoorwaarden, deelnemers en kwaliteitstests verhinderen een verdedigbaar samengevoegd percentage.
- De steekproefgroottes beschrijven de reikwijdte van de studie, geen onafhankelijke replicaties. De betrokkenheid van leveranciers bij de Copilot-studie is relevant voor de interpretatie.
- Historische resultaten vestigen niet de capaciteiten van de huidige modellen. De normalisatie omvat geen implementatiekosten en toont geen duurzame jaarlijkse besparingen aan.
Actualiteit en correcties
Onderhouden door het redactieteam van Workspace369. Beoordeel per kwartaal en wanneer een geciteerde producent een vervangende studie publiceert. Volgende redactionele beoordeling: december 2026. Bewaar historische modelversies en observatiedata. De edatiedatum verandert alleen wanneer het bewijs of de inhoud substantieel wordt beoordeeld; het verandert de onderliggende observatieperiode niet.
Eerste editie: . Gegevensverzameling, bronvermelding en berekeningen gecontroleerd voor deze editie. Er wordt geen onafhankelijke peer review geclaimd.
Een fout of een nieuwere primaire release gevonden? Stuur een correctie met de bron en het betreffende statistiek. Gecorrigeerde gegevens moeten worden vastgelegd in de revisiegeschiedenis voordat ze opnieuw worden gepubliceerd.
Primaire bronnen en herkomst
Elke gerapporteerde numerieke cel linkt rechtstreeks naar de producent. De downloads bevatten exacte tabel- of werkmap locators, observatieperiodes, toegangsdates, formules en inputreferenties.
- MIT / Noy en ZhangMIT-onderzoeksmededeling voor het gepubliceerde Science schrijfexperiment ↗Gepubliceerd op 14 juli 2023. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.
- Harvard Business School AI Institute / Dell’Acqua en collega'sTerug naar het begin van AI op het werk: institutionele beoordeling van het gepubliceerde consultingexperiment ↗Gepubliceerd op 9 april 2026. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.
- Peng, Kalliamvakou, Cihon en DemirerDe impact van AI op de productiviteit van ontwikkelaars: bewijs van GitHub Copilot, arXiv v1 ↗Gepubliceerd op 13 februari 2023. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.
- METRHet meten van de impact van AI begin 2025 op de productiviteit van ervaren open-source ontwikkelaars ↗Gepubliceerd op 10 juli 2025. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.
- METRWe wijzigen ons ontwerp voor experimenten met ontwikkelaarsproductiviteit ↗Gepubliceerd op 24 februari 2026. Geraadpleegd op 12 september 2026.Geselecteerde feitelijke observaties parafraseren met bronvermelding. Geen enkel rapport, grafiek, deelnemersgegevens of propriëtaire database wordt herverdeeld; bronrechten blijven bij de producent.
Gemaakt om te controleren, daarna te citeren
Hoe dit rapport te citeren
Voor een op bronnen gebaseerde statistiek, vermeld de oorspronkelijke uitgever en link naar de exacte rij hier bij het gebruik van onze compilatie. Voor een gemodelleerd resultaat, citeer Workspace369 en neem de aannames op. Het linken naar deze pagina maakt ons niet de oorspronkelijke producent van gegevens van derden.
Workspace369. (2026-09-12). AI Productiviteit en Tijdsbesparing Benchmarks. https://workspace369.com/research/ai-productivity-time-savings-benchmarks/. Primaire bronnen en observatieperioden zoals vermeld in het rapport.
De downloads zijn referentiedatasets in het Engels, ook op vertaalde pagina's. De rechten van de bron blijven bij de makers. Vermeld de compilatie en berekeningen van Workspace369; raadpleeg de hergebruiksvoorwaarden van elke bron.