2026 пакет: поштова скринька, ШІ, бухгалтерський облік.Відкрити додаток
← Дослідження Workspace369

Дані з показаною роботою.

Бенчмарки продуктивності та економії часу за допомогою ШІ

Порівняйте експериментальні результати ШІ для написання, консалтингу та кодування з обмеженнями епохи моделей, виміряними проти сприйнятих результатів та відтворюваними розрахунками індексу часу.

Коротка версія

Видання 2026 року

Ключові висновки

Кожне посилання веде до відповідного рядка даних. Заявлені цифри належать їхньому цитованому виробнику; змодельовані результати позначені як розрахунки.

  1. Експеримент з написання: менший час виконання завдання за допомогою ШІ: 40% (експеримент 2023 року; опубліковано липень 2023 року).MIT / Ной і Чжан
  2. Експеримент з написання: вища оцінена якість вихідного матеріалу: 18% (експеримент 2023 року; опубліковано липень 2023 року).MIT / Ной і Чжан
  3. Консалтинговий експеримент: збільшення кількості виконаних підзавдань: 12,2% (дослідження вперше опубліковано у 2023 році; резюме опублікованого дослідження квітень 2026 року).Інститут ШІ Гарвардської школи бізнесу / Дель'Аква та колеги
  4. Консалтинговий експеримент: приблизно вища якість інноваційного завдання: 32% (дослідження вперше опубліковано у 2023 році; резюме опублікованого дослідження квітень 2026 року).Інститут ШІ Гарвардської школи бізнесу / Дель'Аква та колеги
  5. Завдання зі стратегії: правильні відповіді без ШІ: 84,5% (Дослідження вперше опубліковано у 2023 році; резюме опублікованого дослідження квітень 2026 р.).Інститут ШІ Гарвардської школи бізнесу / Дель'Аква та колеги
  6. Завдання зі стратегії: правильні відповіді з доступом до GPT-4: 70,6% (Дослідження вперше опубліковано у 2023 році; резюме опублікованого дослідження квітень 2026 р.).Інститут ШІ Гарвардської школи бізнесу / Дель'Аква та колеги
  7. Завдання зі стратегії: правильні відповіді з GPT-4 та оглядом підказок: 60% (Дослідження вперше опубліковано у 2023 році; резюме опублікованого дослідження квітень 2026 р.).Інститут ШІ Гарвардської школи бізнесу / Дель'Аква та колеги
  8. Експеримент Copilot: зменшення часу виконання одного завдання кодування: 55,8% (15 травня – 20 червня 2022 року).Пенг, Калліамваку, Чіхон і Демірер
  9. Експеримент METR на початку 2025 року: довший час виконання з дозволеним ШІ: 19% (лютий-червень 2025 р.).METR
  10. Учасники METR: сприйняте прискорення ШІ після експерименту: 20% (лютий-червень 2025 р.).METR

Чи допомагає ШІ з короткими завданнями професійного написання?

Експеримент з написання виявив менше витраченого часу та вищу оцінену якість за допомогою допомоги. Його завдання не вимагали повної фактичної точності або організаційного контексту багатьох реальних документів, орієнтованих на клієнта.

Бенчмарки продуктивності ШІ — експерименти 2022–2025 років; оновлення установ перевірено до вересня 2026 року. Набір персоналу для конкретних досліджень; не є репрезентативною глобальною вибіркою працівників.
Результат проти контролюПовідомлена зміна
Скорочення часу виконання завдання40%Випадковий експеримент
Збільшення оціненої якості18%Випадковий експеримент

Покращення показника якості та скорочення часу є різними результатами і не повинні додаватися.

Первинне джерело: MIT / Ной і Чжан — 14 липня 2023 р.

Чи може ШІ покращити одне консалтингове завдання і нашкодити іншому?

Так. Дослідження розділяє завдання, з якими модель могла впоратися, від стратегічної проблеми, щодо якої вона була ненадійною. Продуктивність на першому наборі не встановлює точність на другому.

Бенчмарки продуктивності ШІ — експерименти 2022–2025 років; оновлення установ перевірено до вересня 2026 року. Набір персоналу для конкретних досліджень; не є репрезентативною глобальною вибіркою працівників.
Результат і умоваПовідомлений відсоток
Більше підзавдань виконано під час вправи з інновацій12.2%Випадковий експеримент
Вища якість інноваційного завдання, приблизно32%Випадковий експеримент
Правильна відповідь на стратегію: без ШІ84.5%Випадковий експеримент
Правильна відповідь на стратегію: доступ до GPT-470.6%Випадковий експеримент
Правильна відповідь на стратегію: GPT-4 плюс огляд підказок60%Випадковий експеримент

Оцінка якості є приблизною. Це історичні дані GPT-4, а не еталон сучасних моделей.

Первинне джерело: Інститут ШІ Гарвардської школи бізнесу / Дель'Аква та колеги — 9 квітня 2026 року

Чому дослідження кодування показують різні ефекти продуктивності?

Автономне завдання кодування та підтримка в зрілому репозиторії — це різні завдання. Дослідження також використовували різні покоління моделей та методи набору персоналу. Їхні результати слід залишати окремо, а не усереднювати.

Бенчмарки продуктивності ШІ — експерименти 2022–2025 років; оновлення установ перевірено до вересня 2026 року. Набір персоналу для конкретних досліджень; не є репрезентативною глобальною вибіркою працівників.
Дослідження та результатПовідомлена зміна
Призначення Copilot: зменшення часу виконання55.8%Випадковий експеримент
METR: збільшення фактичного часу виконання19%Випадковий експеримент
METR: очікуване прискорення до роботи24%Сприйняття учасника
METR: сприйняте прискорення після роботи20%Сприйняття учасника

Пізніше подальше дослідження METR повідомило про серйозні проблеми з вибором та вимірюванням часу. Його автори не розглядають подальше дослідження як надійну оцінку поточного ефекту; історичне уповільнення не є твердженням щодо всіх розробників у 2026 році.

Первинні джерела: Пенг, Калліамваку, Чіхон і Демірер — 13 лютого 2023 р. · METR — 10 липня 2025 р. · METR — 24 лютого 2026 р.

Що означає кожна виміряна зміна часу на тій самій базовій лінії?

Базовий індекс полегшує читання арифметики без об'єднання досліджень. Кожна контрольна умова отримує однаковий початковий індекс; результуючий індекс допомоги все ще стосується лише власного експерименту.

Бенчмарки продуктивності ШІ — експерименти 2022–2025 років; оновлення установ перевірено до вересня 2026 року. Набір персоналу для конкретних досліджень; не є репрезентативною глобальною вибіркою працівників.
ЕкспериментІндекс допоміжного часу; контроль = 100
Експеримент з написання60Нормалізований розрахунок
Призначення Copilot44.2Нормалізований розрахунок
Завдання репозиторію METR119Нормалізований розрахунок

Нормалізація Workspace369, а не новий спостережуваний результат. Менше означає менше часу. Скорочення часу не є таким самим відсотковим збільшенням пропускної здатності, і жодна оцінка пропускної здатності не заявлена.

Первинні джерела: MIT / Ной і Чжан — 14 липня 2023 р. · Пенг, Калліамваку, Чіхон і Демірер — 13 лютого 2023 р. · METR — 10 липня 2025 р.

Як бізнесу тестувати економію часу за допомогою ШІ?

Визначте повторюване завдання та стандарт прийняття перед порівнянням допоміжної та не допоміжної роботи. Включіть підготовку підказок, перевірку фактів, перегляд та переробку. Зберігайте доступ до даних клієнта та вимоги щодо схвалення людиною незмінними під час порівняння.

Відстежуйте як час, так і якість. Не застосовуйте відсоток завдання написання до всього фонду оплати праці та не припускайте такого ж результату для автономного агента.

Як був побудований цей звіт

Методологія та обмеження

  1. Це вибіркове порівняння доказів, а не систематичний огляд або мета-аналіз. Дослідження були включені за ідентифікованими завданнями, оригінальними даними виробника та чітко визначеними результатами.
  2. Дані про написання та консультування використовують загальнодоступні резюме опублікованих досліджень їхніх дослідницьких установ. Кодований документ та звіт METR надають оригінальні експериментальні деталі. Робочі документи та опубліковані версії не змішуються.
  3. Виміряні результати та сприйняті прискорення мають окремі мітки доказів. Розрахунок індексу часу використовує лише зміну виміряного часу виконання; думки з опитування не включені до нього.
  4. Версії моделей та дати досліджень залишаються пов'язаними з висновками. Ми перевірили подальше дослідження METR і зберегли його попередження щодо надійності новіших оцінок.

Що ці цифри не можуть вам сказати

  • Вибрані експерименти не можуть встановити універсальну рентабельність інвестицій у ШІ. Різні завдання, контрольні умови, учасники та тести якості запобігають обґрунтованому об'єднаному відсотку.
  • Розміри вибірки описують обсяг дослідження, а не незалежні повторення. Участь постачальника у дослідженні Copilot має значення для інтерпретації.
  • Історичні результати не встановлюють можливостей сучасних моделей. Нормалізація не включає витрати на впровадження та не демонструє стійкої річної економії.

Актуальність та виправлення

Підтримується редакційною командою Workspace369. Переглядайте щокварталу та коли цитований виробник випускає замінне дослідження. Наступний редакційний огляд: грудень 2026 року. Зберігайте історичні версії моделей та дати спостережень. Дата видання змінюється лише тоді, коли докази або вміст суттєво переглядаються; це не змінює базовий період спостереження.

Перше видання: . Перевірено вилучення даних, зазначення джерела та арифметичні розрахунки для цього видання. Незалежний рецензентський розгляд не стверджується.

Знайшли помилку чи новіший первинний реліз? Надішліть виправлення з джерелом та ураженою статистикою. Підтверджені виправлення мають бути записані в історії ревізій перед повторною публікацією.

Первинні джерела та походження

Кожна заявлена числова комірка посилається безпосередньо на свого виробника. Завантаження включають точні посилання на таблиці або робочі зошити, періоди спостереження, дати доступу, формули та посилання на вхідні дані.

  1. MIT / Ной і ЧжанПрес-реліз дослідження MIT щодо опублікованого експерименту з написання наукових текстів ↗Опубліковано 14 липня 2023 р. Доступно 12 вересня 2026 р.Вибрані фактичні спостереження перефразовані з посиланням. Жоден звіт-джерело, діаграма, дані учасників або пропрієтарна база даних не розповсюджуються; права на джерело залишаються за його виробником.
  2. Інститут ШІ Гарвардської школи бізнесу / Дель'Аква та колегиНазад до основ ШІ на роботі: огляд опублікованого консалтингового експерименту ↗Опубліковано 9 квітня 2026 р. Доступно 12 вересня 2026 р.Вибрані фактичні спостереження перефразовані з посиланням. Жоден звіт-джерело, діаграма, дані учасників або пропрієтарна база даних не розповсюджуються; права на джерело залишаються за його виробником.
  3. Пенг, Калліамваку, Чіхон і ДемірерВплив ШІ на продуктивність розробників: докази з GitHub Copilot, arXiv v1 ↗Опубліковано 13 лютого 2023 р. Доступно 12 вересня 2026 р.Вибрані фактичні спостереження перефразовані з посиланням. Жоден звіт-джерело, діаграма, дані учасників або пропрієтарна база даних не розповсюджуються; права на джерело залишаються за його виробником.
  4. METRВимірювання впливу ШІ на початку 2025 року на продуктивність досвідчених розробників з відкритим кодом ↗Опубліковано 10 липня 2025 р. Доступно 12 вересня 2026 р.Вибрані фактичні спостереження перефразовані з посиланням. Жоден звіт-джерело, діаграма, дані учасників або пропрієтарна база даних не розповсюджуються; права на джерело залишаються за його виробником.
  5. METRМи змінюємо дизайн нашого експерименту з продуктивності розробників ↗Опубліковано 24 лютого 2026 р. Доступно 12 вересня 2026 р.Вибрані фактичні спостереження перефразовані з посиланням. Жоден звіт-джерело, діаграма, дані учасників або пропрієтарна база даних не розповсюджуються; права на джерело залишаються за його виробником.

Створено для перевірки, а потім цитування

Як цитувати цей звіт

Для статистики, повідомленої джерелом, вкажіть оригінального видавця та посилайтеся на точний рядок тут, використовуючи нашу компіляцію. Для змодельованого результату цитуйте Workspace369 та включіть припущення. Посилання на цю сторінку не робить нас первинним виробником сторонніх даних.

Workspace369. (2026-09-12). Еталони продуктивності ШІ та економії часу. https://workspace369.com/research/ai-productivity-time-savings-benchmarks/. Первинні джерела та періоди спостереження, як зазначено у звіті.

Завантаження є англомовними наборами даних для довідки, зокрема на перекладених сторінках. Права на джерело залишаються за їхніми виробниками. Вказуйте компіляцію та розрахунки Workspace369; консультуйтеся з умовами повторного використання кожного джерела.