DBT's Microsoft 365 Copilot Pilot — a UK Government AI Trial That Found No Productivity Gain
United Kingdom
The UK's DBT piloted Microsoft 365 Copilot with 1,000 licences for three months. Usage stayed thin — 1.14 actions per …
United Kingdom · London · See the United Kingdom profile
El DWP del Reino Unido probó Microsoft 365 Copilot durante seis meses con un verdadero grupo de comparación de no usuarios. Los usuarios ahorraron una media de 19 minutos al día, menos que los 26 minutos autodeclarados en un ensayo anterior con 20.000 funcionarios.
El Department for Work and Pensions (Ministerio de Trabajo y Pensiones) del Reino Unido, el mayor departamento gubernamental de atención al público, puso a prueba Microsoft 365 Copilot entre octubre de 2024 y marzo de 2025 (evaluación publicada en febrero de 2026), asignando 3549 licencias distribuidas en 12 grupos de licencias que cubren las funciones centrales del departamento, excluyendo al personal de atención de primera línea.
El DWP comparó las respuestas a la encuesta de 1716 usuarios de Copilot (tasa de respuesta del 48%) con 2535 respuestas de un grupo de comparación de no usuarios (tasa de respuesta del 27%), además de 19 entrevistas en profundidad, utilizando un modelo de Regresión Aparentemente No Relacionada (Seemingly Unrelated Regression) para ajustar por edad, género, categoría, puesto, dirección, condiciones de salud y experiencia previa con IA.
La estimación ajustada reveló que los usuarios de Copilot ahorraban una media de 19 minutos al día (26 minutos en búsqueda de información, 25 en redacción de correos electrónicos, 24 en elaboración de resúmenes, 9 en transcripción de reuniones); el 95% de los usuarios declaró estar satisfecho, el 89% redirigió el tiempo ahorrado a otras tareas, y la satisfacción laboral y la calidad percibida del trabajo aumentaron de forma modesta (0,56 y 0,49 puntos en una escala de 7 puntos).
El informe del DWP señala explícitamente que su estimación de 19 minutos se sitúa por debajo de la cifra de 26 minutos al día obtenida en un ensayo del Government Digital Service realizado en junio de 2025 con 20 000 funcionarios públicos, que utilizó medidas autoinformadas sin grupo de comparación -- lo que ilustra cómo el rigor metodológico modifica las estimaciones destacadas de productividad de la IA. El DWP también reveló las limitaciones de su propio ensayo: ausencia de aleatorización, ausencia de línea de base previa a la intervención, y dependencia de medidas autoinformadas.
Implementation detail (cost, timeline, staffing, conditions for success) is not yet available for this practice.
Where this practice's information was retrieved from, and when.
United Kingdom
The UK's DBT piloted Microsoft 365 Copilot with 1,000 licences for three months. Usage stayed thin — 1.14 actions per …
Netherlands
TNO's second annual census of generative-AI use across Dutch government found applications grew from 8 in 2024 to 81 in …
Japan
Japan's Digital Agency built GENAI, a sovereign generative-AI platform deployed to all Agency staff in May 2025. One documented case …
United Kingdom
The UK i.AI built Redbox, an open-source RAG chatbot enabling civil servants to interrogate policy documents via LLM. Deployed to …
Open full copilot Grounded in cited practices — always check the sources.