evidoria

← Volver al listado

Buena práctica Importada

Sandbox de Evaluación de IA Generativa — El banco de pruebas IMDA/AI Verify de Singapur para un despliegue fiable de LLM

Singapur · Singapore · Ver el perfil de Singapur · Ver el perfil de Singapore

Evidencia: Descriptivo / autodeclarado Top 66% 53/100 · Pregunte a Evidence Copilot sobre esta práctica

La IMDA de Singapur y la AI Verify Foundation lanzaron un sandbox de evaluación de IA generativa el 31 de octubre de 2023, con 16 organizaciones — entre ellas Google, Microsoft, AWS, Singtel, OCBC, Deloitte, EY y el regulador PDPC — que prueban un catálogo de evaluación compartido para grandes modelos de lenguaje.

16 organisations
Organizaciones participantes en el lanzamiento (31 October 2023)
11 principles
Principios del marco de pruebas
Sandbox de Evaluación de IA Generativa — El banco de pruebas IMDA/AI Verify de Singapur para un despliegue fiable de LLM

Detalles

Madurez
En expansión
Promotor
Infocomm Media Development Authority (IMDA) & AI Verify Foundation
Período
2023-present
Palabras clave
AI governance, digital economy regulation, technology assurance

Contexto

El 31 de octubre de 2023, la Infocomm Media Development Authority (IMDA) de Singapur y la fundación independiente AI Verify lanzaron un Generative AI Evaluation Sandbox, presentado como un entorno de pruebas controlado pionero para aplicaciones de grandes modelos de lenguaje (LLM) antes de su despliegue más amplio.

Actividades

Dieciséis organizaciones confirmaron su participación en el lanzamiento: los desarrolladores de modelos Google, Microsoft y Amazon Web Services; los desarrolladores de aplicaciones Singtel y OCBC, que probaron casos de uso específicos; los evaluadores externos Deloitte y EY; y la Comisión de Protección de Datos Personales (PDPC) de Singapur como regulador observador. Cada caso de uso del sandbox combina un desarrollador de modelo, un implementador de aplicación y un evaluador externo, de modo que la evaluación se realiza a lo largo de toda la cadena de suministro de IA, en lugar de mediante la autocertificación de un único actor. El sandbox se organiza alrededor de un Catálogo de Evaluación compartido que establece métodos de prueba de referencia, con el objetivo de detectar carencias de evaluación en contextos específicos de dominio e idiomas, y generar aportaciones para normas técnicas de prueba.

Resultados

Según informes posteriores de IAPP, el marco de pruebas abarca 11 principios (incluidos transparencia, seguridad, repetibilidad, equidad y supervisión humana) alineados con el NIST AI Risk Management Framework, el Código de Conducta Internacional del Proceso de Hiroshima y la norma ISO/IEC 42001, y a mediados de 2025 Standard Chartered ya había probado una aplicación de IA generativa a través del sandbox, con evaluación independiente por terceros. La IMDA y la Fundación AI Verify han hecho pública la lista de participantes, el marco y los objetivos, pero ningún dato publicado de forma independiente informa todavía de tasas de aprobación/rechazo, vulnerabilidades encontradas o cambios medibles en los sistemas desplegados como resultado de las pruebas del sandbox.

Implementación

Coste indicativo
Medio (50 000–500 000 €) — Not quantified in sources; run jointly by a statutory regulator and an independent foundation with participating firms bearing their own testing costs.
Tiempo hasta resultados
Medio (1–3 años) — Launched 31 October 2023 with 16 organisations; framework and participation reported as continuing through at least mid-2025 (Standard Chartered pilot).
Personal y competencias
IMDA (statutory regulator) and the AI Verify Foundation (independent non-profit) jointly run the sandbox, Singapore's PDPC observes as regulator; Deloitte and EY act as third-party testers

Condiciones para el éxito

  • A supply-chain evaluation design pairing a model developer, an application deployer and a third-party tester for each use case, rather than self-certification
  • Explicit alignment of the testing framework to international standards (NIST AI RMF, Hiroshima Process, ISO/IEC 42001) to support cross-border credibility

Habitualmente financiado por

National / regional programmes

Vías de financiación indicativas para prácticas de este tipo: compruebe siempre las convocatorias vigentes y las reglas de elegibilidad de cada programa.

¿Usted implementa esta práctica? Reivindíquela — los implementadores verificados obtienen un contacto público en la página y pueden proponer correcciones.

Fuentes de datos

De dónde se obtuvo la información de esta práctica, y cuándo.

Adjuntos

Prácticas similares que pueden serle útiles