evidoria

← Retour à la liste

Bonne pratique Importée

Bac à sable d'évaluation de l'IA générative — Le banc d'essai IMDA/AI Verify de Singapour pour un déploiement fiable des LLM

Singapour · Singapore · Voir le profil de Singapour · Voir le profil de Singapore

Preuves: Descriptif / auto-déclaré Top 66% 53/100 · Demandez à Evidence Copilot à propos de cette pratique

L'IMDA de Singapour et l'AI Verify Foundation ont lancé un bac à sable d'évaluation de l'IA générative le 31 octobre 2023, avec 16 organisations — dont Google, Microsoft, AWS, Singtel, OCBC, Deloitte, EY et le régulateur PDPC — testant un catalogue d'évaluation partagé pour les grands modèles de langage.

16 organisations
Organisations participantes au lancement (31 October 2023)
11 principles
Principes du cadre de test
Bac à sable d'évaluation de l'IA générative — Le banc d'essai IMDA/AI Verify de Singapour pour un déploiement fiable des LLM

Détails

Maturité
En expansion
Promoteur
Infocomm Media Development Authority (IMDA) & AI Verify Foundation
Période
2023-present
Mots-clés
AI governance, digital economy regulation, technology assurance

Contexte

Le 31 octobre 2023, l'Infocomm Media Development Authority (IMDA) de Singapour et la fondation indépendante AI Verify ont lancé un Generative AI Evaluation Sandbox, présenté comme un environnement de test contrôlé inédit pour les applications de grands modèles de langage (LLM) avant un déploiement plus large.

Activités

Seize organisations ont confirmé leur participation au lancement : les concepteurs de modèles Google, Microsoft et Amazon Web Services ; les développeurs d'applications Singtel et OCBC testant des cas d'usage spécifiques ; les testeurs externes Deloitte et EY ; et la Commission de protection des données personnelles de Singapour (PDPC) en tant que régulateur observateur. Chaque cas d'usage du bac à sable associe un concepteur de modèle, un déployeur d'application et un testeur tiers, si bien que l'évaluation s'effectue tout au long de la chaîne d'approvisionnement de l'IA plutôt que par l'autocertification d'un seul acteur. Le bac à sable s'articule autour d'un catalogue d'évaluation commun définissant des méthodes de test de référence, visant à révéler les lacunes d'évaluation dans des contextes sectoriels et linguistiques spécifiques et à alimenter des normes techniques de test.

Résultats

Selon les rapports ultérieurs de l'IAPP, le cadre de test comporte 11 principes (dont la transparence, la sécurité, la reproductibilité, l'équité et le contrôle humain) alignés sur le NIST AI Risk Management Framework, le code de conduite international du Processus d'Hiroshima et l'ISO/IEC 42001, et, mi-2025, Standard Chartered avait déjà testé une application d'IA générative via le bac à sable, avec une évaluation indépendante par un tiers. L'IMDA et la fondation AI Verify ont rendu publics la liste des participants, le cadre et les objectifs, mais aucune donnée publiée de manière indépendante ne rapporte encore de taux de réussite/échec, de vulnérabilités détectées ou de changements mesurables apportés aux systèmes déployés du fait des tests du bac à sable.

Mise en œuvre

Coût indicatif
Moyen (50 k€–500 k€) — Not quantified in sources; run jointly by a statutory regulator and an independent foundation with participating firms bearing their own testing costs.
Délai jusqu’aux résultats
Moyen (1–3 ans) — Launched 31 October 2023 with 16 organisations; framework and participation reported as continuing through at least mid-2025 (Standard Chartered pilot).
Personnel et compétences
IMDA (statutory regulator) and the AI Verify Foundation (independent non-profit) jointly run the sandbox, Singapore's PDPC observes as regulator; Deloitte and EY act as third-party testers

Conditions de réussite

  • A supply-chain evaluation design pairing a model developer, an application deployer and a third-party tester for each use case, rather than self-certification
  • Explicit alignment of the testing framework to international standards (NIST AI RMF, Hiroshima Process, ISO/IEC 42001) to support cross-border credibility

Habituellement financé par

National / regional programmes

Pistes de financement indicatives pour des pratiques de ce type — vérifiez toujours les appels en cours et les règles d'éligibilité de chaque programme.

Vous portez cette pratique ? Revendiquez-la — les porteurs vérifiés obtiennent un contact public sur la page et peuvent proposer des corrections.

Sources de données

D'où proviennent les informations de cette pratique, et quand.

Pièces jointes

Pratiques similaires qui pourraient vous être utiles