A IMDA de Singapura e a AI Verify Foundation lançaram um Sandbox de Avaliação de IA Generativa a 31 de outubro de 2023, com 16 organizações — incluindo Google, Microsoft, AWS, Singtel, OCBC, Deloitte, EY e o regulador PDPC — a testar um catálogo de avaliação partilhado para grandes modelos de linguagem.
16 organisations
Organizações participantes no lançamento (31 October 2023)
11 principles
Princípios no quadro de testes
Detalhes
Maturidade
Em expansão
Promotor
Infocomm Media Development Authority (IMDA) & AI Verify Foundation
Período
2023-present
Palavras-chave
AI governance, digital economy regulation, technology assurance
Contexto
Em 31 de outubro de 2023, a Infocomm Media Development Authority (IMDA) de Singapura e a Fundação independente AI Verify lançaram um Generative AI Evaluation Sandbox, apresentado como um ambiente de teste controlado inédito para aplicações de modelos de linguagem de grande escala (LLM) antes de uma implementação mais ampla.
Atividades
Dezasseis organizações confirmaram participação no lançamento: os desenvolvedores de modelos Google, Microsoft e Amazon Web Services; os desenvolvedores de aplicações Singtel e OCBC, testando casos de uso específicos; os testadores externos Deloitte e EY; e a Comissão de Proteção de Dados Pessoais (PDPC) de Singapura como reguladora observadora. Cada caso de uso do sandbox associa um desenvolvedor de modelo, um implementador de aplicação e um testador terceiro, de modo que a avaliação ocorre ao longo de toda a cadeia de fornecimento de IA, e não através da autocertificação de um único ator. O sandbox está estruturado em torno de um Catálogo de Avaliação partilhado, que define métodos de teste de base, com o objetivo de identificar lacunas de avaliação em contextos específicos de domínio e em diferentes idiomas, e de gerar contributos para normas técnicas de teste.
Resultados
Segundo reportagens posteriores da IAPP, o quadro de testes abrange 11 princípios (incluindo transparência, segurança, repetibilidade, equidade e supervisão humana), alinhados com o NIST AI Risk Management Framework, o Código de Conduta Internacional do Processo de Hiroshima e a ISO/IEC 42001, e, em meados de 2025, o Standard Chartered já tinha testado uma aplicação de IA generativa através do sandbox, com avaliação independente por terceiros. A IMDA e a Fundação AI Verify divulgaram publicamente a lista de participantes, o quadro de referência e os objetivos, mas nenhum dado publicado de forma independente reporta ainda taxas de aprovação/reprovação, vulnerabilidades encontradas ou alterações mensuráveis nos sistemas implementados em resultado dos testes no sandbox.
Implementação
Custo indicativo
Médio (50 mil–500 mil €) — Not quantified in sources; run jointly by a statutory regulator and an independent foundation with participating firms bearing their own testing costs.
Tempo até resultados
Médio (1–3 anos) — Launched 31 October 2023 with 16 organisations; framework and participation reported as continuing through at least mid-2025 (Standard Chartered pilot).
Equipa e competências
IMDA (statutory regulator) and the AI Verify Foundation (independent non-profit) jointly run the sandbox, Singapore's PDPC observes as regulator; Deloitte and EY act as third-party testers
Condições de sucesso
A supply-chain evaluation design pairing a model developer, an application deployer and a third-party tester for each use case, rather than self-certification
Explicit alignment of the testing framework to international standards (NIST AI RMF, Hiroshima Process, ISO/IEC 42001) to support cross-border credibility
Habitualmente financiado por
National / regional programmes
Vias de financiamento indicativas para práticas deste tipo — verifique sempre os avisos abertos e as regras de elegibilidade de cada programa.
Implementa esta prática?
Reivindique-a —
implementadores verificados obtêm um contacto público na página e podem propor correções.
Fontes de dados
De onde foi obtida a informação desta prática, e quando.