evidoria

← Voltar à navegação

Boa prática Importada

Sandbox de Avaliação de IA Generativa — O Banco de Testes IMDA/AI Verify de Singapura para a Implantação Confiável de LLMs

Singapura · Singapore · Ver o perfil de Singapura · Ver o perfil de Singapore

Evidência: Descritivo / autorreportado Top 66% 53/100 · Pergunte a Evidence Copilot sobre esta prática

A IMDA de Singapura e a AI Verify Foundation lançaram um Sandbox de Avaliação de IA Generativa a 31 de outubro de 2023, com 16 organizações — incluindo Google, Microsoft, AWS, Singtel, OCBC, Deloitte, EY e o regulador PDPC — a testar um catálogo de avaliação partilhado para grandes modelos de linguagem.

16 organisations
Organizações participantes no lançamento (31 October 2023)
11 principles
Princípios no quadro de testes
Sandbox de Avaliação de IA Generativa — O Banco de Testes IMDA/AI Verify de Singapura para a Implantação Confiável de LLMs

Detalhes

Maturidade
Em expansão
Promotor
Infocomm Media Development Authority (IMDA) & AI Verify Foundation
Período
2023-present
Palavras-chave
AI governance, digital economy regulation, technology assurance

Contexto

Em 31 de outubro de 2023, a Infocomm Media Development Authority (IMDA) de Singapura e a Fundação independente AI Verify lançaram um Generative AI Evaluation Sandbox, apresentado como um ambiente de teste controlado inédito para aplicações de modelos de linguagem de grande escala (LLM) antes de uma implementação mais ampla.

Atividades

Dezasseis organizações confirmaram participação no lançamento: os desenvolvedores de modelos Google, Microsoft e Amazon Web Services; os desenvolvedores de aplicações Singtel e OCBC, testando casos de uso específicos; os testadores externos Deloitte e EY; e a Comissão de Proteção de Dados Pessoais (PDPC) de Singapura como reguladora observadora. Cada caso de uso do sandbox associa um desenvolvedor de modelo, um implementador de aplicação e um testador terceiro, de modo que a avaliação ocorre ao longo de toda a cadeia de fornecimento de IA, e não através da autocertificação de um único ator. O sandbox está estruturado em torno de um Catálogo de Avaliação partilhado, que define métodos de teste de base, com o objetivo de identificar lacunas de avaliação em contextos específicos de domínio e em diferentes idiomas, e de gerar contributos para normas técnicas de teste.

Resultados

Segundo reportagens posteriores da IAPP, o quadro de testes abrange 11 princípios (incluindo transparência, segurança, repetibilidade, equidade e supervisão humana), alinhados com o NIST AI Risk Management Framework, o Código de Conduta Internacional do Processo de Hiroshima e a ISO/IEC 42001, e, em meados de 2025, o Standard Chartered já tinha testado uma aplicação de IA generativa através do sandbox, com avaliação independente por terceiros. A IMDA e a Fundação AI Verify divulgaram publicamente a lista de participantes, o quadro de referência e os objetivos, mas nenhum dado publicado de forma independente reporta ainda taxas de aprovação/reprovação, vulnerabilidades encontradas ou alterações mensuráveis nos sistemas implementados em resultado dos testes no sandbox.

Implementação

Custo indicativo
Médio (50 mil–500 mil €) — Not quantified in sources; run jointly by a statutory regulator and an independent foundation with participating firms bearing their own testing costs.
Tempo até resultados
Médio (1–3 anos) — Launched 31 October 2023 with 16 organisations; framework and participation reported as continuing through at least mid-2025 (Standard Chartered pilot).
Equipa e competências
IMDA (statutory regulator) and the AI Verify Foundation (independent non-profit) jointly run the sandbox, Singapore's PDPC observes as regulator; Deloitte and EY act as third-party testers

Condições de sucesso

  • A supply-chain evaluation design pairing a model developer, an application deployer and a third-party tester for each use case, rather than self-certification
  • Explicit alignment of the testing framework to international standards (NIST AI RMF, Hiroshima Process, ISO/IEC 42001) to support cross-border credibility

Habitualmente financiado por

National / regional programmes

Vias de financiamento indicativas para práticas deste tipo — verifique sempre os avisos abertos e as regras de elegibilidade de cada programa.

Implementa esta prática? Reivindique-a — implementadores verificados obtêm um contacto público na página e podem propor correções.

Fontes de dados

De onde foi obtida a informação desta prática, e quando.

Anexos

Práticas semelhantes que podem ser úteis