Não deixe que o modelo, a chave ou a interface se tornem o elo mais fraco

Yudun trata o modelo no dispositivo, o tempo de execução de inferência, as credenciais da API, as entradas e saídas e a cadeia de atualização como riscos separados. O código e os recursos valiosos do cliente são protegidos enquanto as chaves privilegiadas e a autorização final permanecem no servidor.

Esses problemas estão impedindo seu aplicativo?

  • Um modelo ou configuração pode ser copiado ou substituído após o envio
  • Uma chave de API de modelo de longa duração está incorporada em APK, IPA ou SO
  • Clientes personificados consomem cota de nuvem e geram custos descontrolados
  • Versões de modelo, tempo de execução e aplicativo oscilam e falham na produção

Como Yudun lida com eles

  • Modelo no dispositivo e proteção em tempo de execução

    Defina a proteção do cliente para recursos de modelo, lógica de pré/pós-processamento e caminhos de invocação de inferência.

  • Limite de interface e credencial

    Remova chaves privilegiadas de longa duração do cliente e use credenciais limitadas e de curta duração com autorização do servidor.

  • Validação de liberação de modelo

    Valide o emparelhamento de modelo, tempo de execução e versão do aplicativo, com desativação, implementação gradual e caminhos de reversão.

Cenário: quando uma chave de API de modelo é extraída, a perda aparece nos gastos na nuvem e nas invocações personificadas

Um cenário público da arquitetura Yudun explica por que ocultar uma string não é um controle completo para roubo e abuso de API de IA móvel.

Veja a arquitetura de controle de risco

O que a avaliação revelou

  • O cliente solicita uma credencial limitada e de curta duração em vez de armazenar a chave mestra do modelo
  • Invocações de modelo são executadas por meio de um proxy de servidor ou gateway controlado
  • Vinculação de solicitações, cotas, registros e monitoramento de custos expõem uso anormal

Escopo: Este é um cenário e arquitetura de risco público, não um incidente de cliente ou uma taxa de bloqueio reivindicada ou economia de custos.

Da avaliação à entrega

Veja a forma de entrega
  1. 01

    Separe os riscos

    Divida modelo, tempo de execução, credenciais, interfaces e dados do usuário em vez de invocar toda a criptografia do modelo.

  2. 02

    Defina o limite cliente-servidor

    Decida o que permanece no dispositivo e quais chaves e ações de alto risco pertencem ao servidor.

  3. 03

    Validar entrega

    Emparelhamento de versões de teste, permissões de interface, desativação de emergência e reversão.

Perguntas que os clientes costumam fazer

Ver todos os artigos

Perguntas antes da compra

Um modelo é seguro após a criptografia de arquivos?

Não. O modelo deve ser usado em tempo de execução, enquanto entradas, saídas, material de memória, interfaces e credenciais permanecem expostos a riscos separados.

Uma chave de API pode ser armazenada em um aplicativo móvel?

Não trate uma chave de alto privilégio e longa duração como um segredo do cliente. Prefira um proxy de servidor com menos privilégios, rotação e registros de solicitação.

Todas as inferências de IA devem ser executadas em um servidor?

Não. A inferência no dispositivo pode reduzir a latência e melhorar a privacidade, mas acrescenta preocupações com entrega de modelo, versão, recurso do dispositivo e material de tempo de execução.

Quando uma reivindicação de proteção de IA é verificada?

Somente quando a versão candidata, o método, os cenários cobertos e os itens em aberto estiverem explícitos. O trabalho de design ou a observação estática não são verificação em tempo de execução.

Padrões de segurança e referências de plataforma

  1. Apple Core ML

    Integração de modelo no dispositivo e limites de tempo de execução

  2. Google AI Edge LiteRT

    Tempo de execução de inferência no dispositivo e contexto de entrega de modelo

  3. OWASP MASVS

    Controles de segurança de aplicativos móveis e escopo de verificação

  4. Android security best practices

    Design de segurança de aplicativo Android e limites de lançamento

  5. Apple Platform Security

    Assinatura de código da plataforma Apple e contexto de segurança de tempo de execução