A OpenAI anunciou ter identificado e bloqueado uma campanha coordenada voltada à distilação de seus modelos de inteligência artificial, com o propósito de extrair capacidades de raciocínio protegidas de seus sistemas. De acordo com informações divulgadas pela companhia, o núcleo da atividade foi vinculado a indivíduos associados à empresa chinesa Moonshot AI, criadora do chatbot Kimi.
Conforme apurado, as movimentações tiveram início nos primeiros dias de julho e alcançaram seu ponto mais alto entre os dias 24 e 25 do mesmo mês. Nesse período, a desenvolvedora detectou 16 mil solicitações realizadas por mais de quatro mil usuários que seguiam um padrão específico de extração. Investigações posteriores ampliaram o escopo para um conjunto com mais de 15 mil usuários. A empresa declarou que a campanha foi totalmente interrompida em 28 de julho.
A tentativa de extração não envolveu invasões a bancos de dados ou quebras diretas da criptografia que protege o raciocínio dos modelos. O método consistia em explorar a forma como o sistema processava informações entre sessões distintas. Os operadores copiavam dados de raciocínio criptografados de uma conversa e, em seguida, pediam ao modelo que os descriptografasse e transcrevesse para texto visível em outra interação.
Representantes da OpenAI destacaram que os operadores manipularam as interações para reproduzir o raciocínio protegido de maneira coordenada e em larga escala, violando os termos de serviço. A técnica foi definida pela companhia como um novo formato de ataque de distilação.
Até o momento, não há clareza se toda a operação foi conduzida por um único operador utilizando milhares de contas ou se contou com a participação de múltiplos grupos. A associação com pessoas ligadas à Moonshot AI foi apontada pela empresa, embora evidências técnicas detalhadas não tenham sido tornadas públicas.
A prática conhecida como distilação de modelos consiste em um método legítimo de treinamento, no qual um sistema avançado serve como referência para ensinar um modelo menor e mais eficiente. No entanto, controvérsias surgem quando companhias utilizam tecnologias proprietárias de terceiros para obter grandes volumes de dados de forma não autorizada.
Com informações: Olhar Digital — ver matéria original
Esta matéria foi produzida com apoio de inteligência artificial e revisada por um jornalista antes da publicação.
