Pesquisadores da divisão Apple Machine Learning Research apresentaram um método para criar dados sintéticos destinados ao treinamento de agentes em grandes modelos de linguagem, o qual não exige a presença de um ambiente de software real. O processo tradicional de coleta desses dados enfrenta uma séria limitação de escalabilidade, pois geralmente necessita de ambientes totalmente implementados com APIs executáveis e bancos de dados realistas previamente preenchidos.

A solução proposta utiliza grandes modelos de linguagem como modelos de mundo digitais, operando em tempo real. Dispondo apenas das especificações da API, o sistema gera trajetórias de interação que imitam o comportamento de um agente em um ambiente com preservação de estado. Isso permite contornar a etapa de criação de suporte infraestrutural complexo para cada novo cenário de treinamento.

Teoricamente, essa abordagem elimina o gargalo associado à necessidade de emular o backend para cada tarefa. O método baseia-se exclusivamente nas descrições de interfaces, criando a ilusão de interação com um sistema ativo, o que pode acelerar significativamente a preparação de conjuntos de dados para o treinamento de agentes autônomos.