Skyline Run AI Lab
Treine, observe e compare sete métodos de aprendizado sem sair do navegador.
O PPO começa com a configuração recomendada: treine no Distrito 1 e valide nos Distritos 2 e 3. Inicie o treinamento ao lado da simulação ao vivo ou abra as seções avançadas para personalizar mundos, gerenciar políticas e inspecionar diagnósticos.
Configuração do treinamento
Reprodutibilidade
Salvos neste navegador
Ainda não há modelos salvos neste navegador.
Executar e inspecionar
Mais estatísticas da execução
Os controles de salvar e observar ficam disponíveis quando o treinamento produz uma política avaliada.
Rede neural ao vivo
Aguardando a primeira decisão da rede…
Opções específicas do método
Demonstrações humanas
O PPO pode clonar o comportamento de execuções elegíveis dos distritos da campanha no conjunto de treinamento atual antes do aprendizado por reforço.
0 de 0 demonstrações salvas são elegíveis para os distritos de treinamento selecionados.
Ainda não há demonstrações salvas. Conclua um distrito no jogo e salve a execução.
Políticas e avaliação
Política ativa
Nenhuma política ativa avaliada está pronta.
Testar política
Teste a política selecionada em todos os distritos da campanha e em cinco mundos gerados inéditos. Os resultados incluem rodadas limpas e com 25% de repetição de ações e nunca alteram a seleção da política.
Grupo de comparação
Nenhuma política no grupo de comparação.
Diagnósticos Mostrar gráficos de treinamento e diagnósticos de rede específicos do algoritmo
As métricas aparecem quando o treinamento começa.
As métricas aparecem quando o treinamento começa.
As métricas aparecem quando o treinamento começa.
As métricas aparecem quando o treinamento começa.
As métricas aparecem quando o treinamento começa.
As métricas aparecem quando o treinamento começa.