Criado em público · experimento de laboratório
Aprendizado de máquina no navegador

Skyline Run AI Lab

Treine, observe e compare sete métodos de aprendizado sem sair do navegador.

Comece pelo básico

O PPO começa com a configuração recomendada: treine no Distrito 1 e valide nos Distritos 2 e 3. Inicie o treinamento ao lado da simulação ao vivo ou abra as seções avançadas para personalizar mundos, gerenciar políticas e inspecionar diagnósticos.

Configuração do treinamento

Os sete métodos treinam com os mesmos controles sem limitações, e trocar de algoritmo mantém os mundos escolhidos. Demonstrações continuam exclusivas do PPO e o controle de recompensas, do NEAT simples.
Reprodutibilidade

Salvos neste navegador

Ainda não há modelos salvos neste navegador.

Executar e inspecionar

Ocioso Etapas do ambiente: 0
Mais estatísticas da execução
Etapas de avaliação: 0 0 ticks/s
Velocidade
Desative a renderização para treinar em velocidade máxima.
Sobrepõe os tiles percebidos e mostra as entradas exatas da rede.

Os controles de salvar e observar ficam disponíveis quando o treinamento produz uma política avaliada.

Rede neural ao vivo

Aguardando a primeira decisão da rede…

Mundos de treinamento

A configuração recomendada treina no distrito principal e valida em dois outros distritos da campanha. Personalize esses mundos explicitamente quando quiser testar a generalização.

Distritos de treinamento
Mundos de validação
Opções específicas do método
Demonstrações humanas As demonstrações de clonagem comportamental estão disponíveis apenas no PPO.
IA treinadora O treinamento com controlador de recompensas está disponível apenas no NEAT simples.

Demonstrações humanas

O PPO pode clonar o comportamento de execuções elegíveis dos distritos da campanha no conjunto de treinamento atual antes do aprendizado por reforço.

0 de 0 demonstrações salvas são elegíveis para os distritos de treinamento selecionados.

Ainda não há demonstrações salvas. Conclua um distrito no jogo e salve a execução.

Políticas e avaliação

Política ativa

Nenhuma política ativa avaliada está pronta.

Testar política

Teste a política selecionada em todos os distritos da campanha e em cinco mundos gerados inéditos. Os resultados incluem rodadas limpas e com 25% de repetição de ações e nunca alteram a seleção da política.

Grupo de comparação

Nenhuma política no grupo de comparação.

Diagnósticos Mostrar gráficos de treinamento e diagnósticos de rede específicos do algoritmo
Iteração 0 Episódio 0 Melhor progresso: 0 px Agentes ativos: 0 0 ticks/s Ocioso Etapas do ambiente: 0 Etapas de avaliação: 0
Recompensa do episódio

As métricas aparecem quando o treinamento começa.

Progresso normalizado por episódio

As métricas aparecem quando o treinamento começa.

Progresso médio do episódio

As métricas aparecem quando o treinamento começa.

Perda do treinamento

As métricas aparecem quando o treinamento começa.

Entropia da política

As métricas aparecem quando o treinamento começa.

Conclusões por geração

As métricas aparecem quando o treinamento começa.