← Voltar para o catálogo

stable-baselines3

Esta skill oferece algoritmos de aprendizado por reforço prontos para produção (PPO, SAC, DQN, TD3, DDPG, A2C) com uma API semelhante ao scikit-learn, adequada para experimentos padrão de RL e prototipagem rápida com ambientes Gymnasium. Para treinamento paralelo de alto desempenho ou sistemas multiagente, pufferlib é recomendado.

28.9kestrelas
Atualizado mês passado

Ver no GitHub ↗Licença: MIT

Como adicionar

/plugin marketplace add K-Dense-AI/scientific-agent-skills

O comando exato pode variar conforme o repositório. Confira o README no GitHub.

Para o autor da skill

Cole no README do seu repo

Mostra que sua skill está catalogada na Skillteca, gera backlink e tráfego rastreável.

Listada na Skillteca
[![Listada na Skillteca](https://www.skillteca.com.br/api/badge/stable-baselines3/svg)](https://www.skillteca.com.br/skills/stable-baselines3?utm_source=badge&utm_medium=readme&utm_campaign=badge)

Skills relacionadas

Ver todas de Documentos

Alerta por categoria

Receba novas skills de Documentos toda segunda

1 email curto, só com as skills novas de Documentos. 4 minutos de leitura, sem spam, cancela com 1 clique.

Você confirma o email no primeiro envio. Sem spam. Cancela com 1 clique.

CompartilharXLinkedIn

Comentários · Nenhum comentário

  • Ainda não há comentários. Seja o primeiro.