/
GraphTreeHeap
/
NeuroFighter
Обзор
Документация
Войти
/
GraphTreeHeap
/
NeuroFighter
Код
Запросы
0
Задачи
Вики
Пакеты
0
Релизы
0
Аналитика
Безопасность
master
src/main_train_ppo.py
28 строк
955 B
FedMam
moving to the new project version
11 окт 2025, 04:16
11 окт 2025, 04:16
00409b0
Код
Авторство
О чём код?
from mechanics import * from neural_ppo_singlehead import * from robotics import * torch.set_num_threads(7) torch.manual_seed(192837) device = 'cuda' if torch.cuda.is_available() else 'cpu' agent = PPOAgentWrapper(learning_rate=1e-4, weight_decay=0.0, gamma=0.99, gae_lambda=0.95, clip_epsilon=0.2, entropy_coef_start=0.01, entropy_coef_min=0.001, entropy_coef_decay_episodes=1000, batch_size=1024, update_epochs=4, hidden_dim=256, device=device, seed=192837) agent.train_self_play(epochs=200, iterations_per_epoch=10, trajs_per_iter=20, opponent_pool_size=10, verbose=True)