🎮

RL Agent Agents

3,902 个Agent
Reinforcement learning agents
分类
🤖 General Agent 371,187 📱 Application 364,538 🔗 On-Chain 207,222 🧠 LLM Model 199,151 📊 Trading 39,991 🏗️ Framework 35,951 💬 Language Model 28,567 🔌 MCP Server 27,700 📋 Other 24,631 👥 Social 6,144 🦾 Robotics 6,004 GPT Agent 5,314 🎮 RL Agent 3,902 🎤 Voice 3,320 ⚙️ Productivity 3,040 🏠 Lifestyle 2,524 📚 Education 2,407 🔧 Tool 2,181 🔬 Research 2,052 🗣️ LLM Agent 2,020 ✍️ Writing 1,860 🌐 Multi-Agent 1,713 💻 Programming 1,695 🎨 DALL·E 1,051
# Agent 平台 评分 信号等级
2761 Qwen2.5-0.5B-hint_following_reward-512 HuggingFace 1.67 unrated
2762 Qwen2.5-0.5B-hint_following_reward_faithful_prompt-1024 HuggingFace 1.67 unrated
2763 Qwen2.5-0.5B-hint_following_reward_faithful_prompt-2048 HuggingFace 1.67 unrated
2764 Qwen2.5-0.5B-hint_following_reward_faithful_prompt-512 HuggingFace 1.67 unrated
2765 Qwen2.5-0.5B-hint_verbalization_reward_relaxed_v7-1024 HuggingFace 1.67 unrated
2766 Qwen2.5-0.5B-hint_verbalization_reward_relaxed_v7-2048 HuggingFace 1.67 unrated
2767 Qwen2.5-0.5B-hint_verbalization_reward_relaxed_v7-512 HuggingFace 1.67 unrated
2768 Qwen2.5-0.5B-hint_verbalization_reward_strict_v9-1024 HuggingFace 1.67 unrated
2769 Qwen2.5-0.5B-hint_verbalization_reward_strict_v9-2048 HuggingFace 1.67 unrated
2770 Qwen2.5-0.5B-hint_verbalization_reward_strict_v9-512 HuggingFace 1.67 unrated
2771 Qwen2.5-0.5B-hybrid_accuracy_hint_reward-1024 HuggingFace 1.67 unrated
2772 Qwen2.5-0.5B-hybrid_accuracy_hint_reward-2048 HuggingFace 1.67 unrated
2773 Qwen2.5-0.5B-hybrid_accuracy_hint_reward-512 HuggingFace 1.67 unrated
2774 Qwen2.5-0.5B-Instruct-code_problems_hint_following-1024 HuggingFace 1.67 unrated
2775 Qwen2.5-0.5B-Instruct-code_problems_hint_following-2048 HuggingFace 1.67 unrated
2776 Qwen2.5-0.5B-Instruct-hint_verbalization_reward_strict_v2-1024 HuggingFace 1.67 unrated
2777 Qwen2.5-0.5B-Instruct-hint_verbalization_reward_strict_v2-2048 HuggingFace 1.67 unrated
2778 Qwen2.5-0.5B-Instruct-hint_verbalization_reward_strict_v2-512 HuggingFace 1.67 unrated
2779 Qwen2.5-0.5B-Instruct-mmlu_trained_ha-1024 HuggingFace 1.67 unrated
2780 Qwen2.5-0.5B-Instruct-mmlu_trained_ha-2048 HuggingFace 1.67 unrated