Compose an agent
Pick a recipe or framework starter. See the patterns it instantiates. Ask the catalog’s resident LLM about your composition — should you swap a pattern? Add one? Trade off?
OpenClaw-RL 代理 SDK
通过将实时多轮对话转化为完全异步的强化学习训练信号,在终端、图形用户界面、软件工程和工具调用环境中训练个性化的LLM代理。
Patterns it instantiates (5)
- Agent-as-a-Judge — 通过另一个代理评估代理的完整轨迹(步骤、工具调用、中间状态),而不仅仅是评分最终输出。
- Evaluator-Optimizer — 一个LLM生成;另一个评估并反馈;循环直到满足标准。
- 事件驱动代理 — 在外部事件(webhooks、消息队列、文件更改)上触发代理,而不是用户请求或计划任务。
- 过程奖励模型 — 训练一个评分每个推理步骤的验证器,而不仅仅是最终答案。
- 工具使用 — 让LLM对外部工具包进行类型化调用,而不是生成周围系统需要解析的自由文本。
Ask the catalog expert
⌘/Ctrl + Enter to send. Set OPENAI_API_KEY in .env if the catalog reports it is disabled.