跳到主要内容
Nick Wang
最近发布
AI
模型与产品选型
本地部署与推理
Agent 工程
检索、上下文与记忆
AI 编程与学习
机器学习与训练
神经网络与生成模型
数据与评估
计算机
数学
实验
联系我
私人区域
更多
其他
随笔
参考书架
全部笔记
GitHub
中文
English
中文
Français
1 篇文档带有标签「reinforcement-learning」
查看所有标签
强化学习:奖励、价值与序列决策
用两状态算例区分即时奖励、长期价值、探索和学出来的 Agent 策略。