核心结论:正向强化训练建立在对正确行为的奖励而非对错误行为的惩罚之上,正确的奖励时机和类型是训练效果的保证。
详细内容
1. 及时性是奖励机制的核心,奖励必须在期望行为出现后的一到三秒内给出让狗狗准确关联行为和奖励;;
2. 零食奖励的价值分级很重要,日常训练使用低价值奖励而在高干扰环境使用最高价值的特殊奖励;;
3. 混合使用零食奖励和玩具奖励可保持新鲜感,对于玩具驱动型犬种如梗犬拉扯游戏是比食物更强的奖励;;
4. 口头表扬和抚摸是社交性奖励虽然不如食物直接但在距离奖励困难时是非常实用的替代方式;;
5. 逐步将连续强化过渡到间歇性强化,不是每次正确行为都奖励而是逐步增加间隔使行为更加稳固持久