斯金纳箱与游戏设计
美国的心理学家和行为科学家斯金纳提出了一种“操作条件反射”理论,认为人或动物为了达到某种目的,会采取一定的行为作用于环境。

实验1:将一只很饿的小白鼠放入一个有按钮的箱中,每次按下按钮,则掉落食物。
结果:小白鼠自发学会了按按钮。
实验2:将一只小白鼠放入一个有按钮的箱中。每次小白鼠不按下按钮,则箱子通电。
结果:小白鼠学会了按按钮。
当这种行为的后果对他有利时,这种行为就会在以后重复出现;不利时,这种行为就减弱或消失。人们可以用这种正强化或负强化的办法来影响行为的后果,从而修正其行为,这就是强化理论,也叫做行为修正理论。

如图所示,想要增加该行为就使用【强化】,有正向与负向两种,想减少该行为就使用【惩罚】,也有正向与反向两种;
-
强化正向:给狗吃垂涎已久的高级肉罐;
-
强化负向:把狗狗讨厌的项圈与绳索去除;
-
惩罚正向:把狗狗丢进笼子关禁闭;
-
惩罚负向:把狗狗心爱的玩具收起来不给它玩;
如何有效的反复增加行为?
1、正确的方式
惩罚可以迅速建立行为模式,但一定的副作用:来得快,去得也快,一旦惩罚消失,则行为模式也会迅速消失。实验证明,被惩罚消除的行为是不牢固的,只要停止惩罚一解除,行为就会再次出现 ,而强化则影响更深远长久;
2、合适的形式
曾经做过两组小白鼠试验,第一次采用定时制,每隔1分钟按一次按钮就会出现食物,小白鼠学会按钮后,当停止供应食物后,小白鼠迅速遗忘了该行为;
第二次采用概率型,将一只很饿的小白鼠放入斯金纳箱中,多次按下按钮,概率掉落食物。当不再掉落食物时,小白鼠的行为消失速度非常慢。
如何应用于游戏化产品中
大家都知道好的游戏奖励设计能鼓励或刺激玩家持续游玩,但如何让设计的奖励生效,即便有经验的设计师也不一定能说个明白,依据激励强化理论转化为游戏设计思路,有以下三条:
奖励(原文称强化物)的选择至少要考虑到三个方面
-
奖励是玩家真正所需的,且能让玩家感受到渴望;
-
奖励具有一定稀缺性和排他性,也就说需要获得某种独享;
-
奖励周期设计需要用曲线而不是直线,收益和付出关系需要合理的有增有减,非一尘不变,也非超出控制;
1、奖励的实用与稀缺性
一种物品一旦不再稀缺,强化作用就会迅速消失,哪怕是不花成本的微笑,用多了笑脸也会失去激励效应。

在游戏中某需求的资源到达一定界限之后,如果再把这些作为奖励,俺么这些奖励的吸引力会大大降低,会存在着一个递减效应。这个很好理解,不那么需要就不会有强烈获得欲望;奖励确定是玩家所需要的东西,并且能引起激励玩家的获得欲望;
在《游戏产品化》一书中曾提到游戏本质就是精通的过程,而其中学习后的成果必须与游戏目标相对应,可以是奖励也可以是玩家水平提升,最终它必须与游戏最终目的做结合;简单理解:玩家收集的内容是需要与游戏目的相关联的,案例:《马里奥》中的金币收集100个获1UP(续关次数),而它就是达到更深层关卡的秘诀;相反假如核心收集物若与游戏目标无关/背离,玩家就会反复难受:每次遇到该收集物都会产生厌恶情绪;案例:《巴兰的异想奇境》以下为网媒的评价:
大量水晶被塞进了关卡的每一个角落,但收集它们无法给玩家带来实际上的收益,而它们唯一的价值是被拿回主岛喂给宠物“福宝”。当玩家发现收集它们几乎没有意义的时候,对于场景中的水晶就会容易失去收集的欲望,从而让这个系统变得名存实亡。
——《游民星空》


2、奖励投放曲线
还记得概率型的试验吗?这项试验对游戏来说最大好处是:游戏即便有瑕疵,依然不会让玩家放弃游戏,谁都没办法保证自己的游戏每个节点能令所有玩家满意,那么我们的策略就是养成玩家持续行为的习惯,尽可能的把玩家引导下一处,让玩家在其他游戏环节中得到满足,只要这样做就能尽可能的提升玩家的游戏体验感。一款再好的游戏假若没人能玩到最后,那么它也不能称为好游戏;
这项重要的任务就依靠游戏投放设计去解决,游戏行为没有试验中点击按钮那么简单,它可能是一项有难度的关卡,或是一个简单任务,你会发现多出来一个因素,那就是行为成本有高有低,这点在原试验是不存在的,需要控制花费不同精力却得到相同奖励的极端情出现。正确的方式是:以玩家付出做奖励价值参考基准,在合理范围内上下浮动(保持随机性)。
3、非理性行为
奖励与行为之间的关系是非理性的,我们把它称为“迷信”,在动物实验时偶然动作获得触发得到的奖励,会促使玩家疯狂的去重现这个动作,比如手游中抽卡系统,很多玩家会迷信的穿COS服抽卡、在凌晨抽卡等一些奇怪的操作,并认为它可能会影响抽卡结果。事实上迷信只有在多次无效的情形下,才会逐渐产生操作性消退。但是,只要有偶然性存在,迷信就不能彻底根除。
可以利用这点在想让玩家重复尝试的行为上设置概率型奖励,这不仅限于一定要是付费设计,例如:国产RPG中大家都养成了一个习惯,喜欢在每个地图边缘疯狂按空格以免错漏任何一个隐藏道具;


4、如何填充奖励池
游戏设计经常会遇到这样的情况,能有效刺激玩家欲望的奖励大多都是有限的,或者说必须控制,假如滥发会造成贬值的新问题,物品一旦不稀缺,奖励作用就会消失。其次,玩家需求的本就不是单一性和重复性的,这就需要大范围、多样化的奖励进行激励。
这里就需要知道如何应用奖励组合:
1)增加搜索组合的范围的原则:设计者能提供、奖励对玩家能接受、奖励能起到奖励的激励作用;
2)奖励组合的方式:第一种:将原本就具有激励作用的不同事物结合使用;第二种:原本没有激励作用的事物按照行为关系结合使用,使它产生强化作用,这就是条件强化物。具体做法,把一个中性刺激物与一个强化刺激物反复匹配联合,那么该中性刺激物就具备了强化的性质和作用。举例子:《守望先锋》开补给箱,或是许多抽卡游戏都有类似的设定,其实箱子内的补给品才是奖励本体,但由于每次开箱先看到灯光后才出现并奖励,这个中性的灯光它就成了条件性强化物。只要玩家开出过好东西并记住这个灯光,那么在以后游戏任何地方看到类似的光源都会情不自禁的想去接近互动;


5、条件强化物与类强化物
上文中提到的条件强化物具有以下特点
1)中性刺激物与奖励之间联系次数越多,效果越强;
2)中性刺激物与奖励之间出现间隔不能太长;
- 奖励中断不再出现则,中性刺激物的激励效果将迅速消失;
大家发现它其实并不牢固,对其他因素依赖性很强,这是由于中性刺激物与奖励存在单一的对应,假如设定成一对多,就是我们说的类强化物;
例如:《魔兽世界》声望点数、代币设计就是这种;
-
中性刺激物:声望点数
-
奖励:这里不再是单一奖励,而是可选的多种奖励;
※现实生活中,人们喜欢钱也是因为它几乎可以联系所有人类的需求:衣食住行(奖励);
因为类强化物联系更广泛,这就意味着只要还有剩余的联系存在它就能发挥激励作用,理论中明确说明虽然奖励众多,但必须有高价值高吸引力的奖励;《魔兽世界》中声望兑换就会有独占的宠物,或者坐骑,即便玩家毕业了为了获取该道具,也必须去回头刷该声望;不同的类强化物之间关联的奖励也是独立分开的,例如商城贩卖的内容几乎都是独占的,游戏其它方式无法获得,这样的设计才使得每个渠道都有各自的吸引力;


其实早期的《梦幻西游》经验值也算是这类设定,经验值可以选择升级也可以用于门派技能提升等级,那么玩家就对经验值产生更吸引的动力,想去不断刷怪获取。
6、激励类型
如果只是偶然对儿童的良好行为给予奖励,在停止奖励后,这种良好行为保持的时间,要比每一次良好行为都给予奖励保持的时间长得多。
间歇性奖励又有四种类型:
1)固定间时强化,奖励是定期的,如计时工资,
《魔兽世界》经验值双倍系统,需在旅店附近下线累计时长:
-
越强大时刺激行动概率越大;
-
奖励出现后由于玩家知道短期不会有,所以会降低,但下次满的时候又增加;
※类似的系统《魔力宝贝》《梦幻西游》的打卡功能,只是在显示上有所差异;


2)变动间时强化,奖励是不定期的,如随时进行的奖励;
现今被游戏使用泛滥的随机掉落系统就符合这条,因为例子太多了就不列举,仅说明特点:
-
它能够消除奖励出现后的反应概率降低现象;
-
因难以琢磨后续奖励出现的时间,因此,能使玩家保持一个相对稳定的行为水平;
3)固定比率强化,奖励按一定比率进行,如营业提成;《魔兽世界》收集一堆的材料开始烧生活技能,材料没有了就会停止这种行为,当材料足够多时越发提升该行为概率,其特点是:
假如行为的成本很高,导致行为无法保持时,就会出现快速消退,这种情况被斯金纳称为“行为缺失”
※有两种情况会产生,第一种是单次无法满足该行为,第二种是无法持续满足该行为;
有点类似瓜子理论,其中提到能让人不停的想嗑瓜子第一条件是:不论人们喜欢与否,很容易拿起第一颗瓜子(也就是行为成本足够低);就因为很嗑瓜子简单,容易开始这种行为,其次容易掌握技巧,逐渐熟练改进嗑瓜子的方法,这个过程增强了自信,在潜意识中,人们期望享受这个过程。每嗑开一颗瓜子,人们马上就会享受到一粒瓜子仁。(瓜子仁就是奖励);
4)变动比率强化,强化按随机比率进行,如彩票得奖、赌博输赢等;
这个就是抽卡系统的底层原理,为什么抽卡做保底比不做保底感受要更好,请看特点说明:
-
它可以消除固定比率强化(第三个,就上一个)后所出现的反应消退现象;
-
这种程式的比率幅度在变,所以,玩家行为可能得变高也可能变低,如果长时间得不到奖励(确切说是有价值的或想要的)就一定会降低,若改成平均值不变,玩家就会根据这种随机性来调整自己,并保持一种稳定的行为速率;
没有要显示的评论
没有要显示的评论