
„Pozitivní posilování mě láká, ale nechci koně, který se mi bude dobývat do kapes a pro pamlsek půjde přes mrtvoly.“ Podobná obava patří mezi nejčastější námitky proti tréninku s potravní odměnou. Výzkum ale naznačuje, že samotný pamlsek nežádoucí chování nevysvětluje. Rozhodující je především to, za jakých okolností potrava přichází, jakému chování následuje a zda kůň rozumí pravidlům, podle nichž ji může získat.
Pozitivní posilování bývá někdy zjednodušováno na „trénink s pamlsky“. To je ale podobné, jako bychom klasické ježdění popsali jako „tahání za otěže“. Pamlsek je pouze jeden z možných nástrojů. Podstatou metody je učení prostřednictvím přesně definovaných následků chování.
V terminologii teorie učení znamená pozitivní posilování, že po určitém chování následuje přidání podnětu a pravděpodobnost opakování tohoto chování se následně zvyšuje. „Pozitivní“ zde tedy neznamená hodné nebo laskavé, ale přidání. Důležitý je ještě jeden detail: něco můžeme odborně označit za posilovač až tehdy, když to skutečně zvyšuje budoucí pravděpodobnost daného chování. Potrava je u koní typickým primárním posilovačem, její aktuální hodnota se však může mezi jednotlivými koňmi i situacemi lišit.
Při tréninku je současně důležité sledovat aktuální emoční stav koně. Současné principy equitation science doporučují nevyvolávat reakce typu útěk, boj nebo ztuhnutí a udržovat co nejnižší míru arousalu, která ještě umožňuje splnění úkolu a efektivní učení. To platí i při používání potravních odměn. Potrava může být velmi účinným motivátorem, ale vysoká hodnota očekávané odměny může u některých koní současně zvyšovat aktivaci a při špatně nastavených pravidlech také frustraci.
Jakou roli hrála potrava při prvních kontaktech člověka s koňmi, nevíme. Představa člověka nabízejícího potravu obezřetnému zvířeti je z hlediska asociativního učení možná, ale zůstává hypotézou.
Ani současná archeologie a paleogenomika nám na tuto otázku nedávají odpověď. Analýza stovek starověkých koňských genomů ukazuje výraznější lidskou kontrolu reprodukce linie dnešních domácích koní přibližně od roku 2200 př. n. l. a známky specifického managementu koní v Botaji kolem roku 3500 př. n. l. Z těchto nálezů však nelze vyvozovat, zda při sbližování člověka a koně hrálo nějakou významnou úlohu krmení nebo potravní odměna.
Mnohem pevnější historický bod máme až v písemných pramenech.
Už Xenofón ve 4. století př. n. l. ve spise O jezdectví doporučoval zařídit, aby si mladý kůň spojoval potravu, vodu a úlevu od obtěžujícího hmyzu s přítomností člověka. Současně doporučoval příjemný tělesný kontakt na místech, kde jej kůň vyhledává.
Je ovšem důležité tento text neposuzovat anachronicky. Xenofón nepopisoval moderní pozitivní posilování a některé části jeho postupu bychom podle současných welfare standardů nepovažovali za vhodné doporučení. Historicky je však jeho text pozoruhodným dokladem toho, že člověk už před více než dvěma tisíci lety vědomě využíval asociaci mezi svou přítomností a pro koně hodnotnými důsledky.
Moderní pozitivní posilování tedy nevynalezlo motivaci potravou. Vytvořilo však mnohem přesnější rámec pro práci s načasováním, kritérii a následky chování.
A právě zde začíná rozdíl mezi tréninkem a prostým rozdáváním dobrot.
Tato obava je mezi chovateli natolik rozšířená, že ji vědci skutečně zkoumali.
Hockenhullová a Creightonová se v roce 2010 zaměřily na nežádoucí orální chování koní – olizování rukou, hledání potravy v oblečení, okusování a další projevy někdy označované anglickým výrazem mugging. Pracovaly s údaji od 1 067 koní, získanými prostřednictvím internetových dotazníků britských majitelů rekreačních koní.
Devadesát jedna procent respondentů uvedlo, že svého koně krmí z ruky. Hand-feeding byl statisticky spojen se třemi z pěti sledovaných projevů nežádoucího orálního chování, zatímco okusování rukou a kousání do oblečení s ním spojeno nebylo. Clicker training používalo 14 % respondentů a jeho používání nebylo spojeno s vyšším výskytem žádného z pěti sledovaných projevů.
Výsledek je zajímavý, ale jeho význam je nutné držet v mezích designu studie. Šlo o průřezovou dotazníkovou práci založenou na convenience sample, nikoli o kontrolovaný experiment. Nevíme tedy, zda určitý způsob krmení chování způsobil, zda už problémové chování ovlivňovalo způsob, jakým majitel s koněm pracoval, ani jak kvalitně jednotliví respondenti clicker training skutečně prováděli.
Data proto neprokazují, že clicker training nežádoucímu chování zabraňuje. Zároveň však nepodporují představu, že systematické používání potravy při clicker tréninku automaticky vede k vyššímu výskytu dotírání, okusování nebo kousání.
A upozorňují na důležitou věc: běžné krmení z ruky a použití potravy jako přesně načasovaného důsledku chování není vhodné automaticky považovat za totéž.
V operantním tréninku záleží především na tom, po kterém chování odměna přichází.
Jestliže kůň strčí člověku hlavu do kapsy a vzápětí dostane mrkev, právě strčení hlavy do kapsy může být posíleno. Jestliže však potravu dostává za klidné stání s hlavou mimo osobní prostor člověka, posilujeme právě toto chování.
Kůň v obou případech dostal stejnou mrkev. Naučil se ale něco jiného.
Současně potrava není pouze „výplata za výkon“. Prostřednictvím klasického podmiňování může vytvářet asociace s člověkem, prostředím nebo konkrétním podnětem. K tomu se ještě vrátíme.

Jedním ze základních principů operantního učení je skutečnost, že chování, po němž opakovaně přichází posilující důsledek, má tendenci se v podobné situaci objevovat častěji.
A člověk může velmi snadno posílit chování, které posílit vůbec nechtěl.
Kůň hrábne přední nohou – dostane pozornost. Kope do dveří boxu – někdo přijde. Natáhne hlavu po pamlsku – člověk mu jej podá, aby „už dal pokoj“. Strčí do člověka – ruka s mrkví se otevře.
Z hlediska učení může být takové chování naprosto logickým výsledkem předchozích zkušeností.
Proto korektní pozitivní posilování nezačíná složitými cviky. Začíná srozumitelnými a konzistentními pravidly.
Jedním z prvních může být například: přítomnost potravy není signálem k tomu, aby ses ji pokusil získat z rukou nebo oblečení člověka. Odměna přichází za určité chování – například klidné stání, hlavu mimo prostor člověka, následování targetu nebo jiný jednoznačně definovaný úkol.
Na první pohled to může působit nelogicky. Kůň, který dostává při tréninku mnoho drobných odměn, by přece mohl být potravou zaujatější než kůň, který dostane mrkev jednou za čas.
Z hlediska učení ale může systematický trénink vytvořit něco velmi důležitého – předvídatelnost.
Kůň se může naučit, že člověk může mít potravu u sebe, aniž by její přítomnost znamenala možnost zmocnit se jí.
Může se naučit, které chování k odměně vede a které nikoli.
Nemusí zkoušet fyzicky pronikat k potravě, pokud má zkušenost, že existuje jasná a opakovatelná cesta, jak odměnu získat.
A především jej můžeme naučit jednoduché, velmi dobře upevněné chování, ke kterému se může vracet ve chvíli, kdy neví, co po něm člověk chce.
Není to automatický důsledek R+. Je to tréninková strategie, kterou lze cíleně vybudovat.
Představme si dva koně. Oba vědí, že člověk má u sebe granule, a oba o ně mají zájem.
První nemá žádný naučený systém. Zkouší proto repertoár, který mu někdy v minulosti fungoval: natáhne hlavu, šťouchne člověka, hledá v kapse, okusuje ruku.
Druhého jsme naučili, že cesta k odměně vede například přes klidné postavení hlavy, dotyk targetu nebo setrvání na stanovišti. Když tápe, může nabídnout některé z těchto známých chování.
Ne proto, že by měl menší potravní motivaci, ale proto, že má k dispozici jinou naučenou strategii.
Zajímavá je v tomto kontextu studie Innesové a McBridea z roku 2008. Autoři sedm týdnů porovnávali pozitivní a negativní posilování u 16 mladých poníků ve věku 6–18 měsíců, kteří pocházeli z prostředí zanedbávání či špatného zacházení. V pozdějších fázích byli pozitivně posilovaní poníci ochotnější zapojovat se do tréninku a v nových situacích více vykazovali explorativní chování a strategie typu „pokus–omyl“.
Studie je zajímavá, ale právě vzhledem ke specifické populaci ji není vhodné bez výhrady zobecňovat na všechny koně. Podporuje však myšlenku, že způsob, jakým je při učení zacházeno s chybou a úspěchem, může ovlivňovat ochotu zvířete aktivně hledat řešení.
Kvalitní trénink nemůže sledovat pouze viditelné splnění úkolu. Trenér by měl současně vnímat stav, ve kterém se kůň nachází.
Pro učení není jedno, zda kůň stojí před člověkem zvědavý, soustředěný a relativně uvolněný, nebo zda má podobnou polohu těla, ale současně se nachází ve vysokém stresu.
Výzkum afektivních stavů často pracuje se dvěma základními rozměry: valencí a arousalem.
Valence označuje, zda je daný stav pro zvíře spíše pozitivní, nebo negativní.
Arousal vyjadřuje míru aktivace organismu – od nízké po vysokou.
„Aktivovaný“ proto automaticky neznamená „vystrašený“. Kůň očekávající oblíbenou potravu může být výrazně aktivovaný a přitom se nacházet v pozitivně valenčním kontextu. Kůň, který se bojí, může mít podobně vysoký arousal, ale negativní valenci.

Cílem tréninku proto není nulový arousal.
Kůň musí být dostatečně aktivovaný, aby vnímal, reagoval a byl motivovaný. Problém přichází tehdy, když aktivace stoupne natolik, že omezuje schopnost zpracovávat informace, vybírat odpověď nebo se učit.
Proto se v současných principech tréninku doporučuje udržovat co nejnižší arousal potřebný pro konkrétní úkol, vyhýbat se vyvolávání reakcí fight, flight a freeze a podporovat pozitivní afektivní stavy. Vysoký arousal přitom může vzniknout i v souvislosti s potravním motivátorem.
Tohle je jedna z nejdůležitějších praktických věcí.
Přijetí potravy není validovaný samostatný test emočního klidu.
Samotná skutečnost, že kůň potravu přijímá a žvýká, nám nedovoluje spolehlivě určit jeho valenci ani úroveň arousalu. Potravní situace sama může vyvolávat výraznou aktivaci a behaviorální a fyziologické reakce koně navíc nemusí vždy probíhat paralelně.
Velmi názorná je práce Christensenové, Rundgrenové a Olssonové z roku 2006. Dvacet sedm dvouletých hřebců bylo rozděleno do tří skupin a vystavováno děsivému podnětu – pohybujícímu se bílému nylonovému vaku. Jedna skupina byla vystavena plné intenzitě podnětu v rámci habituace, druhá prošla postupnou systematickou desenzitizací a třetí byla před vystavením plnému podnětu trénována tak, aby si jej spojila s pozitivním důsledkem.
V tomto konkrétním experimentu byla nejúčinnější systematická desenzitizace. Tito koně vykazovali méně únikových reakcí, potřebovali méně tréninkových jednotek a kritéria nakonec dosáhli všichni, zatímco v ostatních skupinách někteří koně stanoveného výsledku nedosáhli.
Pro naše téma je ale zásadní ještě jiný nález: změny srdeční frekvence přetrvávaly i poté, co viditelné behaviorální reakce ustaly.
Kůň tedy může přestat utíkat nebo jinak nápadně reagovat, aniž by fyziologická aktivace okamžitě zmizela.
Podobnou opatrnost podporují i další práce. Carmo a kol. například zjistili, že všech třináct klisen při pozitivně posilované fázi přijímalo alespoň část nabízených potravních odměn, přesto jejich následné behaviorální a mimické projevy nebylo možné jednoduše označit jako stav klidu. Jiná studie sledující koně v novém a potravním kontextu ukázala, že míra fyziologického arousalu nemusí být vždy zřetelná z množství navenek pozorovaného chování.
„Sežral pamlsek“ je tedy informace. Není to diagnóza emočního stavu.
Stejně problematický je opačný extrém. Ani odmítnutí potravy nemá jediný možný význam. Hodnotu potravy ovlivňují individuální preference, předchozí zkušenost, sytost, prostředí i zdravotní stav.
Pokud však kůň, který je za běžných okolností výrazně potravně motivovaný, v konkrétní situaci náhle potravu odmítá, je to prakticky významný signál, že bychom měli posoudit obtížnost situace, prostředí a míru jeho aktivace.
Valenchonová a kol. v roce 2017 rozdělili 60 koní do čtyř skupin po patnácti. Koně se učili instrumentální úlohu pomocí pozitivního nebo negativního posilování a část z nich byla současně vystavena novým a náhlým stresorům, které s učeným úkolem přímo nesouvisely.
Bez těchto vnějších stresorů nebyl mezi pozitivním a negativním posilováním významný rozdíl ve výkonu při učení.
Po přidání stresoru se výkon při pozitivním posilování významně zhoršil. U negativně posilované skupiny měl pokles výkonu slabší charakter a u některých ukazatelů pouze tendenci.
Autoři nabídli možné vysvětlení. Negativní posilování ve svém experimentálním paradigmatu považovali za stresor přímo spojený s učeným úkolem a předpokládali, že mohl soustředit pozornost koně k relevantnímu podnětu, zatímco vnější stres odváděl pozornost jinam.
Je důležité zdůraznit, že jde o interpretaci výsledku konkrétního experimentu, nikoli o důkaz, že negativní posilování je při stresu obecně vhodnější nebo welfare příznivější. Výkonnost v laboratorní učební úloze sama o sobě není měřítkem welfare.
Studie současně ukázala vztah k osobnosti. Při pozitivním posilování patřili bázlivější koně konzistentně mezi horší žáky, a to s vnějším stresorem i bez něj. Při negativním posilování byla závislost složitější a měnila se podle přítomnosti vnějšího stresoru.
Výsledek připomíná, že věda nám nedává jednoduchou rovnici „R+ = vždy lepší učení“.
Dává nám něco užitečnějšího:
stres, typ posilování a temperament konkrétního koně se vzájemně ovlivňují.
A je to také argument proti představě:
„Když se bojí, budu do něj sypat pamlsky a ono se to spraví.“
Nemusí.
Jestliže podnět koně natolik aktivuje, že jeho pozornost ovládá hrozba, měla by první otázka znít: mohu situaci zjednodušit? Mohu zvětšit vzdálenost? Snížit intenzitu podnětu? Dát koni více času?
Teprve poté řešíme, jaký posilovač nebo tréninkový postup bude nejvhodnější.
Zajímavý výsledek přinesla Fortinová a kol. v roce 2018.
Pětapadesát klisen bylo nejprve vystaveno prostředí spojenému buď s pozitivními událostmi – například potravní odměnou –, s negativními událostmi, nebo emocionálně neutrálnímu kontextu. Vědci následně zkoumali nejen osvojení instrumentální úlohy, ale také kognitivní flexibilitu – schopnost změnit chování ve chvíli, kdy původně naučené pravidlo přestane fungovat.
Samotné prvotní osvojení úlohy se mezi skupinami zásadně nelišilo.
Rozdíl se objevil ve fázi vyhasínání.
Koně v pozitivně navozeném emočním stavu vykázali větší flexibilitu než koně z negativního a neutrálního kontextu. Rychleji tedy opouštěli dříve funkční strategii poté, co přestala přinášet očekávaný výsledek.
Studie současně ukázala souvislost s osobností – menší bázlivost byla spojena s lepším počátečním učením i větší kognitivní flexibilitou.
To je pro praktický trénink mimořádně zajímavé.
Kvalita učení totiž není pouze otázkou:
„Dokázal jsem dostat koně přes děsivý předmět?“
Stejně důležitá může být otázka:
„V jakém emočním kontextu se to naučil a jak tato zkušenost ovlivní jeho další chování?“
Ani pozitivní očekávání není totéž co klid.
Když kůň očekává něco, co má vysokou hodnotu, může být výrazně aktivovaný. Pozitivní valence tedy může existovat současně s vysokým arousalem.
Problém může vzniknout ve chvíli, kdy zvíře očekává dostupnou odměnu, ale nemůže se k ní dostat nebo nerozumí tomu, co vede k jejímu získání.
Pheliponová a kol. v roce 2024 porovnávali u 21 koní dvě situace. V první kůň směřoval k potravě a očekával, že k ní dostane přístup. Ve druhé byla přítomnost potravy signalizována, ale přístup k ní umožněn nebyl.
Behaviorální profily se výrazně lišily. Při pozitivní anticipaci drželi koně krk níže, častěji měli uši dopředu a pohybovali se rychleji. Ve frustrující situaci měli krk výše, uši častěji dozadu či do stran a více interagovali s experimentátory.
Ricci-Bonotová a Mills v roce 2023 sledovali 31 koní ve třech situacích spojených s očekáváním potravy – anticipaci, frustraci při čekání a zklamání po ztrátě očekávané odměny. Pomocí EquiFACS našli rozdíly především mezi frustrací a zklamáním. Ve frustrující situaci byla například vyšší pravděpodobnost větší viditelnosti očního bělma, rotace uší a kousání do krmného zařízení.
Ani tyto experimenty přímo nezkoumají běžnou tréninkovou lekci, ale dobře ukazují, že očekávání potravy a zablokování přístupu k ní mohou vytvářet odlišné afektivní a behaviorální stavy.
Čím větší hodnotu má očekávaná odměna, tím důležitější proto může být srozumitelnost kritérií a předvídatelnost systému.
Práce Loftusové a kol. publikovaná v roce 2025 nabízí v tomto směru důležitou opatrnost.
Vědci sledovali 20 zdravých koní při čtyřech podmínkách, které měly potenciál navodit pozitivní afektivní stav:
Současně měřili chování a řadu fyziologických parametrů – srdeční a dechovou frekvenci, variabilitu srdeční frekvence, termografické parametry i salivární kortizol.
Výsledek nebyl jednoduchý ve stylu „potrava = radost“ nebo „drbání = klid“.
Reakce se lišily podle typu podnětu i individuálních charakteristik koní a osobnost byla spojena s odlišnými odpověďmi na jednotlivé podmínky. Autoři současně zdůrazňují nutnost rozlišovat valenci od samotné míry arousalu.
Studie je malá a její analýza má částečně explorativní charakter. Neprokazuje tedy, že bychom mohli každému koni přesně přiřadit „ideální typ odměny“.
Velmi dobře ale podporuje obecnější princip:
účinek podnětu není možné hodnotit pouze podle toho, jak příjemný se zdá člověku. Je třeba sledovat skutečnou reakci konkrétního koně.
Stejný typ potravy může jednoho koně motivovat přiměřeně, jiného málo zajímat a u dalšího vyvolávat výrazně vyšší očekávání a aktivaci.

Carmo a kol. v roce 2023 sledovali třináct dospělých klisen při vstupu do fixačního prostoru. Studie měla crossover design: jednotlivé klisny byly v jedné fázi po vstupu a klidném setrvání odměňovány potravou a v jiné fázi sloužily jako kontroly bez odměny.
Koně v pozitivně posilované fázi vykazovali změny mimiky odpovídající vyšší pozornosti a aktivitě – například častěji směřovali uši dopředu, méně zavírali oči a vykazovali více pohybů nozder.
Autoři byli při interpretaci velmi opatrní. Třídenní použití potravní odměny nepřineslo výrazné změny většiny celkových tělesných projevů ve fixačním prostoru a výsledky neumožňují tvrdit, že potrava automaticky vyvolala jednoznačně pozitivnější emoční valenci.
Všech třináct klisen přitom během odměňované fáze alespoň část nabízené potravy přijímalo.
Jde o další důvod, proč jednoduchá rovnice
pamlsek = pozitivní emoce = klid
nefunguje.
Při pozitivním posilování pracujeme s operantním podmiňováním: určité chování vede k určitému následku a jeho budoucí pravděpodobnost se proto může změnit.
Kůň stojí požadovaným způsobem – dostane odměnu.
Dotkne se targetu – dostane odměnu.
Nastoupí přední nohou na rampu – marker, poté odměna.
Současně však probíhá také klasické neboli pavlovovské podmiňování. Kůň vytváří asociace mezi jednotlivými podněty, prostředím, lidmi a tím, co po nich obvykle následuje.
Právě zde se může měnit afektivní význam situace.
Přepravník, veterinární vybavení nebo šustící předmět se mohou postupně stát prediktorem něčeho příjemného – pokud je zkušenost dávkována tak, aby byla pro koně zvládnutelná.
Tento princip je základem protipodmiňování neboli counter-conditioningu.
Cílem není odvést koni pozornost kusem mrkve, zatímco stojí v panice vedle děsivého předmětu. Cílem je měnit asociaci s podnětem v takové intenzitě a situaci, kterou je kůň schopen zpracovat.
Při práci s děsivými podněty se proto používá například systematická desenzitizace, counter-conditioning či diferenciální posilování a naopak se doporučuje vyhýbat floodingu – nucenému vystavení vysoké intenzitě aversivního podnětu bez postupného přizpůsobení.
Je zároveň důležité nevytvořit z žádné z těchto metod dogma.
Ve studii Christensenové a kol. z roku 2006 byla z porovnávaných metod nejúčinnější systematická desenzitizace, nikoli counter-conditioning.
Novější práce Droguettové a kol. z roku 2024 však u dvaceti koní ukázala, že krátký counter-conditioning při expozici děsivému podnětu může snížit odpor při manipulaci a projevy související se strachem a zvýšit explorativní chování vůči handlerovi. Rozdíly srdeční frekvence přitom statisticky významné nebyly.
Výsledky tedy nejsou v rozporu. Ukazují spíše, že counter-conditioning může být účinným nástrojem, ale nemáme důvod jej prohlašovat za univerzálně nejlepší řešení každého strachu.
Dobré behaviorální řešení není otázkou módní nálepky, ale volby postupu odpovídajícího konkrétnímu koni, problému a míře jeho arousalu.

Můžeme pozitivně posílit pozorovatelné chování, které s klidem často souvisí – například setrvání na místě, čekání, snížení hlavy nebo určitou orientaci těla.
Emoční stav však není totožný s jedním pozorovatelným projevem.
Kůň může stát bez hnutí a být výrazně aktivovaný.
Může držet hlavu nízko proto, že jsme jej tuto polohu naučili.
Může přijmout potravu a současně věnovat intenzivní pozornost potenciálně děsivému podnětu.
A může naopak vykazovat poměrně vysokou pohybovou aktivitu při pozitivním očekávání.
Proto není vhodné hodnotit jednotlivé gesto izolovaně.
Přesnější obraz získáváme kombinací více ukazatelů: celkového držení těla, svalového tonu, polohy hlavy a krku, očí a uší, charakteru pohybu a dýchání, ochoty zkoumat prostředí, schopnosti přesměrovat pozornost a především změn oproti běžnému projevu konkrétního koně.
Žádný z těchto znaků přitom není sám o sobě spolehlivým „detektorem emocí“.
Právě proto současný výzkum afektivních stavů stále více kombinuje behaviorální a fyziologické ukazatele.
Ani zde neplatí, že čím chutnější pamlsek, tím lepší trénink.
Odměna musí mít pro konkrétního koně dostatečnou hodnotu, aby skutečně fungovala jako posilovač, ale nemusí mít hodnotu maximální.
Pro koně, kterého velmi chutná odměna nadměrně aktivuje, může být při jednoduchém opakovaném úkolu praktičtější méně hodnotná potrava, například vhodná část běžné krmné dávky. U obtížnějšího nebo méně motivujícího úkolu může být naopak hodnotnější odměna účinnější.
Individuální rozdíly jsou přitom významné.
To, co jednoho koně optimálně motivuje, může být pro jiného příliš málo zajímavé nebo naopak spojeno s tak vysokým očekáváním, že se zhoršuje kvalita tréninku.
Pokud odměna zvyšuje arousal natolik, že kůň přestává být schopen soustředěně pracovat, není jediným řešením „zakázat pamlsky“. Je třeba znovu posoudit hodnotu odměny, kritéria, frekvenci posilování, prostředí i samotnou strukturu úkolu.
Dobré pozitivní posilování zároveň není nekonečné natahování kritéria, dokud kůň náhodou „uhodne správnou odpověď“. Úkol se při shapingu rozděluje na dostatečně malé dosažitelné kroky a postupně se posilují aproximace směřující k cílovému chování.
Pokud se z původně soustředěného koně stává při lekci stále hektičtější „automat na chování“, který nabízí jednu odpověď za druhou, hrabe, šťouchá do člověka a nedokáže čekat, není to něco, co bychom měli automaticky označit za skvělou motivaci.
Je to informace, že je třeba systém znovu vyhodnotit.
S pozitivním posilováním bývá často spojován clicker, ale clicker sám není podstatou metody.
Kliknutí, krátké slovo nebo jiný jednoznačný signál lze používat jako marker – prostředek k přesnému označení okamžiku chování, které chceme zachytit. V praxi tak můžeme koni sdělit například „právě tento krok byl ten správný“, přestože samotnou potravní odměnu dostane o okamžik později.
Aby takový signál měl prediktivní význam, musí se jej kůň prostřednictvím předchozí zkušenosti naučit spojovat s následným důsledkem.
Je ale důležité rozlišovat mezi praktickou funkcí markeru a tvrzením, že clicker sám funguje jako silný sekundární posilovač.
Williamsová a kol. v roce 2004 rozdělili 60 koní do šesti skupin a sledovali osvojení jednoduchého operantního úkolu – dotyku plastového kuželu nosem. Mezi koňmi dostávajícími po správné reakci click následovaný potravou a koňmi dostávajícími pouze potravu nebyl významný rozdíl v počtu pokusů potřebných k naučení úlohy. Rozdíl nebyl ani v následném vyhasínání chování.
Lansadeová a Calandreau následně spojili u čtrnácti koní slovo „good“ s potravou celkem 288krát. Když při jiné naučené operantní úloze potravu odstranili a jedné skupině ponechali pouze tento naučený zvukový signál, „good“ nedokázalo chování udržet lépe než úplná absence posílení.
To neznamená, že marker nemá praktickou hodnotu. Jeho významnou výhodou může být časová přesnost informace, zejména při tvarování chování, u něhož nelze potravu doručit přesně v okamžiku správné reakce.
Znamená to ale, že clicker nemáme důvod chápat jako magický předmět nebo spolehlivou náhradu skutečného posilovače.
Nejdůležitější stále zůstává přesnost člověka – co označuje, kdy to označuje a jaký důsledek následně přichází.
Právě zde se dostáváme k důvodu, proč dobře vedený kůň nemusí kolem potravy působit chaoticky.
Na začátku není prioritou naučit poklonu, španělský krok ani následování člověka ve volnosti. Prioritou je vytvořit několik jednoduchých, bezpečných a dobře upevněných pravidel.
Kůň se může postupně naučit například, že:
prohledávání oblečení člověka nevede k odměně;
klidné čekání se vyplácí;
marker označuje přesně tu odpověď, kterou trenér zachytil;
neúspěšný pokus nemusí vyvolat konflikt – pouze nepřinesl očekávaný důsledek;
při nejasném novém úkolu se může vrátit k jednoduchému známému chování.
Takovým „bezpečným přístavem“ může být klidné stání, target nebo stanoviště. Konkrétní volba je méně důležitá než skutečnost, že kůň má k dispozici dobře naučenou alternativu k dotírání, kousání nebo chaotickému nabízení celé škály chování.
Současně ale platí něco zásadního:
„bezpečný přístav“ není pouze naučená poloha těla.
Pokud kůň dokáže stát na stanovišti, ale jeho arousal stále stoupá, není cílem trvat za každou cenu na správné poloze. Je třeba řešit také příčinu vysoké aktivace.

Pak bychom neměli řešit především pamlsek.
Pokud se kůň při určitém podnětu dostal do velmi vysokého arousalu, praktickým řešením může být zvětšit vzdálenost, snížit intenzitu podnětu, zjednodušit úkol, vrátit se k předchozímu známému kroku, umožnit bezpečné pozorování, zkrátit expozici nebo situaci ukončit a příště začít výrazně snadněji.
To není „prohra pozitivky“.
Je to práce s učením a welfare.
Potravní odměna není sedativum. Nemá zakrývat skutečnost, že se kůň bojí. Ve vysokém stresu se navíc může měnit její motivační hodnota a pozornost koně může být zaměstnána něčím důležitějším – vnímanou hrozbou.
Experiment Valenchonové a kol. názorně ukazuje, že stres může výrazně změnit výkon při učení a že jeho účinek závisí také na temperamentu a konkrétním typu tréninkové situace.
Potravní odměna nemusí ovlivňovat pouze pravděpodobnost jednotlivého chování. Prostřednictvím asociativního učení může měnit také to, co kůň očekává v přítomnosti člověka a v samotné tréninkové situaci.
Práce Sankeyové a kol. z roku 2010 patří v tomto směru mezi nejcitovanější.
Jednadvacet poníků bylo rozděleno do skupiny trénované pozitivním a negativním posilováním. Úkolem bylo naučit se couvat na hlasový povel. Výzkumníci následně sledovali nejen výkon, ale také srdeční frekvenci a chování vůči známým i neznámým lidem krátce po tréninku a znovu po pěti měsících.
Poníci trénovaní pozitivním posilováním více vyhledávali kontakt s lidmi, zatímco u negativně posilované skupiny autoři zaznamenali vyšší emoční aktivaci při tréninku a menší vyhledávání kontaktu.
Rozdíly byly patrné také po pěti měsících.
Výsledek je velmi zajímavý, ale i zde je třeba odolat příliš širokému zobecnění. Studie porovnává konkrétní dva experimentální postupy u 21 poníků. Není důkazem, že jakékoli použití negativního posilování automaticky zhoršuje vztah člověka a koně.
Dobře však ukazuje obecný princip:
kůň se během tréninku neučí pouze cvik. Učí se zároveň, co předpovídá trenér a celá situace.
A ještě jedna důležitá brzda idealizace.
Harrisová a McDonnellová v práci publikované 29. května 2026 analyzovaly 20 veřejně dostupných videí s nakládáním koní, jejichž autoři své postupy prezentovali jako pozitivní posilování.
Pouze osm z dvaceti trenérů používalo podle kódování autorek výhradně R+. Další tři používali R+ ve více než 90 % sledovaných zásahů. Sedm jej výrazněji kombinovalo s negativním posilováním a zbývající dva používali R+ jen v malé části svých kroků, přičemž převažovalo negativní posilování a objevoval se i pozitivní trest.
Pozoruhodná byla také velmi silná statistická asociace: čím vyšší byl podíl jednání klasifikovaného jako R+, tím vyšší byl v tomto vzorku podíl pozitivních behaviorálních odpovědí koní souvisejících s postupem nakládání.
Ani zde ale nelze mluvit o kauzalitě. Nešlo o randomizovaný experiment, ale o analýzu vybraných existujících internetových videí. Výsledky mohly ovlivňovat schopnosti jednotlivých trenérů, předchozí zkušenosti koní, obtížnost případů, střih videí a další faktory.
Studie však přesvědčivě ukazuje něco jiného:
označení „pozitivní trénink“ ještě neznamená, že člověk pozitivní posilování skutečně používá – natož že jej používá korektně.
Nestačí mít clicker.
Nestačí mít kapsu granulí.
Nestačí koně někdy pochválit.
Rozhodující je celý systém učení.
Kůň je velké a silné zvíře a potravní motivace může být velmi intenzivní. Bylo by proto chybou tvrdit, že při používání odměn nemohou vzniknout problémy.
Mohou.
Kůň může začít nabízet chování v příliš vysokém tempu, být frustrovaný, strkat do člověka, hledat potravu v kapsách nebo se soustředit více na očekávání jídla než na samotný úkol.
Takové chování ale není samo o sobě důkazem selhání principu pozitivního posilování. Je především informací o tom, jak současný tréninkový systém funguje.
Možná jsme nechtěně posilovali nevhodné chování.
Možná kůň nerozumí kritériu.
Možná má zvolená odměna příliš vysokou hodnotu.
Možná je systém posilování nepředvídatelný.
Možná jsme zvýšili obtížnost příliš rychle.
Možná je prostředí příliš náročné.
A možná už vůbec neřešíme problém s technikou posilování, ale koně, jehož arousal je příliš vysoký pro kvalitní učení.
Právě zde leží největší rozdíl mezi prostým „dáváním pamlsků“ a promyšleným tréninkem pomocí pozitivního posilování.
Kůň, který někdy dostane mrkev bez jakékoli vazby na vlastní chování a jindy ji získá například dotíráním, nemá důvod chápat jasný systém. Kůň systematicky trénovaný pomocí odměn se naopak může naučit velmi přesná pravidla.
Může se naučit, že člověk u sebe může mít potravu, aniž by bylo užitečné se jí zmocňovat. Může se naučit, které jeho chování vede k odměně a které nikoli. A může získat jednoduchou známou odpověď, ke které se vrací ve chvíli, kdy novému požadavku nerozumí.
Kvalitní pozitivní trénink ale jde ještě o krok dál.
Trenér ví, že splněný úkol není všechno. Sleduje také stav, ve kterém jej kůň plní – zda ještě dokáže vnímat a učit se, zda očekávání odměny nepřerůstá ve frustraci a zda se původně nepříjemná situace skutečně stává lépe zvládnutelnou, nikoli pouze situací, ve které kůň dokáže sníst pamlsek.
Možná právě to je nejpřesnější odpověď na obavu, že si pozitivním posilováním „vyrobíme bestii, která půjde pro pamlsek přes mrtvoly“.
Korektní pozitivní posilování neučí koně, že potrava je důvodem zapomenout na všechno ostatní. Učí ho předvídatelnému vztahu mezi vlastním chováním a jeho důsledky. A dobrý trenér přitom stejně pozorně jako výsledné chování sleduje také stav koně, který se za ním skrývá.

Cooper, J. J. (1998). Comparative learning theory and its application in the training of horses. Equine Veterinary Journal Supplement, 27, 39–43. doi:10.1111/j.2042-3306.1998.tb05144.x.
Christensen, J. W., Rundgren, M., & Olsson, K. (2006). Training methods for horses: habituation to a frightening stimulus. Equine Veterinary Journal, 38(5), 439–443. doi:10.2746/042516406778400574.
Innes, L., & McBride, S. (2008). Negative versus positive reinforcement: An evaluation of training strategies for rehabilitated horses. Applied Animal Behaviour Science, 112, 357–368. doi:10.1016/j.applanim.2007.08.011.
Hockenhull, J., & Creighton, E. (2010). Unwanted oral investigative behaviour in horses: A note on the relationship between mugging behaviour, hand-feeding titbits and clicker training. Applied Animal Behaviour Science, 127, 104–107. doi:10.1016/j.applanim.2010.08.008.
Sankey, C., Richard-Yris, M.-A., Henry, S., Fureix, C., Nassur, F., & Hausberger, M. (2010). Reinforcement as a mediator of the perception of humans by horses (Equus caballus). Animal Cognition, 13, 753–764. doi:10.1007/s10071-010-0326-9.
Williams, J. L., Friend, T. H., Nevill, C. H., & Archer, G. (2004). The efficacy of a secondary reinforcer (clicker) during acquisition and extinction of an operant task in horses. Applied Animal Behaviour Science, 88, 331–341. doi:10.1016/j.applanim.2004.03.008.
Valenchon, M., Lévy, F., Moussu, C., & Lansade, L. (2017). Stress affects instrumental learning based on positive or negative reinforcement in interaction with personality in domestic horses. PLOS ONE, 12(5), e0170783. doi:10.1371/journal.pone.0170783.
McLean, A. N., & Christensen, J. W. (2017). The application of learning theory in horse training. Applied Animal Behaviour Science, 190, 18–27. doi:10.1016/j.applanim.2017.02.020.
Lansade, L., & Calandreau, L. (2018). A conditioned reinforcer did not help to maintain an operant conditioning in the absence of a primary reinforcer in horses. Behavioural Processes, 146, 61–63. doi:10.1016/j.beproc.2017.11.012.
Fortin, M., Valenchon, M., Lévy, F., Calandreau, L., Arnould, C., & Lansade, L. (2018). Emotional state and personality influence cognitive flexibility in horses (Equus caballus). Journal of Comparative Psychology, 132(2), 130–140. doi:10.1037/com0000091.
Safryghin, A., Hebesberger, D. V., & Wascher, C. A. F. (2019). Testing for behavioral and physiological responses of domestic horses across different contexts. Frontiers in Psychology, 10, 849. doi:10.3389/fpsyg.2019.00849.
Carmo, L. G., Werner, L. C., Michelotto, P. V. Jr., & Daros, R. R. (2023). Horse behavior and facial movements in relation to food rewards. PLOS ONE, 18(6), e0286045. doi:10.1371/journal.pone.0286045.
Ricci-Bonot, C., & Mills, D. S. (2023). Recognising the facial expression of frustration in the horse during feeding period. Applied Animal Behaviour Science, 265, 105966. doi:10.1016/j.applanim.2023.105966.
Phelipon, R. et al. (2024). Differences in behaviour, facial expressions and locomotion between positive anticipation and frustration in horses. Applied Animal Behaviour Science, 274, 106262. doi:10.1016/j.applanim.2024.106262.
Droguett, F., Miguez, G., Quezada-Scholz, V. E., Tadich, T., & Laborda, M. A. (2024). Assessing the effect of counterconditioning to reduce neophobic response in horses. Applied Animal Behaviour Science, 281, 106453. doi:10.1016/j.applanim.2024.106453.
Librado, P. et al. (2024). Widespread horse-based mobility arose around 2200 BCE in Eurasia. Nature. doi:10.1038/s41586-024-07597-5.
Loftus, L., Newman, A., Leach, M., et al. (2025). Exploring the induction and measurement of positive affective state in equines through a personality-centred lens. Scientific Reports, 15, 18550. doi:10.1038/s41598-025-98034-8.
Harris, H. G., & McDonnell, S. M. (2026). Positive Reinforcement (R+) Horse Training in Practice: Evaluation of Online Trailer-Training Demonstrations. Animals, 16(11), 1667. doi:10.3390/ani16111667.
International Society for Equitation Science. ISES Training Principles – 10 First Principles of Horse Training.
Xenophon. On the Art of Horsemanship, Book II.

