Учебная схема
Игроки по очереди выбирают Stop или Continue. Если последний возможный игрок продолжит, получает меньше, чем при Stop. На предыдущем узле другой игрок знает этот будущий выбор и тоже сравнивает свой Stop с исходом после Continue.
Обратная индукция
Начинаем с последнего решения, где Stop строго лучше. Заменяем последнюю подыгру её равновесным payoff и переходим на один узел назад. Если там Stop снова лучше продолжения к уже вычисленному исходу, выбираем Stop.
Повторяя rollback, в стандартной конечной centipede с соответствующими возрастающими, но чередующимися payoff получается остановка в первом узле.
Почему парадоксально
На более поздних узлах общая сумма выигрышей может быть намного больше, но SPNE требует последовательной оптимальности в каждой подыгре. Конечность горизонта создаёт «последний» шаг для индукции.
В бесконечной версии без конечного последнего узла этот конкретный rollback-аргумент не переносится автоматически.
Редакционная практика по динамическим играм game_theory_open_bank · CC0 1.0.