DamiRocK

Centipede с четырьмя решениями: обратная индукция к ранней остановке

При конечном горизонте каждый последний decision-maker сравнивает Stop/Continue; рациональный rollback может передать стимул остановки к самому первому узлу.

Учебная схема

Игроки по очереди выбирают Stop или Continue. Если последний возможный игрок продолжит, получает меньше, чем при Stop. На предыдущем узле другой игрок знает этот будущий выбор и тоже сравнивает свой Stop с исходом после Continue.

Обратная индукция

Начинаем с последнего решения, где Stop строго лучше. Заменяем последнюю подыгру её равновесным payoff и переходим на один узел назад. Если там Stop снова лучше продолжения к уже вычисленному исходу, выбираем Stop.

Повторяя rollback, в стандартной конечной centipede с соответствующими возрастающими, но чередующимися payoff получается остановка в первом узле.

Почему парадоксально

На более поздних узлах общая сумма выигрышей может быть намного больше, но SPNE требует последовательной оптимальности в каждой подыгре. Конечность горизонта создаёт «последний» шаг для индукции.

В бесконечной версии без конечного последнего узла этот конкретный rollback-аргумент не переносится автоматически.

Редакционная практика по динамическим играм game_theory_open_bank · CC0 1.0.

Reading preferences

Appearance
Contrast
More options

Saved only in this browser. Your device’s reduced-motion setting is always respected. Browser zoom works throughout the site.