Условие
Саша и Тоша одновременно выбирают s,t. Тоша получает −t²+A st. Саша с вероятностью 1/2 имеет хороший тип с полезностью −s²+2s, а с вероятностью 1/2 плохой тип с −s²−2st. Саша знает тип, Тоша — нет.
Лучшие ответы типов Саши
Хороший тип максимизирует −s²+2s и выбирает s_G=1. Плохой тип для фиксированного t максимизирует −s²−2st и выбирает s_B=−t.
Лучший ответ Тоши
При фиксированной стратегии Саши ожидаемая полезность Тоши равна −t²+A t E[s]. Его лучший ответ: t=A E[s]/2.
В равновесии E[s]=(1−t)/2. Поэтому t=A(1−t)/4 и
t*=A/(A+4).
Исправление исходного генератора
R-шаблон правильного варианта вычисляет A/(A+2). Это не удовлетворяет совместным условиям лучших ответов, кроме специальных вырожденных случаев. Значение A/(A+4) получено непосредственно из полезностей задания и является явным исправлением ключа.
Важно не подставлять реакцию плохого типа в функцию Тоши и затем дифференцировать её как Stackelberg-реакцию: в одновременной Bayesian Nash игре при одностороннем отклонении Тоша считает стратегию Саши фиксированной.
game_theory_open_bank gt_17 · CC0 1.0 · ошибка формулы генератора исправлена по условиям игры.