Студопедия — Игра двух лиц с нулевой суммой
Студопедия Главная Случайная страница Обратная связь

Разделы: Автомобили Астрономия Биология География Дом и сад Другие языки Другое Информатика История Культура Литература Логика Математика Медицина Металлургия Механика Образование Охрана труда Педагогика Политика Право Психология Религия Риторика Социология Спорт Строительство Технология Туризм Физика Философия Финансы Химия Черчение Экология Экономика Электроника

Игра двух лиц с нулевой суммой






Методы теории игр наиболее развиты для конечной одноходовой игры двух лиц с нулевой суммой (т.е. сумма выигрышей игроков равна 0). Такие игры еще называют антагонистическими.

Пусть и – участники игры. Саму игру опишем с помощью, так называемой платежной матрицы (матрицы игры) порядка . Строки этой матрицы – это чистые стратегии игрока , а столбцы – чистые стратегии игрока /

Предполагается, что каждому игроку известны все элементы платежной матрицы.

Элемент определяет результат игры, а именно выигрыш игрока при выборе игроками и стратегий и соответственно.

В этом случае достаточно исследовать только платежную матрицу игрока .

В данной игре игрок стремится выбрать такую строку матрицы, чтобы максимизировать свой выигрыш, а игрок - такой столбец матрицы, чтобы минимизировать свой проигрыш.

 

Bj Ai B1 B2 B3 Bn
A1 α 11 α 12 α 13 α 1n
A2 α 21 α 12 α 13 α 2n
Am α m1 α m2 α m3 α mn

Рис. 4.1

 

Задачей теории игр является нахождение решения игры, т.е. определение для каждого игрока его оптимальной стратегии и цены игры.

Оптимальной называется стратегия, которая при многократном повторении игры обеспечивает данному игроку максимально возможный средний выигрыш (или максимально возможный средний проигрыш) независимо от поведения противника.

Ценой игры называется выигрыш (проигрыш), соответствующий оптимальным стратегиям игроков.

В теории игр наилучшим принято считать поведение игроков, при котором каждый игрок предполагает, что его противник не глупее ( принцип разумности ).

Если игрок А выбрал стратегию i, то его выигрыш составит

Отсюда максимальный гарантированный выигрыш

.

Стратегия, соответствующая называется максимильной стратегией, а - нижней ценой игры или максимином.

Игрок В, рассуждая аналогично может среди всех своих стратегий выбрать ту, которая обеспечит ему минимальный гарантированный проигрыш.

Стратегия, соответствующая называется минимаксной стратегией, а величина - верхней ценой игры или минимаксом.

Если игрок А будет придерживаться максимаксной стратегии, то он получает выигрыш не меньше максиминного значения, т.е.

Если игрок В придерживается минимаксной стратегии, то его проигрыш буде т не больше минимального значения, т.е.

В общем случае отношения между нижней и верхней ценой игры устанавливаются неравенством

Существуют игры, для которых . Элемент платежной матрицы, отвечающей этим стратегиям называется Седловой точкой. Ей отвечает цена игры :

Если , то игра выгодна игроку А.

При игра выгодна игроку В.

Если , то игра выгодна обоим игрокам и называется безобидной или справедливой.

Игра 2-х лиц без Седловой точки. Смешанные стратегии:

Одна из возможностей расширения стратегий игроков – разнообразить способ выбора своей стратегии, например, «случайно».

Как мы уже отмечали, в отсутствии Седловой точки, игрок А, применяя свою максиминную стратегию, выиграет не менее , а игрок В, применяя свою минимаксную стратегию, проигрывает не более , где . Применение чистых стратегий в каждой партии такой игры не дает возможность игрокам увеличить выигрыш , чем уменьшить проигрыш . Для того, чтобы это было возможным необходимо применять не одну, а несколько чистых стратегий, чередуя их случайным образом с какими-то частотами. Такая стратегия получила название смешанной (ее элементами являются чистые стратегии).

Смешанная стратегия имеет смысл при условии, что игра состоит из более чем одной партии.

Обозначим смешанные стратегии игроков А и В через

и , где

- вероятность (частота) применения игроком А чистой стратегии , - вероятность (частота) принятия игроком В чистой стратегии .

Причем и .

Чистые стратегии игроков А и В, для которых вероятности и отличны от 0 называются активными.

Теорема (основная теорема теории игр) (теорема минимакса).

Любая конечная игра двух лиц с нулевой суммой имеет, по крайней мере, одно решение (т.е. пару оптимальных стратегий, в общем случае смешанных) и соответствующую цену.

Решение игры, не имеющей Седловой точки может осуществляться различными методами. Рассмотрим наиболее важные из них.

Графическое решение игр вида и :

Этот метод применим только к играм, в которых хотя бы один игрок имеет только две стратегии.

Рассмотрим следующую игру (без Седловой точки)

Ожидаемые выигрыши игрока А, соответствующие чистым стратегиям игрока В, представлены в таблице

В А

 

Отсюда видно, что ожидаемый выигрыш игрока А линейно зависит от . В соответствии с критерием минимакса игрок А должен выбирать так:

Чистые стратегии игрока В Ожидаемые выигрыши игрока А
 
 
N

Пример:

Вj Аi В1 В2 В3
  А1 доминирующая одинаковые
В4

А1       6
А2        
А3        
А4        

 

Замечания: Стратегии, для которых есть доминирующие и дублирующие стратегии можно отбрасывать.

Вj Аi В1 В2 В3 В4
А1        
А4        

В3 доминирующая

 

Вj Аi В1 В2 В4  
А1        
А4        
        2

 

 
 

 

 
 

  - цена игры   Чистая стратегия Игрок В Ожидаемый выигрыш игрока А    
  -6х1 + 8 z1  
  -2х1 + 6 z2  
  1 + 1 z3  
       
 
 
z

 
 

 

Чистая стратегия Игрока А   Ожидаемый выигрыш Игрока В
  -4у1+6
  1+1
   

 







Дата добавления: 2014-11-10; просмотров: 1344. Нарушение авторских прав; Мы поможем в написании вашей работы!



Кардиналистский и ординалистский подходы Кардиналистский (количественный подход) к анализу полезности основан на представлении о возможности измерения различных благ в условных единицах полезности...

Обзор компонентов Multisim Компоненты – это основа любой схемы, это все элементы, из которых она состоит. Multisim оперирует с двумя категориями...

Композиция из абстрактных геометрических фигур Данная композиция состоит из линий, штриховки, абстрактных геометрических форм...

Важнейшие способы обработки и анализа рядов динамики Не во всех случаях эмпирические данные рядов динамики позволяют определить тенденцию изменения явления во времени...

Роль органов чувств в ориентировке слепых Процесс ориентации протекает на основе совместной, интегративной деятельности сохранных анализаторов, каждый из которых при определенных объективных условиях может выступать как ведущий...

Лечебно-охранительный режим, его элементы и значение.   Терапевтическое воздействие на пациента подразумевает не только использование всех видов лечения, но и применение лечебно-охранительного режима – соблюдение условий поведения, способствующих выздоровлению...

Тема: Кинематика поступательного и вращательного движения. 1. Твердое тело начинает вращаться вокруг оси Z с угловой скоростью, проекция которой изменяется со временем 1. Твердое тело начинает вращаться вокруг оси Z с угловой скоростью...

Определение трудоемкости работ и затрат машинного времени На основании ведомости объемов работ по объекту и норм времени ГЭСН составляется ведомость подсчёта трудоёмкости, затрат машинного времени, потребности в конструкциях, изделиях и материалах (табл...

Гидравлический расчёт трубопроводов Пример 3.4. Вентиляционная труба d=0,1м (100 мм) имеет длину l=100 м. Определить давление, которое должен развивать вентилятор, если расход воздуха, подаваемый по трубе, . Давление на выходе . Местных сопротивлений по пути не имеется. Температура...

Огоньки» в основной период В основной период смены могут проводиться три вида «огоньков»: «огонек-анализ», тематический «огонек» и «конфликтный» огонек...

Studopedia.info - Студопедия - 2014-2024 год . (0.009 сек.) русская версия | украинская версия