- Quando o mundo é deterministico e completamente observavel o estado atual é dispensavel no plano
- Observação Parcial
- Nenhuma observação
- Sensores
- Como planejar sem conhecer o estado?
- Estado de crença: Representa a crença atual do agente de quais estados ele pode estar
- O Estado de crença cria um novo espaço de planejamento
- Nenhuma observação: Solução, quando houver, é um plano, uma sequencia de ações
- Sensores: solução é um plano contigencial, isto é, uma politica que mapeia cada sequência de observações e ações de uma ação
- Estados de crença B: seja N a quantidade de estados em E, então todos os setados são todos os estados possíveis subjconjuntos dos estados de E, totalizando 2^n estados de crença
- Estado Inicial: Tipicamente o conjunto de tdos os estados E;
- Ações Possiveis: Assumindo que ações ilegais tem nenhum efeito no mundo $b \in B$
- $Actions(b) = \cup_{s \in B} Actions_E(s)$
- Modelo de Transição: como o agente não sabe onde está, os estados futuros são todos os estados resultantes dos possíveis estados:
- $b' = RESULT'(b,a) = \{s|s = RESULT_e(S,A) \wedge s \in b \}$
- Teste de meta: Todos os estados que formam a crença devem estar no estado meta
- Problemas sem observação também são chamados de conformantes
- nem todo problema é solucionável sem observação
- a solução consiste em sequência de ações (um plano)
- considere que ações ilegais tem nenhum efeito no mundo, então se o plano p é uma solução para o estado inicial b, então, o mesmo plano é uma solução para qualquer b’ subconjunto de b($b' \subsetneq b$)
- se um estado b já foi gerado na árvore de busaca, qualquer estado b’que contém o estado b pode ser descartado ($b \subsetneq b'$)
- Observação parcial:
- Estado completo: Posição do aspirador, condição do comodo A, condição do comodo B)
- observaçãp parcial: (posição do aspirador, condição do cômodo ocupado pelo aspirador)
- exemplo $s=(A, Dirty, Clean)$ e $o = (A, Dirty)$
- Formalização:
- Predição: é o modelo de transição quando não há observação
- $\overline{b} = PREDICT(b,a) = \{s'|s' = RESULT_E(s,a) \wedge s \in b\}$
- Atualização: para cada percepção o em O, determina o estado de crença resultante
- $b'= UPDATE(\overline{b}, o) = \{s|o = PERCEPT(s) \wedge s \in \overline{b}\}$
- Observação Parcial e Não Determinismo
- Observações Possíveis:
- $Possible\_percept(\overline{b}) = \{o|o = PERCEPT(s) \wedge s \in \overline{b}\}$
- Resultados possíveisz\ll
- Solução:
- plano contifencial:
- [suck, if 5 the [r,suck] else []]
- Política: mapeia estados em ações