optimal D network = p(r) / (p(x) + p(r))
loss:
–> sum[ log(D(r)) + log(1-D(x)) ] –> sum[ log(D(r)) - log(D(x)) ]