Compute binary cross-entropy loss from true labels and predicted probabilities to monitor training and spot badly calibrated outputs.
p 应裁剪至 (ε,1−ε) 避免 log(0)。