1秒登錄
在pytorch中計算KLDiv loss時,注意reduction='batchmean',不然loss不僅會在batch維度上取平均,還會在概率分布的維度上取平均。
參考:KL散度-相對熵
本站轉載的文章為個人學習借鑒使用,本站對版權不負任何法律責任。如果侵犯了您的隱私權益,請聯系本站郵箱yoyou2525@163.com刪除。