百度大模型开发-日常实习凉经

百度大模型岗面经

  1. 介绍DPO和PPO
  2. DPO损失函数怎么算的
  3. 梯度检查点如何提升效率
  4. 详细讲一下deepseed
  5. 以7B的模型为例,计算训练需要多少显存说明都有哪些部分,每部分怎么算的,以及用deepseed每一个阶段节省多少内存,怎么节省的,计算过程中都有乘以2字节是为什么,什么原理
  6. 做Rag 时候的分块策略
  7. BM25原理,RRF的原理
  8. Kl散度的输入是什么,怎么来的

手撕:用torch实现kl散度