12号中午面我的就是一个小姐姐,声音巨甜。要是没有客户端开发这个,我还以为是我的面试官。。。🤣职业规划这个确实重要啊,有明确的发展规划,比起找工作时才漫无目的地寻找未来方向的同学,公司肯定不太敢要没规划的。因为,你没规划,你不知道自己想要什么,入职过后,突然发现自己不想干这个咋办。😫鹅厂的企业文化很棒,希望这波面试能过吧,凉凉的话,国内公司就没啥想去的了。手动狗头

相关推荐

一面(1.5h)1.自我介绍,过实习,讲论文,根据表述实时跟进询问交流2.讲一下大模型训练和推理的流程, SFT 和 RLHF 的作用分别是什么3.为什么探索 MoE 架构, MoE 相比 Dense 有什么好处4.有没有全量微调过5.推导一下神经网络反向传播的过程6.在 RLHF 中,目前主流的强化学习算法有哪几个,写一下损失函数的表达式7.一道排列组合的概率题8.平常有用过 RLHF 吗,简单介绍一下9. 开放题:对目前大模型的发展有什么看法10.代码:多头自注意力二面(1h)1.自我介绍,过实习和论文2.知道哪些强化学习算法,除了 PPO和 DPO 这些呢3. 知道 LoRA 的原理吗, A 和 B 两个矩阵怎么初始化,有了解过其他的初始化方法吗4.除了 DeepSpeed ,还用过其他的什么优化方法吗5.ZeRO -1, ZeRO -2,ZeRO -3三个模式的区别6.讲一下 RLHF 的流程,之前有用 RLHF 做过模型对齐吗7.当时你用 DeepSpeed ZeRO -3来微调Qwen2-72B,每一张卡占用的显存大概是多少,估算一下为什么是占这么多的显存8. 在微调 Qwen 的时候,数据是怎么构造的9.代码:无重复字符的最长子串📳对于想求职算法岗的同学,如果想参加高质量项目辅导,提升面试能力,欢迎后台联系。
查看19道真题和解析
点赞 评论 收藏
分享
牛客网
牛客网在线编程
牛客网题解
牛客企业服务