腾讯-混元大模型面经-华5硕

腾讯-混元大模型面经-华5硕
部门与岗位:TEG - 混元大模型团队 - 大模型对齐
一面
自我介绍,过实习,讲论文,论文过的比较细,有说的笼统的地方面试官会实时进行询问交流
了解哪些大模型,简要挑一两个介绍一下,当时说了 Qwen 和 DeepSeek,然后面试官又问了这两个有什么区别
接着上一问,为什么大家都开始探索 MoE 架构,MoE 相比 Dense 有什么好处
在之前实习的时候用 LoRA 微调过 Qwen,于是问了有没有全量微调过,有没有对比过两者的性能表现
讲一下大模型训练和推理的流程,SFT 和 RLHF 的作用分别是什么
在 RLHF 中,目前主流的强化学习算法有哪几个,写一下损失函数的表达式
代码:22. 括号生成
代码:多头自注意力
一面问的八股还是比较多的,问的也比较细,而且还写了两道代码题,整个面试花的时间也比较多,大概一个半小时左右
二面
自我介绍,过实习和论文,面试官会一起进行探讨,包括工作的动机、贡献和结果,也会提一些问题和建议
之前实习用 DeepSpeed 微调过 Qwen2-72B,于是面试官问了 ZeRO-1,ZeRO-2,ZeRO-3 三个模式的区别
当时你用 DeepSpeed ZeRO-3 来微调 Qwen2-72B,每一张卡占用的显存大概是多少,估算一下为什么是占这么多的显存

除了 DeepSpeed,还用过其他的什么优化方法吗
我看你也用到了 LoRA,知道 LoRA 的原理吗,A 和 B 两个矩阵怎么初始化,有了解过其他的初始化方法吗
对 RLHF 了解的多吗
代码:3. 无重复字符的最长子串
二面更多的是结合具体的工作来问的,从用到的东西来引出问题,问的也比较灵活。当然因为部门主要是做对齐的,所以也大概聊了聊 RLHF
三面
自我介绍,挑一个觉得做的比较好的论文和实习讲一下,面试官问的比较详细,为什么选现在这种方案,为什么 work,其他方案有考虑吗
在微调 Qwen 的时候,数据是怎么构造的,有用到什么数据清洗方法吗,数据配比是怎么做的
讲一下 RLHF 的流程,之前有用 RLHF 做过模型对齐吗
在做对齐的时候,为什么 SFT 之后还要做 RLHF,只用 SFT 可以吗
知道哪些强化学习算法,除了 PPO 和 DPO 这些呢,DeepSeek 用的 GRPO 相比于 GPT 的 PPO 做了哪些改进
开放题:对目前大模型的发展有什么看法
代码:零钱的两个题 322. 零钱兑换518. 零钱兑换 II
三面面试官更聚焦于对齐这一块的内容,考的比较深。由于之前没有接触过强化学习,答得还是比较吃力的,不过面试官还挺好的,会一起讨论来做引导
四面
自我介绍,过论文和实习,问的也比较细,这里能明显的感受出来面试官的视角更系统,会把这些工作串起来问我看你简历上没写 RLHF,平常有用过 RLHF 吗
推导一下神经网络反向传播的过程一道排列组合的概率题
开放题:你觉得大模型目前还有哪些可以改进的点
四面整体更看重思维和基础,没有考察什么八股
总结
一共四轮技术面,整体来说强度比较大,对于大模型八股的考察比较细,对大模型的理解问的也比较深刻,包括一些数理逻辑基础,考察的比较全面

#26届实习##大模型##八股##面经##腾讯##内推#腾讯-混元大模型面经-华5硕-主页内tui
腾讯2026校园招聘技术研发提前批专项,报名启动

面向对象:毕业时间在2025.1.1~2026.12.31期间的同学

开放岗位:前端、移动端、PC端、游戏端、测试开发、技术运营等

招聘项目选择:【人才专项-技术研发提前批】,截止时间:8月5日。
技术研发提前批专项面试未通过,不影响后续参加常规应届生招聘。

专项优势:
-更大几率发起面试,投递即进专项简历库
-更快流程推进,先人一步拿到正式offer
-更高offer成功率,大前端、测试开发等热招岗位需求多多

内推链接:https://join.qq.com/resume.html?k=ANQI6RfQ3rhPS2dpyIkeSw(内推简历优先筛选,加速流程推进)
全部评论

相关推荐

家人们,最近刷招聘软件是不是已经刷到焦虑?秋招这波“内卷”真的太猛了——大厂算法岗的岗位,一个“算法工程师”的职位,简历池能直接溢出屏幕;投递了几十份简历,要么石沉大海,要么连面试通知的影子都没见到,整个人都emo了…但今天想跟大家掏心窝子说一句:越是这种时候,越别“躺平”!秋招的“黄金投递期”就这么几个月,简历这事儿,真的是“广撒网,多捞鱼”的核心解法,咱们得主动出击才行!先聊聊为啥秋招这么“卷”?今年高校毕业生1179万,又创历史新高;大厂岗位虽然在扩招,但优质岗位(尤其是算法岗这种“香饽饽”)的竞争比,早就不是“10:1”,而是“100:1”甚至“500:1”。HR一天要看几百份简历,筛简历的标准越来越“卷”——学历、实习经历、项目成果、甚至编程语言熟练度,都可能成为“生死线”。但你要知道:“卷”不代表没机会。大厂算法岗的岗位总量其实不少(比如字节、阿里、腾讯、百度、美团这些,每个季度都有几十上百个算法岗在招),只要你主动“触达”这些机会,总有“漏网之鱼”会砸到你头上。为啥“多投简历”是关键解法?可能有人会说:“投那么多,都没回音,不是浪费时间吗?”但我想说:简历投递的本质,是“概率游戏”+“经验积累”,你得先让自己“被看到”,才有机会“被选中”。👉 “广撒网”能增加“被捞到”的概率:比如你投10家,可能只有1家给面试;但投30家,可能就有3-5家给机会。大厂的“简历初筛”环节,有时候靠关键词(比如“Python”“机器学习”“NLP”)就能过滤掉大半人,多投几家,总能让HR看到你的“闪光点”。👉 “多捞鱼”能帮你“试错”和“复盘”:哪怕面试没通过,你也能从HR反馈、面试题目里知道自己的短板(比如算法题没做出来?项目经验不够深?),下次针对性补,越试越清楚“自己能做什么”“想做什么”。👉 还能帮你“定位目标”:投几家大厂后,你会发现有的公司更看重“业务落地”,有的更看重复现能力,有的偏爱有竞赛经验的… 这些信息能帮你调整简历方向,比如你发现某家公司特别喜欢“推荐算法”,就可以把实习中相关的项目经验多写两句,让简历更“对口”。怎么“高效多投”?给几个实操小技巧1️⃣ 分优先级投递,别盲目海投:先列个“目标清单”,比如“我最想去的3家大厂(比如小红书、字节、阿里)”+“次目标5家(比如腾讯、百度、美团)”,剩下的“随缘投”。每个岗位单独改简历——别用“一份简历投所有岗位”,针对不同岗位突出不同重点(比如投算法岗,就把“模型优化”“A/B测试”“数据指标”这些关键词加粗)。2️⃣ 主动用“内推”,效率翻倍:自己海投的简历,大概率会被扔进“待筛选池”,等排到你可能已经过了一周;但内推能直接跳过初筛,简历直达HR甚至业务负责人,甚至可能有“内推导师”帮你改简历、内推面试,通过率至少翻3倍!👉 重点来了:小红书算法岗内推码,直接甩给你们!如果你也想冲小红书的算法岗(比如推荐算法、搜索算法、NLP算法),这里有个内推码:[XHS202408](这是我自己留的码)小红书火热招聘中,众多岗位总有一个适合你,点击下方链接开始投递吧!https://hr.xiaohongshu.com/recommend/job-list/XHSRC-2690957e0a0952116de1c3db88119f0c另外内推码附上,Y35KY3FPK33N💡 使用方式:打开小红书APP → 搜索“小红书算法岗招聘” → 找到对应岗位(比如“小红书推荐算法工程师(2024届校招)”) → 点击投递,在“内推码”输入框粘贴这个码,提交后就能直接进入内推通道,后续会有HR或业务同学联系你,比自己投快太多!最后想说:秋招确实“卷”,但“卷”不代表“没机会”。多投简历不是“摆烂式努力”,而是用“行动”对抗焦虑——你投递的每一份简历,都是在给未来的自己“铺路”。别犹豫了,现在就打开招聘软件,把目标岗位列出来,针对性改简历,然后把内推码用起来!(PS:如果内推码需要具体岗位链接,或者有其他问题,评论区留言,我看到会回~)
投递美团等公司10个岗位
点赞 评论 收藏
分享
评论
1
收藏
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务