AI infra应届春招

#AI求职记录# 📍面试公司:文远知行一面(更新2026/03/26挂)
🕐面试时间:2026/03/20
💻面试岗位:AI infra(时长1小时)
❓面试问题:
一、实习项目拷打10分钟,你在上一家公司做了什么
二、八股
    1、PD分离机制,如何调度两个队列          ——回答PD区别,然后我如何设计调度策略,优先D,也保证P不被饿死
    2、vllm如何优化显存?                            ——讲了pageattention、continue batching、内存复用
    3、chunk prefill                                       ——分块计算,我感觉这个没啥好讲的,可能是针对padding吧
    4、什么是虚拟内存                                   ——这个很简单
    5、说一下进程和线程的区别,以及操作系统如何调度    ——这个也简单
    6、讲一下TCP\IP栈                                  ——说实话没听明白,后来询问之后是介绍TCP/IP模型
    7、追问如何通过IP地址进行通信(找到目标ip) ——这个我其实忘了,随便说了一下洪泛搜索,不知道对不对
    8、K8S拷打,简历上没写这个                   ——反正基本都不会,应该是炸了,只知道pod和container😓

三、手撕(dfs+优化思路)
    给的测试数据不大,十分钟写了个O(N^N)的算法,运行没问题,然后要求优化成O(N^logN) ——想了很久,提示二分后没时间了,就没写了。  

四、反问
    1、我今天表现怎么样
        答:我感觉你没睡醒😂,状态不好。(我感觉这面试官也一直打哈欠)
    2、对我有什么建议吗
        答:简历都挺好的,技术上不应该只追求论文,你可以多了解一下K8S这些
    3、部门业务是啥
        答:我们组是做ai infra的,顶层可能是k8s负责调度大模型,中间有做算法优化,底层也有cuda算子优化吧。(这个                面试官介绍的挺详细的,我感觉他是负责K8S调度的)

🙌面试感想:
    发挥不是很好,面试官人挺不错,感觉凉了大半截了,过几天看看结果吧。

#发面经攒人品#
全部评论
哥,面试的八股都是怎么找的呀,能分享吗?
点赞 回复 分享
发布于 03-22 17:00 北京

相关推荐

03-25 11:22
已编辑
门头沟学院 算法工程师
📍面试公司:京东infra一面(更新2026/03/25已挂)🕐面试时间:2026/03/23💻面试岗位:ai infra❓面试问题:零、查户口,问我啥时候毕业,哪里人,哪个专业,手头上有没有offer,面过其他什么公司?(简历上有但是会问)一、项目拷打(十分钟)二、八股(二十五分钟)1、讲一下大模型推理优化有些方法?                                      ——(这个问的很宽泛,可以从各方面回答)2、你刚刚说到有pageattention,这个具体是什么?               ——(上个问题的追问)3、Flashattention为什么能加速,计算过程是什么?4、你有讲到PD分离机制,那么如何实现调度队列?5、PD分离的时候chunk prefill是指同一个请求的PD插入吗?      ——(这里回答说A的prefill chunk过程中插入B的decoder,而不是A的decoder)6、C++的多态如何实现?7、你刚刚说的虚函数是怎么实现多态的,请具体说说看?8、你说了虚函数表,那么虚函数表里面的函数顺序是怎么样的?是按照声明顺序吗?   ——(这个问题我没答好)三、手撕(快排)(十五分钟)没写出来😭,其他排序都会写,就这个忘了,我又炸了。。。。。。/(ㄒoㄒ)/~~四、反问1、公式一问(我今天表现怎么样?对我有什么建议吗?)答:整体表现还可以,快排写不出来很不应该,我们这边很重视这个代码能力。(意思是寄/(ㄒoㄒ)/~~)2、他都这么说了,我也不好意思再问下去了。🙌面试感想:大概是寄了,就当积攒经验了,还有26届的同学还在找工作吗,可以交流交流看看。
查看10道真题和解析
点赞 评论 收藏
分享
算法题: 1- 快排,寻找两个正序数组的中位数,下一个排列,二叉树中的最大路径和,Path Sum III2- 给定若干点的数轴坐标数组和固定数量的等长线段,问该线段最少要多长才能覆盖所有点3- 前k个高频字符串,词频一样时按字典序升序排列4- 给定初始字符串s,每次将字符串向右旋转一次,并将旋转后的字符串拼接到原字符串的末尾,每次操作都会使字符串的长度变为原来的两倍,求计算出无限扩展后的字符串中第 N个位置的字符5- 两根手指放在26个小写字母组成的键盘上,最少移动多少距离才能敲出给定的字符串sorch手撕题:MHA * 3,Flash Attention v1,flow matching model采样的伪代码ai infra或算法八股:1- flow matching模型预测的是什么,怎么理解conditional velocity (conditioned on data sample x0)2- 如何计算QwenImage的time shift3- 介绍Flash Attention的原理和实现思路4- GPU matrix transpose使用shared memory的好处5- CPU按列遍历一个行优先的矩阵相比按行遍历为什么性能会变差,具体是因为哪个性能指标变差导致的6- weight-only量化有哪些,实现weight-only量化cuda kernel时如何优化访存,是否了解Marlin kernel7- Megatron SP的实现方式8- DeepSpeed ZeRO stage1和stage 2的通信量区别,论文和代码实现有没有gap9- 多GPU通信时NVSHMEM和NVLink的区别
查看15道真题和解析
点赞 评论 收藏
分享
评论
7
9
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务