百融云创ai infra面经(已口头offer)

timeline:

2月10日一面

2月13日二面(leader面)

2月14日三面

2月24日四面(hr面)

2月25日谈薪,口头offer(跟hr提了几天时间考虑要不要接)

面试提问的一些大概问题(针对项目的问题略过。。。):

能说一下reduce类算子有哪些优化方案吗?

对于reduce类算子,考虑shape为[M, N],对于M非常大怎么优化?对于N非常大怎么优化?

了解sglang和vllm吗?

vllm采用了哪些优化方案?PageAttention的实现思路是怎样的?

vllm你觉得哪些方面可以进一步优化?

说说flashattention的原理

openMP外层循环开了四个线程,在内层循环可以开大于四个线程的循环吗?

有哪些原子操作?锁的原理?

说说CUDA的内存模型

CUDA的cache是可配置的吗?

手撕:实现LRU

还有一些其他问题不大记得了。。

全部评论
实习面试简单点不
点赞 回复 分享
发布于 2025-08-05 14:43 河北
咋不去好未来呢
点赞 回复 分享
发布于 2025-03-01 15:25 陕西
base是哪里?
点赞 回复 分享
发布于 2025-02-28 12:20 北京

相关推荐

03-25 11:22
已编辑
门头沟学院 算法工程师
📍面试公司:京东infra一面(更新2026/03/25已挂)🕐面试时间:2026/03/23💻面试岗位:ai infra❓面试问题:零、查户口,问我啥时候毕业,哪里人,哪个专业,手头上有没有offer,面过其他什么公司?(简历上有但是会问)一、项目拷打(十分钟)二、八股(二十五分钟)1、讲一下大模型推理优化有些方法?                                      ——(这个问的很宽泛,可以从各方面回答)2、你刚刚说到有pageattention,这个具体是什么?               ——(上个问题的追问)3、Flashattention为什么能加速,计算过程是什么?4、你有讲到PD分离机制,那么如何实现调度队列?5、PD分离的时候chunk prefill是指同一个请求的PD插入吗?      ——(这里回答说A的prefill chunk过程中插入B的decoder,而不是A的decoder)6、C++的多态如何实现?7、你刚刚说的虚函数是怎么实现多态的,请具体说说看?8、你说了虚函数表,那么虚函数表里面的函数顺序是怎么样的?是按照声明顺序吗?   ——(这个问题我没答好)三、手撕(快排)(十五分钟)没写出来😭,其他排序都会写,就这个忘了,我又炸了。。。。。。/(ㄒoㄒ)/~~四、反问1、公式一问(我今天表现怎么样?对我有什么建议吗?)答:整体表现还可以,快排写不出来很不应该,我们这边很重视这个代码能力。(意思是寄/(ㄒoㄒ)/~~)2、他都这么说了,我也不好意思再问下去了。🙌面试感想:大概是寄了,就当积攒经验了,还有26届的同学还在找工作吗,可以交流交流看看。
查看10道真题和解析
点赞 评论 收藏
分享
评论
5
27
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务