学不进去了,记录一下今年的暑期实习

腾讯:3.7 一面通过,我说不想去深圳,现在还没约二面(感觉寄了)
字节:3.18 一面
阿里云:3.18 一面
美团:3.9 笔试 380,3.16 笔试 470,筛简历ing
达摩院:筛简历
百度:筛简历
旷视:筛简历

--------------------------------3.18 更新 ------------------------------------
补充一下个人背景
本硕 985 科班,两段实习(阿里和字节),一个开源项目
目前投的主要是机器学习系统,之前的实习完全不相关,项目相关

腾讯约了二面
字节一面:前面聊的还行,面试官:你基础不错呀,来道 hard,没写完全
阿里云一面:项目被拷打,场景题被拷打,面试官至少是个 P8,压力拉满,感觉是寄了

--------------------------------3.21 更新 ------------------------------------
字节二面:面试官反馈还不错,但是 HR 在问能实习多久,不会因为这个挂我吧
阿里云:竟然过了一面,今晚二面,不过怀疑是 KPI,平常心吧
腾讯:今晚二面,因为实在不想去深圳,平常心吧
美团:昨晚打电话,今早就面了,感觉也还行,等结果

--------------------------------3.23 更新 ------------------------------------
心态炸了
字节要求实习时长,实在满足不了(真的很想去啊),寄了,不知道该投啥了
阿里云又又又来拷打我了,可能不是很 match,很折磨,结束的时候人都是晕的
腾讯到 HR 面了
美团还没动静

--------------------------------4.2 更新 ------------------------------------
更新一下状态
腾讯:已OC
字节:卡实习时长,已挂
阿里云:卡了半个月流程,挂了
美团:已OC
达摩院:一面没动静了
淘天:二面

吐槽一下,阿里系的流程是真的推不动,太难受了
全部评论
我也是跟tx说不考虑深圳,现在10天多了也没反应
4 回复 分享
发布于 2024-03-18 13:59 北京
楼主,我们好像是一个开源社区的。。
1 回复 分享
发布于 2024-03-21 16:47 广东
↑春招实习 Mark↑
1 回复 分享
发布于 2024-03-19 19:00 广东
tx投的那个部门呀 teg吗
1 回复 分享
发布于 2024-03-19 12:50 上海
校友好猛
1 回复 分享
发布于 2024-03-18 20:39 北京
阿里云是什么部门啊
点赞 回复 分享
发布于 2024-04-08 16:54 浙江
字节要求多长的实习时间鸭
点赞 回复 分享
发布于 2024-03-25 13:42 北京
佬 美团那边约面试了没
点赞 回复 分享
发布于 2024-03-19 15:31 江苏
佬真的猛吧,佬是之前实习后端,后来转 ai编译的嘛?
点赞 回复 分享
发布于 2024-03-19 12:22 湖北
需要的话友友可以看看我首页,有内推码直接内推米哈游大量岗位,包括实习和正式,可以咨询
点赞 回复 分享
发布于 2024-03-19 08:42 上海
佬,字节是暑期实习的吗
点赞 回复 分享
发布于 2024-03-18 17:32 广东
关注一下
点赞 回复 分享
发布于 2024-03-18 17:09 上海
同学你好,考虑暑期来pdd试试不?我们部门可优先录用,部门转正概率也较高,有问题可私信联系我
点赞 回复 分享
发布于 2024-03-18 11:05 上海

相关推荐

2025-11-20 18:15
山东大学 算法工程师
1.实习介绍2. Lora 原理(核心是低秩分解:将原始权重更新近似为两个低秩矩阵乘积,减少参数量,保留主导方向,训练高效)3.了解 DeepSpeed 吗,ZeRO -1, ZeRO -2和 ZeRO3分别做了哪些优化(1优化优化器状态,2优化梯度,3切分参数,全面节省显存)4. Qwen的模型结构是怎么样的,相比于 LLaMA,DeepSeek 有什么区别(Qwen采用GQA+SwiGLU+RMSNorm,和LLaMA架构非常相似,差异在训练数据和tokenizer中文支持更好;DeepSeek只用MoE/MLA架构,Qwen系列主要是Dense模型)5.怎么缓解大模型的幻觉问题(RAG,RLHF对齐,事实监督)6.大模型的 MoE 结构相比于 Dense 结构训练的难点在什么地方,DeepSeekMoE为什么效果好,有什么值得我们借鉴创新点(MoE面临负载不均衡、训练不稳定问题;DeepSeekMoE通过细粒度专家和共享专家设计提升稳定性和效果)7.知道FP16和BF16有什么区别吗,包括FP32和INT8这些,在训练大模型的时候,应该怎么选择(FP16精度高但易溢出,BF16动态范围大;训练常用BF16混合精度,推理用INT8量化加速)8.讲-下 RLHF 的流程,写-下 PPO和 DPO的 Loss表达式(训练奖励模型后用PPO/DPO优化策略:PPO Loss: policy ratio + KL 约束/ DPO Loss: logit preference diff + sigmoid binary loss)9.对于超长上下文业界一般是怎么做的,你知道 Qwen是怎么做的吗(业界常用ROPE 变体/滑动窗口注意力/稀疏注意力等:Qwen使用YaRN和窗口注意力扩展上下文)10.开放题:你觉得目前大模型的上限在哪里(推理能力、长期记忆、具身交互和能耗效率,需要架构创新和多模态融合突破)11.代码:152.乘积最大子数组
查看9道真题和解析
点赞 评论 收藏
分享
评论
17
15
分享

创作者周榜

更多
牛客网
牛客网在线编程
牛客网题解
牛客企业服务