北京零一万物信息技术有限公司——大模型推理优化工程师

北京零一万物信息技术有限公司(BOSS直聘招聘方)于2026年9月5日发布大模型推理优化工程师岗位,坐标北京,给出35-60K·15薪的薪酬区间,学历要求硕士。从薪酬结构看,15薪意味着年终部分占比较重,实际年薪范围约52万至90万,在同类技术岗中属于中上水平。
岗位的核心指向是“推理优化”,这在大模型落地环节中属于工程侧的关键角色。通俗说,模型训练完不等于能用,推理速度、显存占用、成本控制都决定了一个模型能否真正跑在业务里。此类岗位通常涉及算子融合、量化、剪枝、蒸馏、推理框架选型或自研等方向,但本条招聘信息未披露具体技术栈,建议求职者联系招聘方确认。学历卡在硕士,反映出团队对算法理解深度的要求——只懂工程框架调用不够,还得能理解模型内部结构。
从这条招聘信息看,硕士确实是明确要求,原因是这类岗位既要懂工程框架,还得能理解模型内部结构,纯调包经验很难过关。但别急着劝退——如果你有2年以上推理加速经验,熟悉TensorRT、vLLM、MindSpore任一生态,或者对KV Cache、Continuous Batching这些机制有实操心得,本科背景也有谈的空间。应届博士如果论文方向对口,比如高效Transformer或模型压缩,反而有机会破格。说白了,学历是筛子,真本事才是钥匙。
查看完整问答 →北京零一万物是近年成立的AI创业公司,核心团队有前百度高管背景,主攻大模型底座与行业应用。选择这类公司的好处是技术氛围浓、决策链路短,模型迭代速度快,工程师能接触到从训练到部署的全流程;代价则是业务方向可能随融资节奏调整,稳定性不如大厂。如果候选人有2年以上推理加速经验,熟悉TensorRT、vLLM、MindSpore任一生态,或对KV Cache、Continuous Batching等机制有实操心得,拿到上限薪资的可能性较大。应届博士如果论文方向对口(如高效Transformer、模型压缩),也有机会破格。
同城同类岗位中,另外两家企业也在招类似角色:
· 月之暗面(Moonshot AI)——推理性能优化工程师,35-70K·14薪,要求硕士,侧重长文本场景下的显存调度与延迟优化。
· 智谱华章(智谱AI)——大模型部署优化工程师,30-60K·14薪,硕士及以上,偏GLM系列模型的国产芯片适配与推理加速。
这两家的共同点是都要求扎实的C++/CUDA功底,且面试会现场分析算子瓶颈,纯调包经验很难过关。
北京AI岗位市场趋势
从2026年下半年的招聘数据看,北京大模型岗位出现两个明显变化。其一,纯算法岗数量增速放缓,推理优化、部署工程、AI Infra类岗位占比上升,企业不再迷信“发论文”的能力,转而关心模型怎么省钱、怎么跑得快。其二,薪酬带宽拉大,同样一个优化工程师,给到30K和给到70K的都有,差异不在年限,而在是否真正解决过千卡集群或单卡极限压榨的问题。
从北京2026年下半年的招聘数据看,风向挺明显:纯算法岗数量增速放缓,推理优化、部署工程、AI Infra这类岗位占比在上升。企业不再迷信发论文的能力,更关心模型怎么省钱、怎么跑得快。薪酬带宽也拉开了,同样一个优化工程师,30K到70K都有,差的不在年限,而在你有没有真正解决过千卡集群或单卡极限压榨的问题。想入这行,建议把推理引擎源码读一遍,能现场写算子的能力比堆技术名词管用。
查看完整问答 →对求职者而言,现在投递这类岗位,建议在简历里直接写清楚做过的项目规模——模型参数量、并发请求数、优化前后的延迟对比数字,比罗列技术名词管用得多。另外,北京AI岗位的面试轮次普遍在4-6轮,其中至少一轮是现场写算子或系统设计,提前把推理引擎的源码读一遍是基本功课。