此信息由前程无忧(51JOB)审核并发布(查看原发布网址),应届生求职网转载该信息只是出于传递更多就业招聘信息,促进大学生就业的目的。如您对此转载信息有疑义,请与原信息发布者前程无忧(51JOB)核实,并请同时联系本站处理该转载信息。
[北京]北京首都在线科技股份有限公司
职位:推理优化工程师-27届校招
发布时间:2026-08-21
工作地点:北京
信息来源:前程无忧(51JOB)
职位类型:全职
职位描述
专业1:计算机科学与技术
专业2:软件工程
福利:六险一金
职能类别:算法工程师
岗位职责
1. 调研主流大模型(GLM、Qwen、DeepSeek等)的KV Cache基础结构,整理不同模型的缓存特性差异,协助团队完成优化方案调研、文档沉淀与实验验证。
2. 学习vLLM、SGLang推理框架与PD分离架构基础原理,协助完成分布式KV Cache跨节点数据传输的测试、调试工作,积累大模型分布式推理基础经验。
3. 参与GPU显存、内存、磁盘多级缓存卸载的相关实验,协助完成128K长上下文推理场景的资源适配、显存占用测试与数据分析工作。
4. 协助优化大模型推理调度逻辑,基于缓存命中率、显存水位等指标,开展对比实验,辅助提升推理吞吐与延迟表现。
5. 参与分布式KV缓存服务的基础功能迭代,协助完成数据统计、日志整理、基础监控配置,保障推理服务稳定运行。
任职要求
1. 本科及以上学历,计算机、软件工程、人工智能、电子信息等相关专业。
2.掌握Python基础编程,有C++/CUDA任意一种语言基础即可,了解GPU并行计算、高性能计算基础概念;
3.掌握C++/Rust任意一门编程语言,熟悉操作系统、内存管理、计算机网络等底层基础课程;
4.了解大模型推理基本流程,知道KV Cache的作用与基础原理,有vLLM/SGLang框架使用、部署、实验经验者优先;
5. 具备基本的代码调试、问题排查思维,愿意学习GPU显存优化、缓存优化相关技术。
6.了解高性能IO、网络通信基础原理即可,无需精通RDMA/SPDK等技术;
7.对大模型、AI推理有基本认知,愿意跨界学习大模型系统优化相关技术即可。
优先加分项
1. 有大模型推理框架使用、二次调试、课程实验、毕设相关经历;
2. 了解模型量化、剪枝、显存优化等基础技术,有相关实验或项目经历;
3. 接触过长文本大模型推理、GPU资源调优相关实践;
4. 有分布式系统、高性能网络、NPU开发相关学习或项目经历;
5. 基础扎实、自驱力强,对大模型推理系统、高性能优化方向有长期兴趣。
公司简要介绍:
公司名称:北京首都在线科技股份有限公司
公司类型:上市公司
公司规模:500-1000人
公司介绍:一、基础工商与上市信息
全称:北京首都在线科技股份有限公司(Capitalonline,简称 CDS)
成立 / 上市:2005-07-13 成立;2020-07-01 深交所创业板上市,股票代码300846企查查
创始人 / 法人:曲宁
总部地址:北京市朝阳区紫月路 18 号院 9 号楼
资质:高新技术企业、专精特新小巨人企业,注册资本约 5.03 亿元企查查
二、发展历程
2005:起步做 IDC 机房、带宽托管业务
2010:转型云计算,布局 IaaS 云主机
2014:行业较早出海,美国搭建海外云节点,全球化布局
2020:创业板上市
2023 至今:全面AI 智算转型,All in GPU 算力,推进 “一体两翼” 云 + 智 + 网战略
三、核心业务(两大板块)
1. 传统基础云业务
IDC 机房托管、服务器租赁、全球 BGP 带宽、跨境专线
通用云主机、混合云、海外云节点(覆盖亚太、欧美)
服务游戏、跨境电商、音视频、中小企业海外建站
2. 核心增长:AI 智能算力(智算云,公司战略重心)
自建智算中心:落地甘肃、新疆、杭州等东数西算节点,布局上万张 GPU 算力集群(A 股算力梯队靠前)
算力服务:大模型训练、AI 推理、渲染、数字孪生、自动驾驶仿真算力租赁
核心优势:全球一体化调度、异构 GPU 池化、跨境高速专线,兼顾国内 + 海外 AI 客户算力需求启信宝
行业方案:AI 大模型、工业互联网、车联网、数字政务、医疗影像算力
四、全球布局规模
国内 + 海外共 94 个数据中心、52 个可用区、24 个区域节点、上千边缘算力节点
分支机构:上海、广州、中国香港、新加坡、美国达拉斯等,业务覆盖 50 + 国家,主打企业全球一站式上云 / 算力部署启信宝
