AI Infra网络研发工程师
1.AI推理网络性能优化 ● 负责设计和优化大规模推理系统中GPU集群的高性能网络架构,支持GPU间通信、KV Cache远端访问、分布式存储数据读写等场景,提供极致的网络通信性能。 ● 深入研究和应用RDMA、GPUDirect等技术,优化集体通信(AllReduce、All-to-All)及点对点通信性能,解决大规模并发下的网络拥塞与丢包问题。 ● 开发与调优网络协议栈(如TCP/IP、RDMA、自定义传输协议),结合AI框架(PyTorch/TensorFlow)和集合通信库(NCCL),实现通信与计算的深度融合与流水线并行。 2.Agentic网络基础设施构建 ● 构建高可用、低延迟的AI Agent接入网关,支持海量用户访问AI应用时的负载均衡、流量调度、ingress/egress连接管理,保障服务SLA。 ● 设计与优化接入层协议(如HTTP/3、WebSocket、gRPC),处理Agent交互中的长连接保持、消息路由、安全认证及限流熔断等机制。 ● 协同上层业务团队,针对强化学习(RL)后训练以及AI Agent动态交互特性(如容器/Sandbox资源构建、工具调用、
招聘公告与岗位信息
所属企业:阿里云
招聘批次:社招/日常
截止时间:2122-08-30
工作地点:杭州
发布时间:2026-04-07
招聘方向
AI Infra网络研发工程师
投递提示
点击右侧「立即投递」前往官方网申渠道;投递前请核对岗位、城市与截止时间。
说明:以上内容依据原始公告字段整理,完整信息以官方公告原文(job)为准。
截止时间:2122-08-30
招聘流程
截止时间:2122-08-30
点击右侧「立即投递」前往官方网申渠道。
投递建议
在正式投递 阿里云 前,建议回到原始招聘公告再次核对投递渠道、截止时间、城市范围和学历要求,尤其留意图片中的补充说明。
如果你同时在看多条校招,建议先处理与 阿里云 匹配度最高、时间要求最明确的岗位,再做海投扩展,避免在信息不完整的职位上投入过多时间。
准备 阿里云 相关简历时,优先保留和岗位关键词、业务方向、目标城市最相关的经历,弱相关内容可以下沉到后半部分。
常见问题 FAQ
建议先看 4 件事:岗位方向是否匹配、城市是否可接受、学历和毕业时间是否符合、投递截止时间是否紧张。如果这 4 项都大致匹配,再花时间优化简历和准备笔面试,投入产出会更高。