岗位描述(节选)
1. GPU集群高性能存储架构设计与建设
负责大规模GPU算力集群高性能存储系统的架构设计、方案选型与落地交付,支撑AI大模型训练对高吞吐、低延迟、海量小文件并发访问的严苛需求。
主导并行文件系统(如Lustre、GPFS、BeeGFS等) 的规划部署与调优,设计合理的热数据-冷数据分层存储策略,平衡性能与成本。
参与存储系统与GPU集群的整体协同设计,优化数据加载、Checkpoint及KVCache等应用场景,避免存储成为算力瓶颈。
2. 存储性能深度调优与瓶颈攻坚
深入分析和优化存储系统的IOPS、吞吐量、延迟等核心指标,识别并解决数据加载阶段的性能瓶颈,确保GPU利用率达到最优。
针对AI训练场景中的海量小文件读取、Checkpoint大块写入和KVCache加载等典型负载,进行针对性的存储参数调优与缓存策略优化。
探索和落地GPU存储直通、NVMe-oF等前沿技术,打通存储与GP……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 6843 个杭州岗位(全城各职能合计),其中 744 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 9K ~ 20K(25~75 分位),中位约 12K,最低 1K、最高 250K。
在招岗位较多的企业:阿里巴巴集团(含高德/阿里云) 1231 个海康威视 1108 个字节跳动 603 个零跑科技 525 个阿里巴巴控股集团 228 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。