共 4547 个在招岗位 · 覆盖国企、大厂官方招聘
1、负责阿里集团境内/境外付款业务,根据系统相关指引完成操作并合理把控整个流程及系统风险问题,确保款项及时、准确、安全支付; 2、对于银承、商承票据业务、信用证、保函等特殊结算方式熟练,了解整个链路如何运转; 3、梳理当前结算链路风险,及时识别风险场景、提出结算方案,根据落地解决; 4. 配合部门工作需要,完成资金管理相关的其他业务内容并与协同方沟通完成新业务接入; 5. 持续致力于提高账户管理工作效率与不断加强精益化,提升财资价值创造的工作; 6. 不断完善内部操作流程及系统的优化与梳理,加强风险管理,促进团队间合作与发展; 7. 协助完成团队目标及主管安排的其他资金项目;
1. 负责面向业务场景的AI应用研发与工程化落地,参与需求分析、方案设计、核心模块开发及效果优化,完善全链路端到端R2C流程。 2. 负责构建AI应用相关的数据处理、模型集成、服务接口及效果评估体系,与产品、算法、数据、业务等团队协同,持续提升应用体验与业务价值。 3. 跟进AI技术与工程实践的发展,结合业务需求开展技术预研和方案创新,沉淀可复用的技术组件与最佳实践,支撑复杂业务问题的高效解决。
1、根据公司开发战略需求,制定开店网络规划及新店开发策略; 2、店面选址的商务谈判,合同签订及后续合同变更等事宜;负责合同的商务谈判,确认房屋合法性及工程条件,避免法律风险 3、深入了解公司战略,能很快推动新业务推出,也能根据业务转型及时调整执行策略; 4、对内部Setup的设计、机电、工程有很强的协调引导能力,快速找到问题解决问题; 5、为门店后期运营解决各种关于业主的疑难问题
1. 负责淘天集团商业数据安全,建立安全制度/卡口/审批流程对商业数据的开放和使用进行安全评审和管控。 2. 通过商业数据资产梳理,对服务和接口进行监控,实现事前事中数据泄漏告警。 3. 通过因子挖掘、数据分析、数据模型、策略运营,对爬虫等数据泄漏利用方式进行防控和持续对抗。 4. 兼顾风险防控和用户体验的平衡,优化防控策略的分层处置机制; 5. 对数据泄漏风险事件应急响应,进行快速的风险定位与止血,建立完善的事后处置流程。 6. 构建风控Agent对风险进行感知、巡检、止血、策略定制、样本分析等工作。
1. 集团级AI数据引擎架构:负责架构基于文本和多模态数据(音频、图像、视频)的采集、清洗、处理、治理与资产化管理,打造可复用、可观测、可解释的 EB 级数据体系,支撑大模型训练与推理的高质量数据供给; 2. AI Native数据Pipeline设计和建设:设计并带领团队建设实施高效数据管线,实现数据分渠道过滤、去重、质量诊断、调度编排和异常告警等环节的自动化,显著降低人力成本; 3. 设计和实现数据&模型闭环迭代:与数据策略团队合作,基于评测反馈的短板,设计对应的专项数据集,并在训练过程中构建可观测指标,量化数据对模型能力提升的贡献,动态更新数据集,实现数据 → 模型 → 评测 → 数据的循环优化; 4. 负责数据资产治理:负责元数据、数据血缘、分类分级、质量评分、数据标准、价值评估等治理框架的设计与落地,推动数据资产的可视化与可运营化,让数据可管理、可复用、可增长。
1. 熟悉存储介质及协议(如SCM, SSD, CMR / SMR HDD,TAPE等)、了解SCSI, NVMe等存储协议以及iSCSi , NVMe over Fabric等存储网络协议,了解文件系统和设备驱动的架构和实现, 开发软硬件一体化的存储产品满足阿里巴巴云数据中心的业务挑战和需要。 2. 深入理解存储业务应用,对分布式文件系统,块存储,对象存储,文件存储,以及大数据平台进行深入分析,了解阿里业务情况与用户需求,制高性能,低成本存储软硬件技术和产品的发展路线。 3. 与阿里云各软硬件团队合作,开发针对大容量,高性能存储的存储引擎、文件系统等。
1. 负责SOC系统方案,系统场景验证,CPU核/NoC/DDR/PCIe等子系统的System level级验证; 2. 负责验证策略,验证方案及验证feature list的制定; 3. 负责子系统及/系统级前仿、后仿验证交付; 4. 支持Emu&FPGA系统case调试,硅后调试; 5. 作为技术专家解决团队内同学的SoC验证技术问题,提升团队成员的SoC技术能力。
1、负责天猫国际保健&母婴&数码行业用户体系搭建及用户运营,通过商家产品工具、行业规则机制、权益玩法等机制设计并推动落地,驱动行业用户规模增长; 2、通过精细化运营实现用户规模的高效沉淀,挖掘新渠道、转化新用户,维护老客户并提升用户活跃度和客单价; 3、通过数据分析、挖掘、分析,发现潜在增长点,挖掘消费者需求,结合供给侧策略制定整体增长策略并推进落地。
负责高性能网络系统的架构设计与技术演进,围绕 RDMA网络、超节点 等核心技术,构建低延迟、高吞吐的网络基础设施,支撑 Agent时代的AI 推理和训练、分布式存储、KV cache等业务场景。作为网络架构师,推动技术选型、方案落地与团队能力建设。 核心职责 • 主导高性能网络架构的规划与设计,涵盖数据中心网络拓扑、RDMA 网络方案、集合通信优化等方向; • 负责ScaleOut和ScaleUP网络的选型、部署、调优及故障排查,保障大规模集群的网络性能与稳定性; • 深入理解商用网的特性和自研网卡的开发,推动硬件能力与业务场景的深度结合; • 设计并优化 AI 训练场景下的集合通信方案,包括 NCCL 调优、网络拓扑感知调度、流量工程等; • 推动网络可观测性体系建设,建立网络性能基线、异常检测和根因分析能力; • 跟踪业界前沿技术发展,输出技术洞察与演进路线; • 与上层业务团队紧密协作,端到端解决跨领域性能瓶颈。
1. 参与AI网关的系统设计与实现, 独立完成相关模块的完整设计、开发工作,并保证功能交付的质量与稳定性。 2. 参与AI网关的用户需求实现,主动组织、推动上下游团队的协作,按时保质地交付用户功能需求。 3. 参与AI网关的高可用能力构建,主动通过架构设计解决高可用容灾,通过单元测试、功能测试、性能测试、容灾演练等持续提升自身负责模块的稳定性能力。 4. 参与AI网关的性能调优,关注前沿技术发展趋势,结合实际场景落地持续提升AI中间件的性能,打造一流的AI中间件产品。 5. 参与 AI 中间件的AI场景探索与落地,基于用户需求独自完成设计与开发工作,并保证功能交付的质量与稳定性。 6. 参与 AI 中间件相关的开源项目Higress、 HiRoute影响力和标准的构建,在开源社区担任重要角色,组织社区持续发展。
岗位名称:AI智算高速光互联技术专家(NPO/CPO、国产化方向) 岗位核心职责 负责面向AI智算中心光互联的各种国产化技术方案,除了传统可插拔光模块外,特别是AI时代新型光互联——NPO(近封装光学)/CPO(共封装光学)技术规格制定、光电协同设计、样机调试、系统集成及量产导入,并保障后续上线后的稳定性保障工作。 具体工作职责与任务 1.光互联芯片方案选型和技术规格制定 NPO/CPO技术规格和交互文档:负责NPO/CPO光引擎的技术规格设计,具体包括定义光引擎与ASIC芯片(例如交换芯片)的边界条件:例如form factor、连接器信号定义、功耗、散热、EEPROM等。编写技术规格书,明确定义光接口和电接口指标,确保满足相应的OIF或IEEE标准,以及可靠性要求等;编写对系统设备的软硬件设计要求文档,输入给系统设备软硬件开发团队以确保软硬件兼容性。制定规格前需通过测试等各种手段确定技术规格的可用性。 关键器件选型与评估:主导核心光电芯片的选型工作,包括硅光芯片(PIC)、电芯片(EIC/Driver/TIA)、外置CW laser及光纤阵列(FA)等。 跟踪 OIF、IEEE、MSA 等国际标准进展,推动国产技术方案进入生态体系。 2. 硬件研发 原理图与PCB设计:负责光引擎载板及测试主板的原理图设计,指导Layout工程师进行高密度互连(HDI)PCB设计,重点把控差分信号线的等长、等距及串扰控制。 DFx审查与优化:组织并主导设计评审,具体执行可制造性设计(DFM)、可测试性设计(DFT)和可装配性设计(DFA)审查。 3. 调测试与问题攻关 样机Bring-up:负责NPO/CPO样机的上电调试(Bring-up)。 高速信号完整性调试:使用示波器、误码仪等专业设备,对高速链路进行眼图测试和误码率(BER)分析。针对信号衰减或反射问题,调整均衡参数(CTLE/DFE)或优化走线。 系统集成测试:按照系统规格进行整机测试,确保NPO/CPO在系统内的软硬件功能和性能的兼容性满足要求。 4. 供应链协同与量产导入 供应商技术对接:作为技术接口人,对接国内光电芯片厂商、光模块厂商,确保供应商的供应交付,接收厂商的PCN并进行判断是否导入和如何导入。 产线良率监控指导:深入产线分析不良品(FA),定位失效根因(如耦合效率低、芯片虚焊),并推动工艺改进,将直通率(FPY)提升至量产标准;当发生批次性质量问题时负责问题跟进和解决方案。 5. 线上运营支持和保障 对批量上线的NPO、CPO的运行质量进行跟踪,若发生不符合预期的链路质量问题,协助运营同学进行定位和分析,找到根因并提供解决方案,以保障智算网络的链路稳定性。
1. 技术规划 负责数据中心交换机及NPO/CPO系统方向的硬件技术规划,主导交换芯片、CPU、电源、时钟及光电器件方案选型、架构设计和工程化落地,提前识别设计、质量及供应链风险。 跟踪交换芯片、高速SerDes、NPO/CPO、光电共封装及国内外产业链发展趋势,结合业务场景推动关键技术预研与落地。 2. 架构与解决方案设计 面向数据中心及高速交换场景,负责数据中心交换机端到端硬件架构规划及整机解决方案设计,输出PRD、硬件规格书等关键文档。 主导交换芯片平台设计,包括端口规划、SerDes通道、控制与管理平面、电源与时钟树、关键器件选型以及国产化替代方案等。 跟踪国产化交换芯片及国产NPO/CPO产业链、竞品和生态动态,保障方案先进性、可落地性和供应安全。 3. 技术研发 主持交换机硬件开发,负责原理图设计与审查、BOM搭建及维护、Layout指导、DFx审查、测试标准制定及测试结果评审。 负责交换芯片及配套器件的系统集成与调试,完成样机Bring-up、问题定位、量产导入及良率提升。 负责高速SerDes链路性能测试和调试,完成眼图、BER、抖动等关键指标分析与优化,具备国产SerDes方案调优能力。 推动国产NPO/CPO方案的系统设计、样机验证、联调测试和工程化落地,协同国内芯片、封装、光器件、测试等合作伙伴完成方案导入和问题闭环。 4. 性能优化 面向研发、生产、交付、运维全链路,持续优化数据中心交换机及NPO/CPO平台的性能、稳定性和可靠性。 建立国产器件及方案导入、验证、替代和生命周期管理机制,提升平台国产化水平与供应链韧性。
负责数据中心网络相关前沿技术的洞察和网络架构的设计,尤其是灵骏 AI 计算领域,作为 PD 和架构师,设计和落地数据中心新架构、新产品。 网络架构团队所设计的集群架构承载了阿里云上的 AI 计算、高性能存储、大数据等各类业务;近年专注灵骏 AI 训练高性能网络架构,设计了业界领先的 HPN 7.0,HPN 8.0以及新时代的TPN架构,完成了诸多 AI 场景中的网络架构优化设计。 团队对外面向内部业务与云产品场景,洞悉分析各类内部业务与云产品对网络的诉求,设计网络架构方案;对内规划数据中心网络发展方向,实现各代架构的 HLD/LLD 设计,带领研发、运营等团队共同落地新架构。 核心职责|网络规划与架构设计 与灵骏、ECS、存储等云产品团队,以及电商等内部业务团队对接,将业务需求转化为涵盖 AIDC 内部网络顶层设计,并制定前瞻性的网络演进路线图。 ● AIDC 内网架构:主导端到端设计,涵盖 GPU 集群互联、Spine-Leaf / Clos 拓扑、前端业务网络及带外管理网络; ● 拥塞控制与标准制定:负责超大规模集群网络的拥塞控制调优与标准制定,包括 PFC、ECN 及带内网络遥测(INT); ● 架构交付物:输出架构文档(HLD / LLD)、网络拓扑图、配置规范及 SOP等; ● 存量架构优化:识别现有网络架构中的风险,制定改进路线图并推动落地执行。
1. 负责异构AI芯片算子优化领域的技术规划与核心研发,制定面向大模型推理的算子技术路线,主导震旦算子库架构及持续演进。 2. 深入分析芯片计算、存储和互联特征,研发核心算子及融合方案,解决异构AI服务器在不同模型和部署形态下的性能瓶颈。 3. 推动震旦算子库与SGLang、vLLM等推理框架及业务系统深度集成,将算子优化转化为端到端时延、吞吐和资源效率收益。 4. 交付可复用的算子库、关键算子实现、性能模型和优化方案,并从软件实践中提炼对推理框架及下一代硬件的技术需求。
1. 负责大模型推理系统与全链路仿真领域的技术规划与核心研发,制定仿真技术路线,主导震旦从模型、算子到调度和服务的仿真架构演进。 2. 构建请求调度、KV Cache、并行计算、通信及分离架构的系统模型,刻画异构AI服务器在真实业务负载下的时延、吞吐和资源效率。 3. 贯通流量画像、算子性能模型和系统仿真,形成异构AI服务器的部署策略、容量规划方案、瓶颈归因及系统优化方案,并推动业务应用。 4. 交付仿真引擎、系统模型库、标准接口和方案分析结论,并推动核心技术进入主流推理框架及开源社区。
1.从推理框架与算子层的视角,参与异构资源 Profiling & Tracing 平台的架构设计与能力建设,覆盖框架调度、算子执行、硬件微观指标等全链路性能诊断能力; 2.能基于主流推理框架(vLLM / SGLang / TRT-LLM)的源码理解,分析调度策略对推理延迟与吞吐的影响,定位性能瓶颈并提出优化方案; 3.负责 GPU 满载运行场景下的稳定性与性能问题排查,包括 RAS 故障(ECC、XID、NCCL 超时)、框架层显存泄漏与 OOM 分析、推理延迟异常等; 4.负责从集群视角优化多卡/多节点的资源利用率与负载均衡; 5.负责建立面向多种异构硬件架构的统一诊断与 Profiling 能力;
主导 SoC 基础设施(NOC、CRG、Memory subsystem 等)的微架构设计与优化,在架构早期锁定延迟与 PPA 目标。 作为微架构评审 owner,review 团队 RTL 与设计方案,识别流水线级数、关键路径、仲裁/缓冲、访存路径等影响延迟与 PPA 的问题,把关PPA目标。 建立微架构设计规范与评审流程,指导培养团队,系统性提升微架构设计水平。 协调设计、验证、物理实现、DFT 跨领域工作,主导 PPA/timing 问题的根因分析与收敛。
1. 负责AI硬件系统仿真和CoDesign领域的技术规划与核心研发,制定面向异构AI服务器的仿真技术路线,主导软硬协同仿真模型和设计方法演进。 2. 构建覆盖芯片计算、KV Cache存储层次、片间互联、多卡服务器及集群拓扑的参数化模型,支撑AF分离等异构系统架构分析与设计。 3. 从模型负载和业务SLA出发开展设计空间分析,量化算力、带宽、容量、互联、卡间配比和服务器形态的关键取舍,收敛芯片、互联及服务器规格。 4. 交付硬件系统仿真工具、异构服务器方案、芯片与互联需求及服务器规格建议,支撑下一代AI硬件及服务器规格定义。
1. 架构设计与技术规划 承担服务器/整机柜产品的硬件系统架构设计,输出系统方案、产品规格书、配置规则等关键文档 主导 EVT/DVT/PVT 各阶段架构评审,对架构决策的质量与进度负责 跟踪 CPU、GPU、内存、互连、供电、散热等领域的技术趋势,规划新技术在自研产品中的落地路径 端到端研发交付 2. 覆盖需求分析 → 方案设计 → 原理图/Layout 审查 → BOM 选型 → DFx 评审 → 测试验证 → 量产导入的完整链路 与 BIOS/BMC、结构、热设计、SI/PI、系统测试、供应链等团队协同,闭环解决跨领域问题 对存量机型的硬件质量与运营稳定性负责,主导线上疑难问题的定位与复盘 3. 关键技术攻关 独立或牵头攻克高速互连、大功率供电、液冷散热、超高功耗芯片散热、EMC 等方向的工程难题 主导专业实验验证,沉淀测试用例、设计规范、复用资产 4. 供应商与生态协同 深入供应商研发端审核设计过程,管理需求匹配性与质量风险 参与核心器件国产化选型的架构适配与验证
1. 架构设计与技术规划 承担服务器/整机柜产品的硬件系统架构设计,输出系统方案、产品规格书、配置规则等关键文档 主导 EVT/DVT/PVT 各阶段架构评审,对架构决策的质量与进度负责 跟踪 CPU、GPU、内存、互连、供电、散热等领域的技术趋势,规划新技术在自研产品中的落地路径 端到端研发交付 2. 覆盖需求分析 → 方案设计 → 原理图/Layout 审查 → BOM 选型 → DFx 评审 → 测试验证 → 量产导入的完整链路 与 BIOS/BMC、结构、热设计、SI/PI、系统测试、供应链等团队协同,闭环解决跨领域问题 对存量机型的硬件质量与运营稳定性负责,主导线上疑难问题的定位与复盘 3. 关键技术攻关 独立或牵头攻克高速互连、大功率供电、液冷散热、超高功耗芯片散热、EMC 等方向的工程难题 主导专业实验验证,沉淀测试用例、设计规范、复用资产 4. 供应商与生态协同 深入供应商研发端审核设计过程,管理需求匹配性与质量风险 参与核心器件国产化选型的架构适配与验证
1. 架构设计与技术规划 承担服务器/整机柜产品的硬件系统架构设计,输出系统方案、产品规格书、配置规则等关键文档 主导 EVT/DVT/PVT 各阶段架构评审,对架构决策的质量与进度负责 跟踪 CPU、GPU、内存、互连、供电、散热等领域的技术趋势,规划新技术在自研产品中的落地路径 端到端研发交付 2. 覆盖需求分析 → 方案设计 → 原理图/Layout 审查 → BOM 选型 → DFx 评审 → 测试验证 → 量产导入的完整链路 与 BIOS/BMC、结构、热设计、SI/PI、系统测试、供应链等团队协同,闭环解决跨领域问题 对存量机型的硬件质量与运营稳定性负责,主导线上疑难问题的定位与复盘 3. 关键技术攻关 独立或牵头攻克高速互连、大功率供电、液冷散热、超高功耗芯片散热、EMC 等方向的工程难题 主导专业实验验证,沉淀测试用例、设计规范、复用资产 4. 供应商与生态协同 深入供应商研发端审核设计过程,管理需求匹配性与质量风险 参与核心器件国产化选型的架构适配与验证
1. 负责服务器整机和液冷整机柜产品的系统设计、开发、交付; 2. 根据项目需求,进行服务器结构方案的制定和技术评估,提供可行性分析报告,为项目决策提供技术支持; 3. 与服务器ODM厂家紧密合作,负责服务器整机规格制定、负责整机设计过程质量管控,整机测试,整机交付质量管控; 4. 负责服务器结构相关的技术文档编写和维护,包括设计文档、测试报告、用户手册等; 5. 负责服务器产品的测试和验证工作,以及过程管理,解决测试过程中出现的结构问题,确保产品质量; 6. 跟踪行业新技术动态,研究新技术在服务器结构设计中的应用,不断提升产品竞争力;
1、负责SSD 端到端产品化交付:从产品规划、业务需求收集、分析需求、产品转化、供应商合作、定制开发落地、引入交付、系统级测试交付、推动产品上线和解决线上问题 2、基于业务需求,分析行业的控制器、SSD产品,设计对应的方案,并实施引入SSD部件,交付上线;支撑自研SSD产品化交付。 3、持续跟踪SSD相关领域的技术发展趋势,结合对业务应用场景的深入分析,并推动相关技术的产品化实现。 4、负责系统化的解决全闪存存储系统的稳定性问题,系统化设计报错方案,优化监控和诊断,提升诊断的准确率。 5、负责SSD产品需求测试规格,测试策略、测试方案,测试用例,测试标准的定义和输出。对标业界标杆,引入先进的测试方法。负责SSD相关测试和验证新技术的调研,预研和推广落地工作。
1、负责服务器BIOS 自主研发及产品交付和维护,能主导需求分析、版本管理、功能开发与测试,线上运维全生命周期研发,保障产品高质量交付。 2、负责海量服务器硬件组件的BIOS 统一化定制, 与厂商协同研发并指导其开展工作,推动 BIOS 研发标准化,测试自动化。 3、负责服务器BIOS/CPU领域RAS、故障定位系统、系统性能调优、安全、功耗等竞争力特性的策略制定、方案落地。 4、结合阿里业务应用场景,开拓BIOS技术发展方向,引领行业标准建设,并推动相关技术产品化落地。
1、负责服务器网卡(普通网卡/智能网卡/DPU)的引入测试全流程,包括功能、性能、兼容性、可靠性及长稳测试;主导测试方案设计与验收标准制定,确保产品满足交付质量要求。 2、负责服务器网卡在生产环境的稳定性保障,建立线上风险识别、故障预警及应急响应机制;主导疑难问题定位与根因分析,协同多方推动问题闭环,持续提升线上质量。 3、负责服务器网卡测试工具、自动化测试框架及诊断工具的设计与开发,提升测试效率与问题定位能力。
1. 主导或参与智能网卡/DPU相关系统软件和驱动软件的开发、功能验证,产品化落地以及上线运维。 2. 根据云产品业务特点,通过软硬件结合技术,进行业务软件优化,持续创造客户价值。 3. 通过智能网卡的创新应用,帮助云产品基础设施持续提升技术竞争力。
1. 主导或参与智能网卡/DPU相关系统软件和驱动软件的开发、功能验证,产品化落地以及上线运维。 2. 根据云产品业务特点,通过软硬件结合技术,进行业务软件优化,持续创造客户价值。 3. 通过智能网卡的创新应用,帮助云产品基础设施持续提升技术竞争力。
1. 针对整机柜超节点服务器,全面赋能计算、互联、监控、故障及性能诊断等核心能力; 2. 梳理适配超节点异构服务器产品的业务场景,开展对应的昆仑组件设计与开发,涵盖性能评测分析、容器镜像等关键模块; 3. 基于整机柜硬件架构及典型业务落地场景,构建典型故障与异常案例库,并设计相应的故障诊断方案; 4. 负责跟踪与研究主流GPU架构设计技术,参与下一代AI Infra的规划与设计; 5. 结合业务画像,构建面向异构硬件与系统的全链路量化分析模型,形成数据驱动的决策数据库,有效推动异构服务器产品的规划与规模化落地。
1. 针对整机柜超节点服务器,全面赋能计算、互联、监控、故障及性能诊断等核心能力; 2. 梳理适配超节点异构服务器产品的业务场景,开展对应的昆仑组件设计与开发,涵盖性能评测分析、容器镜像等关键模块; 3. 基于整机柜硬件架构及典型业务落地场景,构建典型故障与异常案例库,并设计相应的故障诊断方案; 4. 负责跟踪与研究主流GPU架构设计技术,参与下一代AI Infra的规划与设计; 5. 结合业务画像,构建面向异构硬件与系统的全链路量化分析模型,形成数据驱动的决策数据库,有效推动异构服务器产品的规划与规模化落地。
1.负责 UE 场景下 Agent 工作流设计与落地:需求理解、任务拆解、工具调用、结果验证、失败修复与回滚; 2.负责 LLM 与 UE 工程桥接能力建设:代码生成/补丁、蓝图与资产分析、运行日志诊断、规则校验; 3.设计并实现研发质量门禁:静态检查、编译检查、PIE 冒烟验证、关键日志契约、风险提示机制; 4.建设多 Agent/多工具编排体系:任务路由、上下文检索、结构化工件输出、可追踪审计链路; 5.推动 AI 功能在真实项目中的工程化落地:稳定性、可维护性、可观测性、可回退能力; 6.与客户端、玩法、TA、技术策划协作,沉淀可复用模板、规则库与最佳实践。