-
负责智能驾驶云平台大模型训练和推理的基础设施保障,数据闭环,智能驾驶业务运营,智能运维等领域,欢迎数据处理、数据挖掘、数据标注、三维可视化、数据仓库、AI In
-
【岗位职责】
1. 智能体与模型集成:负责游戏中AI智能体(Multi-Agent)、视觉理解与生成模型(如图像/视频生成) 等前沿AI系统的工程实现、性能优化
-
职位描述
1. 基于cuda和TensorRT开发推理框架,优化工具链;
2. 开发工具监测GPU运行效率及显存使用,提高应用的效率和性能;
3. 与其它技术团
-
核心职责
1. 参与核心研发,负责推理引擎与深度学习训练和推理框架的设计、研发及迭代,支撑AI算法高效落地与规模化应用。
2. 主导算子优化(融合/自定义开发)
-
我们正在寻找一位对主流GPU硬件架构有深刻理解、并拥有丰富CUDA编程经验的资深开发工程师,加入我们的人工智能(AI)核心团队。您将主导GPUKernel的优化
-
职位描述
1、为类Nvidia的GPGPU硬件开发底层的高性能计算库;
2、挖掘硬件潜力,逐步优化不同应用场景下的性能;
3、参与设计并完善计算库的软件架构,搭
-
职位描述:
1. 使用CUDA/OpenMP/MPI等工具对已有算法进行并行加速,如流体模拟仿真粒子法算法工业化落地等;
2. 检测GPU运行效率及显存使用,提
-
工作职责
-负责公司基础大模型和专精大模型业务适配优化工作,通过SFT、RL、模型压缩、知识蒸馏、推理加速等技术保障大模型能力更好的落地业务。
-负责构建各类大
-
【职位摘要】
我们正在寻找对硬件与软件协同有深刻洞见的高性能计算开发专家。您将加入AI工具链团队,成为连接未来AI芯片架构设计与极致软件性能的核心桥梁。您的工作
-
岗位职责:
1. 针对超算平台的数学库和算法求解器性能优化;
2. 针对特定平台的编译器改造,包括硬件性能模型构建、基于处理器/加速卡指令集和微架构进行编译器配
-
职位描述:
1.研发方向:参与公司多芯片推理平台的搭建
2.技术支持:为公司个业务场景提供技术支持,推动同构融合计算技术在实际产品中的应用和落地
3.团队协作:
-
岗位职责
1. 负责 HPC 核心算法设计开发,优化 CPU/GPU/ASIC 多芯片性能,追求极致吞吐量与延迟;
2. 对接业务场景,定位并解决计算性能瓶颈,
-
工作职责:
1.熟练C++开发,具备高性能工程编码能力。对C++17/20等新特性有深入理解,在智能指针,STL高效使用,内存优化,数据结构布局优化上有丰富的
-
岗位职责:
基于 NVidia GPU 架构和自研芯片架构特性,完成深度学习算子,CV 、点云计算库的开发及优化
基本要求:
1、计算机、软件工程、自动化等
-
工作职责:
1. 负责NN算法、传统图像算法在移动端、桌面端的部署和优化;
2. 负责与开发对接联调,保证算法在工程端落地;
3. 从算法部署优化角度对算
-
高性能异构计算实习生
地点:北京/无锡
本科及以上面议
工作职责:
1) 参与PerfXAPI异构计算软件栈(计算库,框架)的研发
2) 参与CPU(ARM或R
-
岗位职责:
1. 研发高质量的芯片基础软件栈,包括支撑大语言模型在内的深度学习,线性代数,科学计算,信号处理等方向的基础加速库;
2. 分析重要的性能指
-
AI Infra研发工程师(国产异构智能计算)
工作内容
参与开源项目群 InfiniTensor 的研发,包括但不限于:
国产异构计算平台适配与性能优化
-
在 SmartX 超融合及企业云产品之上,构建面向企业的高性能 AI 推理平台,负责大模型推理系统研发与性能优化,持续提升推理吞吐、降低服务延迟和资源消耗,帮助
-
1.手机端侧AI模型部署和优化;
2.自研芯片AI算法模型(检测、分类、分割、图像增强等)在端侧NPU上的评估,转换、适配、部署评估。
-
岗位职责:
1. 承担智能驾驶系统AI模型性能优化工作,持续优化高性能AI算子库与计算图优化引擎。
2. 负责智能驾驶系统AI模型量化、调优、分布式推理优化,持
-
【职位亮点】
核心攻坚:负责公司最前沿的异构计算适配,解决国产化“卡脖子”底层支撑。
技术深度:横跨通用计算、类脑计算、异构加速,接触行业最全的国产芯片矩阵。
-
岗位职责:
1、对自研AI芯片的关键部件和核心算子进行系统级的性能分析和优化;
2、根据优化结果,对AI芯片的硬件架构、软件性能评估模型提供改进意见;
3
-
岗位职责
1.、负责深度学习模型在推理阶段的性能分析与优化(包括 CPU、GPU、NPU、DSP 等多平台)。对模型计算图进行分解、融合与算子调度优化,提升整体
-
工作职责:
1.AI模型相关领域前沿技术研究;
2.深度学习框架在特定GPU上的适配和加速;
3. AI模型性能评估和部署,基础算子库开发与优化建议。
4.负责
-
工作职责
-负责昆仑芯AI芯片性能深度学习高性能计算库开发,支持各种AI场景
-探索新一代AI芯片编程模型和架构
-深度学习框架PaddlePaddle图性能优
-
职位描述:
1、为类Nvidia的GPGPU硬件开发底层的高性能计算库;
2、挖掘硬件潜力,逐步优化不同应用场景下的性能;
3、参与设计并完善计算库的软件架构,
-
作为高性能计算工程师,你将负责开发和维护投研平台的核心模块,涵盖数据处理框架、因子计算框架、AI模型训练平台、因子/模型分析框架以及回测框架等。你将与投研团队紧
-
远算是致力于将高性能计算技术赋能数字化制造的前沿云计算平台公司。我们的客户涵盖了颠覆性创新的创业公司到中国高端制造巨头。远算本着跨界融合,创造价值,定义专业,成
-
岗位职责:
负责大规模深度学习训练/推理框架中 CUDA 内核的性能优化与定制开发
开展与 GPU 体系结构相关的前沿探索性工作,包括新指令集、算子融合、异构计