-
感知模型优化工程师
关于公司
文远知行(WeRide)成立于 2017 年,是全球领先的 L4 级自动驾驶科技公司,致力于“以无人驾驶改变人类出行”,已
-
职位描述:
主导智驾场景算法模型优化瘦身,释放大模型的端侧潜力
负责智驾模型在车端芯片平台量化压缩工具链的开发工作,支持推理芯片的量化仿真验证。
针对实际车载场
-
AI模型部署和优化工程师
职位概述
我们正在寻找一位专注于AI音频处理模型部署与优化的算法工程师,加入我们的空间音频核心研发团队。你将负责将前沿的AI音源分离
-
【工作职责】
针对量产辅助驾驶业务需求,搭建高效的AI系统,为算法迭代提供模型优化、量化、部署的高效算法工具链。你将参与到以下工作中:
1. 端到端模型、LLM
-
职位描述
1. 负责AI模型的网络级压缩与优化,涵盖量化(QAT/PTQ)、投机采样(Speculative Decoding)、Token压缩、知识蒸馏等技术
-
针对图片/视频生成这一应用场景,进行推理加速,职责包括但不限于:
1. 使用量化、蒸馏、Sparse Attention等技术,针对不同应用场景提供极致性能加速
-
工作职责
欢迎加入摩尔线程,我们专注于AI模型工程化,对最热门模型进行训练和推理的适配以及性能优化,探索GPU性能的极限,为全球客户提供先进的解决方案。加入我
-
多模态赛道头部的 AI 大模型公司,目前公司接近 300 人,北京总部 + 上海 office。2 月刚刚完成一轮超 6 亿元融资,4 月又完成 B 轮 20
-
1. 参与模型压缩部署相关⼯作,包括但不限于量化、剪枝、蒸馏等,
2. 参与模型部署的开发以及性能调优;
【职位要求】
1. 熟悉Linux,具有良好的编程能⼒
-
公司简介:墨芯人工智能(Moffett AI)成立于2018年,总部位于中国深圳,在上海、北京、硅谷设有全球办公室。墨芯拥有全球领先、自主研发的稀疏化算法,是双
-
岗位职责
1、负责大语言模型(LLM)在生产环境中的推理性能优化,包括但不限于延迟(latency)、吞吐量(throughput)、显存占用(memory f
-
(AI SSD / 存算协同方向)
岗位职责
AI SSD 硬件适配与分层存储设计:聚焦大模型推理场景,负责模型权重、嵌入表(Embedding Table)、
-
职位描述:
1. 核心推理服务构建与优化:负责公司核心大模型的规模化部署与性能优化。深入应用 vLLm、SGLang、TensorRT-LLM 等业界前沿的推理
-
职位描述:
1、多平台模型适配与迁移 (Model Porting):
负责将 GLM-4、Qwen、DeepSeek 等主流开源 Coding 模型,快速适配
-
职位要求
1、本科及以上学位,计算机、深度学习等相关专业,3年及以上工作经验
2、熟练掌握Linux环境下的C/C++与Python语言
3、熟练使用至少一种训
-
工作职责
1 负责大语言模型(LLM)训练基础设施的设计与开发,包括大规模数据加载优化、训练数据构建和数据处理 Pipeline。
2 负责大规模训练数据格式与
-
岗位职责
- 负责大模型训练与推理全链路性能优化,通过模型量化(INT4/INT8)、剪枝、蒸馏、KV Cache优化等技术,降低推理时延、提升吞吐量,控制部署
-
岗位职责
1. 负责端侧大模型推理优化相关工作,包括但不限于量化、剪枝、蒸馏、KV Cache 优化、投机推理、长上下文优化等方向。
2. 负责大模型在
-
岗位职责:
1.负责研发大模型推理及性能优化技术,例如KV缓存优化、算子融合优化、模型切分等;
2.负责研发大模型服务部署及优化技术,例如动态batching、
-
职位描述
1. 负责模型训练与推理全链路效率提升,支撑算法团队复杂模型的高效工程化落地与规模化部署;
2. 参与生成式、多模态及深度 CTR/CVR 等复杂模型
-
职位描述
1、负责智能驾驶模型在多种不同硬件平台(主部署平台为地平线征程系列,兼有NV平台)的极致性能优化,结合编译优化、并行计算优化、图融合、高效CUDA算子
-
职位描述
1. 负责大模型训练框架的开发,以支持在各种架构的GPU以及TPU等,多种硬件上的混合异构训练。
2. 负责国产芯片的适配工作,并开发针对各种国产芯片
-
范式智能(6682.HK)是领先的全栈AI云服务平台,提供包括先知AIOS、HAMi vGPU、信创模盒等高效AI基础设施,具备从底层异构算力纳管优化到智能体模
-
工作职责:
-负责千帆MaaS平台级推理降本与效率优化策略设计与落地,并支持定制化推理性能优化
-负责量化、投机推理(MTP / speculative de
-
职位描述:
1.核心推理服务构建与优化:负责公司核心大模型的规模化部署与性能优化。深入应用 vLLm、SGLang、TensorRT-LLM 等业界前沿的推理框
-
岗位概述:
专注于网约车各模型的高效推理部署与性能优化,负责推理性能提升、问题排查和稳定性保障,支撑模型在实际业务场景中的落地使用。
岗位职责:
1、负责网约车
-
岗位职责
1、针对重点大模型应用场景,基于寒武纪产品推理解决方案,深度参与各软件模块的性能分析及优化,包括但不限于:算法分析、竞品性能分析、框架及算子实现优化等
-
岗位职责:
- 参与大规模模型(如MoE等)架构设计与优化,推动模型性能提升。
- 负责模型训练框架的开发与优化,包括分布式训练、各种并行加速技术。
- 对训练
-
1、抖音研发直播互动团队支持抖音直播、社交互动等业务,并通过AIGC和大语言模型等AI技术探索全新的互动内容,业务发展迅猛,发展空间巨大;加入我们,你将与优秀伙
-
职位描述
1、高性能算子开发与优化:负责AI模型(尤其是大语言模型及多模态模型)在GPU上的核心算子(Kernel)的设计、开发与极致性能优化,支撑训练和推理场