At NVIDIA, we build groundbreaking products for the following sectors: Deep Learning, High Performance Computing, Gaming, VR, and Automotive. See your efforts in action as developers use your tools to debug, profile and analyze the performance
模型仿真技术专家(上海) 上海 全职 研发 - 电子 / 半导体 职位描述 职责描述:负责对SystemC kernel 优化控制, 对仿真模型进行性能profiling和优化; 研究探索相关前沿的仿真建模技术 职位要求 任职要求:1. 计算机/电子类专业本科/硕士毕业; 2. 5年以上C/C++面向对象编程经验;3. 熟悉ESL 方法学/SystemC/TLM 建模/GEM5/QEMU; 4. 有搭建各类仿真环境/基于仿真工具进行二次开发经验者优先; 投递...
Riot Games was established in 2006 by entrepreneurial gamers who believe that player-focused game development can result in great games. In 2009, Riot released its debut title League of Legends to critical and player acclaim. As
模型推理系统工程师 上海 校招 正式 技术族 - 软件类 职位 ID:A223864 职位描述 1. 负责机器人端侧模型运行后端建设,支持 SLM、VLM、Omni、TTS 等模型的稳定推理。2. 参与模型导出、量化、推理引擎构建、版本管理和性能基线建设。3. 支持 Model Gateway 后端能力,包括 Infer、Stream、Cancel、Warmup、Health、Metrics 等接口。4. 完成 TensorRT、TensorRT-LLM、ONNX Runtime、vLLM、SGLang 等推理后端适配。5. 分析模型 TTFT、P95/P99、内存峰值、吞吐、显存占用和端到端时延。6. 负责模型运行日志、端云对齐、结构化输出稳定性验证。7. 与模型训练、交互系统和 Infra 团队协作,推动模型在机器人端侧 Demo 中稳定运行。 职位要求 * 熟悉
OverviewBruker’s Nano Surface and Metrology (BNSM) Division is the leader in advanced X-ray, AFM, and other various metrology products, including the semiconductor IC and compound semiconductor industries. The BNSM division offers the most comprehensive portfolio of
The objective of this role is to support end-to-end data migration from local China-based platforms (both SaaS and on-premise systems) into Microsoft Dynamics 365. The role will focus on understanding data lineage, designing extraction and transformation
About Kuoni Tumlare: At Kuoni Tumlare, we deliver truly inspiring and innovative solutions and experiences that create value both for our Partners and Society at large. Our wide portfolio of products and solutions is built on
AI院-训练Infra工程师 北京、上海 全职 互联网 / 电子 / 网游 职位描述 1、负责大规模预训练框架的研发、优化和维护,根据业务需求持续改进训练框架和策略,提升模型训练效率2、分析和定位训练中的性能瓶颈,实施针对性优化措施,提升训练效率和稳定性3、跟进业界技术进展,不断同步与集成最新训练优化策略 职位要求 1、对自然语言处理、计算机视觉和多模态算法有深入理解,熟悉主流的 LLM 和 VLM 模型架构,有分布式训练经验2、精通 Python 编程语言,熟悉 PyTorch 深度学习框架和 Megatron 分布式训练框架3、有大规模预训练优化 / MoE 训练优化经验的优先考虑加分项:1、在ACM、NOI、IOI、超算比赛中有获奖经历者优先2、具有 cuda 算子优化/profiling 能力者优先 投递...
Please note that we will never request payment or bank account information at any stage of the recruitment process. As we continue to grow our teams, we urge you to be cautious of fraudulent job postings
机器人系统软件架构师 深圳、上海 全职 智能机器人板块 职位描述 1、主导机器人核心软件系统的架构设计与重构:评估现有系统耦合点,制定分层/模块化拆分方案,定义模块间接口契约,推进架构方案从设计到落地的全过程;2、负责系统级技术选型与架构权衡决策:针对实时性、可靠性、可扩展性等约束,在多种方案间做出有据可依的取舍,并输出架构决策记录;3、设计和优化多板卡间的进程通信、数据分发、状态管理和配置管理等平台服务架构;4、负责端到端性能分析与优化,建立量产级性能基线体系(内存/启动时间/通信延迟/故障恢复等),定义测量方法和发版质量卡口;5、使用系统级 profiling 工具(perf / ftrace / perfetto 等)定位瓶颈,设计并实施优化方案;6、输出高质量的架构设计文档,建立可供团队协作的技术参考体系;7、参与技术评审和代码 review,指导工程师成长,推动工程规范和研发体系建设。 职位要求 1、计算机科学、电子工程或相关领域本科及以上学历;2、5年以上嵌入式系统或系统软件开发经验,其中至少1年承担过系统架构师或技术负责人角色;3、有主导过复杂系统架构设计或重构的完整经历:从问题分析、方案设计、接口定义到落地实施和效果验证;4、精通 C/C++,熟练使用 Python;具备多线程/多进程、IPC、实时调度等系统编程能力;5、熟练掌握 Linux 系统级调试与性能分析工具(perf / ftrace / perfetto / valgrind / gdb 等);6、有从性能瓶颈定位到方案设计到落地验证的完整优化闭环经验;7、具备优秀的抽象建模与文档表达能力,能将复杂系统拆解为清晰的架构图和接口规范;8、具备出色的团队合作精神,拥有谦逊开放的态度,乐于持续学习;加分项: 1、有机器人操作系统(ROS/ROS2)或类似中间件框架的开发经验;2、有 DDS 或类似发布-订阅通信中间件的使用与调优经验;3、有自动驾驶或机器人领域的量产项目经验,理解量产级软件质量要求;4、有状态机设计、行为树、任务调度等机器人功能架构的实践经验;5、熟悉深度学习模型的端侧部署与推理优化(ONNX Runtime / TensorRT / NPU
Work Your Magic with us! Ready to explore, break barriers, and discover more? We know you’ve got big plans – so do we! Our colleagues across the globe love innovating with science and technology to enrich
【27届校招】全链路性能优化工程师 深圳、上海 正式 研发 - 算法 智能机器人板块 职位描述 职位描述1、主导机器人核心软件系统的架构设计与重构:评估现有系统耦合点,制定分层/模块化拆分方案,定义模块间接口契约,推进架构方案从设计到落地的全过程;2、负责系统级技术选型与架构权衡决策:针对实时性、可靠性、可扩展性等约束,在多种方案间做出有据可依的取舍,并输出架构决策记录;3、设计和优化多板卡间的进程通信、数据分发、状态管理和配置管理等平台服务架构;4、负责端到端性能分析与优化,建立量产级性能基线体系(内存/启动时间/通信延迟/故障恢复等),定义测量方法和发版质量卡口;5、使用系统级 profiling 工具(perf / ftrace / perfetto 等)定位瓶颈,设计并实施优化方案;6、输出高质量的架构设计文档,建立可供团队协作的技术参考体系;7、参与技术评审和代码 review,指导工程师成长,推动工程规范和研发体系建设。 职位要求 职位要求1、计算机科学、电子工程或相关领域本科及以上学历;2、有嵌入式系统或系统软件开发经验,其中至少1年承担过系统架构师或技术负责人角色;3、有主导过复杂系统架构设计或重构的完整经历:从问题分析、方案设计、接口定义到落地实施和效果验证;4、精通 C/C++,熟练使用 Python;具备多线程/多进程、IPC、实时调度等系统编程能力;5、熟练掌握 Linux 系统级调试与性能分析工具(perf / ftrace / perfetto / valgrind / gdb 等);6、有从性能瓶颈定位到方案设计到落地验证的完整优化闭环经验;7、具备优秀的抽象建模与文档表达能力,能将复杂系统拆解为清晰的架构图和接口规范;8、具备出色的团队合作精神,拥有谦逊开放的态度,乐于持续学习;加分项: 1、有机器人操作系统(ROS/ROS2)或类似中间件框架的开发经验;2、有 DDS 或类似发布-订阅通信中间件的使用与调优经验;3、有自动驾驶或机器人领域的量产项目经验,理解量产级软件质量要求;4、有状态机设计、行为树、任务调度等机器人功能架构的实践经验;5、熟悉深度学习模型的端侧部署与推理优化(ONNX Runtime /
SummaryWe are looking for a passionate and experienced Software Engineer to help build next- generation of Applied Machine Learning Platform at Apple China. Applied Machine Learning Platform team provides backend services and infrastructure for various Machine
AI软件测试工程师/专家 上海、杭州 全职 研发 - 电子 / 半导体 职位描述 1.AI模型与工具链测试: 负责AI全栈测试,包括但不限于:大语言模型(LLM)、计算机视觉模型(CNN/Transformer等)的精度验证、性能调优与端到端测试;NPU固件通信、算子接口、多芯片互联及算力抽象层的功能与性能测试;基于openVX compiler等编译器框架的AI工具链测试(如模型编译优化、量化部署等)2.RISC-V工具链测试: 负责RISC-V架构下Debug诊断工具(如GDB扩展、Trace工具)及编译器(LLVM/GCC定制)的测试3.设计测试方案,覆盖单元测试、集成测试、系统测试全流程, 开发自动化测试用例,验证工具链的稳定性与性能 职位要求 1.本科及以上学历,优先考虑计算机科学或者电子工程相关专业;2.熟悉深度学习模型推理流程,有CNN/Transformer/LLM等模型本地部署经验者优先;3.了解AI编译器栈(ONNX Runtime等),能验证模型编译后的精度与性能损失4.熟悉编译器原理(如LLVM/Clang/RVCC),或RISC-V Debug协议5.有嵌入式工具链测试经验(如交叉编译器、性能分析工具)者优先6.具备性能调优经验(如Profiling、瓶颈分析), 精通AI算子精度,性能等回归测试方法者优先7.有NPU/GPU等异构计算平台的测试经验者优先 投递...
Are you ready to unlock intelligence? If you don’t think you meet all of the criteria below but are still interested in the job, please apply. Nobody checks every box - we’re looking for candidates that
By clicking the “Apply” button, I understand that my employment application process with Takeda will commence and that the information I provide in my application will be processed in line with Takeda’s Privacy Notice and Terms
Typical Accountabilities Design and lead strategic, technical and scientific activities of fit-for-purpose translational medicine studies in support of non-oncology programs. Design and deliver translational medicine strategies including mechanism of action, prognostic and predictive biomarkers, pharmacodynamics, patient
Minimum qualifications: Bachelors degree in Computer Science, Mathematics, a related technical field, or equivalent practical experience. 10 years of experience with cloud native architecture in a customer-facing or support role. Experience in developing and deploying models
具身大模型训练框架工程师-觅蜂子公司 上海 校招 正式 技术族 - 算法类 职位 ID:A83406 职位描述 可以选择以下一个或多个方向深入参与:建设具身智能统一训练框架,支撑 VLA、世界模型、分层决策模型等具身基础模型的预训练与后训练,覆盖从十亿级到百亿 / 千亿级参数规模,并面向 300B+ 模型持续演进。建设大规模分布式训练系统,包括数据并行、张量并行、流水线并行、混合并行、MoE、长上下文、低精度训练与推理等,支撑万卡 GPU 集群上的稳定训练。建设规模化后训练与强化学习系统,涵盖模仿学习、在线 / 离线 RL、真机 RL,以及云端训练 + 边缘异步 rollout 的云边协同架构。建设训练效率优化体系,围绕数据、计算、异步、通信全链路进行度量与优化,包括 IO、算子融合、CUDA Graph、计算通信 overlap、梯度同步、性能 profiling 等。与算法团队协作,快速复现并工程化落地 VLA、世界模型、flow matching、RL 等前沿算法。 职位要求 计算机基础扎实,学习能力强,愿意深入复杂系统和底层细节。代码能力强,代码品味好,能熟练使用 AI
仿真引擎开发工程师 (Unreal Engine/C++) 上海 正式 软件类 职位描述 1. 深度物理引擎集成与仿真架构 (核心攻坚)负责 Unreal Engine 与 外部高精度物理动力学解算器(非 UE 自带 Chaos/PhysX)的底层集成与数据通信。实现渲染线程与物理线程的精准同步,解决刚体动力学、关节约束(Joints/Constraints)及摩擦力模型在仿真环境中的数值稳定性问题。构建确定性(Deterministic)的仿真步长机制,确保仿真结果的可复现性,对齐现实世界的物理参数。2. 传感器仿真与 Ground Truth 生成基于 Unreal 渲染管线开发高保真的传感器模型(RGB Camera, LiDAR, Depth Camera, IMU)。编写自定义 Shader 和 Render Pass,实现语义分割、深度图、光流等 Ground Truth 数据的实时渲染与导出。解决仿真中的传感器噪声模型(Noise Model)与畸变模拟,缩小