【人形机器人】Linux实时微内核/Kernel工程师 北京 全职 智能制造 / 工业互联网 / 工业自动化 - 研发 职位描述 1. 负责实时微内核(例如Xenomai),在地平线、英伟达 Jetson 异构多核平台上的移植、裁剪与定制开发,面向机器人实时控制场景设计微内核运行环境。2. 负责实时核与 Linux 主核之间的 AMP 异构协同架构设计,定义双核间通信机制(RPMsg/共享内存/Mailbox),保障实时任务与非实时任务的可靠协同运行。3. 负责实时操作系统任务调度策略设计,包括任务优先级规划、实时任务与中断的时序设计、任务间通信(IPC/消息队列/信号量/事件组)机制的实现与优化。4. 负责 Linux 侧 PREEMPT-RT 实时补丁的集成、调优与验证,对系统中断延迟、调度抖动进行系统性测量、分析与优化,建立实时性基线指标体系。5. 负责 CPU 隔离(isolcpus)、内存锁定(mlockall)、中断亲和性绑定、NUMA 优化等实时性增强配置,保障关键控制周期的确定性响应。6. 负责基于 cyclictest、ftrace、perf、oscilloscope 等工具的实时性测试与验证,输出实时性测试报告与优化方案文档。7. 负责内核崩溃分析(kdump/kexec/coredump)与系统看门狗配置,保障系统运行稳定性与故障可追溯性。 职位要求 1. 计算机、电子、自动化、控制工程等相关专业,本科及以上学历。2.
Are you fascinated by the chance to make a real impact on millions of Ubuntu users? We are looking for a passionate Linux kernel engineer to join our team and help us bring Ubuntu to the next
Were looking for outstanding AI systems software engineers to develop groundbreaking technologies across the inference systems software stack. Our team builds core AI systems software that accelerates high-impact workloads on NVIDIA GPUs, from deep learning primitives
NVIDIA is seeking Software Performance Architects to optimize GPU kernel performance for state-of-the-art data-center platforms. We build automated, data-driven workflows to detect, explain, and prevent performance regressions across key deep learning workloads, partnering closely with kernel developers, compiler
高性能计算工程师-Genie业务部 北京、上海 校招 正式 技术族 - 算法类 职位 ID:A200131 职位描述 负责 HPC 核心算法设计开发,优化 CPU/GPU/ASIC 多芯片性能,追求极致吞吐量与延迟;对接业务场景,定位并解决计算性能瓶颈,提升业务运行效率;参与异构计算集群的构建,推进异构计算方案落地与迭代。 职位要求 有高性能计算(HPC)或 AI 优化加速相关工作经验;精通 CUDA 生态,熟悉编译流程,深入理解 GPU 架构、内存模型及并行计算原理,具备扎实的 CUDA 编程功底,能独立编写、调试并优化 CUDA Kernel;熟练使用 Triton、CUTLASS 等工具,有基于这些工具进行算子开发、模型加速的实战经验;理解 PyTorch/TensorFlow 等 AI 框架及常见 AI 模型(VLA, LLM等);熟悉Nsys, NCU
Role Summary We are seeking an experienced Assistant Vice President (AVP) Software Engineering Lead to join the COMPASS transformation program. The successful candidate will lead the design, development, and modernization of business-critical applications supporting Shareholder Services
固件开发专家 上海、杭州 全职 互联网 / 电子 / 网游 职位描述 岗位职责1. 主导 AI 芯片运行时(Runtime/Fireware)、驱动(Driver)及基础库(Lib)的设计与优化,构建高效的异构计算框架。2. 开发调试工具(Debugger)、性能分析工具(Profiler)及自动化测试框架,支撑芯片量产交付。3.Pre-silicon阶段协同架构/DV/CV团队建立验证基础设施,支持C-Model/Simulation/Emulation平台算子开发4.Post-silicon阶段NPU Bringup;职位要求:1.计算机相关专业,5年以上工作经验,3年以上芯片Firmware开发、调试和测试经验;2.熟悉ARM/RISC-V架构,熟悉NEON/RVV向量指令优化,熟悉汇编,驱动开发3.有NPU Firmware/Runtime 开发和量产交付经验优先;4.熟悉linux kernel内存管理/进程管理/系统调用等核心机制,具备os开发相关经验者优先。5. 具备复杂问题拆解能力,能独立制定技术方案并推动跨团队协作。 职位要求 - 投递...
自研 NPU 芯片运行时高级开发工程师 上海 全职 互联网 / 电子 / 网游 职位描述 1. 主导 AI 芯片运行时(Runtime/Fireware)、驱动(Driver)及基础库(Lib)的设计与优化,构建高效的异构计算框架。2. 开发调试工具(Debugger)、性能分析工具(Profiler)及自动化测试框架,支撑芯片量产交付。3.Pre-silicon阶段协同架构/DV/CV团队建立验证基础设施,支持C-Model/Simulation/Emulation平台算子开发4.Post-silicon阶段NPU Bringup; 职位要求 1.计算机相关专业,5年以上工作经验,3年以上芯片Firmware开发、调试和测试经验;2.熟悉ARM/RISC-V架构,熟悉NEON/RVV向量指令优化,熟悉汇编,驱动开发3.有NPU Firmware/Runtime 开发和量产交付经验优先;4.熟悉linux kernel内存管理/进程管理/系统调用等核心机制,具备os开发相关经验者优先。5. 具备复杂问题拆解能力,能独立制定技术方案并推动跨团队协作。 投递...
具身大模型部署与优化实习生 深圳 实习 互联网 / 电子 / 网游 职位描述 负责将大语言模型、多模态模型和具身智能模型高效部署到机器人端侧芯片和云端,实现低延迟实时推理。1、负责VLA(操作模型)等大模型在自研芯片上的端侧部署,完成模型量化(INT8/INT4/FP8)、图优化和推理加速;2、设计和优化模型推理服务(基于 vLLM/TensorRT-LLM),支撑 VLA 推理的低延迟需求;3、建立模型部署的标准化流程:模型转换→量化→性能基准测试→端侧验证→上线发布;4、模型优化,参与大模型的量化部署工作,探索模型在嵌入式端侧的高效运行;5、与算法团队协作,从模型设计阶段介入,提供部署可行性评估和性能预估。6、实验验证: 协助将算法部署至真实人形机器人平台,进行效果调试与性能评估。 职位要求 1、计算机、人工智能、自动化、机器人等相关专业在读硕士、博士、优秀本科生;2、 具备扎实的深度学习基础,熟悉 Transformer 架构,对 VLA 等主流模型有深入理解;3、熟悉 C++/Python,具备良好的代码风格和算法实现能力;4、有以下至少一项经验:-模型量化(PTQ/QAT/混合精度)与精度-速度 trade-off 调优;-CUDA 编程与 GPU kernel 优化;-嵌入式 NPU 部署(高通/联发科/NVIDIA Orin);-熟悉至少一种推理框架:TensorRT / ONNX Runtime / vLLM /
About A1 There are over 5 billion users using basic applications today such email, notes, tasks that are not AI-native. Our mission is to build a proactive smart assistant for everyday users to bring intelligence to
【27届校招】算法工程师(C++方向)-杭州 杭州 正式 技术类 2027届秋季校园招聘项目 职位描述 1、负责参与得物搜推引擎系统、特征存储和服务系统、预估推理框架、AI训练框架和机器学习平台的研发,重点研发搜推引擎、GPU分布式训练系统、预估服务系统、AI推理框架,支持搜广推生成式召回, 大模型探索等前沿工程挑战方向.2、深度参与性能优化, 对业界搜推工程链路所需 GPU训练和推理性能优化,自定义GPU算子的cuda kernel开发和优化, 打造性能卓越的搜广推工程基建.3、参与特征平台、索引平台、模型训练,模型服务等重要方向的研发,提升平台的效率和易用性,加速得物算法团队的模型迭代效率.4、深度参与AI 建设(如AI搜索, AI推荐等方向), 利用AI 解决和提效当前链路, 打造AI时代下搜推广工程链路. 职位要求 1、2027届毕业生,本科及以上学历,基础扎实, 精通数据结构/算法,操作系统,网络通信等核心理论知识;2 、有较好的AI 兴趣, 对业界大模型, Agent 编排, AI Loop, AI Harness 等Agent 框架和AI工程有不错理解和使用, 学习意愿.3 、有较强的动手能力,具备优秀的编码能力,熟练掌握C/C++编程语言,ACM参赛者优先,有搜推引擎和深度学习框架开发的优先.4、有较好的逻辑思考能力, 快速识别关键问题, 清晰描述问题和沟通解决方案, 有一个或者多个技术点深入思考者优先;5、有较好的主动性,开放心态,能大胆,主动问问题,思考问题,大胆提出自己的想法和建议,开源社区积极参与者或者活跃者优先; 投递...
【27届校招】嵌入式软件工程师 上海 正式 研发 - 电子 / 半导体 职位描述 1.负责嵌入式平台的方案设计、开发、调试、验证以及维护。2.基于仿真平台、FPGA验证平台,完成操作系统移植、SOC底层驱动软件开发。3.负责Bootloader、Linux内核的驱动开发、调试与优化工作。 职位要求 1. 方向要求,熟悉以下任一方向即可:1)以太网驱动:Ethernet驱动开发与验证;2)高速方向:高速接口(PCIe)。2.熟悉Linux内核驱动开发框架,有较好的Linux基础,熟悉makefile,熟悉常用的Linux kernel调试工具。3.熟悉ARM Cortex-A/R/M架构,具备芯片bringup、移植经验者优先。4.熟练使用示波器等硬件工具分析定位问题。5.具备芯片验证和驱动开发经验者优先。6.有参与开源软件硬件项目,具备良好的团队合作能力,沟通能力和学习能力。 投递...
【27届校招】AI软件工程师 上海 正式 研发 - 电子 / 半导体 职位描述 1. 高性能计算核心开发:针对自研芯片架构,设计、开发并优化高性能的CUDA及DSP算子,以支撑大模型推理、实时图像处理等关键业务。2. AI系统集成与验证:负责自研芯片上AI加速器系统的集成与验证,并搭建与完善算子自动化测试验证平台,确保代码的工程化质量与高效落地。3. 嵌入式与算法软件交付:参与高实时性、高算力的嵌入式软件平台与通用机器人操作系统的设计与交付。 4. 前沿算法探索与实现:参与自动驾驶/机器人算法(如识别、规划、导航、多模态大模型等)的设计、交付与优化。 5. 全栈生态建设:深度参与从芯片需求到架构设计的转换,并为建设高性能计算软件栈的生态做出贡献。 职位要求 1. 硕士及以上学历,计算机、电子、软件、通信、自动化、数学等相关专业。2. 精通 C/C++ 与 Python,熟悉Linux开发环境,掌握gprof/perf等性能剖析工具,具备扎实的数据结构与算法基础和良好的软件工程习惯。 3. 具备极强的学习能力、良好的沟通协调能力和团队合作精神。4. 核心技术要求 (满足以下至少一项): * 高性能计算:理解GPU架构(如SM/Tensor Core/Memory Hierarchy)及CUDA编程模型(Kernel/Thread Hierarchy/Stream),了解并行计算、缓存优化、向量化指令集(AVX/NEON)等知识。* 深度学习工程化:熟悉深度学习模型从训练到部署的全流程,对CUDA、PyTorch/TensorFlow、ONNX Runtime以及Transformer、VLM等流行模型架构有一定了解。 * 底层系统软件:对CPU体系结构、操作系统原理、Linux驱动和应用有较深入的理解。加分项
【2027 届校招】机器人嵌入式开发工程师 北京 正式 互联网 / 电子 / 网游 - 研发 【千寻智能2027届秋季校园招聘】 职位描述 1. 底层核心开发实战:参与机器人/数采设备嵌入式底层软件开发、系统配置、功能集成,负责MCU/Linux底层基础功能、音视频、设备控制模块迭代。2. 外设驱动从零调试:独立参与 GPIO、SPI、I2C、CAN、ADC、PWM、DMA、Flash 等芯片外设驱动开发、配置与功能验证,积累扎实的底层驱动落地经验。3. 软硬件联合联调:配合硬件、应用团队完成底层接口联调,精准定位软硬件耦合Bug,迭代优化系统稳定性与实时性。4. 设备智能化功能开发:参与设备云端对接、设备状态管理、远程控制、整机OTA升级等核心功能开发,掌握智能设备云端一体化架构。5. 技术沉淀与规范搭建:梳理底层开发文档、驱动适配规范、问题复盘清单,助力团队软件标准化、模块化建设。 职位要求 1. C语言功底扎实,熟练掌握指针、结构体、位操作、内存管理、回调机制等底层核心编程思想,代码风格规范。2. 熟悉嵌入式开发流程,熟练使用 Keil / GCC 交叉编译等开发工具链,具备独立编译、烧录、调试能力。3. 了解 UART、I2C、SPI、CAN、以太网等至少一种通信总线原理,具备底层通信调试认知。4. 优先加分项:有 STM32、RK 平台实际项目开发经验;有 RTOS、Linux Kernel、设备驱动移植、内核调试经验;熟练使用AI辅助开发(SPEC Coding、Skill、Agent工具),高效落地编码调试;参与过电赛、智能车、机器人竞赛、嵌入式科创项目者。
低精度量化/模型压缩算法工程师 上海 校招 正式 技术族 - 算法类 职位 ID:A39276 职位描述 1. 负责大模型、多模态模型、具身智能模型的低精度量化、模型压缩、蒸馏、剪枝、稀疏化算法研发与落地。2. 研究并实现 INT4/NVFP4/INT8/FP8 等量化方案:GPTQ、AWQ、SmoothQuant、GPTQ-For-LLaMA、bitsandbytes 等。3. 负责模型压缩算法在训练、推理、端边、云端不同场景的精度保持与性能收益。4. 与推理引擎、算子团队协同,将量化 / 压缩算法对接 TensorRT-LLM、vLLM、ONNX Runtime、NPU/GPU等硬件与推理栈。5. 构建自动化量化工具链、精度评估体系、压缩后模型稳定性验证流程。6. 针对机器人端侧(Jetson//Thor/Orin/NPU)等资源受限场景,实现极小内存、极低功耗下的模型部署。7. 输出算法方案、实验报告、性能 / 精度对比,支撑业务规模化降本增效。 职位要求 1. 硕士及以上,计算机/人工智能/电子/数学相关,2年以上模型量化或压缩经验。2. 精通深度学习模型结构:Transformer、Attention、FFN、Norm、激活函数。3. 熟悉主流量化算法:PTQ、QAT、GPTQ、AWQ、SmoothQuant、LLM.int8 ()、FP8 量化。4. 熟悉模型压缩技术:剪枝、知识蒸馏、动态稀疏、低秩分解(LoRA/QLoRA)。5. 熟练使用
优才-低精度量化/模型压缩算法工程师 上海 校招 正式 技术族 - 算法类 职位 ID:A43922 职位描述 1. 负责大模型、多模态模型、具身智能模型的低精度量化、模型压缩、蒸馏、剪枝、稀疏化算法研发与落地。2. 研究并实现 INT4/NVFP4/INT8/FP8 等量化方案:GPTQ、AWQ、SmoothQuant、GPTQ-For-LLaMA、bitsandbytes 等。3. 负责模型压缩算法在训练、推理、端边、云端不同场景的精度保持与性能收益。4. 与推理引擎、算子团队协同,将量化 / 压缩算法对接 TensorRT-LLM、vLLM、ONNX Runtime、NPU/GPU等硬件与推理栈。5. 构建自动化量化工具链、精度评估体系、压缩后模型稳定性验证流程。6. 针对机器人端侧(Jetson//Thor/Orin/NPU)等资源受限场景,实现极小内存、极低功耗下的模型部署。7. 输出算法方案、实验报告、性能 / 精度对比,支撑业务规模化降本增效。 职位要求 1. 硕士及以上,计算机/人工智能/电子/数学相关,2年以上模型量化或压缩经验。2. 精通深度学习模型结构:Transformer、Attention、FFN、Norm、激活函数。3. 熟悉主流量化算法:PTQ、QAT、GPTQ、AWQ、SmoothQuant、LLM.int8 ()、FP8 量化。4. 熟悉模型压缩技术:剪枝、知识蒸馏、动态稀疏、低秩分解(LoRA/QLoRA)。5. 熟练使用
At Sonos we want to create the ultimate listening experience for our customers and know that it starts by listening to each other. As part of the Sonos team, you’ll collaborate with people of all styles,
大模型算法工程Co-Design-2028届实习 北京、上海 校招 实习 研发 - 算法 2028届实习生招聘 职位描述 寻找深度理解大模型算法,同时具备顶尖系统工程设计能力的专家。你将作为算法研究与工程落地的核心桥梁,主导优化大模型训练/推理效率、性能与成本,确保前沿算法在大规模系统中高效实现。1. 协同设计与优化: - 深入理解大模型算法(架构、训练/推理技术),评估其工程可行性、性能瓶颈与成本。 - 主导设计下一代训练/推理框架或核心组件,确保原生支持高效算法实现(如高效Attention、通信优化)。 - 系统性解决训练/推理工作负载的性能瓶颈(计算、通信、存储)。2. 高性能系统实现: - 设计并实现高性能核心(如定制Kernel)、优化通信与数据流水线。3. 分布式架构: - 设计构建大规模分布式训练系统(DeepSpeed/Megatron-LM/FSDP)。 - 设计构建高并发、低延迟的大模型推理服务平台。4. 前瞻探索与协作: - 跟踪领域前沿,探索验证新技术(新硬件、非Transformer架构等)。 - 高效沟通,跨团队(算法、工程、平台)协作推动方案落地。 职位要求 1. 学历/经验: 计算机/人工智能等相关领域本科及以上,或具备同等杰出实践经验。2. 大模型基础: 深刻理解Transformer架构及大模型训练/推理等相关核心技术。3. 工程硬实力:
Join our Team About this opportunity: We are looking for a highly motivated AI Agent Engineer Intern to join our AI and Innovation team. You will work on designing, developing, and evaluating AI agents powered by
SummaryImagine what you could do here. At Apple, new ideas have a way of becoming extraordinary products, services, and customer experiences very quickly. We are looking for great Systems Reliability Engineers to design, build and operate