Research Engineer - LLM/VLM Inference Optimization (Seed Infra)
负责字节跳动 AI 基础模型的高性能推理系统设计与优化,通过编译优化、CUDA 算子开发及分布式推理技术,提升大模型(LLM/VLM)在生产环境中的吞吐量并降低延迟。
美国
还有完整任职要求、杰联解读与匹配提示,登录后可见。
登录后查看完整详情与岗位匹配
免费版可查看 5 个完整机会详情;还没有职业档案时,可直接上传简历获得匹配提示。登录后会自动回到当前岗位。
免费登录 / 注册,继续查看并匹配未经你同意,我们不会把你的信息发送给企业。