多模态大模型优化工程师-Data AML(北京/上海/杭州/深圳)
面议
1、深度参与对字节跳动自研模型Seedance/Seedream/Seed-VLM,以及开源LLM/VLM模型的软硬件协同优化和算法优化,构建业界领先的模型优化能力矩阵;
2、研发面向多端异构平台的量化&稀疏,MOE压缩,Token压缩,Cache复用,投机解码,KV Cache压缩等加速算法,构建Training-Free或结合Post-training/RL-Training的加速算法矩阵;
3、面向分布式训练/推理场景,深度挖掘模型表示位宽/分辨率/步数/结构等维度的冗余,并加速训练和推理过程,通过算法和工程创新实现降本增效;
4、探索Efficient AIGC,Efficient LLM领域的问题,结合具体应用场...